SSD Nodes Learn Hosting plans →
Руководства Matt ConnorАвтор: Matt Connor · Обновлено 2026-08-13

Сравнение цен API Claude и ChatGPT: что выгоднее

Узнайте, как рассчитывается стоимость токенов для Claude и ChatGPT. Мы разобрали три реальных сценария нагрузки, чтобы показать, в каких случаях Claude обходится дороже OpenAI.

Краткий ответ

В сравнении цен на API Claude и ChatGPT нет однозначного лидера, так как оба поставщика устанавливают разные тарифы на входные и выходные токены для каждого уровня. По состоянию на август 2026 года два верхних уровня Claude стоят столько же за входной токен, сколько аналогичные модели OpenAI, но дешевле за выходной токен, поэтому Claude оказывается немного выгоднее при выполнении задач с большим объемом вывода. На начальном уровне Claude стоит в несколько раз дороже за ту же работу. Любой ответ, в котором не указаны конкретный уровень и соотношение токенов, является лишь предположением.

Поэтому на этой странице сначала приведены расчеты, затем три примера рабочих нагрузок с их соотношением токенов, а после — коэффициенты, которые влияют на итоговый счет сильнее, чем базовые тарифы.

Единственная необходимая формула

Оба API тарифицируют текст одинаково. Вы платите за токены, которые отправляете, и по более высокому тарифу за токены, которые модель генерирует в ответ.

cost = (input tokens / 1,000,000) * input rate + (output tokens / 1,000,000) * output rate

Один токен — это примерно 4 символа английского текста или около 0,75 слова. Используйте это значение только для предварительной оценки. Для точного расчета стоимости используйте значения, которые каждый API возвращает в объекте usage в составе каждого ответа.

# Rates are US dollars per million tokens.
def cost(in_tok, out_tok, in_rate, out_rate):
    return in_tok / 1e6 * in_rate + out_tok / 1e6 * out_rate

# One support-chat turn: 1,400 tokens in, 220 tokens out, on a $2 / $10 model.
print(round(cost(1400, 220, 2.0, 10.0), 6))

Скрипт выводит 0.005, что составляет полцента за один оборот диалога. Умножьте это число на количество ожидаемых оборотов в месяц, чтобы получить бюджет. Если единица измерения «миллион токенов» кажется абстрактной, что на самом деле можно получить за миллион токенов в Claude поможет представить конкретный объем текста. Освойте эту формулу, и любое изменение цен в будущем потребует лишь правки одной строки вместо проведения нового анализа.

Опубликованные тарифы, август 2026

Это прейскурантные цены, опубликованные обоими вендорами 1 августа 2026 года. Этот блок — единственное место в статье, где указаны цены. Сверьте их с claude.com/pricing и страницей цен OpenAI перед утверждением бюджета.

ChartList prices in US dollars per million tokens, August 2026
The data behind this chart
[
  {
    "label": "Frontier",
    "claude_input": 5,
    "claude_output": 25,
    "openai_input": 5,
    "openai_output": 30
  },
  {
    "label": "Workhorse",
    "claude_input": 2,
    "claude_output": 10,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Workhorse from September",
    "claude_input": 3,
    "claude_output": 15,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Small",
    "claude_input": 1,
    "claude_output": 5,
    "openai_input": 0.2,
    "openai_output": 1.2
  }
]

Пары составлены по позициям в линейке, а не по популярности. Frontier — это Claude Opus 5 против gpt-5.6-sol. Workhorse — это Claude Sonnet 5 против gpt-5.6-terra. Small — это Claude Haiku 4.5 против gpt-5.6-luna. Оба вендора также предлагают более высокие уровни обслуживания, а OpenAI сохраняет старые поколения по их исходным тарифам. У Claude этот уровень представлен Fable 5, цена которого вдвое выше уровня frontier по обоим показателям при сохранении того же соотношения выходных данных пять к одному, поэтому сколько стоит Fable 5 и когда применяется этот тариф стоит прочитать, прежде чем считать Opus 5 самым дорогим пунктом в счете. Сравнение флагмана одной компании с бюджетной моделью другой дает бессмысленные цифры, что и является основой большинства опубликованных сравнений для привлечения внимания.

Две вещи в этом блоке требуют особого упоминания. 2 и 10 для Sonnet 5 являются вводными тарифами, и Anthropic указывает, что они действуют до 31 августа 2026 года, после чего стоимость Sonnet 5 составит 3 и 15. Это изменение превращает уровень workhorse из небольшого преимущества Claude в явную победу OpenAI, и оно произойдет в период актуальности этой статьи.

Второе — это закономерность, которую стоит запомнить: Claude оценивает выходные данные ровно в 5 раз дороже собственных входных данных во всех приведенных выше строках, а OpenAI — в 6 раз. Именно это соотношение, а не абсолютная ставка, определяет, кто из вендоров будет выгоднее при вашем соотношении токенов.

Почему стоимость за миллион токенов нельзя сравнивать напрямую у разных поставщиков

Тариф — это количество долларов за токен. Счет — это стоимость за токен, умноженная на количество токенов. При этом количество токенов для одного и того же текста зависит от модели, а не от самого текста.

Компания Anthropic прямо указывает на это: модели Claude 4.7 и более поздние, включая Claude Opus 5 и Claude Sonnet 5, используют новый токенизатор. Он генерирует примерно на 30% больше токенов для того же текста, чем Claude Sonnet 4.6 и более ранние версии. Тариф не изменился, а сумма в счете — да.

Таким образом, два одинаковых на вид тарифа не означают одинаковые счета. Прежде чем доверять любому сравнению, включая это, подсчитайте количество токенов для обоих вариантов на ваших собственных текстах.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "messages": [{"role": "user", "content": "Summarise the attached contract."}]
  }'

Корректный ответ представляет собой небольшой JSON-объект, содержащий input_tokens. Ошибка 401 означает, что переменная ключа в вашей оболочке не задана. Пропустите один и тот же текст через токенизатор другого поставщика, разделите одно количество на другое, а затем умножьте полученный коэффициент на опубликованный тариф перед сравнением. Если коэффициент в пользу одного из поставщиков превышает примерно 1.2, это перевешивает любую разницу в тарифах, указанную в блоке выше.

Сценарий первый: функция чата

Чат поддержки внутри веб-приложения. 120,000 обращений в месяц. Каждое обращение отправляет системный промпт, схемы инструментов, два извлеченных фрагмента из базы знаний и несколько предыдущих сообщений — около 1,400 входных токенов; модель отвечает примерно 220 токенами. Это интерактивный процесс, поэтому пакетные скидки здесь неприменимы. Используйте уровень производительности workhorse.

ChartChat feature, monthly cost in US dollars, 120,000 turns
The data behind this chart
[
  {
    "label": "List price",
    "claude_usd": "600.00",
    "openai_usd": "652.80"
  },
  {
    "label": "Cached prefix",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Small tier, cached",
    "claude_usd": "213.60",
    "openai_usd": "48.00"
  }
]

По прейскуранту Claude обходится в 600.00, а OpenAI — в 652.80. Стоимость входных данных идентична, так как тарифы на ввод одинаковы. Вся разница приходится на выходные данные, и преимущество Claude здесь слишком мало, чтобы выбирать поставщика на его основе.

Теперь пометим 800 из этих 1,400 входных токенов как стабильный префикс: это системный промпт и схемы инструментов, которые не меняются между обращениями. Оба поставщика взимают 10% от базового тарифа на ввод при попадании в кэш. Счет Claude снижается до 427.20, а OpenAI — до 480.00. Кэширование важнее выбора поставщика, и обе платформы его поддерживают.

Здесь Claude проигрывает. Большинству ответов службы поддержки не требуется модель уровня workhorse. Перенесите тот же трафик на уровень small, и Claude выставит счет на 213.60, в то время как OpenAI — на 48.00. Если разделить эти показатели, Claude стоит примерно в четыре с половиной раза дороже за ту же работу. Claude Haiku 4.5 взимает 1 за миллион входных токенов против 0.2 у gpt-5.6-luna, и никакое кэширование не покроет пятикратный разрыв. Если ваша рабочая нагрузка подходит для небольшой модели, OpenAI дешевле, и разница в цене существенна.

Сценарий два: конвейер обработки длинных документов

25,000 контрактов в месяц. Каждый запрос содержит одну и ту же инструкцию и JSON-схему объёмом 9,000 токенов, затем 12,000 токенов текста контракта, а модель возвращает около 700 токенов структурированных полей. Вывод составляет менее 4% от общего количества токенов в этой задаче, и именно этот факт определяет результат сравнения.

ChartMonthly cost in US dollars, three workloads, cached and paired like-for-like
The data behind this chart
[
  {
    "label": "Chat feature",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Document pipeline",
    "claude_usd": "820.00",
    "openai_usd": "855.00"
  },
  {
    "label": "Coding agent",
    "claude_usd": "116.10",
    "openai_usd": "124.20"
  }
]

При кэшировании префикса в 9,000 токенов на обеих сторонах, Claude выставляет счёт на 820.00, а OpenAI — на 855.00. Стоимость входных данных совпадает до цента, так как основные тарифы на ввод в августе 2026 года идентичны. Вся разница заключается в стоимости вывода, которая у Claude в 5 раз выше стоимости ввода, а у OpenAI — в 6 раз.

Эта задача также поддерживает пакетную обработку (batching). Оба поставщика предоставляют скидку 50% на ввод и вывод при асинхронной работе, поэтому оба итоговых значения уменьшаются вдвое, а разрыв сохраняется. Пакетная обработка — это самая значительная скидка на обеих платформах, и ночной конвейер обработки документов всегда может её использовать.

Там, где Claude проигрывает, действует та же логика уровней, что и ранее. Извлечение полей по фиксированной схеме — это именно та работа, с которой хорошо справляется небольшая модель, а ввод составляет 97% токенов в данном случае. Переход на уровень ниже умножает тариф на ввод OpenAI на 0.1, а тариф на ввод Claude — на 0.5. Протестируйте небольшую модель на 200 документах, прежде чем делать вывод о необходимости использования более мощной модели, применяя ту же оценку, которую вы бы использовали для выбора подходящего уровня Claude для задачи.

Сценарий три: постоянно работающий агент для написания кода

Один разработчик запускает агента на VPS, совершая примерно 900 обращений к модели в месяц. Каждое обращение содержит около 60 000 входных токенов контекста репозитория, из которых 80% приходится на попадание в кэш, и генерирует около 1 800 токенов правок и пояснений. Рассчитаем стоимость для передового уровня (frontier tier), так как в программировании разрыв в возможностях напрямую влияет на финансовые потери.

Claude обходится в 116.10 против 124.20 у OpenAI. При одинаковой частоте входных данных и одинаковой доле чтений из кэша, более низкая стоимость генерации у Claude дает преимущество примерно в 7%.

Эти 7% находятся в пределах погрешности токенизатора, упомянутой ранее, поэтому данный сценарий следует рассматривать как равенство по тарифам. Что не является равенством, так это модель биллинга. Для одного разработчика при таком объеме подписка обычно обходится дешевле, чем оплата по факту использования API, и все сравнение меняется, как только вы добавляете подписку. Проработайте этот момент с помощью сравнения стоимости API и подписки, прежде чем переводить агента на оплату по факту использования. Если вы все же решите использовать тарификацию по токенам, сначала изучите, на что они расходуются, поскольку потребление токенов агентом для написания кода определяется контекстом, который повторно отправляется при каждом обращении, а не самим написанным кодом.

Множители, определяющие размер счета

Базовая ставка — это лишь малая часть итоговой суммы. Каждый из перечисленных ниже факторов влияет на реальный счет сильнее, чем разница в тарифах между двумя поставщиками на одном уровне.

Кэширование входных данных. Оба поставщика взимают 10% от стоимости базового ввода за попадание в кэш (cache hit). Anthropic также берет плату за запись в кэш: 1.25 от стоимости базового ввода для записи с пятиминутным сроком хранения и 2 стоимости для записи с часовым сроком. Последующее обращение обновляет запись по цене чтения. Таким образом, пятиминутная запись окупается после первого же чтения. При рабочей нагрузке с большими паузами между запросами запись происходит чаще, чем чтение, поэтому кэширование в таких случаях обходится дороже, чем экономит. Стабильный трафик хорошо кэшируется. Импульсный трафик — нет.

Скидки на пакетную обработку (Batch discounts). Скидка 50% на ввод и вывод у обоих поставщиков, только для асинхронных задач. Если задачу можно отложить, это сокращает счет у любого поставщика вдвое, причем скидка суммируется с кэшированием.

Доля вывода. Claude взимает за вывод сумму, в 5 раз превышающую ставку за ввод. OpenAI взимает 6-кратную ставку. Чем больше ваших токенов записывается, а не считывается, тем выгоднее выглядит Claude при равной ставке за ввод; для задач, где преобладает ввод, ситуация обратная.

Повторные попытки (Retries). Повторная попытка означает повторную оплату всего объема входных данных без получения полезного результата. Если 6% ваших вызовов не проходят валидацию схемы и требуют повтора, объем ваших входных данных на 6% больше, чем предполагалось в плане. Учитывайте повторные попытки как статью расходов, а не как ошибку. Команды обнаруживают этот множитель в последнюю очередь, хотя зачастую он превышает разницу в ценах поставщиков, из-за которой велись недельные споры.

Кто проигрывает и где

Claude полностью проигрывает в сегменте начального уровня. gpt-5.6-luna стоит 0.2 за миллион входных токенов против Claude Haiku 4.5 с ценой 1, при стоимости выходных токенов 1.2 против 5. Высокообъемная классификация и извлечение коротких данных обходятся в Claude примерно в четыре раза дороже.

Claude проигрывает в сегменте рабочих моделей с 1 сентября 2026 года, когда заканчивается действие вводного тарифа и Sonnet 5 переходит на 3 и 15 против неизменной gpt-5.6-terra. Claude выигрывает в сегменте передовых моделей по стоимости выходных токенов, однако этот отрыв может быть нивелирован вашими собственными показателями использования токенов. Ни одна из сторон не выигрывает в задачах с преобладанием входных данных в августе 2026 года, так как при цене 2 за миллион токенов для обеих сторон стоимость входных данных оказывается одинаковой.

Как измерить это на собственном трафике

Считывайте объект usage в каждом ответе и сохраняйте четыре значения для каждого запроса: количество входных токенов, выходных токенов, токенов чтения из кэша и токенов записи в кэш. В API Claude они приходят как input_tokens, output_tokens, cache_read_input_tokens и cache_creation_input_tokens. Суммируйте их за день, умножайте на текущие тарифы и сравнивайте полученную сумму со счетом. Разница между ними обычно возникает из-за повторных попыток или участка кода, о котором вы забыли при выпуске релиза.

Проводите сравнение на данных за неделю реального трафика, а не на тестовом промпте, и сравнивайте стоимость выполнения одной задачи, а не стоимость одного токена. Модель, которая отвечает с первой попытки по двойному тарифу, обходится дешевле, чем модель, которой требуется три попытки по половинному тарифу. Стоимость токена — это тариф. Стоимость выполненной задачи — это ваш счет.

Установите жесткий лимит расходов, прежде чем оставлять что-либо запущенным. Обе платформы позволяют задать лимиты затрат в консоли управления, а агент, застрявший в цикле повторных попыток, может за одну ночь потратить бюджет, рассчитанный на месяц. Настройте это так, как описано в разделе контроль расходов для постоянно работающего агента. Если вы создаете первую версию на собственном сервере, в руководстве первое приложение на Claude API на VPS описаны принципы работы с ключами и цикл запросов, на котором базируются эти расчеты.

FAQ

Дешевле ли Claude API, чем ChatGPT API?

Не всегда. В августе 2026 года тарифы на входные токены (input tokens) в топовых и стандартных моделях обоих провайдеров одинаковы. Claude берет меньше за выходной токен (output token), поэтому при задачах с большим объемом вывода Claude выходит на несколько процентов дешевле. В бюджетном сегменте модель gpt-5.6-luna от OpenAI стоит в пять раз меньше, чем Claude Haiku 4.5 за входной токен, поэтому высоконагруженная классификация данных значительно выгоднее на OpenAI. Рассчитайте стоимость для своей задачи самостоятельно, так как при такой небольшой разнице в цене итоговая выгода зависит от структуры вашего рабочего процесса, а не от прайс-листа.

Почему одни и те же слова стоят разное количество токенов в разных API?

Потому что у каждой модели свой токенизатор, а количество токенов — это характеристика конкретной модели. Anthropic указывает, что модели Claude 4.7 и более новые генерируют примерно на 30% больше токенов для того же текста, чем Claude Sonnet 4.6 и предыдущие версии. Отправьте свой текст в эндпоинт для подсчета токенов каждого вендора, разделите один результат на другой, а затем умножьте полученный коэффициент на опубликованный тариф перед сравнением. Разница в 20% в количестве токенов перекрывает большинство различий в тарифах.

Может ли кэширование промптов увеличить счет?

Да, в случае с Anthropic. Запись в кэш стоит в 1.25 раза дороже базового тарифа на входные данные для пятиминутного хранения и в 2 раза для часового, тогда как использование кэша (hit) стоит 0.1 от базового тарифа. Если ваш трафик имеет выраженные пики и большинство записей истекают до того, как их кто-либо прочитает, вы платите повышенную цену за запись, не получая выгоды от чтений. Сравните cache_creation_input_tokens и cache_read_input_tokens в своих логах. Если коэффициент близок к 1, кэширование приносит вам убытки — увеличьте время хранения записи или откажитесь от кэширования.

Что лучше использовать для агента по написанию кода: API или подписку?

Для одного разработчика при обычном объеме работы подписка обычно обходится дешевле, чем оплата по факту использования API, так как агент по написанию кода при каждом запросе повторно отправляет большой контекст, который оплачивается каждый раз. Сначала замерьте расходы в течение недели, а затем сравните общую сумму API со стоимостью подписки. API выгоднее при неравномерной нагрузке или если вам нужен программный доступ, который не предоставляет подписка. Если причиной перехода на API стало достижение лимитов использования, а не цена, то способы обхода лимитов использования Claude включают несколько вариантов, которые стоят дешевле, чем переход на оплату по факту.

#claude#openai#api-pricing#tokens#cost-comparison