Claude или ChatGPT API: что дешевле
Сравните стоимость Claude и ChatGPT API по трём рабочим нагрузкам: формула расчёта токенов, цены уровней и случаи, когда счёт Claude выше.
Краткий ответ
У API Claude и ChatGPT нет однозначного победителя по цене, поскольку оба поставщика по-разному тарифицируют входные и выходные токены на каждом уровне. По состоянию на август 2026 два верхних уровня Claude имеют ту же цену за входной токен, что и соответствующие уровни OpenAI, но меньшую цену за выходной токен. Поэтому Claude немного выгоднее для задач с большим объёмом выходных данных. На малом уровне Claude стоит в несколько раз дороже для той же задачи. Любой ответ, в котором не указаны уровень и соотношение токенов, является предположением.
Сначала на этой странице приводится арифметика. Затем рассматриваются три рабочие нагрузки с расчётом стоимости и указанием соотношения токенов. После этого описываются множители, которые влияют на фактический счёт сильнее, чем заявленная тарифная ставка.
Единственная необходимая формула
Оба API одинаково рассчитывают стоимость текста. Вы платите за отправленные токены, а за токены, которые модель возвращает, применяется более высокий тариф.
cost = (input tokens / 1,000,000) * input rate + (output tokens / 1,000,000) * output rate
Токен содержит примерно 4 символа английского текста, то есть около 0.75 слова. Используйте это значение только для предварительной оценки. Для точного расчета используйте количество токенов, которое каждый API возвращает в объекте usage каждого ответа.
# Rates are US dollars per million tokens.
def cost(in_tok, out_tok, in_rate, out_rate):
return in_tok / 1e6 * in_rate + out_tok / 1e6 * out_rate
# One support-chat turn: 1,400 tokens in, 220 tokens out, on a $2 / $10 model.
print(round(cost(1400, 220, 2.0, 10.0), 6))Скрипт выводит 0.005 — это половина цента за один обмен. Умножьте эту сумму на ожидаемое количество обменов в месяц — и получите бюджет. Запомните эту формулу: после этого любое изменение цены будет требовать одной правки строки, а не нового анализа.
Опубликованные тарифы, август 2026
Это прайс-лист, опубликованный обоими поставщиками 1 августа 2026 года. Это единственный блок в статье, где указана цена. Перед утверждением бюджета сверьте данные со страницей claude.com/pricing и страницей тарифов OpenAI.
The data behind this chart
[
{
"label": "Frontier",
"claude_input": 5,
"claude_output": 25,
"openai_input": 5,
"openai_output": 30
},
{
"label": "Workhorse",
"claude_input": 2,
"claude_output": 10,
"openai_input": 2,
"openai_output": 12
},
{
"label": "Workhorse from September",
"claude_input": 3,
"claude_output": 15,
"openai_input": 2,
"openai_output": 12
},
{
"label": "Small",
"claude_input": 1,
"claude_output": 5,
"openai_input": 0.2,
"openai_output": 1.2
}
]Сопоставление выполнено по позициям в каждой линейке, а не по известности моделей. В верхнем сегменте сравниваются Claude Opus 5 и gpt-5.6-sol. В основном рабочем сегменте сравниваются Claude Sonnet 5 и gpt-5.6-terra. В малом сегменте сравниваются Claude Haiku 4.5 и gpt-5.6-luna. Оба поставщика также продают более дорогие уровни, не вошедшие в этот блок, а OpenAI продолжает указывать старые поколения по первоначальным тарифам. Сравнение флагманской модели одного поставщика с бюджетной моделью другого даёт бессмысленный результат. Именно поэтому большинство опубликованных сравнений выносят в заголовок некорректную цифру.
В этом блоке нужно отметить два момента. Тарифы Sonnet 5 2 и 10 являются вводными. Anthropic указывает, что они действуют до 31 августа 2026 года. После этого Sonnet 5 будет тарифицироваться по 3 и 15. Это изменение превращает основной рабочий уровень из небольшого преимущества Claude в явное преимущество OpenAI. Оно произойдёт в пределах периода актуальности этой статьи.
Второй момент — закономерность, которую стоит запомнить: во всех строках выше Claude тарифицирует вывод ровно в 5 раз дороже собственного ввода, а OpenAI — в 6 раз. Именно это соотношение, а не абсолютный тариф, определяет смену победителя в зависимости от соотношения токенов ввода и вывода.
Почему ставка за миллион токенов не позволяет сравнивать поставщиков
Ставка — это сумма в долларах за токен. Счет рассчитывается как сумма в долларах за токен, умноженная на количество токенов. Количество токенов в тексте зависит от модели, а не от самого текста.
Anthropic прямо указывает это в документации: модели Claude 4.7 и более поздние модели, включая Claude Opus 5 и Claude Sonnet 5, используют новый токенизатор. Для одного и того же текста он создает примерно на 30% больше токенов, чем Claude Sonnet 4.6 и более ранние модели. Ставка не изменилась. Счет изменился.
Поэтому две одинаковые на вид ставки не означают два одинаковых счета. Подсчитайте токены с обеих сторон на собственном тексте, прежде чем доверять любому сравнению, включая это сравнение.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5",
"messages": [{"role": "user", "content": "Summarise the attached contract."}]
}'Корректный ответ представляет собой небольшой объект JSON, содержащий input_tokens. 401 означает, что ключевая переменная пуста в вашей оболочке. Обработайте тот же текст токенизатором другого поставщика, разделите одно количество токенов на другое, затем умножьте опубликованную ставку на полученное соотношение и только после этого сравнивайте ставки. Если соотношение дает одному поставщику преимущество более чем примерно в 1.2 раза, оно перевешивает любую разницу между ставками в блоке выше.
Сценарий 1: функция чата
Веб-приложение содержит ассистента службы поддержки. Объем составляет 120,000 диалоговых ходов в месяц. Каждый ход отправляет системный промпт, схемы инструментов, два найденных фрагмента из базы поддержки и несколько предыдущих сообщений — около 1,400 входных токенов. Модель отвечает примерно 220 токенами. Функция работает интерактивно, поэтому скидка за пакетную обработку здесь неприменима. Используйте уровень workhorse.
The data behind this chart
[
{
"label": "List price",
"claude_usd": "600.00",
"openai_usd": "652.80"
},
{
"label": "Cached prefix",
"claude_usd": "427.20",
"openai_usd": "480.00"
},
{
"label": "Small tier, cached",
"claude_usd": "213.60",
"openai_usd": "48.00"
}
]По стандартной цене Claude тарифицируется в размере 600.00, а OpenAI — 652.80. Затраты на входные токены одинаковы, поскольку тарифы на входные токены совпадают. Вся разница приходится на выходные токены, и преимущество Claude слишком мало, чтобы выбирать поставщика только по этому критерию.
Теперь отметьте 800 из 1,400 входных токенов как стабильный префикс: системный промпт и схемы инструментов не меняются между ходами. Оба поставщика взимают за попадание в кэш 10% базового тарифа на входные токены. Счет Claude снижается до 427.20, а OpenAI — до 480.00. Кэширование дает больший эффект, чем выбор поставщика, и обе платформы его поддерживают.
Здесь Claude проигрывает. Для большинства ответов службы поддержки не нужна модель уровня workhorse. Перенесите тот же трафик на малый уровень: Claude тарифицируется в размере 213.60, а OpenAI — 48.00. Если разделить одну сумму на другую, Claude оказывается примерно в четыре с половиной раза дороже за ту же работу. Claude Haiku 4.5 взимает 1 за миллион входных токенов, тогда как gpt-5.6-luna — 0.2, и никакое кэширование не устранит пятикратную разницу. Если ваша нагрузка подходит для малой модели, OpenAI дешевле, причем разница существенна.
Сценарий 2: конвейер обработки документов с большим контекстом
25,000 контрактов в месяц. Каждый запрос содержит одну и ту же инструкцию на 9,000 токенов и JSON-схему, затем 12,000 токенов текста контракта, а модель возвращает около 700 токенов структурированных полей. На вывод приходится менее 4% токенов в этой задаче, и именно этот факт определяет сравнение.
The data behind this chart
[
{
"label": "Chat feature",
"claude_usd": "427.20",
"openai_usd": "480.00"
},
{
"label": "Document pipeline",
"claude_usd": "820.00",
"openai_usd": "855.00"
},
{
"label": "Coding agent",
"claude_usd": "116.10",
"openai_usd": "124.20"
}
]При кэшировании префикса из 9,000 токенов с обеих сторон Claude стоит 820.00, а OpenAI — 855.00. Стоимость входных данных совпадает до цента, потому что в августе 2026 тарифы на основные входные данные одинаковы. Вся разница приходится на вывод: у Claude его стоимость в 5 раз выше стоимости входных данных, а у OpenAI — в 6 раз.
Эта задача также поддерживает пакетную обработку. Оба поставщика снижают стоимость входных и выходных данных на 50% при асинхронной обработке. Поэтому общая стоимость уменьшается вдвое, а соотношение разницы сохраняется. Пакетная обработка — самая большая отдельная скидка на обеих платформах, а ночной конвейер обработки документов всегда может ее использовать.
Claude проигрывает по той же логике тарифных уровней, что и раньше. Извлечение полей по фиксированной схеме — именно та задача, с которой небольшая модель справляется хорошо, а на входные данные здесь приходится 97% токенов. При переходе на один уровень ниже ставка OpenAI за входные данные уменьшается в 0.1 раза, а ставка Claude — в 0.5 раза. Протестируйте небольшую модель на 200 документах, прежде чем считать, что вам нужна более крупная модель, используя ту же оценку, которую вы применили бы для выбора подходящего уровня Claude для задачи.
Сценарий 3: постоянно работающий агент для разработки
Один разработчик запускает агент на VPS и выполняет примерно 900 обращений к модели в месяц. Каждое обращение содержит около 60,000 входных токенов контекста репозитория, из которых 80% попадает в кэш, и возвращает около 1,800 токенов изменений и пояснений. Используйте тариф для передовых моделей, поскольку при разработке дефицит возможностей приводит к реальным затратам.
Claude тарифицирует 116.10, а OpenAI — 124.20. Тариф за входные данные и тариф за чтение из кэша одинаковы, а более низкий тариф Claude за выходные данные дает преимущество примерно в 7%.
Эти 7% находятся в пределах погрешности токенизатора, указанной ранее, поэтому по тарифам считайте этот сценарий равным. Но модель тарификации различается. Для одного разработчика при таком объеме подписка обычно обходится дешевле, чем тарификация API по фактическому использованию. После учета подписки весь результат сравнения меняется. Перед тем как перевести агента на тарификацию по использованию, изучите сравнение стоимости API и подписки. Если вы все же используете тарификацию по фактическому использованию, сначала выясните, куда расходуются токены, поскольку использование токенов агентом для разработки в основном связано с повторной передачей контекста при каждом обращении, а не с написанным им кодом.
Множители, которые определяют счет
Базовая ставка — наименьшая статья в этом списке. Каждый из указанных ниже факторов изменяет фактический счет сильнее, чем разница между двумя поставщиками на одном уровне.
Кэшированный ввод. Оба поставщика взимают 10% базовой стоимости ввода за попадание в кэш. Anthropic также взимает плату за запись в кэш: 1.25 базовой стоимости ввода за запись на пять минут и 2 за запись на один час. Последующее попадание продлевает срок действия этой записи по цене чтения. Поэтому запись на пять минут окупается после одного чтения. Если между запросами проходят большие интервалы, рабочая нагрузка чаще записывает данные, чем читает их, и кэширование обходится дороже сэкономленной суммы. При стабильном трафике кэширование эффективно. При импульсном трафике — нет.
Скидки на пакетную обработку. На обеих платформах предоставляется скидка 50% на ввод и вывод, но только для асинхронных задач. Если выполнение задачи может подождать, счет у любого поставщика уменьшается вдвое. Скидка суммируется с кэшированием.
Доля вывода. Claude взимает за вывод 5-кратную ставку ввода. OpenAI взимает 6-кратную ставку. Чем больше ваших токенов записывается, а не считывается, тем выгоднее выглядит Claude при одинаковой ставке ввода. Для рабочих нагрузок, ориентированных преимущественно на ввод, верно обратное.
Повторные попытки. При повторной попытке ввод оплачивается полностью заново, а пригодный результат не возвращается. Если 6% вызовов завершаются ошибкой проверки схемы и запускаются повторно, фактический объем ввода на 6% больше запланированного. Учитывайте повторные попытки отдельной статьей затрат, а не статьей ошибок. Команды обычно обнаруживают этот множитель последним. Часто он оказывается больше разницы между поставщиками, которую они обсуждали целую неделю.
Кто проигрывает и в каких случаях
Claude безусловно проигрывает в младшем ценовом сегменте. gpt-5.6-luna стоит 0.2 за миллион входных токенов, тогда как Claude Haiku 4.5 — 1. Стоимость выходных токенов составляет 1.2 против 5. Обработка больших объемов данных для классификации и краткого извлечения данных в Claude обходится примерно в 4 раза дороже.
Claude проигрывает в основном рабочем сегменте с 1 сентября 2026 года, когда заканчивается вводный тариф и Sonnet 5 переходит на 3 и 15 при неизменной цене gpt-5.6-terra. Claude выигрывает в передовом сегменте по стоимости выходных токенов, но разница может исчезнуть из-за ваших собственных объемов токенов. Ни одна сторона не выигрывает в задачах, где преобладают входные данные, в августе 2026 года: при цене 2 за миллион токенов с обеих сторон стоимость обработки входных данных одинакова.
Как измерять это на собственном трафике
Читайте объект usage в каждом ответе и сохраняйте четыре показателя для каждого запроса: входные токены, выходные токены, токены чтения из кэша и токены записи в кэш. В Claude API они передаются как input_tokens, output_tokens, cache_read_input_tokens и cache_creation_input_tokens. Суммируйте их за день, умножьте на текущие тарифы и сравните результат со счетом. Разница обычно возникает из-за повторных попыток или участка кода, о котором вы забыли после выпуска.
Проводите сравнение на реальном трафике за одну неделю, а не на тестовом запросе. Сравнивайте стоимость выполненной задачи, а не стоимость токена. Модель, которая отвечает с первой попытки по тарифу, вдвое выше, дешевле модели, которой требуются три попытки по тарифу, вдвое ниже. Стоимость токена — это тариф. Стоимость выполненной задачи — это ваш счет.
Установите жесткий лимит расходов до того, как оставите систему работать без контроля. Обе платформы позволяют задать лимиты расходов в своих консолях. Агент, застрявший в цикле повторных попыток, может израсходовать месячный бюджет за одну ночь. Настройте это так же, как контроль расходов для постоянно работающего агента. Если вы создаете первую версию на собственном сервере, в материале первое приложение Claude API на VPS описаны обработка ключей и цикл запросов, на которых основаны эти расчеты.
FAQ
API Claude дешевле API ChatGPT?
Не всегда. В августе 2026 на обоих API тарифы для уровней frontier и workhorse одинаковы за входной токен, а Claude берет меньше за выходной токен. Поэтому при преобладании выходных данных Claude обходится на несколько процентов дешевле. На малом уровне OpenAI gpt-5.6-luna стоит одну пятую от цены Claude Haiku 4.5 за входной токен, поэтому классификация больших объемов значительно дешевле в OpenAI. Рассчитайте собственную стоимость на основе собственного распределения токенов. При такой небольшой разнице результат определяется вашей рабочей нагрузкой, а не тарифной сеткой.
Почему одинаковые слова дают разное количество токенов в разных API?
Потому что у каждой модели собственный токенизатор, и количество токенов зависит от модели. Anthropic указывает, что Claude 4.7 и более поздние модели создают примерно на 30% больше токенов для того же текста, чем Claude Sonnet 4.6 и более ранние модели. Передайте собственный текст в endpoint подсчета токенов каждого поставщика, разделите один результат на другой, а затем умножьте это соотношение на опубликованный тариф перед сравнением. Разница в 20% по количеству токенов превышает большинство различий в опубликованных тарифах.
Может ли кэширование промптов увеличить счет?
Да, в Anthropic. Запись в кэш стоит 1.25 базового тарифа за входной токен для записи сроком на пять минут и 2 базовых тарифа для записи сроком на один час. Обращение к записи в кэше стоит 0.1 базового тарифа. Если ваш трафик достаточно непостоянен и большинство записей удаляется до первого обращения, вы платите повышенную стоимость записи, но не получаете обращений к кэшу. Сравните cache_creation_input_tokens с cache_read_input_tokens в журналах. Соотношение около 1 означает, что кэширование увеличивает ваши расходы. Увеличьте срок хранения записи или отключите ее.
Запускать coding agent через API или по подписке?
Для одного разработчика при обычном объеме использования подписка обычно дешевле поминутной оплаты API, потому что coding agent повторно отправляет большой контекст при каждом ходе, а этот контекст оплачивается каждый раз. Сначала измеряйте расходы в течение недели, затем сравните общую стоимость API с ценой места по подписке. API выгоднее при неравномерной нагрузке или когда нужен программный доступ, которого подписка не предоставляет.