SSD Nodes Learn 🎉 VPS от $4.99/мес
Руководства Matt ConnorАвтор: Matt Connor · Обновлено 2026-08-07

Сравнение цен API Claude и ChatGPT: что выгоднее

Узнайте, как рассчитывается стоимость токенов для Claude и ChatGPT. Мы разобрали три реальных сценария нагрузки, чтобы показать, в каких случаях API от Anthropic обходится дороже.

Краткий ответ

В сравнении цен на API Claude и ChatGPT нет однозначного лидера, так как оба поставщика используют разные тарифы на входные и выходные токены для каждого уровня доступа. По состоянию на август 2026 года два верхних уровня Claude стоят столько же за входной токен, сколько аналоги от OpenAI, но дешевле за выходной токен, поэтому Claude оказывается немного выгоднее при задачах с большим объемом вывода. На начальном уровне Claude стоит в несколько раз дороже за ту же работу. Любой ответ, в котором не указаны конкретный уровень и соотношение токенов, является лишь предположением.

Поэтому на этой странице сначала приведены расчеты, затем три примера рабочих нагрузок с учетом соотношения токенов, а также коэффициенты, которые влияют на итоговый счет сильнее, чем базовые тарифы.

Единственная необходимая формула

Оба API тарифицируют текст одинаково. Вы платите за токены, которые отправляете, и по более высокому тарифу за токены, которые модель генерирует в ответ.

cost = (input tokens / 1,000,000) * input rate + (output tokens / 1,000,000) * output rate

Один токен — это примерно 4 символа английского текста или около 0,75 слова. Используйте это значение только для предварительной оценки. Для точного расчета стоимости используйте значения, которые каждый API возвращает в объекте usage в составе каждого ответа.

# Rates are US dollars per million tokens.
def cost(in_tok, out_tok, in_rate, out_rate):
    return in_tok / 1e6 * in_rate + out_tok / 1e6 * out_rate

# One support-chat turn: 1,400 tokens in, 220 tokens out, on a $2 / $10 model.
print(round(cost(1400, 220, 2.0, 10.0), 6))

Скрипт выводит 0.005, что составляет полцента за итерацию. Умножьте это число на количество итераций, ожидаемых в течение месяца, и вы получите бюджет. Если единица измерения «миллион токенов» в знаменателе кажется абстрактной, что на самом деле можно получить за миллион токенов в Claude поможет представить конкретный объем текста. Освойте эту формулу, и любое изменение цен в будущем потребует лишь правки одной строки вместо проведения нового анализа.

Опубликованные тарифы, август 2026

Это прейскурантные цены, опубликованные обоими поставщиками 1 августа 2026 года. Этот блок — единственное место в публикации, где указаны цены. Сверьте их с claude.com/pricing и страницей цен OpenAI перед утверждением бюджета.

ChartList prices in US dollars per million tokens, August 2026
The data behind this chart
[
  {
    "label": "Frontier",
    "claude_input": 5,
    "claude_output": 25,
    "openai_input": 5,
    "openai_output": 30
  },
  {
    "label": "Workhorse",
    "claude_input": 2,
    "claude_output": 10,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Workhorse from September",
    "claude_input": 3,
    "claude_output": 15,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Small",
    "claude_input": 1,
    "claude_output": 5,
    "openai_input": 0.2,
    "openai_output": 1.2
  }
]

Пары сформированы по позиции в линейке, а не по популярности. Frontier — это Claude Opus 5 против gpt-5.6-sol. Workhorse — это Claude Sonnet 5 против gpt-5.6-terra. Small — это Claude Haiku 4.5 против gpt-5.6-luna. Оба поставщика также предлагают более высокие уровни обслуживания, а OpenAI сохраняет старые поколения моделей по их исходным тарифам. Сравнение флагманской модели одного вендора с бюджетной моделью другого дает бессмысленные цифры, которые часто используются в заголовках популярных сравнений.

Два момента в этом блоке требуют особого внимания. 2 и 10 для Sonnet 5 являются вводными тарифами; Anthropic указывает, что они действуют до 31 августа 2026 года, после чего стоимость Sonnet 5 составит 3 и 15. Это изменение превращает преимущество Claude в сегменте workhorse из незначительного в явное преимущество OpenAI, и оно произойдет в период актуальности данной публикации.

Второй момент — закономерность, которую стоит запомнить: Claude устанавливает цену на выходные токены ровно в 5 раз выше стоимости входных во всех приведенных строках, а OpenAI — в 6 раз. Именно это соотношение, а не абсолютная ставка, определяет, какая модель будет выгоднее в зависимости от вашего соотношения токенов.

Почему стоимость за миллион токенов нельзя сравнивать напрямую у разных поставщиков

Тариф — это количество долларов за токен. Счет — это стоимость за токен, умноженная на количество токенов. При этом количество токенов для одного и того же текста является свойством модели, а не самого текста.

Anthropic прямо указывает на это: модели Claude 4.7 и более поздние, включая Claude Opus 5 и Claude Sonnet 5, используют новый токенизатор. Он создает примерно на 30% больше токенов для того же текста, чем Claude Sonnet 4.6 и более ранние версии. Тариф не изменился, а итоговый счет — да.

Таким образом, два одинаковых на первый взгляд тарифа не означают одинаковые счета. Прежде чем доверять любому сравнению, включая это, самостоятельно подсчитайте количество токенов для вашего текста у обоих поставщиков.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "messages": [{"role": "user", "content": "Summarise the attached contract."}]
  }'

Корректный ответ представляет собой небольшой JSON-объект, содержащий input_tokens. Ошибка 401 означает, что ключевая переменная не задана в вашей оболочке. Пропустите тот же текст через токенизатор другого поставщика, разделите одно количество на другое, а затем умножьте полученный коэффициент на опубликованный тариф перед сравнением. Если коэффициент в пользу одного из поставщиков превышает примерно 1.2, это перевешивает любую разницу в тарифах, указанную выше.

Сценарий первый: функция чата

Поддержка пользователей внутри веб-приложения. 120,000 сообщений в месяц. Каждое сообщение включает системный промпт, схемы инструментов, два фрагмента из базы знаний и несколько предыдущих реплик — около 1,400 входных токенов. Модель отвечает примерно 220 токенами. Взаимодействие интерактивное, поэтому пакетные скидки здесь неприменимы. Используйте уровень производительности «workhorse».

ChartChat feature, monthly cost in US dollars, 120,000 turns
The data behind this chart
[
  {
    "label": "List price",
    "claude_usd": "600.00",
    "openai_usd": "652.80"
  },
  {
    "label": "Cached prefix",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Small tier, cached",
    "claude_usd": "213.60",
    "openai_usd": "48.00"
  }
]

По прайс-листу Claude обходится в 600.00, а OpenAI — в 652.80. Стоимость входных данных идентична, так как тарифы на них совпадают. Вся разница приходится на выходные токены, и преимущество Claude здесь слишком мало, чтобы выбирать поставщика только по этому критерию.

Теперь пометим 800 из 1,400 входных токенов как стабильный префикс: это системный промпт и схемы инструментов, которые не меняются между сообщениями. Оба поставщика взимают 10% от базового тарифа за попадание в кэш (cache hit). Счет Claude снижается до 427.20, а OpenAI — до 480.00. Кэширование важнее выбора поставщика, и обе платформы его поддерживают.

Здесь Claude проигрывает. Большинству ответов службы поддержки не требуется модель уровня «workhorse». Перенесите тот же трафик на уровень «small», и Claude будет стоить 213.60, а OpenAI — 48.00. При делении одного показателя на другой выясняется, что Claude обходится примерно в четыре с половиной раза дороже за ту же работу. Claude Haiku 4.5 стоит 1 за миллион входных токенов против gpt-5.6-luna по цене 0.2, и никакое кэширование не покроет пятикратную разницу. Если ваша нагрузка подходит для небольшой модели, OpenAI дешевле, причем с существенным отрывом.

Сценарий два: конвейер обработки длинных документов

25,000 контрактов в месяц. Каждый запрос содержит одну и ту же инструкцию и JSON-схему объемом 9,000 токенов, затем 12,000 токенов текста контракта, а модель возвращает около 700 токенов структурированных полей. Объем вывода составляет менее 4% от общего количества токенов в этой задаче, и именно этот факт определяет результат сравнения.

ChartMonthly cost in US dollars, three workloads, cached and paired like-for-like
The data behind this chart
[
  {
    "label": "Chat feature",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Document pipeline",
    "claude_usd": "820.00",
    "openai_usd": "855.00"
  },
  {
    "label": "Coding agent",
    "claude_usd": "116.10",
    "openai_usd": "124.20"
  }
]

При кэшировании префикса объемом 9,000 токенов с обеих сторон, Claude выставляет счет на 820.00, а OpenAI — на 855.00. Стоимость входных данных совпадает до цента, так как основные тарифы на ввод в августе 2026 года идентичны. Вся разница заключается в стоимости вывода, которая у Claude в 5 раз выше стоимости ввода, а у OpenAI — в 6 раз.

Эта задача также поддерживает пакетную обработку (batching). Оба поставщика предоставляют скидку 50% на ввод и вывод при асинхронной работе, поэтому оба итоговых значения уменьшаются вдвое, а разрыв сохраняется. Пакетная обработка — это самая значительная скидка на обеих платформах, и ночной конвейер обработки документов всегда может ее использовать.

Claude проигрывает из-за той же логики уровней, что и ранее. Извлечение полей по фиксированной схеме — это именно та работа, с которой хорошо справляется небольшая модель, а ввод составляет 97% токенов в данной задаче. Переход на уровень ниже уменьшает тариф на ввод OpenAI в 0.1 раза, а тариф на ввод Claude — в 0.5 раза. Протестируйте небольшую модель на 200 документах, прежде чем делать вывод о необходимости использования более мощной модели, применяя ту же оценку, которую вы использовали бы для выбора подходящего уровня Claude для задачи.

Сценарий три: постоянно работающий агент для написания кода

Один разработчик запускает агента на VPS, совершая примерно 900 обращений к модели в месяц. Каждое обращение содержит около 60 000 входных токенов контекста репозитория, из которых 80% приходится на попадание в кэш, и генерирует около 1 800 токенов правок и пояснений. Рассчитаем стоимость для передового уровня моделей (frontier tier), так как в программировании разрыв в возможностях напрямую влияет на финансовые потери.

Claude обходится в 116.10, в то время как OpenAI — в 124.20. При одинаковой частоте входных данных и одинаковой доле чтений из кэша, более низкая стоимость вывода у Claude дает преимущество примерно в 7%.

Эти 7% находятся в пределах погрешности токенизатора, упомянутой ранее, поэтому данный сценарий можно считать равным по стоимости. Что не является равным, так это модель биллинга. Для одного разработчика при таком объеме подписка обычно обходится дешевле, чем оплата по факту использования API, и вся картина сравнения меняется, как только вы добавляете подписку. Проработайте этот вопрос с помощью сравнения стоимости API и подписки, прежде чем переводить агента на оплату по факту использования. Если вы все же выбрали оплату по факту, сначала изучите, на что расходуются токены, поскольку в использовании токенов агентом для написания кода преобладает контекст, повторно отправляемый при каждом обращении, а не сам написанный код.

Множители, определяющие размер счета

Базовая ставка — это лишь малая часть расходов. Каждый из перечисленных ниже факторов влияет на итоговый счет сильнее, чем разница в тарифах между двумя поставщиками на одном уровне.

Кэширование входных данных. Оба поставщика взимают 10% от стоимости базового ввода при попадании в кэш (cache hit). Anthropic также берет плату за запись в кэш: 1.25 от стоимости базового ввода для записи с пятиминутным сроком хранения и 2 — для часового. Последующее обращение к кэшу обновляет запись по цене чтения. Таким образом, пятиминутная запись окупается после первого же чтения. При рабочей нагрузке с большими паузами между запросами запись происходит чаще, чем чтение, поэтому кэширование в таких случаях увеличивает расходы, а не сокращает их. Стабильный трафик хорошо кэшируется, а импульсный — нет.

Скидки на пакетную обработку (batch). Скидка 50% на ввод и вывод у обоих поставщиков, действует только для асинхронных задач. Если задача допускает ожидание, это сокращает счет вдвое у любого из поставщиков, причем скидка суммируется с кэшированием.

Доля вывода. Claude взимает за вывод в 5 раз больше, чем за ввод. OpenAI — в 6 раз. Чем больше ваших токенов записывается, а не считывается, тем выгоднее выглядит Claude при равной стоимости ввода, и наоборот — для задач, где преобладает ввод.

Повторные попытки (retries). Повторная попытка оплачивается как полный ввод данных, при этом полезный результат не возвращается. Если 6% ваших вызовов не проходят валидацию схемы и требуют повтора, объем вашего ввода на 6% превышает запланированный. Учитывайте повторные попытки как статью расходов, а не как ошибку. Команды обнаруживают этот множитель в последнюю очередь, и зачастую он оказывается значительнее, чем разница в ценах поставщиков, из-за которой велись недельные споры.

Кто проигрывает и где

Claude полностью проигрывает в сегменте начального уровня. gpt-5.6-luna стоит 0.2 за миллион входных токенов против 1 у Claude Haiku 4.5, а стоимость выходных токенов составляет 1.2 против 5. Высокообъемная классификация и короткое извлечение данных обходятся в Claude примерно в четыре раза дороже.

Claude проигрывает в сегменте рабочих решений с 1 сентября 2026 года, когда заканчивается действие вводного тарифа и стоимость Sonnet 5 повышается до 3 и 15 при неизменной цене gpt-5.6-terra. Claude выигрывает в сегменте передовых моделей по стоимости выходных токенов, однако этот отрыв может быть нивелирован вашими собственными показателями использования токенов. Ни одна из сторон не выигрывает в задачах с преобладанием входных данных в августе 2026 года, так как при цене 2 за миллион токенов стоимость входных данных у обоих провайдеров одинакова.

Как измерить это на собственном трафике

Считывайте объект usage в каждом ответе и сохраняйте четыре значения для каждого запроса: входные токены, выходные токены, токены чтения из кэша и токены записи в кэш. В API Claude они приходят как input_tokens, output_tokens, cache_read_input_tokens и cache_creation_input_tokens. Суммируйте их за день, умножайте на текущие тарифы и сравнивайте полученную сумму со счетом. Разница между ними обычно возникает из-за повторных попыток или кода, который вы забыли обновить в релизе.

Проводите сравнение на данных за неделю реального трафика, а не на тестовых промптах, и сравнивайте стоимость выполнения одной задачи, а не стоимость за токен. Модель, которая отвечает с первой попытки по двойной цене, обходится дешевле, чем модель, которой требуется три попытки по половинной цене. Стоимость за токен — это тариф. Стоимость за выполненную задачу — это ваш итоговый счет.

Установите жесткий лимит расходов, прежде чем запускать что-либо в работу. Обе платформы позволяют задать лимиты трат в консоли управления, а агент, застрявший в цикле повторных запросов, может потратить месячный бюджет за одну ночь. Настройте это так же, как вы делаете контроль расходов для постоянно работающего агента. Если вы создаете первую версию на собственном сервере, в руководстве первое приложение на Claude API на VPS описаны принципы работы с ключами и цикл запросов, на которых базируются эти расчеты.

FAQ

Дешевле ли Claude API, чем ChatGPT API?

Не всегда. В августе 2026 года тарифы на входные токены (input tokens) в основных и высокопроизводительных категориях у обоих провайдеров одинаковы. Claude берет меньше за выходной токен (output token), поэтому при задачах с большим объемом вывода Claude обходится на несколько процентов дешевле. В категории малых моделей gpt-5.6-luna от OpenAI стоит в пять раз меньше, чем Claude Haiku 4.5 за входной токен, поэтому массовая классификация данных значительно выгоднее на OpenAI. Рассчитайте стоимость самостоятельно, исходя из вашего соотношения токенов, так как при такой небольшой разнице итоговая сумма зависит от характера нагрузки, а не от прайс-листа.

Почему одни и те же слова стоят разное количество токенов в разных API?

У каждой модели свой токенизатор, а количество токенов — это характеристика конкретной модели. Anthropic заявляет, что модели Claude 4.7 и новее генерируют примерно на 30% больше токенов для того же текста, чем Claude Sonnet 4.6 и более ранние версии. Отправьте свой текст в эндпоинт для подсчета токенов каждого вендора, разделите один результат на другой, а затем умножьте полученный коэффициент на опубликованный тариф перед сравнением. Разница в 20% по количеству токенов перекрывает большинство различий в тарифах.

Может ли кэширование промптов увеличить счет?

Да, в случае с Anthropic. Запись в кэш стоит в 1.25 раза дороже базового тарифа на входные данные для пятиминутного хранения и в 2 раза для часового, тогда как попадание в кэш (hit) стоит 0.1 от базового тарифа. Если ваш трафик имеет выраженные пики и большинство записей истекают до того, как к ним обратятся, вы платите повышенную стоимость за запись, не получая экономии от чтений. Сравните cache_creation_input_tokens и cache_read_input_tokens в ваших логах. Если коэффициент близок к 1, кэширование приносит убытки: увеличьте время хранения записи или откажитесь от него.

Что лучше для агента по написанию кода: API или подписка?

Для одного разработчика при обычном объеме работы подписка, как правило, обходится дешевле, чем оплата API по факту использования. Агент по написанию кода при каждом запросе повторно отправляет большой контекст, и каждый раз этот контекст тарифицируется. Сначала замерьте расходы в течение недели, а затем сравните итоговую сумму по API со стоимостью подписки. API выгоднее, если нагрузка неравномерная или если вам нужен программный доступ, который не предоставляет подписка.

#claude#openai#api-pricing#tokens#cost-comparison