SSD Nodes Learn Hosting plans →
Посібники Matt ConnorВід Matt Connor · Оновлено 2026-08-13

Claude чи ChatGPT API: що дешевше?

Порівняйте Claude і ChatGPT API за формулою токенів: три реальні сценарії з розрахунками покажуть, коли рахунок Claude вищий і який рівень обрати.

Коротка відповідь

У порівнянні цін на API Claude і ChatGPT немає однозначного переможця, оскільки обидва постачальники по-різному тарифікують вхідні та вихідні токени на кожному рівні. Станом на August 2026 два старші рівні Claude мають таку саму ціну за вхідний токен, як відповідні рівні OpenAI, і нижчу ціну за вихідний токен, тому Claude трохи вигідніший для завдань із великим обсягом вихідних даних. На найнижчому рівні Claude коштує в кілька разів дорожче за ту саму роботу. Будь-яка відповідь, у якій не вказано рівень і співвідношення токенів, є припущенням.

Тому на цій сторінці спочатку наведено розрахунок, потім три робочі навантаження з розрахованою вартістю та їхнім співвідношенням токенів, а далі — множники, які впливають на фактичний рахунок сильніше, ніж базова тарифна ставка.

Потрібна лише одна формула

Обидва API однаково тарифікують текст. Ви платите за токени, які надсилаєте, і за токени, які модель повертає у відповіді, за вищою ставкою.

cost = (input tokens / 1,000,000) * input rate + (output tokens / 1,000,000) * output rate

Один токен — це приблизно 4 символи англійського тексту або близько 0.75 слова. Використовуйте це лише для первинної оцінки. Для точного розрахунку беріть кількість токенів, яку кожен API повертає в об’єкті usage кожної відповіді.

# Rates are US dollars per million tokens.
def cost(in_tok, out_tok, in_rate, out_rate):
    return in_tok / 1e6 * in_rate + out_tok / 1e6 * out_rate

# One support-chat turn: 1,400 tokens in, 220 tokens out, on a $2 / $10 model.
print(round(cost(1400, 220, 2.0, 10.0), 6))

Скрипт виводить 0.005 — це половина цента за один запит і відповідь. Помножте це значення на очікувану кількість запитів і відповідей на місяць — так ви отримаєте бюджет. Якщо одиниця в мільйон токенів у знаменнику здається абстрактною, у статті скільки тексту насправді можна отримати за мільйон токенів у Claude наведено конкретний обсяг тексту. Вивчіть цю формулу один раз, і кожну наступну зміну ціни можна буде внести одним рядком, без нового аналізу.

Опубліковані тарифи, серпень 2026 року

Це прайсові ціни, опубліковані обома постачальниками 1 серпня 2026 року. Цей блок — єдине місце в публікації, де наведено ціну. Перш ніж затверджувати бюджет, звірте дані з claude.com/pricing і сторінкою тарифів OpenAI.

ChartList prices in US dollars per million tokens, August 2026
The data behind this chart
[
  {
    "label": "Frontier",
    "claude_input": 5,
    "claude_output": 25,
    "openai_input": 5,
    "openai_output": 30
  },
  {
    "label": "Workhorse",
    "claude_input": 2,
    "claude_output": 10,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Workhorse from September",
    "claude_input": 3,
    "claude_output": 15,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Small",
    "claude_input": 1,
    "claude_output": 5,
    "openai_input": 0.2,
    "openai_output": 1.2
  }
]

Відповідність визначено за позицією в кожній лінійці, а не за популярністю. У категорії Frontier порівнюються Claude Opus 5 і gpt-5.6-sol. У категорії Workhorse — Claude Sonnet 5 і gpt-5.6-terra. У категорії Small — Claude Haiku 4.5 і gpt-5.6-luna. Обидва постачальники також пропонують вищі рівні, не наведені в цьому блоці, а OpenAI і далі вказує старі покоління за початковими тарифами. На стороні Claude це Fable 5: його ціна вдвічі вища за рядок Frontier для обох типів токенів, але співвідношення ціни вихідних токенів до вхідних залишається п’ятикратним. Тому варто прочитати скільки коштує Fable 5 і коли така ціна виправдана, перш ніж вважати Opus 5 найдорожчою моделлю у своєму рахунку. Порівняння флагманської моделі з одного боку з бюджетною моделлю з іншого дає беззмістовне число. Саме так більшість опублікованих порівнянь отримує свої заголовкові висновки.

У цьому блоці потрібно окремо зазначити дві речі. 2 і 10 для Sonnet 5 є вступними тарифами. Anthropic зазначає, що вони діють до 31 серпня 2026 року, після чого для Sonnet 5 застосовуватимуться 3 і 15. Через цю єдину зміну перевага Claude у категорії Workhorse перетворюється на явну перевагу OpenAI. Вона настає протягом періоду актуальності цієї публікації.

Друга річ — закономірність, яку варто запам’ятати: Claude оцінює вихідні токени рівно в 5 разів дорожче за власні вхідні токени в кожному наведеному вище рядку, а OpenAI — у 6 разів. Саме це співвідношення, а не абсолютний тариф, визначає зміну переможця залежно від пропорції ваших токенів.

Чому ставка за мільйон токенів не дає змоги порівнювати постачальників

Ставка — це кількість доларів за токен. Вартість — це кількість доларів за токен, помножена на кількість токенів. Кількість токенів у фрагменті тексту залежить від моделі, а не від самого тексту.

Anthropic прямо зазначає: моделі Claude 4.7 і новіші, зокрема Claude Opus 5 і Claude Sonnet 5, використовують новіший токенізатор. Для того самого тексту він створює приблизно на 30% більше токенів, ніж Claude Sonnet 4.6 і старіші моделі. Ставка не змінилася. Вартість змінилася.

Тому дві однакові на вигляд ставки не означають дві однакові суми рахунка. Порахуйте токени з обох боків на власному тексті, перш ніж покладатися на будь-яке порівняння, зокрема на це.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "messages": [{"role": "user", "content": "Summarise the attached contract."}]
  }'

Коректна відповідь — це невеликий JSON-об’єкт, що містить input_tokens. 401 означає, що ключова змінна порожня у вашій shell-сесії. Пропустіть той самий текст через токенізатор іншого постачальника, поділіть одну кількість токенів на іншу, а потім помножте цей коефіцієнт на опубліковану ставку, перш ніж порівнювати. Якщо коефіцієнт відрізняється на користь одного постачальника більш ніж приблизно в 1.2 раза, це нівелює будь-яку різницю ставок у наведеному вище блоці.

Сценарій 1: функція чату

Помічник підтримки всередині вебзастосунку. 120,000 діалогових ходів на місяць. Для кожного ходу надсилаються system prompt, схеми інструментів, два отримані фрагменти з бази довідки та кілька попередніх повідомлень — приблизно 1,400 вхідних токенів. Модель відповідає приблизно 220 токенами. Функція інтерактивна, тому знижка за пакетну обробку тут не застосовується. Запускайте її на рівні workhorse.

ChartChat feature, monthly cost in US dollars, 120,000 turns
The data behind this chart
[
  {
    "label": "List price",
    "claude_usd": "600.00",
    "openai_usd": "652.80"
  },
  {
    "label": "Cached prefix",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Small tier, cached",
    "claude_usd": "213.60",
    "openai_usd": "48.00"
  }
]

За стандартною ціною Claude коштує 600.00, тоді як OpenAI — 652.80. Вартість вхідних даних однакова, оскільки тарифи на вхідні токени однакові. Уся різниця припадає на вихідні токени, і Claude має тут перевагу, недостатню для вибору постачальника.

Тепер позначте 800 із цих 1,400 вхідних токенів як стабільний префікс: system prompt і схеми інструментів, які не змінюються між ходами. Обидва постачальники стягують 10% базового тарифу на вхідні дані за влучання в кеш. Рахунок Claude зменшується до 427.20, а OpenAI — до 480.00. Кешування дає більший ефект, ніж вибір постачальника, і обидві платформи його підтримують.

Саме тут Claude програє. Для більшості відповідей підтримки не потрібна модель рівня workhorse. Перенесіть той самий трафік на малий рівень: Claude коштуватиме 213.60, а OpenAI — 48.00. Якщо поділити одне значення на інше, Claude коштує приблизно в чотири з половиною рази дорожче за ту саму роботу. Claude Haiku 4.5 стягує 1 за мільйон вхідних токенів, тоді як gpt-5.6-luna — 0.2. Жоден обсяг кешування не усуває п’ятикратної різниці. Якщо ваше робоче навантаження відповідає можливостям малої моделі, OpenAI дешевший, і різниця суттєва.

Сценарій 2: конвеєр обробки документів із довгим контекстом

25,000 контрактів на місяць. Кожен запит містить ту саму інструкцію на 9,000 токенів і JSON-схему, потім 12,000 токенів тексту контракту, а модель повертає близько 700 токенів структурованих полів. Вихідні дані становлять менше 4% токенів у цьому завданні, і саме цей факт визначає результат порівняння.

ChartMonthly cost in US dollars, three workloads, cached and paired like-for-like
The data behind this chart
[
  {
    "label": "Chat feature",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Document pipeline",
    "claude_usd": "820.00",
    "openai_usd": "855.00"
  },
  {
    "label": "Coding agent",
    "claude_usd": "116.10",
    "openai_usd": "124.20"
  }
]

За кешування префікса на 9,000 токенів у обох випадках Claude коштує 820.00, а OpenAI — 855.00. Вартість вхідних даних збігається до цента, оскільки в серпні 2026 року тарифи на обробку вхідних даних збігаються. Уся різниця припадає на обробку вихідних даних: у Claude вона коштує в 5 разів дорожче за вхідні дані, а в OpenAI — у 6 разів.

Це завдання також можна виконувати пакетно. Обидва постачальники знижують вартість вхідних і вихідних даних на 50% для асинхронної обробки, тому загальна вартість у кожному випадку зменшується вдвічі, а співвідношення залишається незмінним. Batch дає найбільшу окрему знижку на будь-якій із платформ, а нічний конвеєр обробки документів завжди може його використовувати.

Claude програє з тієї самої причини, що й раніше: вибір тарифного рівня. Вилучення полів за фіксованою схемою — саме те завдання, з яким добре справляється мала модель, а вхідні дані становлять тут 97% усіх токенів. Перехід на рівень нижче зменшує тариф OpenAI на вхідні дані в 0.1 раза, а тариф Claude — у 0.5 раза. Перевірте малу модель на 200 документах, перш ніж вважати, що вам потрібна більша, використовуючи ту саму оцінку, яку ви застосували б для вибору відповідного рівня Claude для завдання.

Сценарій третій: постійно активний coding agent

Один розробник запускає agent на VPS і виконує приблизно 900 звернень до моделі на місяць. Кожне звернення містить близько 60,000 вхідних токенів контексту репозиторію, з яких 80% припадає на cache hit, а результат містить приблизно 1,800 токенів змін і пояснення. Розрахунок виконано за тарифом frontier, оскільки саме в coding різниця в можливостях має реальну вартість.

Claude нараховує 116.10, тоді як OpenAI — 124.20. Ставка за вхідні токени однакова, ставка за читання з кешу однакова, а нижча ставка Claude за вихідні токени дає перевагу приблизно 7%.

Ці 7% перебувають у межах похибки tokenizer, описаної вище, тому в цьому сценарії вважайте ставки рівними. Відмінність полягає в моделі оплати. Для одного розробника за такого обсягу subscription seat зазвичай коштує менше, ніж оплата API calls за фактичним використанням, а після врахування підписки весь розрахунок змінюється. Перш ніж запускати agent з оплатою API calls за фактичним використанням, ознайомтеся з порівнянням вартості API та підписки. Якщо ви все ж використовуєте оплату за фактичним використанням, спочатку з’ясуйте, куди витрачаються токени, оскільки використання токенів coding agent переважно визначається контекстом, який повторно передається під час кожного звернення, а не кодом, який він створює.

Множники, які визначають рахунок

Заявлена ставка — найменша складова в цьому списку. Кожен наведений нижче чинник змінює фактичний рахунок сильніше, ніж різниця між двома постачальниками на одному тарифному рівні.

Кешування вхідних даних. Обидва постачальники стягують 10% базової вартості вхідних даних за cache hit. Anthropic також стягує плату за запис у кеш: 1.25 базової вартості вхідних даних для запису на п’ять хвилин і 2 для запису на одну годину. Подальший hit поновлює цей запис за ціною читання. Отже, запис на п’ять хвилин окупається після одного читання. Якщо між запитами є тривалі паузи, записів буде більше, ніж читань, і кешування коштуватиме дорожче, ніж заощаджуватиме. Стабільний трафік добре кешується. Пакетний трафік — ні.

Знижки за пакетну обробку. Знижка 50% на вхідні та вихідні дані на обох платформах, лише для асинхронних завдань. Якщо виконання завдання можна відкласти, рахунок у будь-якого постачальника зменшиться вдвічі. Ця знижка також застосовується разом із кешуванням.

Частка вихідних даних. Claude стягує за вихідні дані у 5 разів більше, ніж його ставка за вхідні дані. OpenAI стягує у 6 разів більше. Що більша частка ваших токенів генерується, а не передається на вхід, то вигіднішим виглядає Claude за однакової ставки на вхідні дані. Для робочих навантажень, де переважають вхідні дані, справедливе протилежне.

Повторні спроби. Повторна спроба знову оплачує весь обсяг вхідних даних і не повертає нічого придатного для використання. Якщо 6% ваших викликів не проходять перевірку схеми та запускаються повторно, витрати на вхідні дані на 6% більші, ніж передбачено планом. Обліковуйте повторні спроби як окрему статтю витрат, а не як помилки. Команди зазвичай виявляють цей множник останнім. Часто він перевищує різницю між постачальниками, через яку вони сперечалися цілий тиждень.

Яка сторона програє і де

Claude беззаперечно програє в малому класі. gpt-5.6-luna коштує 0.2 за мільйон вхідних токенів, тоді як Claude Haiku 4.5 — 1; для вихідних токенів ціни становлять відповідно 1.2 і 5. Класифікація великих обсягів даних і коротке вилучення даних у Claude коштують приблизно в чотири рази дорожче.

Claude програє в робочому класі з 1 вересня 2026 року, коли завершиться вступний тариф і Sonnet 5 перейде на 3 і 15, тоді як ціна gpt-5.6-terra залишиться без змін. Claude виграє у найпотужнішому класі за ціною вихідних токенів, але цю перевагу можуть нівелювати ваші власні підрахунки токенів. У серпні 2026 року жодна зі сторін не виграє в задачах, де переважають вхідні дані, оскільки за ціни 2 за мільйон з обох боків вартість вхідних токенів однакова.

Як виміряти це на власному трафіку

Читайте об’єкт usage у кожній відповіді та зберігайте чотири показники для кожного запиту: вхідні токени, вихідні токени, токени, прочитані з кешу, і токени, записані в кеш. У Claude API вони передаються як input_tokens, output_tokens, cache_read_input_tokens і cache_creation_input_tokens. Підсумовуйте їх за день, множте на поточні тарифи та порівнюйте отриману суму з рахунком. Різниця між цими значеннями зазвичай означає повторні спроби або шлях виконання коду, про який ви забули.

Виконайте порівняння на даних реального трафіку за один тиждень, а не на тестовому запиті, і порівнюйте вартість завершеного завдання, а не вартість токена. Модель, яка відповідає з першої спроби за подвійним тарифом, дешевша за модель, якій потрібні три спроби за половинним тарифом. Вартість токена — це тариф. Вартість завершеного завдання — це ваш рахунок.

Установіть жорстку межу витрат, перш ніж залишати щось працювати без нагляду. Обидві платформи дають змогу встановити ліміти витрат у своїх консолях, а агент, який застряг у циклі повторних спроб, може витратити місячний бюджет за одну ніч. Налаштуйте це так само, як контроль витрат для агента, що працює постійно. Якщо ви створюєте першу версію на власному сервері, у матеріалі перша програма Claude API на VPS описано роботу з ключами та цикл виконання запитів, на яких ґрунтуються ці розрахунки.

FAQ

Чи дешевший Claude API за ChatGPT API?

Не завжди. У серпні 2026 року frontier- і workhorse-рівні мають однакову ціну за вхідний токен в обох сервісах, а Claude бере менше за вихідний токен, тому для завдань із переважанням вихідних даних Claude обходиться на кілька відсотків дешевше. На малому рівні OpenAI gpt-5.6-luna коштує одну п’яту вартості Claude Haiku 4.5 за вхідний токен, тому класифікація великих обсягів значно дешевша в OpenAI. Розрахуйте власну вартість на основі власного співвідношення токенів, оскільки таку невелику різницю визначає саме ваше робоче навантаження, а не прайс-лист.

Чому однакові слова коштують різну кількість токенів у різних API?

Тому що кожна модель має власний токенізатор, а кількість токенів залежить від моделі. Anthropic зазначає, що Claude 4.7 і новіші моделі генерують приблизно на 30% більше токенів для того самого тексту, ніж Claude Sonnet 4.6 і попередні моделі. Надішліть власний текст до endpoint підрахунку токенів кожного постачальника, поділіть одну кількість на іншу, а потім помножте це співвідношення на опубліковану ставку перед порівнянням. Різниця в 20% за кількістю токенів перевищує більшість опублікованих відмінностей у тарифах.

Чи може prompt caching збільшити рахунок?

Так, в Anthropic. Запис у кеш коштує 1.25 базової ставки за вхідні дані для запису на п’ять хвилин і 2 рази базову ставку для запису на одну годину, тоді як звернення до кешу коштує 0.1 базової ставки. Якщо ваш трафік має такі сплески, що більшість записів кешу втрачає чинність до першого звернення, ви сплачуєте підвищену ціну запису, але не отримуєте жодного звернення до кешу. Порівняйте cache_creation_input_tokens і cache_read_input_tokens у журналах. Співвідношення, близьке до 1, означає, що кешування збільшує ваші витрати, тому збільште строк зберігання запису або відмовтеся від кешування.

Чи варто запускати coding agent через API чи за підпискою?

Для одного розробника зі звичайним обсягом роботи підписка зазвичай коштує менше, ніж тарифікація API за фактичним використанням, оскільки coding agent надсилає великий контекст повторно під час кожного кроку, і щоразу цей контекст тарифікується. Спочатку вимірюйте використання протягом тижня, а потім порівняйте загальну вартість API з ціною підписки. API вигідніший, якщо використання нерегулярне або якщо вам потрібен програмний доступ, якого не надає підписка. Якщо перейти на API вас змусило досягнення ліміту використання, а не ціна, варіанти після досягнення ліміту Claude містять кілька рішень, які коштують менше, ніж перехід на тарифікацію за фактичним використанням.

#claude#openai#api-pricing#tokens#cost-comparison