Скільки коштує 1M токенів у Claude
Claude тарифікує вхідні та вихідні токени окремо. Дізнайтеся, як перетворити 1M токенів і співвідношення input/output на суму в місячному рахунку.
Скільки коштує 1M токенів у Claude?
1M токенів — це один мільйон токенів. Саме в цій одиниці вказують ціни для кожного Claude API (application programming interface). Єдиної ціни немає, оскільки вхідні та вихідні токени тарифікуються за різними ставками, а кожна модель має власну пару ставок. Станом на August 2026 один мільйон вхідних токенів коштує $1 у Claude Haiku 4.5, $2 у Claude Sonnet 5 і $5 у Claude Opus 5.
Вихідні токени коштують дорожче. У кожній поточній моделі ставка за вихідні токени у п’ять разів вища за ставку за вхідні токени. Тому саме співвідношення між ними сильніше впливає на рахунок, ніж вказана ціна за мільйон токенів. Застосунок, який надсилає великі документи й повертає короткі відповіді, працює за зовсім іншою економікою, ніж застосунок, який генерує довгі відповіді на короткий запит.
Ця сторінка присвячена економіці використання: скільки коштує токен і як оцінити рахунок до початку розробки. Щоб дізнатися, куди фактично витрачаються токени під час роботи, прочитайте де витрачаються токени під час сеансу Claude Code.
Як виглядає 1M токенів
Токен — це фрагмент тексту, який модель читає або генерує. Орієнтовне правило Anthropic: один токен на 4 символи, або приблизно 0.75 англійського слова. Отже, один мільйон токенів — це близько 750,000 слів, або приблизно 4 MB звичайного тексту.
Опубліковані оцінки для поширених типів вхідних даних допомагають краще оцінити масштаб.
The data behind this chart
[
{
"label": "Average web page (10 kB)",
"tokens": "2,500"
},
{
"label": "Documentation page (100 kB)",
"tokens": "25,000"
},
{
"label": "Research paper PDF (500 kB)",
"tokens": "125,000"
}
]За таких показників 1M токенів — це приблизно 400 середніх вебсторінок, прочитаних один раз, або вісім наукових статей такого обсягу. Це один повний прохід кодовою базою середнього розміру або місяць помірного використання чату однією людиною.
Усе це слід сприймати як оцінку. Код, JSON і тексти мовами, відмінними від англійської, містять менше слів на один токен, тому співвідношення 0.75 є оптимістичним орієнтиром. Є ще один чинник, який змінює кількість токенів: Claude Opus 4.7 і новіші моделі, зокрема Opus 5 і Sonnet 5, використовують новий tokenizer, який створює приблизно на 30 відсотків більше токенів для того самого тексту, ніж Sonnet 4.6 і попередні версії. Claude Haiku 4.5 використовує старий tokenizer. Тому підрахунок, виконаний для Haiku 4.5, занижує кількість токенів для Sonnet 5 за ідентичного вхідного тексту. Через це пряме порівняння ціни за мільйон токенів між цими версіями є некоректним. Перш ніж ухвалювати рішення, підрахуйте кількість токенів для того самого запиту в обох моделях.
Вартість Claude за мільйон токенів
The data behind this chart
[
{
"label": "Haiku 4.5",
"input_usd": 1,
"output_usd": 5
},
{
"label": "Sonnet 5 (to 31 Aug 2026)",
"input_usd": 2,
"output_usd": 10
},
{
"label": "Sonnet 5 (from 1 Sep 2026)",
"input_usd": 3,
"output_usd": 15
},
{
"label": "Opus 5",
"input_usd": 5,
"output_usd": 25
}
]Для Claude Sonnet 5 діють вступні тарифи: $2 за вхідні та $10 за вихідні дані до 31 August 2026. З 1 September 2026 застосовуватиметься стандартний тариф: $3 за вхідні та $15 за вихідні дані. Claude Opus 5 коштує $5 за вхідні та $25 за вихідні дані. Окремо від цієї шкали тарифів перебуває Claude Fable 5: $10 за вхідні та $50 за вихідні дані, тому доцільність цих тарифів залежить від завдань, для яких ви фактично його використовуєте.
Тарифи змінюються. Розглядайте всі наведені на цій сторінці суми як приклад станом на August 2026 і перевіряйте актуальні значення на офіційній сторінці тарифів, перш ніж затверджувати бюджет.
Ці тарифи показують вартість Claude, але не визначають, чи буде він дешевшим варіантом для вашого робочого навантаження. У матеріалі три завдання з розрахунком вартості для Claude і ChatGPT показано, для яких сценаріїв кожен API є вигіднішим.
Довжина контексту не змінює тариф. У Claude 4.6 і новіших версіях повне контекстне вікно на 1M токенів оплачується за стандартним тарифом, тому запит на 900,000 токенів має таку саму вартість за токен, як і запит на 9,000 токенів. Довгий prompt коштує дорожче, оскільки містить більше токенів. Окремий тариф для довгого контексту не застосовується.
Арифметика, яка не змінюється разом із ціною
Кожен рахунок — це два множення та одне додавання.
cost = (input_tokens / 1,000,000) * input_rate
+ (output_tokens / 1,000,000) * output_rateУ вигляді коду, який можна запустити:
INPUT_RATE = 2.00 # USD per million input tokens, Sonnet 5, August 2026
OUTPUT_RATE = 10.00 # USD per million output tokens
def cost(input_tokens, output_tokens):
return (input_tokens * INPUT_RATE + output_tokens * OUTPUT_RATE) / 1_000_000
print(f"{cost(4300, 400):.4f}")Він виводить 0.0126. Запит із 4,300 вхідними токенами та 400 вихідними токенами коштує приблизно 1.3 цента в Sonnet 5. Зберігайте обидві ставки в одному місці у своєму коді. Коли ціна змінюється, ви редагуєте два рядки, і всі оцінки у вашій системі оновлюються відповідно.
Оцінка для реального застосунку
Візьмімо support assistant. Його system prompt і документація продукту містять 4,000 токенів. Вони надсилаються з кожним запитом, оскільки Messages API не зберігає стан, а модель нічого не пам’ятає між викликами. Запит користувача додає приблизно 300 токенів. Відповідь містить приблизно 400 токенів. Отже, на один запит припадає 4,300 вхідних і 400 вихідних токенів.
За 1M вхідних токенів можна виконати приблизно 232 запити такої форми. За 1,000 запитів на день застосунок споживає 4.3 мільйона вхідних токенів щодня, тому «1M токенів» — це менше ніж шість годин роботи з таким навантаженням.
The data behind this chart
[
{
"label": "Opus 5, list rates",
"cost_per_1k_usd": "31.50"
},
{
"label": "Sonnet 5, list rates",
"cost_per_1k_usd": "12.60"
},
{
"label": "Sonnet 5, Batch API",
"cost_per_1k_usd": "6.30"
},
{
"label": "Haiku 4.5, list rates",
"cost_per_1k_usd": "6.30"
},
{
"label": "Sonnet 5, warm prompt cache",
"cost_per_1k_usd": "5.40"
}
]Для Claude Opus 5 таке навантаження коштує $31.50 на 1,000 запитів. Для Sonnet 5 це $12.60. Перехід на Claude Haiku 4.5 знижує вартість до $6.30, а warm prompt cache у Sonnet 5 зменшує її ще більше — до $5.40.
Помножте ці значення на 30, щоб отримати вартість місяця за такого навантаження. Sonnet 5 за стандартними тарифами коштує приблизно $378 на місяць. Той самий застосунок із warm cache коштує приблизно $162. Вибір моделі та рішення щодо кешування кожне окремо мають більший вплив, ніж будь-яка знижка, яку ви зможете погодити за такого обсягу. Вибір моделі — окреме питання. Найдешевша модель, яка проходить ваші оцінювання, є найкращим варіантом: як вибрати між Opus, Sonnet і Haiku пояснює, як правильно це перевірити.
Кешування prompt зменшує витрати на повторювану частину
Цей префікс на 4,000 токенів однаковий у кожному запиті, але щоразу за нього стягується повна ціна вхідних даних. Кешування prompt зберігає оброблений префікс і застосовує знижену ставку під час його повторного використання.
Читання з кешу коштує 0.1 базової ставки для вхідних даних. Запис у кеш коштує 1.25 базової ставки для часу життя 5 хвилин або 2 базові ставки для часу життя 1 година. Тому кеш на 5 хвилин окупається після одного читання: запис коштує на 0.25 більше, а кожне читання заощаджує 0.9. Для кешу на 1 годину потрібно два читання, щоб вийти в точку беззбитковості.
Найпростіший спосіб увімкнути кешування — додати одне поле верхнього рівня:
curl https://api.anthropic.com/v1/messages \
-H "content-type: application/json" \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-5",
"max_tokens": 1024,
"cache_control": {"type": "ephemeral"},
"system": "You are a helpful assistant.",
"messages": [
{"role": "user", "content": "What are the key themes in Pride and Prejudice?"}
]
}'Після цього перегляньте блок usage у відповіді:
{
"usage": {
"cache_creation_input_tokens": 5120,
"cache_read_input_tokens": 1800,
"input_tokens": 50,
"output_tokens": 503
}
}Ці три лічильники вхідних даних тарифікуються за трьома різними ставками. Разом вони показують фактичний обсяг вхідних даних: total_input_tokens = cache_read_input_tokens + cache_creation_input_tokens + input_tokens. Оцінка вартості, яка враховує лише input_tokens, буде суттєво неточною після ввімкнення кешування.
Є дві причини, через які кеш може не окупатися. Обидві не спричиняють помилок.
Префікс має бути побайтно ідентичним. Пошук у кеші виконується за збігом префікса. Тому мітка часу або ім’я користувача на початку system prompt змінює його в кожному запиті. У такому разі щоразу стягується 1.25 базової ставки для вхідних даних, а читання з кешу не відбувається жодного разу. Ознака проблеми — cache_creation_input_tokens залишається високим, а cache_read_input_tokens — на рівні 0. Розмістіть cache_control в останньому блоці, вміст якого однаковий у різних запитах, а все змінне розмістіть після нього. Зміна визначень tools інвалідовує весь кеш нижче них, оскільки інвалідація виконується в такому порядку: tools, потім system, потім messages.
Префікс має бути достатньо довгим. Мінімальна довжина префікса, який можна кешувати, становить 512 токенів для Opus 5, 1,024 для Sonnet 5 і 4,096 для Haiku 4.5. Коротший prompt не кешується, і помилка не повертається. Префікс на 4,000 токенів у наведеному вище прикладі кешується в Sonnet 5, але не кешується в Haiku 4.5, оскільки 4,000 менше за мінімальний поріг цієї моделі. Якщо обидва лічильники показують 0, кешування не відбулося.
Пакетна обробка вдвічі зменшує вартість
Batch API асинхронно обробляє запити зі знижкою 50 відсотків на вхідні та вихідні дані. У наведеному вище прикладі це зменшує вартість з $12.60 за 1,000 запитів до $6.30. Знижка сумується з кешуванням prompt, тому пакетне завдання з кешованими даними є найдешевшим способом виконувати великі обсяги роботи.
Компромісом є затримка. Тому пакетна обробка не підходить для завдань, результату яких людина очікує в реальному часі. Вона підходить для нічної класифікації та масового дозаповнення документів.
Чому витрати на чат зростають у межах одного діалогу
Оскільки API не зберігає стан, ваш клієнт надсилає весь діалог повторно під час кожного ходу. Тому використання токенів у межах одного чату зростає пропорційно квадрату його довжини, а не лінійно.
Припустімо, що кожен хід у середньому містить 500 токенів. Хід 1 надсилає 500 вхідних токенів. Хід 2 — 1,000. Хід 20 — 10,000. Сума за формулою n(n+1)/2 показує, що діалог із 20 ходів надіслав приблизно 105,000 вхідних токенів, хоча сам транскрипт містить лише 10,000 токенів.
Саме тому функція чату коштує дорожче, ніж можна припустити за її транскриптом. Тому ж кешування стабільного префікса або узагальнення старіших ходів окупається в довгих гілках діалогу. Агент, який циклічно виконує tool calls, має таку саму структуру, але ситуація ще гірша: кожен результат інструмента залишається в історії та повторно надсилається під час кожного наступного ходу. Встановлення жорсткого ліміту витрат для агента, якого ви запускаєте самостійно має найбільше значення саме тут, оскільки це зростання відбувається автоматично, і ніхто за ним не стежить.
Порахуйте токени, перш ніж робити припущення
Не виводьте кількість токенів із кількості слів. API обчислює її для вас без додаткової плати, використовуючи окремий ліміт швидкості, не пов’язаний зі створенням повідомлень.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-5",
"system": "You are a scientist",
"messages": [{
"role": "user",
"content": "Hello, Claude"
}]
}'Відповідь містить одне поле:
{ "input_tokens": 14 }Передайте в нього фактичний системний промпт і визначення інструментів разом із типовим повідомленням користувача, а потім підставте отримане число у наведену вище функцію вартості. Endpoint приймає те саме тіло запиту, що й запит повідомлення, тому зображення та PDF-файли також підраховуються коректно. Важливі два застереження. Це оцінка, яка може дещо відрізнятися від значення, за яким виставляється рахунок. Крім того, підрахунок виконується tokenizer моделі, яку ви передаєте, тому вказуйте модель, яку фактично використовуватимете.
Кількість вихідних токенів неможливо порахувати заздалегідь, оскільки їх ще не існує. Обмежуйте її за допомогою max_tokens, а потім вимірюйте фактичний розподіл за даними usage.output_tokens у робочому трафіку.
Що ще входить до рахунку
Основну частину рахунку становлять токени. Є кілька інших складових, які не є токенами й часто стають несподіванкою.
- Визначення інструментів перетворюються на вхідні токени в кожному запиті. Лише системний промпт для використання інструментів додає від 286 до 406 токенів у Opus 5, ще до врахування власних схем. Десять докладних описів інструментів можуть подвоїти невеликий промпт.
- Пошук у вебі тарифікується за ставкою $10 за 1,000 пошукових запитів. Додатково оплачуються токени, які споживають результати після додавання до контексту.
- Отримання вебсторінок не має окремої плати, але отримана сторінка перетворюється на вхідні токени. Сторінка документації розміром 100 kB містить приблизно 25,000 таких токенів.
- Запит на інференс лише у США за допомогою
inference_geoу Claude 4.6 і пізніших версіях застосовує множник 1.1 до кожної категорії токенів, включно з читанням і записом кешу.
Чи варто взагалі купувати API, залежить від обсягу використання. Зазвичай це питання виникає після досягнення ліміту використання в тарифному плані, а варіанти після досягнення ліміту охоплюють період очікування до завершення вікна та перенесення цієї роботи на тарифіковані виклики API. За невеликого обсягу використання фіксований місячний план зазвичай одразу вигідніший, а порівняння API з підпискою Claude розглядає це на основі реальних чисел.
FAQ
Скільки коштує 1M токенів у Claude?
Це залежить від моделі та від того, чи є токени вхідними або вихідними. Станом на August 2026 один мільйон вхідних токенів коштує $1 у Claude Haiku 4.5, $2 у Claude Sonnet 5 за вступною ціною та $5 у Claude Opus 5. Вихідні токени в кожній із цих моделей коштують у п’ять разів дорожче за вхідні. Починаючи з 1 September 2026, ціна вхідних токенів у Sonnet 5 становитиме $3, а вихідних — $15. Тарифи змінюються, тому перед внесенням суми до бюджету перевірте їх на офіційній сторінці цін.
Чи дорівнює 1M токенів 1M слів?
Ні. Один токен — це приблизно 4 символи англійського тексту або близько 0.75 слова, тому один мільйон токенів — це приблизно 750,000 слів. Це співвідношення є лише орієнтовним. Код, JSON і мови, відмінні від англійської, використовують більше токенів на одне слово. Claude Opus 4.7 і новіші моделі також використовують новіший токенізатор, який створює приблизно на 30 percent більше токенів для ідентичного тексту, ніж Claude Sonnet 4.6 і попередні моделі, тому кількість токенів не можна безпосередньо порівнювати між поколіннями моделей. Вимірюйте її за допомогою безкоштовного endpoint /v1/messages/count_tokens, передаючи модель, яку плануєте запускати.
Чи завжди кешування промптів заощаджує кошти?
Ні. Запис у кеш на 5 minutes коштує 1.25 базової ставки для вхідних токенів, тому префікс, який записали, але жодного разу не прочитали, коштує на 25 percent дорожче, ніж його звичайне надсилання. Кеш окупається вже під час першого читання. Кешування може непомітно не спрацювати з двох причин. Якщо кешований префікс змінюється між запитами, збіг під час пошуку не знаходиться, оскільки порівнюється точний префікс. Якщо префікс коротший за мінімальну довжину, яку модель може кешувати, тобто 1,024 токенів у Sonnet 5 і 4,096 у Haiku 4.5, нічого не кешується, а помилка не повертається. Якщо cache_creation_input_tokens і cache_read_input_tokens обидва мають значення 0, кеш не використовується.
Чому мій рахунок зростав швидше, ніж кількість повідомлень?
Тому що вся розмова повторно надсилається під час кожного ходу. Messages API не зберігає стан, тому 20-й хід у чаті знову передає всі 19 попередніх ходів як вхідні дані. Якщо в середньому один хід містить 500 токенів, розмова з 20 ходів надсилає приблизно 105,000 вхідних токенів, хоча весь транскрипт містить лише 10,000 токенів. Цикли агентів працюють так само, оскільки кожен результат інструмента залишається в історії. Кешуйте стабільний префікс або підсумовуйте старі ходи й вилучайте їх із запиту.