Сколько стоит 1 миллион токенов в Claude
Узнайте актуальные тарифы на 1 миллион токенов для моделей Claude Haiku, Sonnet и Opus. Разбираем разницу в стоимости входных и выходных данных для расчета бюджета API.
Сколько стоит 1M токенов в Claude?
1M токенов означает один миллион токенов; это единица измерения, в которой указываются цены на все API (интерфейс прикладного программирования) Claude. Единой цены не существует, так как ввод и вывод тарифицируются по разным ставкам, и для каждой модели предусмотрена своя пара цен. По состоянию на август 2026 года один миллион входных токенов стоит $1 в Claude Haiku 4.5, $2 в Claude Sonnet 5 и $5 в Claude Opus 5.
Вывод — это более дорогая часть. Во всех текущих моделях ставка за вывод в пять раз выше ставки за ввод, поэтому соотношение между ними влияет на ваш счет сильнее, чем общая цифра. Приложение, которое отправляет длинные документы и получает короткие ответы, работает иначе, чем приложение, которое пишет длинные ответы на основе короткого запроса.
Эта страница посвящена юнит-экономике: стоимости токена и способам оценки счета до начала разработки. О том, куда именно расходуются токены во время работы, читайте в куда уходят токены в сеансе Claude Code.
Как выглядит 1M токенов
Токен — это фрагмент текста, который модель считывает или записывает. По приблизительным оценкам Anthropic, один токен соответствует 4 символам или примерно 0,75 слова на английском языке. Таким образом, один миллион токенов — это около 750 000 слов или примерно 4 MB обычного текста.
Опубликованные оценки для типичных входных данных позволяют лучше представить этот масштаб.
The data behind this chart
[
{
"label": "Average web page (10 kB)",
"tokens": "2,500"
},
{
"label": "Documentation page (100 kB)",
"tokens": "25,000"
},
{
"label": "Research paper PDF (500 kB)",
"tokens": "125,000"
}
]При таких показателях 1M токенов — это примерно 400 средних веб-страниц, прочитанных один раз, или восемь научных статей такого же объема. Это один проход по кодовой базе среднего размера или месяц неинтенсивного использования чата одним пользователем.
Рассматривайте все эти данные как оценочные. Код, JSON и текст на языках, отличных от английского, содержат меньше слов в одном токене, поэтому соотношение 0,75 является оптимистичной оценкой. Еще один фактор влияет на подсчет: Claude Opus 4.7 и более поздние версии, включая Opus 5 и Sonnet 5, используют новый токенизатор, который создает примерно на 30 процентов больше токенов для того же текста, чем Sonnet 4.6 и более ранние версии. Claude Haiku 4.5 использует старый токенизатор. Поэтому количество, измеренное на Haiku 4.5, будет занижать результат для Sonnet 5 при идентичных входных данных, из-за чего прямое сравнение цены за миллион токенов для разных моделей будет некорректным. Перед принятием решения подсчитайте количество токенов для одного и того же промпта для обеих моделей.
Тарифы Claude за миллион токенов
The data behind this chart
[
{
"label": "Haiku 4.5",
"input_usd": 1,
"output_usd": 5
},
{
"label": "Sonnet 5 (to 31 Aug 2026)",
"input_usd": 2,
"output_usd": 10
},
{
"label": "Sonnet 5 (from 1 Sep 2026)",
"input_usd": 3,
"output_usd": 15
},
{
"label": "Opus 5",
"input_usd": 5,
"output_usd": 25
}
]На модель Claude Sonnet 5 действует ознакомительная цена: $2 за входные токены и $10 за выходные токены до 31 августа 2026 года. С 1 сентября 2026 года вступают в силу стандартные тарифы: $3 за входные и $15 за выходные токены. Стоимость Claude Opus 5 составляет $5 и $25 соответственно.
Тарифы могут меняться. Рассматривайте все цифры на этой странице как пример расчета по состоянию на август 2026 года. Перед утверждением бюджета уточняйте актуальные данные на официальной странице с ценами.
Длина контекста не влияет на тарифную ставку. В Claude 4.6 и более поздних версиях полное окно контекста в 1M токенов тарифицируется по стандартным расценкам. Таким образом, стоимость одного токена в запросе на 900,000 токенов такая же, как и в запросе на 9,000 токенов. Длинный промпт стоит дороже только из-за большего количества токенов; отдельные тарифы для длинного контекста не применяются.
Арифметика, устойчивая к изменению цен
Любой счет состоит из двух операций умножения и одной операции сложения.
cost = (input_tokens / 1,000,000) * input_rate
+ (output_tokens / 1,000,000) * output_rateЗаписано в виде кода, который можно запустить:
INPUT_RATE = 2.00 # USD per million input tokens, Sonnet 5, August 2026
OUTPUT_RATE = 10.00 # USD per million output tokens
def cost(input_tokens, output_tokens):
return (input_tokens * INPUT_RATE + output_tokens * OUTPUT_RATE) / 1_000_000
print(f"{cost(4300, 400):.4f}")Результат вывода — 0.0126. Запрос, который отправляет 4,300 входных токенов и получает 400 выходных токенов, стоит около 1.3 цента при использовании Sonnet 5. Храните оба тарифа в одном месте вашего кода. При изменении цены вы редактируете две строки, и все оценки в вашей системе обновляются автоматически.
Пример расчета для реального приложения
Представьте помощника службы поддержки. Его системный промпт и документация по продукту занимают 4,000 токенов. Они отправляются с каждым запросом, так как API Messages не сохраняет состояние, и модель не помнит контекст между вызовами. Вопрос пользователя добавляет около 300 токенов. Ответ составляет около 400 токенов. Итого на один запрос приходится 4,300 входных и 400 выходных токенов.
Один миллион входных токенов покрывает около 232 таких запросов. При 1,000 запросов в день приложение потребляет 4.3 миллиона входных токенов ежедневно, поэтому объема в "1M токенов" хватает менее чем на шесть часов работы.
The data behind this chart
[
{
"label": "Opus 5, list rates",
"cost_per_1k_usd": "31.50"
},
{
"label": "Sonnet 5, list rates",
"cost_per_1k_usd": "12.60"
},
{
"label": "Sonnet 5, Batch API",
"cost_per_1k_usd": "6.30"
},
{
"label": "Haiku 4.5, list rates",
"cost_per_1k_usd": "6.30"
},
{
"label": "Sonnet 5, warm prompt cache",
"cost_per_1k_usd": "5.40"
}
]При использовании Claude Opus 5 такой трафик стоит $31.50 за 1,000 запросов. Для Sonnet 5 стоимость составляет $12.60. Переход на Claude Haiku 4.5 снижает цену до $6.30, а использование прогретого кеша промптов в Sonnet 5 позволяет снизить затраты еще сильнее — до $5.40.
Умножьте эти показатели на 30, чтобы получить данные за месяц. При стандартных тарифах Sonnet 5 обойдется примерно в $378 в месяц. То же приложение с прогретым кешем будет стоить около $162. Выбор модели и решение об использовании кеширования влияют на бюджет сильнее, чем любые скидки, которые вы сможете согласовать при таком объеме. Выбор модели — это отдельная задача, и побеждает самая дешевая из тех, что проходят ваши тесты: выбор между Opus, Sonnet и Haiku содержит описание того, как правильно проводить такое тестирование.
Кэширование промптов сокращает повторяющуюся часть
Префикс объемом 4,000 токенов идентичен в каждом запросе, и вы каждый раз оплачиваете его полную стоимость как входных данных. Кэширование промптов сохраняет обработанный префикс и позволяет использовать его повторно по сниженной ставке.
Чтение из кэша стоит 0.1 от базовой ставки за входные данные. Запись в кэш стоит 1.25 от базовой ставки при времени жизни 5 минут или 2 от базовой ставки при времени жизни 1 час. Таким образом, 5-минутный кэш окупается после первого же чтения, так как запись обходится на 0.25 дороже, а каждое чтение экономит 0.9. Для окупаемости 1-часового кэша требуется два чтения.
Самый простой способ включить эту функцию — добавить одно поле верхнего уровня:
curl https://api.anthropic.com/v1/messages \
-H "content-type: application/json" \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-5",
"max_tokens": 1024,
"cache_control": {"type": "ephemeral"},
"system": "You are a helpful assistant.",
"messages": [
{"role": "user", "content": "What are the key themes in Pride and Prejudice?"}
]
}'Затем прочитайте блок usage, который вернется в ответе:
{
"usage": {
"cache_creation_input_tokens": 5120,
"cache_read_input_tokens": 1800,
"input_tokens": 50,
"output_tokens": 503
}
}Эти три счетчика входных данных тарифицируются по трем разным ставкам, и их сумма составляет ваш фактический объем входных данных: total_input_tokens = cache_read_input_tokens + cache_creation_input_tokens + input_tokens. Оценка стоимости, учитывающая только input_tokens, будет сильно неточной после включения кэширования.
Две причины мешают кэшированию стать выгодным, и обе они приводят к сбоям без вывода сообщений об ошибках.
Префикс должен быть идентичен побайтово. Поиск в кэше осуществляется по совпадению префикса, поэтому временная метка или имя пользователя в начале системного промпта меняют его при каждом запросе. В результате вы каждый раз платите 1.25 от базовой стоимости входных данных и ни разу не используете чтение из кэша. Признаком этого является высокое значение cache_creation_input_tokens при значении cache_read_input_tokens, равном 0. Размещайте cache_control после последнего блока, содержимое которого остается неизменным во всех запросах, а все переменные данные переносите после него. Изменение определений tools делает недействительным весь кэш ниже них, так как проверка недействительности выполняется в порядке: инструменты, затем системные инструкции, затем сообщения.
Префикс должен быть достаточно длинным. Минимальная длина для кэширования составляет 512 токенов для Opus 5, 1,024 для Sonnet 5 и 4,096 для Haiku 4.5. Более короткий промпт не кэшируется, при этом ошибка не возвращается. Префикс из 4,000 токенов в примере выше кэшируется на Sonnet 5, но не кэшируется на Haiku 4.5, так как 4,000 меньше минимального порога этой модели. Если оба счетчика равны 0, значит, кэширование не выполнялось.
Пакетная обработка снижает стоимость вдвое
Batch API обрабатывает запросы асинхронно со скидкой 50 процентов как на входные, так и на выходные данные. В приведенном выше примере это превращает $12.60 за 1 000 запросов в $6.30. Скидка суммируется с кэшированием промптов, поэтому кэшированное пакетное задание является самым дешевым способом выполнения массовых задач.
Вы жертвуете задержкой, что делает пакетную обработку непригодной для задач, где пользователь ожидает ответа в реальном времени. Она подходит для ночной классификации данных и обработки накопленных документов.
Почему стоимость чата растет в рамках одной беседы
Поскольку API не сохраняет состояние, клиент повторно отправляет всю историю беседы при каждом новом запросе. В результате потребление токенов в рамках одного чата растет пропорционально квадрату его длины, а не линейно.
Предположим, что средний объем одного сообщения составляет 500 токенов. На 1-м шаге отправляется 500 входных токенов. На 2-м шаге отправляется 1 000. На 20-м шаге отправляется 10 000. Если суммировать это по формуле n(n+1)/2, то за 20 шагов беседы будет отправлено около 105 000 входных токенов, хотя объем самой транскрипции составляет всего 10 000 токенов.
Именно поэтому функция чата обходится дороже, чем кажется исходя из объема транскрипции, и именно поэтому кэширование стабильного префикса или суммаризация старых сообщений окупаются в длинных ветках диалога. Агент, который выполняет циклы вызовов инструментов, работает по той же схеме, но с худшими показателями: результат каждого инструмента остается в истории и повторно отправляется при каждом последующем запросе. Установка жесткого лимита расходов для агента, который вы запускаете самостоятельно здесь критически важна, так как этот рост происходит автоматически и остается без контроля.
Подсчет токенов перед выполнением запроса
Прекратите вычислять количество токенов на основе количества слов. API выполняет этот подсчет за вас бесплатно, используя отдельный лимит запросов, не связанный с созданием сообщений.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-5",
"system": "You are a scientist",
"messages": [{
"role": "user",
"content": "Hello, Claude"
}]
}'Ответ содержит одно поле:
{ "input_tokens": 14 }Передайте в него ваш реальный системный промпт и определения инструментов вместе с типичным сообщением пользователя, а затем подставьте полученное число в функцию расчета стоимости, приведенную выше. Эндпоинт принимает тот же формат тела запроса, что и запрос на отправку сообщения, поэтому изображения и PDF-файлы также учитываются корректно. Следует учитывать два нюанса. Полученное значение является оценочным и может незначительно отличаться от итогового счета. Кроме того, подсчет выполняется с использованием токенизатора той модели, которую вы указываете, поэтому передавайте именно ту модель, которую планируете использовать.
Количество выходных токенов невозможно подсчитать заранее, так как они еще не существуют. Ограничьте их с помощью max_tokens, а затем оцените реальное распределение на основе usage.output_tokens при работе с реальным трафиком.
Что еще влияет на счет
Токены составляют основную часть счета. Некоторые позиции не являются токенами, и они часто становятся неожиданностью для пользователей.
- Определения инструментов становятся входными токенами при каждом запросе. Один только системный промпт для использования инструментов добавляет от 286 до 406 токенов в Opus 5, еще до учета ваших собственных схем. Десять подробных описаний инструментов могут увеличить небольшой промпт вдвое.
- Веб-поиск оплачивается по тарифу $10 за 1 000 поисковых запросов, сверх стоимости токенов, которые потребляют результаты при попадании в контекст.
- Веб-запросы (web fetch) не имеют отдельной комиссии, но полученная страница преобразуется во входные токены. Страница документации объемом 100 кБ — это примерно 25,000 токенов.
- Запрос на выполнение вычислений только в США с использованием
inference_geoв Claude 4.6 и более поздних версиях применяет множитель 1.1 к каждой категории токенов, включая чтение и запись в кэш.
Целесообразность использования API зависит от объема ваших задач. Ниже определенного уровня использования фиксированный ежемесячный тариф оказывается выгоднее, и в сравнении API с подпиской Claude этот анализ проведен с использованием реальных цифр.
FAQ
Сколько стоит 1M токенов в Claude?
Стоимость зависит от модели, а также от того, являются ли токены входными или выходными. По состоянию на август 2026 года один миллион входных токенов стоит $1 в Claude Haiku 4.5, $2 в Claude Sonnet 5 по вводным ценам и $5 в Claude Opus 5. Стоимость вывода в пять раз превышает стоимость ввода для каждой из этих моделей. С 1 сентября 2026 года цена для Sonnet 5 изменится на $3 за ввод и $15 за вывод. Тарифы меняются, поэтому уточняйте их на официальной странице цен перед тем, как закладывать сумму в бюджет.
Равны ли 1M токенов 1M слов?
Нет. Один токен — это примерно 4 символа английского текста или около 0,75 слова, поэтому один миллион токенов составляет примерно 750 000 слов. Это соотношение является лишь ориентиром. Код, JSON и языки, отличные от английского, используют больше токенов на слово. В Claude Opus 4.7 и более поздних версиях также используется новый токенизатор, который создает примерно на 30 процентов больше токенов для того же текста, чем Claude Sonnet 4.6 и более ранние версии, поэтому показатели не являются переносимыми между поколениями моделей. Выполняйте замеры с помощью бесплатной конечной точки /v1/messages/count_tokens, передавая модель, которую вы планируете использовать.
Всегда ли кэширование промптов экономит деньги?
Нет. Запись в кэш длительностью 5 минут стоит в 1,25 раза больше базовой ставки ввода, поэтому префикс, который был записан, но ни разу не прочитан, обходится на 25 процентов дороже, чем его обычная отправка. Затраты окупаются с первого чтения. Кэширование может не сработать двумя способами, причем оба происходят без вывода ошибок. Если кэшированный префикс меняется между запросами, поиск не даст совпадений, так как требуется точное соответствие префикса. Если префикс короче минимальной длины, поддерживаемой моделью для кэширования (1 024 токена для Sonnet 5 и 4 096 для Haiku 4.5), данные не кэшируются, а ошибка не возвращается. Если значения cache_creation_input_tokens и cache_read_input_tokens равны 0, кэш не работает.
Почему мой счет вырос быстрее, чем количество сообщений?
Потому что весь диалог отправляется заново на каждом шаге. API Messages не сохраняет состояние, поэтому 20-й шаг чата снова передает все 19 предыдущих шагов в качестве входных данных. При среднем размере шага в 500 токенов диалог из 20 шагов отправляет около 105 000 входных токенов, хотя объем стенограммы составляет всего 10 000 токенов. Циклы агентов ведут себя так же, поскольку каждый результат работы инструмента остается в истории. Кэшируйте стабильный префикс или создавайте краткое содержание старых шагов и удаляйте их из запроса.