SSD Nodes Learn 🎉 VPS от $4.99/мес
Руководства Matt ConnorАвтор: Matt Connor · Обновлено 2026-08-07

Сколько стоит 1 миллион токенов в Claude

Узнайте актуальные цены на 1 миллион входных и выходных токенов для моделей Claude Haiku, Sonnet и Opus. Разбираем расчет стоимости API и влияние соотношения ввода и вывода.

Сколько стоит 1M токенов в Claude?

1M токенов означает один миллион токенов; это единица измерения, в которой указываются цены для всех API (application programming interface) Claude. Единой цены не существует, так как ввод и вывод тарифицируются по разным ставкам, и для каждой модели предусмотрена своя пара цен. По состоянию на август 2026 года один миллион входных токенов стоит $1 в Claude Haiku 4.5, $2 в Claude Sonnet 5 и $5 в Claude Opus 5.

Вывод — более дорогая часть. Во всех текущих моделях стоимость вывода в пять раз превышает стоимость ввода, поэтому соотношение этих двух показателей влияет на ваш счет сильнее, чем общая цифра. Приложение, которое отправляет длинные документы и получает короткие ответы, ведет себя иначе, чем то, которое пишет длинные ответы на основе короткого запроса.

Эта страница посвящена юнит-экономике: стоимости токена и методам оценки счета до начала разработки. О том, куда именно расходуются токены во время работы, читайте в куда уходят токены в сессии Claude Code.

Как выглядят 1M токенов

Токен — это фрагмент текста, который модель считывает или записывает. Согласно примерным оценкам Anthropic, один токен соответствует 4 символам или примерно 0.75 слова на английском языке. Таким образом, один миллион токенов — это около 750 000 слов или примерно 4 MB обычного текста.

Опубликованные оценки для типичных входных данных позволяют лучше представить этот масштаб.

ChartApproximate input token counts for common content, published estimates
The data behind this chart
[
  {
    "label": "Average web page (10 kB)",
    "tokens": "2,500"
  },
  {
    "label": "Documentation page (100 kB)",
    "tokens": "25,000"
  },
  {
    "label": "Research paper PDF (500 kB)",
    "tokens": "125,000"
  }
]

При таких показателях 1M токенов — это примерно 400 средних веб-страниц, прочитанных один раз, или восемь научных статей такого же объема. Это один проход по кодовой базе среднего размера или месяц неинтенсивного использования чата одним человеком.

Воспринимайте все эти цифры как оценочные. Код, JSON и текст на языках, отличных от английского, содержат меньше слов в одном токене, поэтому соотношение 0.75 является оптимистичной оценкой. Есть еще один фактор, влияющий на подсчет: Claude Opus 4.7 и более поздние версии, включая Opus 5 и Sonnet 5, используют новый токенизатор, который генерирует примерно на 30 процентов больше токенов для того же текста, чем Sonnet 4.6 и более ранние версии. Claude Haiku 4.5 использует старый токенизатор. Поэтому количество токенов, измеренное для Haiku 4.5, будет заниженным для Sonnet 5 при идентичных входных данных, что делает прямое сравнение цены за миллион токенов между этими моделями некорректным. Перед принятием решения подсчитайте количество токенов для одного и того же промпта в обеих моделях.

Стоимость Claude за миллион токенов

ChartClaude API list price in USD per million tokens, August 2026
The data behind this chart
[
  {
    "label": "Haiku 4.5",
    "input_usd": 1,
    "output_usd": 5
  },
  {
    "label": "Sonnet 5 (to 31 Aug 2026)",
    "input_usd": 2,
    "output_usd": 10
  },
  {
    "label": "Sonnet 5 (from 1 Sep 2026)",
    "input_usd": 3,
    "output_usd": 15
  },
  {
    "label": "Opus 5",
    "input_usd": 5,
    "output_usd": 25
  }
]

На модель Claude Sonnet 5 до 31 августа 2026 года действует ознакомительная цена: $2 за входные токены и $10 за выходные. С 1 сентября 2026 года вступает в силу стандартный тариф: $3 за входные и $15 за выходные токены. Стоимость Claude Opus 5 составляет $5 и $25 соответственно.

Тарифы меняются. Рассматривайте все цифры на этой странице как примеры расчёта по состоянию на август 2026 года. Перед утверждением бюджета обязательно уточняйте актуальные данные на официальной странице цен.

Размер контекста не влияет на тарифную ставку. В Claude 4.6 и более поздних версиях полное окно контекста в 1M токенов тарифицируется по стандартным ценам. Таким образом, стоимость одного токена в запросе на 900 000 токенов такая же, как и в запросе на 9 000 токенов. Длинный промпт стоит дороже только из-за большего количества токенов; отдельных повышенных тарифов для длинного контекста не существует.

Расчет стоимости при изменении цен

Каждый счет состоит из двух операций умножения и одной операции сложения.

cost = (input_tokens  / 1,000,000) * input_rate
     + (output_tokens / 1,000,000) * output_rate

Код для выполнения расчетов:

INPUT_RATE = 2.00    # USD per million input tokens, Sonnet 5, August 2026
OUTPUT_RATE = 10.00  # USD per million output tokens

def cost(input_tokens, output_tokens):
    return (input_tokens * INPUT_RATE + output_tokens * OUTPUT_RATE) / 1_000_000

print(f"{cost(4300, 400):.4f}")

Результат выполнения — 0.0126. Запрос, отправляющий 4,300 входных токенов и получающий 400 выходных токенов, стоит около 1.3 цента при использовании Sonnet 5. Храните оба тарифа в одном месте вашего кода. При изменении цены вам потребуется отредактировать всего две строки, после чего все оценки стоимости в вашей системе будут автоматически обновлены.

Реалистичная оценка для работающего приложения

Представим помощника службы поддержки. Его системный промпт и документация по продукту занимают 4 000 токенов. Эти данные отправляются с каждым запросом, так как Messages API не сохраняет состояние, и модель ничего не помнит между вызовами. Вопрос пользователя добавляет около 300 токенов. Ответ составляет примерно 400 токенов. Итого: 4 300 входных и 400 выходных токенов на один запрос.

Один миллион входных токенов покрывает около 232 запросов такого объема. При 1 000 запросов в день приложение потребляет 4,3 миллиона входных токенов ежедневно, поэтому «1 млн токенов» — это менее шести часов работы.

ChartEstimated cost per 1,000 requests at 4,300 input and 400 output tokens
The data behind this chart
[
  {
    "label": "Opus 5, list rates",
    "cost_per_1k_usd": "31.50"
  },
  {
    "label": "Sonnet 5, list rates",
    "cost_per_1k_usd": "12.60"
  },
  {
    "label": "Sonnet 5, Batch API",
    "cost_per_1k_usd": "6.30"
  },
  {
    "label": "Haiku 4.5, list rates",
    "cost_per_1k_usd": "6.30"
  },
  {
    "label": "Sonnet 5, warm prompt cache",
    "cost_per_1k_usd": "5.40"
  }
]

При использовании Claude Opus 5 такой трафик стоит $31.50 за 1 000 запросов. На Sonnet 5 стоимость составляет $12.60. Переход на Claude Haiku 4.5 снижает цену до $6.30, а использование прогретого кэша промптов на Sonnet 5 позволяет снизить её еще сильнее — до $5.40.

Умножьте эти показатели на 30, чтобы получить стоимость месяца работы. Sonnet 5 по стандартным тарифам обойдется примерно в $378 в месяц. То же приложение с прогретым кэшем будет стоить около $162. Выбор модели и решение о кэшировании влияют на бюджет сильнее, чем любые скидки, которые вы сможете согласовать при таком объеме. Вопрос о том, какую модель использовать, решается просто: побеждает самая дешевая модель, успешно прошедшая ваши тесты. В разделе выбор между Opus, Sonnet и Haiku описано, как правильно проводить такое тестирование.

Кэширование промптов сокращает повторяющуюся часть

Этот префикс из 4,000 токенов идентичен в каждом запросе, и вы каждый раз платите полную стоимость за ввод. Кэширование промптов сохраняет обработанный префикс и позволяет использовать его повторно по сниженной ставке.

Чтение из кэша стоит 0.1 от базовой ставки ввода. Запись в кэш стоит 1.25 от базовой ставки при времени жизни 5 минут или 2 от базовой ставки при времени жизни 1 час. Таким образом, 5-минутный кэш окупается после первого же чтения, так как запись стоит на 0.25 больше, а каждое чтение экономит 0.9. 1-часовому кэшу требуется два чтения, чтобы выйти в ноль.

Самый простой способ включить эту функцию — добавить одно поле верхнего уровня:

curl https://api.anthropic.com/v1/messages \
  -H "content-type: application/json" \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-opus-5",
    "max_tokens": 1024,
    "cache_control": {"type": "ephemeral"},
    "system": "You are a helpful assistant.",
    "messages": [
      {"role": "user", "content": "What are the key themes in Pride and Prejudice?"}
    ]
  }'

Затем прочитайте блок usage, который вернется в ответе:

{
  "usage": {
    "cache_creation_input_tokens": 5120,
    "cache_read_input_tokens": 1800,
    "input_tokens": 50,
    "output_tokens": 503
  }
}

Эти три счетчика ввода тарифицируются по трем разным ставкам, и в сумме они составляют ваш реальный объем ввода: total_input_tokens = cache_read_input_tokens + cache_creation_input_tokens + input_tokens. Оценка стоимости, учитывающая только input_tokens, будет сильно неверной после включения кэширования.

Две причины мешают кэшу стать выгодным, и обе они не сопровождаются сообщениями об ошибках.

Префикс должен быть идентичен побайтово. Поиск в кэше выполняется по совпадению префикса, поэтому временная метка или имя пользователя в начале системного промпта меняют его при каждом запросе. В результате вы каждый раз платите 1.25 от базовой стоимости ввода и ни разу не используете кэш. Признак этой проблемы — высокое значение cache_creation_input_tokens при нулевом значении cache_read_input_tokens. Размещайте cache_control после последнего блока, содержимое которого остается неизменным между запросами, а все переменные данные переносите после него. Изменение определений tools делает недействительным весь кэш ниже них, так как проверка недействительности выполняется в порядке: инструменты, затем системный промпт, затем сообщения.

Префикс должен быть достаточно длинным. Минимальная длина для кэширования составляет 512 токенов для Opus 5, 1,024 для Sonnet 5 и 4,096 для Haiku 4.5. Более короткий промпт не кэшируется, при этом ошибка не возвращается. Префикс из 4,000 токенов в примере выше кэшируется на Sonnet 5, но не кэшируется на Haiku 4.5, так как 4,000 меньше минимального порога этой модели. Если оба счетчика показывают 0, значит, ничего не было сохранено в кэш.

Пакетная обработка снижает стоимость вдвое

Batch API обрабатывает запросы асинхронно со скидкой 50 процентов как на входные, так и на выходные данные. В примере выше это превращает $12.60 за 1 000 запросов в $6.30. Скидка суммируется с кэшированием промптов, поэтому кэшированное пакетное задание — это самый дешевый способ выполнения массовых задач.

Вы жертвуете задержкой, поэтому пакетная обработка не подходит для задач, где пользователь ожидает ответа в реальном времени. Она оптимальна для ночной классификации данных и обработки больших архивов документов.

Почему стоимость чата растет в рамках одного диалога

Поскольку API не сохраняет состояние, клиент повторно отправляет всю историю переписки при каждом новом запросе. Поэтому потребление токенов в одном чате растет пропорционально квадрату его длины, а не линейно.

Предположим, что средний объем сообщения составляет 500 токенов. В первом запросе отправляется 500 входных токенов. Во втором — 1000. В двадцатом — 10 000. Если сложить это по формуле n(n+1)/2, то за 20 сообщений будет отправлено около 105 000 входных токенов, хотя объем самой переписки составляет всего 10 000 токенов.

Именно поэтому функция чата обходится дороже, чем кажется по объему текста, и именно поэтому кэширование стабильного префикса или суммаризация старых сообщений окупаются в длинных диалогах. Агент, который выполняет циклы вызова инструментов, ведет себя так же, но еще хуже: результат каждого инструмента остается в истории и повторно отправляется при каждом последующем запросе. Установка жесткого лимита расходов для агента, который вы запускаете самостоятельно здесь критически важна, так как этот рост происходит автоматически и за ним никто не следит.

Подсчет токенов перед выполнением запроса

Перестаньте вычислять количество токенов на основе количества слов. API подсчитывает их для вас бесплатно, используя лимит, отдельный от лимита на создание сообщений.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "content-type: application/json" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-opus-5",
    "system": "You are a scientist",
    "messages": [{
      "role": "user",
      "content": "Hello, Claude"
    }]
  }'

Ответ содержит одно поле:

{ "input_tokens": 14 }

Передайте в него ваш реальный системный промпт и определения инструментов вместе с типичным сообщением пользователя, а затем подставьте полученное число в функцию стоимости, указанную выше. Эндпоинт принимает тот же формат тела запроса, что и обычное сообщение, поэтому изображения и PDF-файлы также учитываются корректно. Важно учитывать два нюанса. Полученное значение является оценочным и может незначительно отличаться от итоговой суммы в счете. Кроме того, подсчет выполняется с использованием токенизатора той модели, которую вы указываете, поэтому передавайте именно ту модель, которую планируете использовать.

Количество выходных токенов невозможно подсчитать заранее, так как они еще не существуют. Ограничьте их с помощью max_tokens, а затем оцените реальное распределение на основе usage.output_tokens при работе с реальным трафиком.

Из чего еще складывается счет

Токены составляют основную часть счета. Однако есть несколько позиций, которые не являются токенами, и они часто становятся неожиданностью.

  • Описания инструментов (tool definitions) становятся входными токенами при каждом запросе. Только системный промпт для использования инструментов добавляет от 286 до 406 токенов в Opus 5, еще до учета ваших собственных схем. Десять подробных описаний инструментов могут удвоить объем небольшого промпта.
  • Поиск в Интернете оплачивается по тарифу $10 за 1 000 поисковых запросов, сверх стоимости токенов, которые потребляют результаты при попадании в контекст.
  • Функция получения содержимого веб-страниц (web fetch) не имеет отдельной комиссии, но загруженная страница преобразуется во входные токены. Страница документации объемом 100 kB — это примерно 25,000 токенов.
  • Запрос на выполнение инференса только в США с использованием inference_geo в Claude 4.6 и более поздних версиях применяет множитель 1.1 к каждой категории токенов, включая чтение и запись в кэш.

Целесообразность покупки доступа к API напрямую зависит от ваших объемов. Ниже определенного уровня использования фиксированный ежемесячный тариф оказывается выгоднее, и в сравнении API с подпиской Claude этот расчет приведен с использованием реальных цифр.

FAQ

Сколько стоит 1 млн токенов в Claude?

Цена зависит от модели и от того, являются ли токены входными или выходными. По состоянию на август 2026 года один миллион входных токенов стоит $1 для Claude Haiku 4.5, $2 для Claude Sonnet 5 по вводным тарифам и $5 для Claude Opus 5. Стоимость выходных токенов в пять раз выше стоимости входных для каждой из этих моделей. С 1 сентября 2026 года цена для Sonnet 5 изменится до $3 за входные и $15 за выходные токены. Тарифы меняются, поэтому уточняйте их на официальной странице цен перед тем, как закладывать сумму в бюджет.

Равен ли 1 млн токенов 1 млн слов?

Нет. Один токен — это примерно 4 символа английского текста или около 0,75 слова, поэтому один миллион токенов составляет примерно 750 000 слов. Это соотношение является лишь ориентиром. Код, JSON и языки, отличные от английского, требуют большего количества токенов на слово. В Claude Opus 4.7 и более поздних версиях используется новый токенизатор, который генерирует примерно на 30 процентов больше токенов для того же текста, чем Claude Sonnet 4.6 и более ранние версии, поэтому показатели не являются переносимыми между поколениями моделей. Выполняйте замеры с помощью бесплатного эндпоинта /v1/messages/count_tokens, передавая в него модель, которую планируете использовать.

Всегда ли кэширование промптов экономит деньги?

Нет. Запись в кэш длительностью 5 минут стоит в 1,25 раза больше базовой ставки за входные токены, поэтому префикс, который был записан, но ни разу не прочитан, обходится на 25 процентов дороже, чем обычная отправка. Кэширование окупается начиная с первого чтения. Оно может не сработать в двух случаях, причём оба происходят без вывода ошибок. Если кэшируемый префикс меняется между запросами, поиск не даст совпадений, так как требуется точное соответствие префикса. Если префикс короче минимально допустимой длины для кэширования (1024 токена для Sonnet 5 и 4096 для Haiku 4.5), данные не кэшируются, а ошибка не возвращается. Если cache_creation_input_tokens и cache_read_input_tokens оба возвращают 0, значит, кэш не используется.

Почему мой счёт растёт быстрее, чем количество сообщений?

Потому что весь диалог отправляется заново на каждом шаге. API Messages не хранит состояние, поэтому 20-й шаг чата снова включает в себя все 19 предыдущих шагов в качестве входных данных. Если средний размер шага составляет 500 токенов, то диалог из 20 шагов отправит около 105 000 входных токенов, хотя длина самой переписки составит всего 10 000 токенов. Циклы агентов работают аналогично, так как каждый результат работы инструмента остаётся в истории. Кэшируйте стабильный префикс или суммируйте старые шаги и удаляйте их из запроса.