Сколько токенов включено в подписку Claude Pro?
В подписке Claude Pro нет фиксированного лимита токенов. Доступ ограничен количеством сообщений в окне времени. Узнайте, как объем контекста влияет на расход вашего лимита.
Сколько токенов включено в подписку Claude Pro?
Подписка Claude Pro не предусматривает фиксированного лимита токенов, и по состоянию на сентябрь 2026 года Anthropic не публикует подобные данные. Использование Claude тарифицируется по количеству сообщений в рамках скользящего временного окна, а не по количеству токенов, списанных с баланса. Размер этого окна зависит от выбранной модели, длины диалога и объема текста в каждом отдельном запросе.
Это ответ, который редко можно услышать, так как пользователи привыкли, что тарифный план работает по принципу API-ключа. API-ключ расходует баланс, исчисляемый в токенах, поэтому вы можете самостоятельно рассчитать стоимость. Подписка же предоставляет доступ к лимиту, который устанавливает и корректирует Anthropic, и этот лимит измеряется в сообщениях, поэтому фиксированного количества токенов не существует. Любая цифра, которую вам назовут — вымышленная.
Поэтому задайте другой вопрос. Что делает мои сообщения «дорогими»? На этот вопрос есть конкретный ответ, и вы можете повлиять на него уже сегодня.
Почему подписка не позволяет указать количество токенов
API тарифицирует каждый запрос по количеству токенов. Входные токены включают всё, что вы отправляете, выходные — всё, что модель генерирует в ответ. У них разные тарифы, поэтому входные и выходные токены стоят по-разному, прежде чем вы приступите к расчётам.
Потребительские тарифные планы не имеют баланса для списания средств. Anthropic ограничивает количество сообщений, которые можно отправить в течение скользящего окна: оно открывается с первым сообщением и закрывается через определённое количество часов. Платные планы имеют второй, более длительный лимит, рассчитываемый за неделю. Сообщение не имеет фиксированного размера, поэтому одинаковое количество сообщений для двух разных пользователей означает разный объём работы. Справочные страницы Anthropic описывают лимиты в примерном количестве сообщений для короткого диалога, а затем предупреждают, что длинные беседы и большие вложения расходуют лимит быстрее. Это предупреждение — вся суть механизма, и принципы его работы практически никогда не разъясняются.
Почему 20-й шаг в чате стоит значительно дороже, чем 1-й
Модель не сохраняет память между запросами. Она не имеет состояния, поэтому каждый шаг требует повторной отправки всей истории беседы: системного промпта, каждого вашего предыдущего сообщения, каждого предыдущего ответа Claude и всех прикрепленных файлов. Ваш новый вопрос может состоять из двадцати слов, но запрос, содержащий его, включает в себя всю стенограмму.
Таким образом, стоимость шага растет вместе с длиной чата, причем линейно. В таблице ниже приведен расчет для набора условных параметров: системный промпт около 1,000 токенов, ваши сообщения около 1,000 токенов каждое и ответы около 1,200 токенов каждый. Эти данные иллюстрируют механизм работы и не являются показателями вашего аккаунта.
The data behind this chart
[
{
"label": "Turn 1",
"sent_this_turn": "2,000",
"cumulative_input": "2,000"
},
{
"label": "Turn 5",
"sent_this_turn": "10,800",
"cumulative_input": "32,000"
},
{
"label": "Turn 10",
"sent_this_turn": "21,800",
"cumulative_input": "119,000"
},
{
"label": "Turn 20",
"sent_this_turn": "43,800",
"cumulative_input": "458,000"
}
]На первом шаге отправляется 2,000 входных токенов. К 20-му шагу тот же короткий вопрос требует отправки 43,800 токенов — более чем в двадцать раз больше при том же объеме вашего ввода. За всю беседу вы отправили 458,000 входных токенов, причем большая часть этого объема — один и тот же текст, отправляемый снова и снова.
Двадцать отдельных чатов из одного шага потребовали бы отправки объема, равного двадцати первым строкам из таблицы выше, и ничего более. Те же вопросы, но значительно меньшая нагрузка. Вложения увеличивают разрыв, так как PDF-файл, прикрепленный на втором шаге, будет повторно отправляться на третьем, четвертом и каждом последующем шаге, независимо от того, актуален ли он для текущего обсуждения.
Именно поэтому два пользователя с одинаковым тарифным планом сообщают о совершенно разном расходе лимитов. Один держит одну ветку диалога открытой всю неделю и достигает лимита к среде. Другой открывает новый чат для каждой задачи и редко сталкивается с ограничениями. Оба действуют корректно. Их расход токенов различается на порядок из-за разницы в привычках.
При работе через API вы можете снизить стоимость повторов с помощью prompt caching, который сохраняет неизменяемую начальную часть запроса, благодаря чему последующие вызовы тарифицируются по сниженной ставке для этой части. В рамках подписки вы не управляете кэшированием, поэтому длина беседы — это единственный рычаг, который находится в ваших руках. Тот же механизм определяет расход в сессиях программирования, где содержимое файлов и определения инструментов передаются при каждом шаге, поэтому поддержание небольшого контекста сессии программирования помогает с лимитами больше, чем любые настройки, а статью о том, куда на самом деле уходят токены в сессии Claude Code, стоит прочитать, прежде чем винить тарифный план.
Что дает каждый тарифный план в относительных величинах
Ни один тариф не публикует абсолютный лимит использования. Публикуются только относительные показатели, и их достаточно для выбора. План Free находится в нижней части списка, и его доступная емкость может сокращаться при высокой нагрузке на сервис. План Pro находится выше. План Max продается в двух вариантах, которые описываются как кратные объемы использования Pro — примерно в 5 и примерно в 20 раз больше. Тарифы Team и Enterprise оплачиваются за каждое рабочее место и имеют собственные ограничения.
Рассматривайте эти множители как декларацию намерений, а не как договор. Anthropic корректирует лимиты, и об этих изменениях не сообщается заранее, что является еще одной причиной, по которой ни одна честная страница не может предоставить вам точное количество токенов. Что касается финансовой стороны сравнения, то стоимость Pro и его ограничения и разница между двумя уровнями Max содержат необходимую информацию, а реальные возможности бесплатного плана описывают базовый уровень.
Выбор модели — это второй множитель, который накладывается на тарифный план. Один и тот же запрос расходует больше лимита на самой мощной модели, чем на самой легкой, так как выполнение более тяжелой модели обходится дороже в пересчете на токен. Перенос рутинных задач с Opus на Sonnet или Haiku часто дает больше рабочего времени, чем повышение тарифа, поэтому подбор модели под конкретную задачу — это первое, что стоит попробовать, если у вас постоянно заканчиваются лимиты.
Как отслеживать собственное потребление вместо догадок
Ваша учетная запись — единственный достоверный источник информации, доступный в два клика. В claude.ai откройте Settings, затем Usage. Там отображается объем потребленных ресурсов в текущем окне и время его сброса. Проверяйте эти данные один раз, когда ответы начинают отклоняться, и еще раз после длительного сеанса — так вы поймете свой паттерн использования быстрее, чем по любым опубликованным цифрам.
В Claude Code две команды с косой чертой выполняют ту же задачу прямо из терминала. /usage сообщает об использовании плана и времени сброса. /context показывает детализацию того, что заполняет контекстное окно в данный момент, разделяя системный промпт, определения инструментов, файлы и историю переписки. Когда /context показывает, что старая переписка занимает основной объем, /clear позволяет начать новый сеанс, и стоимость за запрос вернется к значениям из первой строки таблицы выше.
При работе через API подсчет является точным, и вы можете запросить его перед отправкой любого сообщения:
curl https://api.anthropic.com/v1/messages/count_tokens \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-sonnet-5",
"messages": [{"role": "user", "content": "Summarise the attached report."}]
}'Корректный ответ содержит единственное поле — это число, которое будет использоваться для биллинга:
{"input_tokens": 14}Каждый завершенный запрос возвращает аналогичные данные по завершении:
{"usage": {"input_tokens": 21430, "output_tokens": 512}}Отправьте один короткий вопрос как новый запрос, затем отправьте тот же вопрос в конце длинной ветки переписки и сравните два значения input_tokens. Разница — это именно тот эффект, который учитывает ваша подписка, выраженный в конкретном числе.
Что делать, если лимит исчерпан в процессе выполнения задачи
- Дождитесь окончания периода ожидания. Приложение показывает время сброса лимита, и ожидание часто занимает меньше времени, чем поиск обходных путей. Это правильное решение, если нет срочных задач.
- Переключитесь на более легкую модель. Меньшая модель дешевле в расчете на один запрос в любом тарифном плане, а в некоторых планах она использует отдельную квоту, поэтому работа продолжается, пока тяжелая модель недоступна.
- Начните новый чат, перенеся в него только то, что необходимо для следующего шага. Вставьте итоговый вывод, а не всю историю переписки. Стоимость одного запроса сразу снижается, а качество ответов обычно улучшается, так как модели больше не нужно обрабатывать тысячи токенов завершенного обсуждения.
- Перенесите задачу в API, где токены считаются по каждому запросу и оплачиваются по факту использования. Здесь нет окон ожидания, и вы можете видеть стоимость каждого вызова до и после его выполнения.
Выбор варианта зависит от того, является ли вашей проблемой время или объем нагрузки. Разовый аврал — это проблема тайминга. Если вы упираетесь в лимит каждую среду — это проблема объема нагрузки, и здесь лучше использовать API или расширенный тарифный план, а не пытаться подстроиться под время. полный чек-лист действий при исчерпании лимита в процессе задачи содержит пошаговое руководство по восстановлению работы, а как работают и сбрасываются скользящие окна объясняет логику работы таймеров. Если вы планируете переход на API, сначала оцените стоимость: сравнение API и подписки для одного и того же объема нагрузки и сколько на самом деле стоит миллион токенов помогут вам выполнить расчеты перед принятием решения.
FAQ
Сколько токенов включено в подписку Claude Pro?
Anthropic не публикует лимит токенов для тарифа Pro, и по состоянию на сентябрь 2026 года точного числа не существует. Использование Pro измеряется количеством сообщений в рамках скользящего окна с дополнительным недельным ограничением. Количество доступных сообщений зависит от выбранной модели и длины вашего диалога. Любые страницы, указывающие конкретное ежемесячное число токенов для Pro, являются догадками. Откройте Settings, затем Usage на сайте claude.ai, чтобы увидеть текущий уровень потребления и время сброса лимита.
Сбрасывается ли лимит использования при начале нового чата?
Нет. Использование учитывается для всей учетной записи в рамках окна, поэтому новый чат не возвращает уже потраченный объем. Что меняется, так это стоимость каждого последующего обращения. В новом чате нет истории переписки для повторной отправки, поэтому он начинается с минимальных значений, указанных в таблице выше, вместо того чтобы продолжать увеличивать нагрузку. Создание нового чата при смене темы — самый эффективный способ экономии на любом тарифном плане.
Почему сегодня я достиг лимита быстрее, чем вчера?
Обычно это происходит из-за того, что сегодняшняя работа велась в рамках одного длинного диалога. Каждое сообщение повторно отправляет всю историю переписки вместе с прикрепленными файлами, поэтому стоимость одного обращения постоянно растет, хотя количество сообщений кажется вам неизменным. Другая частая причина — выбор модели: более тяжелые модели расходуют лимит быстрее за один запрос, поэтому работа с самой мощной моделью завершится раньше, чем работа с более легкой.
Стоит ли переходить на API для точного подсчета токенов?
Переходите, если вам нужны точные цифры или предсказуемость. API учитывает входные и выходные токены для каждого вызова, предоставляет эндпоинт для подсчета токенов перед отправкой и не имеет ограничений по времени ожидания. Оплата производится за каждый токен, поэтому интенсивное использование обойдется дороже фиксированной подписки, а редкое — значительно дешевле. Рассчитайте стоимость вашей реальной нагрузки в сравнении с текущим планом перед переходом, так как результат зависит от объема отправляемых токенов.