SSD Nodes Learn Hosting plans →
Руководства Matt ConnorАвтор: Matt Connor

Сколько токенов в Claude Pro: чат и Claude Code

Claude Pro не продаётся в токенах. Что Anthropic обещает на пять часов и на неделю, почему Claude Code тратит лимит быстрее чата и как измерить расход на русском тексте.

Claude Pro не продаётся в токенах

Сколько токенов даёт Claude Pro: ни одного числа Anthropic не публикует, потому что подписка Claude Pro не продаётся в токенах. Лимит задан как «использование» (usage) за пятичасовое окно и за неделю, а сколько сообщений в него помещается, зависит от длины сообщения и разговора и от выбранной модели. Чат на claude.ai и Claude Code тратят один и тот же лимит, но тратят его по-разному: ход в чате стоит ваше сообщение плюс ответ, ход в Claude Code заново отправляет весь контекст сессии и вывод инструментов. Поэтому за те же пять часов в терминале помещается заметно меньше ходов, чем в чате.

Что именно обещает Anthropic на 12 сентября 2026 года

Справочный центр Anthropic (support.claude.com) на 12 сентября 2026 года описывает Pro так. Статья «What is the Pro plan?»: «At least five times the usage per session compared to our free service», то есть минимум в пять раз больше использования за сессию, чем на бесплатном тарифе. Там же: «Your session-based usage limit will reset every five hours» (сессионный лимит сбрасывается каждые пять часов) и «Pro plans also have a weekly usage limit that applies across all models» (у Pro есть также недельный лимит, общий для всех моделей). Цена в той же статье: «The Pro plan is available for $20 per month (US), with pricing in your local currency where supported».

Обратите внимание, чего в этих формулировках нет: ни числа токенов, ни числа сообщений или ходов Claude Code. Единственная количественная фраза, «at least five times», сравнивает Pro с бесплатным тарифом, размер которого тоже не опубликован. Так устроен тариф: Anthropic оставляет за собой право менять размер окна, и формулировка про «сессию» и «неделю» остаётся верной при любом размере. Как работают окна и сбросы на всех тарифах, разобрано в общем разборе лимитов Claude.

Про Claude Code статья «Use Claude Code with your Pro or Max plan» говорит одной фразой: «Both Pro and Max plans offer usage limits that are shared across Claude and Claude Code, meaning all activity in both tools counts against the same usage limits». Оба тарифа дают лимиты, общие для Claude и Claude Code: вся активность в обоих инструментах списывается с одного счётчика. Статья «How do usage and length limits work?» повторяет это шире: «your usage of all different Claude product surfaces (claude.ai, Claude Code, Claude Desktop) counts towards the same usage limit».

Если вам нужны сами цифры тарифа и то, как они менялись, они собраны в обзоре цены и лимитов Claude Pro. Дальше важнее другое: единица измерения.

Почему лимит считается не в токенах, а в «использовании»

Та же статья про Pro объясняет, от чего зависит число сообщений: «The number of messages you can send will vary based on message length, including the length of files you attach, the length of your current conversation, and the model or feature you use». Длина сообщения, длина приложенных файлов, длина текущего разговора и выбранная модель. Три из четырёх факторов измеряются в токенах, четвёртый (модель) задаёт цену токена. Внутри лимит всё же токенный, просто с весами, которые Anthropic не раскрывает, поэтому интерфейс показывает процент, без числа токенов.

Механизм, из-за которого длина разговора вообще имеет значение: у модели нет памяти между запросами. Каждый ваш новый вопрос отправляется на сервер вместе со всей историей текущего чата, и модель читает её заново. Десятое сообщение в длинном разговоре стоит дороже первого, хотя вы напечатали столько же, потому что вместе с ним уходят все девять предыдущих вопросов и ответов. Именно поэтому совет «начните новый чат» из справочного центра действительно экономит лимит. Подробнее о том, что именно тратит окно в чате, в разборе того, на что уходит лимит Claude Pro.

Один пул, два способа его тратить

Ход в чате устроен просто. Вы печатаете сообщение, к нему прикрепляется история разговора и системная подсказка claude.ai, модель пишет ответ. Входящие токены: история плюс ваше сообщение. Исходящие: ответ. Одно обращение к модели на один ваш ход.

Ход в Claude Code устроен иначе. Модель та же; отличается то, что уходит на сервер. Документация Claude Code (code.claude.com/docs/en/costs) формулирует это так: «Claude Code sends your full conversation with every request, and each time Claude uses tools it sends another request carrying that batch of tool results». Claude Code отправляет весь разговор с каждым запросом, и каждый раз, когда Claude вызывает инструменты, уходит ещё один запрос с результатами этих инструментов. Один ваш ход в терминале превращается в цепочку обращений к модели: модель прочитала файл (запрос), запустила тесты (запрос), прочитала вывод тестов (запрос), отредактировала файл (запрос). На каждом шаге цепочки на сервер снова уходит вся история сессии вместе с системной подсказкой, содержимым CLAUDE.md, описаниями инструментов и всеми уже прочитанными файлами.

Кэширование подсказок (prompt caching) снижает цену повторного чтения, но не обнуляет её, и в той же документации это сказано прямо: «With prompt caching, Claude Code re-reads that history at the cached token rate, so a one-line question in a session that has been open all day still draws usage for the whole conversation». Вопрос в одну строку в сессии, открытой весь день, всё равно списывает использование за весь разговор. Кэш на подписке живёт час; после перерыва длиннее часа первый запрос не попадает в кэш и обрабатывает весь контекст по полной цене.

Пример из той же документации показывает пропорции. Блок Session команды /usage для одной сессии на модели Sonnet выглядел так:

ChartПример сессии Claude Code из документации Anthropic: токены по типу, тысячи
The data behind this chart
[
  {
    "label": "\u0412\u0432\u043e\u0434 (input)",
    "tokens_k": 1.2
  },
  {
    "label": "\u0412\u044b\u0432\u043e\u0434 (output)",
    "tokens_k": 5.3
  },
  {
    "label": "\u0427\u0442\u0435\u043d\u0438\u0435 \u0438\u0437 \u043a\u044d\u0448\u0430 (cache read)",
    "tokens_k": 940
  },
  {
    "label": "\u0417\u0430\u043f\u0438\u0441\u044c \u0432 \u043a\u044d\u0448 (cache write)",
    "tokens_k": 50
  }
]

Это опубликованный пример; на вашей машине числа будут другие, и модель в нём (claude-sonnet-4-6) уже старая, но пропорция типична: входящих токенов от вас 1.2 тыс., ответов модели 5.3 тыс., а повторного чтения контекста из кэша 940 тыс. Почти весь расход это повторная отправка контекста. Ваши собственные слова в нём малая доля. Руководство Anthropic для корпоративных администраторов делает из этого практический вывод: «each Claude Code turn carries file contents, tool calls, and multi-step reasoning, so one debugging session can consume more than a day of chat». Одна сессия отладки может стоить больше, чем день переписки в чате.

Отсюда ответ на вопрос из заголовка. Пять часов Pro вмещают в разы меньше ходов Claude Code, чем ходов чата, и точное число зависит от размера вашего репозитория и от того, как часто модель зовёт инструменты. Как устроен расход в терминале и на что смотреть в первую очередь, разобрано в объяснении расхода токенов Claude Code, а способы держать контекст маленьким собраны в руководстве по управлению контекстом Claude Code.

Русский текст стоит больше токенов, чем английский

Токен это кусок текста из словаря токенизатора, обычно короче слова. Словарь строится на обучающих данных, где английского больше, чем любого другого языка, поэтому частые английские слова попадают в словарь целиком, а слово на кириллице чаще режется на несколько кусков. Одна и та же мысль по-русски занимает больше токенов, чем по-английски: в вашем сообщении и в истории, которая уходит на сервер с каждым ходом. Ответ модели по-русски тоже длиннее в токенах. Русский чат тратит пятичасовое окно быстрее, чем английский с тем же числом сообщений.

Конкретный множитель не приводится намеренно. Коэффициент зависит от токенизатора конкретной модели и от вашей лексики: техническая переписка с английскими терминами и командами режется иначе, чем бытовой русский текст. Документация Anthropic отдельно предупреждает, что модели начиная с Claude 4.7 используют новый токенизатор, который даёт примерно на 30 процентов больше токенов на том же тексте, чем прежние модели, так что любой множитель, измеренный год назад, уже неверен. Измерьте свой.

Как измерить свой коэффициент

У API есть бесплатный endpoint подсчёта токенов, POST /v1/messages/count_tokens. Он принимает тот же JSON, что и обычный запрос к модели, и возвращает только число входящих токенов. Подписка Pro ключа к API не даёт, поэтому нужен аккаунт в Claude Console (platform.claude.com) и ключ из него. Сам подсчёт бесплатен, документация говорит об этом прямо: «Token counting is free to use but subject to requests per minute rate limits». На машине нужны curl и jq.

export ANTHROPIC_API_KEY="sk-ant-..."

count() {
  curl -s https://api.anthropic.com/v1/messages/count_tokens \
    -H "x-api-key: $ANTHROPIC_API_KEY" \
    -H "content-type: application/json" \
    -H "anthropic-version: 2023-06-01" \
    -d "$(jq -n --arg t "$1" '{model: "claude-sonnet-5", messages: [{role: "user", content: $t}]}')" \
  | jq .input_tokens
}

count "Почему не проходит рукопожатие WireGuard, если порт 51820 открыт в файрволе?"
count "Why does the WireGuard handshake fail when port 51820 is open in the firewall?"

Функция count собирает JSON через jq -n --arg, чтобы кавычки и переносы строк в тексте не сломали запрос, отправляет его и печатает поле input_tokens. На выходе два числа; их отношение и есть ваш коэффициент для этой пары фраз. Пара фраз это мало: подставьте вместо них реальный кусок вашей переписки, например экспорт длинного чата и его перевод, и коэффициент станет надёжнее. Подставьте в model ту модель, которой реально пользуетесь в claude.ai, потому что счёт ведётся токенизатором указанной модели.

Если вместо числа печатается null, уберите | jq .input_tokens и посмотрите на полный ответ. Ошибка authentication_error означает, что ключ не тот или переменная ANTHROPIC_API_KEY не экспортирована; ошибка not_found_error с упоминанием model означает опечатку в идентификаторе модели. Число в ответе документация называет оценкой (estimate), фактический счёт может отличаться на несколько токенов. Для сравнения языков этой точности достаточно.

Почему в терминале русский почти ничего не стоит

В Claude Code картина обратная. Как показывает пример выше, почти весь расход сессии это повторное чтение контекста, а контекст состоит из кода, путей к файлам, диффов, вывода компилятора и тестов, JSON от инструментов. Всё это ASCII и не зависит от языка, на котором вы пишете модели. Русская часть хода в терминале это ваш запрос и объяснения модели в ответе, то есть малая доля от общего числа токенов. Пишите Claude Code задачи по-русски, не думая о лимите: разница между русской и английской формулировкой одного запроса мала по сравнению с десятками тысяч токенов контекста.

Два исключения, которые стоит знать. Первое: файл CLAUDE.md уходит на сервер с каждым запросом сессии. Если он написан по-русски и длинный, его цена умножается на число запросов в цепочке каждого хода. Документация советует держать CLAUDE.md короче 200 строк; для русского файла это тем более важно, а инструкции для редких задач лучше вынести в скиллы, которые загружаются только по вызову. Второе: если вы просите Claude Code писать документацию или комментарии по-русски, этот текст кириллический, стоит дороже английского и остаётся в истории сессии. Для длинных русских документов заведите отдельную сессию, чтобы они не тянулись в контекст задач по коду.

Итог для русскоязычного разработчика: самый выгодный способ потратить Pro это терминал. Чат по-русски дороже чата по-английски на измеримую вами величину, а Claude Code по-русски стоит почти столько же, сколько Claude Code по-английски.

Как читать счётчик

На claude.ai откройте Settings, раздел Usage. Справочный центр описывает его так: «navigate to Settings > Usage to view progress bars showing how much of your five-hour session and weekly usage limits you've consumed». Две полосы. Первая: «Current session: How much of your plan's five-hour session limit you've used thus far, plus the amount of time remaining in the session», то есть доля пятичасового окна и время до его сброса. Вторая: «Weekly limits: Check when your plan's weekly usage limit resets for Opus only and all other models», недельный лимит с отдельной полосой для Opus и общей для остальных моделей. Обе полосы считают всё вместе: чат, Claude Code и Claude Desktop.

В Claude Code наберите /usage. На подписке экран показывает те же полосы плана, что и сайт, плюс разбивку: какая доля недавнего расхода пришлась на скиллы, субагентов, плагины и отдельные MCP-серверы, и флаги поведения вроде «long context» или «cache misses», если на них пришлось 10 процентов расхода и больше. Клавиши d и w переключают окно между последними 24 часами и 7 днями. Разбивка считается по локальной истории сессий на этой машине, так что расход с другого компьютера и с claude.ai в неё не попадает; полосы плана при этом общие. Блок Session сверху с суммой в долларах предназначен для тех, кто платит за API; на Pro эта сумма ничего не значит для счёта, документация говорит об этом отдельно. Если хотите видеть заполнение контекста постоянно, выведите его в строку статуса, а /context покажет, что именно занимает место.

Проверьте, чем именно вы платите. Статья справочного центра про Claude Code предупреждает: «If you have an ANTHROPIC_API_KEY environment variable set on your system, Claude Code will use this API key for authentication instead of your Claude subscription», и тогда расход идёт на счёт API, минуя подписку. Команда /status показывает, под каким аккаунтом и каким способом вы вошли; та же статья отсылает к ней и за остатком лимита («Monitor your remaining allocation using the /status command»). Если там указан ключ API вместо подписки, выполните /login и войдите через claude.ai. Разница между двумя способами входа разобрана в сравнении входа по подписке и по API-ключу.

Когда окно кончилось, Claude Code печатает You've hit your session limit или You've hit your weekly limit с временем сброса. Смена модели через /model здесь не помогает: лимит общий для всех моделей. Что делать в этот момент, шаг за шагом описано в инструкции на случай, когда лимит Claude исчерпан.

Когда Pro уже мало: Max, кредиты или API

Два признака, что вы переросли Pro: Claude Code упирается в окно каждый рабочий день, и недельная полоса заполняется к середине недели.

Первый вариант: тариф Max. Это тот же пул использования, но больше, с двумя размерами; чем они отличаются и какой из них имеет смысл при вашем режиме, разобрано в сравнении Max за 100 и за 200 долларов. Второй вариант: кредиты использования (usage credits) поверх подписки. Их включают в том же разделе Settings > Usage, а из терминала туда ведёт команда /usage-credits; с ними работа продолжается после исчерпания окна и оплачивается сверх подписки. Одно следствие для Claude Code стоит знать заранее: на кредитах время жизни кэша падает с часа до пяти минут, поэтому после каждого перерыва длиннее пяти минут контекст обрабатывается заново по полной цене. Третий вариант: чистый API с оплатой за токены, без окон вообще. Он выгоден при неровной нагрузке, когда неделями тихо, а потом два дня плотной работы; при ежедневной работе подписка почти всегда дешевле, и сравнение стоимости API и подписки показывает, где проходит граница. Сколько в итоге стоит Claude Code при каждом из способов оплаты, посчитано в разборе стоимости Claude Code.

Оплата подписки из России и доступность аккаунта это отдельный вопрос со своими условиями; расход лимита от него не зависит.

FAQ

Сколько токенов входит в подписку Claude Pro?

Число не опубликовано. На 12 сентября 2026 года справочный центр Anthropic описывает Pro как «at least five times the usage per session compared to our free service» с сессионным лимитом, который «will reset every five hours», и недельным лимитом «that applies across all models». Число сообщений в окне зависит от длины сообщения, приложенных файлов, длины разговора и модели, поэтому интерфейс показывает процент, без числа токенов.

Claude Code и чат на claude.ai тратят один и тот же лимит?

Да. Формулировка Anthropic: «usage limits that are shared across Claude and Claude Code, meaning all activity in both tools counts against the same usage limits». Разница в скорости расхода: ход чата отправляет на сервер историю разговора и ваше сообщение, а ход Claude Code отправляет всю сессию с системной подсказкой, CLAUDE.md, описаниями инструментов и прочитанными файлами, и делает это по одному запросу на каждый вызов инструмента. Поэтому одна сессия отладки может стоить больше дня переписки.

Почему на русском языке лимит Claude Pro заканчивается быстрее?

Токенизатор режет кириллический текст на большее число кусков, чем английский текст того же смысла, поэтому русское сообщение и русская история чата, которая уходит на сервер с каждым ходом, занимают больше токенов. Точный коэффициент зависит от модели и вашей лексики; измерьте его через endpoint count_tokens, отправив один и тот же текст по-русски и по-английски и сравнив input_tokens. В Claude Code эффект почти незаметен, потому что основной объём контекста там код и вывод инструментов, а они от языка не зависят.

Где посмотреть, сколько лимита Claude Pro осталось?

На claude.ai: Settings > Usage, две полосы, сессионная с временем до сброса и недельная. В Claude Code: команда /usage, которая показывает те же полосы плана и разбивку расхода по скиллам, субагентам и MCP-серверам за 24 часа или 7 дней. Долларовая сумма в блоке Session относится к оплате API и на подписке ничего не значит.

Claude Code стал списывать деньги с API, хотя у меня Pro. Почему?

В окружении задана переменная ANTHROPIC_API_KEY. Справочный центр предупреждает, что в этом случае «Claude Code will use this API key for authentication instead of your Claude subscription». Проверьте /status: там видно, вошли вы по ключу или по подписке. Уберите переменную из окружения, выполните /login и войдите через аккаунт claude.ai.