SSD Nodes Learn Hosting plans →
Руководства Matt ConnorАвтор: Matt Connor

Что расходует лимит сообщений в Claude Pro

Anthropic не раскрывает точное число токенов для подписки Claude Pro. Узнайте, как длина диалога, вложения, изображения и работа агентов влияют на исчерпание вашего лимита.

Что расходует лимит Claude Pro

Anthropic не публикует точное количество токенов для подписки Claude Pro, поэтому никто не может назвать ваш лимит в токенах. Однако можно определить, что именно его расходует, и это гораздо полезнее: в первую очередь это длина диалога, затем вложения и изображения, далее — вычислительные затраты на «мышление», а также работа инструментов и агентов.

Токен — это фрагмент текста, примерно равный короткому слову или части длинного слова. Каждый отправленный вами запрос измеряется в токенах, и ваш тарифный план учитывает их в фоновом режиме. На странице Anthropic с рекомендациями по использованию лимитов перечислены факторы, влияющие на этот счетчик: длина сообщения, размер вложенных файлов, текущая длина диалога, использование инструментов (таких как Research и поиск в интернете), выбор модели, уровень сложности задачи и создание артефактов. Каждый пункт из этого списка выполняет одну и ту же функцию. Каждый из них меняет количество токенов, содержащихся в одном запросе.

Два смежных вопроса вынесены на отдельные страницы. Какой объем использования включен в план Pro описывает размер лимита и объясняет, почему он измеряется в сессиях, а не в токенах. Что делать после достижения лимита описывает процесс восстановления доступа. Эта страница посвящена тому, куда именно расходуются ресурсы.

Каждое сообщение отправляет всю историю переписки заново

Этот механизм удивляет почти всех. У модели нет памяти между итерациями. Чтобы ответить на ваше следующее сообщение, она заново считывает всю переписку с первого слова. Документация Anthropic прямо указывает на это: каждый запрос повторно отправляет полную историю диалога.

Следовательно, уточняющий вопрос из пяти слов — это не запрос из пяти слов. Это вся ветка обсуждения плюс пять слов.

Стоит один раз выполнить расчеты. Допустим, каждая итерация добавляет около 500 токенов, включая ваше сообщение и ответ Claude. Вторая итерация отправляет около 1 000 токенов. Десятая — около 5 000. Двадцатая — около 10 000, что в десять раз больше стоимости второй итерации при том же объеме вашего текста. За двадцать итераций ветка перенесла в общей сложности около 105 000 токенов, тогда как те же двадцать вопросов в двадцати новых чатах заняли бы около 10 000. Эти цифры скорее арифметические, чем точные замеры, но общая картина верна.

Именно поэтому одна и та же видимая работа может стоить по-разному. Вы в любом случае ввели одинаковое количество слов. Разница возникла из-за объема истории, накопленной над ними.

У длинных веток есть вторая статья расходов. Когда переписка приближается к пределу контекстного окна (200 000 токенов в тарифе Pro по состоянию на сентябрь 2026 года), Claude суммирует ранние сообщения, чтобы чат мог продолжаться. Anthropic отмечает, что диалоги, запускающие такое автоматическое управление контекстом, потребляют больше вашего лимита использования. Суммирование — это реальная работа, и вы оплачиваете её из того же лимита.

Вы можете наблюдать за этим процессом. Откройте Settings, затем Usage, где в тарифе Pro отображаются индикаторы выполнения для пятичасового и недельного окон. Отправьте двадцатое сообщение в длинной ветке, затем первое сообщение в новом чате и сравните, насколько продвинулся индикатор. В разделе Как работают сессионное и недельное окна описано, когда сбрасывается каждое из них.

Сколько стоят файл или PDF?

ChartInput tokens counted for four short requests
The data behind this chart
[
  {
    "label": "Text question only",
    "input_tokens": 14
  },
  {
    "label": "One tool definition plus a question",
    "input_tokens": 403
  },
  {
    "label": "One JPEG photo plus a question",
    "input_tokens": 1028
  },
  {
    "label": "One small PDF plus a question",
    "input_tokens": 2188
  }
]

Это примеры вывода, опубликованные в документации по подсчету токенов от Anthropic, измеренные для claude-opus-5. Четыре промпта немного различаются, поэтому оценивайте размер разницы, а не точные цифры. Короткий текстовый вопрос занял 14 входных токенов. Фотография с коротким вопросом заняла 1028. Один небольшой PDF-файл (portable document format) с коротким вопросом занял 2188, что примерно в 150 раз больше, чем простой вопрос.

Теперь объедините это с описанной выше повторной отправкой данных. Вложение преобразуется в токены один раз, а затем передается с каждым последующим шагом диалога. Прикрепите 40-страничный отчет в первом сообщении, и вы будете платить за эти 40 страниц снова во втором, третьем и двадцатом сообщении.

Опубликованные цифры стоимости за страницу велики. В API (application programming interface), где задокументированы эти показатели, одна страница PDF обычно потребляет от 1 500 до 3 000 текстовых токенов в зависимости от плотности текста, плюс стоимость изображения страницы, так как каждая страница также преобразуется в графический формат. Таким образом, сорок страниц стоят более 60 000 токенов еще до того, как был задан какой-либо вопрос. При контекстном окне в 200 000 токенов это значительная часть объема, потраченная на страницы, которые могут вам не понадобиться.

Поэтому правило простое. Прикрепляйте только ту часть, которая вам нужна, а не весь файл целиком. Если вы просите Claude прочитать отчет и найти условия оплаты, это стоит вам стоимости всего отчета на каждом последующем шаге диалога. Копирование раздела с условиями оплаты стоит несколько сотен токенов один раз.

Почему скриншоты обходятся дороже, чем кажется

ChartVisual tokens for one image, by pixel size and model tier
The data behind this chart
[
  {
    "label": "200 x 200 crop",
    "standard_tokens": 64,
    "high_res_tokens": 64
  },
  {
    "label": "1000 x 1000 screenshot",
    "standard_tokens": 1296,
    "high_res_tokens": 1296
  },
  {
    "label": "1920 x 1080 screenshot",
    "standard_tokens": 1560,
    "high_res_tokens": 2691
  },
  {
    "label": "3840 x 2160 screenshot",
    "standard_tokens": 1560,
    "high_res_tokens": 4784
  }
]

Claude считывает изображение как сетку фрагментов. Каждый фрагмент представляет собой блок размером 28 на 28 пикселей и считается одним визуальным токеном. Таким образом, стоимость изображения рассчитывается как ширина, деленная на 28 (с округлением в большую сторону), умноженная на высоту, деленную на 28 (с округлением в большую сторону). Скриншот размером 1000 на 1000 пикселей стоит 1296 визуальных токенов, что превышает объем большинства пользовательских запросов.

Выбор модели также влияет на этот показатель. Claude 4.7 и более поздние модели считывают изображения с более высоким разрешением. Полноразмерный 4K-скриншот в них стоит 4784 визуальных токенов против 1560 в старой модели, которая предварительно уменьшает изображение. Один и тот же файл, один и тот же экран, но количество токенов различается примерно в три раза.

Приложение Claude позволяет отправить до 20 изображений в одном сообщении. Двадцать полноразмерных скриншотов — это очень объемный запрос еще до того, как вы ввели какой-либо текст, и каждое последующее сообщение в этом чате будет снова содержать их все. Используйте кадрирование. Фрагмент изображения размером 200 на 200 пикселей с текстом ошибки стоит 64 визуальных токенов, и обычно он дает больше информации для ответа, чем снимок всего рабочего стола.

Сколько стоят уровень мышления и затраченные усилия?

Уровень усилий определяет, сколько времени Claude тратит на размышления перед ответом. В приложении Claude этот параметр находится в меню выбора модели рядом с кнопкой отправки, а уровни варьируются от низкого (low) до среднего (medium), высокого (high), очень высокого (extra high) и максимального (max). Anthropic прямо указывает на компромисс: более высокий уровень усилий расходует больше токенов, поэтому лимиты использования достигаются быстрее. На той же странице рекомендуется использовать низкий или средний уровень для рутинных задач, так как меньшие усилия позволяют эффективнее расходовать лимиты.

У процесса мышления есть и «хвост». В моделях, которые сохраняют историю предыдущих сообщений, процесс мышления из прошлых ответов учитывается как входные токены (input tokens) при каждом последующем обращении в рамках этого диалога. Длительная сессия рассуждений оплачивается один раз в момент выполнения, а затем частично учитывается в каждом последующем сообщении.

Выбор модели имеет еще один эффект, который часто упускают из виду. Токенизатор — компонент, разбивающий текст на токены — изменился в Claude 4.7. Тот же самый входной текст генерирует примерно на 30 процентов больше токенов в Claude 4.7 и более поздних моделях, чем в предыдущих версиях. Anthropic не публикует данные о том, как эти показатели конвертируются в долю лимита Pro, поэтому воспринимайте это как повод использовать более легкие настройки для рутинной работы, а не как фиксированный обменный курс. В модели оплаты по факту использования (pay as you go) система учета является публичной, и входные и выходные токены там тарифицируются по-разному.

Почему агенты и Claude Code быстрее всего исчерпывают лимиты

Claude Code и приложение Claude используют общую квоту.

Планы Pro и Max предоставляют лимиты использования, общие для Claude и Claude Code. Это означает, что вся активность в обоих инструментах учитывается в рамках одних и тех же лимитов.

Работа агента подразумевает чтение гораздо большего объема данных, чем запись. Один запрос на исправление ошибки может привести к открытию десяти файлов, выполнению поиска, чтению результатов и ответу, состоящему из четырех строк пояснений. Вы видите четыре строки. Лимит же учитывает каждый файл, который был прочитан в процессе. Это самый большой разрыв между тем, как выглядит сессия, и тем, сколько она стоит.

Инструменты также потребляют токены еще до того, как вы зададите вопрос, поскольку описание каждого инструмента передается вместе с запросом. В приведенных выше опубликованных примерах короткий вопрос без использования инструментов учитывал 14 входных токенов, в то время как короткий вопрос с определением одного инструмента — 403. Реальные агентские конфигурации содержат гораздо больше инструментов, чем один.

Внутри Claude Code команда /status показывает, сколько ресурсов осталось в вашей сессии. Поддержание небольшого рабочего контекста — самый эффективный рычаг управления, и в управлении контекстом в длительной сессии Claude Code описано, как это делать. В статье Накладные расходы, которые несет агентская обвязка до вашей первой инструкции объясняется остальная часть этого разрыва.

Почему одна и та же работа стоит дороже на некоторых языках

Токенизатор был настроен преимущественно на английский текст, поэтому обычные английские слова часто соответствуют одному токену. Тот же смысл, выраженный на русском, арабском, хинди или японском языках, обычно разбивается на большее количество токенов, что означает, что идентичный вопрос расходует больше вашего лимита. Механика работы на этой странице везде одинакова. Цена за предложение — нет.

Измеряйте свой собственный случай, вместо того чтобы доверять оценкам. Эндпоинт Anthropic для подсчета токенов бесплатен и возвращает количество входных токенов для любого сообщения:

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "content-type: application/json" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-opus-5",
    "messages": [{"role": "user", "content": "Paste your paragraph here"}]
  }'

Ответ представляет собой одну строку:

{"input_tokens": 14}

Запустите его дважды: один раз с английским абзацем, а второй раз с тем же абзацем на вашем языке, затем сравните два числа. Вызов ничего не стоит, но для него требуется API key из Claude Console на платформе platform.claude.com, которая является отдельной учетной записью, отличной от вашей подписки Pro. Переход на английский обычно является плохим решением, так как вы думаете и пишете быстрее на своем родном языке. Вместо этого старайтесь делать ветки обсуждений короткими, а вложения — небольшими. Эти две привычки принесут вам больше пользы, чем англоговорящему пользователю.

Привычки, позволяющие продлить действие плана Pro

  • Начинайте новый диалог при смене темы. Это самая важная привычка из списка, так как длина ветки обсуждения увеличивает стоимость каждого последующего сообщения.
  • Прикрепляйте нужную часть, а не весь файл. Три страницы вместо сорока.
  • Обрезайте скриншоты до области с сообщением об ошибке.
  • Размещайте постоянный контекст в проекте, а не вставляйте его в каждый новый чат. Anthropic указывает, что содержимое проектов кэшируется и не учитывается при расчете лимитов при повторном использовании, поэтому руководства по стилю или схемы следует добавлять в базу знаний проекта.
  • Используйте низкий или средний уровень усилий для рутинных вопросов, а высокий — для задач, которые этого требуют.
  • Задавайте весь вопрос целиком в одном сообщении. Три раунда уточнений стоят дороже, чем одно подробное сообщение, так как каждый раунд приводит к повторной отправке всей истории переписки выше.

Когда лимит уже исчерпан

Тариф Pro стоит 20 долларов в месяц при ежемесячной оплате или 17 долларов в месяц при оплате за год (по состоянию на сентябрь 2026 года). Anthropic заявляет, что этот тариф предоставляет как минимум в пять раз больше лимитов на использование за пятичасовой сеанс по сравнению с бесплатным планом. В разделе Стоимость Pro и его ограничения приведено описание самого плана. Описанные выше привычки позволяют эффективно расходовать лимиты, но у них всё равно есть предел. Если лимит заканчивается раз в месяц, это не критично. Если же вы исчерпываете его каждые несколько дней при выполнении оплачиваемой работы, лучше уделить время изучению вопроса стоит ли переходить на тариф Max.

FAQ

Почему мой лимит Claude Pro сегодня закончился так быстро?

Почти всегда причина в длинной переписке, вложении или в том и другом одновременно. Каждое сообщение отправляет всю историю диалога заново, поэтому двадцатое сообщение стоит во много раз дороже, чем второе, даже если вы ввели одинаковое количество слов. Прикрепленный файл каждый раз отправляется вместе с ним. Откройте Settings, затем Usage, чтобы увидеть, сколько из пятичасового сеанса и недельного окна вы уже использовали, а затем начните отдельные чаты для несвязанных вопросов.

Помогает ли экономить лимиты начало нового диалога?

Да, это самая эффективная привычка. Новый чат начинается без истории, поэтому первое сообщение стоит только столько, сколько вы написали. Минус в том, что Claude больше не знает, о чем шла речь ранее, поэтому вставьте краткое резюме полезной части вместо всей предыдущей переписки. Если вставить весь старый диалог в новый чат, вы воссоздадите ту же проблему, от которой пытались уйти.

Продолжают ли прикрепленные файлы расходовать лимит после первого сообщения?

Да, в рамках одного диалога. Файл преобразуется в токены один раз, и эти токены становятся частью истории диалога, которую несет в себе каждый последующий запрос. 40-страничный PDF остается в запросе до тех пор, пока чат не будет завершен. Исключением являются файлы, размещенные в проектах, так как Anthropic заявляет, что содержимое проектов кэшируется и не учитывается в лимитах при повторном использовании.

Расходует ли написание текста не на английском языке больше лимита?

Обычно да. Токенизатор разбивает неанглийский текст на большее количество токенов для передачи того же смысла, поэтому идентичный вопрос на русском или японском языке стоит дороже, чем на английском. Вы можете самостоятельно измерить разницу, подсчитав количество токенов в одном и том же абзаце на обоих языках с помощью бесплатного API для подсчета токенов. Старайтесь поддерживать короткие диалоги и небольшие вложения, вместо того чтобы менять язык. Эти привычки экономят для вас больше ресурсов, чем для англоговорящего пользователя.

Использует ли Claude Code тот же лимит, что и приложение Claude?

Да. Anthropic заявляет, что лимиты использования Pro и Max являются общими для Claude и Claude Code, поэтому активность в обоих сервисах учитывается в рамках одних и тех же ограничений. Агентские сессии расходуют лимит быстро, так как один запрос может прочитать множество файлов и выполнить несколько инструментов перед ответом. Выполните /status внутри Claude Code, чтобы увидеть, сколько осталось от текущего сеанса.