SSD Nodes Learn 🎉 VPS от $4.99/мес
Руководства Matt ConnorАвтор: Matt Connor · Обновлено 2026-08-07

Что делать, если достигнут лимит использования Claude

Превысили лимит Claude? Узнайте, как определить тип окна ожидания и восстановить работу через смену модели, сокращение контекста, покупку credits или переход на API.

Какой лимит Claude вы превысили

Сообщение о достижении лимита Claude указывает на временное окно, которого вам нужно дождаться, и именно это окно определяет ваши дальнейшие действия. Сессионные и еженедельные лимиты распространяются на все модели одновременно, поэтому переключение между ними не восстановит доступ. Исключением является лимит, относящийся к конкретной модели: смените модель, и вы сможете продолжить работу, пока эта конкретная модель остается заблокированной.

Claude Code выводит временное окно и время его сброса в одной строке:

You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pm

Сессионное окно представляет собой скользящий интервал в пять часов. Еженедельные окна сбрасываются в фиксированное время каждую неделю, закрепленное за вашей учетной записью, поэтому день и час остаются неизменными от недели к неделе. План Pro включает пятичасовое сессионное окно и один еженедельный лимит, действующий для всех моделей. План Max добавляет второй еженедельный лимит, который применяется к отдельному семейству моделей. Сами значения лимитов приведены в полном обзоре лимитов использования Claude. Эта страница продолжает тему, на которой заканчивается тот документ.

Вот момент, на котором часто ошибаются пользователи. Каждый запрос учитывается одновременно в сессионном и еженедельном окне, поэтому один продуктивный день может исчерпать еженедельный лимит, даже если в пятичасовом окне еще есть запас. Прежде чем планировать остаток дня, ознакомьтесь со временем сброса. Сброс в 3:45pm — это повод для перерыва на кофе. Сброс в понедельник в полночь — нет.

Проверяйте показатели, прежде чем делать выводы

На сайте claude.ai откройте Settings, а затем Usage. Индикаторы выполнения показывают, сколько времени из пятичасового окна сессии и каждого недельного окна вы уже использовали. Это позволяет увидеть, какой лимит исчерпан, вместо того чтобы гадать.

В Claude Code выполните /usage. Команда отображает те же индикаторы плана, а также детализацию расхода ресурсов: распределение по навыкам, субагентам, плагинам и отдельным серверам MCP (model context protocol) в процентах от общего объема. Нажмите d для просмотра данных за последние 24 часа и w за последние 7 дней. Инструмент также помечает любые закономерности, на которые приходится 10% или более недавнего использования; чаще всего вы будете видеть длинный контекст (long context) и промахи кэша (cache misses).

Два важных замечания. Детализация рассчитывается на основе истории сессий, сохраненной на данном компьютере, поэтому работа, выполненная на другом ноутбуке или через claude.ai, в ней не учитывается. Сумма в долларах в блоке Session в верхней части экрана рассчитывается по стандартным тарифам для пользователей API (application programming interface), поэтому она не отражает ваш реальный счет при наличии подписки.

Помогает ли переключение на меньшую модель?

Только если в сообщении указана конкретная модель. После You've hit your Opus limit выполните /model, выберите Sonnet или Haiku, и сессия продолжится с сохранением всего контекста. После You've hit your session limit или You've hit your weekly limit команда /model ничего не меняет, так как эти окна являются общими для всех моделей.

Переключение приносит гораздо больше пользы до того, как вы упретесь в лимиты, а не после. Sonnet справляется с большинством задач по программированию за малую часть стоимости Opus, поэтому использование Opus по умолчанию — одна из двух привычек, приводящих к неожиданным расходам. Вторая привычка — никогда не очищать сессию. Поручайте механическое редактирование кода и разбор логов модели Haiku, а Opus оставляйте для архитектурных решений, в которых вы действительно зашли в тупик. В Выбор между Opus, Sonnet и Haiku подробно описано, в каких случаях каждая из моделей оправдывает свою стоимость.

Перестаньте платить за контекст, который больше не используете

Claude Code отправляет всю историю вашего диалога с каждым запросом, а при каждом использовании инструмента отправляет еще один запрос, содержащий пакет результатов работы этого инструмента. Prompt caching означает, что история считывается по кэшированной ставке, а не по полной ставке входных данных, что делает её дешевле, но не бесплатной. Таким образом, однострочный вопрос в сессии, открытой с самого утра, всё равно расходует лимиты на весь объем диалога.

/context
/clear
/compact Focus on the failing tests and the files we changed

/clear ничего не стоит, так как отбрасывает контекст, а не считывает его. /compact вынужден считывать диалог, который он суммирует, поэтому сжатие очень большого контекста само по себе является объемным запросом. Используйте /clear, когда переходите к несвязанным задачам, и /compact только тогда, когда вы находитесь в процессе выполнения задачи и вам нужно сохранить цепочку обсуждения. Запустите /rename перед очисткой, чтобы иметь возможность найти сессию позже с помощью /resume.

Время жизни кэша важнее, чем кажется большинству пользователей. При наличии подписки кэш живет один час. Он сокращается до пяти минут, как только вы начинаете расходовать кредиты, и пять минут также являются значением по умолчанию для API key. Ваше первое сообщение после долгого обеденного перерыва не попадает в кэш и повторно обрабатывает весь контекст по полной стоимости входных данных, именно поэтому расходы часто возрастают без видимой причины. Когда prompt caching окупает себя содержит необходимые расчеты.

В том же месте находятся еще три рычага управления. /mcp выводит список настроенных серверов, чтобы вы могли отключить те, которые не нужны для текущей задачи. Объемный файл CLAUDE.md загружается при запуске сессии независимо от того, требуется ли он для работы, поэтому переместите специализированные инструкции в навыки (skills), которые загружаются только при вызове. Расширенное мышление (extended thinking) тарифицируется как выходные токены, что является более дорогой частью, поэтому уменьшите его с помощью /effort, отключите в /config или установите MAX_THINKING_TOKENS=8000 для модели с фиксированным бюджетом на мышление.

Разбивайте задачу так, чтобы она помещалась в одно окно

Нажимайте Shift+Tab для перехода в режим планирования перед внесением масштабных изменений. Claude изучит кодовую базу и предложит план действий на ваше утверждение. Ошибочное направление, выявленное на этом этапе, стоит одного плана, а не двух часов правок и последующей переделки.

Делегируйте ресурсоемкие операции субагентам. Запуск набора тестов или чтение лога объемом 10 000 строк внутри субагента сохраняет «сырой» вывод в контексте этого субагента, а в основной диалог возвращается только краткое резюме.

Нажимайте Escape в тот момент, когда Claude начинает двигаться в неверном направлении. /rewind восстанавливает как диалог, так и код до предыдущей контрольной точки, поэтому вам не придется оплачивать отмену работы, которая вам не была нужна.

Стоит ли покупать кредиты на использование или использовать API?

Кредиты на использование позволяют аккаунтам уровня Pro или Max продолжать работу после исчерпания лимитов тарифного плана; оплата при этом списывается по стандартным тарифам API. Включите их в разделе Settings, а затем Usage на claude.ai при условии привязанного способа оплаты, либо выполните /usage-credits в Claude Code — это откроет настройки биллинга в браузере. Кредиты распространяются на диалоги в Claude и использование терминала Claude Code с суточным лимитом списания в 2000 долларов. Команда требует авторизации через подписку, поэтому она недоступна при аутентификации с помощью API key.

Другой путь — использование обычного API key из Claude Console, где оплата производится за каждый токен без привязки к сессиям или недельным лимитам. Здесь есть один нюанс: случайно оставленная переменная ANTHROPIC_API_KEY в окружении заставит Claude Code работать через этот ключ, а не через вашу подписку, причем без уведомления. Вы узнаете об этом из счета или из следующего сообщения:

API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.

Ошибка 429 означает достижение лимита запросов для ключа, а не для вашего тарифного плана. Выполните /status и убедитесь, что активные учетные данные соответствуют тем, которые вы планировали использовать.

Во сколько обходится день работы с API?

Приведенный ниже пример — это один день работы в стиле агента: 200 000 некэшированных входных токенов, 1,8 миллиона чтений из кэша и 150 000 выходных токенов. Цены указаны согласно прайс-листу Anthropic на август 2026 года.

ChartOne afternoon of agent work priced at API list rates, August 2026
The data behind this chart
[
  {
    "label": "Opus 5",
    "input_usd_per_mtok": 5,
    "cache_read_usd_per_mtok": 0.5,
    "output_usd_per_mtok": 25,
    "afternoon_usd": 5.65
  },
  {
    "label": "Sonnet 5",
    "input_usd_per_mtok": 2,
    "cache_read_usd_per_mtok": 0.2,
    "output_usd_per_mtok": 10,
    "afternoon_usd": 2.26
  },
  {
    "label": "Haiku 4.5",
    "input_usd_per_mtok": 1,
    "cache_read_usd_per_mtok": 0.1,
    "output_usd_per_mtok": 5,
    "afternoon_usd": 1.13
  }
]

Тот же день работы стоит $5.65 при использовании Opus 5 и $1.13 при использовании Haiku 4.5. Итоговую сумму определяет объем вывода: при цене $25 за миллион токенов для Opus 5 против $5 для Haiku 4.5, 150 000 токенов, которые генерирует Claude, стоят дороже, чем 2 миллиона токенов, которые он считывает. Именно поэтому сокращение бюджета на «мышление» экономит больше средств, чем удаление лишних файлов.

Важная дата: на Sonnet 5 действуют вводные цены в размере $2 и $10 за миллион входных и выходных токенов до 31 августа 2026 года. С 1 сентября 2026 года цена повышается до $3 и $15, что увеличивает стоимость того же дня работы с $2.26 примерно до $3.39.

Как рассчитывается стоимость дня работы

Opus 5: 200 000 некэшированных входных токенов по цене $5 за миллион составляют $1.00. 1,8 миллиона чтений из кэша по цене в одну десятую от входного тарифа составляют $0.90. 150 000 выходных токенов по цене $25 за миллион составляют $3.75. Итого $5.65.

Sonnet 5: $0.40 за некэшированный ввод, $0.36 за чтение из кэша, $1.50 за вывод. Итого $2.26.

Haiku 4.5: $0.20 за некэшированный ввод, $0.18 за чтение из кэша, $0.75 за вывод. Итого $1.13.

Все 3 строк предполагают одинаковое количество токенов, поэтому разница между ними обусловлена исключительно ценой. В реальных условиях стоимость дня зависит от того, какая часть вашего контекста остается в кэше.

Для масштаба: согласно собственной документации Anthropic, средние расходы на Claude Code в корпоративных средах составляют около $13 на разработчика в активный день, и менее $30 в активный день для 90% пользователей по состоянию на август 2026 года. Оплата за токены не всегда выгоднее подписки. Она выигрывает при неравномерной нагрузке, так как в дни простоя расходы равны нулю, но проигрывает при ежедневной работе. В сравнении API и подписки на реальных цифрах показана точка окупаемости.

Запуск длительной задачи на VPS в ночное время

Некоторые задачи не требуют вашего контроля: масштабный рефакторинг, тестовая миграция или проверка документации. Такие задачи также не требуют использования лимитов вашей подписки. Запустите их на VPS (виртуальном выделенном сервере) с использованием API-ключа: оплата будет производиться за каждый токен, а квота вашего тарифного плана останется нетронутой для интерактивной работы на следующий день.

Установите Claude Code на машину с Ubuntu и убедитесь, что он работает:

curl -fsSL https://claude.ai/install.sh | bash
claude --version

claude --version должен вывести строку версии, например 2.1.211 (Claude Code). Ошибка command not found означает, что ~/.local/bin еще не добавлен в ваш PATH, поэтому откройте новую оболочку и попробуйте снова.

Сохраните ключ в файл, а не в историю команд оболочки. Создайте ~/.claude-env в редакторе, добавив одну строку export ANTHROPIC_API_KEY=sk-ant-your-key-here, затем ограничьте права доступа к файлу и загрузите переменную:

chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10

Последняя команда выводит первые десять символов ключа. Этого достаточно, чтобы убедиться в установке переменной, не отображая весь ключ на экране.

Теперь запустите задачу внутри tmux, чтобы она не прервалась при закрытии ноутбука:

tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
  --allowedTools "Read,Edit,Bash" \
  --append-system-prompt-file ./CLAUDE.md \
  --output-format json > ~/overnight.json

Отключитесь от сессии с помощью Ctrl-b, затем d, и закройте соединение. Позже вы сможете вернуться к сессии с помощью tmux attach -t overnight. В Claude Code в сессии tmux на VPS подробно описано управление сессиями.

Параметр --bare здесь важен. Он пропускает автоматический поиск хуков, навыков, плагинов и файла CLAUDE.md, а также не считывает OAuth-учетные данные. Таким образом, запуск выполняется исключительно с использованием API-ключа. Именно это позволяет не расходовать лимиты подписки. Это также означает, что правила проекта не будут применены, поэтому --append-system-prompt-file принудительно их возвращает. Без --bare установленный флаг ANTHROPIC_API_KEY вызывает запрос на подтверждение, на который автоматизированный процесс не сможет ответить.

Утром изучите результат и стоимость в JSON-файле:

jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.json

Claude Code возвращает код 0 при успешном завершении и ненулевой код при ошибке. Это позволяет использовать скрипт-обертку, который проверяет статус завершения и отправляет уведомление об ошибке по почте. Установите лимит расходов в Claude Console перед тем, как оставить задачу работать: агент в цикле повторных попыток в 3 часа ночи — реальный способ потратить реальные деньги. Уменьшите CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY, если хотите замедлить работу агента. В Контроль расходов для работающих в фоне агентов описаны ограничения, которые стоит установить в первую очередь.

Выделите для задачи отдельного пользователя с ограниченными правами и собственную ветку git. Агент, редактирующий репозиторий без присмотра, иногда может сделать то, что вы бы остановили, и работа в отдельной ветке превращает это в git checkout, а не в инцидент. В Безопасный запуск агента для программирования на VPS описаны методы изоляции.

Для массовых задач, не требующих интерактивного взаимодействия, таких как классификация тысяч записей, Batch API обрабатывает запросы асинхронно со скидкой 50% на входные и выходные токены. Это самый дешевый способ оплаты за токены, предлагаемый Anthropic, а ночное время — именно тот период ожидания, который требуется для такой обработки.

Что не поможет восстановить доступ

Начало нового диалога не восстанавливает лимит. Использование учитывается для учетной записи, а не для конкретного диалога. Тем не менее, каждое последующее сообщение становится дешевле, так как новый диалог не содержит истории для повторного чтения, поэтому это полезное действие. Это способ снижения затрат, а не сброс лимитов.

Удаление старых диалогов не возвращает потраченные ресурсы. Токены были списаны в момент обработки запросов.

Переключение моделей после исчерпания лимита сессии или недели не дает результата, так как эти окна общие для всех моделей. Только сообщение, в котором указана модель, отвечает на /model.

Повторные попытки в цикле не приносят результата и лишь занимают терминал. Время сброса, указанное в сообщении, является точным ответом, а /usage покажет тот же таймер без ошибки.

FAQ

Через сколько времени сбросится мой лимит Claude?

Это указано в сообщении. Лимиты сессии действуют в рамках скользящего пятичасового окна, и в сообщении отображается точное время, например resets 3:45pm. Еженедельные лимиты сбрасываются в фиксированное время, закрепленное за вашей учетной записью, и в сообщении указывается день, например resets Mon 12:00am. Чтобы увидеть обе шкалы и время сброса до того, как вы исчерпаете лимит, выполните /usage в Claude Code или откройте Settings, а затем Usage на claude.ai.

Поможет ли переключение на Sonnet возобновить работу?

Только если в сообщении указана конкретная модель. После You've hit your Opus limit выполните /model, выберите другую модель, и сессия продолжится с сохранением вашего контекста. После You've hit your session limit или You've hit your weekly limit выбор модели не имеет значения, так как эти лимиты учитывают использование всех моделей вместе. Переключение на более экономичную модель до того, как вы упретесь в лимит, — это именно то, что позволяет продлить работу в рамках окна.

Сбросит ли создание нового чата мой лимит использования?

Нет. Использование учитывается для всей учетной записи, поэтому новый чат начинается с тем же остатком лимита. Это делает каждое последующее сообщение дешевле, так как в новой беседе нет истории, которую Claude должен перечитывать. /clear в Claude Code делает то же самое и ничего не стоит, в то время как /compact вынуждает систему прочитать беседу, которую она суммирует, поэтому сжатие очень длинной сессии само по себе является затратным запросом.

Дешевле ли использовать API, чем обновлять тарифный план?

Это зависит от того, насколько равномерно вы работаете. Рабочий день, описанный на этой странице, стоит $2.26 при использовании Sonnet 3.5 и $1.13 при использовании Haiku 3.5 по тарифам на август 2026 года. Подписка — это фиксированная плата за ограниченный объем, поэтому она выгоднее, если вы работаете почти каждый день. Оплата за токены выгоднее при неравномерной нагрузке, так как в дни простоя вы не платите ничего.

Могу ли я оставить задачу выполняться, пока жду сброса лимита?

Да, если вы перенесете ее за пределы подписки. Запустите задачу на VPS с установленной переменной окружения ANTHROPIC_API_KEY, и оплата будет производиться за токены, а не расходовать лимит вашего плана, поэтому они не будут конфликтовать. claude --bare -p внутри tmux продолжит работу после закрытия ноутбука, а --output-format json запишет поле total_cost_usd, которое вы сможете проверить утром с помощью jq.