Що робити, якщо досягнуто ліміт використання Claude
Вичерпали ліміти Claude? Дізнайтеся, як працюють сесійні та тижневі вікна очікування. Оберіть оптимальний шлях: перехід на іншу модель, скорочення контексту або використання API.
Який ліміт Claude ви перевищили
Повідомлення про досягнення ліміту Claude вказує часове вікно, на яке ви очікуєте, і саме це вікно визначає ваші подальші дії. Сесійні та тижневі ліміти поширюються на всі моделі одночасно, тому перемикання між ними не відновить ваш доступ. Винятком є ліміт, що стосується лише однієї моделі: змініть модель і продовжуйте роботу, поки ця конкретна модель залишається заблокованою.
Claude Code виводить вікно та час його скидання в одному рядку:
You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pmСесійне вікно — це п'ять годин, що постійно оновлюються. Тижневі вікна скидаються у фіксований час кожного тижня, закріплений за вашим обліковим записом, тому день і година залишаються незмінними з тижня в тиждень. План Pro має п'ятигодинне сесійне вікно та один тижневий ліміт, що діє для всіх моделей. План Max додає другий тижневий ліміт, який застосовується окремо до одного сімейства моделей. Самі обмеження наведено в повному огляді лімітів використання Claude. Ця сторінка продовжує тему, на якій завершується той огляд.
Ось момент, на якому часто виникають труднощі. Кожен запит одночасно враховується і в сесійному, і в тижневому вікні, тому один насичений роботою день може вичерпати тижневий ліміт, навіть якщо в п'ятигодинному вікні ще є запас. Перевірте час скидання, перш ніж планувати решту дня. Скидання о 15:45 — це час на каву. Скидання в понеділок опівночі — ні.
Перевірте показники, перш ніж робити припущення
На claude.ai відкрийте Settings, а потім Usage. Індикатори виконання показують, скільки часу ви використали у межах п'ятигодинного сеансу та кожного тижневого вікна. Це дає змогу побачити, який ліміт вичерпано, замість того щоб вгадувати.
У Claude Code виконайте /usage. Команда відображає ті самі індикатори плану, а також детальний звіт про використання ресурсів, розподілений за навичками, субагентами, плагінами та окремими серверами MCP (model context protocol) у відсотках від загального обсягу. Натисніть d для перегляду даних за останні 24 години та w за останні 7 днів. Система також позначає будь-які патерни, що становлять 10% або більше від нещодавнього використання; найчастіше ви бачитимете довгий контекст (long context) та промахи кешу (cache misses).
Два зауваження. Деталізація розраховується на основі історії сеансів, що зберігається на цьому пристрої, тому робота, виконана на іншому ноутбуці або через claude.ai, у звіті не відображається. Крім того, сума в доларах у блоці Session у верхній частині розрахована за стандартними тарифами для користувачів API (application programming interface), тому вона не відображає ваш фактичний рахунок, якщо ви користуєтеся підпискою.
Чи допомагає перехід на меншу модель?
Лише тоді, коли в повідомленні вказано назву моделі. Після You've hit your Opus limit запустіть /model, оберіть Sonnet або Haiku, і сесія продовжиться з усім контекстом. Після You've hit your session limit або You've hit your weekly limit команда /model нічого не змінить, оскільки ці вікна є спільними для всіх моделей.
Перемикання має набагато більше сенсу до того, як ви досягнете ліміту, а не після. Sonnet виконує більшість завдань із програмування за частку вартості Opus, тому використання Opus як стандартної моделі є однією з двох звичок, що призводять до несподіваних витрат. Інша звичка — сесія, яку ніколи не очищують. Доручайте механічне редагування та аналіз журналів моделі Haiku, а Opus залишайте для архітектурних рішень, у яких ви дійсно зайшли в глухий кут. Вибір між Opus, Sonnet та Haiku детально описує, у яких випадках кожна з них виправдовує свою ціну.
Припиніть платити за контекст, який ви більше не використовуєте
Claude Code надсилає всю історію вашої розмови з кожним запитом, і щоразу, коли Claude використовує інструмент, він надсилає ще один запит, що містить пакет результатів роботи цього інструмента. Кешування промптів (prompt caching) означає, що історія зчитується за кешованим тарифом, а не за повною вартістю вхідних даних, що робить її дешевшою, але не безкоштовною. Тому навіть запитання з одного рядка в сесії, яку ви тримаєте відкритою з ранку, все одно враховує використання для всієї розмови.
/context
/clear
/compact Focus on the failing tests and the files we changed/clear нічого не коштує, оскільки він відкидає контекст, замість того щоб зчитувати його. /compact має зчитати розмову, яку він підсумовує, тому стиснення дуже великого контексту саме по собі є великим запитом. Використовуйте /clear, коли переходите до непов’язаних завдань, і /compact лише тоді, коли ви посеред завдання і вам потрібно зберегти потік розмови. Виконайте /rename перед очищенням, щоб ви могли знайти сесію знову за допомогою /resume.
Час життя кешу має більше значення, ніж очікує більшість користувачів. За підпискою кеш живе годину. Він скорочується до п’яти хвилин, як тільки ви починаєте використовувати кредитні ліміти, і п’ять хвилин також є стандартним значенням для API key. Ваше перше повідомлення після довгої обідньої перерви не потрапляє в кеш і повторно обробляє весь контекст за повною ціною вхідних даних, саме тому використання часто стрибає без видимих причин. Де кешування промптів виправдовує себе охоплює ці розрахунки.
Ще три важелі знаходяться в тому самому місці. /mcp виводить список налаштованих серверів, щоб ви могли вимкнути ті, які не потрібні для цього завдання. Довгий файл CLAUDE.md завантажується на початку сесії незалежно від того, чи потрібен він для роботи, тому перенесіть спеціалізовані інструкції в навички (skills), які завантажуються лише під час виклику. А розширене мислення (extended thinking) тарифікується як вихідні токени, що є дорожчою частиною, тому зменште його за допомогою /effort, вимкніть у /config або встановіть MAX_THINKING_TOKENS=8000 для моделі з фіксованим бюджетом на мислення.
Розбивайте завдання так, щоб воно вміщувалося в одне вікно
Натисніть Shift+Tab, щоб перейти в режим планування перед внесенням значних змін. Claude проаналізує кодову базу та запропонує підхід для вашого схвалення. Помилковий напрямок, виявлений на цьому етапі, коштує лише одного плану, а не двох годин редагування та подальшого перероблення.
Делегуйте об'ємні операції субагентам. Запуск набору тестів або читання лога на 10,000 рядків у межах субагента залишає необроблені дані в контексті цього субагента, а в основну розмову повертається лише підсумок.
Натисніть Escape, як тільки помітите, що Claude рухається в неправильному напрямку. /rewind відновлює розмову та код до попередньої контрольної точки, тому вам не доведеться платити за скасування роботи, яка була небажаною.
Чи варто купувати кредити на використання чи використовувати API?
Кредити на використання дають змогу обліковим записам Pro або Max продовжувати роботу після вичерпання ліміту тарифного плану з оплатою за стандартними тарифами API. Увімкніть їх у розділі Settings, а потім Usage на claude.ai, додавши спосіб оплати, або виконайте /usage-credits у Claude Code, що відкриє налаштування білінгу у браузері. Кредити застосовуються до діалогів у Claude та використання термінала Claude Code з добовим лімітом списання 2000 доларів. Команда потребує входу через підписку, тому вона недоступна, якщо ви автентифікуєтеся за допомогою API key. На безкоштовному тарифі кредити не пропонуються, тому першим кроком має бути перехід на Pro за 20 доларів на місяць, а що додає Pro і де закінчуються його ліміти пояснює, наскільки цього вистачить. Якщо ви поповнюєте баланс кредитами майже щотижня, збільшення ліміту зазвичай є вигіднішим, а різниця між рівнями Max за 100 та 200 доларів полягає у множнику використання, а не в різниці моделей чи функцій.
Інший шлях — це звичайний API key з Claude Console, де оплата здійснюється за токен без будь-яких сесійних чи тижневих обмежень. Одна пастка полягає в наступному: випадковий ANTHROPIC_API_KEY у вашому середовищі спрямовує Claude Code через цей ключ замість вашої підписки без попередження. Ви дізнаєтеся про це з рахунку або з такого повідомлення:
API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.Помилка 429 означає ліміт запитів для ключа, а не для вашого тарифного плану. Виконайте /status і переконайтеся, що активні облікові дані відповідають тим, які ви планували використовувати.
Скільки коштує робочий день з API?
Наведений нижче приклад — це один робочий день програмування за допомогою агента: 200 000 вхідних токенів без кешування, 1,8 мільйона зчитувань із кешу та 150 000 вихідних токенів. Ціни вказані згідно з офіційними тарифами Anthropic станом на серпень 2026 року. Кожен із цих тарифів розрахований на мільйон токенів, тому, якщо ця одиниця виміру здається абстрактною, що насправді означає мільйон токенів допоможе уявити це як обсяг читання та письма.
The data behind this chart
[
{
"label": "Opus 5",
"input_usd_per_mtok": 5,
"cache_read_usd_per_mtok": 0.5,
"output_usd_per_mtok": 25,
"afternoon_usd": 5.65
},
{
"label": "Sonnet 5",
"input_usd_per_mtok": 2,
"cache_read_usd_per_mtok": 0.2,
"output_usd_per_mtok": 10,
"afternoon_usd": 2.26
},
{
"label": "Haiku 4.5",
"input_usd_per_mtok": 1,
"cache_read_usd_per_mtok": 0.1,
"output_usd_per_mtok": 5,
"afternoon_usd": 1.13
}
]Такий самий робочий день коштує $5.65 на Opus 5 та $1.13 на Haiku 4.5. Вихідні дані найбільше впливають на загальну суму: при ціні $25 за мільйон токенів на Opus 5 проти $5 на Haiku 4.5, 150 000 токенів, які генерує Claude, коштують дорожче, ніж 2 мільйони токенів, які він зчитує. Саме тому зменшення бюджету на «мислення» економить більше коштів, ніж скорочення файлів.
Варто звернути увагу на одну дату. На Sonnet 5 діють вступні ціни $2 та $10 за мільйон вхідних та вихідних токенів до 31 серпня 2026 року. З 1 вересня 2026 року ціни зміняться на $3 та $15, що збільшить вартість такого ж робочого дня з $2.26 до приблизно $3.39.
Як розраховується вартість кожного робочого дня
Opus 5: 200 000 вхідних токенів без кешування за ціною $5 за мільйон — це $1.00. 1,8 мільйона зчитувань із кешу за десяту частину вхідного тарифу — це $0.90. 150 000 вихідних токенів за ціною $25 за мільйон — це $3.75. Разом $5.65.
Sonnet 5: $0.40 за вхідні дані без кешування, $0.36 за зчитування з кешу, $1.50 за вихідні дані. Разом $2.26.
Haiku 4.5: $0.20 за вхідні дані без кешування, $0.18 за зчитування з кешу, $0.75 за вихідні дані. Разом $1.13.
Усі 3 рядків розраховані на однаковій кількості токенів, тому різниця між ними зумовлена лише ціною. Реальна вартість робочого дня залежить від того, яка частина вашого контексту залишається в кеші.
Для порівняння: згідно з документацією Anthropic, середні витрати на Claude Code у корпоративних середовищах становлять близько $13 на розробника за активний день, а для 90% користувачів — менше $30 за активний день станом на серпень 2026 року. Оплата за токени не завжди вигідніша за підписку. Вона виграє, коли навантаження нерівномірне, оскільки дні без активності нічого не коштують, але програє, якщо ви працюєте щодня. Порівняння API та підписки на реальних цифрах показує точку окупності.
Запуск тривалого завдання на VPS протягом ночі
Деякі завдання не потребують вашого нагляду: масштабний рефакторинг, тестова міграція або перевірка документації. Такі завдання також не потребують використання вашої підписки. Запустіть їх на VPS (virtual private server) з використанням API key, щоб оплата здійснювалася за токени, а ліміти вашого тарифного плану залишилися недоторканими для інтерактивної роботи наступного дня.
Встановіть Claude Code на Ubuntu та переконайтеся, що він працює:
curl -fsSL https://claude.ai/install.sh | bash
claude --versionclaude --version має вивести рядок версії, наприклад 2.1.211 (Claude Code). Помилка command not found означає, що ~/.local/bin ще не додано до вашого PATH, тому відкрийте нову оболонку та спробуйте знову.
Збережіть ключ у файлі, а не в історії команд оболонки. Створіть ~/.claude-env у редакторі, додавши один рядок export ANTHROPIC_API_KEY=sk-ant-your-key-here, після чого обмежте права доступу та завантажте його:
chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10Останній рядок виводить перші десять символів, чого достатньо для підтвердження встановлення змінної без відображення всього ключа на екрані.
Тепер запустіть завдання всередині tmux, щоб воно продовжувало працювати після закриття вашого ноутбука:
tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
--allowedTools "Read,Edit,Bash" \
--append-system-prompt-file ./CLAUDE.md \
--output-format json > ~/overnight.jsonВід’єднайтеся за допомогою Ctrl-b, а потім d, і закрийте з’єднання. Повторно під’єднайтеся пізніше за допомогою tmux attach -t overnight. Claude Code у сесії tmux на VPS детально описує керування сесіями.
--bare має тут важливе значення. Він пропускає автоматичне виявлення хуків, навичок, плагінів та файлу CLAUDE.md, а також не зчитує OAuth-облікові дані, тому виконання відбувається виключно через API key. Саме це дозволяє уникнути використання вашої підписки. Це також означає, що правила проєкту не застосовуються, тому --append-system-prompt-file повертає їх примусово. Без --bare встановлений ANTHROPIC_API_KEY викликає запит на підтвердження, на який автоматизований процес не зможе відповісти.
Вранці перегляньте результат і вартість у JSON:
jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.jsonClaude Code завершується з кодом 0 у разі успіху та ненульовим кодом у разі помилки, тому скрипт-обгортка може виконувати дії залежно від статусу завершення та надсилати вам повідомлення про збій. Встановіть ліміт витрат для робочої області в Claude Console перед тим, як залишити завдання працювати: агент у циклі повторних спроб о 3-й годині ночі може призвести до реальних фінансових витрат. Зменште CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY, якщо також хочете сповільнити роботу. Контроль витрат для агентів, що працюють у фоновому режимі містить огляд лімітів, які варто встановити в першу чергу.
Надайте завданню окремого користувача з обмеженими правами та власну гілку git. Агент, що редагує репозиторій без нагляду, іноді може зробити те, що ви б зупинили, а окрема гілка перетворює це на git checkout, а не на інцидент. Безпечний запуск агента для програмування на VPS описує методи ізоляції.
Для масових завдань, які не потребують інтерактивності, наприклад класифікації тисяч записів, Batch API обробляє запити асинхронно зі знижкою 50% як на вхідні, так і на вихідні токени. Це найдешевший спосіб оплати за токени, який пропонує Anthropic, а нічний час ідеально підходить для такої затримки.
Що не допоможе відновити доступ
Початок нової розмови не відновлює ваш ліміт. Використання зараховується на ваш обліковий запис, а не на окрему розмову. Це робить кожне наступне повідомлення дешевшим, оскільки нова розмова не містить історії для повторного читання, тому це все одно доцільно. Це зменшення витрат, а не скидання лімітів.
Видалення старих розмов нічого не повертає. Ці токени були витрачені під час їх обробки.
Перемикання моделей після вичерпання сесійного або тижневого ліміту нічого не дає, оскільки ці вікна є спільними для всіх моделей. Тільки повідомлення, у якому вказано назву моделі, відповідає на /model.
Повторні спроби в циклі нічого не дають, окрім зайнятості вашого терміналу. Час скидання, вказаний у повідомленні, є реальною відповіддю, і /usage покаже вам той самий таймер без помилки.
FAQ
Коли скинеться мій ліміт Claude?
Це вказано у повідомленні. Сесійні ліміти діють у межах п'ятигодинного змінного вікна, і повідомлення показує точний час, наприклад resets 3:45pm. Щотижневі ліміти скидаються у фіксований час, закріплений за вашим обліковим записом, і повідомлення вказує день, наприклад resets Mon 12:00am. Щоб побачити обидві шкали та час скидання до того, як ви вичерпаєте ліміт, виконайте /usage у Claude Code або відкрийте Settings, а потім Usage на claude.ai.
Чи допоможе перемикання на Sonnet відновити роботу?
Лише якщо в повідомленні вказано конкретну модель. Після You've hit your Opus limit виконайте /model, оберіть іншу модель, і сесія продовжиться зі збереженням контексту. Після You've hit your session limit або You've hit your weekly limit вибір моделі не має значення, оскільки ці ліміти враховують використання всіх моделей разом. Перемикання на дешевшу модель до того, як ви досягнете ліміту, — це те, що насправді подовжує роботу у вікні.
Чи скинеться ліміт використання, якщо почати новий чат?
Ні. Використання рахується для вашого облікового запису, тому новий чат починається з тим самим залишком ліміту. Це робить кожне наступне повідомлення дешевшим, оскільки нова розмова не містить історії, яку Claude має перечитувати. /clear у Claude Code робить те саме і нічого не коштує, тоді як /compact має прочитати розмову, яку він підсумовує, тому стиснення дуже великої сесії саме по собі є запитом, що споживає ліміт.
Чи дешевше використовувати API, ніж оновлювати план підписки?
Це залежить від стабільності вашого навантаження. Робочий день, описаний на цій сторінці, коштує $2.26 на Sonnet 5 та $1.13 на Haiku 4.5 за тарифами серпня 2026 року. Підписка — це фіксована плата за обмежений обсяг, тому вона вигідніша, якщо ви працюєте більшість днів. Оплата за токени вигідніша, якщо ваше навантаження нерівномірне, оскільки в дні простою ви нічого не платите.
Чи можу я залишити завдання виконуватися, поки чекаю на скидання ліміту?
Так, якщо ви перенесете його з вашої підписки. Запустіть його на VPS з налаштованою змінною ANTHROPIC_API_KEY у середовищі, і оплата здійснюватиметься за токени, а не з ліміту вашого плану, тому вони не конфліктуватимуть. claude --bare -p всередині tmux продовжує працювати після закриття ноутбука, а --output-format json записує поле total_cost_usd, яке ви можете перевірити вранці за допомогою jq.