Скільки токенів входить у Claude Pro?
Claude Pro не має опублікованої квоти токенів: ліміт рахується повідомленнями у ковзному вікні. Дізнайтеся, що його скорочує та де перевірити свій ліміт.
Скільки токенів включає Claude Pro?
Claude Pro не передбачає фіксованої кількості токенів, а станом на September 2026 Anthropic не публікує такого показника. Підписка Claude розраховується за кількістю повідомлень у ковзному часовому вікні, а не за токенами, списаними з балансу. Тривалість цього вікна залежить від вибраної моделі, обсягу вашої розмови та кількості тексту, який передається в кожному повідомленні.
Саме це зазвичай не зазначають у відповіді на таке запитання, оскільки користувачі очікують, що тариф працює як API key. API key витрачає баланс, порахований у токенах, тому суму рахунку можна самостійно обчислити. Тариф надає доступ у межах ліміту, який Anthropic встановлює та змінює. Цей ліміт визначається в повідомленнях, тому назвати фіксовану кількість токенів неможливо. Якщо хтось називає вам таке число, його просто вигадали.
Тому поставте інше запитання: що робить мої повідомлення витратними? На нього є конкретна відповідь, і ви можете використати її вже сьогодні.
Чому передплата не може вказати кількість токенів
API тарифікує кожен запит за кількістю токенів. Вхідні токени охоплюють усе, що ви надсилаєте, а вихідні токени — усе, що модель генерує у відповідь. Для них діють різні тарифи, тому спочатку потрібно врахувати, що вхідні та вихідні токени мають різну вартість, а вже потім щось оцінювати.
Споживчі плани не мають балансу, який можна витрачати. Anthropic обмежує кількість повідомлень, які можна надсилати протягом ковзного періоду: він починається з першого повідомлення та завершується через визначену кількість годин. Платні плани також мають друге, довше обмеження, яке розраховується за тиждень. Повідомлення не мають фіксованого розміру, тому однакова кількість повідомлень може означати дуже різний обсяг роботи для двох різних користувачів. На сторінках довідки Anthropic описує обмеження як приблизну кількість повідомлень для короткої розмови, а потім попереджає, що довгі розмови та великі вкладення швидше вичерпують доступний ліміт. У цьому й полягає вся суть, але механізм, який стоїть за цим, майже ніколи не пояснюють.
Чому 20-й хід чату коштує значно дорожче за 1-й
Модель не зберігає пам’ять між запитами. Вона не має стану, тому під час кожного ходу повторно надсилається вся розмова: системний prompt, кожне ваше попереднє повідомлення, кожна попередня відповідь Claude і кожен прикріплений файл. Нове запитання може містити 20 слів. Але запит із ним містить увесь транскрипт.
Тому вартість ходу зростає разом із довжиною чату, причому лінійно. У рядках нижче показано цю арифметику для одного набору припущень: системний prompt містить близько 1,000 токенів, кожне ваше повідомлення — близько 1,000 токенів, а кожна відповідь — близько 1,200 токенів. Це ілюстрація механізму, а не вимірювання для вашого облікового запису.
The data behind this chart
[
{
"label": "Turn 1",
"sent_this_turn": "2,000",
"cumulative_input": "2,000"
},
{
"label": "Turn 5",
"sent_this_turn": "10,800",
"cumulative_input": "32,000"
},
{
"label": "Turn 10",
"sent_this_turn": "21,800",
"cumulative_input": "119,000"
},
{
"label": "Turn 20",
"sent_this_turn": "43,800",
"cumulative_input": "458,000"
}
]Під час першого ходу надсилається 2,000 вхідних токенів. До 20-го ходу те саме коротке запитання надсилає 43,800, тобто більш ніж у 20 разів більше, хоча ви вводите стільки ж тексту. За всю розмову ви надіслали 458,000 вхідних токенів, і більшість із них — це той самий текст, який надсилається знову й знову.
20 окремих чатів з одним ходом надіслали б у 20 разів більше, ніж указано в першому рядку вище, і нічого додаткового. Ті самі запитання створили б лише частину навантаження. Вкладення збільшують різницю, оскільки PDF, прикріплений під час 2-го ходу, повторно надсилається під час 3-го, 4-го та кожного наступного ходу, навіть якщо розмова вже не стосується цього файла.
Ось чому двоє користувачів одного плану повідомляють про зовсім різну тривалість використання. Один тримає один потік відкритим увесь тиждень і досягає ліміту в середу. Інший відкриває новий чат для кожного завдання й майже не стикається з обмеженням. Ніхто з них не робить нічого неправильного. Витрати токенів відрізняються на порядок через різні звички використання.
В API повторні витрати можна зменшити за допомогою prompt caching. Він зберігає незмінну початкову частину запиту, тому наступні виклики для цієї частини тарифікуються за зниженою ставкою вхідних даних. У межах підписки ви не керуєте кешуванням, тому довжина розмови — це параметр, на який ви справді можете впливати. Той самий механізм особливо важливий у coding sessions, де вміст файлів і визначення інструментів передаються під час кожного ходу. Тому зменшення контексту coding session дає змогу суттєвіше впливати на ліміти, ніж будь-яке налаштування. Також варто прочитати куди насправді витрачаються токени в Claude Code session, перш ніж звинувачувати план.
Що дає кожен рівень плану у відносному вираженні
Жоден рівень не публікує фіксований ліміт. Публікуються лише відносні значення, і їх достатньо для вибору. Free має найнижчий рівень, а доступний обсяг може зменшуватися, коли навантаження на сервіс високе. Pro розташований вище. Max доступний у двох варіантах, описаних як кратні обсягу використання Pro: приблизно у 5 і приблизно у 20 разів. Team і Enterprise оплачуються за користувача та мають власні ліміти.
Сприймайте ці множники як опис призначення, а не як умову договору. Anthropic коригує ліміти без попереднього повідомлення. Це ще одна причина, чому жодна достовірна сторінка не може назвати точну кількість токенів. Щодо вартості, скільки коштує Pro і де діє його ліміт та різниця між двома рівнями Max містять потрібну інформацію, а що насправді дозволяє безкоштовний план описує найнижчий рівень.
Вибір моделі — це другий множник, який додається до рівня плану. Те саме запитання займає більшу частину доступного вікна в найбільшої моделі, ніж у найменшої, оскільки потужніша модель дорожча в роботі для кожного токена. Перенесення звичайних завдань з Opus на Sonnet або Haiku часто дає більше робочого часу, ніж перехід на дорожчий план. Тому як підібрати модель до завдання — це перше, що варто спробувати, якщо ліміт регулярно вичерпується.
Як переглянути власне використання, а не робити припущення
Ваш обліковий запис є єдиним достовірним джерелом, і доступ до нього займає два кліки. На claude.ai відкрийте Settings, а потім Usage. Там відображається обсяг використання в поточному вікні та час скидання цього вікна. Перевірте ці дані один раз, коли відповіді почнуть відхилятися, і ще раз після тривалого сеансу. Так ви швидше визначите власний характер використання, ніж за будь-якими опублікованими показниками.
У Claude Code ті самі дії виконують дві команди зі слешем у терміналі. /usage показує використання плану та час скидання. /context розкладає поточний вміст контекстного вікна за складовими: системний prompt, визначення інструментів, файли та історію розмови. Якщо /context показує, що стара історія розмови займає більшу частину контексту, /clear запускає новий сеанс, і вартість одного запиту знову наближається до першого рядка наведеної вище таблиці.
В API кількість токенів визначається точно. Її можна запитати до надсилання будь-яких даних:
curl https://api.anthropic.com/v1/messages/count_tokens \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-sonnet-5",
"messages": [{"role": "user", "content": "Summarise the attached report."}]
}'Коректна відповідь містить одне поле. Саме це число буде використано для розрахунку вартості:
{"input_tokens": 14}Після завершення кожного запиту відображається та сама інформація про облік:
{"usage": {"input_tokens": 21430, "output_tokens": 512}}Надішліть одне коротке запитання в новому запиті, а потім те саме запитання наприкінці довгої гілки. Порівняйте два значення input_tokens. Різниця точно показує ефект, який вимірює ваша підписка, у числовому вигляді.
Що робити, якщо ліміт спрацьовує під час роботи
- Дочекайтеся нового вікна. Застосунок показує час скидання ліміту, і очікування часто займає менше часу, ніж пошук обхідного рішення. Це правильний вибір, якщо термінової роботи немає.
- Перейдіть на легшу модель. Менша модель дешевша за кожен запит у всіх планах, а в деяких планах використовує окремий ліміт. Тому роботу можна продовжити, поки потужніша модель недоступна.
- Створіть новий чат і перенесіть до нього лише те, що потрібно для наступного кроку. Вставте висновок, а не весь transcript. Вартість кожного запиту одразу зменшиться, а відповіді зазвичай покращаться, оскільки моделі більше не потрібно опрацьовувати тисячі токенів уже завершеного обговорення.
- Перенесіть роботу в API, де токени підраховуються для кожного запиту, а оплата нараховується за токени. Не потрібно чекати завершення вікна, а вартість кожного виклику можна побачити до та після його виконання.
Вибір залежить від того, у чому проблема: у часі чи в обсязі роботи. Разове перевантаження — це проблема часу. Якщо ви щосереди досягаєте одного й того самого обмеження, це проблема обсягу роботи. У такому разі потрібен API або більший план, а не точніше планування часу. повний список дій, якщо ліміт спрацьовує під час роботи описує відновлення крок за кроком, а як ковзні вікна відкриваються та скидаються пояснює, чому ліміт працює саме так. Якщо ви плануєте перейти на API, спочатку розрахуйте вартість: порівняння API з підпискою для такого самого обсягу роботи і скільки насправді коштує мільйон токенів містять потрібні розрахунки.
FAQ
Скільки токенів включає Claude Pro?
Anthropic не публікує ліміт токенів для Pro, і станом на September 2026 такої цифри немає. Pro має облік за кількістю повідомлень у ковзному вікні, а також довший ліміт, який розраховується за тиждень. Кількість доступних повідомлень залежить від моделі та довжини вашої розмови. Будь-яка сторінка, де вказано конкретну місячну кількість токенів для Pro, містить припущення. Відкрийте Settings, а потім Usage на claude.ai, щоб переглянути власне використання та час скидання ліміту.
Чи скидає початок нового чату моє використання?
Ні. Використання обліковується для вашого акаунта в межах усього вікна, тому новий чат не повертає вже використаний обсяг. Змінюється лише вартість кожного наступного повідомлення. У новому чаті немає попереднього тексту розмови, який потрібно повторно надсилати, тому він починається з нижньої частини наведеної вище діаграми, а не продовжує зростати. Відкривати новий чат після зміни теми — найдешевша доступна звичка на будь-якому плані.
Чому сьогодні я досягнув ліміту швидше, ніж учора?
Зазвичай причина в тому, що сьогоднішня робота відбувалася в одній довгій гілці. Кожне повідомлення повторно надсилає всю розмову та всі прикріплені файли, тому вартість одного повідомлення постійно зростає, хоча для вас кількість повідомлень не змінюється. Інша поширена причина — модель: потужніші моделі швидше витрачають доступний обсяг за один запит, тому робота вдень із найбільшою моделлю завершується раніше, ніж робота вранці з меншою моделлю.
Чи варто перейти до API, щоб отримувати точний облік токенів?
Перейдіть, якщо вам потрібні точні значення або передбачуваність. API підраховує вхідні та вихідні токени для кожного виклику, надає endpoint для підрахунку токенів перед надсиланням і не має вікна, завершення якого потрібно чекати. Оплата здійснюється за токени, тому інтенсивне використання коштує дорожче за фіксовану підписку, а невелике використання — значно дешевше. Перед переходом розрахуйте вартість реального навантаження порівняно з поточним планом, оскільки результат залежить від кількості токенів, які ви надсилаєте.