Mipaka ya matumizi ya Claude ni nini?
Jua tofauti kati ya mipaka ya usajili na kosa la API 429. Kubadilisha models hakurejeshi uwezo wa kutumia Claude. Jifunze jinsi ya kusubiri au kutatua.
Ni zipi mipaka ya matumizi ya Claude?
Mipaka ya matumizi ya Claude imegawanyika katika mifumo miwili tofauti. Kazi ya kwanza ni kubaini ni mfumo upi ulikuzuia. Usajili wa Claude (Pro, Max, Team, au Enterprise) unakupa kiasi cha matumizi kinachofanyiwa marekebisho kila muda. Kiasi hiki kinashirikishwa kati ya mifano (models) na Claude chat, hivyo unazuiliwa kwa ujumbe kama You've hit your session limit · resets 3:45pm. Claude API inapima kitu tofauti: kasi ya kutuma maombi (requests) na token, inayopigwa hesabu kwa kila dakika. Inakuzuia kwa kosa la HTTP 429 la aina ya rate_limit_error na kichwa cha habari (header) cha retry-after kinachoonyesha ni sekunde ngapi za kusubiri.
Suluhisho hivi havina uhusiano wowote. Mipaka ya usajili inahusu kiasi ulichotumia ndani ya muda fulani, hivyo unasubiri kuanza upya au unanunua matumizi zaidi. Mipaka ya kasi ya API (rate limit) inahusu kasi yako ya sasa, na huondoka baada ya sekunde chache ukipunguza kasi.
Namba za mipaka ya mpango (plan allowances) na ngazi za rate-limit hubadilika mara kwa mara. Namba isiyo sahihi ni mbaya zaidi kuliko kutokuwa na namba, hivyo hakuna namba iliyoonyeshwa hapa. Soma namba zako mwenyewe kwa kutumia amri (commands) zilizo chini.
Ni kikomo gani ulichofikia? Soma ujumbe kamili
Claude Code hutaja mfumo kwenye maandishi yanayochapishwa. Linganisha ujumbe wako kabla ya kubadilisha kitu chochote.
You've hit your session limit · resets 3:45pmni kikomo cha usajili. Kiwango cha mpango wako kwa kipindi hiki kimeisha.You've hit your weekly limit · resets Mon 12:00amni mfumo ule ule lakini kwa kipindi cha muda mrefu zaidi.You've hit your Opus limit · resets 3:45pmni kikomo cha usajili kinachotumika kwa maombi ya Opus pekee. Hii ndiyo hali pekee ambapo kubadilisha model husaidia.API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.ni kikomo cha kasi cha API (API rate limit). Umefikia kikomo kilichosanidiwa kwa API key yako, au kwa mradi wako wa Amazon Bedrock au Google Cloud.API Error: Server is temporarily limiting requests (not your usage limit)ni kizuizi cha muda mfupi kisichohusiana na kiasi cha mpango wako. Claude Code hujaribu tena kiotomatiki kwa kutumia backoff kabla ya kukuonyesha mstari huo.
Kikomo cha usajili: session, wiki, na dirisha la Opus
Mpango wa usajili unajumuisha kiasi cha matumizi kinachozunguka. Kiwango kinapofika mwisho, Claude Code inazuia maombi zaidi hadi muda wa kuanza upya unaoonyeshwa kwenye ujumbe. Sifa mbili za kiasi hicho husababisha mkanganyiko mwingi.
- Kinashirikishwa na Claude chat. Kazi unayofanya kwenye claude.ai hutumia kiasi kilekile kama kazi inayofanyika kwenye terminal, hivyo matumizi makubwa ya chat mchana yanapunguza muda wa kodi jioni.
- Kinashirikishwa kati ya mifano (models) tofauti. Vikomo vya session na wiki havina bajeti kwa kila model, isipokuwa tu kwa kikomo cha Opus.
Kwenye Claude for Teams na Enterprise, muundo uliowekwa ni kiasi kwa kila kiti (per-seat) kinachozunguka kwenye dirisha la saa tano na dirisha la wiki, kinashirikishwa na Claude chat na Cowork, na kinatengenezwa kulingana na kiwango cha kiti (Standard au Premium). Kwenye Pro na Max, muda wa kuanza upya unaoonyeshwa kwenye ujumbe na /usage zako ni namba za kuaminika, si namba iliyonukuliwa kutoka kwenye blogu. Ikiwa bado unachagua kiwango, mpango gani wa Claude unaohitaji unalinganisha kile kinachozuiwa na kila mmoja.
Kwa nini kubadilisha model kwa kutumia /model hakurejeshewi uwezo wa kutumia
Hii ndiyo hatua inayofanywa kimakosa mara nyingi zaidi, na hati ya maelezo inaeleza wazi: mipaka ya session na ya wiki inashirikishwa kwenye model zote, hivyo kubadilisha model hakurejeshei uwezo wa kutumia. Kuchagua model ndogo baada ya muda wako wa session kuisha kubadilisha tu model itakayojibu. Haibadili kiasi cha matumizi kilichobaki, kwa sababu matumizi hayakuwekwa kwa kila model, hivyo kubadilisha model hakuna kinachoweza kuachia.
Pengeleo ni kikomo cha Opus, ambacho ni kikomo maalum kwa model hiyo. Ikiwa ujumbe unasoma You've hit your Opus limit, basi /model ndiyo suluhisho sahihi. Badilisha kwenda model nyingine na uendelee kufanya kazi, kwa sababu ni maombi ya Opus pekee yaliyozuiwa.
Kuchukulia kikomo hiki kama hitilafu (bug) ni kosa la pili. Kufanya reinstall au kuingia upya (re-authenticating) hakibadili chochote. Matumizi yatarudishwa wakati muda (window) utakapofutwa, au unaponunua salio la matumizi (usage credits).
Hatua za kuchukua unapofikia kikomo cha usajili
- Soma muda wa kurejesha (reset time). Dirisha la kikao (session window) ni fupi. Dirisha la kila wiki si kitu cha kusubiri ukiwa mbele ya kompyuta yako.
- Ikiwa ni kikomo cha Opus, kimbiza
/modelna uchague modeli nyingine. - Kimbiza
/usageili kuona viwango vya mpango wako, baa zako, na muda wa kurejesha./costni jina mbadala (alias) kwa skrini hiyo hiyo. - Kimbiza
/usage-creditsili kuendelea kufanya kazi baada ya kufikia kikomo. Kwenye Pro na Max, hufungua mipangilio ya malipo. Kwenye Team na Enterprise, hufungua mipangilio ya matumizi ya shirika lako, au hutuma ombi kwa wasimamizi (admins) wako ikiwa huna ufikiaji wa malipo. - Ikiwa unapata kikomo hicho kila wiki, mpango wako haufai kwa namna unavyofanya kazi.
/usage-credits inahitaji usajili wa claude.ai uliowashwa kupitia /login. Haitumika kwa uthibitisho wa API key, kwa sababu API key haina kiasi cha mpango cha kuongeza.
Kadi za matumizi (Usage credits) zina athari moja muhimu. Muda wa kuhifadhi prompt cache ni saa moja kwenye usajili, lakini hupungua hadi dakika tano pindi unapotumia kadi, hivyo mzunguko zaidi huanza bila data iliyohifadhiwa na matumizi ya tokeni ya Claude Code huongezeka kwa kazi ileile.
Ujumbe unaofanana na mipaka ya matumizi lakini siyo
Makosa manne ya Claude Code yanaripotiwa kama mipaka ya matumizi, lakini siyo mipaka.
- Onyo la context au auto-compact siyo kikomo cha matumizi.
/contexthuchapisha mstari kamaContext exceeds the 200k-token limit by 94k tokens — run /compact or /clear to continue.wakati mazungumzo yamevuka urefu wa context window ya model. Historia ya zamani hufupishwa ili kutoa nafasi, na kiasi chako cha mpango (plan allowance) hakiguswi. Error during compaction: Conversation too long. Press esc twice to go up a few messages and try again.inamaanisha/compactimefeli, kwa sababu hakuna nafasi ya kutosha ya context iliyobaki kuweka muhtasari utakaozalisha.Credit balance is too lowinamaanisha shirika lako la Console limeishiwa kwa salio la kulipia kabla (prepaid credits). Ongeza salio kwenye platform.claude.com/settings/billing, ambayo pia inatoa huduma ya kujijazia salio kiotomatiki (auto-reload).API Error: Usage credits required for 1M context · run /usage-credits to turn them on, or /model to switch to standard contextni ukaguzi wa haki (entitlement check), siyo kikomo cha kiasi (quota). Chagua toleo la model lisilo na kiambishi cha[1m], au wekaCLAUDE_CODE_DISABLE_1M_CONTEXT=1.
Ujumbe mmoja zaidi unatoka kwenye API. 413 request_too_large ni kikomo cha ukubwa wa ombi moja, siyo kikomo cha kasi (rate limit).
Kikomo cha kiwango cha API: kile ambacho 429 kinahesabu hasa
Messages API inapima mambo matatu, kulingana na kila kundi la modeli.
- maombi kwa dakika (RPM)
- tokeni za kuingiza kwa dakika (ITPM)
- tokeni za kutolewa kwa dakika (OTPM)
Shirika lako pia lina kikomo cha matumizi, ambacho ni kitu tofauti: gharama ya juu ya kila mwezi kwa matumizi ya API. Ukifika kwenye kikomo cha matumizi cha kiwango chako (tier), matumizi ya API yatasimama hadi mwezi unaofuata isipokuwa uombe kikomo kikubwa zaidi. Hakuna mzunguko wa kujaribu tena (retry loop) unaoweza kutatua hili.
Mambo manne yanayoamua wakati 429 inapotokea.
- Vimiko viko kwa kila kundi la modeli. Vinatumika kando kwa kila modeli, hivyo unaweza kutumia modeli tofauti hadi kwenye vikomo vyake husika kwa wakati mmoja. Baadhi ya familia zinashiriki mfumo mmoja: kikomo cha kiwango cha Opus ni jumla ya Claude Opus 4.8, Opus 4.7, Opus 4.6 na Opus 4.5, wakati Claude Sonnet 5 kina chake.
- Uwezo hujazwa upya mfululizo. API hutumia algorithm ya token bucket, hivyo uwezo hujazwa upya mfululizo badala ya kuanza upya wakati maalum. Kikomo cha maombi 60 kwa dakika kinaweza kutekelezwa kama ombi moja kwa sekunde, hivyo maombi 60 yanayotumwa kwa wakati mmoja bado yatasimama.
- Ni tokeni zisizohifadhiwa (uncached) pekee zinazohesabiwa kwenye ITPM kwa modeli nyingi.
input_tokensnacache_creation_input_tokenszinahesabiwa.cache_read_input_tokenshaisihesabiwi kwenye modeli nyingi za Claude, isipokuwa Claude Haiku 3.5 ambayo ni ubaguzi uliowekwa. Kwa hivyo, kuhifadhi (caching) kunatoa nafasi zaidi ya kiwango cha maombi pamoja na punguzo la gharama. Upande wa matokeo,max_tokenskubwa haisihesabiwi kwenye OTPM, kwa sababu OTPM inahesabu tu tokeni ambazo zimetolewa. - Vimiko viko katika ngazi ya shirika. Workspace inaweza kupewa kikomo kidogo, na vimiko vya shirika vyote vinatumika hata kama vimiko vya workspace vikijumlishwa ni vikubwa zaidi. Kikomo ambacho hukijapitia kwenye workspace kinatoka kwenye shirika, hakibaki bila kikomo.
Viwango vilivyowekwa kama Start, Build, Scale na Custom vinaamua namba halisi, vikipangwa kiotomatiki kutokana na historia yako ya matumizi na hali ya akaunti yako. Mashirika mapya yanaweza kuanza chini ya vimiko vya kawaida vilivyochapishwa, hivyo 429 ya kwanza inaweza kutokea mapema kuliko jedwali linavyotabiri. Ongezeko la ghafla la matumizi husababisha vikomo vya kasi, ambavyo hurudisha 429 wakati bado uko ndani ya kiwango chako, hivyo ongeza trafiki taratibu. Kila namba iliyochapishwa ni dari: vimiko vilivyowekwa ni matumizi ya juu yanayoruhusiwa, si viwango vya chini vilivyohakikishwa. Ili kuomba zaidi, tumia sehemu ya "Request rate limit increase" kwenye ukurasa wa Limits kwenye Claude Console.
Kusoma 429: retry-after, vichwa vya habari, na SDK retries
Kila kosa la API hurudisha mfumo uleule: kitu cha error kilichofungwa ndani kinachobeba aina na ujumbe, pamoja na request_id ya kiwango cha juu.
{
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "<names the rate limit you exceeded>"
},
"request_id": "req_011CSHoEeqs5C35K2UUqR7Fy"
}Vichwa vya habari (headers) hubeba maelezo mengine.
retry-afterni idadi ya sekunde za kusubiri kabla ya kujaribu tena ombi. Majaribio ya mapema yatafeli.anthropic-ratelimit-requests-limit,anthropic-ratelimit-requests-remainingnaanthropic-ratelimit-requests-resetzinaelezea bajeti ya ombi lako.anthropic-ratelimit-input-tokens-*naanthropic-ratelimit-output-tokens-*zinafanya hivyo kwa ITPM na OTPM, zikiwa na viambishi vya limit, remaining na reset.anthropic-ratelimit-tokens-*huonyesha thamani za kikomo kinachozuia zaidi kinachotumika sasa.
Vichwa vya habari vya reset ni timestamps za RFC 3339. Vichwa vya habari vya remaining token vinasawazishwa hadi elfu inayofuata, hivyo visome kama kipimo (gauge). Fast mode ina pool yake na vichwa vya habari vyake vya anthropic-fast-*. Soma vyote kutoka kwa simu yoyote iliyofanikiwa:
curl -s -D - -o /dev/null https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-5","max_tokens":16,"messages":[{"role":"user","content":"hi"}]}' \
| grep -i 'ratelimit\|retry-after\|request-id'Kila jibu pia hubeba kichwa cha habari cha request-id cha kipekee, kama vile req_018EeWyXxfu5pfWkrYcMdjWG. Huonekana kama request_id kwenye miili ya makosa na kama _request_id kwenye majibu ya SDK za Python na TypeScript. Kirejelee kichwa hicho unapowasiliana na msaada wa kiufundi.
Angalia ikiwa unahitaji backoff loop kabla ya kuiandika. SDK rasmi hujaribu tena makosa ya muda mfupi, ikiwa ni pamoja na makosa ya muunganisho, kikomo cha kasi (rate limits), na makosa ya seva ya 5xx, kwa kutumia exponential backoff, mara mbili kwa kimawazo, huku kizingatia kichwa cha retry-after kinapokuwepo. Kila client hukubali chaguo la maximum-retries ili kubadilisha au kuzima tabia hiyo.
import anthropic
client = anthropic.Anthropic(max_retries=5) # the SDK default is 2
try:
msg = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "hello"}],
)
except anthropic.RateLimitError as err:
headers = err.response.headers
print("still limited after retries; wait", headers.get("retry-after"), "seconds")
print("request id:", headers.get("request-id"))529 overloaded_error si kosa lako
429 inamaanisha umefanya maombi mengi mno kwa haraka. 529 overloaded_error inamaanisha API imezidiwa kwa muda, na inaweza kutokea wakati API inapopata msongamano mkubwa wa trafiki kutoka kwa watumiaji wote. Key yako au kodi yako haijasababisha hitilafu hii. Jaribu tena kwa kutumia exponential backoff, ambayo SDKs tayari hufanya kwa majibu ya 5xx, na kagua status.claude.com ikiwa tatizo litaendelea. 500 api_error ni hitilafu ya ndani ambayo unapaswa kujaribu tena kwa njia hiyo hiyo, na hakuna kati ya hizo mbili inayohusiana na rate limit.
Soma mipaka yako badala ya kutumia jedwali
Kwenye usajili, /usage ndiyo skrini muhimu zaidi. Inaonyesha viashiria vya matumizi ya mpango wako na mchanganuo wa kilichotumia rasilimali hizo, na d au w hubadilisha kati ya saa 24 zilizopita na siku 7 zilizopita. Kuna mambo mawili ya kuzingatia. Sehemu ya Session inaonyesha matumizi ya API token na imetengenezwa kwa ajili ya watumiaji wa API, hivyo wasajili wanaweza kupuuza kiasi cha fedha kilichopo hapo. Namba hizo zinatoka kwenye historia ya session ya ndani kwenye mashine hiyo, hivyo matumizi kutoka kifaa kingine au kutoka claude.ai hayataonekana.
Upande wa API, ukurasa wa Usage kwenye Claude Console una michoro miwili, "Rate Limit - Input Tokens" na "Rate Limit - Output Tokens". Chati ya input inaonyesha kiwango cha juu cha kila saa cha input tokens zisizohifasiwa (uncached) kwa dakika moja dhidi ya kiwango chako cha ITPM, ikiwa na kiwango cha cache karibu nacho, ili uweze kuona unavyokaribia kikomo badala ya kukutana nacho wakati wa matumizi ya kawaida (production).
Ili kusoma mipaka iliyosanidiwa kwa kutumia programu:
curl -s https://api.anthropic.com/v1/organizations/rate_limits \
-H "x-api-key: $ANTHROPIC_ADMIN_KEY" \
-H "anthropic-version: 2023-06-01"Inahitaji Admin API key, na GET /v1/organizations/workspaces/{workspace_id}/rate_limits hufanya hivyo kwa kila workspace. Zote ni za kusoma tu: ili kubadilisha kikomo, tumia tab ya Limits kwenye Console.
Tumia less, ili usifikie kikomo kidogo zaidi
Mifumo yote hupima kitu kilekile, hivyo njia hizi zinafanya kazi kwenye mifumo yote miwili.
- Tumia token chache kwa kila mzunguko. Kazi zinazoendelea hufanya cache iwe na data, na
/clearkati ya kazi zisizohusiana haigharimu chochote. Matumizi ya token ya Claude Code yanaelezea njia hizo zote. - Punguza juhudi. Viwango ni
low,medium,high,xhighnamax. Menyu ya/effortpia inatoaultracode, ambayo huongeza matumizi badala ya kuyapunguza. Fikira ya kina kwenye mabadiliko ya majina ya kimekanika haileti faida yoyote. - Punguza uwingi wa kazi (concurrency) baada ya makosa ya 429. Punguza
CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCYna epuka kutumia subagents nyingi kwa wakati mmoja. Tumia/statuspia:ANTHROPIC_API_KEYinayotokea inaweza kuelekeza maombi kupitia funguo ya kiwango cha chini badala ya usajili wako. - Hamisha kazi zisizo za mwingiliano kwenda kwenye Message Batches API. Inafanya kazi nyingi kwa wakati mmoja bila kuhitaji usimamizi wa papo hapo kwa punguzo la 50% kwenye token za kuingiza na kutoa, chini ya viwango vyake vya mwendo (rate limits), hivyo kazi ya usiku haitaingiliana na kikao chako.
Kazi za vipindi vinavyobadilika-badilika zinazoendeshwa na programu badala ya mtu zinapaswa kutumia API key tangu mwanzo. App yako ya kwanza ya Claude API kwenye VPS inaelezea usimamizi wa funguo na majaribio ya marudio, na safari ndefu ya agent itaendelea hata kama muunganisho utakatika unapotumia Claude Code ikiwa inafanya kazi kwenye VPS ndani ya tmux.
FAQ
Kwa nini kubadilisha modeli hakurekebishi kikomo cha matumizi ya Claude?
Kwa sababu vikomo vya kikao na vya wiki vinashirikishwa kwenye modeli zote. Kiasi cha matumizi ni cha mpango (plan) na si modeli, hivyo /model hubadilisha modeli itakayojibu na si kiasi cha matumizi kilichobaki. Pengelezo pekee ni You've hit your Opus limit, ambayo inahusu maombi ya Opus pekee. Katika hali hiyo, kubadilisha modeli ndio suluhisho lililoelezwa.
Maana ya 429 rate_limit_error ni nini, na ningoje kwa muda gani?
Inamaanisha akaunti yako imefikia kikomo cha kasi kwa kundi hilo la modeli: maombi kwa dakika, tokeni za kuingiza kwa dakika, au tokeni za kutolewa kwa dakika. Jibu hubeba kichwa cha habari cha retry-after chenye sekunde za kusubiri, na majaribio ya mapema yatakosa. SDK rasmi tayari hujaribu tena (retry) vikomo vya kasi na makosa ya 5xx kwa kutumia exponential backoff, mara mbili kwa kawaida, kwa kuzingatia kichwa hicho. 429 inayojitokeza wakati bado upo ndani ya vikomo vya kiwango chako inaashiria kikomo cha kasi kutokana na ongezeko la ghafla la maombi.
Ninawezaje kuona vikomo vya matumizi ya Claude na muda wa kuanza upya?
Ndani ya Claude Code, tumia /usage kuona viwango vya mpango wako, muda wa kuanza upya, na mchanganuo wa matumizi; /cost ni jina mbadala (alias), na d au w hubadilisha kati ya saa 24 zilizopita na siku 7 zilizopita. Takwimu hizo zinatoka kwenye historia ya kikao ya ndani, hivyo hazijumuishi matumizi kutoka kwenye vifaa vingine na kutoka claude.ai. Kwenye API, Console inaonyesha chati za vikomo vya kasi, na GET /v1/organizations/rate_limits hurudisha vikomo vilivyosanidiwa kwa kutumia Admin API key.
Je, naweza kuendelea kufanya kazi baada ya kufikia kikomo cha mpango wangu wa Claude?
Wakati mwingine. Tumia /usage-credits kununua matumizi zaidi ya kikomo kwenye Pro na Max, au kuomba kwa admin kwenye Team na Enterprise; inahitaji kuingia (login) kwenye claude.ai kupitia /login na haipatikani kwa kutumia uthibitishaji wa API key. Vinginevyo, subiri muda wa kuanza upya, badilisha modeli ikiwa ilikuwa kikomo cha Opus, au hamisha kazi kwenda kwenye API key, ambayo inapima kwa dakika badala ya kwa muda maalum.