SSD Nodes Learn
మార్గదర్శకాలు Matt Connorద్వారా Matt Connor · అప్‌డేట్ చేయబడింది 2026-07-24

Claude usage limits సమస్యను ఎలా పరిష్కరించాలి?

Claude subscription మరియు API 429 rate limits మధ్య తేడాలను తెలుసుకోండి. మోడల్ మార్చినా లిమిట్ తగ్గదు కాబట్టి, పరిష్కారం కోసం ఈ వివరాలను చూడండి.

Claude usage limits అంటే ఏమిటి?

Claude usage limits రెండు వేర్వేరు వ్యవస్థల ద్వారా పనిచేస్తాయి. ఏ వ్యవస్థ వల్ల మీ వినియోగం ఆగిపోయిందో తెలుసుకోవడం మొదటి పని. Claude subscription (Pro, Max, Team, లేదా Enterprise) మీకు ఒక rolling usage allowance ని ఇస్తుంది. ఇది అన్ని models కి మరియు Claude chat కి ఉమ్మడిగా వర్తిస్తుంది, కాబట్టి ఇది You've hit your session limit · resets 3:45pm వంటి సందేశంతో మీ వినియోగాన్ని ఆపుతుంది. Claude API మరొక దానిని కొలుస్తుంది: మీరు ప్రతి నిమిషానికి ఎన్ని requests మరియు tokens పంపుతున్నారనే వేగాన్ని ఇది లెక్కిస్తుంది. ఇది rate_limit_error రకానికి చెందిన HTTP 429 error మరియు ఎన్ని సెకన్ల పాటు వేచి ఉండాలో తెలిపే retry-after header తో మీని ఆపుతుంది.

వీటి పరిష్కారాలు వేర్వేరుగా ఉంటాయి. Subscription limit అనేది ఒక নির্দিষ্ট సమయ వ్యవధిలో మీరు ఎంత ఉపయోగించారో దానికి సంబంధించినది, కాబట్టి reset అయ్యే వరకు వేచి ఉండాలి లేదా మరిన్ని usage ని కొనుగోలు చేయాలి. API rate limit అనేది మీ ప్రస్తుత వేగానికి సంబంధించినది, మీరు వేగాన్ని తగ్గించిన వెంటనే ఇది సెకన్లలో క్లియర్ అవుతుంది.

Plan allowances మరియు rate-limit tier నంబర్లు తరచుగా మారుతుంటాయి. తప్పు నంబర్‌ను ఇవ్వడం అసలు లేకపోవడం కంటే అధ్వన్నం, అందుకే ఇక్కడ ఏ నంబర్లునూ ఇవ్వలేదు. కింద ఉన్న commands ద్వారా మీ స్వంత వివరాలను తెలుసుకోండి.

మీరు ఏ లిమిట్‌ను చేరుకున్నారు? ఖచ్చితమైన సందేశాన్ని చదవండి

Claude Code ప్రింట్ చేసే టెక్స్ట్‌లో సిస్టమ్ పేరును పేర్కొంటుంది. మీరు ఏవైనా మార్పులు చేసే ముందు మీ సిస్టమ్‌తో దానిని సరిపోల్చుకోండి.

  • You've hit your session limit · resets 3:45pm అనేది సబ్‌స్క్రిప్షన్ లిమిట్. ఈ విండో కోసం మీ ప్లాన్ యొక్క రోలింగ్ అలవెన్స్ అయిపోయింది.
  • You've hit your weekly limit · resets Mon 12:00am అనేది అదే సిస్టమ్, కానీ ఎక్కువ విండో కాలపరిమితికి సంబంధించినది.
  • You've hit your Opus limit · resets 3:45pm అనేది కేవలం Opus రిక్వెస్ట్‌లకు మాత్రమే వర్తించే సబ్‌స్క్రిప్షన్ లిమిట్. మోడల్‌ను మార్చడం వల్ల ఉపయోగపడే ఏకైక సందర్భం ఇదే.
  • API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com. అనేది API రేట్ లిమిట్. మీ API key కోసం, లేదా మీ Amazon Bedrock లేదా Google Cloud ప్రాజెక్ట్ కోసం కాన్ఫిగర్ చేసిన లిమిట్‌ను మీరు చేరుకున్నారు.
  • API Error: Server is temporarily limiting requests (not your usage limit) అనేది మీ ప్లాన్ కోటాకు సంబంధం లేని స్వల్పకాలిక త్రోటిల్ (throttle). Claude Code ఆ లైన్‌ను మీకు చూపించే ముందు, బ్యాక్‌ఆఫ్ (backoff) పద్ధతితో దానిని ఆటోమేటిక్‌గా మళ్ళీ ప్రయత్నిస్తుంది.

Subscription limits: session, weekly, and the Opus window

సబ్‌స్క్రిప్షన్ ప్లాన్‌లో రోలింగ్ యూసేజ్ అలవెన్స్ (rolling usage allowance) ఉంటుంది. ఈ పరిమితి ముగిసినప్పుడు, మెసేజ్‌లో చూపిన రీసెట్ సమయం వచ్చే వరకు Claude Code తదుపరి రిక్వెస్ట్‌లను నిలిపివేస్తుంది. ఈ అలవెన్స్‌కు సంబంధించిన రెండు అంశాల వల్ల గందరగోళం ఏర్పడుతుంది.

  • ఇది Claude chatతో కలిసి ఉపయోగించబడుతుంది. claude.aiలో మీరు చేసే పనులు మరియు టెర్మినల్‌లో చేసే పనులు ఒకే అలవెన్స్‌ను ఉపయోగిస్తాయి. కాబట్టి, చాట్‌లో ఎక్కువ సమయం గడిపితే, కోడింగ్ కోసం మిగిలి ఉండే సమయం తగ్గుతుంది.
  • ఇది వివిధ మోడల్‌ల మధ్య పంచుకోబడుతుంది. Opus పరిమితి మినహా, సెషన్ మరియు వీక్లీ లిమిట్‌లకు మోడల్-బేస్డ్ బడ్జెట్ ఉండదు.

Claude for Teams మరియు Enterprise ప్లాన్‌లలో, ప్రతి సీటుకు (per-seat) ఒక అలవెన్స్ ఉంటుంది. ఇది రోలింగ్ 5-గంటల విండో మరియు వీక్లీ విండో ఆధారంగా రీసెట్ అవుతుంది. ఇది Claude chat మరియు Coworkతో కలిసి ఉపయోగించబడుతుంది. సీటు టైర్ (Standard లేదా Premium) ఆధారంగా దీని పరిమాణం మారుతుంది. Pro మరియు Max ప్లాన్‌లలో, మెసేజ్‌లో కనిపించే రీసెట్ సమయం మరియు మీ /usage బార్‌లు మాత్రమే ఖచ్చితమైన వివరాలు; బ్లాగ్ పోస్ట్‌లలోని వివరాలను నమ్మవద్దు. మీరు ఇంకా ప్లాన్‌ను ఎంచుకోకపోతే, ఏ Claude ప్లాన్ మీకు అవసరమో ఇక్కడ చూడవచ్చు.

/model ఉపయోగించి మోడల్‌ను మార్చడం వల్ల యాక్సెస్ ఎందుకు పునరుద్ధరించబడదు

ఇది అత్యంత సాధారణమైన తప్పు. దీని గురించి డాక్యుమెంటేషన్ స్పష్టంగా చెబుతోంది: session మరియు weekly limits అన్ని మోడల్‌లకు కలిపి ఉంటాయి, కాబట్టి మోడల్‌ను మార్చడం వల్ల యాక్సెస్ పునరుద్ధరించబడదు. మీ session window ముగిసిన తర్వాత చిన్న మోడల్‌ను ఎంచుకోవడం వల్ల కేవలం సమాధానం ఇచ్చే మోడల్ మాత్రమే మారుతుంది. ఇది మిగిలి ఉన్న allowanceను మార్చదు, ఎందుకంటే allowance మోడల్ వారీగా ఉండదు. కాబట్టి మోడల్ మార్చడం వల్ల ఏ పరిమితి విడుదల కాదు.

Opus limit దీనికి మినహాయింపు, ఇది కేవలం ఆ మోడల్‌కు మాత్రమే వర్తించే ceiling. ఒకవేళ మెసేజ్ You've hit your Opus limit అని ఉంటే, /model సరైన పరిష్కారం. మరొక మోడల్‌కు మారి పని కొనసాగించండి, ఎందుకంటే కేవలం Opus requests మాత్రమే బ్లాక్ చేయబడ్డాయి.

లిమిట్‌ను ఒక bug గా భావించడం రెండవ తప్పు. Reinstall చేయడం లేదా re-authenticating చేయడం వల్ల ఏమీ మారదు. window reset అయినప్పుడు లేదా మీరు usage credits కొనుగోలు చేసినప్పుడు allowance తిరిగి వస్తుంది.

subscription limit ఎదురైనప్పుడు ఏమి చేయాలి

  1. reset time ని చూడండి. session window తక్కువ సమయం ఉంటుంది. weekly window కోసం మీరు మీ డెస్క్ వద్దే వేచి ఉండాల్సిన అవసరం లేదు.
  2. ఒకవేళ అది Opus limit అయితే, /model రన్ చేసి మరొక model ని ఎంచుకోండి.
  3. మీ plan limits, bars మరియు అవి ఎప్పుడు reset అవుతాయో చూడటానికి /usage రన్ చేయండి. అదే స్క్రీన్ కోసం /cost ఒక alias.
  4. ceiling దాటి కూడా పని కొనసాగించడానికి /usage-credits రన్ చేయండి. Pro మరియు Max లో ఇది మీ billing settings ని ఓపెన్ చేస్తుంది. Team మరియు Enterprise లో ఇది మీ organization usage settings ని ఓపెన్ చేస్తుంది, లేదా మీకు billing access లేకపోతే మీ admins కి ఒక request పంపిస్తుంది.
  5. ప్రతి వారం ఇదే సమస్య ఎదురవుతుంటే, మీ పని విధానానికి ఆ plan సరిపోదు.

/usage-credits కి /login ద్వారా sign in చేయబడిన claude.ai subscription అవసరం. API key authentication తో ఇది అందుబాటులో ఉండదు, ఎందుకంటే API key కి పెంచుకోవడానికి plan allowance ఉండదు.

Usage credits వల్ల ఒక ముఖ్యమైన side effect ఉంది. subscription లో prompt cache lifetime ఒక గంట ఉంటుంది, కానీ మీరు credits వాడుతున్నప్పుడు అది ఐదు నిమిషాలకు తగ్గుతుంది, కాబట్టి ఎక్కువ turns cold గానే మొదలవుతాయి మరియు అదే పని కోసం Claude Code token usage పెరుగుతుంది.

Usage limits లాగా అనిపించే కానీ అవి కావు అనే సందేశాలు

Claude Code లో వచ్చే నాలుగు లోపులు (errors) usage limits లాగా కనిపిస్తాయి, కానీ అవి usage limits కావు.

  • context లేదా auto-compact హెచ్చరిక usage limit కాదు. సంభాషణ (conversation) మోడల్ context window కంటే ఎక్కువగా పెరిగినప్పుడు Context exceeds the 200k-token limit by 94k tokens — run /compact or /clear to continue. వంటి లైన్ /context ప్రింట్ చేస్తుంది. స్పేస్ ఖాళీ చేయడానికి పాత హిస్టరీని సమ్మరైజ్ (summarize) చేస్తుంది, దీనివల్ల మీ plan allowance ప్రభావితం కాదు.
  • Error during compaction: Conversation too long. Press esc twice to go up a few messages and try again. అంటే /compact ఫెయిల్ అయిందని అర్థం, ఎందుకంటే సమ్మరీని నిల్వ చేయడానికి తగినంత free context మిగిలి లేదు.
  • Credit balance is too low అంటే మీ Console organization లో prepaid credits అయిపోయాయని అర్థం. platform.claude.com/settings/billing లో క్రెడిట్స్ యాడ్ చేయండి, అక్కడ auto-reload సౌకర్యం కూడా ఉంది.
  • API Error: Usage credits required for 1M context · run /usage-credits to turn them on, or /model to switch to standard context అనేది ఒక entitlement check మాత్రమే, quota అయిపోవడం కాదు. [1m] suffix లేని model variant ని ఎంచుకోండి, లేదా CLAUDE_CODE_DISABLE_1M_CONTEXT=1 సెట్ చేయండి.

మరొకటి API నుండి వస్తుంది. 413 request_too_large అనేది ఒకే రిక్వెస్ట్ యొక్క size limit, అది rate limit కాదు.

API rate limits: 429 అంటే అసలు ఏమిటి

Messages API ప్రతి model class కోసం విడివిడిగా మూడు అంశాలను లెక్కిస్తుంది.

  • requests per minute (RPM)
  • input tokens per minute (ITPM)
  • output tokens per minute (OTPM)

మీ organization కి ఒక spend limit కూడా ఉంటుంది, ఇది వేరే అంశం: API usage కోసం గరిష్ట నెలవారీ ఖర్చు. మీరు మీ tier యొక్క spend cap కి చేరుకున్నప్పుడు, మీరు అధిక limit కోసం అభ్యర్థించనంత వరకు, తదుపరి నెల వరకు API usage ఆగిపోతుంది. ఏ retry loop కూడా దీనిని పరిష్కరించలేదు.

429 ఎప్పుడు వస్తుందో నాలుగు అంశాలు నిర్ణయిస్తాయి.

  • Limits model class కి సంబంధించి ఉంటాయి. ఇవి ప్రతి model కి విడివిడిగా వర్తిస్తాయి, కాబట్టి మీరు వేర్వేరు models ని వాటికి సంబంధించిన limits వరకు ఒకేసారి ఉపయోగించవచ్చు. కొన్ని families ఒకే bucket ని పంచుకుంటాయి: Opus rate limit అనేది Claude Opus 4.8, Opus 4.7, Opus 4.6 మరియు Opus 4.5 ల మొత్తం పరిమితి, అయితే Claude Sonnet 5 కి దాని స్వంత limit ఉంటుంది.
  • Capacity నిరంతరంగా refill అవుతుంది. API token bucket algorithm ని ఉపయోగిస్తుంది, కాబట్టి capacity ఒక నిర్ణీత సమయంలో reset అవ్వకుండా నిరంతరంగా పెరుగుతుంది. నిమిషానికి 60 requests limit ని సెకనుకు ఒక request గా అమలు చేయవచ్చు, కాబట్టి 60 requests ఒకేసారి పంపినా అవి fail అవుతాయి.
  • చాలా models లో uncached input మాత్రమే ITPM కింద లెక్కించబడుతుంది. input_tokens మరియు cache_creation_input_tokens లెక్కించబడతాయి. cache_read_input_tokens చాలా Claude models లో లెక్కించబడదు, Claude Haiku 3.5 దీనికి మినహాయింపు. కాబట్టి caching ఉపయోగించడం వల్ల rate-limit headroom మరియు discount రెండూ లభిస్తాయి. Output వైపు చూస్తే, అధిక max_tokens OTPM కింద లెక్కించబడదు, ఎందుకంటే OTPM కేవలం ఉత్పత్తి చేయబడిన tokens ని మాత్రమే లెక్కిస్తుంది.
  • Limits organization level లో ఉంటాయి. ఒక workspace కి తక్కువ limit ఇవ్వవచ్చు, మరియు organization-wide limits ఎల్లప్పుడూ వర్తిస్తాయి, workspace limits మొత్తం ఎక్కువగా ఉన్నప్పటికీ. మీరు workspace లో limit ని override చేయకపోతే, అది organization నుండి inherit అవుతుంది, అన్‌లిమిటెడ్ గా ఉండదు.

Start, Build, Scale మరియు Custom అని పిలవబడే tiers అసలు సంఖ్యలను నిర్ణయిస్తాయి, ఇవి మీ usage history మరియు account standing ఆధారంగా ఆటోమేటిక్‌గా కేటాయించబడతాయి. కొత్త organizations ప్రామాణికంగా ప్రచురించబడిన limits కంటే తక్కువలో ప్రారంభం కావచ్చు, కాబట్టి మొదటి 429 పట్టికలో ఉన్న దానికంటే ముందే రావచ్చు. usage లో అకస్మాత్తుగా పెరగడం వల్ల acceleration limits trigger అవుతాయి, ఇవి మీరు మీ tier లో ఉన్నప్పటికీ 429 ని తిరిగి ఇస్తాయి, కాబట్టి traffic ని క్రమంగా పెంచండి. ప్రతి ప్రచురించబడిన సంఖ్య ఒక ceiling: documented limits గరిష్టంగా అనుమతించబడే usage, హామీ ఇవ్వబడిన కనీసాలు (guaranteed minimums) కావు. మరింత కావాలని అడగడానికి, Claude Console లోని Limits page లోని "Request rate limit increase" control ని ఉపయోగించండి.

429: retry-after, headers మరియు SDK retries గురించి తెలుసుకోవడం

ప్రతి API error ఒకే రకమైన envelope ని తిరిగి ఇస్తుంది: ఇందులో type మరియు message కలిగిన ఒక nested error object, మరియు ఒక top-level request_id ఉంటాయి.

{
  "type": "error",
  "error": {
    "type": "rate_limit_error",
    "message": "<names the rate limit you exceeded>"
  },
  "request_id": "req_011CSHoEeqs5C35K2UUqR7Fy"
}

మిగిలిన వివరాలు headers లో ఉంటాయి.

  • రిక్వెస్ట్ మళ్ళీ చేయడానికి ఎన్ని సెకన్ల పాటు వేచి ఉండాలో retry-after తెలియజేస్తుంది. త్వరగా ప్రయత్నిస్తే అవి విఫలమవుతాయి.
  • anthropic-ratelimit-requests-limit, anthropic-ratelimit-requests-remaining మరియు anthropic-ratelimit-requests-reset మీ request budget గురించి వివరిస్తాయి.
  • anthropic-ratelimit-input-tokens-* మరియు anthropic-ratelimit-output-tokens-* కూడా ITPM మరియు OTPM కోసం అదే విధంగా limit, remaining మరియు reset suffixes తో పనిచేస్తాయి.
  • ప్రస్తుతం అమలులో ఉన్న అత్యంత కఠినమైన limit యొక్క విలువలను anthropic-ratelimit-tokens-* ప్రదర్శిస్తుంది.

Reset headers లు RFC 3339 timestamps. Remaining token headers లు సమీపంలోని వేల సంఖ్యకు (nearest thousand) రౌండ్ చేయబడతాయి, కాబట్టి వాటిని ఒక అంచనాగా (gauge) మాత్రమే పరిగణించండి. Fast mode కి దాని స్వంత pool మరియు దాని స్వంత anthropic-fast-* headers ఉంటాయి. విజయవంతమైన కాల్ నుండి వీటిని చదవండి:

curl -s -D - -o /dev/null https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{"model":"claude-sonnet-5","max_tokens":16,"messages":[{"role":"user","content":"hi"}]}' \
  | grep -i 'ratelimit\|retry-after\|request-id'

ప్రతి response లో req_018EeWyXxfu5pfWkrYcMdjWG వంటి ఒక ప్రత్యేకమైన request-id header కూడా ఉంటుంది. ఇది error bodies లో request_id గా మరియు Python మరియు TypeScript SDK responses లో _request_id గా కనిపిస్తుంది. మీరు సపోర్ట్‌ను సంప్రదించేటప్పుడు దీనిని తప్పక పేర్కొనండి.

Backoff loop అవసరమా కాదా అనేది రాసే ముందే తనిఖీ చేయండి. అధికారిక SDKలు connection errors, rate limits మరియు 5xx server errors వంటి తాత్కాలిక వైఫల్యాలను (transient failures) ఆటోమేటిక్‌గా exponential backoff తో మళ్ళీ ప్రయత్నిస్తాయి. డిఫాల్ట్‌గా ఇవి రెండుసార్లు ప్రయత్నిస్తాయి మరియు retry-after header అందుబాటులో ఉన్నప్పుడు దానిని అనుసరిస్తాయి. ఈ ప్రవర్తనను మార్చడానికి లేదా నిలిపివేయడానికి ప్రతి client లో maximum-retries ఆప్షన్ ఉంటుంది.

import anthropic

client = anthropic.Anthropic(max_retries=5)  # the SDK default is 2

try:
    msg = client.messages.create(
        model="claude-sonnet-5",
        max_tokens=1024,
        messages=[{"role": "user", "content": "hello"}],
    )
except anthropic.RateLimitError as err:
    headers = err.response.headers
    print("still limited after retries; wait", headers.get("retry-after"), "seconds")
    print("request id:", headers.get("request-id"))

529 overloaded_error మీ తప్పు కాదు

429 అంటే మీరు చాలా వేగంగా రిక్వెస్ట్‌లు పంపుతున్నారని అర్థం. 529 overloaded_error అంటే API తాత్కాలికంగా ఓవర్‌లోడ్ అయిందని అర్థం. వినియోగదారులందరి నుండి అధిక ట్రాఫిక్ వచ్చినప్పుడు ఇది సంభవించవచ్చు. మీ API key లేదా మీ కోడ్ వల్ల ఇది జరగదు. SDKలు 5xx రెస్పాన్స్‌ల కోసం ఇప్పటికే ఉపయోగించే exponential backoff పద్ధతిని ఉపయోగించి మళ్ళీ ప్రయత్నించండి. సమస్య తగ్గకపోతే status.claude.com తనిఖీ చేయండి. 500 api_error అనేది అంతర్గత లోపం (internal error), దీనిని కూడా అదే విధంగా మళ్ళీ ప్రయత్నించాలి. ఇవి రెండూ రేట్ లిమిట్ (rate limit) కావు.

టేబుల్ బదులుగా మీ స్వంత లిమిట్స్‌ను చదవండి

సబ్‌స్క్రిప్షన్‌లో, /usage అనేది ముఖ్యమైన స్క్రీన్. ఇది మీ ప్లాన్ వినియోగం (usage) బార్లను మరియు వాటి వినియోగానికి కారణమైన వివరాలను చూపుతుంది. d లేదా w ద్వారా గత 24 గంటలు మరియు గత 7 రోజుల మధ్య మార్చుకోవచ్చు. రెండు ముఖ్యమైన విషయాలు. Session బ్లాక్ API టోకెన్ వినియోగాన్ని చూపుతుంది మరియు ఇది API వినియోగదారుల కోసం ఉద్దేశించబడింది, కాబట్టి సబ్‌స్క్రిబర్లు దానిలోని డాలర్ విలువను పట్టించుకోవనవసరం లేదు. ఈ సంఖ్యలు ఆ మెషీన్‌లోని లోకల్ సెషన్ హిస్టరీ నుండి వస్తాయి, కాబట్టి ఇతర పరికరాల నుండి లేదా claude.ai నుండి జరిగిన వినియోగం ఇందులో ఉండదు.

API వైపున, Claude Console లోని Usage పేజీ రెండు చార్ట్‌లను చూపుతుంది: "Rate Limit - Input Tokens" మరియు "Rate Limit - Output Tokens". ఇన్‌పుట్ చార్ట్ ప్రతి నిమిషానికి uncached input tokens యొక్క గంటవారీ గరిష్ట విలువను మీ ప్రస్తుత ITPM లిమిట్‌తో పోల్చి చూపుతుంది. దాని పక్కనే మీ cache rate కూడా ఉంటుంది, తద్వారా ప్రొడక్షన్‌లో లిమిట్‌ను చేరుకోకముందే అది ఎంత దగ్గరగా ఉందో మీరు గమనించవచ్చు.

మీరు కాన్ఫిగర్ చేసిన లిమిట్స్‌ను ప్రోగ్రామాటిక్‌గా చదవడానికి:

curl -s https://api.anthropic.com/v1/organizations/rate_limits \
  -H "x-api-key: $ANTHROPIC_ADMIN_KEY" \
  -H "anthropic-version: 2023-06-01"

దీనికి Admin API key అవసరం, మరియు GET /v1/organizations/workspaces/{workspace_id}/rate_limits ప్రతి వర్క్‌స్పేస్ కోసం ఇదే విధంగా పనిచేస్తుంది. ఇవి రెండూ read-only: లిమిట్‌ను మార్చడానికి, Console లోని Limits ట్యాబ్‌ను ఉపయోగించండి.

less ఉపయోగించడం ద్వారా పరిమితులను తగ్గించుకోండి

రెండు వ్యవస్థలు లోపల ఒకే రకమైన కొలమానాలను ఉపయోగిస్తాయి, కాబట్టి ఈ పద్ధతులు రెండింటికీ వర్తిస్తాయి.

  • ప్రతి turn లో తక్కువ tokens వాడండి. నిరంతర పనుల వల్ల cache వేడిగా ఉంటుంది, మరియు సంబంధం లేని పనుల మధ్య /clear వాడటం వల్ల ఖర్చు ఉండదు. Claude Code token usage గురించి పూర్తి వివరాలు ఇక్కడ ఉన్నాయి.
  • ప్రయత్నాన్ని (effort) తగ్గించండి. స్థాయిలు low, medium, high, xhigh మరియు max. /effort మెనూలో ultracode కూడా ఉంది, ఇది ఖర్చును తగ్గించకుండా పెంచుతుంది. సాధారణ rename వంటి పనులకు deep reasoning అవసరం లేదు.
  • 429 error వచ్చిన తర్వాత concurrency తగ్గించండి. CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY తగ్గించండి మరియు అనేక parallel subagents వాడకండి. /status కూడా వాడండి: ఒక పొరపాటు వల్ల ANTHROPIC_API_KEY మీ subscription బదులు low-tier key ద్వారా requests పంపవచ్చు.
  • non-interactive పనులను Message Batches API కి మార్చండి. ఇది పెద్ద మొత్తంలో పనులను asynchronously నిర్వహిస్తుంది. దీనికి input మరియు output tokens పై 50% డిస్కౌంట్ ఉంటుంది మరియు దీనికి ప్రత్యేక rate limits ఉంటాయి. దీనివల్ల nightly jobs మీ session కి ఆటంకం కలిగించవు.

వ్యక్తి ద్వారా కాకుండా ప్రోగ్రామ్ ద్వారా జరిగే bursty పనులకు మొదటి నుండి API key వాడటం మంచిది. Your first Claude API app on a VPS లో key handling మరియు retries గురించి తెలుస్తుంది. Claude Code running on a VPS inside tmux వాడటం వల్ల connection తెగిపోయినా long agent run నిరంతరంగా కొనసాగుతుంది.

FAQ

మోడల్‌ను మార్చడం వల్ల నా Claude usage limit ఎందుకు సరిచేయదు?

ఎందుకంటే session మరియు weekly limits అన్ని మోడల్‌లకు కలిపి ఉంటాయి. ఈ పరిమితి ప్లాన్‌కు సంబంధించింది, మోడల్‌కు కాదు. కాబట్టి /model అనేది ఏ మోడల్ సమాధానం ఇవ్వాలో మారుస్తుంది కానీ, మిగిలి ఉన్న allowance ను మార్చదు. దీనికి You've hit your Opus limit ఒక్కటే మినహాయింపు, ఇది కేవలం Opus requests కు మాత్రమే వర్తిస్తుంది. ఆ సందర్భంలో, మోడల్‌ను మార్చడం అనేది సూచించబడిన పరిష్కారం.

429 rate_limit_error అంటే ఏమిటి, నేను ఎంత సమయం వేచి ఉండాలి?

మీ ఖాతా ఆ మోడల్ క్లాస్ యొక్క rate limit ను చేరుకుందని దీని అర్థం: అంటే प्रति నిమిషానికి requests, ప్రతి నిమిషానికి input tokens, లేదా ప్రతి నిమిషానికి output tokens. రెస్పాన్స్‌లో వేచి ఉండాల్సిన సెకన్లతో కూడిన retry-after header ఉంటుంది, అంతకంటే త్వరగా చేసే retries విఫలమవుతాయి. అధికారిక SDKలు ఇప్పటికే exponential backoff తో rate limits మరియు 5xx errors ను రెండుసార్లు (default గా) రీట్రై చేస్తాయి, ఆ header ను అనుసరిస్తూనే. మీరు మీ tier పరిమితుల్లో ఉన్నప్పటికీ 429 ఎర్రర్ వస్తే, అది అకస్మాత్తుగా పెరిగిన traffic వల్ల వచ్చిన acceleration limit ను సూచిస్తుంది.

నా Claude usage limits మరియు అవి ఎప్పుడు reset అవుతాయో నేను ఎలా చూడగలను?

Claude Code లో, మీ ప్లాన్ bars, reset times మరియు usage breakdown కోసం /usage రన్ చేయండి; /cost అనేది ఒక alias, మరియు d లేదా w గత 24 గంటలు మరియు గత 7 రోజులకు మధ్య మారుస్తుంది. ఈ గణాంకాలు local session history నుండి వస్తాయి, కాబట్టి ఇవి ఇతర పరికరాల నుండి మరియు claude.ai నుండి జరిగిన usage ను చూపించవు. API లో, Console మీ rate limits ను చూపిస్తుంది, మరియు GET /v1/organizations/rate_limits మీ configured limits ను Admin API key తో అందిస్తుంది.

నా Claude plan limit దాటిన తర్వాత నేను పనిని కొనసాగించవచ్చా?

కొన్నిసార్లు సాధ్యమే. Pro మరియు Max ప్లాన్‌లలో పరిమితి దాటిన తర్వాత usage కొనసాగించడానికి, లేదా Team మరియు Enterprise ప్లాన్‌లలో అడ్మిన్ నుండి కోరడానికి /usage-credits రన్ చేయండి; దీనికి /login ద్వారా claude.ai లాగిన్ అవసరం మరియు API key authentication తో ఇది అందుబాటులో ఉండదు. లేకపోతే, reset time వరకు వేచి ఉండండి, అది Opus limit అయితే మోడల్‌ను మార్చండి, లేదా మీ పనిని API key కి మార్చండి, ఇది window కి బదులుగా ప్రతి నిమిషానికి లెక్కగడుతుంది.