Claude usage limit पहुँचने पर क्या करें?
Claude usage limit पहुँचने पर घबराएं नहीं। पहले यह देखें कि आपकी सेशन या साप्ताहिक विंडो कब रीसेट होगी। आप छोटे मॉडल का उपयोग कर सकते हैं या API पर स्विच कर सकते हैं।
आप Claude की किस सीमा तक पहुँच गए हैं
Claude की सीमा पहुँचने का संदेश उस विंडो का नाम बताता है जिसका आप इंतज़ार कर रहे हैं, और वही विंडो तय करती है कि आप आगे क्या कर सकते हैं। सेशन और साप्ताहिक सीमाएं एक साथ सभी मॉडल्स पर लागू होती हैं, इसलिए मॉडल बदलने से आपको एक्सेस वापस नहीं मिलता। यदि कोई सीमा किसी एक मॉडल का नाम लेती है, तो वह अपवाद है: मॉडल बदलें और आप काम जारी रख सकते हैं, जबकि वह एक मॉडल ब्लॉक रहेगा।
Claude Code उसी लाइन में विंडो और उसके रीसेट होने का समय प्रिंट करता है:
You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pmसेशन विंडो पांच घंटे की रोलिंग अवधि होती है। साप्ताहिक विंडो हर हफ्ते एक निश्चित समय पर रीसेट होती है जो आपके अकाउंट को असाइन की गई है, इसलिए दिन और समय हर हफ्ते एक समान रहते हैं। Pro प्लान में पांच घंटे की सेशन विंडो के साथ एक साप्ताहिक सीमा होती है जो सभी मॉडल्स पर लागू होती है। Max प्लान एक दूसरी साप्ताहिक सीमा जोड़ता है जो केवल एक मॉडल फैमिली पर लागू होती है। सीमाएं स्वयं Claude उपयोग सीमाओं के पूर्ण विवरण में दी गई हैं। यह पेज वहीं से शुरू होता है जहाँ वह समाप्त होता है।
यहाँ वह हिस्सा है जहाँ लोग अक्सर गलती करते हैं। हर रिक्वेस्ट सेशन विंडो और साप्ताहिक विंडो दोनों के खिलाफ एक साथ गिनी जाती है, इसलिए एक भारी दोपहर साप्ताहिक कोटा खाली कर सकती है जबकि पांच घंटे की विंडो में अभी भी जगह बची हो सकती है। अपने दिन की बाकी योजना बनाने से पहले रीसेट का समय पढ़ें। 3:45pm पर रीसेट का मतलब एक कॉफी ब्रेक है। सोमवार आधी रात को रीसेट का मतलब ऐसा नहीं है।
अनुमान लगाने से पहले मीटर देखें
claude.ai पर, Settings और फिर Usage खोलें। प्रोग्रेस बार दिखाते हैं कि आपने पांच घंटे की सेशन विंडो और प्रत्येक साप्ताहिक विंडो का कितना उपयोग किया है, ताकि आप अनुमान लगाने के बजाय यह देख सकें कि कौन सी विंडो खाली है।
Claude Code में, /usage चलाएं। यह समान प्लान बार और हालिया उपयोग का विवरण दिखाता है, जिसे कुल उपयोग के प्रतिशत के रूप में स्किल्स, सब-एजेंट्स, प्लगइन्स और व्यक्तिगत MCP (model context protocol) सर्वर्स के आधार पर विभाजित किया गया है। पिछले 24 घंटों के लिए d दबाएं और पिछले 7 दिनों के लिए w दबाएं। यह किसी भी ऐसे पैटर्न को भी चिह्नित करता है जो हालिया उपयोग के 10% या उससे अधिक के लिए जिम्मेदार है, और आप जो दो सबसे आम पैटर्न देखेंगे वे हैं long context और cache misses।
दो सावधानियां। यह विवरण उस मशीन पर संग्रहीत सेशन हिस्ट्री से निकाला गया है, इसलिए आपने किसी अन्य लैपटॉप या claude.ai पर जो काम किया है, वह इसमें शामिल नहीं है। और शीर्ष पर Session ब्लॉक में दी गई डॉलर राशि API (application programming interface) उपयोगकर्ताओं के लिए मानक लिस्ट दरों पर आधारित है, जिसका अर्थ है कि जब आप सब्सक्रिप्शन पर होते हैं तो यह आपका बिल नहीं है।
क्या छोटे मॉडल पर स्विच करने से मदद मिलती है?
यह केवल तब होता है जब मैसेज में किसी मॉडल का नाम लिया गया हो। You've hit your Opus limit के बाद, /model चलाएं, Sonnet या Haiku चुनें, और सेशन पूरी जानकारी के साथ आगे बढ़ता रहेगा। You've hit your session limit या You've hit your weekly limit के बाद, /model कुछ भी नहीं बदलता है, क्योंकि वे विंडो हर मॉडल में साझा की जाती हैं।
सीमा तक पहुँचने के बाद स्विच करने की तुलना में, पहले स्विच करना कहीं अधिक फायदेमंद है। Sonnet अधिकांश कोडिंग कार्य Opus की तुलना में बहुत कम दर पर संभाल लेता है, इसलिए Opus को अपना डिफ़ॉल्ट बनाए रखना उन दो आदतों में से एक है जो अधिकांश अप्रत्याशित उपयोग का कारण बनती हैं। दूसरी आदत है ऐसा सेशन जिसे कभी क्लियर नहीं किया जाता। मैकेनिकल संपादन और लॉग ट्राइएज का काम Haiku को दें, और Opus को केवल उन डिज़ाइन निर्णयों के लिए रखें जहाँ आप वास्तव में अटक गए हों। Opus, Sonnet और Haiku के बीच चुनाव में विस्तार से बताया गया है कि प्रत्येक मॉडल अपनी कीमत के अनुसार कहाँ उपयोगी है।
जिन संदर्भों (context) का उपयोग बंद कर दिया है, उनके लिए भुगतान न करें
Claude Code हर अनुरोध के साथ आपकी पूरी बातचीत भेजता है, और हर बार जब Claude किसी टूल का उपयोग करता है, तो वह टूल परिणामों के उस बैच को लेकर एक और अनुरोध भेजता है। Prompt caching का अर्थ है कि इतिहास को पूर्ण इनपुट दर के बजाय cached दर पर पढ़ा जाता है, जिससे यह सस्ता हो जाता है, लेकिन मुफ्त नहीं। इसलिए, सुबह से खुले हुए सत्र में एक पंक्ति का प्रश्न भी पूरी बातचीत के लिए उपयोग (usage) की खपत करता है।
/context
/clear
/compact Focus on the failing tests and the files we changed/clear की कोई लागत नहीं है, क्योंकि यह संदर्भ को पढ़ने के बजाय उसे हटा देता है। /compact को उस बातचीत को पढ़ना पड़ता है जिसका वह सारांश प्रस्तुत करता है, इसलिए बहुत बड़े संदर्भ को संक्षिप्त करना स्वयं में एक बड़ा अनुरोध है। जब आप असंबंधित काम पर जाएं तो /clear का उपयोग करें, और /compact का उपयोग केवल तब करें जब आप किसी कार्य के बीच में हों और आपको थ्रेड को बनाए रखने की आवश्यकता हो। क्लियर करने से पहले /rename चलाएं ताकि आप /resume के साथ सत्र को फिर से ढूंढ सकें।
Cache की अवधि लोगों की अपेक्षा से कहीं अधिक मायने रखती है। सब्सक्रिप्शन पर cache एक घंटे तक रहता है। जब आप उपयोग क्रेडिट का उपयोग कर रहे होते हैं तो यह घटकर पांच मिनट रह जाता है, और API key पर भी पांच मिनट ही डिफ़ॉल्ट होता है। लंबे लंच के बाद आपका पहला संदेश cache से चूक जाता है और पूरे संदर्भ को पूर्ण इनपुट मूल्य पर पुन: संसाधित करता है, यही कारण है कि उपयोग अक्सर बिना किसी स्पष्ट कारण के बढ़ जाता है। जहाँ prompt caching स्वयं का खर्च निकाल लेती है में इसकी गणना शामिल है।
तीन और विकल्प उसी स्थान पर मौजूद हैं। /mcp आपके कॉन्फ़िगर किए गए सर्वरों को सूचीबद्ध करता है ताकि आप उन सर्वरों को बंद कर सकें जिनकी इस कार्य के लिए आवश्यकता नहीं है। एक लंबी CLAUDE.md फ़ाइल सत्र की शुरुआत में ही लोड हो जाती है, चाहे काम के लिए उसकी आवश्यकता हो या न हो, इसलिए विशेष निर्देशों को skills में ले जाएं, जो केवल बुलाए जाने पर ही लोड होती हैं। और extended thinking को output tokens के रूप में बिल किया जाता है, जो कि महंगा हिस्सा है, इसलिए इसे /effort के साथ कम करें, /config में इसे बंद करें, या निश्चित thinking बजट वाले मॉडल पर MAX_THINKING_TOKENS=8000 सेट करें।
काम को विभाजित करें ताकि वह एक विंडो में फिट हो जाए
किसी बड़े बदलाव से पहले plan mode में जाने के लिए Shift+Tab दबाएं। Claude कोडबेस का विश्लेषण करता है और आपकी स्वीकृति के लिए एक दृष्टिकोण प्रस्तावित करता है। यदि कोई गलत दिशा वहां पकड़ी जाती है, तो इसमें केवल एक plan का खर्च आता है, न कि दो घंटे की एडिटिंग और उसके बाद के सुधार का।
शोर मचाने वाले ऑपरेशंस को subagents को सौंपें। टेस्ट सूट चलाना या subagent के भीतर 10,000 लाइनों का लॉग पढ़ना raw output को उस subagent के संदर्भ में ही रखता है, और केवल सारांश ही आपकी मुख्य बातचीत में वापस आता है।
जैसे ही Claude गलत दिशा में आगे बढ़े, Escape दबाएं। /rewind बातचीत और कोड दोनों को पहले के चेकपॉइंट पर पुनर्स्थापित कर देता है, ताकि आपको उस काम को हटाने के लिए भुगतान न करना पड़े जिसे आप कभी चाहते ही नहीं थे।
क्या आपको usage credits खरीदने चाहिए या API का उपयोग करना चाहिए?
Usage credits Pro या Max account को plan की सीमा समाप्त होने के बाद भी काम जारी रखने की सुविधा देते हैं, जिसका बिल standard API दरों पर आता है। इन्हें claude.ai पर Settings और फिर Usage के अंतर्गत payment method जोड़कर चालू करें, या Claude Code में /usage-credits चलाएं, जो ब्राउज़र में आपकी billing settings खोल देगा। Credits Claude conversations और Claude Code terminal usage दोनों पर लागू होते हैं, जिनकी दैनिक redemption सीमा $2000 है। इस command के लिए subscription login आवश्यक है, इसलिए जब आप API key के साथ authenticate करते हैं तो यह उपलब्ध नहीं होती।
दूसरा विकल्प Claude Console से एक plain API key है, जिसका बिल प्रति token के आधार पर आता है और इसमें कोई session या साप्ताहिक सीमा नहीं होती। इसमें एक समस्या यह है: आपके environment में मौजूद एक अनचाहा ANTHROPIC_API_KEY Claude Code को आपके subscription के बजाय उस key के माध्यम से route कर देता है, जिसकी सूचना आपको नहीं मिलती। आपको इसका पता बिल से चलता है, या फिर इससे:
API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.यह 429 error key पर लगी rate limit है, न कि आपके plan पर। /status चलाएं और पुष्टि करें कि active credential वही है जिसका आप उपयोग करना चाहते थे।
API पर एक दोपहर का खर्च क्या है?
नीचे दिया गया उदाहरण एजेंट-शैली की कोडिंग की एक दोपहर का है: 200,000 uncached input tokens, 1.8 million cache reads, और 150,000 output tokens। कीमतें अगस्त 2026 तक Anthropic की सूची दरों के अनुसार हैं। इनमें से प्रत्येक दर प्रति मिलियन tokens के लिए उद्धृत की गई है, इसलिए यदि वह इकाई अभी भी अमूर्त लगती है, तो एक मिलियन tokens का वास्तविक मूल्य क्या है इसे पढ़ने और लिखने की उस मात्रा में बदल देता है जिसकी आप कल्पना कर सकते हैं।
The data behind this chart
[
{
"label": "Opus 5",
"input_usd_per_mtok": 5,
"cache_read_usd_per_mtok": 0.5,
"output_usd_per_mtok": 25,
"afternoon_usd": 5.65
},
{
"label": "Sonnet 5",
"input_usd_per_mtok": 2,
"cache_read_usd_per_mtok": 0.2,
"output_usd_per_mtok": 10,
"afternoon_usd": 2.26
},
{
"label": "Haiku 4.5",
"input_usd_per_mtok": 1,
"cache_read_usd_per_mtok": 0.1,
"output_usd_per_mtok": 5,
"afternoon_usd": 1.13
}
]वही दोपहर Opus 5 पर $5.65 और Haiku 4.5 पर $1.13 की पड़ती है। Output ही कुल खर्च को प्रभावित करता है: Opus 5 पर प्रति मिलियन tokens $25 की तुलना में Haiku 4.5 पर $5 के साथ, Claude द्वारा लिखे गए 150,000 tokens की लागत उसके द्वारा पढ़े गए 2 मिलियन tokens से अधिक है। यही कारण है कि thinking budget को कम करना फाइलों को छोटा करने की तुलना में अधिक बचत करता है।
एक तारीख ध्यान देने योग्य है। Sonnet 5 पर 31 अगस्त 2026 तक प्रति मिलियन input और output tokens के लिए $2 और $10 की प्रारंभिक कीमत है, और 1 सितंबर 2026 को यह बढ़कर $3 और $15 हो जाएगी, जो उसी दोपहर के खर्च को $2.26 से बढ़ाकर लगभग $3.39 कर देती है।
प्रत्येक दोपहर के आंकड़े की गणना कैसे की जाती है
Opus 5: $5 प्रति मिलियन की दर से 200,000 uncached input tokens का खर्च $1.00 है। input दर के दसवें हिस्से पर 1.8 million cache reads का खर्च $0.90 है। $25 प्रति मिलियन की दर से 150,000 output tokens का खर्च $3.75 है। कुल $5.65।
Sonnet 5: $0.40 uncached input, $0.36 cache reads, $1.50 output। कुल $2.26।
Haiku 4.5: $0.20 uncached input, $0.18 cache reads, $0.75 output। कुल $1.13।
सभी 3 पंक्तियाँ समान token counts मानती हैं, इसलिए उनके बीच का अंतर पूरी तरह से कीमत का है। एक वास्तविक दोपहर इस बात पर निर्भर करती है कि आपका कितना context cached रहता है।
पैमाने के लिए, अगस्त 2026 तक Anthropic का अपना documentation enterprise deployments में औसत Claude Code खर्च को प्रति developer प्रति active day $13 के करीब, और 90% users के लिए प्रति active day $30 से कम बताता है। Per token billing स्वचालित रूप से subscription से सस्ती नहीं होती है। यह तब फायदेमंद है जब आपका load spiky हो, क्योंकि शांत दिनों में कोई खर्च नहीं होता, और जब आप हर दिन काम करते हैं तो यह नुकसानदेह हो सकता है। वास्तविक आंकड़ों के साथ API बनाम subscription की तुलना में crossover बिंदु दिया गया है।
VPS पर रात भर लंबा जॉब चलाएं
कुछ कार्यों के लिए आपको निगरानी रखने की आवश्यकता नहीं होती: जैसे बड़ा refactor, test migration, या documentation sweep। इन कार्यों के लिए आपके subscription window की भी आवश्यकता नहीं है। इन्हें API key के साथ एक VPS (virtual private server) पर डालें; ये per token billing का उपयोग करेंगे जबकि आपका plan allowance कल के interactive काम के लिए सुरक्षित रहेगा।
Ubuntu box पर Claude Code इंस्टॉल करें और सुनिश्चित करें कि यह चल रहा है:
curl -fsSL https://claude.ai/install.sh | bash
claude --versionclaude --version को 2.1.211 (Claude Code) जैसा version string print करना चाहिए। यहाँ command not found का अर्थ है कि ~/.local/bin अभी आपके PATH में नहीं है, इसलिए एक नया shell खोलें और पुनः प्रयास करें।
Key को shell history में रखने के बजाय एक file में रखें। एक editor में ~/.claude-env बनाएँ जिसमें एक line हो, export ANTHROPIC_API_KEY=sk-ant-your-key-here, फिर इसे lock करें और load करें:
chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10अंतिम line पहले दस characters print करती है, जो पूरी key को screen पर दिखाए बिना variable के set होने की पुष्टि करने के लिए पर्याप्त है।
अब tmux के अंदर job शुरू करें ताकि आपके laptop को बंद करने पर भी यह चलता रहे:
tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
--allowedTools "Read,Edit,Bash" \
--append-system-prompt-file ./CLAUDE.md \
--output-format json > ~/overnight.jsonCtrl-b और फिर d दबाकर detach करें, और connection बंद कर दें। बाद में tmux attach -t overnight के साथ reattach करें। Claude Code in a tmux session on a VPS session handling को विस्तार से कवर करता है।
यहाँ --bare महत्वपूर्ण है। यह hooks, skills, plugins और CLAUDE.md की auto-discovery को skip करता है, और यह कभी भी OAuth credentials नहीं पढ़ता, इसलिए run केवल API key का उपयोग करता है और कुछ नहीं। यही वह चीज़ है जो job को आपके subscription से दूर रखती है। इसका मतलब यह भी है कि project rules हट जाते हैं, इसीलिए --append-system-prompt-file उन्हें जानबूझकर वापस लाता है। --bare के बिना, एक set ANTHROPIC_API_KEY एक बार का approval prompt trigger करता है जिसका उत्तर unattended run नहीं दे सकता।
सुबह, JSON से परिणाम और लागत पढ़ें:
jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.jsonClaude Code सफलता पर 0 exit देता है और run विफल होने पर non-zero, इसलिए एक wrapper script exit status के आधार पर branch कर सकती है और आपको विफलता की सूचना mail कर सकती है। इसे चलने के लिए छोड़ने से पहले Claude Console में workspace spend limit set करें: 3am पर retry loop में फंसा agent वास्तविक पैसे खर्च करने का एक निश्चित तरीका है। यदि आप इसे धीमा करना चाहते हैं तो CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY को कम करें। Cost control for agents you leave running उन caps के बारे में बताता है जिन्हें पहले set करना उचित है।
Job को अपना unprivileged user और अपनी git branch दें। एक agent जो unattended तरीके से repository edit कर रहा है, कभी-कभी ऐसा कुछ कर सकता है जिसे आप रोक देते, और एक branch इसे एक incident के बजाय एक git checkout बना देती है। Running a coding agent safely on a VPS isolation को कवर करता है।
Bulk काम के लिए जो बिल्कुल भी interactive नहीं है, जैसे हजारों records को classify करना, Batch API अनुरोधों को asynchronously process करता है और input व output tokens दोनों पर 50% की छूट देता है। यह Anthropic द्वारा प्रकाशित सबसे सस्ता per token मार्ग है, और रात भर की window ठीक वही latency है जिसकी इसे आवश्यकता होती है।
क्या करने से आपका एक्सेस वापस नहीं मिलता है
नई बातचीत शुरू करने से आपकी allowance रिस्टोर नहीं होती है। उपयोग की गणना आपके अकाउंट के आधार पर की जाती है, न कि किसी बातचीत के आधार पर। यह हर अगले मैसेज को सस्ता जरूर बना देता है, क्योंकि एक नई बातचीत में कोई पुराना इतिहास नहीं होता जिसे दोबारा पढ़ना पड़े, इसलिए ऐसा करना फायदेमंद है। यह लागत में कटौती है, न कि रीसेट।
पुरानी बातचीत को डिलीट करने से कुछ भी रिफंड नहीं होता है। वे tokens तब खर्च हो चुके थे जब उन्हें प्रोसेस किया गया था।
सेशन या साप्ताहिक मैसेज के बाद मॉडल बदलने से कुछ नहीं होता, क्योंकि वे विंडोज सभी मॉडल्स के बीच साझा की जाती हैं। केवल वही मैसेज जो किसी मॉडल का नाम लेता है, /model पर प्रतिक्रिया देता है।
लूप में बार-बार प्रयास करने से आपके टर्मिनल के व्यस्त रहने के अलावा कुछ नहीं होता। मैसेज में दिया गया रीसेट समय ही वास्तविक उत्तर है, और /usage आपको बिना किसी एरर के वही घड़ी दिखाएगा।
FAQ
How long until my Claude limit resets?
The message tells you. Session limits run on a rolling five hour window and the message shows a clock time, such as resets 3:45pm. Weekly limits reset at a fixed time each week assigned to your account, and the message shows the day, such as resets Mon 12:00am. To see both bars and both reset times before you hit anything, run /usage in Claude Code, or open Settings and then Usage on claude.ai.
Does switching to Sonnet get me working again?
Only when the message names a model. After You've hit your Opus limit, run /model, choose a different model, and the session continues with your context intact. After You've hit your session limit or You've hit your weekly limit, model choice makes no difference, because those windows count every model together. Switching to a cheaper model before you hit the wall is what actually stretches the window.
Will starting a new chat reset my usage limit?
No. Usage is counted against your account, so a new chat starts against the same empty allowance. It does make each following message cheaper, because a new conversation carries no history for Claude to re-read. /clear in Claude Code does the same thing and costs nothing, while /compact has to read the conversation it summarizes, so compacting a very large session is itself an expensive request.
Is the API cheaper than upgrading my plan?
It depends on how steady your usage is. The worked afternoon on this page costs $2.26 on Sonnet 5 and $1.13 on Haiku 4.5 at August 2026 list rates. A subscription is a flat fee for a capped allowance, so it wins when you work most days. Per token billing wins when your load is spiky, because quiet days cost you nothing at all.
Can I keep a job running while I wait for the reset?
Yes, if you move it off your subscription. Run it on a VPS with ANTHROPIC_API_KEY set in the environment and it bills per token instead of drawing on your plan window, so the two never compete. claude --bare -p inside tmux survives your laptop closing, and --output-format json writes a total_cost_usd field you can check in the morning with jq.