SSD Nodes Learn Hosting plans →
गाइड Matt Connorलेखक: Matt Connor · अपडेट किया गया: 2026-09-22

Claude usage limit पहुँचने पर क्या करें?

यदि आपको Claude usage limit का संदेश मिला है तो पहले अपनी विंडो चेक करें। सेशन या साप्ताहिक सीमा के आधार पर मॉडल बदलें, कॉन्टेक्स्ट छोटा करें या API का उपयोग करके अपना काम जारी रखें।

आप Claude की किस सीमा (limit) तक पहुँचे हैं

Claude की सीमा पहुँचने का संदेश उस विंडो (window) का नाम बताता है जिसका आप इंतज़ार कर रहे हैं, और वही विंडो तय करती है कि आप आगे क्या कर सकते हैं। सेशन (session) और साप्ताहिक सीमाएँ एक साथ सभी मॉडल्स पर लागू होती हैं, इसलिए मॉडल बदलने से आपको एक्सेस वापस नहीं मिलता। जिस सीमा में किसी एक मॉडल का नाम होता है, वह अपवाद है: मॉडल बदलें और आप काम जारी रख सकते हैं जबकि वह एक मॉडल ब्लॉक रहता है।

Claude Code उसी लाइन में विंडो और उसके रीसेट होने का समय प्रिंट करता है:

You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pm

सेशन विंडो पाँच घंटे की एक रोलिंग अवधि है। साप्ताहिक विंडो हर सप्ताह एक निश्चित समय पर रीसेट होती है जो आपके अकाउंट के लिए निर्धारित है, इसलिए दिन और समय हर सप्ताह एक समान रहते हैं। Pro प्लान में पाँच घंटे की सेशन विंडो के साथ एक साप्ताहिक सीमा होती है जो सभी मॉडल्स पर लागू होती है। Max प्लान में एक दूसरी साप्ताहिक सीमा जुड़ती है जो विशेष रूप से एक मॉडल फैमिली पर लागू होती है। सीमाएँ स्वयं Claude उपयोग सीमाओं के पूर्ण विवरण में दी गई हैं। यह पेज वहीं से शुरू होता है जहाँ वह समाप्त होता है।

यहाँ वह हिस्सा है जहाँ लोग अक्सर उलझ जाते हैं। हर रिक्वेस्ट सेशन विंडो और साप्ताहिक विंडो दोनों के खिलाफ एक साथ गिनी जाती है, इसलिए एक भारी दोपहर आपके साप्ताहिक कोटे को खाली कर सकती है जबकि पाँच घंटे की विंडो में अभी भी जगह बची हो सकती है। अपने दिन की बाकी योजना बनाने से पहले रीसेट का समय पढ़ें। दोपहर 3:45 बजे का रीसेट एक कॉफी ब्रेक हो सकता है। सोमवार आधी रात का रीसेट ऐसा नहीं है।

अनुमान लगाने से पहले मीटर देखें

claude.ai पर, Settings और फिर Usage खोलें। प्रोग्रेस बार दिखाते हैं कि आपने पांच घंटे की सेशन विंडो और प्रत्येक साप्ताहिक विंडो का कितना उपयोग किया है, ताकि आप अनुमान लगाने के बजाय देख सकें कि कौन सी विंडो खाली है।

Claude Code में, /usage चलाएं। यह समान प्रोग्रेस बार दिखाता है और साथ ही यह विवरण भी देता है कि हालिया उपयोग कहाँ हुआ है, जिसे कुल उपयोग के प्रतिशत के रूप में स्किल्स, सब-एजेंट्स, प्लगइन्स और व्यक्तिगत MCP (model context protocol) सर्वर्स के आधार पर विभाजित किया गया है। पिछले 24 घंटों के लिए d दबाएं और पिछले 7 दिनों के लिए w दबाएं। यह किसी भी ऐसे पैटर्न को भी चिह्नित करता है जो हालिया उपयोग का 10% या उससे अधिक है, और आप जो दो सबसे आम पैटर्न देखेंगे वे हैं लॉन्ग कॉन्टेक्स्ट और कैश मिस।

दो सावधानियां। यह विवरण उस मशीन पर संग्रहीत सेशन हिस्ट्री से निकाला गया है, इसलिए किसी अन्य लैपटॉप या claude.ai पर किया गया काम इसमें शामिल नहीं है, भले ही उसने उसी अलाउंस का उपयोग किया हो, क्योंकि Claude Code और आपके claude.ai चैट्स एक ही सब्सक्रिप्शन विंडो साझा करते हैं। और शीर्ष पर Session ब्लॉक में दी गई डॉलर राशि API (application programming interface) उपयोगकर्ताओं के लिए मानक लिस्ट दरों पर आधारित है, जिसका अर्थ है कि जब आप सब्सक्रिप्शन पर होते हैं तो यह आपका बिल नहीं है।

क्या छोटे मॉडल पर स्विच करने से मदद मिलती है?

यह केवल तभी होता है जब मैसेज में किसी मॉडल का नाम लिया गया हो। You've hit your Opus limit के बाद, /model चलाएं, Sonnet या Haiku चुनें, और सेशन पूरे कॉन्टेक्स्ट के साथ आगे बढ़ता रहेगा। You've hit your session limit या You've hit your weekly limit के बाद, /model कुछ भी नहीं बदलता है, क्योंकि वे विंडो हर मॉडल में साझा की जाती हैं।

लिमिट हिट करने के बाद की तुलना में, पहले स्विच करना कहीं अधिक फायदेमंद है। Sonnet अधिकांश कोडिंग कार्य Opus की तुलना में बहुत कम खर्च में संभाल लेता है, इसलिए Opus को अपना डिफ़ॉल्ट बनाए रखना उन दो आदतों में से एक है जिनके कारण अक्सर अप्रत्याशित उपयोग (surprise usage) होता है। दूसरी आदत एक ऐसा सेशन है जिसे कभी क्लियर नहीं किया जाता। मैकेनिकल संपादन और लॉग ट्राइएज (log triage) का काम Haiku को दें, और Opus को केवल उन डिज़ाइन निर्णयों के लिए रखें जहाँ आप वास्तव में अटक गए हैं। Opus, Sonnet और Haiku के बीच चयन में विस्तार से बताया गया है कि प्रत्येक मॉडल अपनी कीमत के अनुसार कहाँ उपयोगी है।

जिन संदर्भों (context) का उपयोग बंद कर दिया है, उनके लिए भुगतान करना बंद करें

Claude Code हर अनुरोध के साथ आपकी पूरी बातचीत भेजता है, और हर बार जब Claude किसी टूल का उपयोग करता है, तो वह टूल परिणामों के उस बैच को लेकर एक और अनुरोध भेजता है। प्रॉम्प्ट कैशिंग का मतलब है कि इतिहास को पूर्ण इनपुट दर के बजाय कैश की गई दर पर फिर से पढ़ा जाता है, जिससे यह सस्ता हो जाता है, मुफ्त नहीं। इसलिए, सुबह से खुले हुए सत्र में एक पंक्ति का प्रश्न भी पूरी बातचीत के लिए उपयोग (usage) की खपत करता है।

/context
/clear
/compact Focus on the failing tests and the files we changed

/clear की कोई लागत नहीं है, क्योंकि यह संदर्भ को पढ़ने के बजाय उसे हटा देता है। /compact को उस बातचीत को पढ़ना पड़ता है जिसका वह सारांश प्रस्तुत करता है, इसलिए बहुत बड़े संदर्भ को संक्षिप्त करना स्वयं में एक बड़ा अनुरोध है। जब आप किसी असंबंधित कार्य पर जाते हैं तो /clear का उपयोग करें, और /compact का उपयोग केवल तब करें जब आप कार्य के बीच में हों और आपको थ्रेड को बनाए रखने की आवश्यकता हो। क्लियर करने से पहले /rename चलाएं ताकि आप /resume के साथ सत्र को फिर से ढूंढ सकें।

कैश का जीवनकाल (cache lifetime) उससे कहीं अधिक मायने रखता है जितना लोग सोचते हैं। सब्सक्रिप्शन पर कैश एक घंटे तक रहता है। जब आप उपयोग क्रेडिट का उपयोग कर रहे होते हैं तो यह घटकर पांच मिनट रह जाता है, और API key पर भी पांच मिनट ही डिफ़ॉल्ट होता है। लंबे लंच के बाद आपका पहला संदेश कैश को मिस कर देता है और पूरे संदर्भ को पूर्ण इनपुट मूल्य पर फिर से प्रोसेस करता है, यही कारण है कि उपयोग अक्सर बिना किसी स्पष्ट कारण के बढ़ जाता है। प्रॉम्प्ट कैशिंग कब किफायती होती है में इसकी गणना को समझाया गया है।

तीन और विकल्प एक ही स्थान पर मौजूद हैं। /mcp आपके कॉन्फ़िगर किए गए सर्वरों की सूची दिखाता है ताकि आप उन सर्वरों को बंद कर सकें जिनकी इस कार्य के लिए आवश्यकता नहीं है। एक लंबी CLAUDE.md फ़ाइल सत्र शुरू होते ही लोड हो जाती है, चाहे कार्य को इसकी आवश्यकता हो या न हो, इसलिए विशेष निर्देशों को स्किल्स (skills) में ले जाएं, जो केवल बुलाए जाने पर ही लोड होती हैं। और विस्तारित थिंकिंग (extended thinking) को आउटपुट टोकन के रूप में बिल किया जाता है, जो कि महंगा हिस्सा है, इसलिए इसे /effort के साथ कम करें, /config में इसे बंद करें, या निश्चित थिंकिंग बजट वाले मॉडल पर MAX_THINKING_TOKENS=8000 सेट करें।

कार्य को विभाजित करें ताकि वह एक विंडो में फिट हो जाए

किसी बड़े बदलाव से पहले प्लान मोड में जाने के लिए Shift+Tab दबाएं। Claude कोडबेस का विश्लेषण करता है और आपकी स्वीकृति के लिए एक दृष्टिकोण प्रस्तावित करता है। यदि वहां कोई गलत दिशा पकड़ी जाती है, तो इसमें केवल एक प्लान का खर्च आता है, न कि दो घंटे की एडिटिंग और फिर से काम करने का।

शोर मचाने वाले ऑपरेशन्स को सब-एजेंट्स (subagents) को सौंपें। टेस्ट सूट चलाना या सब-एजेंट के अंदर 10,000 लाइन की लॉग फाइल पढ़ना, रॉ आउटपुट को उसी सब-एजेंट के कॉन्टेक्स्ट में रखता है, और केवल सारांश ही आपकी मुख्य बातचीत में वापस आता है।

जैसे ही Claude गलत दिशा में आगे बढ़े, Escape दबाएं। /rewind बातचीत और कोड दोनों को पिछले चेकपॉइंट पर रिस्टोर कर देता है, ताकि आपको उस काम को हटाने के लिए भुगतान न करना पड़े जिसे आप कभी चाहते ही नहीं थे।

क्या आपको usage credits खरीदने चाहिए या API का उपयोग करना चाहिए?

Usage credits Pro या Max अकाउंट को प्लान की सीमा समाप्त होने के बाद भी काम जारी रखने की सुविधा देते हैं, जिसका बिल मानक API दरों पर आता है। इन्हें claude.ai पर Settings और फिर Usage के अंतर्गत एक भुगतान विधि जोड़कर चालू करें, या Claude Code में /usage-credits चलाएं, जो ब्राउज़र में आपकी बिलिंग सेटिंग्स खोल देगा। Credits Claude वार्तालापों और Claude Code टर्मिनल उपयोग दोनों पर लागू होते हैं, जिनकी दैनिक रिडेम्पशन सीमा $2000 है। इस कमांड के लिए सब्सक्रिप्शन लॉगिन की आवश्यकता होती है, इसलिए जब आप API key के साथ authenticate करते हैं तो यह उपलब्ध नहीं होता है। फ्री प्लान पर credits बिल्कुल भी नहीं दिए जाते हैं, इसलिए पहला कदम $20 प्रति माह पर Pro लेना है, और Pro क्या जोड़ता है और इसकी सीमाएं आपको कहाँ रोकती हैं यह बताता है कि यह आपको कितनी दूर तक ले जाता है। यदि आप अधिकांश सप्ताह credits के साथ टॉप-अप कर रहे हैं, तो आमतौर पर एक बड़ी allowance रखना सस्ता विकल्प होता है, और $100 और $200 Max टियर्स के बीच का अंतर मॉडल्स या फीचर्स में अंतर के बजाय उपयोग का मल्टीप्लायर है।

दूसरा रास्ता Claude Console से एक साधारण API key है, जिसका बिल प्रति टोकन के हिसाब से आता है और इसमें कोई सेशन या साप्ताहिक विंडो नहीं होती है। इसके साथ एक समस्या यह है: आपके एनवायरनमेंट में एक अनचाहा ANTHROPIC_API_KEY Claude Code को आपके सब्सक्रिप्शन के बजाय उस key के माध्यम से रूट कर देता है, बिना आपको बताए। आपको इसका पता बिल से चलता है, या इससे:

API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.

वह 429 आपकी key पर रेट लिमिट है, आपके प्लान पर नहीं। /status चलाएं और पुष्टि करें कि सक्रिय क्रेडेंशियल वही है जिसका आप उपयोग करना चाहते थे।

API पर एक दोपहर का खर्च क्या है?

नीचे दिया गया उदाहरण एजेंट-शैली की कोडिंग की एक दोपहर का है: 200,000 अनकैश्ड इनपुट टोकन, 1.8 मिलियन कैश रीड्स, और 150,000 आउटपुट टोकन। कीमतें अगस्त 2026 तक Anthropic की सूची दरों के अनुसार हैं। इनमें से प्रत्येक दर प्रति मिलियन टोकन के हिसाब से उद्धृत है, इसलिए यदि वह इकाई अभी भी अमूर्त लगती है, तो एक मिलियन टोकन का वास्तविक मूल्य क्या है इसे पढ़ने और लिखने की उस मात्रा में बदल देता है जिसे आप समझ सकते हैं।

ChartOne afternoon of agent work priced at API list rates, August 2026
The data behind this chart
[
  {
    "label": "Opus 5",
    "input_usd_per_mtok": 5,
    "cache_read_usd_per_mtok": 0.5,
    "output_usd_per_mtok": 25,
    "afternoon_usd": 5.65
  },
  {
    "label": "Sonnet 5",
    "input_usd_per_mtok": 2,
    "cache_read_usd_per_mtok": 0.2,
    "output_usd_per_mtok": 10,
    "afternoon_usd": 2.26
  },
  {
    "label": "Haiku 4.5",
    "input_usd_per_mtok": 1,
    "cache_read_usd_per_mtok": 0.1,
    "output_usd_per_mtok": 5,
    "afternoon_usd": 1.13
  }
]

वही दोपहर Opus 5 पर $5.65 और Haiku 4.5 पर $1.13 की पड़ती है। आउटपुट ही कुल खर्च को प्रभावित करता है: Opus 5 पर $25 प्रति मिलियन टोकन की तुलना में Haiku 4.5 पर $5 के साथ, Claude द्वारा लिखे गए 150,000 टोकन, उसके द्वारा पढ़े गए 2 मिलियन टोकन से अधिक महंगे पड़ते हैं। यही कारण है कि थिंकिंग बजट को कम करना फाइलों को छोटा करने की तुलना में अधिक बचत करता है। यदि प्रश्न यह है कि किस मॉडल को चलाने के बजाय किस प्रदाता को भुगतान करना है, तो Claude और ChatGPT API दोनों पर तीन कार्यों की लागत दिखाता है कि प्रत्येक बिल कहाँ अधिक आता है।

एक तारीख ध्यान देने योग्य है। Sonnet 5 पर 31 अगस्त 2026 तक प्रति मिलियन इनपुट और आउटपुट टोकन के लिए $2 और $10 की प्रारंभिक कीमत है, और यह 1 सितंबर 2026 को $3 और $15 हो जाएगी, जो उसी दोपहर के खर्च को $2.26 से बढ़ाकर लगभग $3.39 कर देती है।

प्रत्येक दोपहर का आंकड़ा कैसे निकाला जाता है

Opus 5: $5 प्रति मिलियन की दर से 200,000 अनकैश्ड इनपुट टोकन $1.00 के हैं। इनपुट दर के दसवें हिस्से पर 1.8 मिलियन कैश रीड्स $0.90 के हैं। $25 प्रति मिलियन की दर से 150,000 आउटपुट टोकन $3.75 के हैं। कुल $5.65।

Sonnet 5: $0.40 का अनकैश्ड इनपुट, $0.36 के कैश रीड्स, $1.50 का आउटपुट। कुल $2.26।

Haiku 4.5: $0.20 का अनकैश्ड इनपुट, $0.18 के कैश रीड्स, $0.75 का आउटपुट। कुल $1.13।

सभी 3 पंक्तियाँ समान टोकन गणना मानती हैं, इसलिए उनके बीच का अंतर पूरी तरह से कीमत का है। एक वास्तविक दोपहर इस बात पर निर्भर करती है कि आपका कितना संदर्भ कैश में रहता है।

पैमाने के लिए, Anthropic का अपना दस्तावेज़ीकरण अगस्त 2026 तक एंटरप्राइज़ परिनियोजन में औसत Claude Code खर्च को प्रति डेवलपर प्रति सक्रिय दिन $13 के करीब, और 90% उपयोगकर्ताओं के लिए प्रति सक्रिय दिन $30 से कम बताता है। प्रति टोकन बिलिंग स्वचालित रूप से सदस्यता से सस्ती नहीं होती है। यह तब जीतती है जब आपका लोड स्पाइकी (अस्थिर) होता है, क्योंकि शांत दिनों में कोई खर्च नहीं होता है, और यह तब हारती है जब आप हर दिन काम करते हैं। वास्तविक संख्याओं के साथ तुलना में, API बनाम सदस्यता में क्रॉसओवर बिंदु दिया गया है।

VPS पर रात भर लंबा जॉब चलाएं

कुछ कार्यों के लिए आपको निगरानी रखने की आवश्यकता नहीं होती है: जैसे कि बड़ा refactor, test migration, या documentation sweep। इन कार्यों के लिए आपके subscription window की भी आवश्यकता नहीं है। इन्हें API key के साथ एक VPS (virtual private server) पर डालें; ये per-token billing का उपयोग करेंगे, जबकि आपका plan allowance कल के interactive काम के लिए सुरक्षित रहेगा।

Ubuntu box पर Claude Code इंस्टॉल करें और सुनिश्चित करें कि यह चल रहा है:

curl -fsSL https://claude.ai/install.sh | bash
claude --version

claude --version को 2.1.211 (Claude Code) जैसा version string प्रिंट करना चाहिए। यहाँ command not found का मतलब है कि ~/.local/bin अभी तक आपके PATH में नहीं है, इसलिए एक नया shell खोलें और पुनः प्रयास करें। वही installer आप Linux desktop पर भी चलाएंगे, जहाँ CLI, beta desktop app और editor plugins के साथ रहता है।

Key को shell history में रखने के बजाय एक file में रखें। एक editor में ~/.claude-env बनाएँ जिसमें एक लाइन export ANTHROPIC_API_KEY=sk-ant-your-key-here हो, फिर उसे lock करें और load करें:

chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10

वह अंतिम लाइन पहले दस characters प्रिंट करती है, जो पूरी key को screen पर दिखाए बिना यह पुष्टि करने के लिए पर्याप्त है कि variable set हो गया है।

अब tmux के अंदर job शुरू करें ताकि आपके laptop को बंद करने पर भी यह चलता रहे:

tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
  --allowedTools "Read,Edit,Bash" \
  --append-system-prompt-file ./CLAUDE.md \
  --output-format json > ~/overnight.json

Ctrl-b और फिर d दबाकर detach करें, और connection बंद कर दें। बाद में tmux attach -t overnight के साथ reattach करें। VPS पर tmux session में Claude Code session handling को विस्तार से बताता है।

यहाँ --bare महत्वपूर्ण है। यह hooks, skills, plugins और CLAUDE.md की auto-discovery को छोड़ देता है, और यह कभी भी OAuth credentials नहीं पढ़ता है, इसलिए run केवल API key का उपयोग करता है और कुछ नहीं। यही वह चीज़ है जो job को आपके subscription से बाहर रखती है। इसका मतलब यह भी है कि project rules हट जाते हैं, इसीलिए --append-system-prompt-file उन्हें जानबूझकर वापस देता है। --bare के बिना, एक set ANTHROPIC_API_KEY एक बार का approval prompt ट्रिगर करता है जिसका उत्तर unattended run नहीं दे सकता।

सुबह, JSON से परिणाम और लागत पढ़ें:

jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.json

Claude Code सफलता पर 0 exit देता है और run विफल होने पर non-zero, इसलिए एक wrapper script exit status के आधार पर branch कर सकती है और आपको विफलता की सूचना mail कर सकती है। इसे चलने के लिए छोड़ने से पहले Claude Console में workspace spend limit सेट करें: रात के 3 बजे retry loop में फंसा एक agent वास्तविक पैसे खर्च करने का एक निश्चित तरीका है। यदि आप इसे धीमा करना चाहते हैं तो CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY को कम करें। चलते हुए agents के लिए लागत नियंत्रण उन सीमाओं के बारे में बताता है जिन्हें पहले सेट करना उचित है।

Job को अपना unprivileged user और अपनी git branch दें। एक agent जो unattended तरीके से repository को edit कर रहा है, वह कभी-कभी ऐसा कुछ कर सकता है जिसे आप रोक देते, और एक branch इसे एक incident के बजाय git checkout बना देती है। VPS पर कोडिंग एजेंट को सुरक्षित रूप से चलाना isolation को कवर करता है।

Bulk काम के लिए जो बिल्कुल भी interactive नहीं है, जैसे कि हजारों records को classify करना, Batch API अनुरोधों को asynchronously 50% की छूट पर (input और output दोनों tokens पर) process करता है। यह Anthropic द्वारा प्रकाशित सबसे सस्ता per-token मार्ग है, और रात भर की window बिल्कुल वही latency है जिसकी इसे आवश्यकता होती है।

क्या करने से आपका एक्सेस वापस नहीं मिलता है

केवल समय बीतने से आपकी usage allowance वापस मिलती है। इसलिए Claude usage limit reset करने का हर कथित तरीका बारीकी से जाँचने पर विफल हो जाता है।

नई बातचीत शुरू करने से आपकी allowance रिस्टोर नहीं होती है। उपयोग की गणना आपके अकाउंट के आधार पर की जाती है, न कि किसी बातचीत के आधार पर। हालाँकि, इससे बाद के प्रत्येक मैसेज की लागत कम हो जाती है, क्योंकि एक नई बातचीत में दोबारा पढ़ने के लिए कोई पुराना इतिहास नहीं होता है, इसलिए ऐसा करना अभी भी फायदेमंद है। यह लागत में कटौती है, न कि रीसेट।

पुरानी बातचीत को डिलीट करने से कुछ भी रिफंड नहीं मिलता है। वे टोकन तब खर्च हो गए थे जब उन्हें प्रोसेस किया गया था।

किसी सेशन या साप्ताहिक मैसेज के बाद मॉडल बदलने से कुछ नहीं होता, क्योंकि वे विंडो सभी मॉडल्स के बीच साझा की जाती हैं। केवल वही मैसेज जो किसी मॉडल का नाम लेता है, वह /model पर प्रतिक्रिया देता है।

लूप में बार-बार प्रयास करने से आपके टर्मिनल के व्यस्त रहने के अलावा कुछ नहीं होता। मैसेज में दिया गया रीसेट समय ही वास्तविक उत्तर है, और /usage आपको बिना किसी त्रुटि के वही घड़ी दिखाएगा।

Upgrade करने से ही सीमा बढ़ती है। इसलिए भुगतान करने के बाद भी यदि limits नहीं बदलती हैं, तो allowance में समस्या मान लेने से पहले जाँच करें कि नई plan पुरानी limits क्यों बनाए रख सकती है।

FAQ

How long until my Claude limit resets?

The message tells you. Session limits run on a rolling five hour window and the message shows a clock time, such as resets 3:45pm. Weekly limits reset at a fixed time each week assigned to your account, and the message shows the day, such as resets Mon 12:00am. To see both bars and both reset times before you hit anything, run /usage in Claude Code, or open Settings and then Usage on claude.ai.

Does switching to Sonnet get me working again?

Only when the message names a model. After You've hit your Opus limit, run /model, choose a different model, and the session continues with your context intact. After You've hit your session limit or You've hit your weekly limit, model choice makes no difference, because those windows count every model together. Switching to a cheaper model before you hit the wall is what actually stretches the window.

Will starting a new chat reset my usage limit?

No. Usage is counted against your account, so a new chat starts against the same empty allowance. It does make each following message cheaper, because a new conversation carries no history for Claude to re-read. /clear in Claude Code does the same thing and costs nothing, while /compact has to read the conversation it summarizes, so compacting a very large session is itself an expensive request.

Is the API cheaper than upgrading my plan?

It depends on how steady your usage is. The worked afternoon on this page costs $2.26 on Sonnet 5 and $1.13 on Haiku 4.5 at August 2026 list rates. A subscription is a flat fee for a capped allowance, so it wins when you work most days. Per token billing wins when your load is spiky, because quiet days cost you nothing at all.

Can I keep a job running while I wait for the reset?

Yes, if you move it off your subscription. Run it on a VPS with ANTHROPIC_API_KEY set in the environment and it bills per token instead of drawing on your plan window, so the two never compete. claude --bare -p inside tmux survives your laptop closing, and --output-format json writes a total_cost_usd field you can check in the morning with jq.