SSD Nodes Learn Hosting plans →
गाइड Matt Connorलेखक: Matt Connor · अपडेट किया गया: 2026-08-26

क्या Claude API लेना सब्सक्रिप्शन से सस्ता है?

क्या आपको Claude API का उपयोग करना चाहिए या मंथली सब्सक्रिप्शन लेना चाहिए? यहाँ प्रति-टोकन दरों का सटीक गणित और ब्रेक-ईवन पॉइंट दिया गया है जो आपके उपयोग के अनुसार लागत तय करेगा।

क्या Claude API सब्सक्रिप्शन से सस्ती है?

एक निश्चित उपयोग सीमा से नीचे Claude API सब्सक्रिप्शन की तुलना में सस्ती है, और उससे अधिक उपयोग होने पर यह महंगी हो जाती है। यदि कोई डेवलपर पूरे दिन इंटरैक्टिव तरीके से कोडिंग कर रहा है, तो आमतौर पर फ्लैट प्लान अधिक किफायती रहता है। ऐसे प्रोग्राम के लिए जो स्वयं API calls करता है, API ही एकमात्र विकल्प है, इसलिए लागत यहाँ निर्णय का आधार नहीं होती। बाकी गणना आप दस मिनट में कर सकते हैं।

कोई आधिकारिक 'ब्रेक-ईवन' संख्या नहीं है जिसे आप देख सकें। सब्सक्रिप्शन को टोकन अलाउंस के बजाय 'यूसेज विंडो' के रूप में बेचा जाता है, इसलिए कोई भी प्रकाशित आंकड़ा यह नहीं बता सकता कि दोनों रेखाएं कहाँ मिलती हैं। नीचे दिया गया फॉर्मूला वर्तमान प्रति-टोकन दरों पर आधारित है, साथ ही इसमें आपके व्यवहार के वे पहलू शामिल हैं जो प्लान शुल्क की तुलना में परिणाम को अधिक प्रभावित करते हैं। नीचे दी गई प्रत्येक ब्रेक-ईवन संख्या प्रकाशित दरों और मान्यताओं पर आधारित मेरी अपनी गणना है, न कि कोई आधिकारिक दस्तावेजी आंकड़ा।

यदि आप अभी भी यह तय कर रहे हैं कि कौन सा प्लान खरीदना है, तो आपके काम करने के तरीके के लिए कौन सा Claude प्लान उपयुक्त है इसका उत्तर देता है। यह पोस्ट मानती है कि आप जानते हैं कि आप कौन सा प्लान खरीदेंगे, और आप यह जानना चाहते हैं कि क्या उसे खरीदना उचित है।

दो बिलिंग मॉडल जिनका स्वरूप एक जैसा नहीं है

सब्सक्रिप्शन वह क्षमता है जिसका आप उपयोग नहीं कर सकते। आप एक निश्चित शुल्क का भुगतान करते हैं और आपको एक भत्ता (allowance) मिलता है जो एक निश्चित समय-सारणी पर रीसेट होता है। Anthropic के Claude Code दस्तावेज़ Team और Enterprise सीटों के स्वरूप को स्पष्ट करते हैं: उपयोग "प्रति-सीट भत्ते से लिया जाता है जो पांच-घंटे की रोलिंग विंडो और साप्ताहिक विंडो पर रीसेट होता है", जिसे Claude चैट और Cowork के साथ साझा किया जाता है। एक सब्सक्राइबर उसी स्वरूप का सामना करता है जब उसे "You've hit your session limit" और "You've hit your weekly limit" जैसे संदेश मिलते हैं। जिस क्षमता का आप उपयोग नहीं करते, वह वह पैसा है जिसे आपने खर्च कर दिया है। जिस क्षमता से आप अधिक उपयोग करते हैं, वह विंडो रीसेट होने तक आपके काम को रोक देती है, और /model के साथ मॉडल बदलने से एक्सेस बहाल नहीं होता, क्योंकि ये विंडो सभी मॉडलों में साझा की जाती हैं। यदि आप अभी इनमें से किसी एक संदेश को देख रहे हैं, तो आप किस विंडो के रीसेट होने की प्रतीक्षा कर रहे हैं, यह पता लगाना इस गणित से पहले आता है, क्योंकि पांच-घंटे और साप्ताहिक सीमाएं अलग-अलग प्रतिक्रियाओं की मांग करती हैं।

API एक मीटर है जो कभी नहीं रुकता। इसमें कोई विंडो या दीवार नहीं है। प्रत्येक अनुरोध का मूल्य प्रति टोकन निर्धारित होता है, और कुछ चीजें टोकन से बाहर भी मूल्यवान होती हैं: वेब सर्च "Claude API पर $10 प्रति 1,000 सर्च के लिए उपलब्ध है"। कोई भी चीज़ किसी सीमा पर नहीं रुकती। इनवॉइस बस बढ़ती जाती है। इसके नीचे कोई मुफ्त टियर भी नहीं है, हालांकि साइनअप क्रेडिट और वे हिस्से जो मुफ्त हैं इस गणित के मायने रखने से पहले एक शुरुआती प्रयोग में मदद करेंगे।

23 July 2026 तक की योजना शुल्क, Claude मूल्य निर्धारण पृष्ठ से उद्धृत: Pro "$17 प्रति माह वार्षिक सब्सक्रिप्शन छूट के साथ ($200 अग्रिम बिलिंग)। यदि मासिक बिल किया जाता है तो $20" है, और इसमें Claude Code शामिल है। Max को "$100 प्रति माह से शुरू" के रूप में सूचीबद्ध किया गया है। Team सीटें "$20 प्रति सीट / माह यदि वार्षिक बिल किया जाता है" से शुरू होती हैं। Enterprise सबसे दिलचस्प है, क्योंकि यह दोनों मॉडल एक साथ चलाता है: "सीट मूल्य + API दरों पर उपयोग $20/सीट"। यदि आप उस हाइब्रिड मॉडल पर विचार कर रहे हैं, तो Enterprise सीट शुल्क वास्तव में क्या कवर करता है यह सीट न्यूनतम और उन हिस्सों के बारे में बताता है जो केवल एक बातचीत किए गए कोटेशन में आते हैं। यदि आप पूरे Claude के बजाय विशेष रूप से कोडिंग टूल की कीमत लगा रहे हैं, तो प्रत्येक योजना पर Claude Code की लागत उन शुल्कों को एक अनुमानित मासिक गणना के विरुद्ध रखती है। यदि इस तुलना का फ्लैट पक्ष अभी तक Claude पर तय नहीं हुआ है, तो ChatGPT के Go, Plus और Pro के विरुद्ध मूल्य निर्धारण वाले ये टियर उस निर्णय का दूसरा हिस्सा हैं। शुल्क अक्सर बदलते रहते हैं, और प्रत्येक के पीछे की क्षमता कभी भी टोकन में प्रकाशित नहीं की जाती है, इसलिए जिस दिन आप निर्णय लें, उस दिन मूल्य निर्धारण पृष्ठ अवश्य पढ़ें।

जो आपको API से नहीं मिल सकता

एक प्लान अलाउंस, और इसके इर्द-गिर्द बना इंटरफ़ेस। Claude Code की /usage-credits कमांड सब्सक्रिप्शन उपयोग क्रेडिट को मैनेज करती है, और आप इसे "/login के माध्यम से अपने claude.ai सब्सक्रिप्शन के साथ साइन इन करने के बाद" चलाते हैं; यह कमांड API की ऑथेंटिकेशन के साथ उपलब्ध नहीं है। /usage स्क्रीन भी बिलिंग मोड के अनुसार अलग होती है: इसका Session ब्लॉक "API टोकन उपयोग दिखाता है और यह API उपयोगकर्ताओं के लिए है", जबकि सब्सक्राइबर इसके बजाय प्लान उपयोग बार और उपयोग का विवरण देखते हैं। ये दोनों ही इस बात पर निर्भर करते हैं कि आपके प्लान में Claude Code शामिल है या नहीं, जिसे किन प्लान्स में Claude Code शामिल है, और क्या इसका उपयोग विंडो साझा करता है स्पष्ट करता है, जिसमें वह स्थिति भी शामिल है जहाँ एक अनचाही API की चुपचाप आपसे शुल्क ले लेती है। वे यह भी मानते हैं कि आप उस मशीन पर वह इंटरफ़ेस खोल सकते हैं जिस पर आप वास्तव में काम करते हैं, जो Linux पर आपकी अपेक्षा से छोटी सूची है, इसलिए भुगतान करने से पहले वहाँ कौन सी सतहें नेटिव रूप से चलती हैं और प्रत्येक को किस प्लान की आवश्यकता है की जाँच करना उचित है।

Claude Code में एक लंबा प्रॉम्प्ट कैश। यह वास्तविक पैसे खर्च करता है और इसे अनदेखा करना आसान है। दस्तावेज़ कहते हैं कि "सब्सक्रिप्शन पर इसकी अवधि एक घंटे की है और उपयोग क्रेडिट का उपयोग करने पर यह घटकर पाँच मिनट रह जाती है; API की या क्लाउड प्रदाता पर, यह डिफ़ॉल्ट रूप से पाँच मिनट है"। कैश अवधि से अधिक के ब्रेक के बाद आपका पहला संदेश कैश को मिस कर देता है, इसलिए आपका पूरा संदर्भ फिर से प्रोसेस किया जाता है और राइट प्राइस पर बिल किया जाता है। सब्सक्रिप्शन पर आप पचास मिनट की मीटिंग ले सकते हैं और वापस आकर काम जारी रख सकते हैं। API की पर, वही ब्रेक सेशन प्रीफ़िक्स के पूर्ण री-राइट की लागत लगाता है।

सब्सक्रिप्शन से आपको क्या नहीं मिल सकता

प्रोग्रामेटिक एक्सेस (Programmatic access): Claude को कॉल करने वाले किसी cron job या webhook handler के लिए एक API key की आवश्यकता होती है। यदि आपका वर्कलोड ऐसा है, तो तुलना यहीं समाप्त हो जाती है। Building your first Claude API app on a VPS में key handling और पहली कार्यशील स्क्रिप्ट के बारे में बताया गया है।

Batch API डिस्काउंट: प्राइसिंग पेज पर यह स्पष्ट रूप से लिखा है: "Batch API इनपुट और आउटपुट दोनों टोकन पर 50% छूट के साथ बड़ी मात्रा में अनुरोधों की एसिंक्रोनस प्रोसेसिंग की अनुमति देता है।" यह उन सभी कार्यों के लिए मीटर को आधा कर देता है जिनका कोई इंसान इंतजार नहीं कर रहा है। प्रति मिलियन टोकन बैच दरें Opus 4.8 पर $2.50 इन और $12.50 आउट, Sonnet 5 पर शुरुआती कीमत पर $1 और $5, और Haiku 4.5 पर $0.50 और $2.50 हैं। इसमें लेटेंसी (latency) का समझौता करना पड़ता है: अधिकांश बैच एक घंटे के भीतर पूरे हो जाते हैं, जो बैच 24 घंटे के भीतर पूरा नहीं होता वह समाप्त हो जाता है, और स्ट्रीमिंग को बैच नहीं किया जा सकता है। Batch और prompt caching एक साथ काम करते हैं, और चूंकि एक बैच पांच मिनट से अधिक समय तक चल सकता है, इसलिए इसके भीतर 1-घंटे के cache का उपयोग करें।

प्रति-प्रोजेक्ट लागत का विवरण (Per-project cost attribution): प्रत्येक API रिस्पॉन्स एक usage ब्लॉक लौटाता है, जिससे आप एक अनुरोध की लागत को लॉग कर सकते हैं और उसे किसी प्रोजेक्ट या ग्राहक के नाम कर सकते हैं। एक सब्सक्रिप्शन केवल उस व्यक्ति के लिए उपयोग का विवरण देता है जिसके पास वह सीट है। यदि आप इसे पूरी टीम के लिए लागू करते हैं, तो यह चुनाव व्यक्तिगत नहीं रह जाता। यही कारण है कि Claude Code priced per seat against the same work billed per token वह तुलना है जिसे आपको तब देखना चाहिए जब आप अन्य लोगों के लिए सीटें खरीद रहे हों।

एक बात को सावधानीपूर्वक समझें, क्योंकि किसी भी दिशा में गलत धारणा बनाना आसान है: ये बिलिंग के अलग-अलग माध्यम हैं। Anthropic का डॉक्यूमेंटेशन सब्सक्रिप्शन बिलिंग को claude.ai सपोर्ट पर और कंसोल बिलिंग को API प्लेटफॉर्म पर भेजता है, और /usage-credits एक API key के तहत काम नहीं करता है। मैंने जो भी जांचा है, उसमें कहीं भी यह नहीं लिखा है कि सब्सक्रिप्शन में API क्रेडिट शामिल है, इसलिए दो अकाउंट और दो बिलों की योजना बनाकर चलें।

ब्रेक-ईवन फॉर्मूला

पहले एक टर्न की कीमत निकालें, फिर उसे स्केल करें।

turn cost = uncached_input_tokens x base_input_price
          + cache_write_tokens    x 1.25 x base_input_price
          + cache_read_tokens     x 0.10 x base_input_price
          + output_tokens         x output_price

monthly API cost = turn cost x turns_per_active_day x active_days_per_month

break even when: monthly API cost = flat plan fee

मल्टीप्लायर प्रकाशित किए जाते हैं, अनुमानित नहीं। 5-मिनट के कैश राइट की लागत "1.25x बेस इनपुट प्राइस", 1-घंटे के राइट की लागत "2x बेस इनपुट प्राइस", और कैश रीड की लागत "0.1x बेस इनपुट प्राइस" होती है। थिंकिंग टोकन्स को आउटपुट टोकन्स के रूप में बिल किया जाता है, इसलिए वे output_tokens में आते हैं, उन मॉडल्स पर भी जो रीजनिंग समरी नहीं दिखाते हैं।

प्रति मिलियन टोकन्स (MTok) बेस रेट, 23 जुलाई 2026 तक प्रभावी:

  • claude-fable-5: $10 इनपुट, $50 आउटपुट। कैश रीड $1। 5-मिनट कैश राइट $12.50। 1M कॉन्टेक्स्ट।
  • claude-opus-4-8 और claude-opus-4-7: $5 इनपुट, $25 आउटपुट। कैश रीड $0.50। 5-मिनट कैश राइट $6.25। 1M कॉन्टेक्स्ट।
  • claude-sonnet-5: 31 अगस्त 2026 तक इंट्रोडक्टरी प्राइसिंग पर $2 इनपुट और $10 आउटपुट, उसके बाद $3 और $15। इंट्रोडक्टरी रेट्स पर, कैश रीड $0.20 और 5-मिनट कैश राइट $2.50। 1M कॉन्टेक्स्ट।
  • claude-haiku-4-5: $1 इनपुट, $5 आउटपुट। कैश रीड $0.10। 5-मिनट कैश राइट $1.25। 200K कॉन्टेक्स्ट।

लंबे कॉन्टेक्स्ट के लिए कोई सरचार्ज नहीं है: "900k-टोकन रिक्वेस्ट को उसी प्रति-टोकन दर पर बिल किया जाता है जिस पर 9k-टोकन रिक्वेस्ट को किया जाता है।"

एक कार्यशील उदाहरण, मान्यताओं के साथ

Sonnet 5 पर 60,000 tokens के context के साथ Claude Code के एक mid-session turn पर विचार करें: 55,000 tokens cache से लिए गए, 3,000 tokens नए cache में लिखे गए, 2,000 tokens ताज़ा uncached input के हैं, और 1,200 tokens thinking सहित output के हैं।

  • Cache reads: 55,000 x $0.20/MTok = $0.0110
  • Cache writes: 3,000 x $2.50/MTok = $0.0075
  • Uncached input: 2,000 x $2.00/MTok = $0.0040
  • Output: 1,200 x $10.00/MTok = $0.0120

यह प्रति turn लगभग $0.035 है। एक सक्रिय दिन में 120 turns पर, यह लगभग $4.14 प्रतिदिन होता है। एक महीने में 20 सक्रिय दिनों पर, यह लगभग $83 प्रति माह होता है।

इसकी तुलना ऊपर दिए गए flat fees से करें, तो यह एक साथ दो बातें स्पष्ट करता है। यह Pro fee से लगभग चार गुना अधिक है, इसलिए कागजों पर Pro सस्ता है, बशर्ते कि इसकी allowance प्रतिदिन 120 Sonnet turns को कवर करती हो। यह वह शर्त है जिसे कोई भी प्रकाशित आंकड़ा आपके लिए स्पष्ट नहीं कर सकता। इसका सबसे सटीक उत्तर Pro में क्या शामिल है और इसकी सीमाएं आपको कहाँ रोकती हैं, इस पर एक विस्तृत नज़र है, जिसे यह मानने से पहले पढ़ना उचित है कि सस्ता शुल्क ही बेहतर विकल्प है। वही $83 का आंकड़ा entry Max fee से कम है, इसलिए यहाँ meter, Max से बेहतर साबित होता है। अंतिम वाक्य में 'entry' शब्द महत्वपूर्ण है, क्योंकि Max दो कीमतों पर बिकता है, और आप वास्तव में कौन सा Max tier खरीदेंगे वह पैमाना बदल देता है जिसके आधार पर आप तुलना कर रहे हैं, और यह अंतर $100 प्रति माह तक हो सकता है।

अब एक-एक करके मान्यताओं को बदलें, और देखें कि कैसे plan fee निर्णायक आंकड़ा नहीं रह जाती।

तीन चीजें प्लान प्राइस की तुलना में ब्रेक-ईवन को अधिक प्रभावित करती हैं

Prompt caching. 60,000-token वाले एक ही टर्न को बिना caching के चलाएं, तो पूरा प्रॉम्प्ट फ्रेश इनपुट के रूप में बिल किया जाता है: 60,000 x $2.00/MTok = $0.12, साथ ही $0.012 आउटपुट, यानी प्रति टर्न $0.132। यह cached टर्न से लगभग चार गुना है, और यह $83 के महीने को लगभग $317 में बदल देता है। यह वह एकमात्र ब्रेक-ईवन है जिसे Anthropic प्रकाशित करता है, क्योंकि यह आपके वर्कलोड पर निर्भर नहीं करता है: "एक cache hit की लागत मानक इनपुट मूल्य का 10% होती है, जिसका अर्थ है कि 5-मिनट की अवधि (1.25x write) के लिए केवल एक cache read के बाद, या 1-घंटे की अवधि (2x write) के लिए दो cache reads के बाद caching का लाभ मिलने लगता है।"

दो failure modes आपको बताए बिना caching को बंद कर देते हैं। पहला है मॉडल की न्यूनतम cacheable लंबाई से छोटा प्रीफिक्स: Fable 5 पर 512 tokens, Opus 4.8 और Sonnet 5 पर 1,024, Opus 4.7 पर 2,048, और Haiku 4.5 पर 4,096। छोटा प्रीफिक्स cache नहीं होता है, और कोई error नहीं दिखाई जाती है। दूसरा है parallel requests, क्योंकि "एक cache entry केवल पहली response शुरू होने के बाद ही उपलब्ध होती है।" एक साथ भेजी गई दस समान requests पूरी इनपुट कीमत चुकाती हैं। दोनों के लिए संकेत cache_read_input_tokens का शून्य पर होना है।

Model choice. Opus 4.8 पर समान टर्न की कीमत तय करें, $5 इन और $25 आउट पर, cache reads $0.50 पर और 5-मिनट writes $6.25 प्रति MTok पर: reads $0.0275, writes $0.0188, uncached इनपुट $0.0100, आउटपुट $0.0300। यह $0.086 प्रति टर्न के आसपास है, जो Sonnet टर्न का 2.5 गुना है, और समान वॉल्यूम पर लगभग $207 प्रति माह है। एक मॉडल विकल्प ने समान काम को एंट्री Max शुल्क से नीचे से दोगुने से अधिक पर पहुँचा दिया। Haiku 4.5, $1 और $5 पर, log triage जैसे यांत्रिक कार्यों के लिए इसे दूसरी दिशा में ले जाता है। Fable 5 इसे फिर से महंगी दिशा में ले जाता है, $10 इन और $50 आउट पर, इसलिए कौन से कार्य वास्तव में Fable 5 की दर को सार्थक बनाते हैं इसे डिफ़ॉल्ट मॉडल बनाने से पहले पढ़ना उचित है।

Effort level मॉडल चयन का हिस्सा है, क्योंकि thinking tokens आउटपुट दरों पर बिल किए जाते हैं। Opus 4.8 पर API डिफ़ॉल्ट high है, और कोडिंग तथा एजेंटिक कार्यों के लिए प्रलेखित शुरुआती बिंदु अधिक महंगा xhigh है। इसे Claude Code में /effort के साथ या API पर output_config.effort के साथ कम करें। एक और चीज पुराने अनुमानों को बदलती है: नए मॉडल एक नए tokenizer का उपयोग करते हैं जो "समान टेक्स्ट के लिए लगभग 30% अधिक tokens उत्पन्न करता है", इसलिए पुराने मॉडल पर मापी गई गणना आज उसी टेक्स्ट को कम करके दिखाती है।

Session hygiene. API stateless है, इसलिए हर टर्न पूरी बातचीत को बिल किए गए इनपुट के रूप में फिर से भेजता है। इसलिए एक लंबा सेशन फ्रेश सेशन की तुलना में प्रति संदेश अधिक महंगा होता है, जो अधिकांश आश्चर्यजनक इनवॉइस के पीछे का तंत्र है और Claude Code सेशन में वास्तव में क्या tokens की खपत करता है में विस्तार से समझाया गया है। असंबंधित कार्यों के बीच /clear चलाएं, क्योंकि पुराना context हर बाद के संदेश पर फिर से भेजा और बिल किया जाता है। एक लंबे कार्य के भीतर /compact चलाएं, ताकि इतिहास को पूरा ले जाने के बजाय सारांशित किया जा सके। निरंतर अंतराल में काम करें, क्योंकि डिफ़ॉल्ट cache की "5-मिनट की लाइफटाइम होती है" और "cached सामग्री का उपयोग हर बार बिना किसी अतिरिक्त लागत के रिफ्रेश हो जाती है"। एक सेशन जिसे आप हर दस मिनट में एक बार छूते हैं, वह हर बार एक re-write की कीमत चुकाता है। एक detached VPS पर tmux में चल रहा Claude Code सेशन निष्क्रिय रहने पर लगभग कुछ भी खर्च नहीं करता है, लेकिन cache लाइफटाइम से अधिक निष्क्रिय रहने पर warm प्रीफिक्स खो जाता है।

निर्णय लेने से पहले अपने उपयोग को मापें

मेरे उदाहरण के आधार पर निर्णय न लें। अपने एक सप्ताह के उपयोग के आधार पर निर्णय लें।

Claude Code में, एक सप्ताह तक प्रत्येक सत्र के अंत में /usage चलाएं (/cost उसी स्क्रीन के लिए एक alias है)। यह सत्र के टोकन काउंट और लागत का अनुमान बताता है, जिसमें डॉक्यूमेंटेशन की एक चेतावनी शामिल है: "डॉलर का आंकड़ा टोकन काउंट से स्थानीय रूप से गणना किया गया एक अनुमान है और यह आपके वास्तविक बिल से भिन्न हो सकता है।" जब आप /clear चलाते हैं तो कुल योग रीसेट हो जाता है, इसलिए पहले स्क्रीन को पढ़ें। सब्सक्रिप्शन पर वह डॉलर का आंकड़ा आपका बिल नहीं है, लेकिन इसके पीछे के टोकन काउंट वही हैं जिनकी इस फॉर्मूले को आवश्यकता है। /context दिखाता है कि विंडो में क्या भरा जा रहा है।

API अकाउंट पर, Claude Console में उपयोग का पेज आधिकारिक रिकॉर्ड है। प्रॉम्प्ट भेजने से पहले उसकी कीमत जानने के लिए, client.messages.count_tokens() का उपयोग करें, जो "उपयोग करने के लिए मुफ्त है लेकिन आपके उपयोग के स्तर के आधार पर प्रति मिनट अनुरोध सीमा के अधीन है", और यह एकमात्र काउंट है जो उस टोकेनाइज़र का उपयोग करता है जिसके तहत आपसे वास्तव में बिल लिया जाएगा।

कॉल के बाद, उपयोग ब्लॉक को पढ़ें, और इसे सही ढंग से पढ़ें:

u = response.usage
total_input = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokens

input_tokens केवल बिना कैश किए गए शेष भाग को गिनता है, जिसे "अंतिम कैश ब्रेकपॉइंट के बाद के टोकन" के रूप में प्रलेखित किया गया है। input_tokens: 4000 रिपोर्ट करने वाला टर्न 4,000-टोकन का टर्न नहीं है, और तीनों क्षेत्रों को एक साथ जोड़ने पर वह प्रॉम्प्ट आकार मिलता है जिसकी इस फॉर्मूले को आवश्यकता है।

फिर तुलना करें। यदि आपकी मापी गई मासिक usage plan fee से स्पष्ट रूप से कम है, तो meter चुनें। यदि वह स्पष्ट रूप से अधिक है, तो plan चुनें, बशर्ते उसका allowance आपके लिए सामान्य working day को कवर करता हो। यदि वह सीमा के आसपास है, तो plan चुनें, क्योंकि plan आपको अप्रत्याशित bill नहीं देगा, जबकि meter दे सकता है। यदि वह Pro fee से भी काफी कम है, तो कोई विकल्प खरीदने से पहले यह तय करें कि आपके काम करने के तरीके के लिए paid plan free tier से बेहतर है या नहीं, क्योंकि इतनी कम usage शायद free limit तक पर्याप्त बार न पहुँचे कि कोई bill उचित ठहरे। यह निर्णय अपरिवर्तनीय भी नहीं है, क्योंकि tier cancel या कम करने पर पहले से भुगतान किया गया महीना बरकरार रहता है, यदि कुछ और हफ्तों की वास्तविक usage आपके अनुमान के विपरीत हो। आप जो भी विकल्प चुनें, यह गणना केवल यह तय करती है कि कौन-सा billing model सस्ता है; क्या यह खर्च बचाए गए घंटों के रूप में अपनी भरपाई करता है, यह अलग गणना है, जिसे अपनी hourly rate के आधार पर करना होगा।

FAQ

क्या Claude API, Claude Pro या Max से सस्ती है?

यह उपयोग की मात्रा पर निर्भर करता है। इसका कोई निश्चित break-even point नहीं है, क्योंकि subscription को token allowance के बजाय usage window के रूप में बेचा जाता है। प्रकाशित per-token दरों के आधार पर एक सामान्य turn की कीमत निकालें, फिर उसे प्रति सक्रिय दिन के turns और प्रति माह सक्रिय दिनों से गुणा करें। इसके बाद इस आंकड़े की तुलना plan fee से करें। एक उदाहरण के तौर पर, 60,000-token वाले Sonnet 5 turn की कीमत लगभग $0.035 आती है। यदि आप महीने में 20 दिन और प्रतिदिन 120 turns का उपयोग करते हैं, तो यह लगभग $83 प्रति माह होगा: जो Pro fee से अधिक है, लेकिन entry Max fee से कम है।

मैं प्रति माह अपने Claude API खर्च की गणना कैसे करूँ?

वास्तविक token counts एकत्र करने के लिए एक सप्ताह तक Claude Code में /usage चलाएं, या यदि आपके पास पहले से API account है तो Claude Console में usage page देखें। फिर एक turn की कीमत निकालें: uncached input को base rate पर, cache writes को base input के 1.25 गुना पर, cache reads को base input के 0.1 गुना पर, और output को output rate पर रखें। thinking tokens को output के रूप में गिनें। इसे प्रति सक्रिय दिन के turns और प्रति माह सक्रिय दिनों से गुणा करें।

Claude API बिल को सबसे अधिक क्या प्रभावित करता है?

Prompt caching, किसी भी अन्य चीज़ से अधिक। Sonnet 5 पर 60,000-token वाले turn की कीमत लगभग $0.035 होती है यदि prefix cache से serve हो, और लगभग $0.132 यदि ऐसा न हो। इसके बाद Model का चुनाव आता है: Opus 4.8 पर उसी turn की कीमत लगभग $0.086 होती है। तीसरे स्थान पर Session length है, क्योंकि API stateless है और हर turn में पूरी बातचीत को billed input के रूप में फिर से भेजा जाता है।

क्या Claude subscription में API access शामिल है?

इन्हें दो अलग-अलग accounts और दो अलग-अलग बिलों के रूप में देखें। API calls का शुल्क Console में आपके द्वारा बनाए गए account पर प्रति token लिया जाता है, और मेरे द्वारा जाँची गई documentation में कहीं भी यह नहीं लिखा है कि subscription से API credit मिलता है। यह स्पष्ट संकेत है कि ये दोनों अलग-अलग माध्यम हैं, क्योंकि Claude Code का /usage-credits command "API key authentication के साथ उपलब्ध नहीं है"। कई developers दोनों का उपयोग करते हैं: interactive coding के लिए एक plan, और जो वे build करते हैं उसके लिए एक key।