क्या Claude API में कोई free tier उपलब्ध है?
Claude API में कोई मुफ्त टियर नहीं है। साइनअप पर सीमित क्रेडिट मिलते हैं, लेकिन टोकन काउंटिंग जैसे कुछ टूल मुफ्त हैं। जुलाई 2026 की दरों और एक छोटे ऐप के खर्च का विवरण यहाँ देखें।
क्या Claude API में कोई free tier उपलब्ध है?
Claude API में कोई free tier उपलब्ध नहीं है। इसमें tokens का कोई मासिक कोटा नहीं मिलता है और न ही $0 में उपयोग करने के लिए कोई plan उपलब्ध है। नए account को API का परीक्षण करने के लिए केवल कुछ मात्रा में free credits मिलते हैं, और Anthropic इस राशि का खुलासा नहीं करता है। एक बार जब ये credits समाप्त हो जाते हैं, तो प्रत्येक request आपके द्वारा भुगतान किए गए balance से काटी जाती है।
यह इसका सीधा उत्तर है। इस guide का शेष भाग इसी पर आधारित है: platform के कौन से हिस्से पूरी तरह से निःशुल्क हैं, यह Claude apps के free plan से अलग प्रश्न क्यों है, और अपना पहला program शुरू करने का सबसे सस्ता और ईमानदार तरीका क्या है।
Claude API अकाउंट पर क्या मुफ्त है
प्लेटफ़ॉर्म के कई हिस्से ऐसे हैं जिन पर कोई टोकन शुल्क नहीं लगता है, और ये सुनने में जितना लगता है, उससे कहीं अधिक महत्वपूर्ण हैं।
- टोकन की गणना (Counting tokens)। टोकन काउंटिंग एंडपॉइंट का उपयोग करना मुफ्त है। इसकी अपनी 'requests-per-minute' सीमा है, जो मैसेज क्रिएशन से अलग है, इसलिए प्रॉम्प्ट को मापने से उसे भेजने के बजट पर कोई असर नहीं पड़ता है।
- स्वयं कंसोल (The Console itself)। एक ऑर्गेनाइजेशन बनाना, अपना यूसेज पेज पढ़ना और वर्कबेंच खोलना पूरी तरह मुफ्त है। वर्कबेंच में प्रॉम्प्ट चलाना एक सामान्य API रिक्वेस्ट है, इसलिए उस हिस्से में किसी भी अन्य कॉल की तरह टोकन का बिल बनता है।
- फाइल ऑपरेशन्स (File operations)। Files API के माध्यम से फाइल अपलोड करना, लिस्ट करना और डिलीट करना मुफ्त है। आप केवल तब भुगतान करते हैं जब किसी फाइल की सामग्री इनपुट टोकन के रूप में रिक्वेस्ट में शामिल होती है।
- वेब फेच (Web fetch)। वेब फेच टूल के लिए कोई अतिरिक्त शुल्क नहीं है, सिवाय उन टोकन के जो यह बातचीत में खींचता है। वेब सर्च मुफ्त नहीं है: जुलाई 2026 तक यह $10 प्रति 1,000 सर्च है।
- कोड निष्पादन (Code execution), एक सीमा तक। जुलाई 2026 तक प्रत्येक ऑर्गेनाइजेशन को प्रति माह 1,550 मुफ्त कंटेनर घंटे मिलते हैं, उसके बाद $0.05 प्रति घंटा प्रति कंटेनर का शुल्क लगता है। जब कोड निष्पादन वेब सर्च या वेब फेच के साथ चलता है, तो इसका कोई अतिरिक्त खर्च नहीं होता है।
यह कोई 'फ्री टियर' नहीं है। इसका मतलब है कि मीटरिंग पारदर्शी है: आपसे इन्फरेंस (inference) के लिए शुल्क लिया जाता है, न कि उसके आसपास की व्यवस्था के लिए। मुफ्त वेब फेच उन डेटा स्रोतों के साथ अच्छी तरह काम करता है जो स्वयं मुफ्त हैं, और keyless मार्केट डेटा API का उपयोग करके स्टॉक और ऑप्शन्स का विश्लेषण करना एक ऐसा उदाहरण है जहाँ आप केवल उन टोकन के लिए भुगतान करते हैं जो फेच किया गया डेटा प्रॉम्प्ट में लाता है।
भुगतान करने से पहले प्रॉम्प्ट की कीमत का आकलन करें
चूंकि टोकन की गिनती निःशुल्क है, इसलिए आप पहले अनुरोध (request) का सटीक आकार जान सकते हैं। यह वही endpoint है जिसे SDKs रैप करते हैं, और यह वास्तविक संदेश के समान ही body लेता है।
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-haiku-4-5",
"system": "You are a scientist",
"messages": [{"role": "user", "content": "Hello, Claude"}]
}'एक सफल रिस्पॉन्स JSON की एक पंक्ति होती है: {"input_tokens": 14}। इसे अपने मॉडल की इनपुट दर से गुणा करें और अनुरोध भेजने से पहले ही आपको उसकी लागत पता चल जाएगी। यदि आपको authentication_error के साथ HTTP 401 प्राप्त होता है, तो इसका अर्थ है कि key गलत है या उसे रद्द कर दिया गया है। यदि key सही दिखती है और कॉल फिर भी authenticate नहीं हो रही है, या आप Anthropic key के बजाय Bedrock, Vertex या Foundry के माध्यम से Claude तक पहुँच रहे हैं, तो क्लाइंट को authenticate करने के चार तरीके यह स्पष्ट करते हैं कि प्रत्येक सेवा क्या अपेक्षा करती है और क्रेडेंशियल को कहाँ सुरक्षित रखना है। टोकन की गिनती उस अकाउंट पर भी काम करती है जिसमें कोई क्रेडिट शेष नहीं है, क्योंकि इसमें कुछ भी जनरेट नहीं किया जाता है।
यह प्रश्न ऐप्स में मौजूद फ्री प्लान से अलग क्यों है
लोग इन दोनों के बारे में सर्च करते हैं, लेकिन इन दोनों का आपस में लगभग कोई संबंध नहीं है। Claude ऐप्स पर मौजूद फ्री प्लान एक वास्तविक प्रोडक्ट है जिसे आप बिना किसी कार्ड के लंबे समय तक इस्तेमाल कर सकते हैं, जो एक रोलिंग यूसेज विंडो द्वारा मापा जाता है, और Claude फ्री टियर में वास्तव में क्या शामिल है यह बताता है कि इसमें क्या-क्या मिलता है और यह कब रिसेट होता है। API एक प्रीपेड मीटरिंग सिस्टम है जिसके पीछे ऐसा कोई प्लान नहीं है।
इसका परिणाम जो लोगों को भ्रमित करता है, वह यह है कि सब्सक्रिप्शन और API की (key) अलग-अलग वॉलेट हैं। Pro के लिए भुगतान करने से API की (key) में फंड नहीं जुड़ता है, और API क्रेडिट आपके चैट अलाउंस को नहीं बढ़ाते हैं। Claude Code वह जगह है जहाँ यह विभाजन लोगों को सबसे ज्यादा भ्रमित करता है, क्योंकि यह दोनों में से किसी पर भी चल सकता है: क्या Claude Code Pro के साथ शामिल है यह स्पष्ट करता है कि कौन से प्लान इसे कवर करते हैं और यह कब चुपचाप API की (key) पर बिलिंग करने लगता है। यदि आप बिल्कुल भी भुगतान न करने के बजाय इन दोनों के बीच चयन कर रहे हैं, तो Claude API की लागत बनाम सब्सक्रिप्शन वास्तविक वर्कलोड पर गणित को समझाता है। इसका अपवाद Claude Enterprise है, जो प्रति-सीट मूल्य और API दरों पर मापे गए टोकन उपयोग को एक ही बिल में रखता है, और Enterprise सीट मूल्य निर्धारण कैसे काम करता है यह बताता है कि मीटर शुरू होने से पहले सीट मिनिमम में क्या-क्या मिलता है।
क्रेडिट समाप्त होने के बाद एक अनुरोध की लागत
ये जुलाई 2026 तक की फर्स्ट-पार्टी API दरें हैं, जो प्रति मिलियन टोकन के आधार पर हैं।
The data behind this chart
[
{
"label": "Haiku 4.5",
"input_usd": 1,
"output_usd": 5
},
{
"label": "Sonnet 5, intro rate",
"input_usd": 2,
"output_usd": 10
},
{
"label": "Opus 5",
"input_usd": 5,
"output_usd": 25
}
]Haiku 4.5 के लिए प्रति मिलियन इनपुट टोकन पर 1 डॉलर और प्रति मिलियन आउटपुट टोकन पर 5 डॉलर का बिल बनता है। Opus 5 के लिए समान वॉल्यूम पर 5 और 25 का शुल्क लगता है, इसलिए आपके द्वारा चुना गया मॉडल किसी भी प्रॉम्प्ट ट्यूनिंग से पहले ही बिल को 5 गुना तक बदल सकता है। Sonnet 5 का आंकड़ा एक परिचयात्मक दर है जो 31 अगस्त 2026 तक प्रभावी है, जिसके बाद यह वापस $3 और $15 हो जाएगी। हर मॉडल में आउटपुट की लागत इनपुट की तुलना में पांच गुना अधिक है, जो इस पृष्ठ पर सबसे महत्वपूर्ण तथ्य है: एक लंबा उत्तर, लंबे प्रश्न की तुलना में अधिक महंगा होता है। आपको कौन सा Claude मॉडल उपयोग करना चाहिए एक कार्य के उदाहरण पर इनकी तुलना करता है। Fable 5 इन तीनों से ऊपर $10 प्रति मिलियन इनपुट टोकन और $50 प्रति मिलियन आउटपुट टोकन पर स्थित है, इसलिए किसी भी नियमित कार्य को इस पर भेजने से पहले ये दरें वास्तव में क्या प्रदान करती हैं यह समझना उचित है।
प्रयोग करने के सबसे सस्ते वास्तविक तरीके
चार लीवर लगभग सारा काम करते हैं, और उनमें से किसी के लिए भी छूट की आवश्यकता नहीं है।
- सबसे छोटे मॉडल से शुरुआत करें जो आपके परीक्षण को पास करता है। Classification, extraction, tagging और routing के लिए शायद ही कभी frontier model की आवश्यकता होती है। Haiku 4.5 की कीमत Opus 5 का पांचवां हिस्सा है और यह तेजी से उत्तर देता है।
max_tokensको सीमित करें। यह generated tokens पर एक कठोर सीमा है, और output वाला हिस्सा महंगा होता है। एक classifier जो एक शब्द में उत्तर देता है, उसे 16,000-token का बजट नहीं दिया जाना चाहिए।- Prompt के उस हिस्से को cache करें जो कभी नहीं बदलता है। Cache read की लागत base input मूल्य का 10% है और पांच मिनट के cache write की लागत 1.25x है, इसलिए एक बार read करने के बाद ही caching अपनी लागत वसूल कर लेती है। Caching एक prefix match है, जिसका अर्थ है कि स्थिर text पहले आना चाहिए और बदलता हुआ प्रश्न अंत में, अन्यथा कुछ भी match नहीं होगा और आप बिना किसी लाभ के write premium का भुगतान करेंगे।
- जो interactive नहीं है उसे batch करें। Message Batches API इनपुट और आउटपुट दोनों पर 50% की छूट देता है, और अधिकांश batches एक घंटे के भीतर पूरे हो जाते हैं। Nightly jobs, backfills और evaluation runs को वहीं रखा जाना चाहिए।
एक छोटे शुरुआती ऐप के लिए लागत का विवरण
एक log-summary script का उदाहरण लें: 1,000 calls, जिनमें से प्रत्येक लगभग 800 input tokens की log lines भेजता है और लगभग 200 tokens का summary प्राप्त करता है। यह Haiku 4.5 पर कुल 800,000 input tokens और 200,000 output tokens के बराबर है।
The data behind this chart
[
{
"label": "Standard rates",
"cost_usd": "1.80"
},
{
"label": "Same job on the Batch API",
"cost_usd": "0.90"
}
]इसकी गणना इस प्रकार है: $1 प्रति मिलियन की दर से 0.8 मिलियन input tokens और $5 प्रति मिलियन की दर से 0.2 मिलियन output tokens, जिसका कुल योग 1.80 डॉलर है। यदि इसे batch के रूप में भेजा जाए, तो वही कार्य 0.90 की लागत में पूरा हो जाता है। शुरुआती credit balance इस स्तर पर काफी टेस्टिंग को कवर कर लेता है, यही कारण है कि free tier का न होना लोगों की अपेक्षा से काफी बाद में महसूस होता है। अपने स्वयं के सर्वर पर पूर्ण walkthrough के लिए, VPS पर पहला Claude API ऐप बनाना देखें, जिसमें key handling, streaming और error paths को कवर किया गया है।
Usage tiers सीमाएं हैं, न कि भत्ते
API स्वचालित रूप से प्रत्येक organization को उसके usage history और account standing के आधार पर एक usage tier में रखता है। इन tiers के नाम Start, Build, Scale और Custom हैं, और प्रत्येक tier rate limits के साथ-साथ monthly spend cap भी निर्धारित करता है। जुलाई 2026 तक, ये caps Start के लिए $500, Build के लिए $1,000 और Scale के लिए $200,000 हैं, जबकि Custom tier की कोई सीमा नहीं है।
इसे एक grant के बजाय एक limit के रूप में समझें। Start tier पर होने का मतलब यह नहीं है कि आपके पास खर्च करने के लिए $500 हैं। इसका मतलब यह है कि आप एक calendar month में $500 से अधिक खर्च नहीं कर सकते; इसके बाद अगले महीने तक usage रुक जाएगा। आप tier cap के अंतर्गत अपनी स्वयं की कम spend limit भी सेट कर सकते हैं। किसी भी card से जुड़े account पर यह सबसे पहला काम होना चाहिए, क्योंकि per-token price की तुलना में runaway loop के कारण पैसे खोना कहीं अधिक सामान्य है।
यदि free विकल्प एक अनिवार्य आवश्यकता हो तो क्या करें
यदि बजट वास्तव में शून्य है और इसे शून्य ही रहना है, तो API सही उपकरण नहीं है, और किसी भी tier की तुलना करने से यह स्थिति नहीं बदलेगी। इसके दो ईमानदार विकल्प बचते हैं। इंटरैक्टिव काम के लिए Claude apps में free plan का उपयोग करें, यह स्वीकार करते हुए कि यह window द्वारा सीमित है और आपको कोई programmable endpoint नहीं देता है। या फिर अपने द्वारा किराए पर लिए गए हार्डवेयर पर एक open-weights model चलाएं, जो प्रति-टोकन बिल को एक ऐसे सर्वर बिल से बदल देता है जिसे आप नियंत्रित करते हैं: Ollama को VPS पर चलाकर LLM को self-host करना उन memory आवश्यकताओं को कवर करता है जो प्रत्येक model size को चाहिए होती हैं और यह भी कि छोटे models वास्तव में क्या कर सकते हैं। यदि समस्या पैसे के बजाय usage window की है, तो Claude Pro $20 प्रति माह पर apps में उस सीमा को बढ़ा देता है, जो कई शुरुआती API बिलों से कम है, हालांकि यह अभी भी आपको code से call करने के लिए कुछ नहीं देता है। क्या वह $20 चुकाना सार्थक है, यह इस बात पर निर्भर करता है कि free limit आपको कितनी बार रोकती है, जिसे Pro के लिए निर्णय मार्गदर्शिका वास्तविक usage patterns के आधार पर समझाती है। यदि आप एक ही lineup के बजाय विभिन्न providers के बीच तुलना कर रहे हैं, तो Claude और ChatGPT plans की मूल्य तुलना दोनों तरफ के free और paid tiers को एक साथ रखती है, जिसमें यह भी शामिल है कि coding के काम के लिए कौन सा सस्ता पड़ता है। और यदि कोई subscription जिसके लिए आप पहले से भुगतान कर रहे हैं, उस खर्च का हिस्सा है जिसे आप शून्य करना चाहते हैं, तो उस plan को cancel या downgrade करना आपके द्वारा खरीदे गए महीने को बरकरार रखता है और अगले महीने के भुगतान को रोक देता है।
इनके बीच की किसी भी स्थिति के लिए, व्यावहारिक उत्तर है: एक funded key, एक कम spend limit, एक छोटा model, और पहले दिन से ही prompt caching को चालू रखना।
FAQ
क्या Claude API का उपयोग निःशुल्क है?
नहीं। इसमें कोई फ्री टियर या मासिक फ्री टोकन की सुविधा नहीं है। नए अकाउंट्स को API टेस्ट करने के लिए थोड़ी मात्रा में फ्री क्रेडिट मिलते हैं, जिसके बाद प्रत्येक रिक्वेस्ट प्रीपेड क्रेडिट या फाइल में दर्ज कार्ड से काटी जाती है। प्लेटफॉर्म के कुछ हिस्से निःशुल्क हैं, जिनमें टोकन काउंटिंग, फाइल अपलोड और डिलीट करना, और वेब फेच टूल (फेच किए गए टोकन के अलावा) शामिल हैं।
क्या Claude API के लिए साइन अप करने पर मुझे फ्री क्रेडिट मिलते हैं?
हाँ, थोड़ी मात्रा में मिलते हैं, और Anthropic इसकी सटीक संख्या सार्वजनिक नहीं करता है। इसे अपने इंटीग्रेशन की कार्यक्षमता जांचने के लिए पर्याप्त मानें, न कि किसी प्रोजेक्ट को बनाने के लिए बजट। एंटरप्राइज मूल्यांकन के लिए विस्तारित ट्रायल क्रेडिट Anthropic सेल्स टीम के माध्यम से व्यवस्थित किए जाते हैं, वे स्वचालित रूप से नहीं मिलते।
क्या Claude Pro या Max के भुगतान में API एक्सेस शामिल है?
नहीं। सब्सक्रिप्शन और API key का बिल अलग-अलग बनता है और उनकी मीटरिंग भी अलग होती है। Pro और Max प्लान Claude ऐप्स के भीतर आपकी लिमिट बढ़ाते हैं। API key प्रीपेड क्रेडिट का उपयोग करती है और प्रति मिनट रिक्वेस्ट और टोकन द्वारा सीमित होती है। यदि आपको दोनों की आवश्यकता है, तो आपको दोनों के लिए भुगतान करना होगा।
Claude API को टेस्ट करने का सबसे सस्ता तरीका क्या है?
सबसे पहले अपने टोकन काउंट करें, क्योंकि वह एंडपॉइंट फ्री है। फिर Haiku 4.5 पर एक सख्त max_tokens के साथ टेस्ट चलाएं, किसी भी फिक्स्ड सिस्टम प्रॉम्प्ट को कैश करें ताकि बार-बार होने वाली कॉल्स इनपुट कीमत के 10% पर ही पड़ें, और जो कुछ भी इंटरैक्टिव नहीं है उसे Batch API के माध्यम से आधी कीमत पर भेजें। इन सेटिंग्स पर जुलाई 2026 तक एक हजार छोटी कॉल्स की कीमत एक डॉलर से थोड़ी अधिक है।