SSD Nodes Learn 8GB RAM — $66/साल
गाइड Matt Connorलेखक: Matt Connor · अपडेट किया गया: 2026-08-01

क्या Claude API का कोई निःशुल्क स्तर है?

Claude API में कोई free tier नहीं है। नए account पर थोड़े credits मिलते हैं, token counting निःशुल्क है, और July 2026 की rates से पहली छोटी app की लागत जानें।

क्या Claude API का कोई निःशुल्क स्तर है?

Claude API का कोई निःशुल्क स्तर नहीं है। निःशुल्क tokens की कोई मासिक सीमा नहीं है और ऐसा कोई plan नहीं है जिसे आप $0 पर जारी रख सकें। नए account को API का परीक्षण करने के लिए थोड़ी मात्रा में निःशुल्क credits मिलते हैं, लेकिन Anthropic इसकी मात्रा प्रकाशित नहीं करता। ये credits समाप्त होने के बाद, प्रत्येक request आपके द्वारा भुगतान किए गए balance से खर्च होती है।

सीधा उत्तर यही है। इस guide का बाकी भाग इसी से संबंधित है: platform के कौन-से हिस्से बिल्कुल निःशुल्क हैं, यह Claude apps के निःशुल्क plan से अलग प्रश्न क्यों है, और पहला program चलाने का सबसे कम खर्च वाला वास्तविक तरीका क्या है।

Claude API खाते पर क्या निःशुल्क है

प्लेटफ़ॉर्म की कई सुविधाओं पर token शुल्क नहीं लगता। उनका महत्व अपेक्षा से अधिक है।

  • Token की गणना। Token counting endpoint का उपयोग निःशुल्क है। इसकी requests-per-minute सीमा अलग होती है और message creation से अलग लागू होती है। इसलिए किसी prompt को मापने से उसे भेजने के budget में कमी नहीं होती।
  • Console स्वयं। Organization बनाना, usage page पढ़ना और Workbench खोलना निःशुल्क है। Workbench में prompt चलाना एक सामान्य API request है। इसलिए उस पर किसी भी अन्य call की तरह tokens का शुल्क लगता है।
  • File operations। Files API के माध्यम से files upload करना, उनकी सूची देखना और उन्हें delete करना निःशुल्क है। शुल्क तभी लगता है जब किसी file की सामग्री input tokens के रूप में request में शामिल होती है।
  • Web fetch। Web fetch tool बातचीत में शामिल की गई सामग्री के tokens के अतिरिक्त कोई शुल्क नहीं जोड़ता। Web search निःशुल्क नहीं है। July 2026 के अनुसार इसकी कीमत $10 प्रति 1,000 searches है।
  • Code execution, एक सीमा तक। July 2026 के अनुसार प्रत्येक organization को प्रति माह 1,550 निःशुल्क container hours मिलते हैं। इसके बाद प्रति container प्रति घंटे $0.05 शुल्क लगता है। Web search या web fetch के साथ चलने पर code execution का अतिरिक्त शुल्क नहीं लगता।

इनमें से कोई भी free tier नहीं है। इसका अर्थ केवल यह है कि metering सही है। आप inference के लिए शुल्क देते हैं, उसके आसपास की plumbing के लिए नहीं।

भुगतान करने से पहले prompt की कीमत निकालें

गणना निःशुल्क है, इसलिए आप पहले अनुरोध का सटीक आकार जान सकते हैं। यह वही endpoint है जिसे SDKs wrap करते हैं, और इसमें वास्तविक message जैसा ही body लिया जाता है।

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "content-type: application/json" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-haiku-4-5",
    "system": "You are a scientist",
    "messages": [{"role": "user", "content": "Hello, Claude"}]
  }'

सही response JSON की एक पंक्ति होती है: {"input_tokens": 14}। इसे अपने model की input rate से गुणा करें। इससे request भेजने से पहले ही उसकी लागत पता चल जाती है। यदि आपको authentication_error के साथ HTTP 401 मिलता है, तो key गलत है या revoke कर दी गई है। बिना credit वाले account पर भी गणना काम करती है, क्योंकि कुछ भी generate नहीं किया जाता।

यह apps के free plan से अलग प्रश्न क्यों है

लोग दोनों के बारे में खोजते हैं, लेकिन इन दोनों का लगभग कोई संबंध नहीं है। Claude apps का free plan एक वास्तविक product है, जिसे आप card के बिना लंबे समय तक इस्तेमाल कर सकते हैं। इसका उपयोग rolling usage window के आधार पर मापा जाता है। Claude free tier में वास्तव में क्या शामिल है में बताया गया है कि इसमें क्या मिलता है और यह कब reset होता है। API में prepaid metering होती है और उसके पीछे ऐसा कोई plan नहीं होता।

इससे जुड़ी वह बात अक्सर भ्रम पैदा करती है कि subscription और API key अलग-अलग wallets हैं। Pro के लिए भुगतान करने से key में धनराशि नहीं जुड़ती। API credits आपके chat allowance को नहीं बढ़ाते। यदि आपका उद्देश्य भुगतान से पूरी तरह बचना नहीं है और आप दोनों में से किसी एक को चुन रहे हैं, तो वास्तविक workloads के आधार पर Claude API की लागत और subscription की तुलना गणना समझाता है।

क्रेडिट समाप्त होने के बाद एक अनुरोध की लागत

ये July 2026 तक प्रति million tokens के लिए first-party API rates हैं।

ChartClaude API rates per million tokens, July 2026
The data behind this chart
[
  {
    "label": "Haiku 4.5",
    "input_usd": 1,
    "output_usd": 5
  },
  {
    "label": "Sonnet 5, intro rate",
    "input_usd": 2,
    "output_usd": 10
  },
  {
    "label": "Opus 5",
    "input_usd": 5,
    "output_usd": 25
  }
]

Haiku 4.5 प्रति million input tokens के लिए 1 dollar और प्रति million output tokens के लिए 5 dollars लेता है। Opus 5 समान मात्रा के लिए 5 और 25 लेता है। इसलिए चुना गया model किसी भी prompt tuning से पहले ही bill में 5x का अंतर ला सकता है। Sonnet 5 की दर introductory rate है, जो 31 August 2026 तक लागू रहेगी। इसके बाद यह $3 और $15 पर लौट आएगी। इन सभी models में output की लागत input से पांच गुना है। यही इस पृष्ठ की सबसे उपयोगी जानकारी है: लंबा प्रश्न पूछने की तुलना में अधिक विस्तार वाला उत्तर महंगा होता है। आपको कौन सा Claude model उपयोग करना चाहिए में एक वास्तविक job के उदाहरण से इनकी तुलना की गई है।

प्रयोग करने के सबसे किफायती वास्तविक तरीके

चार उपाय लगभग सारा काम कर देते हैं, और इनमें से किसी के लिए छूट की आवश्यकता नहीं होती।

  • उस सबसे छोटे मॉडल से शुरू करें जो आपका परीक्षण पास करता हो। Classification, extraction, tagging और routing के लिए आमतौर पर frontier model की आवश्यकता नहीं होती। Haiku 4.5 की कीमत Opus 5 की कीमत का पांचवां हिस्सा है और यह तेज़ी से उत्तर देता है।
  • max_tokens की सीमा निर्धारित करें। यह generated tokens की अधिकतम सीमा है, और output महंगा भाग है। जो classifier एक शब्द में उत्तर देता है, उसके लिए 16,000-token का budget नहीं होना चाहिए।
  • Prompt के उस भाग को cache करें जो कभी नहीं बदलता। Cache read की लागत base input price की 10% होती है और five-minute cache write की लागत 1.25x होती है। इसलिए एक ही read के बाद caching की लागत पूरी हो जाती है। Caching prefix match पर आधारित है। इसका अर्थ है कि स्थिर text पहले और बदलने वाला question अंत में होना चाहिए। अन्यथा कुछ भी match नहीं होगा और आपको बिना लाभ के write premium देना पड़ेगा।
  • जो भी interactive नहीं है, उसे batch करें। Message Batches API input और output दोनों पर 50% की छूट देता है, और अधिकांश batches एक घंटे के भीतर पूरे हो जाते हैं। Nightly jobs, backfills और evaluation runs को वहीं चलाएं।

पहले छोटे app की लागत का उदाहरण

एक log-summary script लें: 1,000 calls, जिनमें प्रत्येक लगभग 800 input tokens वाली log lines भेजता है और लगभग 200 tokens का summary प्राप्त करता है। Haiku 4.5 पर यह 800,000 input tokens और 200,000 output tokens होते हैं।

Chart1,000 calls at 800 input and 200 output tokens, Haiku 4.5
The data behind this chart
[
  {
    "label": "Standard rates",
    "cost_usd": "1.80"
  },
  {
    "label": "Same job on the Batch API",
    "cost_usd": "0.90"
  }
]

गणना यह है: 0.8 million input tokens की दर $1 और 0.2 million output tokens की दर $5 है। कुल लागत 1.80 dollars होती है। यदि यही काम batch के रूप में भेजा जाए, तो लागत 0.90 होती है। Starter credit balance इस स्तर पर बहुत-से परीक्षणों की लागत कवर करता है। इसी कारण free tier न होने का प्रभाव लोगों की अपेक्षा से काफी बाद में दिखाई देता है। अपने server पर पूरा walkthrough देखने के लिए VPS पर पहला Claude API app बनाना key handling, streaming और error paths को कवर करता है।

उपयोग स्तर अनुमतियां नहीं, अधिकतम सीमाएं हैं

API उपयोग इतिहास और खाते की स्थिति के आधार पर प्रत्येक organization को अपने-आप एक usage tier में रखता है। इन tiers के नाम Start, Build, Scale और Custom हैं। प्रत्येक tier rate limits और मासिक spend cap निर्धारित करता है। July 2026 तक Start की सीमा $500, Build की $1,000 और Scale की $200,000 है। Custom पर कोई cap नहीं है।

इसे अनुमति के बजाय सीमा समझें। Start tier पर होने का अर्थ यह नहीं है कि आपके पास खर्च करने के लिए $500 उपलब्ध हैं। इसका अर्थ है कि किसी calendar month में आप $500 से अधिक खर्च नहीं कर सकते। इसके बाद अगले month तक usage रुक जाता है। आप tier cap से कम अपनी spend limit भी निर्धारित कर सकते हैं। Card से जुड़े किसी भी account पर सबसे पहले यही करें। Runaway loop से पैसे खोने की संभावना per-token price की वजह से होने वाली हानि की तुलना में बहुत अधिक होती है।

यदि मुफ्त होना अनिवार्य आवश्यकता है

यदि बजट वास्तव में शून्य है और उसे वहीं बनाए रखना है, तो API सही साधन नहीं है। Tier बदलने से भी यह स्थिति नहीं बदलेगी। दो ईमानदार विकल्प उपलब्ध हैं। इंटरैक्टिव कार्य के लिए Claude apps में free plan का उपयोग करें। इसके लिए यह स्वीकार करना होगा कि उपयोग window के आधार पर सीमित है और कोई प्रोग्राम योग्य endpoint उपलब्ध नहीं कराता। या अपने द्वारा किराए पर लिए गए hardware पर open-weights model चलाएँ। इसमें प्रति-token शुल्क के स्थान पर आपके नियंत्रण में server का शुल्क आता है: LLM को self-host करने के लिए VPS पर Ollama चलाना में प्रत्येक model size के लिए आवश्यक memory और छोटे models की वास्तविक क्षमताओं का विवरण दिया गया है।

इन दोनों के बीच के किसी विकल्प के लिए व्यावहारिक समाधान है: funded key, कम spend limit, छोटा model और पहले दिन से prompt caching चालू रखें।

FAQ

क्या Claude API का उपयोग निःशुल्क है?

नहीं। इसमें कोई निःशुल्क tier और कोई मासिक निःशुल्क token allowance नहीं है। नए accounts को API का परीक्षण करने के लिए थोड़ी मात्रा में निःशुल्क credits मिलते हैं। उसके बाद हर request prepaid credit या file पर मौजूद card से शुल्क लेती है। Platform के कुछ हिस्सों का कोई शुल्क नहीं है। इनमें token counting, file uploads और deletions, तथा web fetch tool शामिल हैं। web fetch tool द्वारा प्राप्त सामग्री के tokens का शुल्क अलग से लगता है।

क्या Claude API के लिए sign up करने पर मुझे निःशुल्क credits मिलते हैं?

हाँ, थोड़ी मात्रा में। Anthropic यह संख्या प्रकाशित नहीं करता। इसे अपनी integration के काम करने का प्रमाण प्राप्त करने के लिए पर्याप्त मानें, न कि आगे निर्माण करने के budget के रूप में। Enterprise evaluation के लिए अतिरिक्त trial credit Anthropic sales के माध्यम से व्यवस्थित किया जाता है। यह अपने-आप प्रदान नहीं किया जाता।

क्या Claude Pro या Max का भुगतान API access भी शामिल करता है?

नहीं। Subscription और API key का billing अलग-अलग होता है और इनकी metering भी अलग होती है। Pro और Max, Claude apps के भीतर आपकी allowance बढ़ाते हैं। API key prepaid credits का उपयोग करती है और requests तथा tokens के आधार पर प्रति मिनट सीमित होती है। दोनों की आवश्यकता होने पर दोनों के लिए भुगतान करना होगा।

Claude API का परीक्षण करने का सबसे सस्ता तरीका क्या है?

पहले अपने tokens की गणना करें, क्योंकि वह endpoint निःशुल्क है। फिर Haiku 4.5 पर कम max_tokens के साथ test चलाएँ। किसी स्थिर system prompt को cache करें, ताकि दोहराई गई calls input price के 10% पर पढ़ी जाएँ। जो भी interactive नहीं है, उसे आधी कीमत पर Batch API के माध्यम से भेजें। इन settings पर, July 2026 के अनुसार, एक हजार छोटी calls की लागत 1 dollar से थोड़ी अधिक होती है।