SSD Nodes Learn
मार्गदर्शक Matt Connorद्वारे Matt Connor · अपडेटेड 2026-07-24

Claude API की Subscription? कोणता स्वस्त?

Claude API आणि Subscription मधील खर्चाची तुलना. प्रति-token दर आणि break-even गणित समजून घेण्यासाठी हा लेख वाचा. तुमच्या वापरासाठी कोणता प्लॅन योग्य आहे?

Claude API हे सबस्क्रिप्शनपेक्षा स्वस्त आहे का?

वापर कमी असल्यास Claude API हे सबस्क्रिप्शनपेक्षा स्वस्त पडते, आणि वापर वाढल्यास ते महाग ठरते. दिवसभर इंटरएक्टिव्ह कोडिंग करणाऱ्या डेव्हलपरसाठी, सहसा 'फ्लॅट प्लॅन' (flat plan) फायदेशीर ठरतो. स्वतःहून कॉल्स करणारा प्रोग्राम असल्यास, API हा एकमेव पर्याय असतो, त्यामुळे तिथे खर्च निर्णायक ठरत नाही. बाकी सर्व गणित तुम्ही दहा मिनिटांत करू शकता.

यासाठी कोणताही अधिकृत 'ब्रेक-इव्हन' (break-even) आकडा उपलब्ध नाही. सबस्क्रिप्शनमध्ये टोकन अलाउन्सऐवजी 'युसेज विंडोज' (usage windows) विकले जातात, त्यामुळे दोन्ही कुठे एकत्र येतात हे सांगण्यासाठी कोणताही प्रकाशित आकडा नाही. खालील सूत्र सध्याच्या प्रति-टोकन दरांवर आधारित आहे, तसेच तुमच्या वापराच्या अशा पद्धतींचा यात समावेश आहे ज्या प्लॅन फी पेक्षा उत्तर अधिक बदलू शकतात. खाली दिलेला प्रत्येक ब्रेक-इव्हन आकडा हा प्रकाशित दर आणि गृहितकांच्या आधारे केलेले माझे स्वतःचे गणित आहे, तो कोणताही अधिकृत आकडा नाही.

जर तुम्ही अजूनही कोणता प्लॅन खरेदी करायचा याचा विचार करत असाल, तर तुमच्या कामासाठी कोणता Claude प्लॅन योग्य आहे याचे उत्तर देते. या पोस्टमध्ये असे गृहीत धरले आहे की तुम्हाला कोणता प्लॅन घ्यायचा आहे हे माहित आहे, आणि तुम्हाला तो खरोखर घ्यावा की नाही हे जाणून घ्यायचे आहे.

दोन भिन्न बिलींग मॉडेल्स

सबस्क्रिप्शन म्हणजे अशी क्षमता जी तुम्ही वापरली नाही तरीही तुम्हाला द्यावी लागते. तुम्ही एक निश्चित शुल्क भरता आणि तुम्हाला एका ठराविक वेळापत्रकानुसार रिसेट होणारी मर्यादा मिळते. Anthropic च्या Claude Code डॉक्युमेंटेशननुसार, Team आणि Enterprise सीट्ससाठी वापरण्याची पद्धत अशी आहे: वापर "एका रोलिंग पाच-तासांच्या विंडो आणि एका साप्ताहिक विंडोवर आधारित प्रति-सीट अलाउन्समधून वापरला जातो", जो Claude chat आणि Cowork सोबत शेअर केला जातो. सबस्क्रायबरला "You've hit your session limit" आणि "You've hit your weekly limit" असे संदेश मिळाल्यावर त्यांची मर्यादा संपल्याचे समजते. न वापरलेली क्षमता म्हणजे वाया गेलेला पैसा. क्षमता संपल्यास विंडो रिसेट होईपर्यंत तुमचे काम थांबते, आणि /model वापरून मॉडेल बदलल्यास प्रवेश पुन्हा मिळत नाही, कारण विंडोज सर्व मॉडेल्ससाठी सामायिक असतात.

API म्हणजे कधीही न थांबणारा मीटर आहे. तिथे कोणतीही विंडो किंवा मर्यादा नाही. प्रत्येक विनंतीचे मूल्य प्रति-टोकन आकारले जाते, आणि काही गोष्टी टोकन्सच्या बाहेर आकारल्या जातात: वेब सर्च "Claude API वर $10 प्रति 1,000 सर्च दरात उपलब्ध आहे". कोणतीही मर्यादा कामाला थांबवत नाही. बिल फक्त वाढत जाते.

23 July 2026 पर्यंतचे प्लॅन शुल्क, Claude pricing पेजवरून: Pro हे "$17 Per month with annual subscription discount ($200 billed up front). $20 if billed monthly" आहे, आणि यामध्ये Claude Code समाविष्ट आहे. Max ची किंमत "From $100 Per month" अशी आहे. Team सीट्सची सुरुवात "$20 Per seat / month if billed annually" पासून होते. Enterprise हा विशेष प्रकार आहे, कारण त्यात दोन्ही मॉडेल्स एकत्र चालतात: "Seat price + usage at API rates $20/seat". शुल्क वारंवार बदलतात आणि प्रत्येक प्लॅनमागील अलाउन्स टोकन्समध्ये कधीही प्रकाशित केला जात नाही, त्यामुळे निर्णय घेण्याच्या दिवशी pricing पेज नक्की वाचा.

तुम्ही API मधून काय मिळवू शकत नाही

प्लॅन अलाउन्स आणि त्याच्याभोवती तयार केलेले इंटरफेस. Claude Code मधील /usage-credits कमांड सबस्क्रिप्शन युसेज क्रेडिट्स व्यवस्थापित करते, आणि तुम्ही ते "/login द्वारे तुमच्या claude.ai सबस्क्रिप्शनने साइन इन केल्यानंतर" वापरू शकता; "API key authentication सह ही कमांड उपलब्ध नाही." /usage स्क्रीन देखील बिलींग मोडनुसार बदलते: त्याचा Session ब्लॉक "API टोकन वापर दर्शवतो आणि API वापरकर्त्यांसाठी आहे", तर सबस्क्रायबरना प्लॅन युसेज बार आणि युसेज ब्रेकडाउन दिसतो.

Claude Code मध्ये लांब प्रॉम्प्ट कॅशे (prompt cache). यासाठी प्रत्यक्ष पैसे लागतात आणि हे लक्षात घेणे सोपे आहे. डॉक्युमेंटेशन सांगते की "सबस्क्रिप्शनवर याचे आयुष्य एक तास असते आणि युसेज क्रेडिट्स वापरू लागल्यावर ते पाच मिनिटांवर येते; API key किंवा क्लाउड प्रोव्हायडरवर, ते डीफॉल्टनुसार पाच मिनिटे असते". कॅशे लाइफटाइमपेक्षा जास्त वेळाच्या ब्रेकनंतर तुमचा पहिला मेसेज कॅशे वापरू शकत नाही, त्यामुळे तुमचा संपूर्ण कॉन्टेक्स्ट पुन्हा प्रोसेस केला जातो आणि write किमतीवर बिल आकारले जाते. सबस्क्रिप्शनवर तुम्ही 50 मिनिटांची मीटिंग घेऊ शकता आणि पुन्हा कामाला सुरुवात करू शकता. API key वर त्याच ब्रेकसाठी संपूर्ण सेशन प्रीफिक्स पुन्हा लिहावा लागतो.

तुम्ही सबस्क्रिप्शनमधून काय मिळवू शकत नाही

प्रोग्राममॅटिक ॲक्सेस (Programmatic access). Claude ला कॉल करणाऱ्या cron job किंवा webhook handler ला API key ची आवश्यकता असते, त्यामुळे जर तुमचे काम असे असेल, तर तुलना तिथेच संपते. VPS वर तुमचे पहिले Claude API ॲप तयार करणे मध्ये की हँडलिंग आणि पहिले कार्यरत स्क्रिप्ट दिले आहे.

Batch API डिस्काउंट. pricing पेज स्पष्टपणे सांगते: "Batch API इनपुट आणि आउटपुट दोन्ही टोकन्सवर 50% डिस्काउंटसह विनंत्यांच्या मोठ्या प्रमाणात असिंक्रोनस प्रोसेसिंगची परवानगी देते." यामुळे मानवी हस्तक्षेपाची गरज नसलेल्या कामासाठी मीटर अर्धा होतो. Opus 4.8 वर प्रति मिलियन टोकन्सचे Batch दर $2.50 इनपुट आणि $12.50 आउटपुट आहेत, Sonnet 5 वर सुरुवातीच्या किमतीत $1 आणि $5 आहेत, आणि Haiku 4.5 वर $0.50 आणि $2.50 आहेत. यामध्ये विलंब (latency) हा एकमेव तोटा आहे: बहुतेक बॅचेस एक तासाच्या आत पूर्ण होतात, पण जर एखादा बॅच 24 तासांच्या आत पूर्ण झाला नाही तर तो एक्स्पायर होतो, आणि स्ट्रीमिंग बॅचमध्ये करता येत नाही. Batch आणि prompt caching एकत्र काम करतात, आणि बॅच पाच मिनिटांपेक्षा जास्त वेळ चालू शकतो, म्हणून त्यामध्ये 1-hour कॅशे वापरा.

प्रति-प्रोजेक्ट खर्च विभागणी (Per-project cost attribution). प्रत्येक API रिस्पॉन्समध्ये usage ब्लॉक असतो, त्यामुळे तुम्ही एका सिंगल विनंतीचा खर्च नोंदवू शकता आणि तो एखाद्या प्रोजेक्टला किंवा ग्राहकाला लागू करू शकता. सबस्क्रिप्शन फक्त सीट धारण करणाऱ्या व्यक्तीसाठी एकच युसेज रिपोर्ट देते.

एक गोष्ट लक्षात ठेवा, कारण दोन्ही दिशांनी असा अंदाज घेणे सोपे आहे: हे दोन वेगळे बिलींग प्लॅटफॉर्म आहेत. Anthropic चे डॉक्युमेंटेशन सबस्क्रिप्शन बिलींग claude.ai सपोर्टकडे आणि Console बिलींग API प्लॅटफॉर्मकडे वळवते, आणि /usage-credits API key अंतर्गत काम करत नाही. मी तपासलेल्या माहितीनुसार सबस्क्रिप्शनमध्ये API क्रेडिट समाविष्ट असल्याचे कुठेही म्हटलेले नाही, त्यामुळे दोन खाती आणि दोन बिले यासाठी तयार राहा.

ब्रेक-इव्हन सूत्र (The break-even formula)

एका टर्नची किंमत काढा, मग त्याचे प्रमाण वाढवा.

turn cost = uncached_input_tokens x base_input_price
          + cache_write_tokens    x 1.25 x base_input_price
          + cache_read_tokens     x 0.10 x base_input_price
          + output_tokens         x output_price

monthly API cost = turn cost x turns_per_active_day x active_days_per_month

break even when: monthly API cost = flat plan fee

मल्टिप्लायर्स (multipliers) प्रकाशित आहेत, अंदाजित नाहीत. 5-मिनिटांच्या कॅशे राइटसाठी "1.25x base input price" लागते, 1-तासाच्या राइटसाठी "2x base input price" लागते, आणि कॅशे रीडसाठी "0.1x base input price" लागते. थिंकिंग टोकन्स (Thinking tokens) आउटपुट टोकन्सप्रमाणे बिल आकारले जातात, त्यामुळे ते output_tokens मध्ये येतात, जरी मॉडेल रिझनिंग समरी दाखवत नसले तरीही.

प्रति मिलियन टोकन्स (MTok) बेस दर, 23 July 2026 रोजी:

  • claude-fable-5: $10 इनपुट, $50 आउटपुट. कॅशे रीड $1. 5-मिनिटांचे कॅशे राइट $12.50. 1M कॉन्टेक्स्ट.
  • claude-opus-4-8 आणि claude-opus-4-7: $5 इनपुट, $25 आउटपुट. कॅशे रीड $0.50. 5-मिनिटांचे कॅशे राइट $6.25. 1M कॉन्टेक्स्ट.
  • claude-sonnet-5: 31 August 2026 पर्यंत सुरुवातीच्या किमतीत $2 इनपुट, $10 आउटपुट, त्यानंतर $3 आणि $15. सुरुवातीच्या दरांवर, कॅशे रीड $0.20 आणि 5-मिनिटांचे कॅशे राइट $2.50. 1M कॉन्टेक्स्ट.
  • claude-haiku-4-5: $1 इनपुट, $5 आउटपुट. कॅशे रीड $0.10. 5-मिनिटांचे कॅशे राइट $1.25. 200K कॉन्टेक्स्ट.

लांब कॉन्टेक्स्टसाठी कोणताही अतिरिक्त शुल्क नाही: "900k-टोकन विनंतीसाठी त्याच प्रति-टोकन दराने बिल आकारले जाते ज्या दराने 9k-टोकन विनंतीसाठी आकारले जाते."

एक उदाहरण, गृहितकांसह

Sonnet 5 वर 60,000 टोकन्सचा कॉन्टेक्स्ट असलेला एक मध्यम-वेळचा Claude Code टर्न घ्या: 55,000 कॅशेमधून, 3,000 नवीन कॅशेमध्ये लिहिलेले, 2,000 नवीन अनकॅश्ड इनपुट, आणि 1,200 आउटपुट टोकन्स (थिंकिंगसह).

  • कॅशे रीड्स: 55,000 x $0.20/MTok = $0.0110
  • कॅशे राइट्स: 3,000 x $2.50/MTok = $0.0075
  • अनकॅश्ड इनपुट: 2,000 x $2.00/MTok = $0.0040
  • आउटपुट: 1,200 x $10.00/MTok = $0.0120

याचा अर्थ एका टर्नसाठी अंदाजे $0.035. एका सक्रिय दिवसात 120 टर्न असल्यास, दिवसाला साधारण $4.14. महिन्यात 20 सक्रिय दिवस असल्यास, महिन्याला साधारण $83.

याची तुलना वरील फ्लॅट फीशी करा. हे Pro फीच्या सुमारे चार पट आहे, त्यामुळे जर Pro ची मर्यादा दररोज 120 Sonnet टर्नसाठी पुरेशी असेल, तर कागदावर Pro स्वस्त आहे. ही अट कोणतीही प्रकाशित संख्या निश्चित करू शकत नाही. हे $83 मूल्य Max च्या सुरुवातीच्या फीपेक्षा कमी आहे, त्यामुळे येथे मीटर (meter) हा Max पेक्षा वर आहे.

आता एक वेळी एक गृहितक बदला आणि पहा की प्लॅन फी ठरवणारा आकडा कसा बदलतो.

तीन गोष्टी ज्या ब्रेक-इव्हनवर प्लॅन किमतीपेक्षा जास्त परिणाम करतात

प्रॉम्प्ट कॅशेइंग (Prompt caching). कॅशेशिवाय तोच 60,000-टोकनचा टर्न चालवा आणि संपूर्ण प्रॉम्प्ट नवीन इनपुट म्हणून बिल आकारले जाईल: 60,000 x $2.00/MTok = $0.12, plus $0.012 आउटपुट, म्हणजेच प्रति टर्न $0.132. हे कॅशेड टर्नपेक्षा जवळजवळ चार पट आहे, ज्यामुळे महिन्याचे $83 चे बिल सुमारे $317 होते. हा असा एकमेव ब्रेक-इव्हन आहे जो Anthropic ने प्रकाशित केला आहे, कारण तो तुमच्या कामावर अवलंबून नाही: "एका कॅशे हिटसाठी स्टँडर्ड इनपुट किमतीच्या 10% खर्च येतो, याचा अर्थ 5-मिनिटांच्या कालावधीसाठी (1.25x write) फक्त एका कॅशे रीडनंतर किंवा 1-तासाच्या कालावधीसाठी दोन कॅशे रीडनंतर कॅशेिंग फायदेशीर ठरते."

दोन त्रुटी कॅशेइंग आपोआप बंद करतात. पहिली म्हणजे मॉडेलच्या किमान कॅशे करण्यायोग्य लांबीपेक्षा लहान प्रीफिक्स: Fable 5 वर 512 टोकन्स, Opus 4.8 आणि Sonnet 5 वर 1,024, Opus 4.7 वर 2,048, आणि Haiku 4.5 वर 4,096 टोकन्स. लहान प्रीफिक्स कॅशे होत नाही आणि कोणतीही त्रुटी (error) येत नाही. दुसरी म्हणजे समांतर विनंत्या (parallel requests), कारण "पहिली रिस्पॉन्स सुरू झाल्यानंतरच कॅशे एंट्री उपलब्ध होते." एकाच वेळी पाठवलेल्या दहा सारख्या विनंत्या पूर्ण इनपुट किंमत भरतात. या दोन्ही गोष्टींचे लक्षण म्हणजे cache_read_input_tokens चे मूल्य शून्य असणे.

मॉडेल निवड. तोच टर्न Opus 4.8 वर करा, जिथे $5 इनपुट आणि $25 आउटपुट आहे, आणि कॅशे रीड $0.50 आणि 5-मिनिटांचे राइट्स $6.25 प्रति MTok आहेत: रीड्स $0.0275, राइट्स $0.0188, अनकॅश्ड इनपुट $0.0100, आउटपुट $0.0300. याचा अर्थ प्रति टर्न अंदाजे $0.086 आहे, जो Sonnet टर्नपेक्षा 2.5 पटीने जास्त आहे, आणि त्याच व्हॉल्यूमसाठी महिन्याला सुमारे $207 खर्च येईल. एका मॉडेलच्या निवडीमुळे ते काम Max च्या सुरुवातीच्या फीच्या खालीून तिच्या दुप्पट किमतीवर पोहोचले. Haiku 4.5 ($1 इनपुट आणि $5 आउटपुट) लॉग ट्रायज सारख्या यांत्रिक कामांसाठी हे विरुद्ध दिशेला नेते.

प्रयत्न पातळी (Effort level) ही मॉडेल निवडीवर अवलंबून असते, कारण थिंकिंग टोकन्स आउटपुट दराने बिल आकारले जातात. Opus 4.8 वर API डीफॉल्ट high आहे, आणि कोडिंग आणि एजेंटिक कामासाठी डॉक्युमेंटेड स्टार्टिंग पॉईंट अधिक महागडा xhigh आहे. Claude Code मध्ये /effort वापरून किंवा API वर output_config.effort वापरून हे कमी करा. आणखी एक गोष्ट जुने अंदाज बदलते: नवीन मॉडेल्स नवीन टोकेनायझर वापरतात जे "एकाच मजकुरासाठी अंदाजे 30% अधिक टोकन्स तयार करतात", त्यामुळे जुन्या मॉडेलवर मोजलेले टोकन्स आजच्या मजकुरासाठी कमी पडू शकतात.

सेशन हायजीन (Session hygiene). API हे stateless आहे, त्यामुळे प्रत्येक टर्न संपूर्ण संभाषण बिल आकारलेल्या इनपुट म्हणून पुन्हा पाठवतो. त्यामुळे लांब सेशनचा प्रत्येक मेसेजचा खर्च नवीन सेशनपेक्षा जास्त असतो, जे अनपेक्षित बिलांचे मुख्य कारण आहे आणि Claude Code सेशनमध्ये प्रत्यक्षात टोकन्स काय वापरतात यामध्ये सविस्तर स्पष्ट केले आहे. असंबद्ध कामांच्या दरम्यान /clear वापरा, कारण जुना कॉन्टेक्स्ट प्रत्येक नंतरच्या मेसेजवर पुन्हा पाठवला जातो आणि पुन्हा बिल आकारला जातो. एका लांब कामात /compact वापरा, जेणेकरून संपूर्ण इतिहास न ठेवता त्याचा सारांश घेतला जाईल. सतत कामाच्या सत्रांमध्ये काम करा, कारण डीफॉल्ट कॅशेला "5 मिनिटांचे आयुष्य असते" आणि "कॅशे केलेला मजकूर प्रत्येक वेळी वापरला तेव्हा कोणताही अतिरिक्त खर्च न करता रिफ्रेश केला जातो". दर दहा मिनिटांनी स्पर्श केल्या जाणाऱ्या सेशनसाठी प्रत्येक वेळी पुन्हा लिहिण्याचा (re-write) खर्च येतो. VPS वर tmux मध्ये चालणाऱ्या विलग Claude Code सेशन मध्ये काम न करता असताना जवळजवळ काहीच खर्च होत नाही, परंतु कॅशे लाइफटाइमपेक्षा जास्त वेळ निष्क्रिय राहिल्यास प्रीफिक्सचा फायदा निघून जातो.

निर्णय घेण्यापूर्वी स्वतःचा वापर मोजा

माझ्या उदाहरणावरून निर्णय घेऊ नका. तुमच्या स्वतःच्या एका आठवड्याच्या वापरावरून निर्णय घ्या.

Claude Code मध्ये, आठवडाभर प्रत्येक सेशनच्या शेवटी /usage चालवा (/cost हा त्याच स्क्रीनचा पर्याय आहे). हे सेशनचे टोकन काउंट आणि खर्चाचा अंदाज देते, परंतु डॉक्युमेंटेशनमधील एक अट लक्षात घ्या: "डालर आकडा हा टोकन काउंटवरून स्थानिक पातळीवर मोजलेला अंदाज आहे आणि तुमच्या प्रत्यक्ष बिलापेक्षा वेगळा असू शकतो." जेव्हा तुम्ही /clear चालवता तेव्हा एकूण (totals) रिसेट होतात, म्हणून आधी स्क्रीन वाचा. सबस्क्रिप्शनवर तो डॉलर आकडा तुमचे बिल नसते, परंतु त्यामागील टोकन काउंट हेच या सूत्रासाठी आवश्यक आहे. /context विंडोमध्ये काय भरत आहे ते दर्शवते.

API खात्यावर, Claude Console मधील युसेज पेज हा अधिकृत रेकॉर्ड आहे. प्रॉम्प्ट पाठवण्यापूर्वी त्याची किंमत काढण्यासाठी, client.messages.count_tokens() "वापरण्यासाठी मोफत आहे परंतु तुमच्या युसेज टियरवर आधारित विनंत्यांच्या मर्यादेस अधीन आहे", आणि हे एकमेव मोजमाप आहे जे तुम्ही ज्या टोकेनायझरवर बिल भरता तेच वापरते.

एका कॉल नंतर, युसेज ब्लॉक वाचा आणि तो योग्यरित्या वाचा:

u = response.usage
total_input = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokens

input_tokens फक्त अनकॅश्ड उर्वरित भाग मोजतो, ज्याला "शेवटच्या कॅशे ब्रेकपॉइंटनंतरचे टोकन्स" असे म्हटले जाते. input_tokens: 4000 दर्शवणारा टर्न म्हणजे 4,000-टोकनचा टर्न नाही, तर या सूत्राला आवश्यक असलेल्या प्रॉम्प्टचा आकार म्हणजे या तीन क्षेत्रांची बेरीज आहे.

त्यानंतर तुलना करा. जर तुमचा मोजलेला महिना स्पष्टपणे प्लॅन फीपेक्षा कमी असेल, तर API वापरा. जर तो स्पष्टपणे जास्त असेल, तर प्लॅन घ्या, जोपर्यंत त्याची मर्यादा तुमच्या सामान्य कामाच्या दिवसासाठी पुरेशी आहे. जर तो मर्यादेच्या जवळ असेल, तर प्लॅन घ्या, कारण प्लॅन तुम्हाला अनपेक्षित धक्का देऊ शकत नाही पण मीटर देऊ शकतो.

FAQ

Claude API हे Claude Pro किंवा Max पेक्षा स्वस्त आहे का?

हे वापराच्या प्रमाणावर अवलंबून आहे, आणि शोधण्यासाठी कोणताही प्रकाशित ब्रेक-इव्हन आकडा नाही, कारण सबस्क्रिप्शन टोकन अलाउन्सऐवजी युसेज विंडोज म्हणून विकले जातात. प्रकाशित प्रति-टोकन दरावरून एका विशिष्ट टर्नची किंमत काढा, तुमच्या दिवसाच्या टर्नने आणि महिन्यातील दिवसांनी गुणून, आणि त्या आकड्याची प्लॅन फीशी तुलना करा. एका उदाहरणात, 60,000-टोकनचा Sonnet 5 टर्न सुमारे $0.035 आला, म्हणजेच दिवसाला 120 टर्न आणि महिन्यात 20 दिवस असल्यास साधारण $83: जे Pro फीपेक्षा जास्त पण Max च्या सुरुवातीच्या फीपेक्षा कमी आहे.

मी माझ्या Claude API चा मासिक खर्च कसा काढू?

खऱ्या टोकन काउंट गोळा करण्यासाठी Claude Code मध्ये आठवडाभर /usage चालवा, किंवा तुमच्याकडे आधीच API खाते असल्यास Claude Console मधील युसेज पेज वाचा. त्यानंतर एका टर्नची किंमत काढा: बेस रेटवर अनकॅश्ड इनपुट, बेस इनपुटच्या 1.25 पट कॅशे राइट्स, बेस इनपुटच्या 0.1 पट कॅशे रीड्स, आणि थिंकिंग टोकन्स आउटपुट मानून आउटपुट रेटवर. दिवसाच्या टर्नने आणि महिन्यातील दिवसांनी गुणून.

Claude API बिल कशाने सर्वाधिक बदलते?

इतर कशापेक्षाही जास्त, प्रॉम्प्ट कॅशेइंगमुळे. Sonnet 5 वरील 60,000-टोकनचा टर्न जेव्हा प्रीफिक्स कॅशेमधून येतो तेव्हा सुमारे $0.035 लागतो आणि जेव्हा तो येत नाही तेव्हा सुमारे $0.132 लागतो. त्यानंतर मॉडेल निवड येते: Opus 4.8 वरील तोच टर्न सुमारे $0.086 लागतो. तिसरे कारण सेशनची लांबी आहे, कारण API हे stateless आहे आणि प्रत्येक टर्न संपूर्ण संभाषण बिल आकारलेल्या इनपुट म्हणून पुन्हा पाठवतो.

Claude सबस्क्रिप्शनमध्ये API ॲक्सेस समाविष्ट आहे का?

त्यांना दोन वेगळी बिले असलेल्या दोन खात्यांसारखे मानणे. API कॉल्स Console मध्ये तुम्ही तयार केलेल्या खात्यावर प्रति-टोकन आकारले जातात, आणि मी तपासलेल्या डॉक्युमेंटेशनमध्ये कुठेही असे म्हटलेले नाही की सबस्क्रिप्शन API क्रेडिट देते. दोन्ही वेगळे आहेत याचे सर्वात स्पष्ट लक्षण Claude Code मधील /usage-credits कमांड आहे, जी "API key authentication सह उपलब्ध नाही". अनेक डेव्हलपर्स दोन्ही वापरतात: इंटरएक्टिव्ह कोडिंगसाठी प्लॅन आणि त्यांनी बनवलेल्या गोष्टींसाठी API की.