Claude API की subscription: स्वस्त पर्याय कोणता?
Claude API आणि subscription यांपैकी स्वस्त पर्याय ठरवण्यासाठी सध्याच्या per-token rates वर break-even गणित पहा. अधिकृत आकडा उपलब्ध नसल्याने गृहितकेही स्पष्ट केली आहेत.
Claude API चे subscription पेक्षा कमी शुल्क आहे का?
वापराचे प्रमाण एका विशिष्ट मर्यादेपेक्षा कमी असेल, तर Claude API चे शुल्क subscription पेक्षा कमी असते. त्यापेक्षा जास्त वापर असल्यास ते अधिक महाग ठरते. दिवसभर परस्परसंवादी पद्धतीने coding करणाऱ्या एका developer साठी flat plan सहसा अधिक फायदेशीर ठरतो. स्वतःहून API calls करणाऱ्या program साठी API हाच एकमेव पर्याय असतो. त्यामुळे खर्च हा निर्णयाचा घटक राहत नाही. उर्वरित गणित तुम्ही दहा मिनिटांत करू शकता.
शोधून पाहण्यासाठी कोणताही अधिकृत break-even आकडा उपलब्ध नाही. Subscription मध्ये शुल्क token allowances ऐवजी usage windows नुसार आकारले जाते. त्यामुळे दोन्ही खर्चरेषा कुठे एकमेकांना छेदतात हे सांगणारा कोणताही प्रकाशित आकडा उपलब्ध नाही. पुढे सध्याच्या per-token rates वर आधारित सूत्र दिले आहे. तसेच तुमच्या स्वतःच्या वापराच्या पद्धतीतील असे घटक दिले आहेत, जे plan fee पेक्षा उत्तरात अधिक मोठा फरक घडवतात. पुढील प्रत्येक break-even आकडा हा प्रकाशित rates आणि नमूद केलेल्या गृहितकांवर आधारित माझा स्वतःचा हिशोब आहे. तो दस्तऐवजीकृत आकडा नाही.
तुम्ही अद्याप कोणता plan घ्यायचा हे ठरवत असाल, तर तुमच्या कामाच्या पद्धतीला कोणता Claude plan योग्य आहे याचे उत्तर तिथे मिळेल. हा लेख तुम्हाला कोणता plan घ्यायचा हे माहीत आहे असे गृहीत धरतो. तुम्हाला तो घ्यायचा आहे की नाही, हे जाणून घ्यायचे आहे.
समान स्वरूपाची नसलेली दोन बिलिंग मॉडेल
Subscription म्हणजे तुम्ही कदाचित न वापरणारी क्षमता. तुम्ही निश्चित शुल्क भरता आणि ठरावीक वेळापत्रकानुसार reset होणारी allowance मिळवता. Anthropic च्या Claude Code documentation मध्ये Team आणि Enterprise seats साठी ही रचना स्पष्ट केली आहे: usage "draws from a per-seat allowance that resets on a rolling five-hour window and a weekly window", आणि ही allowance Claude chat आणि Cowork सोबत shared असते. Subscriber ला वापरलेल्या messages द्वारे हीच रचना जाणवते. त्यावर "You've hit your session limit" आणि "You've hit your weekly limit" असे संदेश दिसतात. तुम्ही न वापरलेली capacity साठीही शुल्क भरलेले असते. तुम्ही allowance पेक्षा जास्त वापरल्यास window reset होईपर्यंत काम थांबते. /model वापरून model बदलल्याने access पुन्हा मिळत नाही, कारण ही windows सर्व models मध्ये shared असतात. तुम्हाला आत्ताच असा संदेश दिसत असल्यास, तुम्ही कोणत्या window ची प्रतीक्षा करत आहात हे ठरवणे हे या गणितापूर्वी करणे आवश्यक आहे. कारण five-hour आणि weekly मर्यादांसाठी वेगवेगळ्या उपायांची गरज असते.
API हे कधीही न थांबणारे meter आहे. येथे कोणतीही window किंवा मर्यादा नाही. प्रत्येक request ची किंमत token नुसार ठरते. काही सेवांची किंमत token च्या बाहेर स्वतंत्रपणे आकारली जाते: web search "is available on the Claude API for $10 per 1,000 searches". कोणत्याही limit वर काम थांबत नाही. Invoice फक्त वाढत जाते. यामध्ये free tier देखील नाही. मात्र signup credit आणि शुल्क नसलेले भाग या गणिताची गरज भासण्यापूर्वी पहिला प्रयोग करण्यासाठी पुरेसे ठरू शकतात.
23 July 2026 रोजी लागू असलेली plan fees, Claude pricing page वरून उद्धृत: Pro ची किंमत "$17 Per month with annual subscription discount ($200 billed up front). $20 if billed monthly" असून त्यात Claude Code समाविष्ट आहे. Max ची किंमत "From $100 Per month" अशी दिली आहे. Team seats ची सुरुवात "$20 Per seat / month if billed annually" पासून होते. Enterprise विशेष आहे, कारण त्यात दोन्ही models एकाच वेळी वापरले जातात: "Seat price + usage at API rates $20/seat". तुम्ही या hybrid पर्यायाचा विचार करत असल्यास, Enterprise seat fee मध्ये प्रत्यक्षात काय समाविष्ट असते या भागात seat minimums आणि negotiated quote मध्येच उपलब्ध असणारे भाग स्पष्ट केले आहेत. Claude संपूर्णपणे नव्हे, तर विशेषतः coding tool ची किंमत ठरवत असल्यास, प्रत्येक plan वर Claude Code ची किंमत याच fees ची worked monthly estimate सोबत तुलना करते. Claude बाबत flat पर्याय अद्याप निश्चित झालेला नसेल, तर ChatGPT च्या Go, Plus आणि Pro च्या तुलनेत मांडलेल्या या tiers हा त्या निर्णयाचा दुसरा भाग आहे. Fees वारंवार बदलतात. प्रत्येक plan मागील allowance tokens मध्ये कधीही प्रकाशित केली जात नाही. त्यामुळे निर्णय घेताना त्या दिवशीचे pricing page तपासा.
API कडून तुम्हाला काय मिळू शकत नाही
योजनेतील allowance आणि त्याभोवती तयार केलेला इंटरफेस. Claude Code मधील /usage-credits command subscription वापराचे credits व्यवस्थापित करते. हे command “/login द्वारे तुमच्या claude.ai subscription मध्ये sign in केल्यानंतर” चालवता येते; API key authentication सह हे command उपलब्ध नसते. बिलिंग mode नुसार /usage screen देखील वेगळी असते. त्यातील Session block “API token usage दाखवतो आणि API users साठी आहे”; subscribers ना त्याऐवजी plan usage bars आणि usage breakdown दिसतात.
Claude Code मधील अधिक दीर्घ prompt cache. यासाठी प्रत्यक्ष पैसे लागतात आणि हा फरक सहज लक्षात येत नाही. Documentation नुसार, “subscription वर cache lifetime एक तास असतो. Usage credits वापरणे सुरू केल्यावर तो पाच मिनिटांपर्यंत कमी होतो; API key किंवा cloud provider वर तो default ने पाच मिनिटांचा असतो.” Cache lifetime पेक्षा जास्त वेळेचा खंड झाल्यानंतरचा पहिला message cache मध्ये मिळत नाही. त्यामुळे संपूर्ण context पुन्हा process केला जातो आणि write prices नुसार billing होते. Subscription वर तुम्ही पन्नास मिनिटांची meeting घेऊन परत आल्यावर cache उपलब्ध राहू शकतो. API key वर त्याच खंडासाठी session prefix पुन्हा पूर्णपणे लिहिण्याचा खर्च होतो.
सबस्क्रिप्शनमधून तुम्हाला काय मिळत नाही
Programmatic access. Claude ला कॉल करणाऱ्या cron job किंवा webhook handler साठी API key आवश्यक असते. त्यामुळे तुमचे workload असे असल्यास तुलना इथेच संपते. VPS वर तुमचे पहिले Claude API अॅप तयार करणे यामध्ये key हाताळणे आणि प्रथम कार्यरत script यांची माहिती दिली आहे.
Batch API discount. Pricing page वर हे स्पष्टपणे नमूद केले आहे: "Batch API allows asynchronous processing of large volumes of requests with a 50% discount on both input and output tokens." ज्या कामासाठी मानवाला प्रतीक्षा करावी लागत नाही, त्यासाठी input आणि output tokens चे मोजमाप निम्मे होते. प्रति million tokens Batch दर Opus 4.8 साठी input $2.50 आणि output $12.50 आहेत. Introductory pricing नुसार Sonnet 5 साठी हे दर अनुक्रमे $1 आणि $5 आहेत. Haiku 4.5 साठी ते $0.50 आणि $2.50 आहेत. यामध्ये latency हा trade-off आहे: बहुतेक batches एका तासाच्या आत पूर्ण होतात. 24 तासांच्या आत पूर्ण न झालेला batch expire होतो. Streaming ला batch करता येत नाही. Batch आणि prompt caching एकत्र वापरता येतात. Batch पाच मिनिटांपेक्षा जास्त काळ चालू शकतो, त्यामुळे त्यामध्ये 1-hour cache वापरा.
Per-project cost attribution. प्रत्येक API response मध्ये usage block मिळतो. त्यामुळे तुम्ही एका request ची किंमत log करून ती एखाद्या project किंवा customer शी जोडू शकता. Subscription मध्ये seat धारण करणाऱ्या व्यक्तीसाठी bars चा एकच संच दाखवला जातो.
एक गोष्ट काळजीपूर्वक स्पष्ट करणे आवश्यक आहे, कारण दोन्ही दिशांनी चुकीचे गृहीत धरणे सोपे आहे: ही स्वतंत्र billing surfaces आहेत. Anthropic चे documentation subscription billing साठी claude.ai support कडे आणि Console billing साठी API platform कडे पाठवते. तसेच /usage-credits API key अंतर्गत कार्य करत नाही. Subscription मध्ये API credit समाविष्ट असल्याचे मी तपासलेल्या कोणत्याही माहितीत नमूद नाही. त्यामुळे दोन accounts आणि दोन bills गृहीत धरून योजना करा.
बरोबरीचा खर्च ठरवण्याचे सूत्र
एका फेरीची किंमत ठरवा आणि नंतर प्रमाण वाढवा.
turn cost = uncached_input_tokens x base_input_price
+ cache_write_tokens x 1.25 x base_input_price
+ cache_read_tokens x 0.10 x base_input_price
+ output_tokens x output_price
monthly API cost = turn cost x turns_per_active_day x active_days_per_month
break even when: monthly API cost = flat plan feeहे गुणक अंदाजे नसून प्रकाशित केलेले आहेत. 5-मिनिटांच्या cache write साठी "मूळ input किमतीच्या 1.25x", 1-तासाच्या write साठी "मूळ input किमतीच्या 2x", आणि cache read साठी "मूळ input किमतीच्या 0.1x" शुल्क आकारले जाते. Thinking tokens साठी output tokens प्रमाणे शुल्क आकारले जाते. त्यामुळे reasoning summary दाखवत नसलेल्या models मध्येही ते output_tokens मध्ये समाविष्ट होतात.
प्रति दशलक्ष tokens (MTok) साठीची मूळ दररचना, 23 July 2026 रोजी लागू:
claude-fable-5: $10 input, $50 output. Cache read $1. 5-मिनिटांचा cache write $12.50. 1M context.claude-opus-4-8आणिclaude-opus-4-7: $5 input, $25 output. Cache read $0.50. 5-मिनिटांचा cache write $6.25. 1M context.claude-sonnet-5: 31 August 2026 पर्यंतच्या introductory pricing अंतर्गत $2 input, $10 output; त्यानंतर हे दर $3 आणि $15 होतील. introductory rates नुसार cache read $0.20 आणि 5-मिनिटांचा cache write $2.50. 1M context.claude-haiku-4-5: $1 input, $5 output. Cache read $0.10. 5-मिनिटांचा cache write $1.25. 200K context.
मोठ्या context साठी कोणतेही अतिरिक्त शुल्क नाही: "900k-token विनंतीसाठी प्रति-token दर 9k-token विनंतीइतकाच असतो."
गृहीतके स्पष्टपणे लिहिलेली एक उदाहरणात्मक गणना
Sonnet 5 वर Claude Code चे मधल्या सत्रातील एक turn गृहीत धरा. या turn मध्ये context चे 60,000 tokens आहेत: त्यापैकी 55,000 cache मधून दिले जातात, 3,000 नव्याने cache मध्ये लिहिले जातात, 2,000 fresh uncached input tokens आहेत आणि thinking धरून output मध्ये 1,200 tokens आहेत.
- Cache reads: 55,000 x $0.20/MTok = $0.0110
- Cache writes: 3,000 x $2.50/MTok = $0.0075
- Uncached input: 2,000 x $2.00/MTok = $0.0040
- Output: 1,200 x $10.00/MTok = $0.0120
म्हणजे प्रत्येक turn साठी सुमारे $0.035. सक्रिय दिवशी 120 turns असल्यास दररोज सुमारे $4.14. महिन्यात 20 सक्रिय दिवस असल्यास महिन्याला सुमारे $83.
ही रक्कम वर दिलेल्या flat fees शी तुलना केल्यास एकाच वेळी दोन गोष्टी स्पष्ट होतात. ही Pro fee पेक्षा सुमारे चारपट आहे. त्यामुळे Pro चा allowance दररोज 120 Sonnet turns पुरवत असेल, तर कागदावर Pro स्वस्त आहे. मात्र, ही अट तुमच्यासाठी कोणताही प्रकाशित आकडा निश्चित करू शकत नाही. याचे सर्वात जवळचे उत्तर Pro मध्ये नेमके काय समाविष्ट आहे आणि त्याच्या मर्यादा तुम्हाला कुठे थांबवतात याचा अधिक जवळून आढावा येथे मिळते. स्वस्त fee निवडण्यापूर्वी ते वाचणे उपयुक्त ठरेल. हेच $83 entry Max fee पेक्षा कमी आहे. त्यामुळे या प्रकरणात meter Max पेक्षा स्वस्त ठरतो. शेवटच्या वाक्यात entry हा शब्द महत्त्वाचा आहे, कारण Max दोन किमतींमध्ये उपलब्ध आहे. त्यामुळे तुम्ही प्रत्यक्षात Max च्या दोन tiers पैकी कोणता खरेदी कराल यानुसार तुम्ही तुलना करत असलेली मर्यादा महिन्याला $100 ने बदलते.
आता एका वेळी एकच गृहीतक बदला आणि plan fee निर्णायक संख्या राहात नाही हे पाहा.
ब्रेक-इव्हनवर प्लॅनच्या किमतीपेक्षा तीन गोष्टींचा अधिक परिणाम होतो
Prompt caching. कॅशिंगशिवाय समान 60,000-token turn चालवल्यास संपूर्ण prompt नवीन input म्हणून आकारला जातो: 60,000 x $2.00/MTok = $0.12, तसेच output साठी $0.012, म्हणजे प्रत्येक turn साठी $0.132. हा cached turn पेक्षा जवळपास चारपट आहे आणि त्यामुळे $83 चा महिना सुमारे $317 होतो. Anthropic प्रकाशित करते तो हा एकमेव break-even आहे, कारण तो तुमच्या workload वर अवलंबून नसतो: "A cache hit costs 10% of the standard input price, which means caching pays off after just one cache read for the 5-minute duration (1.25x write), or after two cache reads for the 1-hour duration (2x write)."
दोन failure modes तुमच्या निदर्शनास न आणता caching बंद करतात. पहिला म्हणजे model च्या किमान cacheable length पेक्षा लहान prefix: Fable 5 वर 512 tokens, Opus 4.8 आणि Sonnet 5 वर 1,024, Opus 4.7 वर 2,048 आणि Haiku 4.5 वर 4,096. लहान prefix cache होत नाही आणि कोणतीही error दिसत नाही. दुसरा म्हणजे parallel requests, कारण "a cache entry only becomes available after the first response begins." एकाच वेळी पाठवलेल्या दहा identical requests साठी input ची पूर्ण किंमत आकारली जाते. दोन्ही प्रकरणांचे लक्षण म्हणजे cache_read_input_tokens चे मूल्य शून्य असणे.
Model choice. समान turn ची किंमत Opus 4.8 वर मोजा. त्याची किंमत input साठी $5 आणि output साठी $25 आहे; cache reads साठी $0.50 आणि 5-minute writes साठी $6.25 प्रति MTok आकारले जातात: reads $0.0275, writes $0.0188, uncached input $0.0100 आणि output $0.0300. म्हणजे प्रत्येक turn साठी सुमारे $0.086, Sonnet turn पेक्षा 2.5 पट, आणि त्याच volume वर महिन्याला सुमारे $207. एका model choice मुळे समान काम entry Max fee पेक्षा कमी खर्चातून तिच्या दुपटीपेक्षा अधिक खर्चापर्यंत गेले. Mechanical work, जसे log triage, यासाठी Haiku 4.5 ची $1 input आणि $5 output किंमत खर्च उलट दिशेने कमी करते. Fable 5 हे आणखी महाग आहे: input साठी $10 आणि output साठी $50. त्यामुळे ते default model म्हणून वापरण्यापूर्वी कोणती कामे Fable 5 च्या दराची प्रत्यक्ष भरपाई करतात हे वाचणे उपयुक्त ठरते.
Effort level हा model choice चाच भाग आहे, कारण thinking tokens साठी output rates प्रमाणे आकारणी होते. Opus 4.8 वर API default high आहे आणि coding तसेच agentic work साठी दस्तऐवजीकरणात दिलेली सुरुवातीची पातळी अधिक महाग xhigh आहे. Claude Code मध्ये /effort किंवा API वर output_config.effort वापरून ती कमी करा. जुन्या अंदाजांवर आणखी एका गोष्टीचा परिणाम होतो: नवीन models एक नवीन tokenizer वापरतात, जो "produces approximately 30% more tokens for the same text", त्यामुळे जुन्या model वर मोजलेली संख्या आजच्या समान text चा खर्च कमी दाखवते.
Session hygiene. API stateless आहे. त्यामुळे प्रत्येक turn मध्ये संपूर्ण conversation billed input म्हणून पुन्हा पाठवली जाते. म्हणून fresh session पेक्षा दीर्घ session मध्ये प्रत्येक message ची किंमत अधिक असते. अनपेक्षित invoices मागे हेच बहुतांश वेळा कारण असते. याचे सविस्तर स्पष्टीकरण Claude Code session मध्ये प्रत्यक्षात कोणते घटक tokens वापरतात येथे दिले आहे. असंबंधित tasks दरम्यान /clear चालवा, कारण जुना context नंतरच्या प्रत्येक message मध्ये पुन्हा पाठवला आणि पुन्हा आकारला जातो. एका दीर्घ task मध्ये /compact चालवा, म्हणजे history पूर्णपणे ठेवण्याऐवजी तिचा summary केला जातो. सलग कामाच्या stints मध्ये काम करा, कारण default cache "has a 5-minute lifetime" आणि "is refreshed for no additional cost each time the cached content is used". दर दहा मिनिटांनी एकदा वापरलेली session प्रत्येक वेळी पुन्हा write करण्याची किंमत देते. tmux मध्ये VPS वर चालू असलेली detached Claude Code session idle असताना जवळजवळ कोणताही खर्च करत नाही; परंतु cache lifetime संपेपर्यंत idle राहिल्यास warm prefix चा लाभ गमावला जातो.
स्वतःचा वापर मोजल्याशिवाय निर्णय घेऊ नका
माझ्या उदाहरणावरून निर्णय घेऊ नका. तुमच्या स्वतःच्या एका आठवड्याच्या वापरावरून निर्णय घ्या.
Claude Code मध्ये एका आठवड्यासाठी प्रत्येक session च्या शेवटी /usage चालवा (/cost हा त्याच screen साठीचा alias आहे). यात session मधील token counts आणि खर्चाचा अंदाज दिसतो. मात्र documentation मधील ही सूचना लक्षात घ्या: "The dollar figure is an estimate computed locally from token counts and may differ from your actual bill." /clear चालवल्यावर totals reset होतात. त्यामुळे आधी screen वाचा. Subscription मध्ये दिसणारी dollar figure तुमचे bill नसते. परंतु तिच्यामागील token counts या formula साठी आवश्यक आहेत. काय window भरत आहे हे /context दाखवते.
API account वापरत असल्यास Claude Console मधील usage page हा अधिकृत record आहे. Prompt पाठवण्यापूर्वी त्याची किंमत मोजण्यासाठी client.messages.count_tokens() हे "free to use but subject to requests per minute rate limits based on your usage tier" आहे. तसेच, प्रत्यक्ष bill साठी वापरल्या जाणाऱ्या tokenizer चा वापर करणारे हेच एकमेव count आहे.
Call नंतर usage block वाचा आणि तो योग्य प्रकारे समजून घ्या:
u = response.usage
total_input = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokensinput_tokens फक्त cache न केलेला उर्वरित भाग मोजते. Documentation मध्ये त्याचे वर्णन "tokens after the last cache breakpoint" असे केले आहे. input_tokens: 4000 दाखवणारा turn हा 4,000-token turn नसतो. या तीन fields ची बेरीज या formula ला आवश्यक असलेला prompt size देते.
त्यानंतर तुलना करा. तुमचा मोजलेला मासिक वापर योजनेच्या शुल्कापेक्षा स्पष्टपणे कमी असेल, तर मीटर-आधारित पर्याय निवडा. तो स्पष्टपणे जास्त असेल, तर योजनेतील allowance तुमच्या नेहमीच्या कामकाजाच्या दिवसासाठी पुरेसा असेल या अटीवर योजना निवडा. वापराचा खर्च सीमारेषेजवळ असेल, तर योजना निवडा, कारण योजना अनपेक्षित खर्च देत नाही; मीटर-आधारित पर्याय देऊ शकतो. वापर अगदी Pro शुल्कापेक्षाही खूप कमी असेल, तर दोन्हीपैकी काहीही खरेदी करण्यापूर्वी तुमच्या कामाच्या पद्धतीसाठी सशुल्क योजना free tier पेक्षा फायदेशीर आहे का हे ठरवा, कारण इतका कमी वापर free limit वारंवार ओलांडणार नाही आणि त्यामुळे कोणतेही बिल योग्य ठरणार नाही. यापैकी कोणताही निर्णय कायमस्वरूपी नसतो, कारण योजना रद्द करणे किंवा tier कमी करणे केल्यास, आणखी काही आठवड्यांचा प्रत्यक्ष वापर तुमच्या अंदाजाच्या विरुद्ध गेला तरी, आधीच भरलेल्या महिन्याचा कालावधी अबाधित राहतो. तुम्ही कोणताही पर्याय निवडला तरी, या गणनेतून केवळ कोणते billing model स्वस्त आहे हे ठरते. वाचवलेल्या तासांमुळे हा खर्च भरून निघतो का हे ठरवण्यासाठी तुमच्या स्वतःच्या तासाच्या दरावर आधारित स्वतंत्र गणना करावी लागते.
FAQ
Claude API हा Claude Pro किंवा Max पेक्षा स्वस्त आहे का?
हे वापराच्या प्रमाणावर अवलंबून आहे. Subscription token allowance म्हणून नव्हे, तर usage window म्हणून विकल्या जात असल्यामुळे शोधता येईल असा प्रकाशित break-even point उपलब्ध नाही. प्रकाशित per-token दरांवरून एका सामान्य turn ची किंमत काढा. ती किंमत प्रत्येक active day मधील turns आणि महिन्यातील active days यांच्या संख्येने गुणा. त्यानंतर मिळालेली रक्कम plan fee शी तुलना करा. एका उदाहरणात, 60,000-token Sonnet 5 turn ची किंमत सुमारे $0.035 आली. दररोज 120 turns आणि महिन्यात 20 active days असल्यास ही किंमत महिन्याला सुमारे $83 होते. ती Pro fee पेक्षा जास्त, पण entry Max fee पेक्षा कमी होती.
माझ्या Claude API चा मासिक खर्च कसा काढू?
प्रत्यक्ष token counts गोळा करण्यासाठी Claude Code मध्ये /usage एक आठवडा चालवा. तुमच्याकडे आधीच API account असल्यास Claude Console मधील usage page पहा. त्यानंतर एका turn ची किंमत काढा: uncached input साठी base rate, cache writes साठी base input च्या 1.25 पट, cache reads साठी base input च्या 0.1 पट आणि output साठी output rate वापरा. Thinking tokens ची गणना output म्हणून करा. ही किंमत प्रत्येक active day मधील turns आणि महिन्यातील active days यांच्या संख्येने गुणा.
Claude API च्या बिलावर सर्वाधिक परिणाम कशाचा होतो?
सर्वाधिक परिणाम prompt caching चा होतो. Sonnet 5 वरील 60,000-token turn ची किंमत prefix cache मधून दिल्यास सुमारे $0.035 असते. Prefix cache मधून न दिल्यास ती सुमारे $0.132 असते. त्यानंतर model choice चा परिणाम होतो. त्याच turn ची Opus 4.8 वरील किंमत सुमारे $0.086 असते. Session length चा परिणाम तिसऱ्या क्रमांकावर होतो. API stateless असल्यामुळे प्रत्येक turn मध्ये संपूर्ण conversation billed input म्हणून पुन्हा पाठवली जाते.
Claude subscription मध्ये API access समाविष्ट आहे का?
त्यांना दोन accounts आणि दोन bills म्हणून समजा. API calls Console मध्ये तयार केलेल्या account विरुद्ध per-token पद्धतीने bill केल्या जातात. मी तपासलेल्या documentation मध्ये subscription मुळे API credit मिळते असे कुठेही नमूद नाही. दोन्ही स्वतंत्र surfaces असल्याचे सर्वात स्पष्ट संकेत म्हणजे Claude Code मधील /usage-credits command. ते command “isn't available with API key authentication” असे documentation मध्ये म्हटले आहे. अनेक developers दोन्ही वापरतात: interactive coding साठी plan आणि त्यांनी तयार केलेल्या गोष्टींसाठी key.