Claude API কি subscription-এর চেয়ে সস্তা? হিসাব দেখুন
বর্তমান per-token rate ধরে API ও subscription-এর break-even হিসাব দেখুন। official সংখ্যা নেই, তাই usage window, model ও token ব্যবহারে খরচ কীভাবে বদলায় জানুন।
সাবস্ক্রিপশন কি Claude API-এর চেয়ে সস্তা?
নির্দিষ্ট ব্যবহারের পরিমাণের নিচে Claude API সাবস্ক্রিপশনের চেয়ে সস্তা, আর তার ওপরে বেশি ব্যয়বহুল। একজন developer যদি সারা দিন ইন্টার্যাক্টিভভাবে coding করেন, তাহলে সাধারণত fixed-price plan বেশি সাশ্রয়ী হয়। কোনো program নিজে API call করলে API-ই একমাত্র বিকল্প; তাই খরচ তখন সিদ্ধান্তের বিষয় নয়। বাকি হিসাব আপনি দশ মিনিটের মধ্যে করতে পারবেন।
দুইটির খরচ সমান হওয়ার কোনো official break-even সংখ্যা খুঁজে পাওয়া যায় না। Subscription-এ token allowance-এর বদলে usage window অনুযায়ী সেবা দেওয়া হয়। তাই কোনো published figure থেকে বলা যায় না যে দুই খরচের রেখা কোথায় মিলবে। নিচে বর্তমান per-token rate অনুযায়ী formula দেওয়া হয়েছে। পাশাপাশি, আপনার ব্যবহারের যে বিষয়গুলো plan fee-এর চেয়ে অনেক বেশি প্রভাব ফেলে, সেগুলোও ব্যাখ্যা করা হয়েছে। নিচের প্রতিটি break-even figure published rate এবং উল্লেখ করা assumption থেকে করা আমার নিজস্ব হিসাব; এগুলো কোনো documented number নয়।
আপনি যদি এখনও কোন plan কিনবেন তা ঠিক করে থাকেন, আপনার কাজের ধরন অনুযায়ী কোন Claude plan উপযুক্ত—এই লেখায় তার উত্তর আছে। এখানে ধরে নেওয়া হয়েছে যে কোন plan কিনবেন তা আপনি জানেন এবং সেটি আদৌ কেনা উচিত কি না, তা জানতে চাইছেন।
দুটি billing model একই কাঠামোর নয়
Subscription হলো এমন capacity, যা আপনি ব্যবহার নাও করতে পারেন। আপনি একটি নির্দিষ্ট fee দেন এবং নির্দিষ্ট schedule অনুযায়ী reset হওয়া allowance পান। Anthropic-এর Claude Code documentation-এ Team ও Enterprise seat-এর কাঠামো বলা হয়েছে: usage “per-seat allowance থেকে নেওয়া হয়, যা rolling পাঁচ ঘণ্টার window এবং weekly window অনুযায়ী reset হয়”; এই allowance Claude chat ও Cowork-এর সঙ্গে shared। Subscriber যে একই কাঠামোর সম্মুখীন হন, তা ব্যবহার করা message-এর মাধ্যমে বোঝা যায়। সেখানে “You've hit your session limit” এবং “You've hit your weekly limit” লেখা দেখা যায়। আপনি যে capacity ব্যবহার করেননি, তার জন্যও fee দিতে হয়। আপনি allowance অতিক্রম করলে window reset না হওয়া পর্যন্ত কাজ বন্ধ থাকে। /model দিয়ে model বদলালেও access ফিরে আসে না, কারণ window-গুলো সব model-এর মধ্যে shared। এখন যদি আপনি এই message-গুলোর একটির দিকে তাকিয়ে থাকেন, আপনি কোন window reset হওয়ার অপেক্ষায় আছেন তা নির্ধারণ করা এই হিসাবের আগে করা দরকার। কারণ পাঁচ ঘণ্টার এবং weekly limit-এর জন্য আলাদা ব্যবস্থা প্রয়োজন।
API হলো এমন একটি meter, যা কখনো থামে না। এখানে কোনো window বা wall নেই। প্রতিটি request token অনুযায়ী মূল্য নির্ধারিত হয়। কিছু service token-এর বাইরে আলাদাভাবে priced হয়। যেমন, web search “Claude API-তে প্রতি 1,000 search-এর জন্য $10-এ available”। কোনো limit-এ পৌঁছে কাজ থেমে যায় না। শুধু invoice-এর পরিমাণ বাড়তে থাকে। এর নিচে কোনো free tier-ও নেই। তবে signup credit এবং যেসব অংশের জন্য কোনো fee লাগে না এই হিসাব প্রাসঙ্গিক হওয়ার আগেই প্রথম experiment চালানোর সুযোগ দেবে।
23 July 2026 অনুযায়ী plan fee, Claude pricing page থেকে উদ্ধৃত: Pro-এর মূল্য “annual subscription discount-সহ প্রতি মাসে $17 ($200 আগাম billed)। মাসে মাসে billed হলে $20”, এবং এতে Claude Code অন্তর্ভুক্ত। Max-এর মূল্য “প্রতি মাসে $100 থেকে”। Team seat-এর মূল্য annual billing হলে “প্রতি seat / মাসে $20 থেকে”। Enterprise বিশেষভাবে গুরুত্বপূর্ণ, কারণ এতে দুটি model একসঙ্গে ব্যবহৃত হয়: “Seat price + usage at API rates $20/seat”। আপনি যদি এই hybrid plan বিবেচনা করেন, Enterprise seat fee-তে আসলে কী অন্তর্ভুক্ত অংশে seat minimum এবং negotiated quote-এ কেবল যে অংশগুলো পাওয়া যায়, তা ব্যাখ্যা করা হয়েছে। আপনি যদি Claude সামগ্রিকভাবে নয়, নির্দিষ্টভাবে coding tool-এর মূল্য হিসাব করেন, প্রতিটি plan-এ Claude Code-এর মূল্য কত অংশে একই fee-গুলো একটি বাস্তব monthly estimate-এর সঙ্গে দেখানো হয়েছে। Claude-এর flat-price দিকটি এখনো চূড়ান্ত না হলে, ChatGPT-এর Go, Plus এবং Pro-এর সঙ্গে এই tier-গুলোর মূল্য তুলনা সিদ্ধান্তটির অন্য দিকটি দেখায়। Fee প্রায়ই পরিবর্তিত হয়। প্রতিটি plan-এর allowance token হিসেবে কখনো প্রকাশ করা হয় না। তাই সিদ্ধান্ত নেওয়ার দিন pricing page দেখুন।
API থেকে যা পাওয়া যায় না
একটি plan allowance এবং সেটিকে ঘিরে তৈরি interface। Claude Code-এর /usage-credits command subscription usage credit পরিচালনা করে। এটি চালাতে হয় "/login-এর মাধ্যমে আপনার claude.ai subscription-এ sign in করার পরে; API key authentication ব্যবহার করলে command-টি পাওয়া যায় না"। /usage screen-ও billing mode অনুযায়ী ভিন্ন হয়: এর Session block "API token usage দেখায় এবং API user-দের জন্য নির্ধারিত", আর subscriber-রা এর পরিবর্তে plan usage bar এবং usage breakdown দেখতে পান।
Claude Code-এ দীর্ঘতর prompt cache। এর জন্য সরাসরি অর্থ খরচ হয়, কিন্তু বিষয়টি সহজেই চোখ এড়িয়ে যেতে পারে। Documentation-এ বলা আছে, "subscription-এ lifetime এক ঘণ্টা, usage credit ব্যবহার শুরু করলে তা পাঁচ মিনিটে নেমে আসে; API key বা cloud provider ব্যবহার করলে default lifetime পাঁচ মিনিট"। Cache lifetime-এর চেয়ে দীর্ঘ বিরতির পরে পাঠানো প্রথম message cache ব্যবহার করতে পারে না। তাই সম্পূর্ণ context আবার process করা হয় এবং write price অনুযায়ী billing হয়। Subscription ব্যবহার করলে আপনি পঞ্চাশ মিনিটের meeting-এ গিয়ে ফিরে এসে cache সক্রিয় অবস্থায় কাজ চালিয়ে যেতে পারেন। API key ব্যবহার করলে একই বিরতির জন্য session prefix সম্পূর্ণভাবে আবার write করতে হয়।
একটি subscription থেকে যা পাওয়া যায় না
Programmatic access। Claude-কে কল করে এমন cron job বা webhook handler-এর জন্য API key প্রয়োজন। তাই আপনার workload এ ধরনের হলে তুলনা এখানেই শেষ। VPS-এ আপনার প্রথম Claude API app তৈরি করা-এ key ব্যবস্থাপনা এবং প্রথম কার্যকর script সম্পর্কে ব্যাখ্যা করা হয়েছে।
Batch API discount। Pricing page-এ বিষয়টি স্পষ্টভাবে বলা আছে: "Batch API allows asynchronous processing of large volumes of requests with a 50% discount on both input and output tokens." অর্থাৎ কোনো কাজের জন্য মানুষ অপেক্ষা না করলে তার token খরচ অর্ধেক হয়। প্রতি million token হিসেবে Batch rate হলো Opus 4.8-এ input-এর জন্য $2.50 এবং output-এর জন্য $12.50, introductory pricing-এ Sonnet 5-এ $1 এবং $5, এবং Haiku 4.5-এ $0.50 এবং $2.50। এর বিনিময়ে latency বেশি হয়: অধিকাংশ batch এক ঘণ্টার মধ্যে শেষ হয়, 24 ঘণ্টার মধ্যে সম্পন্ন না হলে batch expire হয়, এবং streaming batch করা যায় না। Batch ও prompt caching একসঙ্গে ব্যবহার করা যায়। একটি batch পাঁচ মিনিটের বেশি চলতে পারে বলে এর মধ্যে 1-hour cache ব্যবহার করুন।
Per-project cost attribution। প্রতিটি API response-এ একটি usage block থাকে। তাই একটি নির্দিষ্ট request-এর cost log করে সেটি কোনো project বা customer-এর নামে বরাদ্দ করতে পারেন। Subscription ব্যবহারকারীর জন্য seat ধারণকারী ব্যক্তিকে কেন্দ্র করে এক সেট usage bar দেখায়।
একটি বিষয় সতর্কভাবে মনে রাখুন, কারণ দুই দিকেই ভুল ধারণা হওয়া সহজ: এগুলো আলাদা billing surface। Anthropic-এর documentation subscription billing-এর জন্য claude.ai support এবং Console billing-এর জন্য API platform-এ নির্দেশ করে। এছাড়া /usage-credits API key-এর অধীনে কাজ করে না। আমি যে তথ্য যাচাই করেছি, তার কোথাও বলা নেই যে subscription-এর মধ্যে API credit অন্তর্ভুক্ত থাকে। তাই দুইটি account এবং দুইটি bill ধরে পরিকল্পনা করুন।
খরচ সমান হওয়ার সূত্র
প্রথমে একটি পালা বা turn-এর মূল্য নির্ধারণ করুন, তারপর সেটি বড় পরিসরে প্রয়োগ করুন।
turn cost = uncached_input_tokens x base_input_price
+ cache_write_tokens x 1.25 x base_input_price
+ cache_read_tokens x 0.10 x base_input_price
+ output_tokens x output_price
monthly API cost = turn cost x turns_per_active_day x active_days_per_month
break even when: monthly API cost = flat plan feeমাল্টিপ্লায়ারগুলো প্রকাশিত, অনুমানভিত্তিক নয়। 5-minute cache write-এর খরচ “1.25x base input price”, 1-hour write-এর খরচ “2x base input price”, এবং cache read-এর খরচ “0.1x base input price”। Thinking token-কে output token হিসেবে বিল করা হয়। তাই reasoning summary প্রদর্শন করে না এমন model-এর ক্ষেত্রেও এগুলো output_tokens-এর অন্তর্ভুক্ত।
প্রতি million token (MTok) অনুযায়ী base rate, 23 July 2026-এ প্রযোজ্য:
claude-fable-5: $10 input, $50 output। Cache read $1। 5-minute cache write $12.50। 1M context।claude-opus-4-8এবংclaude-opus-4-7: $5 input, $25 output। Cache read $0.50। 5-minute cache write $6.25। 1M context।claude-sonnet-5: 31 August 2026 পর্যন্ত introductory pricing-এ $2 input, $10 output; এরপর $3 এবং $15। Introductory rate-এ cache read $0.20 এবং 5-minute cache write $2.50। 1M context।claude-haiku-4-5: $1 input, $5 output। Cache read $0.10। 5-minute cache write $1.25। 200K context।
দীর্ঘ context-এর জন্য কোনো অতিরিক্ত surcharge নেই: “900k-token request-এর ক্ষেত্রে প্রতি-token rate 9k-token request-এর সমান।”
প্রতিটি অনুমান উল্লেখ করে একটি ব্যবহারিক উদাহরণ
Sonnet 5-এ Claude Code-এর একটি mid-session turn বিবেচনা করুন, যেখানে context-এর পরিমাণ 60,000 tokens: এর মধ্যে 55,000 cache থেকে পরিবেশিত, 3,000 নতুন করে cache-এ লেখা, 2,000 fresh uncached input এবং thinking-সহ 1,200 output tokens।
- Cache reads: 55,000 x $0.20/MTok = $0.0110
- Cache writes: 3,000 x $2.50/MTok = $0.0075
- Uncached input: 2,000 x $2.00/MTok = $0.0040
- Output: 1,200 x $10.00/MTok = $0.0120
অর্থাৎ প্রতি turn-এর খরচ প্রায় $0.035। সক্রিয় দিনে 120টি turn হলে দিনে প্রায় $4.14। মাসে 20টি সক্রিয় দিন হলে মাসে প্রায় $83।
উপরের fixed fee-এর সঙ্গে এটি তুলনা করলে একই সঙ্গে দুটি বিষয় বোঝা যায়। এই খরচ Pro fee-এর প্রায় চার গুণ। তাই কাগজে-কলমে Pro সস্তা, যদি তার allowance দিনে 120টি Sonnet turn চালানোর জন্য যথেষ্ট হয়। এই শর্তটি আপনার জন্য কোনো প্রকাশিত সংখ্যা নিশ্চিত করতে পারে না। এর সবচেয়ে কাছাকাছি উত্তর পাওয়া যাবে Pro-তে কী অন্তর্ভুক্ত এবং কোন সীমাগুলো আপনাকে থামিয়ে দিতে পারে, তা বিস্তারিত দেখুন অংশে। সস্তা fee-ই চূড়ান্তভাবে ভালো হবে ধরে নেওয়ার আগে এটি পড়া উচিত। একই $83 entry Max fee-এর নিচে থাকে। তাই এই ক্ষেত্রে usage meter Max-এর চেয়ে সাশ্রয়ী। শেষ বাক্যে entry শব্দটি গুরুত্বপূর্ণ, কারণ Max দুটি দামে বিক্রি হয় এবং আপনি বাস্তবে Max-এর কোন tier কিনবেন তার ওপর আপনি যে সীমার সঙ্গে তুলনা করছেন, সেটি মাসে $100 পরিবর্তিত হয়।
এখন একবারে একটি অনুমান পরিবর্তন করুন এবং দেখুন, কীভাবে plan fee আর সিদ্ধান্ত নির্ধারণের প্রধান সংখ্যা থাকে না।
পরিকল্পনার মূল্যের চেয়ে তিনটি বিষয় break-even বিন্দুকে বেশি প্রভাবিত করে
Prompt caching। Caching ছাড়া একই 60,000-token turn চালালে পুরো prompt-কে নতুন input হিসেবে বিল করা হয়: 60,000 x $2.00/MTok = $0.12, এর সঙ্গে output-এর $0.012 যোগ হয়ে প্রতি turn-এ খরচ হয় $0.132। এটি cached turn-এর প্রায় চার গুণ এবং মাসিক $83 খরচকে প্রায় $317-এ নিয়ে যায়। এটিই Anthropic প্রকাশিত একমাত্র break-even হিসাব, কারণ এটি আপনার workload-এর ওপর নির্ভর করে না: "A cache hit costs 10% of the standard input price, which means caching pays off after just one cache read for the 5-minute duration (1.25x write), or after two cache reads for the 1-hour duration (2x write)।"
দুটি failure mode কোনো বার্তা না দিয়েই caching বন্ধ করে দেয়। প্রথমটি হলো model-এর ন্যূনতম cacheable length-এর চেয়ে ছোট prefix: Fable 5-এ 512 tokens, Opus 4.8 এবং Sonnet 5-এ 1,024, Opus 4.7-এ 2,048, এবং Haiku 4.5-এ 4,096। prefix ছোট হলে তা cache হয় না এবং কোনো error-ও দেখানো হয় না। দ্বিতীয়টি হলো parallel requests, কারণ "a cache entry only becomes available after the first response begins." একসঙ্গে পাঠানো দশটি অভিন্ন request-এ input-এর সম্পূর্ণ মূল্য দিতে হয়। উভয় ক্ষেত্রেই লক্ষণ হলো cache_read_input_tokens শূন্য থাকা।
Model choice। একই turn-এর মূল্য Opus 4.8-এ হিসাব করুন। সেখানে input-এর দাম $5 এবং output-এর দাম $25, cache read-এর দাম $0.50 এবং 5-minute write-এর দাম প্রতি MTok-এ $6.25: read $0.0275, write $0.0188, uncached input $0.0100, output $0.0300। এতে প্রতি turn-এ খরচ হয় প্রায় $0.086, যা Sonnet turn-এর 2.5 গুণ, এবং একই volume-এ মাসে প্রায় $207। একটি model বেছে নেওয়ার ফলেই একই কাজ entry Max fee-এর নিচের খরচ থেকে তার দ্বিগুণেরও বেশি হয়ে গেল। $1 input এবং $5 output মূল্যে Haiku 4.5 খরচটি বিপরীত দিকে নিয়ে যায়; log triage-এর মতো mechanical কাজের জন্য এটি উপযোগী। Fable 5 খরচ আরও বাড়ায়: input $10 এবং output $50। তাই এটিকে default model হিসেবে ব্যবহারের আগে কোন কাজগুলো আসলে Fable 5-এর হার পুষিয়ে দেয় পড়ে নিন।
Effort level-ও model choice-এর অংশ, কারণ thinking tokens output rate-এ বিল হয়। Opus 4.8-এ API default হলো high, আর coding ও agentic কাজের জন্য নথিভুক্ত starting point হলো বেশি খরচের xhigh। Claude Code-এ /effort ব্যবহার করে অথবা API-তে output_config.effort ব্যবহার করে এটি কমান। আরও একটি বিষয় পুরোনো হিসাব বদলে দেয়: নতুন model-গুলো নতুন tokenizer ব্যবহার করে, যা "produces approximately 30% more tokens for the same text"। তাই পুরোনো model-এ মাপা count বর্তমানে একই text-এর প্রকৃত count কম দেখায়।
Session hygiene। API stateless, তাই প্রতিটি turn-এ পুরো conversation billed input হিসেবে আবার পাঠানো হয়। ফলে নতুন session-এর তুলনায় দীর্ঘ session-এ প্রতি message-এর খরচ বেশি হয়। অধিকাংশ অপ্রত্যাশিত invoice-এর পেছনে এটাই মূল কারণ, এবং Claude Code session-এ আসলে কোন বিষয়গুলো token ব্যবহার করে-এ এটি বিস্তারিত ব্যাখ্যা করা হয়েছে। সম্পর্কহীন কাজের মধ্যে /clear চালান, কারণ পুরোনো context পরবর্তী প্রতিটি message-এ আবার পাঠানো এবং বিল করা হয়। একটি দীর্ঘ কাজের মধ্যে /compact চালান, যাতে history পুরোটা বহন করার বদলে summary করা হয়। একটানা সময় ধরে কাজ করুন, কারণ default cache-এর "has a 5-minute lifetime" এবং "is refreshed for no additional cost each time the cached content is used"। প্রতি দশ মিনিটে একবার ব্যবহার করা session-এ প্রতিবার re-write-এর খরচ হয়। tmux-এ VPS-এ চলমান একটি detached Claude Code session idle অবস্থায় প্রায় কোনো খরচ করে না, কিন্তু cache lifetime পেরিয়ে idle থাকলে warm prefix আর বজায় থাকে না।
সিদ্ধান্ত নেওয়ার আগে নিজের ব্যবহার মাপুন
আমার উদাহরণ দেখে সিদ্ধান্ত নেবেন না। এক সপ্তাহের নিজের ব্যবহার দেখে সিদ্ধান্ত নিন।
Claude Code-এ এক সপ্তাহ ধরে প্রতিটি session-এর শেষে /usage চালান (/cost একই screen-এর একটি alias)। এটি session-এর token count এবং আনুমানিক খরচ দেখায়। তবে documentation-এ একটি সতর্কতা আছে: "The dollar figure is an estimate computed locally from token counts and may differ from your actual bill." /clear চালালে total reset হয়, তাই আগে screen-টি পড়ে নিন। Subscription-এ দেখানো dollar figure আপনার bill নয়, কিন্তু এর পেছনের token count-ই এই formula-র জন্য প্রয়োজন। /context দেখায় window-টি কোন বিষয় দিয়ে পূর্ণ হচ্ছে।
API account-এ Claude Console-এর usage page-ই authoritative record। কোনো prompt পাঠানোর আগে তার মূল্য হিসাব করতে client.messages.count_tokens() "free to use but subject to requests per minute rate limits based on your usage tier"। আপনি যে tokenizer-এর ভিত্তিতে bill পাবেন, এটিই সেই tokenizer ব্যবহার করে count দেখায়।
কোনো call-এর পরে usage block পড়ুন এবং সঠিকভাবে বুঝুন:
u = response.usage
total_input = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokensinput_tokens শুধু cache না হওয়া অবশিষ্ট অংশ গণনা করে। Documentation-এ এটিকে "tokens after the last cache breakpoint" বলা হয়েছে। কোনো turn-এ input_tokens: 4000 দেখালে সেটি 4,000-token-এর turn নয়। এই তিনটি field যোগ করলে যে সংখ্যা পাওয়া যায়, এই formula-র জন্য prompt size হিসেবে সেটিই প্রয়োজন।
তারপর তুলনা করুন। মাপা মাসিক খরচ যদি plan fee-এর তুলনায় স্পষ্টভাবে কম হয়, তাহলে metered billing বেছে নিন। এটি যদি স্পষ্টভাবে বেশি হয়, তাহলে plan বেছে নিন, তবে তার allowance আপনার স্বাভাবিক কর্মদিবসের কাজের জন্য যথেষ্ট হতে হবে। খরচ যদি সীমার কাছাকাছি হয়, তাহলে plan বেছে নিন। কারণ plan আপনাকে অপ্রত্যাশিত খরচে ফেলবে না, কিন্তু metered billing ফেলতে পারে। খরচ যদি Pro fee-এর তুলনাতেও অনেক কম হয়, তাহলে দুটির যেকোনো একটি কেনার আগে আপনার কাজের ধরনে paid plan free tier-এর চেয়ে কার্যকর কি না নির্ধারণ করুন। কারণ এত কম ব্যবহার হলে free limit যথেষ্ট ঘন ঘন অতিক্রম নাও করতে পারেন, ফলে কোনো বিল দেওয়ারই যৌক্তিকতা নাও থাকতে পারে। এটিও একমুখী সিদ্ধান্ত নয়। কারণ tier বাতিল করা বা নিচের tier-এ নামা হলে ইতিমধ্যে পরিশোধ করা মাসটি বহাল থাকে, যদি আরও কয়েক সপ্তাহের বাস্তব ব্যবহার আপনার হিসাবের সঙ্গে না মেলে। আপনি যে বিকল্পই বেছে নিন, এই হিসাব শুধু কোন billing model সস্তা তা নির্ধারণ করে। এই খরচে পুনরুদ্ধার করা কর্মঘণ্টার মাধ্যমে নিজের মূল্য উঠে আসে কি না তা আপনার নিজস্ব hourly rate ধরে আলাদাভাবে হিসাব করতে হবে।
FAQ
Claude API কি Claude Pro বা Max-এর চেয়ে সস্তা?
এটি ব্যবহারের পরিমাণের ওপর নির্ভর করে। তবে প্রকাশিত কোনো break-even হিসাব নেই, কারণ subscription-গুলো token allowance হিসেবে নয়, usage window হিসেবে বিক্রি হয়। প্রকাশিত প্রতি-token rate ব্যবহার করে একটি সাধারণ turn-এর খরচ হিসাব করুন। এরপর প্রতিদিনের active day-এ আপনার turn-এর সংখ্যা এবং মাসে active day-এর সংখ্যা দিয়ে গুণ করুন। তারপর সেই হিসাব plan fee-এর সঙ্গে তুলনা করুন। একটি উদাহরণে, 60,000-token Sonnet 5 turn-এর খরচ প্রায় $0.035 হয়েছিল। 20 দিন ধরে প্রতিদিন 120টি turn চালালে মাসিক খরচ প্রায় $83 হয়। এটি Pro fee-এর চেয়ে বেশি, কিন্তু entry Max fee-এর চেয়ে কম।
প্রতি মাসে Claude API-এর খরচ কীভাবে হিসাব করব?
বাস্তব token count সংগ্রহ করতে এক সপ্তাহ Claude Code-এ /usage চালান। আপনার API account থাকলে Claude Console-এর usage page-ও দেখুন। এরপর একটি turn-এর খরচ হিসাব করুন: uncached input-এর জন্য base rate, cache write-এর জন্য base input-এর 1.25 গুণ, cache read-এর জন্য base input-এর 0.1 গুণ এবং output-এর জন্য output rate ব্যবহার করুন। Thinking token-গুলোকে output হিসেবে গণনা করুন। সবশেষে প্রতিদিনের active day-এ turn-এর সংখ্যা এবং মাসে active day-এর সংখ্যা দিয়ে গুণ করুন।
Claude API bill-এ কোন বিষয়টি সবচেয়ে বেশি পরিবর্তন আনে?
সবচেয়ে বেশি প্রভাব ফেলে prompt caching। Sonnet 5-এ 60,000-token-এর একটি turn-এর prefix cache থেকে সরবরাহ করা হলে খরচ প্রায় $0.035। Cache ব্যবহার না হলে একই turn-এর খরচ প্রায় $0.132। এর পরের গুরুত্বপূর্ণ বিষয় হলো model choice। একই turn Opus 4.8-এ চালালে খরচ প্রায় $0.086। তৃতীয় বিষয় session length, কারণ API stateless এবং প্রতিটি turn-এ সম্পূর্ণ conversation billed input হিসেবে আবার পাঠানো হয়।
Claude subscription-এর মধ্যে কি API access অন্তর্ভুক্ত থাকে?
এগুলোকে দুটি account এবং দুটি bill হিসেবে বিবেচনা করুন। Console-এ তৈরি করা account-এর বিপরীতে API call প্রতি token হিসেবে billed হয়। আমি যে documentation দেখেছি, তাতে subscription API credit দেয়—এমন কোনো কথা নেই। এগুলো আলাদা surface হওয়ার সবচেয়ে স্পষ্ট প্রমাণ হলো Claude Code-এর /usage-credits command, যা “API key authentication-এর সঙ্গে available নয়”। অনেক developer দুটিই ব্যবহার করেন: interactive coding-এর জন্য একটি plan এবং নিজেদের তৈরি করা কাজের জন্য একটি key।