Claude API নাকি সাবস্ক্রিপশন কোনটি সাশ্রয়ী?
Claude API এবং সাবস্ক্রিপশনের খরচের তুলনা দেখুন। পার-টোকেন রেট এবং ফিক্সড প্ল্যানের গাণিতিক হিসাব দেখে আপনি নিজেই বুঝতে পারবেন আপনার জন্য কোনটি লাভজনক হবে।
Claude API কি সাবস্ক্রিপশনের চেয়ে সস্তা?
ব্যবহারের পরিমাণ একটি নির্দিষ্ট সীমার নিচে থাকলে Claude API সাবস্ক্রিপশনের চেয়ে সস্তা, আর এর উপরে হলে বেশি দামী। একজন ডেভেলপার যদি সারাদিন ইন্টারঅ্যাক্টিভলি কোডিং করেন, তবে সাধারণত ফিক্সড প্ল্যান বা সাবস্ক্রিপশন সাশ্রয়ী হয়। কিন্তু কোনো প্রোগ্রামের জন্য যদি অটোমেটেড কল করতে হয়, তবে API-ই একমাত্র বিকল্প, তাই সেখানে খরচ মুখ্য বিষয় নয়। বাকিটা হলো সাধারণ গাণিতিক হিসাব যা দশ মিনিটে করা সম্ভব।
এর কোনো অফিসিয়াল ব্রেক-ইভেন (break-even) সংখ্যা নেই। সাবস্ক্রিপশন টোকেন এলাউন্স না দিয়ে ইউজেজ উইন্ডো হিসেবে বিক্রি করা হয়, তাই দুটি লাইনের মিলনস্থল কোথায় তা কোনো প্রকাশিত সংখ্যা দিয়ে বলা সম্ভব নয়। নিচে বর্তমান পার-টোকেন রেট অনুযায়ী একটি ফর্মুলা দেওয়া হলো, সাথে আপনার ব্যবহারের ধরন অনুযায়ী যে বিষয়গুলো খরচ পরিবর্তন করতে পারে সেগুলোও যুক্ত করা হয়েছে। নিচে দেওয়া প্রতিটি ব্রেক-ইভেন সংখ্যা প্রকাশিত রেট এবং আমার নিজস্ব অনুমানের ওপর ভিত্তি করে করা হিসাব, এগুলো কোনো অফিসিয়াল ডকুমেন্ট নয়।
আপনি যদি এখনও সিদ্ধান্ত নিতে না পারেন কোন প্ল্যানটি কিনবেন, তবে কোন Claude প্ল্যানটি আপনার কাজের উপযোগী সেটি দেখে নিন। এই পোস্টটি ধরে নিচ্ছে যে আপনি জানেন আপনি কোন প্ল্যানটি কিনবেন এবং আপনি শুধু জানতে চান সেটি কেনা আদৌ লাভজনক কি না।
দুটি ভিন্ন ধরনের বিলিং মডেল
সাবস্ক্রিপশন হলো একটি ক্যাপাসিটি যা আপনি হয়তো ব্যবহার করবেন না। আপনি একটি নির্দিষ্ট ফি প্রদান করেন এবং একটি নির্দিষ্ট সময় অন্তর রিসেট হওয়া এলাউন্স পান। Anthropic-এর Claude Code ডকুমেন্টেশন অনুযায়ী Team এবং Enterprise সিটের জন্য ব্যবহারের নিয়ম হলো: ব্যবহার "per-seat allowance থেকে নেওয়া হয় যা একটি rolling five-hour window এবং একটি weekly window-তে রিসেট হয়", যা Claude chat এবং Cowork-এর সাথে শেয়ার করা হয়। একজন সাবস্ক্রাইবার মেসেজ লিমিট ছুঁয়ে ফেললে একই পরিস্থিতির সম্মুখীন হন, যেখানে মেসেজ আসে "You've hit your session limit" এবং "You've hit your weekly limit"। যে ক্যাপাসিটি আপনি ব্যবহার করছেন না, তা আসলে আপনার অপচয় করা টাকা। ক্যাপাসিটি শেষ হয়ে গেলে উইন্ডো রিসেট না হওয়া পর্যন্ত আপনার কাজ বন্ধ হয়ে যাবে, এবং /model দিয়ে মডেল পরিবর্তন করলেও অ্যাক্সেস ফিরে পাবেন না, কারণ উইন্ডোগুলো সব মডেলের জন্য শেয়ার করা।
API হলো একটি মিটার যা কখনো থামে না। এখানে কোনো উইন্ডো বা দেয়াল নেই। প্রতিটি রিকোয়েস্ট টোকেন অনুযায়ী চার্জ করা হয়, তবে কিছু বিষয় টোকেন ছাড়াও চার্জ করা হয়: যেমন ওয়েব সার্চ "Claude API-তে প্রতি ১,০০০ সার্চে $১০ হিসেবে পাওয়া যায়"। কোনো লিমিট নেই যা কাজ থামিয়ে দেবে। ইনভয়েস বা বিল কেবল বাড়তে থাকে।
২৩ জুলাই ২০২৬ তারিখ পর্যন্ত Claude pricing পেজ অনুযায়ী প্ল্যান ফি: Pro হলো "$১৭ প্রতি মাস বার্ষিক সাবস্ক্রিপশন ডিসকাউন্টে ($২০০ অগ্রিম বিল করা)। মাসিক বিলিং হলে $২০", এবং এতে Claude Code অন্তর্ভুক্ত। Max এর দাম "থেকে $১০০ প্রতি মাস" হিসেবে তালিকাভুক্ত। Team সিটের দাম বার্ষিক বিলিং হলে "প্রতি সিট/মাস $২০" থেকে শুরু। Enterprise হলো সবচেয়ে ইন্টারেস্টিং, কারণ এখানে দুটি মডেলই একসাথে চলে: "Seat price + usage at API rates $20/seat"। ফি প্রায়ই পরিবর্তিত হয় এবং প্রতিটি প্ল্যানের টোকেন এলাউন্স কখনো প্রকাশ করা হয় না, তাই সিদ্ধান্ত নেওয়ার দিন pricing পেজটি দেখে নিন।
যা আপনি API থেকে পাবেন না
প্ল্যান এলাউন্স এবং এর চারপাশের ইন্টারফেস। Claude Code-এর /usage-credits কমান্ড সাবস্ক্রিপশন ইউজেজ ক্রেডিট ম্যানেজ করে, এবং এটি আপনি "/login এর মাধ্যমে আপনার claude.ai সাবস্ক্রিপশন দিয়ে সাইন-ইন করার পর" চালাতে পারেন; API key দিয়ে অথেন্টিকেশন করলে এই কমান্ডটি পাওয়া যাবে না। /usage স্ক্রিনটিও বিলিং মোড অনুযায়ী আলাদা হয়: এর Session ব্লক "API টোকেন ইউজেজ দেখায় এবং এটি API ইউজারদের জন্য", যেখানে সাবস্ক্রাইবাররা প্ল্যান ইউজেজ বার এবং ইউজেজ ব্রেকডাউন দেখতে পান।
Claude Code-এ দীর্ঘ প্রম্পট ক্যাশে (prompt cache)। এটি সরাসরি টাকা খরচ করে এবং এটি খেয়াল না করা সহজ। ডকুমেন্টেশনে বলা হয়েছে "সাবস্ক্রিপশনে এর লাইফটাইম এক ঘণ্টা, কিন্তু ইউজেজ ক্রেডিট ব্যবহার শুরু করলে তা পাঁচ মিনিটে নেমে আসে; API key বা ক্লাউড প্রোভাইডারের ক্ষেত্রে ডিফল্টভাবে এটি পাঁচ মিনিট"। ক্যাশে লাইফটাইমের চেয়ে বেশি সময়ের ব্যবধানের পর আপনার প্রথম মেসেজটি ক্যাশে থাকবে না, ফলে পুরো কনটেক্সটটি পুনরায় প্রসেস হবে এবং রাইট প্রাইসে বিল করা হবে। সাবস্ক্রিপশনে আপনি ৫০ মিনিটের মিটিং সেরে এসে আবার কাজ শুরু করতে পারেন। কিন্তু API key-তে একই বিরতিতে কাজ করলে পুরো সেশন প্রিফিক্সটি পুনরায় রাইট করতে হবে।
যা আপনি সাবস্ক্রিপশন থেকে পাবেন না
প্রোগ্রাম্যাটিক অ্যাক্সেস। একটি cron job বা webhook handler যা Claude কল করে তার জন্য একটি API key প্রয়োজন, তাই আপনার কাজের ধরন যদি এমন হয় তবে তুলনা করার প্রয়োজন নেই। VPS-এ আপনার প্রথম Claude API অ্যাপ তৈরি করা এখানে কী হ্যান্ডলিং এবং প্রথম স্ক্রিপ্ট সম্পর্কে বিস্তারিত বলা হয়েছে।
Batch API ডিসকাউন্ট। প্রাইসিং পেজে এটি স্পষ্টভাবে বলা আছে: "Batch API ইনপুট এবং আউটপুট উভয় টোকেনের ওপর ৫০% ডিসকাউন্টে বড় ভলিউমের রিকোয়েস্ট অ্যাসিনক্রোনাসলি প্রসেস করতে দেয়।" এটি এমন সব কাজের জন্য খরচ অর্ধেক করে দেয় যেখানে মানুষের তাৎক্ষণিক উত্তরের প্রয়োজন নেই। Opus 4.8-এ প্রতি মিলিয়ন টোকেনে Batch রেট হলো $২.৫০ ইনপুট এবং $১২.৫০ আউটপুট, Sonnet 5-এর জন্য প্রোমোশনাল রেটে $১ এবং $৫, এবং Haiku 4.5-এ $০.৫০ এবং $২.৫০। এর বিনিময়ে আপনাকে ল্যাটেন্সি বা বিলম্ব মেনে নিতে হবে: বেশিরভাগ ব্যাচ এক ঘণ্টার মধ্যে শেষ হয়, কিন্তু কোনো ব্যাচ ২৪ ঘণ্টার মধ্যে শেষ না হলে তা এক্সপায়ার হয়ে যায়, এবং স্ট্রিমিংকে ব্যাচ করা যায় না। Batch এবং prompt caching একসাথে কাজ করে, এবং যেহেতু একটি ব্যাচ পাঁচ মিনিটের বেশি সময় ধরে চলতে পারে, তাই এর ভেতরে ১-ঘণ্টার ক্যাশে ব্যবহার করা যায়।
প্রতি প্রজেক্টের খরচ নির্ধারণ। প্রতিটি API রেসপন্স একটি usage ব্লক রিটার্ন করে, ফলে আপনি একটি সিঙ্গেল রিকোয়েস্টের খরচ লগ করতে পারেন এবং তা কোনো প্রজেক্ট বা কাস্টমারের সাথে যুক্ত করতে পারেন। সাবস্ক্রিপশন কেবল সেই ব্যক্তির জন্য একটি ইউজেজ রিপোর্ট দেয় যার নামে সিটটি আছে।
একটি বিষয় সতর্কতার সাথে মনে রাখা জরুরি: এগুলো দুটি আলাদা বিলিং সিস্টেম। Anthropic-এর ডকুমেন্টেশন অনুযায়ী সাবস্ক্রিপশন বিলিং claude.ai সাপোর্ট এবং Console বিলিং API প্ল্যাটফর্মের অধীনে, এবং /usage-credits একটি API key দিয়ে কাজ করে না। আমি যা চেক করেছি তাতে দেখা গেছে সাবস্ক্রিপশনে কোনো API ক্রেডিট অন্তর্ভুক্ত নেই, তাই দুটি আলাদা অ্যাকাউন্ট এবং দুটি আলাদা বিলের জন্য প্রস্তুত থাকুন।
ব্রেক-ইভেন ফর্মুলা
প্রথমে একটি টার্ন বা বার্নের দাম বের করুন, তারপর সেটিকে স্কেল করুন।
turn cost = uncached_input_tokens x base_input_price
+ cache_write_tokens x 1.25 x base_input_price
+ cache_read_tokens x 0.10 x base_input_price
+ output_tokens x output_price
monthly API cost = turn cost x turns_per_active_day x active_days_per_month
break even when: monthly API cost = flat plan feeমাল্টিপ্লায়ারগুলো প্রকাশিত, অনুমান করা নয়। একটি ৫-মিনিট ক্যাশে রাইট "1.25x base input price" খরচ করে, একটি ১-ঘণ্টার রাইট "2x base input price" খরচ করে, এবং একটি ক্যাশে রিড "0.1x base input price" খরচ করে। থিঙ্কিং টোকেন আউটপুট টোকেন হিসেবে বিল করা হয়, তাই এমনকি যে মডেলগুলোতে reasoning summary দেখায় না, সেখানেও এগুলো output_tokens-এ অন্তর্ভুক্ত হবে।
প্রতি মিলিয়ন টোকেনে (MTok) বেস রেট, ২৩ জুলাই ২০২৬ অনুযায়ী:
claude-fable-5: $১০ ইনপুট, $৫০ আউটপুট। ক্যাশে রিড $১। ৫-মিনিট ক্যাশে রাইট $১২.৫০। ১M কনটেক্সট।claude-opus-4-8এবংclaude-opus-4-7: $৫ ইনপুট, $২৫ আউটপুট। ক্যাশে রিড $০.৫০। ৫-মিনিট ক্যাশে রাইট $৬.২৫। ১M কনটেক্সট।claude-sonnet-5: ৩১ আগস্ট ২০২৬ পর্যন্ত প্রোমোশনাল রেটে $২ ইনপুট, $১০ আউটপুট, এরপর $৩ এবং $১৫। প্রোমোশনাল রেটে ক্যাশে রিড $০.২০ এবং ৫-মিনিট ক্যাশে রাইট $২.৫০। ১M কনটেক্সট।claude-haiku-4-5: $১ ইনপুট, $৫ আউটপুট। ক্যাশে রিড $০.১০। ৫-মিনিট ক্যাশে রাইট $১.২৫। ২০০K কনটেক্সট।
লং কনটেক্সটের জন্য কোনো অতিরিক্ত চার্জ নেই: "একটি 900k-টোকেন রিকোয়েস্টের জন্য একই পার-টোকেন রেট চার্জ করা হয় যা একটি 9k-টোকেন রিকোয়েস্টের জন্য হয়।"
একটি বাস্তব উদাহরণ, অনুমানের ভিত্তিতে
Sonnet 5 ব্যবহার করে একটি মিড-সেশন Claude Code টার্ন কল্পনা করুন যেখানে ৬০,০০০ টোকেন কনটেক্সট আছে: ৫৫,০০০ টোকেন ক্যাশ থেকে আসছে, ৩,০০০ টোকেন নতুন ক্যাশে রাইট হচ্ছে, ২,০০০ টোকেন নতুন আনক্যাশেড ইনপুট, এবং ১,২০০ টোকেন আউটপুট (থিংকিং সহ)।
- ক্যাশে রিড: ৫৫,০০০ x $০.২০/MTok = $০.০১১০
- ক্যাশে রাইট: ৩,০০০ x $২.৫০/MTok = $০.০০৭৫
- আনক্যাশেড ইনপুট: ২,০০০ x $২.০০/MTok = $০.০০৪০
- আউটপুট: ১,২০০ x $১০.০০/MTok = $০.০১২০
এর মানে হলো প্রতি টার্নে খরচ প্রায় $০.০৩৫। একটি সক্রিয় দিনে ১২০টি টার্ন হলে দিনে প্রায় $৪.১৪। মাসে ২০ দিন কাজ করলে মাসে প্রায় $৮৩।
এটিকে উপরের ফিক্সড ফি-র সাথে তুলনা করলে দুটি বিষয় বোঝা যায়। এটি Pro ফি-র প্রায় চার গুণ, তাই কাগজে-কলমে Pro সস্তা, যদি এর এলাউন্স প্রতিদিন ১২০টি Sonnet টার্ন সামলাতে পারে। এই শর্তটি কোনো প্রকাশিত সংখ্যা দিয়ে নিশ্চিত করা সম্ভব নয়। অন্যদিকে এই $৮৩ ডলার Max প্ল্যানের শুরুর ফি-র চেয়ে কম, তাই এখানে API বেশি সাশ্রয়ী।
এখন একটি করে অনুমান পরিবর্তন করে দেখুন কীভাবে প্ল্যান ফি আর সিদ্ধান্ত নেওয়ার প্রধান বিষয় থাকে না।
তিনটি বিষয় যা ব্রেক-ইভেনকে প্ল্যান প্রাইসের চেয়ে বেশি প্রভাবিত করে
প্রম্পট ক্যাশিং (Prompt caching)। ক্যাশিং ছাড়া একই ৬০,০০০-টোকেন টার্ন চালালে পুরো প্রম্পটটি নতুন ইনপুট হিসেবে বিল করা হবে: ৬০,০০০ x $২.০০/MTok = $০.১২, সাথে $০.০১২ আউটপুট, অর্থাৎ প্রতি টার্নে $০.১৩২। এটি ক্যাশেড টার্নের প্রায় চার গুণ এবং এতে মাসিক খরচ $৮৩ থেকে বেড়ে প্রায় $৩১৭ হয়ে যাবে। এটিই একমাত্র ব্রেক-ইভেন যা Anthropic প্রকাশ করেছে, কারণ এটি আপনার কাজের পরিমাণের ওপর নির্ভর করে না: "একটি ক্যাশে হিট স্ট্যান্ডার্ড ইনপুট প্রাইসের ১০% খরচ করে, যার মানে হলো ৫-মিনিটের জন্য মাত্র একটি ক্যাশে রিড (1.25x write) অথবা ১-ঘণ্টার জন্য দুটি ক্যাশে রিড (2x write) করলেই ক্যাশিং লাভজনক হয়ে যায়।"
দুটি কারণে ক্যাশিং নিজে থেকেই বন্ধ হয়ে যেতে পারে। প্রথমটি হলো মডেলের মিনিমাম ক্যাশেবল দৈর্ঘ্য অপেক্ষা ছোট প্রিফিক্স: Fable 5-এর জন্য ৫১২ টোকেন, Opus 4.8 এবং Sonnet 5-এর জন্য ১,০২৪ টোকেন, Opus 4.7-এর জন্য ২,০৪৮ টোকেন, এবং Haiku 4.5-এর জন্য ৪,০৯৬ টোকেন। ছোট প্রিফিক্স ক্যাশ হয় না এবং কোনো এরর মেসেজও আসে না। দ্বিতীয়টি হলো প্যারালাল রিকোয়েস্ট, কারণ "একটি ক্যাশে এন্ট্রি কেবল প্রথম রেসপন্স শুরু হওয়ার পর উপলব্ধ হয়।" একসাথে পাঠানো দশটি একই রিকোয়েস্টের জন্য পূর্ণ ইনপুট প্রাইস দিতে হবে। এই উভয় ক্ষেত্রেই cache_read_input_tokens শূন্য দেখাবে।
মডেল নির্বাচন। একই টার্ন Opus 4.8-এ চালান, যেখানে ইনপুট $৫, আউটপুট $২৫, ক্যাশে রিড $০.৫০ এবং ৫-মিনিট রাইট $৬.২৫ প্রতি MTok: রিড $০.০২৭৫, রাইট $০.০১৮৮, আনক্যাশেড ইনপুট $০.০১০, আউটপুট $০.০৩০। এর মানে প্রতি টার্নে খরচ প্রায় $০.০৮৬, যা Sonnet টার্নের ২.৫ গুণ এবং একই ভলিউমে মাসে প্রায় $২০৭। একটি মডেল পরিবর্তনের মাধ্যমেই কাজটির খরচ Max ফি-র নিচে থেকে দ্বিগুণ ছাড়িয়ে গেল। অন্যদিকে Haiku 4.5 ($১ ইনপুট, $৫ আউটপুট) লগ ট্রায়েজ করার মতো মেকানিক্যাল কাজের জন্য খরচ কমিয়ে দেয়।
কাজের ধরন মডেল নির্বাচনের ওপর নির্ভর করে, কারণ থিঙ্কিং টোকেন আউটপুট রেটে বিল করা হয়। Opus 4.8-এ API ডিফল্ট হলো high, এবং কোডিং বা এজেন্টিক কাজের জন্য ডকুমেন্টেশনে উল্লিখিত শুরুর পয়েন্ট হলো দামী xhigh। Claude Code-এ /effort দিয়ে বা API-তে output_config.effort দিয়ে এটি কমানো যায়। আরও একটি বিষয় পুরনো অনুমান বদলে দেয়: নতুন মডেলগুলো নতুন টোকারনাইজার ব্যবহার করে যা "একই টেক্সটের জন্য প্রায় ৩০% বেশি টোকেন তৈরি করে", তাই পুরনো মডেলের টোকেন গণনা বর্তমান টেক্সটের প্রকৃত খরচের চেয়ে কম দেখাবে।
সেশন হাইজিন (Session hygiene)। API হলো স্টেটলেস (stateless), তাই প্রতিটি টার্নে পুরো কথোপকথনটি ইনপুট হিসেবে পুনরায় পাঠানো হয়। ফলে একটি দীর্ঘ সেশনের প্রতিটি মেসেজের খরচ নতুন সেশনের চেয়ে বেশি হয়। এটিই মূলত অপ্রত্যাশিত বিলের প্রধান কারণ, যা Claude Code সেশনে আসলে কী টোকেন খরচ করে বিস্তারিতভাবে আলোচনা করা হয়েছে। সম্পর্কহীন কাজের মাঝে /clear ব্যবহার করুন, কারণ পুরনো কনটেক্সট প্রতিটি মেসেজের সাথে পুনরায় পাঠানো এবং বিল করা হয়। একটি দীর্ঘ কাজের মাঝে /compact ব্যবহার করুন, যাতে পুরো হিস্ট্রি বহন না করে সারসংক্ষেপ হিসেবে পাঠানো হয়। একটানা কাজ করার চেষ্টা করুন, কারণ ডিফল্ট ক্যাশে "৫ মিনিটের লাইফটাইম রাখে" এবং "প্রতিবার ক্যাশেড কন্টেন্ট ব্যবহার করার সময় কোনো অতিরিক্ত খরচ ছাড়াই রিফ্রেশ হয়"। প্রতি দশ মিনিট অন্তর ব্যবহৃত সেশনে প্রতিবার রাইট চার্জ দিতে হবে। একটি বিচ্ছিন্ন VPS-এ tmux-এ চলা Claude Code সেশন যখন অব্যবহৃত থাকে তখন খরচ প্রায় শূন্য, কিন্তু ক্যাশে লাইফটাইম পার হয়ে গেলে প্রিফিক্সটি হারিয়ে যায়।
সিদ্ধান্ত নেওয়ার আগে নিজের ব্যবহার পরিমাপ করুন
আমার উদাহরণ দেখে সিদ্ধান্ত নেবেন না। নিজের এক সপ্তাহের ব্যবহার দেখে সিদ্ধান্ত নিন।
Claude Code-এ এক সপ্তাহ ধরে প্রতিটি সেশনের শেষে /usage চালান (/cost হলো একই স্ক্রিনের একটি এলিয়াস)। এটি সেশনের টোকেন সংখ্যা এবং খরচের একটি আনুমানিক হিসাব দেবে, তবে ডকুমেন্টেশনে একটি সতর্কতা দেওয়া আছে: "ডলারের পরিমাণটি টোকেন সংখ্যার ওপর ভিত্তি করে লোকালি গণনা করা একটি অনুমান এবং এটি আপনার প্রকৃত বিলের চেয়ে আলাদা হতে পারে।" /clear চালালে টোটাল রিসেট হয়, তাই আগে স্ক্রিনটি দেখে নিন। সাবস্ক্রিপশনে এই ডলারের পরিমাণ আপনার বিল নয়, কিন্তু এর পেছনের টোকেন সংখ্যাগুলোই এই ফর্মুলার জন্য প্রয়োজন। /context দেখাবে স্ক্রিনে কী কী তথ্য আসছে।
API অ্যাকাউন্টের ক্ষেত্রে Claude Console-এর ইউজেজ পেজ হলো চূড়ান্ত রেকর্ড। কোনো প্রম্পট পাঠানোর আগে তার দাম জানতে client.messages.count_tokens() ব্যবহার করা যায়, যা "ব্যবহারের ধরন অনুযায়ী মিনিটে রিকোয়েস্ট লিমিট মেনে ফ্রি", এবং এটিই একমাত্র গণনা যা আপনার প্রকৃত বিলিং টোকেনাইজার ব্যবহার করে।
একটি কল শেষ হওয়ার পর ইউজেজ ব্লকটি দেখুন এবং সঠিকভাবে পড়ুন:
u = response.usage
total_input = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokensinput_tokens কেবল আনক্যাশেড অংশ গণনা করে, যা "last cache breakpoint-এর পরের টোকেন" হিসেবে পরিচিত। যদি কোনো টার্ন input_tokens: 4000 দেখায়, তার মানে সেটি ৪,০০০ টোকেনের টার্ন নয়; বরং তিনটি ফিল্ড যোগ করলে প্রম্পট সাইজ পাওয়া যাবে যা এই ফর্মুলার জন্য প্রয়োজন।
এরপর তুলনা করুন। যদি আপনার পরিমাপ করা মাসিক খরচ প্ল্যান ফি-র চেয়ে অনেক কম হয়, তবে API ব্যবহার করুন। যদি এটি অনেক বেশি হয়, তবে সাবস্ক্রিপশন নিন, যদি এর এলাউন্স আপনার স্বাভাবিক কাজের দিনের জন্য যথেষ্ট হয়। যদি এটি ব্রেক-ইভেন লাইনের কাছাকাছি থাকে, তবে সাবস্ক্রিপশন নিন, কারণ সাবস্ক্রিপশন আপনাকে অবাক করবে না কিন্তু API আপনাকে অবাক করতে পারে।
FAQ
Claude API কি Claude Pro বা Max-এর চেয়ে সস্তা?
এটি ব্যবহারের পরিমাণের ওপর নির্ভর করে। এর কোনো প্রকাশিত ব্রেক-ইভেন নেই, কারণ সাবস্ক্রিপশন টোকেন এলাউন্স না দিয়ে ইউজেজ উইন্ডো হিসেবে বিক্রি করা হয়। প্রকাশিত পার-টোকেন রেট দিয়ে একটি সাধারণ টার্নের দাম বের করুন, সেটিকে আপনার প্রতিদিনের টার্ন এবং মাসে কাজের দিন দিয়ে গুণ করুন, তারপর সেই হিসাবটি প্ল্যান ফি-র সাথে তুলনা করুন। একটি উদাহরণে, ৬০,০০০ টোকেনের Sonnet 5 টার্নের খরচ প্রায় $০.০৩৫, যা মাসে ২০ দিন এবং দিনে ১২০টি টার্ন হলে প্রায় $৮৩; যা Pro ফি-র চেয়ে বেশি কিন্তু Max ফি-র চেয়ে কম।
আমি কীভাবে প্রতি মাসে আমার Claude API খরচ বের করব?
প্রকৃত টোকেন সংখ্যা সংগ্রহ করতে এক সপ্তাহ ধরে Claude Code-এ /usage চালান, অথবা আপনার যদি API অ্যাকাউন্ট থাকে তবে Claude Console-এর ইউজেজ পেজ দেখুন। এরপর একটি টার্নের দাম বের করুন: বেস রেটে আনক্যাশেড ইনপুট, বেস ইনপুটের ১.২৫ গুণ ক্যাশে রাইট, বেস ইনপুটের ০.১ গুণ ক্যাশে রিড, এবং আউটপুট রেটে আউটপুট (থিংকিং টোকেন আউটপুট হিসেবে গণ্য করে)। একে প্রতিদিনের টার্ন এবং মাসে কাজের দিন দিয়ে গুণ করুন।
Claude API বিলের ওপর সবচেয়ে বেশি প্রভাব ফেলে কোনটি?
সবকিছুর চেয়ে প্রম্পট ক্যাশিং। ক্যাশে থেকে প্রিফিক্স ব্যবহার করলে ৬০,০০০ টোকেনের একটি Sonnet 5 টার্নের খরচ প্রায় $০.০৩৫, কিন্তু ক্যাশে না থাকলে তা প্রায় $০.১৩২। এর পরে আসে মডেল নির্বাচন: একই টার্ন Opus 4.8-এ প্রায় $০.০৮৬ খরচ করে। তৃতীয়টি হলো সেশনের দৈর্ঘ্য, কারণ API স্টেটলেস এবং প্রতিটি টার্নে পুরো কথোপকথনটি ইনপুট হিসেবে পুনরায় পাঠানো হয়।
Claude সাবস্ক্রিপশনে কি API অ্যাক্সেস অন্তর্ভুক্ত থাকে?
এগুলোকে দুটি আলাদা অ্যাকাউন্ট এবং দুটি আলাদা বিল হিসেবে বিবেচনা করুন। API কলগুলো Console-তে তৈরি করা অ্যাকাউন্টের বিপরীতে টোকেন অনুযায়ী বিল করা হয়, এবং আমি চেক করা কোনো ডকুমেন্টেশনে বলা নেই যে সাবস্ক্রিপশন কোনো API ক্রেডিট দেয়। এদের আলাদা হওয়ার সবচেয়ে বড় প্রমাণ হলো Claude Code-এর /usage-credits কমান্ড, যা "API key দিয়ে অথেন্টিকেশন করলে পাওয়া যায় না"। অনেক ডেভেলপার উভয়ই ব্যবহার করেন: ইন্টারঅ্যাক্টিভ কোডিংয়ের জন্য একটি প্ল্যান এবং তাদের তৈরি করা অ্যাপ্লিকেশনের জন্য একটি API key।