Claude API-তে কি ফ্রি টিয়ার আছে? খরচ ও ক্রেডিট
Claude API-তে কোনো ফ্রি টিয়ার নেই, তবে signup-এ অপ্রকাশিত অল্প credit মেলে। July 2026-এর rates, বিনামূল্যের অংশ এবং প্রথম ছোট app-এর বাস্তব খরচ জানুন।
Claude API-তে কি ফ্রি টিয়ার আছে?
Claude API-তে কোনো ফ্রি টিয়ার নেই। প্রতি মাসে বিনামূল্যে ব্যবহারের জন্য নির্দিষ্ট কোনো টোকেন বরাদ্দ নেই এবং $0 মূল্যের কোনো প্ল্যানে থাকা যায় না। নতুন অ্যাকাউন্টে API পরীক্ষা করার জন্য অল্প পরিমাণ ফ্রি ক্রেডিট পাওয়া যায়, তবে Anthropic এই পরিমাণ প্রকাশ করে না। ওই ক্রেডিট শেষ হয়ে গেলে প্রতিটি অনুরোধ আপনার পরিশোধ করা ব্যালান্স থেকে অর্থ ব্যবহার করে।
এটাই সরাসরি উত্তর। এই গাইডের বাকি অংশে এর পরিণতিগুলো ব্যাখ্যা করা হয়েছে: প্ল্যাটফর্মের কোন অংশগুলো সম্পূর্ণ বিনামূল্যে, Claude অ্যাপগুলোর ফ্রি প্ল্যানের সঙ্গে এটি কেন আলাদা বিষয়, এবং প্রথম প্রোগ্রামটি চালু করার সবচেয়ে কম খরচের বাস্তবসম্মত উপায়।
Claude API অ্যাকাউন্টে কী কী বিনামূল্যে
প্ল্যাটফর্মের কয়েকটি সুবিধার জন্য টোকেন চার্জ লাগে না। এগুলো দেখতে যতটা গুরুত্বপূর্ণ মনে হয়, তার চেয়ে বেশি গুরুত্বপূর্ণ।
- টোকেন গণনা। টোকেন গণনার endpoint বিনামূল্যে ব্যবহার করা যায়। এর requests-per-minute সীমা message creation থেকে আলাদা। তাই prompt মাপলে সেটি পাঠানোর বাজেট থেকে খরচ হয় না।
- Console নিজেই। একটি organization তৈরি করা, usage page পড়া এবং Workbench খোলা—সবই বিনামূল্যে। Workbench-এ prompt চালানো একটি সাধারণ API request। তাই অন্য যেকোনো call-এর মতো এই অংশে টোকেনের জন্য বিল হয়।
- File operations। Files API-এর মাধ্যমে file upload, তালিকাভুক্ত করা এবং delete করা বিনামূল্যে। কোনো file-এর content request-এ input tokens হিসেবে গেলে কেবল তখনই অর্থ প্রদান করতে হয়।
- Web fetch। web fetch tool কথোপকথনে আনা content-এর token ছাড়া অতিরিক্ত কোনো চার্জ যোগ করে না। Web search বিনামূল্যে নয়: July 2026 অনুযায়ী প্রতি 1,000টি search-এর জন্য $10।
- Code execution, একটি সীমা পর্যন্ত। July 2026 অনুযায়ী প্রতিটি organization প্রতি মাসে 1,550টি বিনামূল্যের container hour পায়। এরপর প্রতি container-এর জন্য প্রতি hour-এ $0.05 চার্জ হয়। Web search বা web fetch-এর সঙ্গে চললে Code execution-এর জন্য অতিরিক্ত অর্থ লাগে না।
এর কোনোটিই free tier নয়। এর অর্থ হলো metering সঠিকভাবে করা হয়: inference-এর জন্য বিল হয়, এর চারপাশের plumbing-এর জন্য নয়।
অর্থ পরিশোধের আগে prompt-এর মূল্য নির্ধারণ করুন
গণনা বিনামূল্যে হওয়ায়, আপনি আগে একটি অনুরোধের সঠিক আকার জানতে পারেন। SDK-গুলি এই একই endpoint ব্যবহার করে, এবং এতে প্রকৃত message-এর মতো একই body লাগে।
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-haiku-4-5",
"system": "You are a scientist",
"messages": [{"role": "user", "content": "Hello, Claude"}]
}'স্বাভাবিক response হলো JSON-এর একটি লাইন: {"input_tokens": 14}। এটিকে আপনার model-এর input rate দিয়ে গুণ করলে, অনুরোধ পাঠানোর আগেই এর খরচ জানতে পারবেন। authentication_error-সহ HTTP 401 পেলে key-টি ভুল বা বাতিল করা হয়েছে। কোনো credit অবশিষ্ট না থাকা account-এও গণনা কাজ করে, কারণ এতে কিছু generate করা হয় না।
এটি অ্যাপের ফ্রি প্ল্যানের থেকে ভিন্ন প্রশ্ন কেন
মানুষ উভয় বিষয় নিয়েই খোঁজ করে, কিন্তু এ দুটির মধ্যে প্রায় কোনো সম্পর্ক নেই। Claude apps-এর ফ্রি প্ল্যান একটি বাস্তব product। কোনো card ছাড়াই এটি দীর্ঘ সময় ব্যবহার করা যায়। এটি চলমান usage window অনুযায়ী usage মাপে। Claude-এর ফ্রি tier-এ আসলে কী অন্তর্ভুক্ত অংশে এতে কী সুবিধা থাকে এবং কখন usage reset হয়, তা ব্যাখ্যা করা হয়েছে। API হলো prepaid metering ব্যবস্থা। এর পেছনে এমন কোনো plan নেই।
যে বিষয়টি অনেককে বিভ্রান্ত করে, তা হলো subscription এবং API key আলাদা wallet। Pro-এর জন্য অর্থ প্রদান করলে কোনো key-তে অর্থ যোগ হয় না। API credits আপনার chat allowance বাড়ায় না। আপনি যদি একেবারে অর্থ প্রদান এড়ানোর চেষ্টা না করে দুটির মধ্যে বেছে নেন, তাহলে বাস্তব workload অনুযায়ী Claude API-এর খরচ বনাম subscription অংশে প্রকৃত workload-এর হিসাব দেখানো হয়েছে।
ক্রেডিট শেষ হলে একটি অনুরোধের খরচ
জুলাই 2026 অনুযায়ী, প্রতি 1 মিলিয়ন টোকেনের জন্য এগুলো প্রথম পক্ষের API-এর হার।
The data behind this chart
[
{
"label": "Haiku 4.5",
"input_usd": 1,
"output_usd": 5
},
{
"label": "Sonnet 5, intro rate",
"input_usd": 2,
"output_usd": 10
},
{
"label": "Opus 5",
"input_usd": 5,
"output_usd": 25
}
]Haiku 4.5 প্রতি 1 মিলিয়ন ইনপুট টোকেনের জন্য 1 ডলার এবং প্রতি 1 মিলিয়ন আউটপুট টোকেনের জন্য 5 ডলার বিল করে। Opus 5 একই পরিমাণের জন্য 5 এবং 25 বিল করে। তাই prompt tuning করার আগেই আপনার নির্বাচিত model বিলের পরিমাণ 5x পরিবর্তন করতে পারে। Sonnet 5-এর হারটি একটি প্রারম্ভিক হার, যা 31 August 2026 পর্যন্ত কার্যকর থাকবে। এরপর এটি $3 এবং $15-এ ফিরে যাবে। প্রতিটি model-এর ক্ষেত্রেই output-এর খরচ input-এর চেয়ে পাঁচ গুণ বেশি। এই পৃষ্ঠার সবচেয়ে কার্যকর তথ্য এটিই: দীর্ঘ প্রশ্নের চেয়ে বেশি কথাবার্তাপূর্ণ উত্তরের খরচ বেশি। আপনার কোন Claude model ব্যবহার করা উচিত একটি উদাহরণভিত্তিক কাজের মাধ্যমে এগুলোর তুলনা করে।
পরীক্ষার জন্য সবচেয়ে সাশ্রয়ী বাস্তব পদ্ধতিগুলো
চারটি কৌশল প্রায় সব কাজ করে দেয়, এবং এগুলোর কোনোটির জন্য ছাড়ের প্রয়োজন নেই।
- আপনার পরীক্ষায় উত্তীর্ণ হওয়া সবচেয়ে ছোট মডেল দিয়ে শুরু করুন। শ্রেণিবিন্যাস, তথ্য নিষ্কাশন, ট্যাগিং এবং রাউটিংয়ের জন্য সাধারণত frontier model প্রয়োজন হয় না। Haiku 4.5-এর দাম Opus 5-এর এক-পঞ্চমাংশ, এবং এটি দ্রুত উত্তর দেয়।
max_tokens-এর সীমা নির্ধারণ করুন। এটি তৈরি হওয়া token-এর কঠোর সর্বোচ্চ সীমা, এবং output-ই বেশি ব্যয়বহুল অংশ। এক শব্দে উত্তর দেওয়া classifier-এর জন্য 16,000-token-এর budget রাখা উচিত নয়।- যে prompt-এর অংশ কখনও পরিবর্তিত হয় না, সেটি cache করুন। Cache read-এর খরচ base input price-এর 10%, আর পাঁচ মিনিটের cache write-এর খরচ 1.25x। তাই একবার read হওয়ার পরই caching-এর খরচ উঠে আসে। Caching একটি prefix match। অর্থাৎ স্থির text আগে এবং পরিবর্তনশীল question শেষে রাখতে হবে। তা না হলে কিছুই match করবে না, এবং কোনো লাভ ছাড়াই write premium দিতে হবে।
- যা interactive নয়, তা batch করুন। Message Batches API input এবং output উভয়ের ক্ষেত্রেই 50% ছাড় দেয়, এবং অধিকাংশ batch এক ঘণ্টার মধ্যে শেষ হয়। Nightly job, backfill এবং evaluation run-এর জন্য এটি ব্যবহার করুন।
একটি প্রথম ছোট অ্যাপের খরচের উদাহরণ
একটি log-summary script বিবেচনা করুন: 1,000টি call, প্রতিটিতে প্রায় 800টি input token-এর log line পাঠানো হয় এবং প্রায় 200টি token-এর summary ফেরত পাওয়া যায়। Haiku 4.5-এ এটি 800,000টি input token এবং 200,000টি output token।
The data behind this chart
[
{
"label": "Standard rates",
"cost_usd": "1.80"
},
{
"label": "Same job on the Batch API",
"cost_usd": "0.90"
}
]হিসাবটি হলো: 0.8 million input token-এর জন্য $1 এবং 0.2 million output token-এর জন্য $5। মোট খরচ 1.80 dollar। পরিবর্তে batch হিসেবে পাঠালে একই কাজের খরচ 0.90। এই পরিমাণ testing-এর জন্য starter credit balance দিয়ে অনেক কাজ করা যায়। এ কারণেই free tier না থাকার সমস্যা মানুষ যতটা আশা করে, তার চেয়ে অনেক পরে গুরুতর হয়। আপনার মালিকানাধীন server-এ সম্পূর্ণ নির্দেশিকার জন্য VPS-এ প্রথম Claude API app তৈরি করা-তে key ব্যবস্থাপনা, streaming এবং error path ব্যাখ্যা করা হয়েছে।
ব্যবহারের স্তরগুলো অনুমোদিত খরচ নয়, সর্বোচ্চ সীমা
API ব্যবহারের ইতিহাস এবং অ্যাকাউন্টের অবস্থার ভিত্তিতে প্রতিটি প্রতিষ্ঠানকে স্বয়ংক্রিয়ভাবে একটি ব্যবহারের স্তরে রাখে। স্তরগুলোর নাম Start, Build, Scale এবং Custom। প্রতিটি স্তরে rate limit এবং মাসিক খরচের সর্বোচ্চ সীমা নির্ধারিত থাকে। July 2026 অনুযায়ী, Start-এর সীমা $500, Build-এর $1,000 এবং Scale-এর $200,000; Custom-এর কোনো সীমা নেই।
এটিকে অনুমোদিত খরচ নয়, সীমা হিসেবে বুঝুন। Start স্তরে থাকা মানে আপনার খরচ করার জন্য $500 বরাদ্দ আছে—এমন নয়। এর মানে হলো, কোনো calendar month-এ আপনি $500-এর বেশি খরচ করতে পারবেন না; সীমায় পৌঁছালে পরের month পর্যন্ত ব্যবহার স্থগিত থাকবে। Tier cap-এর চেয়ে কম নিজস্ব খরচের সীমাও নির্ধারণ করতে পারেন। কোনো card-এর সঙ্গে যুক্ত অ্যাকাউন্টে প্রথমেই এটি করা উচিত, কারণ per-token price-এর তুলনায় নিয়ন্ত্রণহীন loop-এর কারণে অর্থ হারানোর সম্ভাবনা অনেক বেশি।
বিনামূল্যে ব্যবহার বাধ্যতামূলক হলে কী করবেন
বাজেট সত্যিই শূন্য হলে এবং সেটি শূন্যই রাখতে হলে, API সঠিক উপায় নয়। Tier পরিবর্তন করলেও এই সমস্যার সমাধান হবে না। দুটি বাস্তবসম্মত বিকল্প থাকে। ইন্টার্যাক্টিভ কাজের জন্য Claude apps-এর free plan ব্যবহার করুন। এতে window অনুযায়ী ব্যবহারের সীমা মেনে নিতে হবে এবং কোনো programmable endpoint পাবেন না। অথবা আপনার ভাড়া নেওয়া hardware-এ open-weights model চালান। এতে প্রতি-token খরচের বদলে আপনি নিয়ন্ত্রণ করতে পারেন এমন server খরচ হবে: VPS-এ Ollama চালিয়ে নিজে LLM host করা নির্দেশিকায় প্রতিটি model size-এর প্রয়োজনীয় memory এবং ছোট model-গুলো বাস্তবে কী করতে পারে তা ব্যাখ্যা করা হয়েছে।
এর মাঝামাঝি যেকোনো ব্যবহারের জন্য বাস্তবসম্মত সমাধান হলো একটি funded key, কম spend limit, একটি ছোট model এবং প্রথম দিন থেকেই prompt caching চালু রাখা।
FAQ
Claude API কি বিনামূল্যে ব্যবহার করা যায়?
না। কোনো free tier নেই এবং প্রতি মাসে বিনামূল্যে ব্যবহারের জন্য কোনো token allowance নেই। নতুন account-এ API পরীক্ষা করার জন্য অল্প পরিমাণ free credit দেওয়া হয়। এরপর প্রতিটি request prepaid credit অথবা account-এ সংরক্ষিত card থেকে খরচ হয়। Platform-এর কিছু অংশের জন্য কোনো খরচ নেই। এর মধ্যে token counting, file upload ও deletion, এবং fetch করা কনটেন্টের token-এর খরচ ছাড়া web fetch tool অন্তর্ভুক্ত।
Claude API-তে sign up করলে কি free credit পাব?
হ্যাঁ, অল্প পরিমাণ free credit পাওয়া যায়। Anthropic এই পরিমাণ প্রকাশ করে না। এটিকে আপনার integration কাজ করছে কি না তা যাচাই করার জন্য যথেষ্ট হিসেবে বিবেচনা করুন, ভবিষ্যৎ কাজের বাজেট হিসেবে নয়। Enterprise evaluation-এর জন্য অতিরিক্ত trial credit Anthropic sales-এর মাধ্যমে ব্যবস্থা করতে হয়। এটি স্বয়ংক্রিয়ভাবে দেওয়া হয় না।
Claude Pro বা Max-এর জন্য অর্থ প্রদান করলে কি API access অন্তর্ভুক্ত থাকে?
না। Subscription এবং API key আলাদাভাবে bill করা হয় এবং এগুলোর usage measurement পদ্ধতিও আলাদা। Pro এবং Max Claude apps-এর ভেতরে আপনার allowance বাড়ায়। API key prepaid credit ব্যবহার করে এবং প্রতি মিনিটে request ও token—উভয় দিক থেকেই সীমাবদ্ধ থাকে। উভয়টি প্রয়োজন হলে উভয়ের জন্য অর্থ প্রদান করতে হবে।
Claude API পরীক্ষা করার সবচেয়ে সাশ্রয়ী উপায় কী?
প্রথমে token count করুন, কারণ ওই endpoint বিনামূল্যে। এরপর Haiku 4.5-এ সীমিত max_tokens দিয়ে test চালান। পুনরাবৃত্ত request-এ input price-এর 10% খরচে পড়ার জন্য অপরিবর্তিত system prompt cache করুন। Interactive নয় এমন কাজ Batch API-এর মাধ্যমে পাঠান, যেখানে খরচ অর্ধেক। এই settings-এ 2026 সালের July অনুযায়ী এক হাজার ছোট call-এর খরচ এক dollar-এর সামান্য বেশি।