Claude limit reached হলে কী করবেন
“Claude limit reached” দেখলে আগে বুঝুন session না weekly window-এ অপেক্ষা করছেন। তারপর ছোট model, ছোট context, usage credits বা API বেছে নিয়ে কাজ চালান।
কোন Claude limit-এ পৌঁছেছেন
Claude limit reached বার্তায় আপনি কোন window-এর জন্য অপেক্ষা করছেন তা উল্লেখ থাকে। পরবর্তী সময়ে আপনি কী করতে পারবেন, সেই window-ই তা নির্ধারণ করে। Session এবং weekly limit একই সময়ে সব model-এর ক্ষেত্রে প্রযোজ্য, তাই model পরিবর্তন করলে আপনার access ফিরে আসে না। কোনো limit-এ একটি নির্দিষ্ট model-এর নাম থাকলে সেটিই ব্যতিক্রম: model পরিবর্তন করে কাজ চালিয়ে যেতে পারবেন, আর ওই একটি model blocked থাকবে।
Claude Code একই লাইনে window এবং reset time দেখায়:
You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pmSession window পাঁচ ঘণ্টার rolling window। Weekly window প্রতি সপ্তাহে আপনার account-এর জন্য নির্ধারিত একটি নির্দিষ্ট সময়ে reset হয়। তাই এক সপ্তাহ থেকে পরের সপ্তাহে দিন এবং সময় একই থাকে। Pro plan-এ পাঁচ ঘণ্টার session window-এর পাশাপাশি সব model-এর ক্ষেত্রে প্রযোজ্য একটি weekly limit থাকে। Max plan-এ আরও একটি weekly limit থাকে, যা আলাদাভাবে একটি model family-এর ক্ষেত্রে প্রযোজ্য। Limit-এর সুনির্দিষ্ট ceiling Claude usage limit-এর পূর্ণ বিবরণে দেওয়া আছে। এই পৃষ্ঠায় সেই বিবরণের পরের বিষয় থেকে শুরু করা হয়েছে।
এখানেই অনেকে সমস্যায় পড়েন। প্রতিটি request একই সময়ে session window এবং weekly window—দুটির বিরুদ্ধেই গণনা হয়। তাই একটি ব্যস্ত বিকেলেই weekly allowance শেষ হয়ে যেতে পারে, যদিও পাঁচ ঘণ্টার window-এ তখনও কিছু capacity অবশিষ্ট থাকে। দিনের বাকি পরিকল্পনা করার আগে reset time দেখুন। 3:45pm-এ reset হলে সেটি একটি coffee break-এর মতো। Monday-এ midnight-এ reset হলে তা নয়।
অনুমান করার আগে ব্যবহার দেখুন
claude.ai-এ Settings খুলে Usage নির্বাচন করুন। Progress bar-এ পাঁচ ঘণ্টার session window এবং প্রতিটি weekly window-এর কতটা ব্যবহার করেছেন তা দেখা যায়। তাই অনুমান না করে কোনটি প্রায় শেষ হয়ে এসেছে তা বোঝা যায়।
Claude Code-এ /usage চালান। এতে একই plan bar-এর পাশাপাশি সাম্প্রতিক ব্যবহার skills, subagents, plugins এবং পৃথক MCP (model context protocol) server-এ কতটা হয়েছে, তার breakdown মোট ব্যবহারের percentage হিসেবে দেখা যায়। গত 24 ঘণ্টার তথ্য দেখতে d এবং গত 7 দিনের তথ্য দেখতে w চাপুন। সাম্প্রতিক ব্যবহারের 10% বা তার বেশি তৈরি করা pattern-ও এটি চিহ্নিত করে। সাধারণত সবচেয়ে বেশি দেখা যায় long context এবং cache miss।
এখানে দুটি বিষয় মনে রাখুন। এই breakdown ওই machine-এ সংরক্ষিত session history থেকে তৈরি হয়। তাই অন্য laptop-এ বা claude.ai-এ করা কাজ এতে দেখা যাবে না। এছাড়া উপরের Session block-এ থাকা dollar figure API (application programming interface) user-দের জন্য প্রযোজ্য standard list rate অনুযায়ী গণনা করা হয়। আপনি subscription ব্যবহার করলে এটি আপনার bill নয়।
ছোট মডেলে পরিবর্তন করলে কি উপকার হয়?
শুধু তখনই, যখন বার্তায় কোনো মডেলের নাম উল্লেখ থাকে। You've hit your Opus limit-এর পরে /model চালিয়ে Sonnet অথবা Haiku নির্বাচন করুন; এরপর session-টি context-এর সবকিছুসহ চলতে থাকবে। You've hit your session limit অথবা You've hit your weekly limit-এর পরে /model চালালে কিছুই পরিবর্তন হবে না, কারণ ওই window-গুলো সব মডেলের মধ্যে shared।
সীমায় পৌঁছানোর পরে নয়, তার অনেক আগেই মডেল পরিবর্তন করা বেশি কার্যকর। Sonnet, Opus-এর তুলনায় অনেক কম খরচে অধিকাংশ coding কাজ সামলাতে পারে। তাই Opus-কে default হিসেবে রেখে দেওয়া অপ্রত্যাশিত usage-এর পেছনে থাকা দুটি অভ্যাসের একটি। অন্যটি হলো এমন session, যা কখনো clear করা হয় না। Mechanical edit এবং log triage Haiku-কে দিন। যে design decision-এ আপনি সত্যিই আটকে আছেন, তার জন্য Opus রাখুন। Opus, Sonnet এবং Haiku-এর মধ্যে নির্বাচন প্রতিটি মডেল কোথায় তার মূল্য যথার্থ করে, তা ব্যাখ্যা করে।
যে context আর ব্যবহার করছেন না, তার জন্য খরচ বন্ধ করুন
Claude Code প্রতিটি request-এর সঙ্গে আপনার সম্পূর্ণ conversation পাঠায়। Claude কোনো tool ব্যবহার করলে tool result-এর সেই batch-সহ আরেকটি request পাঠায়। Prompt caching-এর কারণে history সম্পূর্ণ input rate-এ নয়, cached rate-এ আবার পড়া হয়। এতে খরচ কমে, কিন্তু শূন্য হয় না। তাই সকাল থেকে খোলা একটি session-এ করা এক লাইনের প্রশ্নেও পুরো conversation-এর usage গণনা হয়।
/context
/clear
/compact Focus on the failing tests and the files we changed/clear কোনো খরচ করে না, কারণ এটি context পড়ার পরিবর্তে বাদ দিয়ে দেয়। /compact যে conversation-টির সারসংক্ষেপ তৈরি করে, সেটি আগে পড়তে হয়। তাই খুব বড় context compact করাও নিজেই একটি বড় request। সম্পর্কহীন কাজে গেলে /clear ব্যবহার করুন। Thread ধরে রাখা দরকার হলে, মাঝপথের task-এ শুধু /compact ব্যবহার করুন। পরিষ্কার করার আগে /rename চালান, যাতে পরে /resume দিয়ে session খুঁজে পাওয়া যায়।
Cache lifetime অধিকাংশ মানুষের প্রত্যাশার চেয়ে বেশি গুরুত্বপূর্ণ। Subscription-এ cache এক ঘণ্টা থাকে। Usage credits ব্যবহার শুরু করলে এটি পাঁচ মিনিটে নেমে আসে। API key-এর ক্ষেত্রেও default পাঁচ মিনিট। দীর্ঘ lunch বিরতির পর পাঠানো প্রথম message cache-এ পাওয়া যায় না এবং পুরো context full input price-এ আবার process হয়। তাই কোনো দৃশ্যমান কারণ ছাড়াই usage প্রায়ই বেড়ে যায়। Prompt caching কোথায় খরচ সাশ্রয় করে অংশে এর হিসাব দেওয়া হয়েছে।
একই জায়গায় আরও তিনটি নিয়ন্ত্রণ রয়েছে। /mcp আপনার configured server-এর তালিকা দেখায়, তাই এই task-এর প্রয়োজন নেই এমন server বন্ধ করতে পারেন। একটি দীর্ঘ CLAUDE.md session শুরু হওয়ার সময় load হয়, কাজটির জন্য সেটি প্রয়োজন হোক বা না হোক। তাই specialized instruction-গুলো skills-এ সরিয়ে নিন; এগুলো কেবল invoke করলে load হয়। Extended thinking output token হিসেবে billed হয়, যা খরচের বেশি অংশ। তাই /effort দিয়ে এর মাত্রা কমান, /config-এ এটি বন্ধ করুন, অথবা fixed thinking budget-যুক্ত model-এ MAX_THINKING_TOKENS=8000 সেট করুন।
কাজটি ভাগ করুন, যাতে এটি একটি window-এর মধ্যে সম্পন্ন হয়
বড় পরিবর্তন করার আগে plan mode-এ যেতে Shift+Tab চাপুন। Claude codebase পরীক্ষা করে একটি পদ্ধতি প্রস্তাব করবে, যা আপনি অনুমোদন করবেন। সেখানে ভুল দিক ধরা পড়লে দুই ঘণ্টা edit করার পর পুনরায় কাজ করার বদলে শুধু একটি plan ব্যয় হবে।
বেশি output তৈরি করে এমন কাজ subagent-কে দিন। subagent-এর ভিতরে test suite চালানো বা 10,000 line-এর log পড়ালে raw output সেই subagent-এর context-এ থাকে। শুধু summary আপনার মূল conversation-এ ফিরে আসে।
Claude ভুল দিকে এগোতে শুরু করলেই Escape চাপুন। /rewind conversation এবং code—উভয়কেই আগের checkpoint-এ ফিরিয়ে আনে। ফলে আপনি কখনো চাননি এমন কাজ বাতিল করতে অতিরিক্ত খরচ হয় না।
ব্যবহারের credits কিনবেন, নাকি API ব্যবহার করবেন?
Usage credits Pro বা Max account-কে plan allowance শেষ হওয়ার পরেও কাজ চালিয়ে যেতে দেয়। এর জন্য standard API rates অনুযায়ী bill করা হয়। claude.ai-এ Settings এবং তারপর Usage-এ গিয়ে, একটি payment method যুক্ত করে credits চালু করুন। অথবা Claude Code-এ /usage-credits চালান। এটি browser-এ আপনার billing settings খুলবে। Credits Claude conversations এবং Claude Code terminal usage—উভয়ের ক্ষেত্রেই প্রযোজ্য। প্রতিদিন সর্বোচ্চ $2000 পর্যন্ত credits ব্যবহার করা যায়। এই command চালাতে subscription login প্রয়োজন। তাই API key দিয়ে authenticate করলে এটি ব্যবহার করা যায় না। Free plan-এ credits একেবারেই দেওয়া হয় না। তাই প্রথম পদক্ষেপ হলো মাসে $20-এর Pro plan নেওয়া। Pro plan-এ কী যোগ হয় এবং এর সীমাবদ্ধতা কোথায় থেকে এই plan কতটা কাজে আসবে তা জানা যাবে। অধিকাংশ সপ্তাহে credits দিয়ে account top up করতে হলে সাধারণত বড় allowance নেওয়াই কম খরচের পদ্ধতি। আর $100 এবং $200 Max tier-এর পার্থক্য মূলত usage multiplier-এর পার্থক্য; model বা feature-এর পার্থক্য নয়।
অন্য পদ্ধতি হলো Claude Console থেকে একটি সাধারণ API key নেওয়া। এখানে প্রতি token অনুযায়ী bill করা হয়। কোনো session বা weekly window প্রযোজ্য নয়। তবে একটি সমস্যা আছে। আপনার environment-এ ভুল করে ANTHROPIC_API_KEY থাকলে কোনো সতর্কতা ছাড়াই Claude Code আপনার subscription-এর বদলে ওই key ব্যবহার করবে। এটি bill দেখে, অথবা নিচের output দেখে বুঝতে পারবেন:
API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.এই 429 error-টি আপনার plan-এর rate limit নয়; এটি key-এর rate limit। /status চালিয়ে active credential-টি আপনার প্রত্যাশিত credential কি না নিশ্চিত করুন।
API-এ একটি বিকেলের খরচ কত?
নিচের উদাহরণটি agent-style coding-এর একটি বিকেলের হিসাব: 200,000টি uncached input token, 1.8 millionটি cache read এবং 150,000টি output token। এখানে Anthropic-এর August 2026-এর list rate ব্যবহার করা হয়েছে। প্রতিটি rate প্রতি million token হিসেবে দেওয়া হয়। এই এককটি যদি এখনও বিমূর্ত মনে হয়, এক million token-এর প্রকৃত মূল্য কত সেটি আপনি যে পরিমাণ পড়া ও লেখা কল্পনা করতে পারেন, সেই পরিমাণে রূপান্তর করে।
The data behind this chart
[
{
"label": "Opus 5",
"input_usd_per_mtok": 5,
"cache_read_usd_per_mtok": 0.5,
"output_usd_per_mtok": 25,
"afternoon_usd": 5.65
},
{
"label": "Sonnet 5",
"input_usd_per_mtok": 2,
"cache_read_usd_per_mtok": 0.2,
"output_usd_per_mtok": 10,
"afternoon_usd": 2.26
},
{
"label": "Haiku 4.5",
"input_usd_per_mtok": 1,
"cache_read_usd_per_mtok": 0.1,
"output_usd_per_mtok": 5,
"afternoon_usd": 1.13
}
]একই বিকেলের খরচ Opus 5-এ $5.65 এবং Haiku 4.5-এ $1.13। মোট খরচে output-এর প্রভাব সবচেয়ে বেশি। Opus 5-এ প্রতি million token-এর জন্য $25, আর Haiku 4.5-এ $5। তাই Claude যে 150,000 token লেখে, তার খরচ পড়া 2 million token-এর চেয়ে বেশি। এ কারণেই file কমানোর চেয়ে thinking budget কমালে বেশি সাশ্রয় হয়।
একটি তারিখ মনে রাখুন। Sonnet 5-এর introductory pricing 31 August 2026 পর্যন্ত প্রতি million input token-এর জন্য $2 এবং প্রতি million output token-এর জন্য $10। 1 September 2026 থেকে এই হার $3 এবং $15 হবে। ফলে একই বিকেলের খরচ $2.26 থেকে বেড়ে প্রায় $3.39 হবে।
প্রতিটি বিকেলের খরচ কীভাবে হিসাব করা হয়েছে
Opus 5: 200,000টি uncached input token, প্রতি million-এর জন্য $5 হিসাবে, মোট $1.00। 1.8 millionটি cache read, input rate-এর এক দশমাংশ হিসাবে, মোট $0.90। 150,000টি output token, প্রতি million-এর জন্য $25 হিসাবে, মোট $3.75। সর্বমোট $5.65।
Sonnet 5: uncached input-এর জন্য $0.40, cache read-এর জন্য $0.36 এবং output-এর জন্য $1.50। সর্বমোট $2.26।
Haiku 4.5: uncached input-এর জন্য $0.20, cache read-এর জন্য $0.18 এবং output-এর জন্য $0.75। সর্বমোট $1.13।
সব 3টি row-তে একই token count ধরা হয়েছে। তাই তাদের মধ্যকার পার্থক্য শুধু price-এর কারণে। বাস্তবে একটি বিকেলের খরচ নির্ভর করে আপনার context-এর কতটা cached থাকে তার ওপর।
পরিসর বোঝার জন্য বলা যায়, August 2026 অনুযায়ী Anthropic-এর নিজস্ব documentation-এ enterprise deployment-গুলোর Claude Code ব্যবহারের গড় খরচ active day-পিছু developer প্রতি প্রায় $13। 90% user-এর ক্ষেত্রে এটি active day-পিছু $30-এর নিচে। Per-token billing subscription-এর চেয়ে স্বয়ংক্রিয়ভাবে সস্তা নয়। আপনার কাজের চাপ যদি ওঠানামা করে, তখন এটি লাভজনক, কারণ কাজ না থাকা দিনে কোনো খরচ হয় না। আপনি প্রতিদিন কাজ করলে এটি কম লাভজনক। বাস্তব সংখ্যায় API ও subscription-এর তুলনা-তে crossover দেখানো হয়েছে।
VPS-এ রাতভর দীর্ঘ কাজ চালান
কিছু কাজের জন্য আপনাকে নজরদারি করতে হয় না। যেমন বড় refactor, test migration বা documentation sweep। এসব কাজের জন্য আপনার subscription window-ও প্রয়োজন হয় না। একটি API key ব্যবহার করে কাজগুলো VPS (virtual private server)-এ চালান। এতে per-token billing প্রযোজ্য হবে এবং আগামীকালের interactive কাজের জন্য আপনার plan allowance অব্যবহৃত থাকবে।
একটি Ubuntu server-এ Claude Code install করুন এবং এটি চলছে কি না নিশ্চিত করুন:
curl -fsSL https://claude.ai/install.sh | bash
claude --versionclaude --version একটি version string দেখাবে, যেমন 2.1.211 (Claude Code)। এখানে command not found দেখালে বুঝবেন ~/.local/bin এখনও আপনার PATH-এ নেই। নতুন shell খুলে আবার চেষ্টা করুন।
Shell history-তে key রাখার পরিবর্তে এটি একটি file-এ রাখুন। একটি editor-এ এক লাইনের export ANTHROPIC_API_KEY=sk-ant-your-key-here দিয়ে ~/.claude-env তৈরি করুন। এরপর file-এর permission সীমিত করে এটি load করুন:
chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10শেষের লাইনটি প্রথম দশটি character দেখায়। এতে পুরো key screen-এ না দেখিয়েই variable সেট হয়েছে কি না নিশ্চিত করা যায়।
এবার কাজটি tmux-এর মধ্যে শুরু করুন, যাতে আপনার laptop বন্ধ করলেও এটি চলতে থাকে:
tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
--allowedTools "Read,Edit,Bash" \
--append-system-prompt-file ./CLAUDE.md \
--output-format json > ~/overnight.jsonCtrl-b, তারপর d চাপ দিয়ে detach করুন এবং connection বন্ধ করুন। পরে tmux attach -t overnight দিয়ে আবার attach করুন। VPS-এ tmux session-এ Claude Code-এ session পরিচালনার পুরো প্রক্রিয়া দেওয়া আছে।
এখানে --bare গুরুত্বপূর্ণ। এটি hooks, skills, plugins এবং CLAUDE.md-এর auto-discovery এড়িয়ে যায়। এটি কখনও OAuth credentials পড়ে না। তাই run-এ শুধু API key ব্যবহৃত হয়, অন্য কিছু নয়। এভাবেই কাজটি আপনার subscription-এর বাইরে থাকে। এর ফলে project rules-ও আর পাওয়া যায় না। তাই --append-system-prompt-file সেগুলো ইচ্ছাকৃতভাবে আবার দেয়। --bare না থাকলে সেট করা ANTHROPIC_API_KEY একটি one-time approval prompt চালু করে। unattended run সেই prompt-এর উত্তর দিতে পারে না।
সকালে JSON থেকে result এবং cost দেখুন:
jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.jsonসফল হলে Claude Code 0 exit status দেয়। run ব্যর্থ হলে non-zero exit status দেয়। তাই একটি wrapper script exit status দেখে সিদ্ধান্ত নিতে পারে এবং ব্যর্থ হলে আপনাকে mail করতে পারে। কাজটি চালু রেখে যাওয়ার আগে Claude Console-এ workspace spend limit সেট করুন। রাত 3am-এ retry loop-এ থাকা agent বাস্তব অর্থ খরচ করতে পারে। কাজের গতি কমাতেও চাইলে CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY-এর মান কমান। চালু রাখা agent-এর cost control-এ প্রথমে কোন cap সেট করা উচিত তা ব্যাখ্যা করা হয়েছে।
কাজটির জন্য একটি আলাদা unprivileged user এবং একটি আলাদা git branch ব্যবহার করুন। কোনো repository-তে unattended অবস্থায় কাজ করা agent মাঝে মাঝে এমন কিছু করতে পারে, যা আপনি উপস্থিত থাকলে থামিয়ে দিতেন। আলাদা branch থাকলে সেটি একটি git checkout হিসেবে দেখা যায়, incident হিসেবে নয়। VPS-এ coding agent নিরাপদে চালানো-এ isolation নিয়ে আলোচনা করা হয়েছে।
যে bulk কাজ একেবারেই interactive নয়, যেমন হাজার হাজার record শ্রেণিবদ্ধ করা, তার জন্য Batch API ব্যবহার করুন। এটি request-গুলো asynchronous উপায়ে process করে এবং input ও output token—উভয়ের ওপর 50% discount দেয়। Anthropic প্রকাশিত per-token route-গুলোর মধ্যে এটি সবচেয়ে কম খরচের। রাতভর চালানোর window-ই এর প্রয়োজনীয় latency-এর সঙ্গে ঠিক মানানসই।
যা আপনার access ফিরিয়ে দেয় না
নতুন conversation শুরু করলে আপনার allowance পুনরুদ্ধার হয় না। Usage conversation অনুযায়ী নয়, আপনার account অনুযায়ী গণনা করা হয়। তবে এর পরের প্রতিটি message-এর খরচ কমে, কারণ নতুন conversation-এ পুনরায় পড়ার মতো কোনো history থাকে না। তাই এটি করা উপযোগী। এটি খরচ কমায়, reset করে না।
পুরনো conversation মুছে ফেললে কোনো refund পাওয়া যায় না। ওই token-গুলোর খরচ সেগুলো process করার সময়ই হয়েছে।
একটি session বা weekly message limit-এ পৌঁছানোর পর model পরিবর্তন করলেও কিছু হয় না, কারণ ওই window সব model-এর জন্য shared। শুধু কোনো model-এর নাম উল্লেখ করা message-ই /model-এ সাড়া দেয়।
বারবার retry করলে শুধু আপনার terminal ব্যস্ত থাকে। message-এ দেখানো reset time-ই প্রকৃত উত্তর, এবং /usage error ছাড়াই একই clock দেখাবে।
FAQ
আমার Claude limit reset হতে কতক্ষণ লাগবে?
বার্তাটিতেই সময় দেওয়া থাকে। Session limit চলমান পাঁচ ঘণ্টার window অনুযায়ী গণনা হয়, এবং বার্তায় একটি clock time দেখায়, যেমন resets 3:45pm। Weekly limit প্রতি সপ্তাহে আপনার account-এর জন্য নির্ধারিত একটি fixed time-এ reset হয়, এবং বার্তায় দিনটি দেখায়, যেমন resets Mon 12:00am। কোনো কিছুতে পৌঁছানোর আগে দুইটি bar এবং দুইটি reset time দেখতে Claude Code-এ /usage চালান, অথবা claude.ai-তে Settings খুলে Usage নির্বাচন করুন।
Sonnet-এ switching করলে কি আবার কাজ শুরু করতে পারব?
শুধু তখনই, যখন বার্তায় একটি model-এর নাম থাকে। You've hit your Opus limit-এর পরে /model চালান, অন্য একটি model নির্বাচন করুন, এবং আপনার context অক্ষুণ্ণ রেখে session চালিয়ে যান। You've hit your session limit বা You've hit your weekly limit-এর পরে model নির্বাচন করলে কোনো পার্থক্য হয় না, কারণ ওই window-গুলোতে সব model-এর ব্যবহার একসঙ্গে গণনা করা হয়। সীমায় পৌঁছানোর আগে কম খরচের model-এ switching করলেই window কার্যকরভাবে দীর্ঘ হয়।
নতুন chat শুরু করলে কি আমার usage limit reset হবে?
না। Usage আপনার account-এর বিপরীতে গণনা করা হয়, তাই নতুন chat একই অব্যবহৃত allowance থেকে শুরু হবে। তবে পরবর্তী প্রতিটি message-এর খরচ কমবে, কারণ নতুন conversation-এ Claude-এর পুনরায় পড়ার মতো কোনো history থাকে না। Claude Code-এ /clear একই কাজ করে এবং এর জন্য কোনো খরচ নেই, কিন্তু /compact-কে যে conversation সংক্ষেপ করতে হবে সেটি পড়তে হয়। তাই খুব বড় session compact করাও নিজেই একটি ব্যয়বহুল request।
Plan upgrade করার চেয়ে API কি সস্তা?
আপনার usage কতটা নিয়মিত, তার ওপর নির্ভর করে। এই page-এ বর্ণিত afternoon কাজের খরচ August 2026-এর list rate অনুযায়ী Sonnet 5-এ $2.26 এবং Haiku 4.5-এ $1.13। Subscription হলো capped allowance-এর জন্য একটি fixed fee, তাই আপনি অধিকাংশ দিন কাজ করলে এটি বেশি সাশ্রয়ী। আপনার load যদি অনিয়মিত হয়, per-token billing বেশি সাশ্রয়ী, কারণ একেবারে quiet দিনে কোনো খরচ হয় না।
Reset-এর অপেক্ষায় কি কোনো job চালু রাখতে পারি?
হ্যাঁ, যদি সেটিকে আপনার subscription-এর বাইরে চালান। Environment-এ ANTHROPIC_API_KEY সেট করে VPS-এ এটি চালান। তাহলে subscription plan-এর window থেকে usage না কেটে প্রতি token অনুযায়ী billing হবে, ফলে দুটির মধ্যে কোনো প্রতিযোগিতা হবে না। tmux-এর মধ্যে claude --bare -p চালালে laptop বন্ধ করলেও job চলতে থাকে, এবং --output-format json একটি total_cost_usd field লিখে রাখে। সকালে jq দিয়ে সেটি পরীক্ষা করতে পারবেন।