SSD Nodes Learn
নির্দেশিকা Matt Connorদ্বারা Matt Connor · আপডেট করা হয়েছে 2026-07-24

Claude usage limits সমাধান করার উপায়

Claude subscription এবং API 429 error এর মধ্যে পার্থক্য বুঝুন। মডেল পরিবর্তন করলেও লিমিট রিসেট হয় না। সঠিক সমাধান পেতে সম্পূর্ণ গাইডটি পড়ুন।

Claude-এর usage limits কী কী?

Claude-এর usage limits দুটি আলাদা সিস্টেমে কাজ করে। প্রথম কাজ হলো কোনটি আপনার ব্যবহার সীমিত করে দিচ্ছে তা বোঝা। একটি Claude subscription (Pro, Max, Team, অথবা Enterprise) আপনাকে একটি rolling usage allowance দেয়। এটি বিভিন্ন model-এর মধ্যে এবং Claude chat-এর সাথে শেয়ার করা হয়, তাই এটি আপনাকে You've hit your session limit · resets 3:45pm এর মতো একটি মেসেজ দিয়ে থামিয়ে দেয়। Claude API অন্য কিছু পরিমাপ করে: আপনি প্রতি মিনিটে কত দ্রুত request এবং token পাঠাচ্ছেন। এটি আপনাকে rate_limit_error টাইপের একটি HTTP 429 error এবং কত সেকেন্ড অপেক্ষা করতে হবে তা জানিয়ে একটি retry-after header দিয়ে থামিয়ে দেয়।

এই সমস্যা সমাধানের উপায়গুলো সম্পূর্ণ আলাদা। Subscription limit হলো একটি নির্দিষ্ট সময়ের মধ্যে আপনি কতটুকু ব্যবহার করেছেন তার ওপর ভিত্তি করে, তাই আপনাকে reset হওয়ার জন্য অপেক্ষা করতে হবে অথবা আরও usage কিনতে হবে। API rate limit হলো আপনার বর্তমান গতি বা speed-এর ওপর ভিত্তি করে, এবং আপনি গতি কমিয়ে দিলে কয়েক সেকেন্ডের মধ্যেই এটি ঠিক হয়ে যায়।

Plan allowances এবং rate-limit tier number প্রায়ই পরিবর্তিত হয়। ভুল সংখ্যা প্রদান করার চেয়ে কোনো সংখ্যা না দেওয়াই ভালো, তাই এখানে কোনো সংখ্যা দেওয়া হয়নি। নিচের command গুলো ব্যবহার করে আপনি আপনার নিজস্ব limit দেখে নিতে পারেন।

আপনি কোন লিমিটে পৌঁছেছেন? সঠিক মেসেজটি পড়ুন

Claude Code তার প্রিন্ট করা টেক্সটে সিস্টেমের নাম উল্লেখ করে। কোনো পরিবর্তন করার আগে আপনার মেসেজটির সাথে মিলিয়ে নিন।

  • You've hit your session limit · resets 3:45pm হলো একটি subscription limit। এই উইন্ডোর জন্য আপনার প্ল্যানের rolling allowance শেষ হয়ে গেছে।
  • You've hit your weekly limit · resets Mon 12:00am হলো দীর্ঘতর উইন্ডোর জন্য একই সিস্টেম।
  • You've hit your Opus limit · resets 3:45pm হলো একটি subscription limit যা শুধুমাত্র Opus request-এর ক্ষেত্রে প্রযোজ্য। মডেল পরিবর্তন করলে এই সমস্যাটি সমাধান হতে পারে।
  • API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com. হলো একটি API rate limit। আপনি আপনার API key, অথবা Amazon Bedrock বা Google Cloud প্রজেক্টের জন্য কনফিগার করা লিমিটে পৌঁছে গেছেন।
  • API Error: Server is temporarily limiting requests (not your usage limit) হলো একটি স্বল্পমেয়াদী throttle যা আপনার প্ল্যান কোটার সাথে সম্পর্কিত নয়। Claude Code এই মেসেজটি দেখানোর আগে স্বয়ংক্রিয়ভাবে backoff সহ পুনরায় চেষ্টা (retry) করে।

Subscription limits: session, weekly, and the Opus window

একটি subscription plan-এ একটি rolling usage allowance থাকে। এটি শেষ হয়ে গেলে, মেসেজে দেখানো reset time না আসা পর্যন্ত Claude Code পরবর্তী request ব্লক করে দেয়। এই allowance-এর দুটি বৈশিষ্ট্য বিভ্রান্তি সৃষ্টি করে।

  • এটি Claude chat-এর সাথে শেয়ার করা হয়। claude.ai-তে করা কাজ এবং terminal-এ করা কাজ একই allowance থেকে ব্যবহৃত হয়; তাই chat-এ অতিরিক্ত ব্যবহার আপনার coding-এর সময় কমিয়ে দেয়।
  • এটি সব model-এর জন্য প্রযোজ্য। Session এবং weekly limit-এ প্রতিটি model-এর জন্য আলাদা বাজেট নেই, শুধুমাত্র Opus limit-এর ক্ষেত্রে ব্যতিক্রম রয়েছে।

Claude for Teams এবং Enterprise-এর ক্ষেত্রে, প্রতিটি seat-এর জন্য একটি allowance থাকে যা একটি rolling five-hour window এবং একটি weekly window-তে reset হয়। এটি Claude chat এবং Cowork-এর সাথে শেয়ার করা হয় এবং seat tier (Standard বা Premium) অনুযায়ী নির্ধারিত হয়। Pro এবং Max-এর ক্ষেত্রে, মেসেজে দেখানো reset time এবং আপনার নিজস্ব /usage bar-ই সঠিক তথ্য, কোনো blog post থেকে নেওয়া সংখ্যা নয়। আপনি যদি এখনও tier নির্বাচন না করে থাকেন, তবে কোন Claude plan আপনার প্রয়োজন লিঙ্কে প্রতিটি plan-এর সীমাবদ্ধতা তুলনা করা হয়েছে।

কেন /model ব্যবহার করে মডেল পরিবর্তন করলে অ্যাক্সেস ফিরে আসে না

এটি সবচেয়ে সাধারণ ভুল পদক্ষেপ। ডকুমেন্টেশনে এই বিষয়ে স্পষ্টভাবে বলা আছে: session এবং weekly limits সব মডেলের জন্য শেয়ার করা হয়, তাই মডেল পরিবর্তন করলে অ্যাক্সেস ফিরে আসে না। আপনার session window শেষ হয়ে গেলে একটি ছোট মডেল নির্বাচন করলে শুধুমাত্র উত্তরের মডেলটি পরিবর্তন হয়। এটি অবশিষ্ট allowance পরিবর্তন করে না, কারণ allowance মডেল অনুযায়ী আলাদাভাবে রাখা হয় না; তাই মডেল পরিবর্তন করলে কোনো লিমিট রিলিজ হয় না।

ব্যতিক্রম হলো Opus limit, যা একটি নির্দিষ্ট মডেলের জন্য নির্ধারিত ceiling। যদি মেসেজটি You've hit your Opus limit দেখায়, তবে /model হলো সঠিক সমাধান। অন্য একটি মডেলে সুইচ করুন এবং কাজ চালিয়ে যান, কারণ শুধুমাত্র Opus রিকোয়েস্টগুলো ব্লক করা হয়েছে।

লিমিটটিকে একটি bug হিসেবে গণ্য করা দ্বিতীয় ভুল পদক্ষেপ। Reinstall বা re-authenticate করলে কোনো পরিবর্তন হবে না। window রিসেট হলে অথবা আপনি usage credits কিনলে allowance ফিরে আসবে।

সাবস্ক্রিপশন লিমিট বা সীমা অতিক্রম করলে যা করবেন

  1. রিসেট হওয়ার সময় দেখে নিন। একটি সেশন উইন্ডো খুব অল্প সময়ের জন্য হয়। কিন্তু একটি সাপ্তাহিক উইন্ডোর জন্য আপনার ডেস্কের সামনে বসে অপেক্ষা করার প্রয়োজন নেই।
  2. যদি এটি Opus লিমিট হয়, তবে /model চালান এবং অন্য কোনো মডেল বেছে নিন।
  3. আপনার প্ল্যান লিমিট, বার এবং এগুলো কখন রিসেট হবে তা দেখতে /usage চালান। /cost হলো একই স্ক্রিনের একটি alias।
  4. লিমিট অতিক্রম করার পরও কাজ চালিয়ে যেতে /usage-credits চালান। Pro এবং Max প্ল্যানে এটি আপনার billing settings ওপেন করবে। Team এবং Enterprise প্ল্যানে এটি আপনার organization-এর usage settings ওপেন করবে, অথবা আপনার কাছে billing access না থাকলে অ্যাডমিনদের কাছে একটি রিকোয়েস্ট পাঠাবে।
  5. যদি প্রতি সপ্তাহে আপনি একই সমস্যার সম্মুখীন হন, তবে আপনার কাজের ধরন অনুযায়ী প্ল্যানটি সঠিক সাইজের নয়।

/usage-credits ব্যবহারের জন্য /login এর মাধ্যমে সাইন-ইন করা একটি claude.ai সাবস্ক্রিপশন প্রয়োজন। API key authentication দিয়ে এটি ব্যবহার করা সম্ভব নয়, কারণ API key-এর কোনো প্ল্যান এলাউন্স নেই যা বাড়ানো সম্ভব।

Usage credits ব্যবহারের একটি পার্শ্বপ্রতিক্রিয়া রয়েছে যা জানা জরুরি। সাবস্ক্রিপশনে prompt cache lifetime এক ঘণ্টা থাকে, কিন্তু ক্রেডিট ব্যবহার শুরু করলে এটি কমে মাত্র পাঁচ মিনিটে নেমে আসে। ফলে প্রতিটি নতুন টার্ন 'cold' অবস্থায় শুরু হয় এবং একই কাজের জন্য Claude Code token usage বৃদ্ধি পায়।

Usage limit হিসেবে প্রদর্শিত কিন্তু আসলে তা নয় এমন মেসেজসমূহ

Claude Code-এর চারটি error-কে usage limit হিসেবে রিপোর্ট করা হয়, কিন্তু আসলে সেগুলো usage limit নয়।

  • context বা auto-compact warning কোনো usage limit নয়। যখন conversation-এর আকার model-এর context window অতিক্রম করে, তখন Context exceeds the 200k-token limit by 94k tokens — run /compact or /clear to continue. এর মতো একটি লাইন /context প্রিন্ট করে। জায়গা খালি করার জন্য পুরনো history summarize করা হয় এবং আপনার plan allowance অপরিবর্তিত থাকে।
  • Error during compaction: Conversation too long. Press esc twice to go up a few messages and try again. মানে হলো /compact নিজেই fail করেছে, কারণ summary তৈরি করার মতো পর্যাপ্ত free context অবশিষ্ট নেই।
  • Credit balance is too low মানে হলো আপনার Console organization-এর prepaid credits শেষ হয়ে গেছে। platform.claude.com/settings/billing থেকে credits যোগ করুন, যেখানে auto-reload সুবিধা রয়েছে।
  • API Error: Usage credits required for 1M context · run /usage-credits to turn them on, or /model to switch to standard context হলো একটি entitlement check, এটি quota শেষ হওয়া নয়। [1m] suffix ছাড়া model variant বেছে নিন অথবা CLAUDE_CODE_DISABLE_1M_CONTEXT=1 সেট করুন।

আরও একটি error API থেকে আসে। 413 request_too_large হলো একটি single request-এর size limit, এটি rate limit নয়।

API rate limits: 429 এর প্রকৃত কারণ কী

Messages API প্রতিটি model class এর জন্য আলাদাভাবে তিনটি বিষয় পরিমাপ করে।

  • প্রতি মিনিটে অনুরোধের সংখ্যা (RPM)
  • প্রতি মিনিটে ইনপুট টোকেন (ITPM)
  • প্রতি মিনিটে আউটপুট টোকেন (OTPM)

আপনার organization এর একটি spend limit বা ব্যয়ের সীমা রয়েছে, যা সম্পূর্ণ আলাদা একটি বিষয়: এটি API ব্যবহারের জন্য একটি সর্বোচ্চ মাসিক খরচ। আপনি যখন আপনার tier এর spend cap এ পৌঁছে যাবেন, তখন পরবর্তী মাস না আসা পর্যন্ত API ব্যবহার সাময়িকভাবে বন্ধ হয়ে যাবে, যদি না আপনি উচ্চতর সীমা অনুরোধ করেন। কোনো retry loop দিয়ে এটি সমাধান করা সম্ভব নয়।

৪টি বিষয়ের ওপর ভিত্তি করে 429 এররটি আসে।

  • Limits গুলো model class অনুযায়ী নির্ধারিত। এগুলো প্রতিটি model এর জন্য আলাদাভাবে প্রযোজ্য, তাই আপনি একই সাথে বিভিন্ন model তাদের নিজ নিজ সীমা পর্যন্ত ব্যবহার করতে পারেন। কিছু model family একই bucket শেয়ার করে: Opus rate limit হলো Claude Opus 4.8, Opus 4.7, Opus 4.6 এবং Opus 4.5 এর সম্মিলিত সীমা, যেখানে Claude Sonnet 5 এর নিজস্ব সীমা রয়েছে।
  • Capacity ক্রমাগত রিফিল হয়। API একটি token bucket algorithm ব্যবহার করে, তাই capacity কোনো নির্দিষ্ট সময়ে রিসেট না হয়ে ক্রমাগত পুনরায় পূর্ণ হতে থাকে। প্রতি মিনিটে ৬০টি অনুরোধের সীমা থাকলে তা প্রতি সেকেন্ডে ১টি অনুরোধ হিসেবে কার্যকর হতে পারে, তাই একবারে ৬০টি অনুরোধ পাঠালে সেগুলো ব্যর্থ হবে।
  • বেশিরভাগ model এর ক্ষেত্রে শুধুমাত্র uncached input ITPM হিসেবে গণ্য হয়। input_tokens এবং cache_creation_input_tokens গণনা করা হয়। বেশিরভাগ Claude model এর ক্ষেত্রে cache_read_input_tokens গণনা করা হয় না, তবে Claude Haiku 3.5 এর ক্ষেত্রে এটি একটি ব্যতিক্রম। তাই caching ব্যবহার করলে রেট-লিমিটের headroom এবং ডিসকাউন্ট উভয়ই পাওয়া যায়। আউটপুট এর ক্ষেত্রে, উচ্চ max_tokens OTPM হিসেবে গণ্য হয় না, কারণ OTPM শুধুমাত্র প্রকৃতপক্ষে উৎপন্ন টোকেন গণনা করে।
  • Limits গুলো organization লেভেলে কাজ করে। একটি workspace এর জন্য কম সীমা নির্ধারণ করা যেতে পারে, তবে organization-wide limits সবসময় প্রযোজ্য হবে, এমনকি যদি workspace limit গুলোর সমষ্টি তার চেয়ে বেশি হয়। আপনি যদি কোনো workspace এ সীমা পরিবর্তন (override) না করেন, তবে সেটি organization থেকে উত্তরাধিকারসূত্রে পাওয়া সীমা হিসেবে গণ্য হবে, এটি আনলিমিটেড নয়।

Start, Build, Scale এবং Custom নামে বিভিন্ন tier থাকে যা প্রকৃত সংখ্যা নির্ধারণ করে; এগুলো আপনার ব্যবহারের ইতিহাস এবং অ্যাকাউন্টের অবস্থার ওপর ভিত্তি করে স্বয়ংক্রিয়ভাবে নির্ধারিত হয়। নতুন organization গুলোর ক্ষেত্রে প্রকাশিত standard limits এর চেয়ে কম সীমা থাকতে পারে, তাই একটি টেবিলের পূর্বাভাসের চেয়ে দ্রুত প্রথম 429 এররটি আসতে পারে। ব্যবহারের হঠাৎ বৃদ্ধি acceleration limits ট্রিগার করতে পারে, যা আপনার tier এর ভেতরে থাকা অবস্থাতেই 429 রিটার্ন করে; তাই ট্রাফিক ধীরে ধীরে বৃদ্ধি করুন। প্রতিটি প্রকাশিত সংখ্যা একটি ceiling বা ঊর্ধ্বসীমা: ডকুমেন্ট করা limit গুলো হলো সর্বোচ্চ অনুমোদিত ব্যবহার, কোনো গ্যারান্টিযুক্ত সর্বনিম্ন পরিমাণ নয়। আরও বেশি সীমা পেতে Claude Console এর Limits পেজে থাকা "Request rate limit increase" অপশনটি ব্যবহার করুন।

429: retry-after পড়া, হেডার এবং SDK retry

প্রতিটি API error একই ধরনের envelope প্রদান করে: একটি nested error object যা type এবং message বহন করে, এবং একটি top-level request_id

{
  "type": "error",
  "error": {
    "type": "rate_limit_error",
    "message": "<names the rate limit you exceeded>"
  },
  "request_id": "req_011CSHoEeqs5C35K2UUqR7Fy"
}

বাকি তথ্য হেডারগুলোতে থাকে।

  • retry-after হলো কত সেকেন্ড অপেক্ষা করতে হবে যাতে আপনি পুনরায় request করতে পারেন। এর আগে পুনরায় চেষ্টা করলে তা ব্যর্থ হবে।
  • anthropic-ratelimit-requests-limit, anthropic-ratelimit-requests-remaining এবং anthropic-ratelimit-requests-reset আপনার request budget বর্ণনা করে।
  • anthropic-ratelimit-input-tokens-* এবং anthropic-ratelimit-output-tokens-* একইভাবে ITPM এবং OTPM এর জন্য কাজ করে, যেখানে limit, remaining এবং reset suffix ব্যবহার করা হয়।
  • anthropic-ratelimit-tokens-* বর্তমানে কার্যকর সবচেয়ে restrictive limit এর মান প্রদর্শন করে।

Reset হেডারগুলো RFC 3339 timestamp। Remaining token হেডারগুলো নিকটতম হাজারের গুণিতক হিসেবে রাউন্ড করা হয়, তাই এগুলোকে একটি gauge হিসেবে বিবেচনা করুন। Fast mode এর নিজস্ব pool এবং নিজস্ব anthropic-fast-* হেডার রয়েছে। যেকোনো সফল call থেকে এগুলো পড়ুন:

curl -s -D - -o /dev/null https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{"model":"claude-sonnet-5","max_tokens":16,"messages":[{"role":"user","content":"hi"}]}' \
  | grep -i 'ratelimit\|retry-after\|request-id'

প্রতিটি response এ একটি অনন্য request-id হেডার থাকে, যেমন req_018EeWyXxfu5pfWkrYcMdjWG। এটি error body তে request_id হিসেবে এবং Python ও TypeScript SDK response এ _request_id হিসেবে প্রদর্শিত হয়। সাপোর্ট টিমের সাথে যোগাযোগ করার সময় এটি উল্লেখ করুন।

একটি backoff loop লেখার আগে আপনার আদৌ সেটি প্রয়োজন কি না তা যাচাই করে নিন। অফিসিয়াল SDK গুলো connection error, rate limits এবং 5xx server error এর মতো transient failures গুলো স্বয়ংক্রিয়ভাবে exponential backoff সহ পুনরায় চেষ্টা (retry) করে। ডিফল্টভাবে এটি দুবার করা হয় এবং retry-after হেডার উপস্থিত থাকলে তা অনুসরণ করা হয়। প্রতিটি client এ এই আচরণ পরিবর্তন বা বন্ধ করার জন্য একটি maximum-retries option রয়েছে।

import anthropic

client = anthropic.Anthropic(max_retries=5)  # the SDK default is 2

try:
    msg = client.messages.create(
        model="claude-sonnet-5",
        max_tokens=1024,
        messages=[{"role": "user", "content": "hello"}],
    )
except anthropic.RateLimitError as err:
    headers = err.response.headers
    print("still limited after retries; wait", headers.get("retry-after"), "seconds")
    print("request id:", headers.get("request-id"))

529 overloaded_error আপনার ভুলের কারণে নয়

429 এর অর্থ হলো আপনি খুব দ্রুত রিকোয়েস্ট পাঠিয়েছেন। 529 overloaded_error মানে হলো API সাময়িকভাবে overloaded, যা সকল ব্যবহারকারীর উচ্চ ট্রাফিক বা উচ্চ চাপের কারণে হতে পারে। আপনার key বা কোডের কারণে এটি ঘটেনি। exponential backoff পদ্ধতি ব্যবহার করে পুনরায় চেষ্টা করুন; SDK গুলো ইতিমধ্যে 5xx রেসপন্সের জন্য এটি করে থাকে। সমস্যা সমাধান না হলে status.claude.com চেক করুন। 500 api_error হলো একটি internal error, যা একইভাবে পুনরায় চেষ্টা করে সমাধান করা যায়; এর কোনোটিই rate limit নয়।

টেবিলের পরিবর্তে আপনার নিজস্ব লিমিটগুলো দেখুন

একটি সাবস্ক্রিপশনের ক্ষেত্রে, /usage হলো সবচেয়ে গুরুত্বপূর্ণ স্ক্রিন। এটি আপনার প্ল্যান ব্যবহারের বার এবং কী কারণে ব্যবহার হচ্ছে তার বিস্তারিত দেখায়। এছাড়া d অথবা w দিয়ে শেষ ২৪ ঘণ্টা এবং শেষ ৭ দিনের মধ্যে পরিবর্তন করা যায়। এখানে দুটি বিষয় মনে রাখতে হবে। Session ব্লকটি API token ব্যবহারের তথ্য দেখায় এবং এটি মূলত API ব্যবহারকারীদের জন্য; তাই সাবস্ক্রাইবাররা এর ডলারের পরিমাণ উপেক্ষা করতে পারেন। এই সংখ্যাগুলো ওই মেশিনের লোকাল session history থেকে আসে, তাই অন্য কোনো ডিভাইস বা claude.ai থেকে হওয়া ব্যবহার এখানে দেখা যাবে না।

API এর ক্ষেত্রে, Claude Console-এর Usage পেজে দুটি চার্ট থাকে: "Rate Limit - Input Tokens" এবং "Rate Limit - Output Tokens"। ইনপুট চার্টটি প্রতি মিনিটে আনক্যাশড (uncached) ইনপুট টোকেনের প্রতি ঘণ্টার সর্বোচ্চ মান এবং আপনার বর্তমান ITPM লিমিটের তুলনা দেখায়। এর পাশেই আপনার cache rate দেওয়া থাকে, যাতে প্রোডাকশনে লিমিটে পৌঁছানোর আগেই আপনি তা বুঝতে পারেন।

প্রোগ্রাম্যাটিকভাবে আপনার কনফিগার করা লিমিটগুলো পড়তে:

curl -s https://api.anthropic.com/v1/organizations/rate_limits \
  -H "x-api-key: $ANTHROPIC_ADMIN_KEY" \
  -H "anthropic-version: 2023-06-01"

এর জন্য একটি Admin API key প্রয়োজন, এবং GET /v1/organizations/workspaces/{workspace_id}/rate_limits প্রতিটি workspace-এর জন্য একই কাজ করে। উভয়ই read-only: লিমিট পরিবর্তন করতে Console-এর Limits ট্যাব ব্যবহার করুন।

less ব্যবহার করুন, যাতে আপনি কম লিমিটে পৌঁছান

উভয় সিস্টেমই মূলত একই বিষয় পরিমাপ করে, তাই এই পদ্ধতিগুলো উভয় ক্ষেত্রেই কাজ করে।

  • প্রতি টার্নে কম token ব্যবহার করুন। একটানা কাজ করলে cache গরম থাকে, এবং unrelated task-এর মাঝে /clear করলে কোনো খরচ হয় না। Claude Code token usage এই পদ্ধতিগুলো বিস্তারিত ব্যাখ্যা করে।
  • প্রয়োজনীয়তা বা effort কমিয়ে আনুন। লেভেলগুলো হলো low, medium, high, xhigh এবং max/effort মেনুতে ultracode অপশনও আছে, যা খরচ কমানোর পরিবর্তে বাড়িয়ে দেয়। একটি সাধারণ rename করার জন্য deep reasoning করার প্রয়োজন নেই।
  • 429 এর পরে concurrency কমিয়ে দিন। CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY কমিয়ে আনুন এবং অনেকগুলো parallel subagent ব্যবহার করা এড়িয়ে চলুন। /status ব্যবহার করুন: একটি ভুল ANTHROPIC_API_KEY আপনার subscription-এর পরিবর্তে low-tier key-এর মাধ্যমে request পাঠাতে পারে।
  • non-interactive কাজগুলো Message Batches API-তে সরিয়ে নিন। এটি input এবং output token-এর ওপর 50% ডিসকাউন্টে বড় ভলিউম asynchronous ভাবে চালাতে পারে। এর নিজস্ব rate limits আছে, তাই nightly job আপনার session-এর সাথে প্রতিযোগিতা করবে না।

মানুষের পরিবর্তে প্রোগ্রামের মাধ্যমে চালিত bursty work-এর জন্য শুরু থেকেই API key ব্যবহার করা উচিত। Your first Claude API app on a VPS কি হ্যান্ডলিং এবং retries সম্পর্কে জানায়, এবং আপনি যদি Claude Code running on a VPS inside tmux ব্যবহার করেন, তবে সংযোগ বিচ্ছিন্ন হলেও দীর্ঘক্ষণ চলা agent run সচল থাকবে।

FAQ

কেন মডেল পরিবর্তন করলে আমার Claude usage limit ঠিক হয় না?

কারণ session এবং weekly limit সব মডেলের জন্য শেয়ার করা হয়। এই লিমিটটি আপনার plan-এর জন্য নির্ধারিত, কোনো নির্দিষ্ট মডেলের জন্য নয়; তাই /model পরিবর্তন করলে শুধুমাত্র মডেল পরিবর্তন হয়, কিন্তু অবশিষ্ট allowance পরিবর্তন হয় না। এর একমাত্র ব্যতিক্রম হলো You've hit your Opus limit, যা শুধুমাত্র Opus request-এর ক্ষেত্রে প্রযোজ্য। সেক্ষেত্রে মডেল পরিবর্তন করাই হলো সমাধান।

429 rate_limit_error মানে কী এবং কতক্ষণ অপেক্ষা করা উচিত?

এর মানে হলো আপনার অ্যাকাউন্টটি ওই নির্দিষ্ট model class-এর জন্য নির্ধারিত rate limit অতিক্রম করেছে: যেমন প্রতি মিনিটে request সংখ্যা, প্রতি মিনিটে input token সংখ্যা, অথবা প্রতি মিনিটে output token সংখ্যা। রেসপন্স-এ একটি retry-after header থাকে যা জানায় কত সেকেন্ড অপেক্ষা করতে হবে; এর আগে পুনরায় চেষ্টা করলে তা ব্যর্থ হবে। অফিসিয়াল SDK-গুলো ডিফল্টভাবে দুবার exponential backoff সহ rate limits এবং 5xx error পুনরায় চেষ্টা করে এবং ওই header মেনে চলে। আপনি যদি আপনার tier-এর লিমিটের মধ্যেই থাকেন এবং তবুও 429 error পান, তবে বুঝতে হবে হঠাৎ ব্যবহারের আধিক্যের কারণে acceleration limit অতিক্রম হয়েছে।

আমি কীভাবে আমার Claude usage limits এবং reset হওয়ার সময় দেখতে পারি?

Claude Code-এ আপনার plan bars, reset time এবং usage breakdown দেখতে /usage কমান্ডটি চালান; /cost হলো একটি alias, এবং d অথবা w ব্যবহার করে আপনি শেষ ২৪ ঘণ্টা এবং শেষ ৭ দিনের মধ্যে পরিবর্তন করতে পারেন। এই তথ্যগুলো local session history থেকে আসে, তাই অন্য ডিভাইস বা claude.ai থেকে করা usage এখানে দেখা যাবে না। API-এর ক্ষেত্রে, Console আপনার rate limits প্রদর্শন করে এবং GET /v1/organizations/rate_limits কমান্ডটি Admin API key ব্যবহার করে আপনার কনফিগার করা limits প্রদান করে।

Claude plan limit অতিক্রম করার পর কি আমি কাজ চালিয়ে যেতে পারি?

কখনও কখনও সম্ভব। Pro এবং Max প্ল্যানে লিমিট ছাড়িয়ে গেলে অতিরিক্ত usage কেনার জন্য /usage-credits চালান, অথবা Team এবং Enterprise প্ল্যানে অ্যাডমিনের কাছে অনুরোধ করতে এটি ব্যবহার করুন; এর জন্য /login এর মাধ্যমে claude.ai লগইন প্রয়োজন এবং API key authentication দিয়ে এটি করা সম্ভব নয়। অন্যথায়, reset time পর্যন্ত অপেক্ষা করুন, Opus limit হলে মডেল পরিবর্তন করুন, অথবা কাজটির জন্য API key ব্যবহার করুন, যা নির্দিষ্ট window-র পরিবর্তে প্রতি মিনিটে usage হিসাব করে।