رفع محدودیت استفاده از Claude و خطای 429
اگر با محدودیت استفاده در Claude مواجه شدید، تغییر مدل مشکل را حل نمیکند. تفاوت سهمیه چرخشی اشتراک با خطای HTTP 429 در API و نحوه مدیریت زمان انتظار را اینجا بیاموزید.
محدودیتهای استفاده از Claude چیست؟
محدودیتهای استفاده از Claude در دو سیستم مجزا تعریف میشوند و اولین گام، تشخیص این است که کدامیک باعث توقف فعالیت شما شده است. اشتراک Claude (شامل Pro، Max، Team یا Enterprise) یک سهمیه استفاده چرخشی (rolling usage allowance) در اختیار شما قرار میدهد که بین مدلهای مختلف و چت Claude مشترک است؛ بنابراین در صورت اتمام آن، با پیامی مشابه You've hit your session limit · resets 3:45pm مواجه میشوید. API سرویس Claude معیار متفاوتی دارد: سرعت ارسال درخواستها و توکنها که بهصورت تعداد در دقیقه محاسبه میشود. در صورت عبور از این حد، با خطای HTTP 429 از نوع rate_limit_error و یک هدر retry-after مواجه میشوید که مدتزمان انتظار به ثانیه را مشخص میکند.
راهکارهای رفع این دو محدودیت کاملاً متفاوت هستند. محدودیت اشتراک به میزان استفاده شما در یک بازه زمانی بستگی دارد؛ بنابراین باید تا زمان بازنشانی (reset) صبر کنید یا سهمیه بیشتری خریداری نمایید. محدودیت نرخ (rate limit) در API به سرعت فعلی شما مربوط است و بهمحض کاهش سرعت، پس از چند ثانیه برطرف میشود.
سهمیههای طرحها و اعداد مربوط به سطوح محدودیت نرخ بهطور مداوم تغییر میکنند و درج عدد اشتباه، بدتر از عدم درج آن است؛ به همین دلیل در اینجا عددی ذکر نشده است. برای مشاهده محدودیتهای اختصاصی خود، از دستوراتی که در ادامه آمده است استفاده کنید.
به کدام محدودیت برخورد کردهاید؟ پیام دقیق را بخوانید
Claude Code نام سیستم را در متنی که چاپ میکند ذکر میکند. پیش از هر تغییری، نام سیستم خود را با موارد زیر تطبیق دهید.
You've hit your session limit · resets 3:45pmیک محدودیت اشتراک است. سهمیهٔ چرخشی طرح شما برای این بازهٔ زمانی به پایان رسیده است.You've hit your weekly limit · resets Mon 12:00amهمان سیستم است که در بازهٔ زمانی طولانیتری اعمال میشود.You've hit your Opus limit · resets 3:45pmیک محدودیت اشتراک است که فقط برای درخواستهای Opus اعمال میشود. این تنها موردی است که تغییر مدل در آن کمک میکند.API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.یک محدودیت نرخ API است. شما به محدودیتی که برای API key خود یا برای پروژهٔ Amazon Bedrock یا Google Cloud تنظیم شده، برخورد کردهاید. اینکه کدامیک از این موارد اعمال میشود به نحوهٔ احراز هویت کلاینت بستگی دارد، زیرا کلاینت Bedrock یا Vertex به جای سازمان Anthropic، بر اساس سهمیهٔ پروژهٔ ابری شما محاسبه میشود.API Error: Server is temporarily limiting requests (not your usage limit)یک محدودیت موقت (throttle) است که به سهمیهٔ طرح شما ارتباطی ندارد. Claude Code پیش از نمایش این خط، بهطور خودکار با استفاده از مکانیزم backoff تلاش مجدد میکند.
محدودیتهای اشتراک: نشست، هفتگی و بازه زمانی Opus
طرح اشتراک شامل یک سهمیه مصرف متغیر (rolling) است. هنگامی که این سهمیه به پایان میرسد، Claude Code درخواستهای بعدی را تا زمان بازنشانی که در پیام نمایش داده شده است، مسدود میکند. دو ویژگی این سهمیه باعث ایجاد بیشترین سردرگمی میشود.
- این سهمیه با Claude chat مشترک است. کاری که در claude.ai انجام میدهید از همان سهمیهای استفاده میکند که کار در ترمینال از آن بهره میبرد؛ بنابراین یک بعدازظهر پرکار در چت، زمان کدنویسی شما در عصر را کاهش میدهد. هر محیطی که با آن حساب کاربری وارد شوید از همان منبع مشترک استفاده میکند؛ بنابراین در لینوکس، نسخه بتای دسکتاپ و Claude Code CLI یک سهمیه واحد را بین خود تقسیم میکنند، نه اینکه برای هر کدام یک سهمیه جداگانه داشته باشند.
- این سهمیه بین مدلها مشترک است. محدودیتهای نشست و هفتگی بودجهبندی جداگانهای برای هر مدل ندارند، به استثنای محدودیت Opus.
در Claude for Teams و Enterprise، ساختار مستند شده به صورت سهمیه برای هر کاربر (seat) است که در یک بازه زمانی متغیر پنجساعته و یک بازه هفتگی بازنشانی میشود، با Claude chat و Cowork مشترک است و بر اساس سطح اشتراک (Standard یا Premium) تعیین میشود. در طرحهای Pro و Max، زمان بازنشانی درجشده در پیام و /usage شما، اعداد قابل استناد هستند، نه ارقامی که از یک پست وبلاگی کپی شده باشند. اگر هنوز در حال انتخاب سطح اشتراک هستید، اینکه به کدام طرح Claude نیاز دارید تفاوتهای هر سطح را مقایسه میکند.
چرا تغییر مدل با استفاده از /model دسترسی را بازیابی نمیکند
این رایجترین اقدام اشتباه است و مستندات بهصراحت به آن اشاره کردهاند: محدودیتهای نشست (session) و هفتگی بین تمام مدلها مشترک هستند، بنابراین تغییر مدل باعث بازیابی دسترسی نمیشود. انتخاب یک مدل کوچکتر پس از پایان سهمیهٔ نشست، فقط مدل پاسخدهنده را تغییر میدهد. این کار میزان سهمیهٔ باقیمانده را تغییر نمیدهد، زیرا سهمیه هرگز بهصورت تفکیکشده برای هر مدل در نظر گرفته نشده است؛ بنابراین تغییر مدل چیزی برای آزاد کردن ندارد.
استثنا، محدودیت Opus است که یک سقف کاملاً اختصاصی برای همان مدل محسوب میشود. اگر پیام خطا You've hit your Opus limit را مشاهده کردید، آنگاه /model راهکار صحیح است. به مدل دیگری تغییر وضعیت دهید و به کار خود ادامه دهید، زیرا فقط درخواستهای Opus مسدود شده بودند.
برخورد با محدودیت بهعنوان یک باگ، دومین اقدام اشتباه است. نصب مجدد یا احراز هویت دوباره هیچ تغییری ایجاد نمیکند. سهمیه زمانی بازمیگردد که بازهٔ زمانی مربوطه ریست شود یا اعتبار مصرف خریداری کنید.
هنگام رسیدن به محدودیت اشتراک چه باید کرد
- زمان بازنشانی را بخوانید. پنجرهٔ نشست کوتاه است. پنجرهٔ هفتگی چیزی نیست که بخواهید پشت میز خود منتظر پایانش بمانید.
- اگر محدودیت مربوط به Opus است، دستور
/modelرا اجرا کرده و مدل دیگری را انتخاب کنید. - دستور
/usageرا اجرا کنید تا محدودیتهای طرح، میزان مصرف و زمان بازنشانی آنها را ببینید./costیک نام مستعار (alias) برای همان صفحه است. - دستور
/usage-creditsرا اجرا کنید تا بتوانید پس از رسیدن به سقف مجاز، به کار خود ادامه دهید. در طرحهای Pro و Max، این دستور تنظیمات صورتحساب شما را باز میکند. در طرحهای Team و Enterprise، تنظیمات مصرف سازمان شما را باز میکند یا اگر دسترسی صورتحساب ندارید، درخواستی برای مدیران شما ارسال میکند. - اگر هر هفته به همان بنبست میرسید، این طرح برای نحوهٔ کار شما مناسب نیست و راههای خروج از محدودیت مصرف ارزش آن را دارند که یکبار برای همیشه بررسی شوند، نه اینکه هر بار هنگام بازنشانی با آنها درگیر شوید.
/usage-credits نیازمند اشتراک claude.ai است که از طریق /login وارد شده باشد. این قابلیت با احراز هویت از طریق API key در دسترس نیست، زیرا API key فاقد سهمیهٔ طرح برای افزایش است.
اعتبار مصرف (Usage credits) یک اثر جانبی دارد که دانستن آن پیش از هر چیز ضروری است. طول عمر کشِ پرامپت (prompt cache) در حالت اشتراک یک ساعت است، اما به محض اینکه از اعتبار استفاده کنید، به پنج دقیقه کاهش مییابد؛ بنابراین دفعات بیشتری کار را از حالت سرد (cold) شروع میکنید و مصرف توکن در Claude Code برای همان حجم کار افزایش مییابد.
پیامهایی که شبیه محدودیت استفاده هستند اما نیستند
چهار خطای Claude Code گزارش میشوند که به نظر محدودیت استفاده میآیند، اما هیچکدام از آنها محدودیت استفاده نیستند.
- هشدار context یا auto-compact یک محدودیت استفاده نیست.
/contextزمانی که طول گفتگو از پنجره context مدل فراتر میرود، خطی مانندContext exceeds the 200k-token limit by 94k tokens — run /compact or /clear to continue.را چاپ میکند. تاریخچه قدیمیتر برای آزاد کردن فضا خلاصه میشود و سهمیه طرح شما دستنخورده باقی میماند. Error during compaction: Conversation too long. Press esc twice to go up a few messages and try again.به این معنی است که خود/compactشکست خورده است، زیرا فضای context آزاد کافی برای نگهداری خلاصهای که باید تولید کند، وجود ندارد.Credit balance is too lowبه این معنی است که اعتبار پیشپرداخت سازمان Console شما تمام شده است. اعتبار را در platform.claude.com/settings/billing اضافه کنید که قابلیت شارژ خودکار (auto-reload) را نیز ارائه میدهد.API Error: Usage credits required for 1M context · run /usage-credits to turn them on, or /model to switch to standard contextیک بررسی حق اشتراک است، نه اتمام سهمیه. مدل بدون پسوند[1m]را انتخاب کنید یاCLAUDE_CODE_DISABLE_1M_CONTEXT=1را تنظیم نمایید.
یک مورد دیگر از سمت API است. خطای 413 request_too_large یک محدودیت اندازه برای یک درخواست واحد است، نه محدودیت نرخ (rate limit).
محدودیتهای نرخ API: شمارش واقعی خطای 429
Messages API سه مورد را بهصورت جداگانه برای هر کلاس مدل اندازهگیری میکند.
- تعداد درخواست در دقیقه (RPM)
- تعداد توکنهای ورودی در دقیقه (ITPM)
- تعداد توکنهای خروجی در دقیقه (OTPM)
سازمان شما همچنین یک سقف هزینه (spend limit) دارد که موضوع متفاوتی است: حداکثر هزینه ماهانه برای استفاده از API. هنگامی که به سقف هزینه تعیینشده برای سطح (tier) خود برسید، استفاده از API تا ماه بعد متوقف میشود، مگر اینکه درخواست افزایش سقف بدهید. هیچ حلقه تکرار (retry loop) این مشکل را حل نمیکند.
چهار مکانیسم تعیین میکنند که خطای 429 چه زمانی رخ میدهد.
- محدودیتها بر اساس کلاس مدل هستند. این محدودیتها برای هر مدل بهطور جداگانه اعمال میشوند، بنابراین میتوانید از مدلهای مختلف تا سقف محدودیتهای مربوط به هر کدام بهطور همزمان استفاده کنید. برخی خانوادهها از یک مخزن مشترک استفاده میکنند: محدودیت نرخ Opus مجموع کل برای Claude Opus 4.8، Opus 4.7، Opus 4.6 و Opus 4.5 است، در حالی که Claude Sonnet 5 مخزن اختصاصی خود را دارد.
- ظرفیت بهطور مداوم پر میشود. این API از الگوریتم token bucket استفاده میکند، بنابراین ظرفیت بهجای بازنشانی در یک لحظه ثابت، بهطور مداوم پر میشود. محدودیت 60 درخواست در دقیقه ممکن است به صورت یک درخواست در ثانیه اعمال شود، بنابراین ارسال 60 درخواست بهصورت همزمان همچنان با خطا مواجه میشود.
- در اکثر مدلها، فقط ورودیهای بدون کش (uncached) در ITPM محاسبه میشوند.
input_tokensوcache_creation_input_tokensمحاسبه میشوند.cache_read_input_tokensدر اکثر مدلهای Claude محاسبه نمیشود، که Claude Haiku 3.5 استثنای مستند آن است. بنابراین، استفاده از کش علاوه بر تخفیف، فضای بیشتری برای محدودیت نرخ ایجاد میکند. در سمت خروجی، یکmax_tokensبالا در OTPM محاسبه نمیشود، زیرا OTPM فقط توکنهایی را میشمارد که واقعاً تولید شدهاند. - محدودیتها در سطح سازمان اعمال میشوند. میتوان برای یک فضای کاری (workspace) محدودیت کمتری تعیین کرد، و محدودیتهای کل سازمان همیشه اعمال میشوند، حتی اگر مجموع محدودیتهای فضاهای کاری بیشتر از آن باشد. محدودیتی که در یک فضای کاری تغییر ندادهاید، از سازمان به ارث میرسد و به معنای نامحدود بودن آن نیست.
سطوح Start، Build، Scale و Custom اعداد واقعی را تعیین میکنند که بهطور خودکار بر اساس تاریخچه استفاده و وضعیت حساب شما اختصاص مییابند. سازمانهای جدید ممکن است با محدودیتهایی کمتر از مقادیر استاندارد منتشرشده شروع کنند، بنابراین اولین خطای 429 ممکن است زودتر از آنچه جدول پیشبینی میکند، رخ دهد. افزایش ناگهانی در استفاده، محدودیتهای شتابدهنده (acceleration limits) را فعال میکند که حتی اگر هنوز در محدوده سطح خود باشید، خطای 429 برمیگردانند؛ بنابراین ترافیک خود را بهتدریج افزایش دهید. هر عدد منتشرشده یک سقف است: محدودیتهای مستندشده حداکثر استفاده مجاز هستند، نه حداقلهای تضمینشده. برای درخواست افزایش، از کنترل "Request rate limit increase" در صفحه Limits در Claude Console استفاده کنید.
خواندن خطای 429: retry-after، هدرها و تلاش مجدد در SDK
هر خطای API یک پاکت (envelope) یکسان برمیگرداند: یک شیء تو در توی error که حاوی نوع و پیام خطا است، به علاوه یک request_id در سطح بالا.
{
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "<names the rate limit you exceeded>"
},
"request_id": "req_011CSHoEeqs5C35K2UUqR7Fy"
}سایر اطلاعات در هدرها قرار دارند.
retry-afterتعداد ثانیههایی است که باید تا زمان امکان ارسال مجدد درخواست صبر کنید. تلاشهای زودهنگام با شکست مواجه میشوند.anthropic-ratelimit-requests-limit،anthropic-ratelimit-requests-remainingوanthropic-ratelimit-requests-resetبودجه درخواست شما را توصیف میکنند.anthropic-ratelimit-input-tokens-*وanthropic-ratelimit-output-tokens-*همین کار را برای ITPM و OTPM با پسوندهای مشابه limit، remaining و reset انجام میدهند.anthropic-ratelimit-tokens-*مقادیر مربوط به محدودکنندهترین حد مجاز که در حال حاضر اعمال شده است را نمایش میدهد.
هدرهای reset بر اساس فرمت زمانی RFC 3339 هستند. هدرهای remaining token به نزدیکترین هزار گرد میشوند، بنابراین آنها را به عنوان یک شاخص (gauge) در نظر بگیرید. حالت Fast mode دارای pool اختصاصی و هدرهای anthropic-fast-* مخصوص به خود است. تمام آنها را از هر فراخوانی موفق بخوانید:
curl -s -D - -o /dev/null https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-5","max_tokens":16,"messages":[{"role":"user","content":"hi"}]}' \
| grep -i 'ratelimit\|retry-after\|request-id'هر پاسخ همچنین دارای یک هدر منحصربهفرد request-id است، مانند req_018EeWyXxfu5pfWkrYcMdjWG. این مقدار در بدنه خطاها به صورت request_id و در پاسخهای SDK پایتون و تایپاسکریپت به صورت _request_id ظاهر میشود. هنگام تماس با پشتیبانی، این مقدار را ذکر کنید.
پیش از نوشتن یک حلقه backoff، بررسی کنید که آیا اصلاً به آن نیاز دارید یا خیر. SDKهای رسمی بهطور خودکار خطاهای گذرا، شامل خطاهای اتصال، محدودیت نرخ (rate limits) و خطاهای سرور 5xx را با استفاده از exponential backoff (بهصورت پیشفرض دو بار) و با رعایت هدر retry-after در صورت وجود، مجدداً تلاش میکنند. هر کلاینت یک گزینه maximum-retries برای تغییر یا غیرفعال کردن این رفتار میپذیرد.
import anthropic
client = anthropic.Anthropic(max_retries=5) # the SDK default is 2
try:
msg = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "hello"}],
)
except anthropic.RateLimitError as err:
headers = err.response.headers
print("still limited after retries; wait", headers.get("retry-after"), "seconds")
print("request id:", headers.get("request-id"))529 خطای overloaded تقصیر شما نیست
خطای 429 به این معناست که درخواستهای شما بیش از حد سریع بوده است. خطای 529 overloaded_error نشان میدهد که API بهطور موقت تحت فشار است و ممکن است زمانی رخ دهد که ترافیک کلی API از سوی تمامی کاربران بسیار بالا باشد. هیچکدام از این موارد به کلید (key) یا کد شما مربوط نمیشود. با استفاده از روش exponential backoff دوباره تلاش کنید (که SDKها بهصورت خودکار برای پاسخهای 5xx انجام میدهند) و اگر مشکل برطرف نشد، وضعیت را در status.claude.com بررسی کنید. خطای 500 api_error یک خطای داخلی است که باید به همان روش دوباره تلاش کنید؛ هیچکدام از این دو مورد، محدودیت نرخ (rate limit) محسوب نمیشوند.
به جای جدول، محدودیتهای خود را بخوانید
در یک اشتراک، /usage صفحهای است که اهمیت دارد. این صفحه نوارهای میزان مصرف طرح شما و جزئیات آنچه باعث مصرف آنها شده است را نمایش میدهد و d یا w امکان جابهجایی بین 24 ساعت گذشته و 7 روز گذشته را فراهم میکند. دو نکته را در نظر داشته باشید. بلوک Session میزان استفاده از توکن API را نشان میدهد و برای کاربران API در نظر گرفته شده است، بنابراین مشترکین میتوانند رقم دلاری آن را نادیده بگیرند. اعداد از تاریخچه نشست محلی روی آن دستگاه خاص استخراج میشوند، بنابراین میزان استفاده از دستگاه دیگر یا از طریق claude.ai در آن لحاظ نشده است.
در سمت API، صفحه Usage در Claude Console دو نمودار با نامهای "Rate Limit - Input Tokens" و "Rate Limit - Output Tokens" رسم میکند. نمودار ورودی، حداکثر توکنهای ورودی بدون کش (uncached) در هر دقیقه را در مقابل محدودیت ITPM فعلی شما ترسیم میکند و نرخ کش شما را در کنار آن نمایش میدهد تا بتوانید به جای مواجهه با محدودیت در محیط عملیاتی (production)، نزدیک شدن به آن را زیر نظر داشته باشید.
برای خواندن محدودیتهای پیکربندیشده به صورت برنامهنویسی:
curl -s https://api.anthropic.com/v1/organizations/rate_limits \
-H "x-api-key: $ANTHROPIC_ADMIN_KEY" \
-H "anthropic-version: 2023-06-01"این کار به یک کلید Admin API نیاز دارد و GET /v1/organizations/workspaces/{workspace_id}/rate_limits همین کار را برای هر فضای کاری (workspace) انجام میدهد. هر دو فقط خواندنی هستند: برای تغییر یک محدودیت، از زبانه Limits در Console استفاده کنید.
استفاده از less برای مواجهه با محدودیتهای کمتر
هر دو سیستم در لایه زیرین یک چیز را اندازهگیری میکنند، بنابراین این اهرمها روی هر دو کار میکنند.
- مصرف توکن در هر نوبت را کاهش دهید. دورههای کاری پیوسته باعث گرم ماندن کش میشوند و
/clearبین وظایف نامرتبط هزینهای ندارد. میزان مصرف توکن در Claude Code این اهرمها را بهطور کامل پوشش میدهد. - تلاش را کاهش دهید. سطوح عبارتند از
low،medium،high،xhighوmax. منوی/effortهمچنینultracodeرا ارائه میدهد که بهجای کاهش هزینه، آن را افزایش میدهد. استدلال عمیق روی یک تغییر نام مکانیکی هیچ دستاوردی ندارد. - پس از خطای 429، همروندی (concurrency) را کاهش دهید. مقدار
CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCYرا کم کنید و از اجرای تعداد زیادی subagent موازی بپرهیزید./statusرا نیز اجرا کنید: یکANTHROPIC_API_KEYسرگردان باعث میشود درخواستها بهجای اشتراک شما، از طریق یک کلید سطح پایین هدایت شوند. - کارهای غیرتعاملی را به Message Batches API منتقل کنید. این API حجمهای بزرگ را بهصورت ناهمگام و با 50% تخفیف روی توکنهای ورودی و خروجی اجرا میکند. این کار تحت محدودیتهای نرخ (rate limits) خاص خود انجام میشود، بنابراین یک job شبانه با نشست (session) شما رقابت نخواهد کرد.
کارهایی که دادهها را به context سرازیر میکنند، بیشترین فشار را وارد میکنند: اگر در حال تحلیل سهام و اختیار معامله بر اساس دادههای زنده بازار هستید، استخراج بخش کوچکی که هر پرسش نیاز دارد، کسری از هزینه چسباندن کل جداول قیمتها و زنجیرههاست. کارهای انفجاری که توسط برنامه هدایت میشوند (نه توسط انسان)، از همان ابتدا باید روی یک API key اجرا شوند. انتقال به آنجا نحوه پرداخت و نحوه اندازهگیری مصرف شما را تغییر میدهد، زیرا Claude API هیچ سطح رایگانی فراتر از اعتبار اندک زمان ثبتنام ندارد. اولین برنامه Claude API شما روی یک VPS نحوه مدیریت کلید و تلاشهای مجدد (retries) را پوشش میدهد، و اجرای طولانی یک agent در صورت قطع اتصال، با نگه داشتن Claude Code در حال اجرا روی یک VPS داخل tmux زنده میماند.
FAQ
چرا تغییر مدل، محدودیت استفاده من از Claude را برطرف نمیکند؟
زیرا محدودیتهای نشست (session) و هفتگی بین تمام مدلها مشترک هستند. سهمیه استفاده متعلق به طرح (plan) شماست، نه یک مدل خاص؛ بنابراین /model فقط تعیین میکند کدام مدل پاسخ دهد و تأثیری بر میزان سهمیه باقیمانده ندارد. تنها استثنا You've hit your Opus limit است که فقط برای درخواستهای Opus اعمال میشود. در آن مورد، تغییر مدل راهکار مستند برای رفع مشکل است.
خطای 429 rate_limit_error به چه معناست و چقدر باید منتظر بمانم؟
این خطا به این معنی است که حساب شما به سقف نرخ مجاز برای آن کلاس از مدل رسیده است: تعداد درخواست در دقیقه، توکنهای ورودی در دقیقه یا توکنهای خروجی در دقیقه. پاسخ دریافتی حاوی هدر retry-after است که تعداد ثانیههای انتظار را مشخص میکند و تلاشهای زودهنگام برای ارسال مجدد با شکست مواجه میشوند. SDKهای رسمی بهطور پیشفرض محدودیتهای نرخ و خطاهای 5xx را با استفاده از exponential backoff (دو بار بهصورت پیشفرض) و با رعایت آن هدر، مجدداً تلاش میکنند. دریافت خطای 429 در حالی که هنوز در محدوده سقف طرح خود هستید، نشاندهنده محدودیت شتاب (acceleration limit) ناشی از افزایش ناگهانی حجم درخواستهاست.
چگونه محدودیتهای استفاده از Claude و زمان بازنشانی آنها را مشاهده کنم؟
در Claude Code، دستور /usage را برای مشاهده نوارهای وضعیت طرح، زمانهای بازنشانی و جزئیات مصرف اجرا کنید؛ /cost یک نام مستعار برای همین دستور است و d یا w بین نمایش بازه 24 ساعت گذشته و 7 روز گذشته سوئیچ میکنند. این ارقام از تاریخچه نشست محلی استخراج میشوند، بنابراین استفاده از سایر دستگاهها و claude.ai در آنها لحاظ نمیشود. در API، کنسول نمودار محدودیتهای نرخ شما را نمایش میدهد و GET /v1/organizations/rate_limits با استفاده از یک کلید Admin API، محدودیتهای پیکربندیشده شما را بازمیگرداند.
آیا میتوانم پس از رسیدن به سقف طرح Claude، به کار ادامه دهم؟
گاهی اوقات. دستور /usage-credits را اجرا کنید تا در طرحهای Pro و Max سهمیه اضافی خریداری کنید، یا در طرحهای Team و Enterprise از مدیر سیستم درخواست سهمیه کنید؛ این کار نیازمند ورود به claude.ai از طریق /login است و با احراز هویت از طریق کلید API در دسترس نیست. در غیر این صورت، تا زمان بازنشانی منتظر بمانید، اگر محدودیت مربوط به Opus بود مدل را تغییر دهید، یا کار را به یک کلید API منتقل کنید که به جای بازههای زمانی، بر اساس دقیقه محاسبه میشود.