SSD Nodes Learn Hosting plans →
راهنماها Matt Connorتوسط Matt Connor · به‌روزرسانی شده 2026-08-27

رفع محدودیت استفاده از Claude و خطای 429

اگر با محدودیت استفاده در Claude مواجه شدید، تغییر مدل مشکل را حل نمی‌کند. تفاوت سهمیه چرخشی اشتراک با خطای HTTP 429 در API و نحوه مدیریت زمان انتظار را اینجا بیاموزید.

محدودیت‌های استفاده از Claude چیست؟

محدودیت‌های استفاده از Claude در دو سیستم مجزا تعریف می‌شوند و اولین گام، تشخیص این است که کدام‌یک باعث توقف فعالیت شما شده است. اشتراک Claude (شامل Pro، Max، Team یا Enterprise) یک سهمیه استفاده چرخشی (rolling usage allowance) در اختیار شما قرار می‌دهد که بین مدل‌های مختلف و چت Claude مشترک است؛ بنابراین در صورت اتمام آن، با پیامی مشابه You've hit your session limit · resets 3:45pm مواجه می‌شوید. API سرویس Claude معیار متفاوتی دارد: سرعت ارسال درخواست‌ها و توکن‌ها که به‌صورت تعداد در دقیقه محاسبه می‌شود. در صورت عبور از این حد، با خطای HTTP 429 از نوع rate_limit_error و یک هدر retry-after مواجه می‌شوید که مدت‌زمان انتظار به ثانیه را مشخص می‌کند.

راهکارهای رفع این دو محدودیت کاملاً متفاوت هستند. محدودیت اشتراک به میزان استفاده شما در یک بازه زمانی بستگی دارد؛ بنابراین باید تا زمان بازنشانی (reset) صبر کنید یا سهمیه بیشتری خریداری نمایید. محدودیت نرخ (rate limit) در API به سرعت فعلی شما مربوط است و به‌محض کاهش سرعت، پس از چند ثانیه برطرف می‌شود.

سهمیه‌های طرح‌ها و اعداد مربوط به سطوح محدودیت نرخ به‌طور مداوم تغییر می‌کنند و درج عدد اشتباه، بدتر از عدم درج آن است؛ به همین دلیل در اینجا عددی ذکر نشده است. برای مشاهده محدودیت‌های اختصاصی خود، از دستوراتی که در ادامه آمده است استفاده کنید.

به کدام محدودیت برخورد کرده‌اید؟ پیام دقیق را بخوانید

Claude Code نام سیستم را در متنی که چاپ می‌کند ذکر می‌کند. پیش از هر تغییری، نام سیستم خود را با موارد زیر تطبیق دهید.

  • You've hit your session limit · resets 3:45pm یک محدودیت اشتراک است. سهمیهٔ چرخشی طرح شما برای این بازهٔ زمانی به پایان رسیده است.
  • You've hit your weekly limit · resets Mon 12:00am همان سیستم است که در بازهٔ زمانی طولانی‌تری اعمال می‌شود.
  • You've hit your Opus limit · resets 3:45pm یک محدودیت اشتراک است که فقط برای درخواست‌های Opus اعمال می‌شود. این تنها موردی است که تغییر مدل در آن کمک می‌کند.
  • API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com. یک محدودیت نرخ API است. شما به محدودیتی که برای API key خود یا برای پروژهٔ Amazon Bedrock یا Google Cloud تنظیم شده، برخورد کرده‌اید. اینکه کدام‌یک از این موارد اعمال می‌شود به نحوهٔ احراز هویت کلاینت بستگی دارد، زیرا کلاینت Bedrock یا Vertex به جای سازمان Anthropic، بر اساس سهمیهٔ پروژهٔ ابری شما محاسبه می‌شود.
  • API Error: Server is temporarily limiting requests (not your usage limit) یک محدودیت موقت (throttle) است که به سهمیهٔ طرح شما ارتباطی ندارد. Claude Code پیش از نمایش این خط، به‌طور خودکار با استفاده از مکانیزم backoff تلاش مجدد می‌کند.

محدودیت‌های اشتراک: نشست، هفتگی و بازه زمانی Opus

طرح اشتراک شامل یک سهمیه مصرف متغیر (rolling) است. هنگامی که این سهمیه به پایان می‌رسد، Claude Code درخواست‌های بعدی را تا زمان بازنشانی که در پیام نمایش داده شده است، مسدود می‌کند. دو ویژگی این سهمیه باعث ایجاد بیشترین سردرگمی می‌شود.

  • این سهمیه با Claude chat مشترک است. کاری که در claude.ai انجام می‌دهید از همان سهمیه‌ای استفاده می‌کند که کار در ترمینال از آن بهره می‌برد؛ بنابراین یک بعدازظهر پرکار در چت، زمان کدنویسی شما در عصر را کاهش می‌دهد. هر محیطی که با آن حساب کاربری وارد شوید از همان منبع مشترک استفاده می‌کند؛ بنابراین در لینوکس، نسخه بتای دسکتاپ و Claude Code CLI یک سهمیه واحد را بین خود تقسیم می‌کنند، نه اینکه برای هر کدام یک سهمیه جداگانه داشته باشند.
  • این سهمیه بین مدل‌ها مشترک است. محدودیت‌های نشست و هفتگی بودجه‌بندی جداگانه‌ای برای هر مدل ندارند، به استثنای محدودیت Opus.

در Claude for Teams و Enterprise، ساختار مستند شده به صورت سهمیه برای هر کاربر (seat) است که در یک بازه زمانی متغیر پنج‌ساعته و یک بازه هفتگی بازنشانی می‌شود، با Claude chat و Cowork مشترک است و بر اساس سطح اشتراک (Standard یا Premium) تعیین می‌شود. در طرح‌های Pro و Max، زمان بازنشانی درج‌شده در پیام و /usage شما، اعداد قابل استناد هستند، نه ارقامی که از یک پست وبلاگی کپی شده باشند. اگر هنوز در حال انتخاب سطح اشتراک هستید، اینکه به کدام طرح Claude نیاز دارید تفاوت‌های هر سطح را مقایسه می‌کند.

چرا تغییر مدل با استفاده از /model دسترسی را بازیابی نمی‌کند

این رایج‌ترین اقدام اشتباه است و مستندات به‌صراحت به آن اشاره کرده‌اند: محدودیت‌های نشست (session) و هفتگی بین تمام مدل‌ها مشترک هستند، بنابراین تغییر مدل باعث بازیابی دسترسی نمی‌شود. انتخاب یک مدل کوچک‌تر پس از پایان سهمیهٔ نشست، فقط مدل پاسخ‌دهنده را تغییر می‌دهد. این کار میزان سهمیهٔ باقی‌مانده را تغییر نمی‌دهد، زیرا سهمیه هرگز به‌صورت تفکیک‌شده برای هر مدل در نظر گرفته نشده است؛ بنابراین تغییر مدل چیزی برای آزاد کردن ندارد.

استثنا، محدودیت Opus است که یک سقف کاملاً اختصاصی برای همان مدل محسوب می‌شود. اگر پیام خطا You've hit your Opus limit را مشاهده کردید، آنگاه /model راهکار صحیح است. به مدل دیگری تغییر وضعیت دهید و به کار خود ادامه دهید، زیرا فقط درخواست‌های Opus مسدود شده بودند.

برخورد با محدودیت به‌عنوان یک باگ، دومین اقدام اشتباه است. نصب مجدد یا احراز هویت دوباره هیچ تغییری ایجاد نمی‌کند. سهمیه زمانی بازمی‌گردد که بازهٔ زمانی مربوطه ریست شود یا اعتبار مصرف خریداری کنید.

هنگام رسیدن به محدودیت اشتراک چه باید کرد

  1. زمان بازنشانی را بخوانید. پنجرهٔ نشست کوتاه است. پنجرهٔ هفتگی چیزی نیست که بخواهید پشت میز خود منتظر پایانش بمانید.
  2. اگر محدودیت مربوط به Opus است، دستور /model را اجرا کرده و مدل دیگری را انتخاب کنید.
  3. دستور /usage را اجرا کنید تا محدودیت‌های طرح، میزان مصرف و زمان بازنشانی آن‌ها را ببینید. /cost یک نام مستعار (alias) برای همان صفحه است.
  4. دستور /usage-credits را اجرا کنید تا بتوانید پس از رسیدن به سقف مجاز، به کار خود ادامه دهید. در طرح‌های Pro و Max، این دستور تنظیمات صورت‌حساب شما را باز می‌کند. در طرح‌های Team و Enterprise، تنظیمات مصرف سازمان شما را باز می‌کند یا اگر دسترسی صورت‌حساب ندارید، درخواستی برای مدیران شما ارسال می‌کند.
  5. اگر هر هفته به همان بن‌بست می‌رسید، این طرح برای نحوهٔ کار شما مناسب نیست و راه‌های خروج از محدودیت مصرف ارزش آن را دارند که یک‌بار برای همیشه بررسی شوند، نه اینکه هر بار هنگام بازنشانی با آن‌ها درگیر شوید.

/usage-credits نیازمند اشتراک claude.ai است که از طریق /login وارد شده باشد. این قابلیت با احراز هویت از طریق API key در دسترس نیست، زیرا API key فاقد سهمیهٔ طرح برای افزایش است.

اعتبار مصرف (Usage credits) یک اثر جانبی دارد که دانستن آن پیش از هر چیز ضروری است. طول عمر کشِ پرامپت (prompt cache) در حالت اشتراک یک ساعت است، اما به محض اینکه از اعتبار استفاده کنید، به پنج دقیقه کاهش می‌یابد؛ بنابراین دفعات بیشتری کار را از حالت سرد (cold) شروع می‌کنید و مصرف توکن در Claude Code برای همان حجم کار افزایش می‌یابد.

پیام‌هایی که شبیه محدودیت استفاده هستند اما نیستند

چهار خطای Claude Code گزارش می‌شوند که به نظر محدودیت استفاده می‌آیند، اما هیچ‌کدام از آن‌ها محدودیت استفاده نیستند.

  • هشدار context یا auto-compact یک محدودیت استفاده نیست. /context زمانی که طول گفتگو از پنجره context مدل فراتر می‌رود، خطی مانند Context exceeds the 200k-token limit by 94k tokens — run /compact or /clear to continue. را چاپ می‌کند. تاریخچه قدیمی‌تر برای آزاد کردن فضا خلاصه می‌شود و سهمیه طرح شما دست‌نخورده باقی می‌ماند.
  • Error during compaction: Conversation too long. Press esc twice to go up a few messages and try again. به این معنی است که خود /compact شکست خورده است، زیرا فضای context آزاد کافی برای نگهداری خلاصه‌ای که باید تولید کند، وجود ندارد.
  • Credit balance is too low به این معنی است که اعتبار پیش‌پرداخت سازمان Console شما تمام شده است. اعتبار را در platform.claude.com/settings/billing اضافه کنید که قابلیت شارژ خودکار (auto-reload) را نیز ارائه می‌دهد.
  • API Error: Usage credits required for 1M context · run /usage-credits to turn them on, or /model to switch to standard context یک بررسی حق اشتراک است، نه اتمام سهمیه. مدل بدون پسوند [1m] را انتخاب کنید یا CLAUDE_CODE_DISABLE_1M_CONTEXT=1 را تنظیم نمایید.

یک مورد دیگر از سمت API است. خطای 413 request_too_large یک محدودیت اندازه برای یک درخواست واحد است، نه محدودیت نرخ (rate limit).

محدودیت‌های نرخ API: شمارش واقعی خطای 429

Messages API سه مورد را به‌صورت جداگانه برای هر کلاس مدل اندازه‌گیری می‌کند.

  • تعداد درخواست در دقیقه (RPM)
  • تعداد توکن‌های ورودی در دقیقه (ITPM)
  • تعداد توکن‌های خروجی در دقیقه (OTPM)

سازمان شما همچنین یک سقف هزینه (spend limit) دارد که موضوع متفاوتی است: حداکثر هزینه ماهانه برای استفاده از API. هنگامی که به سقف هزینه تعیین‌شده برای سطح (tier) خود برسید، استفاده از API تا ماه بعد متوقف می‌شود، مگر اینکه درخواست افزایش سقف بدهید. هیچ حلقه تکرار (retry loop) این مشکل را حل نمی‌کند.

چهار مکانیسم تعیین می‌کنند که خطای 429 چه زمانی رخ می‌دهد.

  • محدودیت‌ها بر اساس کلاس مدل هستند. این محدودیت‌ها برای هر مدل به‌طور جداگانه اعمال می‌شوند، بنابراین می‌توانید از مدل‌های مختلف تا سقف محدودیت‌های مربوط به هر کدام به‌طور همزمان استفاده کنید. برخی خانواده‌ها از یک مخزن مشترک استفاده می‌کنند: محدودیت نرخ Opus مجموع کل برای Claude Opus 4.8، Opus 4.7، Opus 4.6 و Opus 4.5 است، در حالی که Claude Sonnet 5 مخزن اختصاصی خود را دارد.
  • ظرفیت به‌طور مداوم پر می‌شود. این API از الگوریتم token bucket استفاده می‌کند، بنابراین ظرفیت به‌جای بازنشانی در یک لحظه ثابت، به‌طور مداوم پر می‌شود. محدودیت 60 درخواست در دقیقه ممکن است به صورت یک درخواست در ثانیه اعمال شود، بنابراین ارسال 60 درخواست به‌صورت همزمان همچنان با خطا مواجه می‌شود.
  • در اکثر مدل‌ها، فقط ورودی‌های بدون کش (uncached) در ITPM محاسبه می‌شوند. input_tokens و cache_creation_input_tokens محاسبه می‌شوند. cache_read_input_tokens در اکثر مدل‌های Claude محاسبه نمی‌شود، که Claude Haiku 3.5 استثنای مستند آن است. بنابراین، استفاده از کش علاوه بر تخفیف، فضای بیشتری برای محدودیت نرخ ایجاد می‌کند. در سمت خروجی، یک max_tokens بالا در OTPM محاسبه نمی‌شود، زیرا OTPM فقط توکن‌هایی را می‌شمارد که واقعاً تولید شده‌اند.
  • محدودیت‌ها در سطح سازمان اعمال می‌شوند. می‌توان برای یک فضای کاری (workspace) محدودیت کمتری تعیین کرد، و محدودیت‌های کل سازمان همیشه اعمال می‌شوند، حتی اگر مجموع محدودیت‌های فضاهای کاری بیشتر از آن باشد. محدودیتی که در یک فضای کاری تغییر نداده‌اید، از سازمان به ارث می‌رسد و به معنای نامحدود بودن آن نیست.

سطوح Start، Build، Scale و Custom اعداد واقعی را تعیین می‌کنند که به‌طور خودکار بر اساس تاریخچه استفاده و وضعیت حساب شما اختصاص می‌یابند. سازمان‌های جدید ممکن است با محدودیت‌هایی کمتر از مقادیر استاندارد منتشرشده شروع کنند، بنابراین اولین خطای 429 ممکن است زودتر از آنچه جدول پیش‌بینی می‌کند، رخ دهد. افزایش ناگهانی در استفاده، محدودیت‌های شتاب‌دهنده (acceleration limits) را فعال می‌کند که حتی اگر هنوز در محدوده سطح خود باشید، خطای 429 برمی‌گردانند؛ بنابراین ترافیک خود را به‌تدریج افزایش دهید. هر عدد منتشرشده یک سقف است: محدودیت‌های مستندشده حداکثر استفاده مجاز هستند، نه حداقل‌های تضمین‌شده. برای درخواست افزایش، از کنترل "Request rate limit increase" در صفحه Limits در Claude Console استفاده کنید.

خواندن خطای 429: retry-after، هدرها و تلاش مجدد در SDK

هر خطای API یک پاکت (envelope) یکسان برمی‌گرداند: یک شیء تو در توی error که حاوی نوع و پیام خطا است، به علاوه یک request_id در سطح بالا.

{
  "type": "error",
  "error": {
    "type": "rate_limit_error",
    "message": "<names the rate limit you exceeded>"
  },
  "request_id": "req_011CSHoEeqs5C35K2UUqR7Fy"
}

سایر اطلاعات در هدرها قرار دارند.

  • retry-after تعداد ثانیه‌هایی است که باید تا زمان امکان ارسال مجدد درخواست صبر کنید. تلاش‌های زودهنگام با شکست مواجه می‌شوند.
  • anthropic-ratelimit-requests-limit، anthropic-ratelimit-requests-remaining و anthropic-ratelimit-requests-reset بودجه درخواست شما را توصیف می‌کنند.
  • anthropic-ratelimit-input-tokens-* و anthropic-ratelimit-output-tokens-* همین کار را برای ITPM و OTPM با پسوندهای مشابه limit، remaining و reset انجام می‌دهند.
  • anthropic-ratelimit-tokens-* مقادیر مربوط به محدودکننده‌ترین حد مجاز که در حال حاضر اعمال شده است را نمایش می‌دهد.

هدرهای reset بر اساس فرمت زمانی RFC 3339 هستند. هدرهای remaining token به نزدیک‌ترین هزار گرد می‌شوند، بنابراین آن‌ها را به عنوان یک شاخص (gauge) در نظر بگیرید. حالت Fast mode دارای pool اختصاصی و هدرهای anthropic-fast-* مخصوص به خود است. تمام آن‌ها را از هر فراخوانی موفق بخوانید:

curl -s -D - -o /dev/null https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{"model":"claude-sonnet-5","max_tokens":16,"messages":[{"role":"user","content":"hi"}]}' \
  | grep -i 'ratelimit\|retry-after\|request-id'

هر پاسخ همچنین دارای یک هدر منحصربه‌فرد request-id است، مانند req_018EeWyXxfu5pfWkrYcMdjWG. این مقدار در بدنه خطاها به صورت request_id و در پاسخ‌های SDK پایتون و تایپ‌اسکریپت به صورت _request_id ظاهر می‌شود. هنگام تماس با پشتیبانی، این مقدار را ذکر کنید.

پیش از نوشتن یک حلقه backoff، بررسی کنید که آیا اصلاً به آن نیاز دارید یا خیر. SDKهای رسمی به‌طور خودکار خطاهای گذرا، شامل خطاهای اتصال، محدودیت نرخ (rate limits) و خطاهای سرور 5xx را با استفاده از exponential backoff (به‌صورت پیش‌فرض دو بار) و با رعایت هدر retry-after در صورت وجود، مجدداً تلاش می‌کنند. هر کلاینت یک گزینه maximum-retries برای تغییر یا غیرفعال کردن این رفتار می‌پذیرد.

import anthropic

client = anthropic.Anthropic(max_retries=5)  # the SDK default is 2

try:
    msg = client.messages.create(
        model="claude-sonnet-5",
        max_tokens=1024,
        messages=[{"role": "user", "content": "hello"}],
    )
except anthropic.RateLimitError as err:
    headers = err.response.headers
    print("still limited after retries; wait", headers.get("retry-after"), "seconds")
    print("request id:", headers.get("request-id"))

529 خطای overloaded تقصیر شما نیست

خطای 429 به این معناست که درخواست‌های شما بیش از حد سریع بوده است. خطای 529 overloaded_error نشان می‌دهد که API به‌طور موقت تحت فشار است و ممکن است زمانی رخ دهد که ترافیک کلی API از سوی تمامی کاربران بسیار بالا باشد. هیچ‌کدام از این موارد به کلید (key) یا کد شما مربوط نمی‌شود. با استفاده از روش exponential backoff دوباره تلاش کنید (که SDKها به‌صورت خودکار برای پاسخ‌های 5xx انجام می‌دهند) و اگر مشکل برطرف نشد، وضعیت را در status.claude.com بررسی کنید. خطای 500 api_error یک خطای داخلی است که باید به همان روش دوباره تلاش کنید؛ هیچ‌کدام از این دو مورد، محدودیت نرخ (rate limit) محسوب نمی‌شوند.

به جای جدول، محدودیت‌های خود را بخوانید

در یک اشتراک، /usage صفحه‌ای است که اهمیت دارد. این صفحه نوارهای میزان مصرف طرح شما و جزئیات آنچه باعث مصرف آن‌ها شده است را نمایش می‌دهد و d یا w امکان جابه‌جایی بین 24 ساعت گذشته و 7 روز گذشته را فراهم می‌کند. دو نکته را در نظر داشته باشید. بلوک Session میزان استفاده از توکن API را نشان می‌دهد و برای کاربران API در نظر گرفته شده است، بنابراین مشترکین می‌توانند رقم دلاری آن را نادیده بگیرند. اعداد از تاریخچه نشست محلی روی آن دستگاه خاص استخراج می‌شوند، بنابراین میزان استفاده از دستگاه دیگر یا از طریق claude.ai در آن لحاظ نشده است.

در سمت API، صفحه Usage در Claude Console دو نمودار با نام‌های "Rate Limit - Input Tokens" و "Rate Limit - Output Tokens" رسم می‌کند. نمودار ورودی، حداکثر توکن‌های ورودی بدون کش (uncached) در هر دقیقه را در مقابل محدودیت ITPM فعلی شما ترسیم می‌کند و نرخ کش شما را در کنار آن نمایش می‌دهد تا بتوانید به جای مواجهه با محدودیت در محیط عملیاتی (production)، نزدیک شدن به آن را زیر نظر داشته باشید.

برای خواندن محدودیت‌های پیکربندی‌شده به صورت برنامه‌نویسی:

curl -s https://api.anthropic.com/v1/organizations/rate_limits \
  -H "x-api-key: $ANTHROPIC_ADMIN_KEY" \
  -H "anthropic-version: 2023-06-01"

این کار به یک کلید Admin API نیاز دارد و GET /v1/organizations/workspaces/{workspace_id}/rate_limits همین کار را برای هر فضای کاری (workspace) انجام می‌دهد. هر دو فقط خواندنی هستند: برای تغییر یک محدودیت، از زبانه Limits در Console استفاده کنید.

استفاده از less برای مواجهه با محدودیت‌های کمتر

هر دو سیستم در لایه زیرین یک چیز را اندازه‌گیری می‌کنند، بنابراین این اهرم‌ها روی هر دو کار می‌کنند.

  • مصرف توکن در هر نوبت را کاهش دهید. دوره‌های کاری پیوسته باعث گرم ماندن کش می‌شوند و /clear بین وظایف نامرتبط هزینه‌ای ندارد. میزان مصرف توکن در Claude Code این اهرم‌ها را به‌طور کامل پوشش می‌دهد.
  • تلاش را کاهش دهید. سطوح عبارتند از low، medium، high، xhigh و max. منوی /effort همچنین ultracode را ارائه می‌دهد که به‌جای کاهش هزینه، آن را افزایش می‌دهد. استدلال عمیق روی یک تغییر نام مکانیکی هیچ دستاوردی ندارد.
  • پس از خطای 429، هم‌روندی (concurrency) را کاهش دهید. مقدار CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY را کم کنید و از اجرای تعداد زیادی subagent موازی بپرهیزید. /status را نیز اجرا کنید: یک ANTHROPIC_API_KEY سرگردان باعث می‌شود درخواست‌ها به‌جای اشتراک شما، از طریق یک کلید سطح پایین هدایت شوند.
  • کارهای غیرتعاملی را به Message Batches API منتقل کنید. این API حجم‌های بزرگ را به‌صورت ناهمگام و با 50% تخفیف روی توکن‌های ورودی و خروجی اجرا می‌کند. این کار تحت محدودیت‌های نرخ (rate limits) خاص خود انجام می‌شود، بنابراین یک job شبانه با نشست (session) شما رقابت نخواهد کرد.

کارهایی که داده‌ها را به context سرازیر می‌کنند، بیشترین فشار را وارد می‌کنند: اگر در حال تحلیل سهام و اختیار معامله بر اساس داده‌های زنده بازار هستید، استخراج بخش کوچکی که هر پرسش نیاز دارد، کسری از هزینه چسباندن کل جداول قیمت‌ها و زنجیره‌هاست. کارهای انفجاری که توسط برنامه هدایت می‌شوند (نه توسط انسان)، از همان ابتدا باید روی یک API key اجرا شوند. انتقال به آنجا نحوه پرداخت و نحوه اندازه‌گیری مصرف شما را تغییر می‌دهد، زیرا Claude API هیچ سطح رایگانی فراتر از اعتبار اندک زمان ثبت‌نام ندارد. اولین برنامه Claude API شما روی یک VPS نحوه مدیریت کلید و تلاش‌های مجدد (retries) را پوشش می‌دهد، و اجرای طولانی یک agent در صورت قطع اتصال، با نگه داشتن Claude Code در حال اجرا روی یک VPS داخل tmux زنده می‌ماند.

FAQ

چرا تغییر مدل، محدودیت استفاده من از Claude را برطرف نمی‌کند؟

زیرا محدودیت‌های نشست (session) و هفتگی بین تمام مدل‌ها مشترک هستند. سهمیه استفاده متعلق به طرح (plan) شماست، نه یک مدل خاص؛ بنابراین /model فقط تعیین می‌کند کدام مدل پاسخ دهد و تأثیری بر میزان سهمیه باقی‌مانده ندارد. تنها استثنا You've hit your Opus limit است که فقط برای درخواست‌های Opus اعمال می‌شود. در آن مورد، تغییر مدل راهکار مستند برای رفع مشکل است.

خطای 429 rate_limit_error به چه معناست و چقدر باید منتظر بمانم؟

این خطا به این معنی است که حساب شما به سقف نرخ مجاز برای آن کلاس از مدل رسیده است: تعداد درخواست در دقیقه، توکن‌های ورودی در دقیقه یا توکن‌های خروجی در دقیقه. پاسخ دریافتی حاوی هدر retry-after است که تعداد ثانیه‌های انتظار را مشخص می‌کند و تلاش‌های زودهنگام برای ارسال مجدد با شکست مواجه می‌شوند. SDKهای رسمی به‌طور پیش‌فرض محدودیت‌های نرخ و خطاهای 5xx را با استفاده از exponential backoff (دو بار به‌صورت پیش‌فرض) و با رعایت آن هدر، مجدداً تلاش می‌کنند. دریافت خطای 429 در حالی که هنوز در محدوده سقف طرح خود هستید، نشان‌دهنده محدودیت شتاب (acceleration limit) ناشی از افزایش ناگهانی حجم درخواست‌هاست.

چگونه محدودیت‌های استفاده از Claude و زمان بازنشانی آن‌ها را مشاهده کنم؟

در Claude Code، دستور /usage را برای مشاهده نوارهای وضعیت طرح، زمان‌های بازنشانی و جزئیات مصرف اجرا کنید؛ /cost یک نام مستعار برای همین دستور است و d یا w بین نمایش بازه 24 ساعت گذشته و 7 روز گذشته سوئیچ می‌کنند. این ارقام از تاریخچه نشست محلی استخراج می‌شوند، بنابراین استفاده از سایر دستگاه‌ها و claude.ai در آن‌ها لحاظ نمی‌شود. در API، کنسول نمودار محدودیت‌های نرخ شما را نمایش می‌دهد و GET /v1/organizations/rate_limits با استفاده از یک کلید Admin API، محدودیت‌های پیکربندی‌شده شما را بازمی‌گرداند.

آیا می‌توانم پس از رسیدن به سقف طرح Claude، به کار ادامه دهم؟

گاهی اوقات. دستور /usage-credits را اجرا کنید تا در طرح‌های Pro و Max سهمیه اضافی خریداری کنید، یا در طرح‌های Team و Enterprise از مدیر سیستم درخواست سهمیه کنید؛ این کار نیازمند ورود به claude.ai از طریق /login است و با احراز هویت از طریق کلید API در دسترس نیست. در غیر این صورت، تا زمان بازنشانی منتظر بمانید، اگر محدودیت مربوط به Opus بود مدل را تغییر دهید، یا کار را به یک کلید API منتقل کنید که به جای بازه‌های زمانی، بر اساس دقیقه محاسبه می‌شود.