محدودیت Claude تمام شده؟ قدم بعدی چیست؟
اگر پیام «Claude usage limit reached» را میبینید، ابتدا مشخص کنید باید تا پایان کدام بازه صبر کنید؛ سپس مدل کوچکتر، context کوتاهتر، اعتبار مصرف یا API را انتخاب کنید.
کدام محدودیت Claude را فعال کردهاید
پیام رسیدن به محدودیت Claude، بازهای را که باید منتظر بمانید مشخص میکند و همین بازه تعیین میکند بعداً چه کاری میتوانید انجام دهید. محدودیتهای session و weekly بهطور همزمان برای همه مدلها اعمال میشوند؛ بنابراین تغییر مدل دسترسی شما را برنمیگرداند. محدودیتی که نام یک مدل را مشخص میکند، استثناست: میتوانید مدل را تغییر دهید و کار را ادامه دهید، درحالیکه همان مدل همچنان مسدود است.
Claude Code بازه و زمان reset آن را در همان خط نمایش میدهد:
You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pmبازه session بهصورت چرخشی 5 ساعته است. بازههای weekly هر هفته در زمان ثابتی reset میشوند که به حساب شما اختصاص داده شده است؛ بنابراین روز و ساعت آن از یک هفته تا هفته بعد ثابت میماند. پلن Pro علاوه بر بازه session پنجساعته، یک محدودیت weekly دارد که برای همه مدلها اعمال میشود. پلن Max یک محدودیت weekly دوم نیز اضافه میکند که فقط برای یک خانواده مدل اعمال میشود. سقف این محدودیتها در شرح کامل محدودیتهای استفاده از Claude آمده است. این صفحه از جایی ادامه مییابد که آن صفحه پایان مییابد.
نکتهای که بسیاری را غافلگیر میکند این است که هر درخواست همزمان از بازه session و بازه weekly کسر میشود. بنابراین ممکن است یک بعدازظهر پرمصرف، سهمیه weekly را تمام کند، درحالیکه بازه پنجساعته هنوز ظرفیت داشته باشد. پیش از برنامهریزی برای ادامه روز، زمان reset را بررسی کنید. reset در ساعت 3:45pm مانند یک وقفه کوتاه است. reset در نیمهشب دوشنبه چنین وضعیتی ندارد.
پیش از حدسزدن، میزان مصرف را بررسی کنید
در claude.ai، Settings و سپس Usage را باز کنید. نوارهای پیشرفت نشان میدهند چه مقدار از پنجرهٔ جلسهٔ پنجساعته و هر پنجرهٔ هفتگی را مصرف کردهاید؛ بنابراین میتوانید ببینید کدامیک خالی شده است و نیازی به حدسزدن ندارید.
در Claude Code، /usage را اجرا کنید. این دستور همان نوارهای مربوط به پلن را بههمراه تفکیکی از محل مصرف اخیر نشان میدهد. این مصرف بر اساس skills، subagents، plugins و سرورهای MCP (model context protocol) منفرد، بهصورت درصدی از کل مصرف، نسبت داده میشود. برای 24 ساعت گذشته d و برای 7 روز گذشته w را فشار دهید. این بخش همچنین هر الگویی را که 10% یا بیشتر از مصرف اخیر را تشکیل دهد علامتگذاری میکند. دو موردی که بیشتر از همه میبینید، context طولانی و cache miss هستند.
دو نکته را در نظر داشته باشید. این تفکیک بر اساس سابقهٔ session ذخیرهشده روی همان دستگاه محاسبه میشود؛ بنابراین کاری که روی laptop دیگر یا در claude.ai انجام دادهاید، در آن وجود ندارد. همچنین رقم دلاری در بخش Session در بالای صفحه، بر اساس نرخهای فهرستی استاندارد برای کاربران API (application programming interface) محاسبه میشود. بنابراین اگر subscription دارید، این رقم مبلغ صورتحساب شما نیست.
آیا تغییر به یک مدل کوچکتر کمک میکند؟
فقط زمانی که پیام نام یک مدل را مشخص کند. پس از You've hit your Opus limit، /model را اجرا کنید، Sonnet یا Haiku را انتخاب کنید و session با تمام context موجود ادامه پیدا میکند. پس از You've hit your session limit یا You've hit your weekly limit، /model هیچ تغییری ایجاد نمیکند، زیرا این windowها بین همه مدلها مشترک هستند.
تغییر مدل پیش از رسیدن به سقف مصرف، بسیار بیشتر از تغییر پس از آن ارزش دارد. Sonnet بیشتر کارهای coding را با کسری از نرخ Opus انجام میدهد؛ بنابراین، پیشفرض نگهداشتن Opus یکی از دو عادتی است که بیشترین مصرف غیرمنتظره را ایجاد میکنند. عادت دیگر، sessionی است که هرگز clear نمیشود. ویرایشهای مکانیکی و triage لاگ را به Haiku بسپارید و Opus را برای تصمیم طراحیای نگه دارید که واقعاً در آن به نتیجه نمیرسید. انتخاب بین Opus، Sonnet و Haiku توضیح میدهد هر مدل در چه شرایطی ارزش هزینه خود را دارد.
پرداخت برای contextی را که دیگر استفاده نمیکنید متوقف کنید
Claude Code کل conversation شما را همراه هر request ارسال میکند و هر بار که Claude از یک tool استفاده میکند، request دیگری همراه با همان دسته از نتایج tool ارسال میشود. Prompt caching باعث میشود history با نرخ cached دوباره خوانده شود، نه با نرخ کامل input؛ بنابراین هزینه را کاهش میدهد، اما آن را رایگان نمیکند. در نتیجه، یک سؤال یکخطی در sessionی که از صبح باز نگه داشتهاید، همچنان برای کل conversation مصرف ایجاد میکند.
/context
/clear
/compact Focus on the failing tests and the files we changed/clear هیچ هزینهای ندارد، چون context را دور میاندازد و آن را نمیخواند. /compact باید conversationای را که خلاصه میکند بخواند؛ بنابراین compact کردن یک context بسیار بزرگ، خودش یک request بزرگ است. وقتی به کار نامرتبطی میپردازید از /clear استفاده کنید و /compact را فقط زمانی بهکار ببرید که در میانهٔ task هستید و لازم است thread حفظ شود. پیش از پاککردن، /rename را اجرا کنید تا بعداً بتوانید session را با /resume دوباره پیدا کنید.
طول عمر cache بیش از چیزی که بیشتر افراد انتظار دارند اهمیت دارد. در subscription، cache بهمدت یک ساعت باقی میماند. وقتی از usage credits استفاده میکنید، این مدت به پنج دقیقه کاهش مییابد و پنج دقیقه نیز مقدار پیشفرض برای API key است. نخستین پیام پس از یک ناهار طولانی cache را از دست میدهد و کل context را با قیمت کامل input دوباره پردازش میکند؛ به همین دلیل usage اغلب بدون دلیل ظاهری افزایش مییابد. Prompt caching چه زمانی هزینهٔ خود را جبران میکند محاسبات این موضوع را توضیح میدهد.
سه اهرم دیگر نیز در همین بخش قرار دارند. /mcp سرورهای پیکربندیشده را فهرست میکند تا بتوانید سرورهایی را که این task به آنها نیاز ندارد خاموش کنید. یک CLAUDE.md طولانی در شروع session بارگذاری میشود، چه کار به آن نیاز داشته باشد و چه نداشته باشد؛ بنابراین دستورهای تخصصی را به skills منتقل کنید تا فقط هنگام فراخوانی بارگذاری شوند. همچنین extended thinking بهعنوان output tokens محاسبه میشود و بخش پرهزینهتر است؛ بنابراین آن را با /effort کاهش دهید، در /config خاموش کنید یا در مدلی با بودجهٔ ثابت برای thinking، مقدار MAX_THINKING_TOKENS=8000 را تنظیم کنید.
کار را به بخشهایی تقسیم کنید تا در یک پنجره جا بگیرد
پیش از ایجاد یک تغییر بزرگ، Shift+Tab را فشار دهید تا وارد حالت برنامهریزی شوید. Claude کدبیس را بررسی میکند و رویکرد پیشنهادی خود را برای تأیید شما ارائه میدهد. اگر این رویکرد نادرست باشد، اصلاح آن فقط هزینه یک برنامهریزی را دارد، نه 2 ساعت ویرایش بهاضافه بازکاری.
عملیات پرخروجی را به subagentها واگذار کنید. اجرای یک test suite یا خواندن یک لاگ 10,000 خطی در یک subagent باعث میشود خروجی خام در context همان subagent باقی بماند و فقط خلاصه به گفتوگوی اصلی شما برگردد.
بهمحض آنکه Claude در مسیر نادرستی قرار گرفت، Escape را فشار دهید. /rewind هم گفتوگو و هم کد را به یک checkpoint قبلی بازمیگرداند؛ بنابراین برای بازگردانی تغییراتی که هرگز نمیخواستید، هزینهای پرداخت نمیکنید.
آیا باید credit مصرف خریداری کنید یا از API استفاده کنید؟
credit مصرف به حساب Pro یا Max اجازه میدهد پس از پایان سهمیه طرح همچنان کار کند و هزینه آن با نرخ استاندارد API محاسبه میشود. برای فعالکردن آن، در claude.ai به Settings و سپس Usage بروید و یک روش پرداخت متصل کنید؛ یا در Claude Code، /usage-credits را اجرا کنید تا تنظیمات صورتحساب در مرورگر باز شود. creditها برای مکالمههای Claude و استفاده از ترمینال Claude Code اعمال میشوند و سقف مصرف روزانه آنها $2000 است. این فرمان به ورود با subscription نیاز دارد؛ بنابراین هنگام احراز هویت با API key در دسترس نیست.
راه دیگر، استفاده از یک API key ساده از Claude Console است که هزینه آن بر اساس token محاسبه میشود و هیچ session یا بازه هفتگی ندارد. در این روش یک دام رایج وجود دارد: وجود تصادفی ANTHROPIC_API_KEY در environment باعث میشود Claude Code بدون اعلام این موضوع، بهجای subscription از همان key استفاده کند. این مسئله را از روی صورتحساب یا با اجرای دستور زیر متوجه میشوید:
API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.این خطای 429 مربوط به rate limit همان key است، نه plan شما. /status را اجرا کنید و مطمئن شوید credential فعال همان موردی است که قصد استفاده از آن را دارید.
هزینه یک بعدازظهر استفاده از API چقدر است؟
مثال محاسبهشده زیر، هزینه یک بعدازظهر کدنویسی به سبک agent را نشان میدهد: 200,000 توکن ورودی بدون cache، 1.8 میلیون خوانش از cache و 150,000 توکن خروجی. قیمتها، نرخهای فهرستی Anthropic در August 2026 هستند.
The data behind this chart
[
{
"label": "Opus 5",
"input_usd_per_mtok": 5,
"cache_read_usd_per_mtok": 0.5,
"output_usd_per_mtok": 25,
"afternoon_usd": 5.65
},
{
"label": "Sonnet 5",
"input_usd_per_mtok": 2,
"cache_read_usd_per_mtok": 0.2,
"output_usd_per_mtok": 10,
"afternoon_usd": 2.26
},
{
"label": "Haiku 4.5",
"input_usd_per_mtok": 1,
"cache_read_usd_per_mtok": 0.1,
"output_usd_per_mtok": 5,
"afternoon_usd": 1.13
}
]همین بعدازظهر در Opus 5 برابر با $5.65 و در Haiku 4.5 برابر با $1.13 هزینه دارد. عامل اصلی افزایش هزینه، خروجی است: در Opus 5، هزینه هر یک میلیون توکن خروجی $25 است، درحالیکه این مقدار در Haiku 4.5 برابر با $5 است. بنابراین 150,000 توکنی که Claude تولید میکند، بیش از 2 میلیون توکنی که میخواند هزینه دارد. به همین دلیل، کاهش thinking budget بیشتر از کمکردن فایلها در هزینه صرفهجویی میکند.
یک تاریخ را باید در نظر بگیرید. Sonnet 5 تا 31 August 2026 با قیمت مقدماتی $2 برای هر یک میلیون توکن ورودی و $10 برای هر یک میلیون توکن خروجی عرضه میشود. از 1 September 2026، این قیمتها بهترتیب به $3 و $15 افزایش مییابند و هزینه همین بعدازظهر را از $2.26 به حدود $3.39 میرسانند.
نحوه محاسبه هزینه هر بعدازظهر
Opus 5: هزینه 200,000 توکن ورودی بدون cache، با نرخ $5 برای هر یک میلیون توکن، $1.00 است. هزینه 1.8 میلیون خوانش از cache، با یکدهم نرخ ورودی، $0.90 است. هزینه 150,000 توکن خروجی، با نرخ $25 برای هر یک میلیون توکن، $3.75 است. مجموع برابر با $5.65 است.
Sonnet 5: هزینه ورودی بدون cache برابر با $0.40، هزینه خوانش از cache برابر با $0.36 و هزینه خروجی برابر با $1.50 است. مجموع برابر با $2.26 است.
Haiku 4.5: هزینه ورودی بدون cache برابر با $0.20، هزینه خوانش از cache برابر با $0.18 و هزینه خروجی برابر با $0.75 است. مجموع برابر با $1.13 است.
هر 3 ردیف، همان تعداد توکن را فرض میکند؛ بنابراین اختلاف میان آنها فقط ناشی از قیمت است. یک بعدازظهر واقعی، بسته به مقدار context که در cache باقی میماند، متفاوت خواهد بود.
برای مقایسه، مستندات خود Anthropic نشان میدهد که میانگین هزینه Claude Code در deploymentهای سازمانی، تا August 2026، حدود $13 برای هر developer در هر روز فعال بوده است. برای 90% از کاربران، این هزینه کمتر از $30 در هر روز فعال است. پرداخت بر اساس توکن، لزوماً از subscription ارزانتر نیست. این روش زمانی مزیت دارد که مصرف شما نوسانی باشد، چون روزهای کممصرف هزینهای ندارند؛ اما اگر هر روز کار کنید، هزینه آن بیشتر میشود. مقایسه API با subscription بر اساس اعداد واقعی نقطه سربهسر را نشان میدهد.
اجرای یک کار طولانی روی VPS در طول شب
برخی کارها نیازی ندارند آنها را زیر نظر داشته باشید: بازآرایی گسترده کد، مهاجرت آزمونها یا بازبینی مستندات. این کارها به سهمیه اشتراک شما نیز نیاز ندارند. آنها را روی یک VPS (virtual private server) همراه با API key اجرا کنید تا هزینه بر اساس تعداد token محاسبه شود و سهمیه plan شما برای کارهای تعاملی روز بعد دستنخورده بماند.
Claude Code را روی یک سرور Ubuntu نصب کنید و از اجرای آن مطمئن شوید:
curl -fsSL https://claude.ai/install.sh | bash
claude --versionclaude --version باید رشتهای شامل نسخه، مانند 2.1.211 (Claude Code)، چاپ کند. اگر در اینجا command not found را میبینید، یعنی ~/.local/bin هنوز در PATH شما قرار ندارد؛ بنابراین یک shell جدید باز کنید و دوباره امتحان کنید.
کلید را بهجای shell history در یک فایل قرار دهید. فایل ~/.claude-env را در یک ویرایشگر ایجاد کنید و فقط یک خط، یعنی export ANTHROPIC_API_KEY=sk-ant-your-key-here، در آن بنویسید. سپس دسترسی فایل را محدود و آن را بارگذاری کنید:
chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10آخرین خط، 10 کاراکتر اول را چاپ میکند. این مقدار برای اطمینان از تنظیمشدن متغیر کافی است و کل کلید را روی صفحه نمایش نمیدهد.
اکنون کار را داخل tmux شروع کنید تا با بستن لپتاپ شما نیز ادامه پیدا کند:
tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
--allowedTools "Read,Edit,Bash" \
--append-system-prompt-file ./CLAUDE.md \
--output-format json > ~/overnight.jsonبا فشردن Ctrl-b و سپس d از نشست خارج شوید و اتصال را ببندید. بعداً با tmux attach -t overnight دوباره به نشست متصل شوید. اجرای Claude Code در یک نشست tmux روی VPS مدیریت نشست را بهطور کامل توضیح میدهد.
--bare در اینجا اهمیت دارد. این گزینه از شناسایی خودکار hooks، skills، plugins و CLAUDE.md صرفنظر میکند و هرگز اعتبارنامههای OAuth را نمیخواند؛ بنابراین اجرا فقط از API key استفاده میکند. همین موضوع باعث میشود کار از سهمیه اشتراک شما کسر نشود. در عین حال، قواعد پروژه نیز کنار گذاشته میشوند؛ به همین دلیل --append-system-prompt-file آنها را بهصورت عمدی دوباره در اختیار برنامه قرار میدهد. بدون --bare، وجود یک ANTHROPIC_API_KEY تنظیمشده باعث نمایش یک درخواست تأیید یکباره میشود که یک اجرای بدون نظارت نمیتواند به آن پاسخ دهد.
صبح، نتیجه و هزینه را از JSON بخوانید:
jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.jsonClaude Code در صورت موفقیت با کد خروج 0 و در صورت شکست با کدی غیرصفر خارج میشود. بنابراین یک wrapper script میتواند بر اساس وضعیت خروج تصمیم بگیرد و در صورت شکست برای شما ایمیل بفرستد. پیش از آنکه کار را بدون نظارت اجرا کنید، یک محدودیت هزینه برای workspace در Claude Console تعیین کنید: اجرای یک agent در حلقه retry در ساعت 3 بامداد واقعاً میتواند هزینه قابلتوجهی ایجاد کند. اگر میخواهید سرعت اجرا را نیز کاهش دهید، مقدار CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY را کم کنید. کنترل هزینه برای agentهایی که بدون نظارت اجرا میشوند محدودیتهایی را که بهتر است ابتدا تنظیم کنید، توضیح میدهد.
برای کار یک کاربر غیرممتاز و یک branch اختصاصی git در نظر بگیرید. agentی که بدون نظارت یک repository را ویرایش میکند، گاهی کاری انجام میدهد که شما در حالت عادی متوقفش میکردید؛ branch این وضعیت را به یک git checkout تبدیل میکند، نه یک رخداد امنیتی. اجرای ایمن coding agent روی VPS روش جداسازی را توضیح میدهد.
برای کارهای حجیم و کاملاً غیرتعاملی، مانند دستهبندی هزاران رکورد، Batch API درخواستها را بهصورت ناهمگام و با 50% تخفیف روی tokenهای ورودی و خروجی پردازش میکند. این ارزانترین مسیر بر اساس تعداد token است که Anthropic منتشر کرده و اجرای شبانه دقیقاً با تأخیر موردنیاز آن سازگار است.
چه چیزهایی دسترسی شما را برنمیگردانند
شروع یک گفتوگوی جدید سهمیهٔ مصرف شما را برنمیگرداند. مصرف به حساب شما اختصاص داده میشود، نه به یک گفتوگو. بااینحال، هر پیام بعدی ارزانتر تمام میشود، چون گفتوگوی جدید سابقهای برای بازخوانی ندارد؛ بنابراین انجام این کار همچنان مفید است. این کار کاهش هزینه است، نه بازنشانی سهمیه.
حذف گفتوگوهای قدیمی هیچ چیزی را بازپرداخت نمیکند. آن توکنها هنگام پردازش مصرف شدهاند.
تغییر مدل پس از یک session یا پیام هفتگی تأثیری ندارد، چون این بازهها میان همهٔ مدلها مشترک هستند. فقط پیامی که یک مدل را نام میبرد به /model پاسخ میدهد.
تلاش مجدد در یک حلقه فقط باعث میشود terminal شما مشغول بماند. زمان reset که در پیام نمایش داده میشود پاسخ واقعی است و /usage همان زمان را بدون خطا نشان میدهد.
FAQ
محدودیت Claude من چه زمانی reset میشود؟
این پیام زمان را به شما میگوید. محدودیتهای session در یک پنجرهٔ شناور 5 ساعته اجرا میشوند و پیام یک زمان مشخص را نشان میدهد؛ برای مثال resets 3:45pm. محدودیتهای هفتگی هر هفته در زمان ثابتی که به حساب شما اختصاص داده شده است reset میشوند و پیام روز را نشان میدهد؛ برای مثال resets Mon 12:00am. برای دیدن هر دو نوار و هر دو زمان reset پیش از رسیدن به هر محدودیتی، در Claude Code دستور /usage را اجرا کنید، یا در claude.ai، Settings و سپس Usage را باز کنید.
آیا تغییر به Sonnet باعث میشود دوباره بتوانم کار کنم؟
فقط زمانی که پیام یک model را نام ببرد. پس از You've hit your Opus limit، دستور /model را اجرا کنید، یک model متفاوت انتخاب کنید و session با context فعلی شما ادامه پیدا میکند. پس از You've hit your session limit یا You've hit your weekly limit، انتخاب model تفاوتی ایجاد نمیکند، زیرا این پنجرهها همهٔ modelها را با هم محاسبه میکنند. تغییر به یک model ارزانتر پیش از رسیدن به محدودیت، راهی است که واقعاً پنجرهٔ استفاده را طولانیتر میکند.
آیا شروع یک chat جدید محدودیت استفاده را reset میکند؟
خیر. استفاده در برابر حساب شما محاسبه میشود؛ بنابراین یک chat جدید نیز با همان allowance خالی آغاز میشود. بااینحال، هر پیام بعدی ارزانتر میشود، زیرا یک conversation جدید سابقهای ندارد که Claude دوباره آن را بخواند. /clear در Claude Code همین کار را انجام میدهد و هزینهای ندارد، اما /compact باید conversation را که خلاصه میکند بخواند؛ بنابراین compact کردن یک session بسیار بزرگ، خود یک درخواست پرهزینه است.
آیا API از ارتقای plan ارزانتر است؟
به میزان ثبات استفادهٔ شما بستگی دارد. بعدازظهر کاری نمونه در این صفحه، با نرخهای فهرست August 2026، روی Sonnet 5 برابر با $2.26 و روی Haiku 4.5 برابر با $1.13 هزینه دارد. یک subscription برای allowance محدود، مبلغ ثابتی دریافت میکند؛ بنابراین زمانی بهتر است که بیشتر روزها کار کنید. صورتحساب بر اساس token زمانی بهتر است که بار کاری شما نوسان زیادی داشته باشد، زیرا روزهای کممصرف هیچ هزینهای برای شما ندارند.
آیا میتوانم هنگام انتظار برای reset، یک job را در حال اجرا نگه دارم؟
بله، اگر آن را از subscription خود خارج کنید. آن را روی یک VPS اجرا کنید و ANTHROPIC_API_KEY را در environment تنظیم کنید؛ در این حالت هزینه بر اساس token محاسبه میشود و از پنجرهٔ plan شما مصرف نمیکند، بنابراین این دو با یکدیگر رقابت نمیکنند. claude --bare -p در tmux پس از بستهشدن laptop شما نیز به کار ادامه میدهد و --output-format json یک فیلد total_cost_usd مینویسد که صبح میتوانید با jq آن را بررسی کنید.