سقف توکن اشتراک Claude Pro چقدر است؟
اشتراک Claude Pro سهمیه توکن مشخصی ندارد و مصرف بر اساس تعداد پیام در بازه زمانی متغیر محاسبه میشود. در اینجا بررسی میکنیم چرا این محدودیت به طول چت بستگی دارد.
اشتراک Claude Pro شامل چند توکن است؟
اشتراک Claude Pro شامل سهمیه توکن مشخصی نیست و تا سپتامبر 2026، شرکت Anthropic هیچ سهمیه عددی برای آن منتشر نکرده است. اشتراک Claude بر اساس تعداد پیامها در یک بازه زمانی متغیر (rolling time window) محاسبه میشود، نه بر اساس کسر توکن از یک موجودی مشخص. گستردگی این بازه زمانی به مدل انتخابی شما، طول مکالمه و حجم متنی که در هر نوبت ارسال میشود، بستگی دارد.
این پاسخی است که بهندرت به این پرسش داده میشود، زیرا کاربران انتظار دارند یک طرح اشتراکی مانند API key عمل کند. در API key، موجودی بر اساس تعداد توکنها مصرف میشود و شما میتوانید صورتحساب خود را محاسبه کنید. اما در طرح اشتراکی، دسترسی به یک سقف محدود فروخته میشود که توسط Anthropic تعیین و تنظیم میگردد؛ از آنجا که این سقف بر اساس تعداد پیام تعریف شده است، هیچ عدد ثابتی برای توکن وجود ندارد که بتوان به آن استناد کرد. هر کسی که عددی به شما ارائه میدهد، آن را از خود ساخته است.
بنابراین، پرسش خود را تغییر دهید. چه چیزی باعث میشود پیامهای من هزینهبر باشند؟ این پرسش پاسخ واقعی دارد و شما میتوانید همین امروز بر اساس آن اقدام کنید.
چرا اشتراک نمیتواند تعداد توکنها را قیمتگذاری کند
این API هزینه هر درخواست را بر اساس تعداد توکنها محاسبه میکند. توکنهای ورودی شامل تمام مواردی است که ارسال میکنید و توکنهای خروجی شامل تمام مطالبی است که مدل در پاسخ مینویسد. این دو مورد نرخهای متفاوتی دارند و به همین دلیل است که هزینه توکنهای ورودی و خروجی متفاوت است؛ بنابراین پیش از هرگونه برآوردی باید به این نکته توجه کنید.
طرحهای مصرفکننده موجودی قابل خرج ندارند. شرکت Anthropic تعداد پیامهایی را که میتوانید در یک بازه زمانی متغیر ارسال کنید محدود کرده است؛ این بازه با اولین پیام شما آغاز شده و پس از گذشت تعداد مشخصی ساعت بسته میشود. طرحهای پولی دارای محدودیت دوم و طولانیتری هستند که در مقیاس یک هفته اندازهگیری میشود. یک پیام اندازه ثابتی ندارد، بنابراین تعداد پیام یکسان برای دو نفر مختلف، حجم کاری بسیار متفاوتی را ایجاد میکند. صفحات راهنمای Anthropic این محدودیتها را بر اساس تعداد تقریبی پیام برای یک گفتگوی کوتاه توصیف میکنند و سپس هشدار میدهند که گفتگوهای طولانی و پیوستهای حجیم، سهمیه شما را سریعتر مصرف میکنند. این هشدار تمام ماجراست و مکانیزم پشت آن تقریباً هرگز توضیح داده نمیشود.
چرا هزینه نوبت بیستم یک چت بسیار بیشتر از نوبت اول است
مدل هیچ حافظهای بین درخواستها نگه نمیدارد. این سیستم بدون وضعیت (stateless) است، بنابراین در هر نوبت، کل گفتگو مجدداً ارسال میشود: پرامپت سیستم، هر پیام قبلی که نوشتهاید، هر پاسخ قبلی از Claude و هر فایلی که پیوست کردهاید. سوال جدید شما ممکن است بیست کلمه باشد، اما درخواستی که آن را حمل میکند، کل متن گفتگو است.
بنابراین هزینه یک نوبت با طول چت افزایش مییابد و این افزایش به صورت خطی است. ردیفهای زیر این محاسبات را بر اساس مجموعهای از فرضیات گرد نشان میدهند: یک پرامپت سیستم نزدیک به 1,000 توکن، پیامهای شما هر کدام نزدیک به 1,000 توکن و پاسخها هر کدام نزدیک به 1,200 توکن. اینها مکانیسم را نشان میدهند و اندازهگیری حساب شما نیستند.
The data behind this chart
[
{
"label": "Turn 1",
"sent_this_turn": "2,000",
"cumulative_input": "2,000"
},
{
"label": "Turn 5",
"sent_this_turn": "10,800",
"cumulative_input": "32,000"
},
{
"label": "Turn 10",
"sent_this_turn": "21,800",
"cumulative_input": "119,000"
},
{
"label": "Turn 20",
"sent_this_turn": "43,800",
"cumulative_input": "458,000"
}
]نوبت اول 2,000 توکن ورودی ارسال میکند. تا نوبت 20، همان سوال کوتاه 43,800 توکن ارسال میکند، که بیش از بیست برابر بیشتر از نوبت اول است، در حالی که میزان تایپ شما یکسان بوده است. در طول کل گفتگو، شما 458,000 توکن ورودی ارسال کردهاید که بخش عمده آن همان متنی است که بارها و بارها ارسال شده است.
بیست چت تکنوبتی جداگانه، بیست برابر ردیف اول بالا ارسال میکردند و نه بیشتر. همان سوالات، با کسری از بار پردازشی. پیوستها این شکاف را عمیقتر میکنند، زیرا فایلی که در نوبت دوم پیوست کردهاید، در نوبت سوم، چهارم و هر نوبت پس از آن دوباره ارسال میشود، صرفنظر از اینکه گفتگو هنوز به آن مربوط باشد یا خیر.
به همین دلیل است که دو نفر با طرح اشتراکی یکسان، میزان مصرف کاملاً متفاوتی را گزارش میکنند. یکی یک رشته گفتگو را تمام هفته باز نگه میدارد و تا چهارشنبه به سقف محدودیت میرسد. دیگری برای هر کار یک چت جدید باز میکند و بهندرت با محدودیت مواجه میشود. هیچکدام کار اشتباهی انجام نمیدهند. میزان مصرف توکن آنها به دلیل تفاوت در عادتهایشان، یک مرتبه بزرگی با هم تفاوت دارد.
در API، میتوانید هزینه تکرار را با استفاده از prompt caching کاهش دهید، که بخش ابتدایی تغییرناپذیر درخواست را ذخیره میکند تا فراخوانیهای بعدی برای آن بخش با نرخ ورودی کاهشیافته محاسبه شوند. در اشتراک معمولی، شما کنترلی بر caching ندارید، بنابراین طول گفتگو اهرمی است که در اختیار دارید. همین مکانیسم در جلسات کدنویسی نیز حاکم است، جایی که محتوای فایلها و تعاریف ابزارها در هر نوبت همراه با درخواست ارسال میشوند، بنابراین کوچک نگه داشتن کانتکست جلسه کدنویسی بیش از هر تنظیماتی به محدودیتهای شما کمک میکند و خواندن مطلب اینکه توکنهای یک جلسه Claude Code واقعاً کجا مصرف میشوند پیش از مقصر دانستن طرح اشتراکی، ارزشمند است.
آنچه هر سطح از طرحها ارائه میدهد، به زبان ساده
هیچکدام از سطوح طرحها سقف استفادهٔ مطلق را منتشر نمیکنند. آنچه منتشر میشود نسبی است و همین تصویر نسبی برای انتخاب کافی است. طرح Free در پایینترین سطح قرار دارد و ظرفیت آن ممکن است هنگام بالا بودن تقاضا برای سرویس، محدودتر شود. طرح Pro در سطح بالاتری قرار میگیرد. طرح Max در دو اندازه عرضه میشود که به عنوان مضربی از استفادهٔ Pro توصیف شدهاند؛ تقریباً 5 برابر و تقریباً 20 برابر. طرحهای Team و Enterprise بر اساس هر کاربر قیمتگذاری میشوند و محدودیتهای خاص خود را دارند.
این ضرایب را به عنوان بیانی از قصد و نیت در نظر بگیرید، نه یک قرارداد. Anthropic این سقفها را تنظیم میکند و این تنظیمات از قبل اعلام نمیشوند؛ به همین دلیل است که هیچ صفحهٔ صادقی نمیتواند عدد دقیقی از توکنها را به شما ارائه دهد. برای بخش مالی همین مقایسه، هزینهٔ طرح Pro و سقف آن و تفاوت بین دو سطح Max این موضوع را پوشش میدهند و آنچه طرح رایگان واقعاً اجازه میدهد کف استفاده را مشخص میکند.
انتخاب مدل، ضریب دومی است که بر روی سطح طرح شما قرار میگیرد. پرسش مشابه در بزرگترین مدل، سهم بیشتری از پنجرهٔ استفادهٔ شما را نسبت به کوچکترین مدل اشغال میکند، زیرا اجرای یک مدل سنگینتر به ازای هر توکن گرانتر است. انتقال کارهای روتین از Opus به Sonnet یا Haiku اغلب زمان کاری بیشتری نسبت به ارتقای طرح برای شما میخرد؛ بنابراین تطبیق مدل با نوع کار اولین چیزی است که باید هنگام تمام شدن سهمیهٔ خود امتحان کنید.
چگونه بهجای حدس زدن، میزان مصرف خود را مشاهده کنید
حساب کاربری شما تنها منبع معتبر است و تنها با دو کلیک در دسترس قرار میگیرد. در claude.ai به بخش Settings و سپس Usage بروید. این بخش نشان میدهد که در پنجره فعلی چه میزان مصرف داشتهاید و این پنجره چه زمانی بازنشانی (reset) میشود. یکبار زمانی که پاسخها رد میشوند و یکبار پس از یک نشست طولانی آن را بررسی کنید؛ با این کار سریعتر از هر عدد منتشرشدهای، الگوی مصرف خود را خواهید آموخت.
در Claude Code دو دستور slash همین کار را از طریق ترمینال انجام میدهند. /usage میزان مصرف طرح و زمان بازنشانی را گزارش میدهد. /context تفکیک میکند که در حال حاضر چه چیزی پنجره context را پر کرده است و system prompt، تعاریف ابزارها، فایلها و تاریخچه گفتگو را از هم جدا میکند. زمانی که /context نشان میدهد گفتگوهای قدیمی فضای زیادی اشغال کردهاند، /clear یک نشست تازه را شروع میکند و هزینه هر نوبت (turn) دوباره به ردیف اول جدول بالا نزدیک میشود.
در API، شمارش دقیق است و میتوانید پیش از ارسال هر چیزی، آن را درخواست کنید:
curl https://api.anthropic.com/v1/messages/count_tokens \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-sonnet-5",
"messages": [{"role": "user", "content": "Summarise the attached report."}]
}'یک پاسخ سالم شامل یک فیلد واحد است و این همان عددی است که برای صورتحساب استفاده میشود:
{"input_tokens": 14}هر درخواست تکمیلشده، هنگام پایان یافتن، همین حسابداری را گزارش میدهد:
{"usage": {"input_tokens": 21430, "output_tokens": 512}}یک سوال کوتاه را به عنوان یک درخواست تازه ارسال کنید، سپس همان سوال را در انتهای یک رشته طولانی (thread) بفرستید و دو مقدار input_tokens را با هم مقایسه کنید. تفاوت این دو، دقیقاً همان تأثیری است که اشتراک شما بر اساس آن اندازهگیری میشود و به صورت یک عدد ثبت میگردد.
هنگامی که محدودیت در میانه انجام کار اعمال میشود چه باید کرد
- منتظر بازه زمانی بمانید. برنامه زمان بازنشانی را نمایش میدهد و مدت انتظار اغلب کوتاهتر از روشهای جایگزین است. این بهترین اقدام زمانی است که مهلت زمانی فوری ندارید.
- از یک مدل سبکتر استفاده کنید. هزینه هر نوبت استفاده از مدلهای کوچکتر در تمام طرحها کمتر است و در برخی طرحها، این مدلها از سهمیه جداگانهای استفاده میکنند؛ بنابراین در حالی که مدل سنگین در حال استراحت است، کار شما ادامه مییابد.
- یک چت جدید شروع کنید و فقط اطلاعات مورد نیاز برای گام بعدی را به آن منتقل کنید. نتیجهگیری را کپی کنید، نه کل متن گفتگو را. هزینه هر نوبت بلافاصله کاهش مییابد و پاسخها معمولاً بهبود مییابند، زیرا مدل دیگر درگیر پردازش هزاران توکن از بحثهای قبلی نیست.
- کار را به API منتقل کنید، جایی که توکنها بر اساس هر درخواست شمرده و هزینه آنها محاسبه میشود. هیچ بازه زمانی برای انتظار وجود ندارد و میتوانید قیمت هر فراخوانی را پیش و پس از انجام آن مشاهده کنید.
اینکه کدام گزینه مناسب است، به این بستگی دارد که مشکل شما محدودیت زمانی است یا حجم کاری. یک فشار کاری مقطعی، یک مشکل زمانی است. دیواری که هر چهارشنبه به آن برخورد میکنید، یک مشکل حجم کاری است و به جای مدیریت زمان، به استفاده از API یا طرحی با ظرفیت بالاتر نیاز دارد. چکلیست کامل برای زمانی که محدودیت در میانه کار اعمال میشود مراحل بازیابی را گامبهگام بررسی میکند و نحوه باز شدن و بازنشانی بازههای زمانی متحرک توضیح میدهد که چرا زمانبندی به این شکل عمل میکند. اگر قصد دارید به سمت API بروید، ابتدا قیمت آن را بسنجید: مقایسه API با اشتراک برای حجم کاری مشابه و هزینه واقعی یک میلیون توکن محاسبات لازم را پیش از جابجایی در اختیار شما قرار میدهند.
FAQ
تعداد توکنهای موجود در Claude Pro چقدر است؟
شرکت Anthropic هیچ سهمیهٔ مشخصی برای تعداد توکنهای نسخه Pro اعلام نکرده است و تا سپتامبر 2026 عددی برای استناد وجود ندارد. استفاده از نسخه Pro بر اساس تعداد پیامها در یک بازهٔ زمانی متغیر (rolling window) محاسبه میشود و سقف کلی آن در طول یک هفته سنجیده میشود. تعداد پیامهایی که در این سقف جای میگیرند، بسته به مدل انتخابی و طول گفتوگوی شما متفاوت است. هر صفحهای که عدد توکن ماهانهٔ مشخصی را برای Pro ذکر کند، صرفاً در حال حدسزدن است. برای مشاهدهٔ میزان مصرف شخصی و زمان بازنشانی سهمیه، در سایت claude.ai به بخش Settings و سپس Usage بروید.
آیا شروع یک چت جدید، سهمیهٔ مصرفی من را بازنشانی میکند؟
خیر. میزان مصرف برای کل حساب کاربری شما در بازهٔ زمانی مربوطه محاسبه میشود؛ بنابراین شروع یک چت جدید، سهمیهٔ مصرفشده را به شما بازنمیگرداند. آنچه تغییر میکند، هزینهٔ هر نوبت (turn) از آن لحظه به بعد است. یک چت جدید فاقد تاریخچه برای ارسال مجدد است، بنابراین بهجای ادامهٔ روند صعودی هزینه، از پایینترین سطح نمودار شروع میشود. باز کردن یک چت تازه هنگام تغییر موضوع، اقتصادیترین عادت در هر طرح اشتراکی است.
چرا امروز سریعتر از دیروز به محدودیت رسیدم؟
معمولاً به این دلیل که کار امروز شما در یک رشتهگفتوگوی (thread) طولانی انجام شده است. در هر نوبت، کل گفتوگو به همراه فایلهای پیوست مجدداً ارسال میشود؛ بنابراین در حالی که تعداد پیامها از نظر شما تغییری نکرده، هزینهٔ هر پیام بهطور پیوسته افزایش مییابد. دلیل رایج دیگر، نوع مدل است: مدلهای سنگینتر در هر نوبت سهمیهٔ بیشتری مصرف میکنند، بنابراین یک بعدازظهر کار با بزرگترین مدل، زودتر از یک صبح کار با مدل کوچکتر به پایان میرسد.
آیا برای شمارش دقیق توکنها باید به سراغ API بروم؟
اگر به آمار دقیق یا پیشبینیپذیری نیاز دارید، از API استفاده کنید. API توکنهای ورودی و خروجی را در هر فراخوانی میشمارد، یک endpoint برای شمارش توکنها در اختیار شما قرار میدهد که میتوانید پیش از ارسال پیام از آن استفاده کنید، و هیچ بازهٔ زمانی انتظاری ندارد. هزینهٔ آن بر اساس تعداد توکن محاسبه میشود؛ بنابراین استفادهٔ سنگین هزینهٔ بیشتری نسبت به اشتراک ثابت دارد و استفادهٔ سبک بسیار ارزانتر تمام میشود. پیش از تغییر، حجم کاری واقعی خود را با طرح فعلی مقایسه کنید، زیرا پاسخ نهایی بسته به تعداد توکنهای ارسالی شما تغییر میکند.