SSD Nodes Learn Hosting plans →
راهنماها Matt Connorتوسط Matt Connor · به‌روزرسانی شده 2026-09-12

سقف توکن اشتراک Claude Pro چقدر است؟

اشتراک Claude Pro سهمیه توکن مشخصی ندارد و مصرف بر اساس تعداد پیام در بازه زمانی متغیر محاسبه می‌شود. در اینجا بررسی می‌کنیم چرا این محدودیت به طول چت بستگی دارد.

اشتراک Claude Pro شامل چند توکن است؟

اشتراک Claude Pro شامل سهمیه توکن مشخصی نیست و تا سپتامبر 2026، شرکت Anthropic هیچ سهمیه عددی برای آن منتشر نکرده است. اشتراک Claude بر اساس تعداد پیام‌ها در یک بازه زمانی متغیر (rolling time window) محاسبه می‌شود، نه بر اساس کسر توکن از یک موجودی مشخص. گستردگی این بازه زمانی به مدل انتخابی شما، طول مکالمه و حجم متنی که در هر نوبت ارسال می‌شود، بستگی دارد.

این پاسخی است که به‌ندرت به این پرسش داده می‌شود، زیرا کاربران انتظار دارند یک طرح اشتراکی مانند API key عمل کند. در API key، موجودی بر اساس تعداد توکن‌ها مصرف می‌شود و شما می‌توانید صورت‌حساب خود را محاسبه کنید. اما در طرح اشتراکی، دسترسی به یک سقف محدود فروخته می‌شود که توسط Anthropic تعیین و تنظیم می‌گردد؛ از آنجا که این سقف بر اساس تعداد پیام تعریف شده است، هیچ عدد ثابتی برای توکن وجود ندارد که بتوان به آن استناد کرد. هر کسی که عددی به شما ارائه می‌دهد، آن را از خود ساخته است.

بنابراین، پرسش خود را تغییر دهید. چه چیزی باعث می‌شود پیام‌های من هزینه‌بر باشند؟ این پرسش پاسخ واقعی دارد و شما می‌توانید همین امروز بر اساس آن اقدام کنید.

چرا اشتراک نمی‌تواند تعداد توکن‌ها را قیمت‌گذاری کند

این API هزینه هر درخواست را بر اساس تعداد توکن‌ها محاسبه می‌کند. توکن‌های ورودی شامل تمام مواردی است که ارسال می‌کنید و توکن‌های خروجی شامل تمام مطالبی است که مدل در پاسخ می‌نویسد. این دو مورد نرخ‌های متفاوتی دارند و به همین دلیل است که هزینه توکن‌های ورودی و خروجی متفاوت است؛ بنابراین پیش از هرگونه برآوردی باید به این نکته توجه کنید.

طرح‌های مصرف‌کننده موجودی قابل خرج ندارند. شرکت Anthropic تعداد پیام‌هایی را که می‌توانید در یک بازه زمانی متغیر ارسال کنید محدود کرده است؛ این بازه با اولین پیام شما آغاز شده و پس از گذشت تعداد مشخصی ساعت بسته می‌شود. طرح‌های پولی دارای محدودیت دوم و طولانی‌تری هستند که در مقیاس یک هفته اندازه‌گیری می‌شود. یک پیام اندازه ثابتی ندارد، بنابراین تعداد پیام یکسان برای دو نفر مختلف، حجم کاری بسیار متفاوتی را ایجاد می‌کند. صفحات راهنمای Anthropic این محدودیت‌ها را بر اساس تعداد تقریبی پیام برای یک گفتگوی کوتاه توصیف می‌کنند و سپس هشدار می‌دهند که گفتگوهای طولانی و پیوست‌های حجیم، سهمیه شما را سریع‌تر مصرف می‌کنند. این هشدار تمام ماجراست و مکانیزم پشت آن تقریباً هرگز توضیح داده نمی‌شود.

چرا هزینه نوبت بیستم یک چت بسیار بیشتر از نوبت اول است

مدل هیچ حافظه‌ای بین درخواست‌ها نگه نمی‌دارد. این سیستم بدون وضعیت (stateless) است، بنابراین در هر نوبت، کل گفتگو مجدداً ارسال می‌شود: پرامپت سیستم، هر پیام قبلی که نوشته‌اید، هر پاسخ قبلی از Claude و هر فایلی که پیوست کرده‌اید. سوال جدید شما ممکن است بیست کلمه باشد، اما درخواستی که آن را حمل می‌کند، کل متن گفتگو است.

بنابراین هزینه یک نوبت با طول چت افزایش می‌یابد و این افزایش به صورت خطی است. ردیف‌های زیر این محاسبات را بر اساس مجموعه‌ای از فرضیات گرد نشان می‌دهند: یک پرامپت سیستم نزدیک به 1,000 توکن، پیام‌های شما هر کدام نزدیک به 1,000 توکن و پاسخ‌ها هر کدام نزدیک به 1,200 توکن. این‌ها مکانیسم را نشان می‌دهند و اندازه‌گیری حساب شما نیستند.

ChartInput tokens per turn as one conversation grows (illustration)
The data behind this chart
[
  {
    "label": "Turn 1",
    "sent_this_turn": "2,000",
    "cumulative_input": "2,000"
  },
  {
    "label": "Turn 5",
    "sent_this_turn": "10,800",
    "cumulative_input": "32,000"
  },
  {
    "label": "Turn 10",
    "sent_this_turn": "21,800",
    "cumulative_input": "119,000"
  },
  {
    "label": "Turn 20",
    "sent_this_turn": "43,800",
    "cumulative_input": "458,000"
  }
]

نوبت اول 2,000 توکن ورودی ارسال می‌کند. تا نوبت 20، همان سوال کوتاه 43,800 توکن ارسال می‌کند، که بیش از بیست برابر بیشتر از نوبت اول است، در حالی که میزان تایپ شما یکسان بوده است. در طول کل گفتگو، شما 458,000 توکن ورودی ارسال کرده‌اید که بخش عمده آن همان متنی است که بارها و بارها ارسال شده است.

بیست چت تک‌نوبتی جداگانه، بیست برابر ردیف اول بالا ارسال می‌کردند و نه بیشتر. همان سوالات، با کسری از بار پردازشی. پیوست‌ها این شکاف را عمیق‌تر می‌کنند، زیرا فایلی که در نوبت دوم پیوست کرده‌اید، در نوبت سوم، چهارم و هر نوبت پس از آن دوباره ارسال می‌شود، صرف‌نظر از اینکه گفتگو هنوز به آن مربوط باشد یا خیر.

به همین دلیل است که دو نفر با طرح اشتراکی یکسان، میزان مصرف کاملاً متفاوتی را گزارش می‌کنند. یکی یک رشته گفتگو را تمام هفته باز نگه می‌دارد و تا چهارشنبه به سقف محدودیت می‌رسد. دیگری برای هر کار یک چت جدید باز می‌کند و به‌ندرت با محدودیت مواجه می‌شود. هیچ‌کدام کار اشتباهی انجام نمی‌دهند. میزان مصرف توکن آن‌ها به دلیل تفاوت در عادت‌هایشان، یک مرتبه بزرگی با هم تفاوت دارد.

در API، می‌توانید هزینه تکرار را با استفاده از prompt caching کاهش دهید، که بخش ابتدایی تغییرناپذیر درخواست را ذخیره می‌کند تا فراخوانی‌های بعدی برای آن بخش با نرخ ورودی کاهش‌یافته محاسبه شوند. در اشتراک معمولی، شما کنترلی بر caching ندارید، بنابراین طول گفتگو اهرمی است که در اختیار دارید. همین مکانیسم در جلسات کدنویسی نیز حاکم است، جایی که محتوای فایل‌ها و تعاریف ابزارها در هر نوبت همراه با درخواست ارسال می‌شوند، بنابراین کوچک نگه داشتن کانتکست جلسه کدنویسی بیش از هر تنظیماتی به محدودیت‌های شما کمک می‌کند و خواندن مطلب اینکه توکن‌های یک جلسه Claude Code واقعاً کجا مصرف می‌شوند پیش از مقصر دانستن طرح اشتراکی، ارزشمند است.

آنچه هر سطح از طرح‌ها ارائه می‌دهد، به زبان ساده

هیچ‌کدام از سطوح طرح‌ها سقف استفادهٔ مطلق را منتشر نمی‌کنند. آنچه منتشر می‌شود نسبی است و همین تصویر نسبی برای انتخاب کافی است. طرح Free در پایین‌ترین سطح قرار دارد و ظرفیت آن ممکن است هنگام بالا بودن تقاضا برای سرویس، محدودتر شود. طرح Pro در سطح بالاتری قرار می‌گیرد. طرح Max در دو اندازه عرضه می‌شود که به عنوان مضربی از استفادهٔ Pro توصیف شده‌اند؛ تقریباً 5 برابر و تقریباً 20 برابر. طرح‌های Team و Enterprise بر اساس هر کاربر قیمت‌گذاری می‌شوند و محدودیت‌های خاص خود را دارند.

این ضرایب را به عنوان بیانی از قصد و نیت در نظر بگیرید، نه یک قرارداد. Anthropic این سقف‌ها را تنظیم می‌کند و این تنظیمات از قبل اعلام نمی‌شوند؛ به همین دلیل است که هیچ صفحهٔ صادقی نمی‌تواند عدد دقیقی از توکن‌ها را به شما ارائه دهد. برای بخش مالی همین مقایسه، هزینهٔ طرح Pro و سقف آن و تفاوت بین دو سطح Max این موضوع را پوشش می‌دهند و آنچه طرح رایگان واقعاً اجازه می‌دهد کف استفاده را مشخص می‌کند.

انتخاب مدل، ضریب دومی است که بر روی سطح طرح شما قرار می‌گیرد. پرسش مشابه در بزرگ‌ترین مدل، سهم بیشتری از پنجرهٔ استفادهٔ شما را نسبت به کوچک‌ترین مدل اشغال می‌کند، زیرا اجرای یک مدل سنگین‌تر به ازای هر توکن گران‌تر است. انتقال کارهای روتین از Opus به Sonnet یا Haiku اغلب زمان کاری بیشتری نسبت به ارتقای طرح برای شما می‌خرد؛ بنابراین تطبیق مدل با نوع کار اولین چیزی است که باید هنگام تمام شدن سهمیهٔ خود امتحان کنید.

چگونه به‌جای حدس زدن، میزان مصرف خود را مشاهده کنید

حساب کاربری شما تنها منبع معتبر است و تنها با دو کلیک در دسترس قرار می‌گیرد. در claude.ai به بخش Settings و سپس Usage بروید. این بخش نشان می‌دهد که در پنجره فعلی چه میزان مصرف داشته‌اید و این پنجره چه زمانی بازنشانی (reset) می‌شود. یک‌بار زمانی که پاسخ‌ها رد می‌شوند و یک‌بار پس از یک نشست طولانی آن را بررسی کنید؛ با این کار سریع‌تر از هر عدد منتشرشده‌ای، الگوی مصرف خود را خواهید آموخت.

در Claude Code دو دستور slash همین کار را از طریق ترمینال انجام می‌دهند. /usage میزان مصرف طرح و زمان بازنشانی را گزارش می‌دهد. /context تفکیک می‌کند که در حال حاضر چه چیزی پنجره context را پر کرده است و system prompt، تعاریف ابزارها، فایل‌ها و تاریخچه گفتگو را از هم جدا می‌کند. زمانی که /context نشان می‌دهد گفتگوهای قدیمی فضای زیادی اشغال کرده‌اند، /clear یک نشست تازه را شروع می‌کند و هزینه هر نوبت (turn) دوباره به ردیف اول جدول بالا نزدیک می‌شود.

در API، شمارش دقیق است و می‌توانید پیش از ارسال هر چیزی، آن را درخواست کنید:

curl https://api.anthropic.com/v1/messages/count_tokens \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-sonnet-5",
    "messages": [{"role": "user", "content": "Summarise the attached report."}]
  }'

یک پاسخ سالم شامل یک فیلد واحد است و این همان عددی است که برای صورت‌حساب استفاده می‌شود:

{"input_tokens": 14}

هر درخواست تکمیل‌شده، هنگام پایان یافتن، همین حسابداری را گزارش می‌دهد:

{"usage": {"input_tokens": 21430, "output_tokens": 512}}

یک سوال کوتاه را به عنوان یک درخواست تازه ارسال کنید، سپس همان سوال را در انتهای یک رشته طولانی (thread) بفرستید و دو مقدار input_tokens را با هم مقایسه کنید. تفاوت این دو، دقیقاً همان تأثیری است که اشتراک شما بر اساس آن اندازه‌گیری می‌شود و به صورت یک عدد ثبت می‌گردد.

هنگامی که محدودیت در میانه انجام کار اعمال می‌شود چه باید کرد

  1. منتظر بازه زمانی بمانید. برنامه زمان بازنشانی را نمایش می‌دهد و مدت انتظار اغلب کوتاه‌تر از روش‌های جایگزین است. این بهترین اقدام زمانی است که مهلت زمانی فوری ندارید.
  2. از یک مدل سبک‌تر استفاده کنید. هزینه هر نوبت استفاده از مدل‌های کوچک‌تر در تمام طرح‌ها کمتر است و در برخی طرح‌ها، این مدل‌ها از سهمیه جداگانه‌ای استفاده می‌کنند؛ بنابراین در حالی که مدل سنگین در حال استراحت است، کار شما ادامه می‌یابد.
  3. یک چت جدید شروع کنید و فقط اطلاعات مورد نیاز برای گام بعدی را به آن منتقل کنید. نتیجه‌گیری را کپی کنید، نه کل متن گفتگو را. هزینه هر نوبت بلافاصله کاهش می‌یابد و پاسخ‌ها معمولاً بهبود می‌یابند، زیرا مدل دیگر درگیر پردازش هزاران توکن از بحث‌های قبلی نیست.
  4. کار را به API منتقل کنید، جایی که توکن‌ها بر اساس هر درخواست شمرده و هزینه آن‌ها محاسبه می‌شود. هیچ بازه زمانی برای انتظار وجود ندارد و می‌توانید قیمت هر فراخوانی را پیش و پس از انجام آن مشاهده کنید.

اینکه کدام گزینه مناسب است، به این بستگی دارد که مشکل شما محدودیت زمانی است یا حجم کاری. یک فشار کاری مقطعی، یک مشکل زمانی است. دیواری که هر چهارشنبه به آن برخورد می‌کنید، یک مشکل حجم کاری است و به جای مدیریت زمان، به استفاده از API یا طرحی با ظرفیت بالاتر نیاز دارد. چک‌لیست کامل برای زمانی که محدودیت در میانه کار اعمال می‌شود مراحل بازیابی را گام‌به‌گام بررسی می‌کند و نحوه باز شدن و بازنشانی بازه‌های زمانی متحرک توضیح می‌دهد که چرا زمان‌بندی به این شکل عمل می‌کند. اگر قصد دارید به سمت API بروید، ابتدا قیمت آن را بسنجید: مقایسه API با اشتراک برای حجم کاری مشابه و هزینه واقعی یک میلیون توکن محاسبات لازم را پیش از جابجایی در اختیار شما قرار می‌دهند.

FAQ

تعداد توکن‌های موجود در Claude Pro چقدر است؟

شرکت Anthropic هیچ سهمیهٔ مشخصی برای تعداد توکن‌های نسخه Pro اعلام نکرده است و تا سپتامبر 2026 عددی برای استناد وجود ندارد. استفاده از نسخه Pro بر اساس تعداد پیام‌ها در یک بازهٔ زمانی متغیر (rolling window) محاسبه می‌شود و سقف کلی آن در طول یک هفته سنجیده می‌شود. تعداد پیام‌هایی که در این سقف جای می‌گیرند، بسته به مدل انتخابی و طول گفت‌وگوی شما متفاوت است. هر صفحه‌ای که عدد توکن ماهانهٔ مشخصی را برای Pro ذکر کند، صرفاً در حال حدس‌زدن است. برای مشاهدهٔ میزان مصرف شخصی و زمان بازنشانی سهمیه، در سایت claude.ai به بخش Settings و سپس Usage بروید.

آیا شروع یک چت جدید، سهمیهٔ مصرفی من را بازنشانی می‌کند؟

خیر. میزان مصرف برای کل حساب کاربری شما در بازهٔ زمانی مربوطه محاسبه می‌شود؛ بنابراین شروع یک چت جدید، سهمیهٔ مصرف‌شده را به شما بازنمی‌گرداند. آنچه تغییر می‌کند، هزینهٔ هر نوبت (turn) از آن لحظه به بعد است. یک چت جدید فاقد تاریخچه برای ارسال مجدد است، بنابراین به‌جای ادامهٔ روند صعودی هزینه، از پایین‌ترین سطح نمودار شروع می‌شود. باز کردن یک چت تازه هنگام تغییر موضوع، اقتصادی‌ترین عادت در هر طرح اشتراکی است.

چرا امروز سریع‌تر از دیروز به محدودیت رسیدم؟

معمولاً به این دلیل که کار امروز شما در یک رشته‌گفت‌وگوی (thread) طولانی انجام شده است. در هر نوبت، کل گفت‌وگو به همراه فایل‌های پیوست مجدداً ارسال می‌شود؛ بنابراین در حالی که تعداد پیام‌ها از نظر شما تغییری نکرده، هزینهٔ هر پیام به‌طور پیوسته افزایش می‌یابد. دلیل رایج دیگر، نوع مدل است: مدل‌های سنگین‌تر در هر نوبت سهمیهٔ بیشتری مصرف می‌کنند، بنابراین یک بعدازظهر کار با بزرگ‌ترین مدل، زودتر از یک صبح کار با مدل کوچک‌تر به پایان می‌رسد.

آیا برای شمارش دقیق توکن‌ها باید به سراغ API بروم؟

اگر به آمار دقیق یا پیش‌بینی‌پذیری نیاز دارید، از API استفاده کنید. API توکن‌های ورودی و خروجی را در هر فراخوانی می‌شمارد، یک endpoint برای شمارش توکن‌ها در اختیار شما قرار می‌دهد که می‌توانید پیش از ارسال پیام از آن استفاده کنید، و هیچ بازهٔ زمانی انتظاری ندارد. هزینهٔ آن بر اساس تعداد توکن محاسبه می‌شود؛ بنابراین استفادهٔ سنگین هزینهٔ بیشتری نسبت به اشتراک ثابت دارد و استفادهٔ سبک بسیار ارزان‌تر تمام می‌شود. پیش از تغییر، حجم کاری واقعی خود را با طرح فعلی مقایسه کنید، زیرا پاسخ نهایی بسته به تعداد توکن‌های ارسالی شما تغییر می‌کند.