SSD Nodes Learn
راهنماها Matt Connorتوسط Matt Connor · به‌روزرسانی شده 2026-07-24

مقایسه هزینه Claude API و اشتراک ماهانه

آیا استفاده از Claude API از اشتراک ارزان‌تر است؟ در این مقاله نقطه سر‌به‌سر هزینه بر اساس نرخ هر توکن و محاسبات دقیق برای مدل‌های مختلف را بررسی می‌کنیم.

آیا Claude API ارزان‌تر از اشتراک است؟

استفاده از Claude API در حجم‌های پایین از یک اشتراک ارزان‌تر است و در حجم‌های بالا گران‌تر تمام می‌شود. برای یک توسعه‌دهنده که تمام روز به صورت تعاملی کدنویسی می‌کند، معمولاً طرح‌های ثابت (flat plan) برنده هستند. برای برنامه‌ای که خودش درخواست‌ها را ارسال می‌کند، API تنها گزینه است، بنابراین هزینه تعیین‌کننده نیست. باقی‌مانده محاسبات ساده است که در 10 دقیقه انجام می‌شود.

هیچ عدد رسمی برای نقطه سر‌به‌سر (break-even) وجود ندارد. اشتراک‌ها بر اساس بازه‌های استفاده (usage windows) فروخته می‌شوند تا سهمیه توکن، بنابراین هیچ رقم منتشر شده‌ای نمی‌تواند نقطه تلاقی این دو را به شما بگوید. آنچه در ادامه می‌آید، فرمولی است که بر اساس نرخ‌های فعلی هر توکن، به علاوه بخش‌هایی از رفتار شما که پاسخ را بسیار فراتر از هزینه ماهانه طرح می‌برد، محاسبه شده است. تمام ارقام سر‌به‌سر در ادامه، محاسبات شخصی من بر اساس نرخ‌های منتشر شده و فرض‌های اعلام شده است، نه یک عدد مستند.

اگر هنوز در حال تصمیم‌گیری برای خرید هستید، این مطلب که کدام طرح Claude با سبک کاری شما سازگار است به این سوال پاسخ می‌دهد. این پست فرض را بر این می‌گذارد که شما می‌دانید کدام طرح را می‌خواهید بخرید و فقط می‌خواهید بدانید آیا اصلاً آن را بخرید یا خیر.

دو مدل صورت‌حساب با ساختار متفاوت

اشتراک، ظرفیتی است که ممکن است از آن استفاده نکنید. شما هزینه ثابتی پرداخت می‌کنید و سهمیه‌ای دریافت می‌کنید که در یک زمان‌بندی مشخص بازنشانی (reset) می‌شود. مستندات Claude Code شرکت Anthropic ساختار نشست‌های Team و Enterprise را اینگونه بیان می‌کند: استفاده از "یک سهمیه برای هر کاربر است که در یک پنجره متحرک 5 ساعته و یک پنجره هفتگی بازنشانی می‌شود" و با Claude chat و Cowork مشترک است. مشترک نیز با رسیدن به تعداد پیام‌های مشخص با همین وضعیت روبرو می‌شود که با پیام‌های "You've hit your session limit" و "You've hit your weekly limit" شناخته می‌شود. ظرفیتی که استفاده نکنید، پولی است که صرف کرده‌اید. استفاده بیش از ظرفیت باعث توقف کار شما تا بازنشانی پنجره می‌شود و تغییر مدل با /model دسترسی را بازیابی نمی‌کند، زیرا پنجره‌ها بین مدل‌ها مشترک هستند.

API مانند یک کنتور است که هرگز متوقف نمی‌شود. هیچ پنجره یا محدودیتی وجود ندارد. هر درخواست بر اساس توکن قیمت‌گذاری می‌شود و برخی موارد خارج از توکن قیمت‌گذاری می‌شوند: جستجوی وب "در Claude API با قیمت 10 دلار به ازای هر 1,000 جستجو در دسترس است". هیچ چیز در یک محدودیت متوقف نمی‌شود؛ صورت‌حساب فقط بزرگتر می‌شود.

هزینه‌های طرح‌ها تا تاریخ 23 July 2026، برگرفته از صفحه قیمت‌گذاری Claude: مدل Pro شامل "17 دلار در ماه با تخفیف اشتراک سالانه (200 دلار پرداخت پیش‌پرداخت) و 20 دلار برای پرداخت ماهانه" است و Claude Code را شامل می‌شود. مدل Max با عبارت "از 100 دلار در ماه" لیست شده است. نشست‌های Team از "20 دلار به ازوی هر کاربر / ماه در صورت پرداخت سالانه" شروع می‌شوند. مدل Enterprise جالب‌ترین بخش است، زیرا هر دو مدل را همزمان اجرا می‌کند: "قیمت هر کاربر + استفاده با نرخ‌های API به میزان 20 دلار/هر کاربر". هزینه‌ها اغلب تغییر می‌کنند و سهمیه پشت هر کدام هرگز به توکن منتشر نمی‌شود، بنابراین در روز تصمیم‌گیری، صفحه قیمت‌گذاری را چک کنید.

آنچه از API نمی‌توانید دریافت کنید

سهمیه طرح و رابط کاربری ساخته شده حول آن. دستور /usage-credits در Claude Code میزان استفاده از اعتبار اشتراک را مدیریت می‌کند و شما آن را "پس از ورود به سیستم با اشتراک claude.ai از طریق /login اجرا می‌کنید؛ این دستور با احراز هویت API key در دسترس نیست." صفحه /usage نیز بسته به حالت صورت‌حساب متفاوت است: بخش Session در آن "میزان استفاده از توکن API را نشان می‌دهد و برای کاربران API در نظر گرفته شده است"، در حالی که مشترکین به جای آن، نوارهای استفاده از طرح و جزئیات استفاده را می‌بینند.

حافظه پنهان (cache) طولانی‌تر در Claude Code. این مورد هزینه واقعی دارد و به راحتی نادیده گرفته می‌شود. مستندات می‌گوید: "طول عمر حافظه در اشتراک یک ساعت است و پس از استفاده از اعتبارات استفاده، به 5 دقیقه کاهش می‌یابد؛ در API key یا ارائه‌دهنده ابری، به طور پیش‌فرض 5 دقیقه است". اولین پیام شما پس از وقفه‌ای طولانی‌تر از زمان حافظه پنهان، از cache استفاده نمی‌کند، بنابراین کل متن شما دوباره پردازش شده و با قیمت write صورت‌حساب می‌شود. در اشتراک، می‌توانید یک جلسه 50 دقیقه‌ای داشته باشید و دوباره با حافظه گرم (warm) برگردید. در API key، همان وقفه باعث بازنویسی کامل پیشوند (prefix) جلسه می‌شود.

آنچه از اشتراک نمی‌توانید دریافت کنید

دسترسی برنامه‌نویسی شده (Programmatic access). یک cron job یا یک webhook handler که Claude را فراخوانی می‌کند، به یک API key نیاز دارد، بنابراین اگر حجم کاری شما این است، مقایسه تمام شده است. ساخت اولین اپلیکیشن Claude API خود روی یک VPS نحوه مدیریت کلید و اولین اسکریپت آماده کار را پوشش می‌دهد.

تخفیف Batch API. صفحه قیمت‌گذاری صراحتاً بیان می‌کند: "Batch API اجازه پردازش ناهمگام حجم زیادی از درخواست‌ها را با 50% تخفیف در هر دو توکن ورودی و خروجی می‌دهد." این کار هزینه کنتور را برای هر کاری که انسان منتظر آن نیست، نصف می‌کند. نرخ‌های Batch برای هر میلیون توکن در Opus 4.8 برابر با 2.50 دلار برای ورودی و 12.50 دلار برای خروجی است، در Sonnet 5 با قیمت‌های آزمایشی 1 دلار و 5 دلار، و در Haiku 4.5 برابر با 0.50 دلار و 2.50 دلار است. هزینه آن تاخیر (latency) است: اکثر batchها در کمتر از یک ساعت تمام می‌شوند، batchی که در عرض 24 ساعت تکمیل نشود منقضی می‌شود، و حالت streaming را نمی‌توان به صورت batch اجرا کرد. Batch و prompt caching با هم ترکیب می‌شوند و چون یک batch می‌تواند بیش از 5 دقیقه طول بکشد، از حافظه 1- ساعته در داخل آن استفاده کنید.

تخصیص هزینه به هر پروژه. هر پاسخ API یک بلوک usage برمی‌گرداند، بنابراین می‌توانید هزینه یک درخواست واحد را ثبت کرده و آن را به یک پروژه یا مشتری نسبت دهید. یک اشتراک، مجموعه‌ای از نمودارها را فقط برای شخصی که صاحب نشست است گزارش می‌دهد.

یک نکته را با دقت بیان می‌کنم، چون احتمال اشتباه در هر دو جهت وجود دارد: این‌ها سطوح صورت‌حساب جداگانه هستند. مستندات Anthropic صورت‌حساب اشتراک را به پشتیبانی claude.ai و صورت‌حساب Console را به پلتفرم API ارجاع می‌دهد، و /usage-credits تحت یک API key کار نمی‌کند. هیچ‌کدام از مواردی که من بررسی کردم نشان نمی‌دهد که اشتراک شامل اعتبار API است، بنابراین برای دو حساب و دو صورت‌حساب برنامه‌ریزی کنید.

فرمول نقطه سر‌به‌سر

قیمت یک مرحله (turn) را محاسبه کنید، سپس آن را مقیاس‌دهی کنید.

turn cost = uncached_input_tokens x base_input_price
          + cache_write_tokens    x 1.25 x base_input_price
          + cache_read_tokens     x 0.10 x base_input_price
          + output_tokens         x output_price

monthly API cost = turn cost x turns_per_active_day x active_days_per_month

break even when: monthly API cost = flat plan fee

ضرایب منتشر شده‌اند، نه تخمینی. یک نوشتن در حافظه 5 دقیقه‌ای "1.25x قیمت پایه ورودی" هزینه دارد، یک نوشتن 1 ساعته "2x قیمت پایه ورودی" هزینه دارد، و خواندن از حافظه "0.1x قیمت پایه ورودی" هزینه دارد. توکن‌های تفکر (thinking tokens) مانند توکن‌های خروجی صورت‌حساب می‌شوند، بنابراین حتی در مدل‌هایی که خلاصه استدلال را نمایش نمی‌دهند، باید در output_tokens لحاظ شوند.

نرخ‌های پایه برای هر میلیون توکن (MTok)، به‌روز در 23 July 2026:

  • claude-fable-5: 10 دلار ورودی، 50 دلار خروجی. خواندن از cache 1 دلار. نوشتن در cache 5 دقیقه‌ای 12.50 دلار. 1M context.
  • claude-opus-4-8 و claude-opus-4-7: 5 دلار ورودی، 25 دلار خروجی. خواندن از cache 0.50 دلار. نوشتن در cache 5 دقیقه‌ای 6.25 دلار. 1M context.
  • claude-sonnet-5: 2 دلار ورودی، 10 دلار خروجی در قیمت‌های آزمایشی تا 31 August 2026، سپس 3 دلار و 15 دلار. در نرخ‌های آزمایشی، خواندن از cache 0.20 دلار و نوشتن در cache 5 دقیقه‌ای 2.50 دلار. 1M context.
  • claude-haiku-4-5: 1 دلار ورودی، 5 دلار خروجی. خواندن از cache 0.10 دلار. نوشتن در cache 5 دقیقه‌ای 1.25 دلار. 200K context.

هیچ هزینه اضافی برای context طولانی وجود ندارد: "یک درخواست 900k-توکنی با همان نرخ هر توکن یک درخواست 9k-توکنی صورت‌حساب می‌شود."

یک مثال حل شده، با فرض‌های نوشته شده

یک مرحله متوسط در Claude Code با مدل Sonnet 5 را در نظر بگیرید که 60,000 توکن context دارد: 55,000 توکن از cache خوانده شده، 3,000 توکن تازه در cache نوشته شده، 2,000 توکن ورودی تازه بدون cache، و 1,200 توکن خروجی شامل تفکر.

  • خواندن از cache: 55,000 x $0.20/MTok = $0.0110
  • نوشتن در cache: 3,000 x $2.50/MTok = $0.0075
  • ورودی بدون cache: 2,000 x $2.00/MTok = $0.0040
  • خروجی: 1,200 x $10.00/MTok = $0.0120

این حدوداً $0.035 در هر مرحله است. با 120 مرحله در یک روز فعال، تقریباً $4.14 در روز. با 20 روز فعال در ماه، تقریباً $83 در ماه.

این را در مقابل هزینه‌های ثابت بالا قرار دهید؛ این عدد دو چیز را همزمان می‌گوید. این حدوداً چهار برابر هزینه Pro است، بنابراین Pro روی کاغذ ارزان‌تر است، به شرطی که سهمیه آن بتواند 120 مرحله Sonnet در روز را پوشش دهد. این شرط چیزی است که هیچ عدد منتشر شده‌ای نمی‌تواند برای شما تعیین کند. همان 83 دلار کمتر از هزینه پایه Max است، بنابراین در اینجا کنتور از Max بهتر عمل می‌کند.

حالا هر بار یک فرض را تغییر دهید و ببینید چگونه هزینه طرح دیگر عدد تعیین‌کننده نیست.

سه چیزی که نقطه سر‌به‌سر را بیشتر از قیمت طرح تغییر می‌دهد

Prompt caching. همان مرحله 60,000 توکنی را بدون cache اجرا کنید؛ کل پرامپت به عنوان ورودی تازه صورت‌حساب می‌شود: 60,000 x $2.00/MTok = $0.12، به علاوه $0.012 خروجی، بنابراین $0.132 در هر مرحله. این تقریباً چهار برابر مرحله با cache است و هزینه ماهانه 83 دلاری را به حدود 317 دلار تبدیل می‌کند. این تنها نقطه سر‌به‌سر است که Anthropic منتشر می‌کند، زیرا به حجم کار شما بستگی ندارد: "یک hit در cache برابر با 10% قیمت استاندارد ورودی است، به این معنی که caching تنها پس از یک بار خواندن از cache برای مدت 5 دقیقه (1.25x write)، یا پس از دو بار خواندن از cache برای مدت 1 ساعت (2x write) سودآور است."

دو حالت شکست باعث خاموش شدن cache بدون اطلاع به شما می‌شود. اولی، پیشوند کوتاه‌تر از حداقل طول قابل ذخیره در مدل است: 512 توکن در Fable 5، 1,024 در Opus 4.8 و Sonnet 5، 2,048 در Opus 4.7، و 4,096 در Haiku 4.5. یک پیشوند کوتاه‌تر cache نمی‌شود و خطایی هم داده نمی‌شود. دومی، درخواست‌های موازی است، زیرا "یک entry در cache تنها پس از شروع اولین پاسخ در دسترس قرار می‌گیرد." ده درخواست یکسان که همزمان ارسال شوند، همگی قیمت کامل ورودی را پرداخت می‌کنند. نشانه هر دو، صفر بودن cache_read_input_tokens است.

انتخاب مدل. یک مرحله مشابه را در Opus 4.8 با قیمت 5 دلار ورودی و 25 دلار خروجی، با خواندن از cache 0.50 دلار و نوشتن 5 دقیقه‌ای 6.25 دلار در هر MTok محاسبه کنید: خواندن 0.0275، نوشتن 0.0188، ورودی بدون cache 0.0100، خروجی 0.0300. این حدوداً $0.086 در هر مرحله است، 2.5 برابر مرحله Sonnet، و حدود 207 دلار در ماه با همان حجم. یک انتخاب مدل، همان کار را از زیر هزینه پایه Max به بیش از دو برابر آن منتقل کرد. Haiku 4.5 با قیمت 1 دلار و 5 دلار، آن را برای کارهای مکانیکی مانند دسته‌بندی لاگ‌ها به سمت دیگر می‌برد.

سطح تلاش به انتخاب مدل مربوط است، زیرا توکن‌های تفکر با نرخ خروجی صورت‌حساب می‌شوند. در Opus 4.8 پیش‌فرض API برابر با high است، و نقطه شروع مستند شده برای کارهای کدنویسی و عامل‌محور (agentic)، مدل گران‌تر یعنی xhigh است. با استفاده از /effort در Claude Code یا output_config.effort در API آن را کاهش دهید. یک چیز دیگر تخمین‌های قدیمی را تغییر می‌دهد: مدل‌های جدیدتر از توکنایزر جدیدتری استفاده می‌کنند که "تقریباً 30% توکن بیشتری برای همان متن تولید می‌کند"، بنابراین شمارش در یک مدل قدیمی‌تر، مقدار همان متن را در امروز کمتر از واقعیت نشان می‌دهد.

بهداشت نشست (Session hygiene). API بدون حالت (stateless) است، بنابراین هر مرحله کل گفتگو را به عنوان ورودی صورت‌حساب شده مجدداً ارسال می‌کند. بنابراین یک نشست طولانی در هر پیام هزینه بیشتری نسبت به یک نشست تازه دارد، که این مکانیزم پشت اکثر صورت‌حساب‌های غافلگیرکننده است و در اینکه واقعاً چه چیزی در یک نشست Claude Code توکن مصرف می‌کند به تفصیل بررسی شده است. بین کارهای بی‌ربط از /clear استفاده کنید، زیرا context قدیمی در هر پیام بعدی دوباره ارسال و صورت‌حساب می‌شود. در داخل یک کار طولانی از /compact استفاده کنید تا تاریخچه به جای حمل کامل، خلاصه‌سازی شود. در بازه‌های مداوم کار کنید، زیرا cache پیش‌فرض "دارای طول عمر 5 دقیقه است" و "هر بار که محتوای cache شده استفاده شود، بدون هزینه اضافی بازنشانی می‌شود". نشستی که هر ده دقیقه یک بار به آن دست می‌زنید، هر بار هزینه بازنویسی (re-write) دارد. یک نشست Claude Code که در tmux روی یک VPS اجرا می‌شود در زمانی که بیکار است تقریباً هیچ هزینه‌ای ندارد، اما بیکار ماندن بیش از زمان عمر cache، باعث از دست رفتن پیشوند گرم می‌شود.

قبل از تصمیم‌گیری، میزان استفاده خود را اندازه‌گیری کنید

از مثال من تصمیم نگیرید. از یک هفته از خودتان تصمیم بگیرید.

در Claude Code، در پایان هر نشست به مدت یک هفته /usage را اجرا کنید (/cost نام مستعار برای همان صفحه است). این دستور تعداد توکن‌های نشست و تخمین هزینه را گزارش می‌دهد، با یک نکته از مستندات: "عدد دلاری یک تخمین است که به صورت محلی از تعداد توکن‌ها محاسبه شده و ممکن است با صورت‌حساب واقعی شما متفاوت باشد." با اجرای /clear، مجموع‌ها بازنشانی می‌شوند، بنابراین ابتدا صفحه را بخوانید. در یک اشتراک، آن عدد دلاری صورت‌حساب شما نیست، اما تعداد توکن‌های پشت آن همان چیزی است که این فرمول به آن نیاز دارد. /context نشان می‌دهد چه چیزی در حال پر کردن پنجره است.

در یک حساب API، صفحه usage در Claude Console منبع معتبر است. برای قیمت‌گذاری یک پرامپت قبل از ارسال آن، client.messages.count_tokens() "استفاده از آن رایگان است اما مشمول محدودیت نرخ درخواست در دقیقه بر اساس سطح استفاده شماست" و این تنها شمارشی است که از توکنایزری استفاده می‌کند که واقعاً برای آن صورت‌حساب خواهید شد.

پس از یک فراخوانی، بلوک usage را بخوانید و آن را درست بخوانید:

u = response.usage
total_input = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokens

input_tokens فقط باقی‌مانده بدون cache را می‌شمارد، که به عنوان "توکن‌های بعد از آخرین نقطه توقف cache" مستند شده است. یک مرحله که input_tokens: 4000 را گزارش می‌دهد، یک مرحله 4,000 توکنی نیست، و سه فیلدی که با هم جمع می‌شوند، اندازه پرامپتی است که این فرمول می‌خواهد.

سپس مقایسه کنید. اگر ماه اندازه‌گیری شده شما به وضوح زیر هزینه طرح قرار گرفت، از کنتور استفاده کنید. اگر به وضوح بالاتر بود، از طرح استفاده کنید، تا زمانی که سهمیه آن یک روز کاری عادی برای شما را پوشش دهد. اگر نزدیک خط بود، از طرح استفاده کنید، زیرا یک طرح نمی‌تواند شما را غافلگیر کند اما یک کنتور می‌تواند.

FAQ

آیا Claude API ارزان‌تر از Claude Pro یا Max است؟

بستگی به حجم استفاده دارد و هیچ نقطه سر‌به‌سر منتشر شده‌ای برای جستجو وجود ندارد، زیرا اشتراک‌ها به جای سهمیه توکن، به صورت بازه‌های استفاده فروخته می‌شوند. قیمت یک مرحله معمولی را از نرخ‌های منتشر شده هر توکن محاسبه کنید، آن را در تعداد مراحل در روز فعال و تعداد روزهای فعال در ماه ضرب کنید، و سپس آن عدد را با هزینه طرح مقایسه کنید. در یک مثال حل شده، یک مرحله 60,000 توکنی Sonnet 5 حدود 0.035 دلار، یا تقریباً 83 دلار در ماه با 120 مرحله در روز طی 20 روز بود: بالاتر از هزینه Pro، پایین‌تر از هزینه پایه Max.

چگونه هزینه ماهانه Claude API خود را محاسبه کنم؟

برای جمع‌آوری تعداد توکن‌های واقعی، یک هفته /usage را در Claude Code اجرا کنید، یا اگر از قبل حساب API دارید، صفحه usage را در Claude Console بخوانید. سپس یک مرحله را قیمت‌گذاری کنید: ورودی بدون cache با نرخ پایه، نوشتن در cache با 1.25 برابر نرخ پایه ورودی، خواندن از cache با 0.1 برابر نرخ پایه ورودی، و خروجی با نرخ خروجی، با احتساب توکن‌های تفکر به عنوان خروجی. آن را در تعداد مراحل در روز فعال و تعداد روزهای فعال در ماه ضرب کنید.

چه چیزی صورت‌حساب Claude API را بیشتر تغییر می‌دهد؟

Prompt caching، بیش از هر چیز دیگری. یک مرحله 60,000 توکنی در Sonnet 5 وقتی پیشوند از cache خوانده شود حدود 0.035 دلار هزینه دارد و وقتی خوانده نشود حدود 0.132 دلار. انتخاب مدل در مرحله بعد است: همان مرحله در Opus 4.8 حدود 0.086 دلار هزینه دارد. طول نشست در مرحله سوم است، زیرا API بدون حالت است و هر مرحله کل گفتگو را به عنوان ورودی صورت‌حساب شده مجدداً ارسال می‌کند.

آیا اشتراک Claude شامل دسترسی API است؟

با آن‌ها به عنوان دو حساب با دو صورت‌حساب مجزا برخورد کنید. فراخوانی‌های API بر اساس توکن در حسابی که در Console ایجاد می‌کنید صورت‌حساب می‌شوند و هیچ‌چیز در مستنداتی که من بررسی کردم نمی‌گوید که اشتراک شامل اعتبار API است. واضح‌ترین نشانه اینکه آن‌ها سطوح جداگانه هستند، دستور /usage-credits در Claude Code است که "با احراز هویت API key در دسترس نیست". بسیاری از توسعه‌دهندگان هر دو را دارند: یک طرح برای کدنویسی تعاملی، و یک کلید برای چیزهایی که می‌سازند.