مقایسه هزینه Claude API و اشتراک ماهانه
آیا استفاده از Claude API از اشتراک ارزانتر است؟ در این مقاله نقطه سربهسر هزینه بر اساس نرخ هر توکن و محاسبات دقیق برای مدلهای مختلف را بررسی میکنیم.
آیا Claude API ارزانتر از اشتراک است؟
استفاده از Claude API در حجمهای پایین از یک اشتراک ارزانتر است و در حجمهای بالا گرانتر تمام میشود. برای یک توسعهدهنده که تمام روز به صورت تعاملی کدنویسی میکند، معمولاً طرحهای ثابت (flat plan) برنده هستند. برای برنامهای که خودش درخواستها را ارسال میکند، API تنها گزینه است، بنابراین هزینه تعیینکننده نیست. باقیمانده محاسبات ساده است که در 10 دقیقه انجام میشود.
هیچ عدد رسمی برای نقطه سربهسر (break-even) وجود ندارد. اشتراکها بر اساس بازههای استفاده (usage windows) فروخته میشوند تا سهمیه توکن، بنابراین هیچ رقم منتشر شدهای نمیتواند نقطه تلاقی این دو را به شما بگوید. آنچه در ادامه میآید، فرمولی است که بر اساس نرخهای فعلی هر توکن، به علاوه بخشهایی از رفتار شما که پاسخ را بسیار فراتر از هزینه ماهانه طرح میبرد، محاسبه شده است. تمام ارقام سربهسر در ادامه، محاسبات شخصی من بر اساس نرخهای منتشر شده و فرضهای اعلام شده است، نه یک عدد مستند.
اگر هنوز در حال تصمیمگیری برای خرید هستید، این مطلب که کدام طرح Claude با سبک کاری شما سازگار است به این سوال پاسخ میدهد. این پست فرض را بر این میگذارد که شما میدانید کدام طرح را میخواهید بخرید و فقط میخواهید بدانید آیا اصلاً آن را بخرید یا خیر.
دو مدل صورتحساب با ساختار متفاوت
اشتراک، ظرفیتی است که ممکن است از آن استفاده نکنید. شما هزینه ثابتی پرداخت میکنید و سهمیهای دریافت میکنید که در یک زمانبندی مشخص بازنشانی (reset) میشود. مستندات Claude Code شرکت Anthropic ساختار نشستهای Team و Enterprise را اینگونه بیان میکند: استفاده از "یک سهمیه برای هر کاربر است که در یک پنجره متحرک 5 ساعته و یک پنجره هفتگی بازنشانی میشود" و با Claude chat و Cowork مشترک است. مشترک نیز با رسیدن به تعداد پیامهای مشخص با همین وضعیت روبرو میشود که با پیامهای "You've hit your session limit" و "You've hit your weekly limit" شناخته میشود. ظرفیتی که استفاده نکنید، پولی است که صرف کردهاید. استفاده بیش از ظرفیت باعث توقف کار شما تا بازنشانی پنجره میشود و تغییر مدل با /model دسترسی را بازیابی نمیکند، زیرا پنجرهها بین مدلها مشترک هستند.
API مانند یک کنتور است که هرگز متوقف نمیشود. هیچ پنجره یا محدودیتی وجود ندارد. هر درخواست بر اساس توکن قیمتگذاری میشود و برخی موارد خارج از توکن قیمتگذاری میشوند: جستجوی وب "در Claude API با قیمت 10 دلار به ازای هر 1,000 جستجو در دسترس است". هیچ چیز در یک محدودیت متوقف نمیشود؛ صورتحساب فقط بزرگتر میشود.
هزینههای طرحها تا تاریخ 23 July 2026، برگرفته از صفحه قیمتگذاری Claude: مدل Pro شامل "17 دلار در ماه با تخفیف اشتراک سالانه (200 دلار پرداخت پیشپرداخت) و 20 دلار برای پرداخت ماهانه" است و Claude Code را شامل میشود. مدل Max با عبارت "از 100 دلار در ماه" لیست شده است. نشستهای Team از "20 دلار به ازوی هر کاربر / ماه در صورت پرداخت سالانه" شروع میشوند. مدل Enterprise جالبترین بخش است، زیرا هر دو مدل را همزمان اجرا میکند: "قیمت هر کاربر + استفاده با نرخهای API به میزان 20 دلار/هر کاربر". هزینهها اغلب تغییر میکنند و سهمیه پشت هر کدام هرگز به توکن منتشر نمیشود، بنابراین در روز تصمیمگیری، صفحه قیمتگذاری را چک کنید.
آنچه از API نمیتوانید دریافت کنید
سهمیه طرح و رابط کاربری ساخته شده حول آن. دستور /usage-credits در Claude Code میزان استفاده از اعتبار اشتراک را مدیریت میکند و شما آن را "پس از ورود به سیستم با اشتراک claude.ai از طریق /login اجرا میکنید؛ این دستور با احراز هویت API key در دسترس نیست." صفحه /usage نیز بسته به حالت صورتحساب متفاوت است: بخش Session در آن "میزان استفاده از توکن API را نشان میدهد و برای کاربران API در نظر گرفته شده است"، در حالی که مشترکین به جای آن، نوارهای استفاده از طرح و جزئیات استفاده را میبینند.
حافظه پنهان (cache) طولانیتر در Claude Code. این مورد هزینه واقعی دارد و به راحتی نادیده گرفته میشود. مستندات میگوید: "طول عمر حافظه در اشتراک یک ساعت است و پس از استفاده از اعتبارات استفاده، به 5 دقیقه کاهش مییابد؛ در API key یا ارائهدهنده ابری، به طور پیشفرض 5 دقیقه است". اولین پیام شما پس از وقفهای طولانیتر از زمان حافظه پنهان، از cache استفاده نمیکند، بنابراین کل متن شما دوباره پردازش شده و با قیمت write صورتحساب میشود. در اشتراک، میتوانید یک جلسه 50 دقیقهای داشته باشید و دوباره با حافظه گرم (warm) برگردید. در API key، همان وقفه باعث بازنویسی کامل پیشوند (prefix) جلسه میشود.
آنچه از اشتراک نمیتوانید دریافت کنید
دسترسی برنامهنویسی شده (Programmatic access). یک cron job یا یک webhook handler که Claude را فراخوانی میکند، به یک API key نیاز دارد، بنابراین اگر حجم کاری شما این است، مقایسه تمام شده است. ساخت اولین اپلیکیشن Claude API خود روی یک VPS نحوه مدیریت کلید و اولین اسکریپت آماده کار را پوشش میدهد.
تخفیف Batch API. صفحه قیمتگذاری صراحتاً بیان میکند: "Batch API اجازه پردازش ناهمگام حجم زیادی از درخواستها را با 50% تخفیف در هر دو توکن ورودی و خروجی میدهد." این کار هزینه کنتور را برای هر کاری که انسان منتظر آن نیست، نصف میکند. نرخهای Batch برای هر میلیون توکن در Opus 4.8 برابر با 2.50 دلار برای ورودی و 12.50 دلار برای خروجی است، در Sonnet 5 با قیمتهای آزمایشی 1 دلار و 5 دلار، و در Haiku 4.5 برابر با 0.50 دلار و 2.50 دلار است. هزینه آن تاخیر (latency) است: اکثر batchها در کمتر از یک ساعت تمام میشوند، batchی که در عرض 24 ساعت تکمیل نشود منقضی میشود، و حالت streaming را نمیتوان به صورت batch اجرا کرد. Batch و prompt caching با هم ترکیب میشوند و چون یک batch میتواند بیش از 5 دقیقه طول بکشد، از حافظه 1- ساعته در داخل آن استفاده کنید.
تخصیص هزینه به هر پروژه. هر پاسخ API یک بلوک usage برمیگرداند، بنابراین میتوانید هزینه یک درخواست واحد را ثبت کرده و آن را به یک پروژه یا مشتری نسبت دهید. یک اشتراک، مجموعهای از نمودارها را فقط برای شخصی که صاحب نشست است گزارش میدهد.
یک نکته را با دقت بیان میکنم، چون احتمال اشتباه در هر دو جهت وجود دارد: اینها سطوح صورتحساب جداگانه هستند. مستندات Anthropic صورتحساب اشتراک را به پشتیبانی claude.ai و صورتحساب Console را به پلتفرم API ارجاع میدهد، و /usage-credits تحت یک API key کار نمیکند. هیچکدام از مواردی که من بررسی کردم نشان نمیدهد که اشتراک شامل اعتبار API است، بنابراین برای دو حساب و دو صورتحساب برنامهریزی کنید.
فرمول نقطه سربهسر
قیمت یک مرحله (turn) را محاسبه کنید، سپس آن را مقیاسدهی کنید.
turn cost = uncached_input_tokens x base_input_price
+ cache_write_tokens x 1.25 x base_input_price
+ cache_read_tokens x 0.10 x base_input_price
+ output_tokens x output_price
monthly API cost = turn cost x turns_per_active_day x active_days_per_month
break even when: monthly API cost = flat plan feeضرایب منتشر شدهاند، نه تخمینی. یک نوشتن در حافظه 5 دقیقهای "1.25x قیمت پایه ورودی" هزینه دارد، یک نوشتن 1 ساعته "2x قیمت پایه ورودی" هزینه دارد، و خواندن از حافظه "0.1x قیمت پایه ورودی" هزینه دارد. توکنهای تفکر (thinking tokens) مانند توکنهای خروجی صورتحساب میشوند، بنابراین حتی در مدلهایی که خلاصه استدلال را نمایش نمیدهند، باید در output_tokens لحاظ شوند.
نرخهای پایه برای هر میلیون توکن (MTok)، بهروز در 23 July 2026:
claude-fable-5: 10 دلار ورودی، 50 دلار خروجی. خواندن از cache 1 دلار. نوشتن در cache 5 دقیقهای 12.50 دلار. 1M context.claude-opus-4-8وclaude-opus-4-7: 5 دلار ورودی، 25 دلار خروجی. خواندن از cache 0.50 دلار. نوشتن در cache 5 دقیقهای 6.25 دلار. 1M context.claude-sonnet-5: 2 دلار ورودی، 10 دلار خروجی در قیمتهای آزمایشی تا 31 August 2026، سپس 3 دلار و 15 دلار. در نرخهای آزمایشی، خواندن از cache 0.20 دلار و نوشتن در cache 5 دقیقهای 2.50 دلار. 1M context.claude-haiku-4-5: 1 دلار ورودی، 5 دلار خروجی. خواندن از cache 0.10 دلار. نوشتن در cache 5 دقیقهای 1.25 دلار. 200K context.
هیچ هزینه اضافی برای context طولانی وجود ندارد: "یک درخواست 900k-توکنی با همان نرخ هر توکن یک درخواست 9k-توکنی صورتحساب میشود."
یک مثال حل شده، با فرضهای نوشته شده
یک مرحله متوسط در Claude Code با مدل Sonnet 5 را در نظر بگیرید که 60,000 توکن context دارد: 55,000 توکن از cache خوانده شده، 3,000 توکن تازه در cache نوشته شده، 2,000 توکن ورودی تازه بدون cache، و 1,200 توکن خروجی شامل تفکر.
- خواندن از cache: 55,000 x $0.20/MTok = $0.0110
- نوشتن در cache: 3,000 x $2.50/MTok = $0.0075
- ورودی بدون cache: 2,000 x $2.00/MTok = $0.0040
- خروجی: 1,200 x $10.00/MTok = $0.0120
این حدوداً $0.035 در هر مرحله است. با 120 مرحله در یک روز فعال، تقریباً $4.14 در روز. با 20 روز فعال در ماه، تقریباً $83 در ماه.
این را در مقابل هزینههای ثابت بالا قرار دهید؛ این عدد دو چیز را همزمان میگوید. این حدوداً چهار برابر هزینه Pro است، بنابراین Pro روی کاغذ ارزانتر است، به شرطی که سهمیه آن بتواند 120 مرحله Sonnet در روز را پوشش دهد. این شرط چیزی است که هیچ عدد منتشر شدهای نمیتواند برای شما تعیین کند. همان 83 دلار کمتر از هزینه پایه Max است، بنابراین در اینجا کنتور از Max بهتر عمل میکند.
حالا هر بار یک فرض را تغییر دهید و ببینید چگونه هزینه طرح دیگر عدد تعیینکننده نیست.
سه چیزی که نقطه سربهسر را بیشتر از قیمت طرح تغییر میدهد
Prompt caching. همان مرحله 60,000 توکنی را بدون cache اجرا کنید؛ کل پرامپت به عنوان ورودی تازه صورتحساب میشود: 60,000 x $2.00/MTok = $0.12، به علاوه $0.012 خروجی، بنابراین $0.132 در هر مرحله. این تقریباً چهار برابر مرحله با cache است و هزینه ماهانه 83 دلاری را به حدود 317 دلار تبدیل میکند. این تنها نقطه سربهسر است که Anthropic منتشر میکند، زیرا به حجم کار شما بستگی ندارد: "یک hit در cache برابر با 10% قیمت استاندارد ورودی است، به این معنی که caching تنها پس از یک بار خواندن از cache برای مدت 5 دقیقه (1.25x write)، یا پس از دو بار خواندن از cache برای مدت 1 ساعت (2x write) سودآور است."
دو حالت شکست باعث خاموش شدن cache بدون اطلاع به شما میشود. اولی، پیشوند کوتاهتر از حداقل طول قابل ذخیره در مدل است: 512 توکن در Fable 5، 1,024 در Opus 4.8 و Sonnet 5، 2,048 در Opus 4.7، و 4,096 در Haiku 4.5. یک پیشوند کوتاهتر cache نمیشود و خطایی هم داده نمیشود. دومی، درخواستهای موازی است، زیرا "یک entry در cache تنها پس از شروع اولین پاسخ در دسترس قرار میگیرد." ده درخواست یکسان که همزمان ارسال شوند، همگی قیمت کامل ورودی را پرداخت میکنند. نشانه هر دو، صفر بودن cache_read_input_tokens است.
انتخاب مدل. یک مرحله مشابه را در Opus 4.8 با قیمت 5 دلار ورودی و 25 دلار خروجی، با خواندن از cache 0.50 دلار و نوشتن 5 دقیقهای 6.25 دلار در هر MTok محاسبه کنید: خواندن 0.0275، نوشتن 0.0188، ورودی بدون cache 0.0100، خروجی 0.0300. این حدوداً $0.086 در هر مرحله است، 2.5 برابر مرحله Sonnet، و حدود 207 دلار در ماه با همان حجم. یک انتخاب مدل، همان کار را از زیر هزینه پایه Max به بیش از دو برابر آن منتقل کرد. Haiku 4.5 با قیمت 1 دلار و 5 دلار، آن را برای کارهای مکانیکی مانند دستهبندی لاگها به سمت دیگر میبرد.
سطح تلاش به انتخاب مدل مربوط است، زیرا توکنهای تفکر با نرخ خروجی صورتحساب میشوند. در Opus 4.8 پیشفرض API برابر با high است، و نقطه شروع مستند شده برای کارهای کدنویسی و عاملمحور (agentic)، مدل گرانتر یعنی xhigh است. با استفاده از /effort در Claude Code یا output_config.effort در API آن را کاهش دهید. یک چیز دیگر تخمینهای قدیمی را تغییر میدهد: مدلهای جدیدتر از توکنایزر جدیدتری استفاده میکنند که "تقریباً 30% توکن بیشتری برای همان متن تولید میکند"، بنابراین شمارش در یک مدل قدیمیتر، مقدار همان متن را در امروز کمتر از واقعیت نشان میدهد.
بهداشت نشست (Session hygiene). API بدون حالت (stateless) است، بنابراین هر مرحله کل گفتگو را به عنوان ورودی صورتحساب شده مجدداً ارسال میکند. بنابراین یک نشست طولانی در هر پیام هزینه بیشتری نسبت به یک نشست تازه دارد، که این مکانیزم پشت اکثر صورتحسابهای غافلگیرکننده است و در اینکه واقعاً چه چیزی در یک نشست Claude Code توکن مصرف میکند به تفصیل بررسی شده است. بین کارهای بیربط از /clear استفاده کنید، زیرا context قدیمی در هر پیام بعدی دوباره ارسال و صورتحساب میشود. در داخل یک کار طولانی از /compact استفاده کنید تا تاریخچه به جای حمل کامل، خلاصهسازی شود. در بازههای مداوم کار کنید، زیرا cache پیشفرض "دارای طول عمر 5 دقیقه است" و "هر بار که محتوای cache شده استفاده شود، بدون هزینه اضافی بازنشانی میشود". نشستی که هر ده دقیقه یک بار به آن دست میزنید، هر بار هزینه بازنویسی (re-write) دارد. یک نشست Claude Code که در tmux روی یک VPS اجرا میشود در زمانی که بیکار است تقریباً هیچ هزینهای ندارد، اما بیکار ماندن بیش از زمان عمر cache، باعث از دست رفتن پیشوند گرم میشود.
قبل از تصمیمگیری، میزان استفاده خود را اندازهگیری کنید
از مثال من تصمیم نگیرید. از یک هفته از خودتان تصمیم بگیرید.
در Claude Code، در پایان هر نشست به مدت یک هفته /usage را اجرا کنید (/cost نام مستعار برای همان صفحه است). این دستور تعداد توکنهای نشست و تخمین هزینه را گزارش میدهد، با یک نکته از مستندات: "عدد دلاری یک تخمین است که به صورت محلی از تعداد توکنها محاسبه شده و ممکن است با صورتحساب واقعی شما متفاوت باشد." با اجرای /clear، مجموعها بازنشانی میشوند، بنابراین ابتدا صفحه را بخوانید. در یک اشتراک، آن عدد دلاری صورتحساب شما نیست، اما تعداد توکنهای پشت آن همان چیزی است که این فرمول به آن نیاز دارد. /context نشان میدهد چه چیزی در حال پر کردن پنجره است.
در یک حساب API، صفحه usage در Claude Console منبع معتبر است. برای قیمتگذاری یک پرامپت قبل از ارسال آن، client.messages.count_tokens() "استفاده از آن رایگان است اما مشمول محدودیت نرخ درخواست در دقیقه بر اساس سطح استفاده شماست" و این تنها شمارشی است که از توکنایزری استفاده میکند که واقعاً برای آن صورتحساب خواهید شد.
پس از یک فراخوانی، بلوک usage را بخوانید و آن را درست بخوانید:
u = response.usage
total_input = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokensinput_tokens فقط باقیمانده بدون cache را میشمارد، که به عنوان "توکنهای بعد از آخرین نقطه توقف cache" مستند شده است. یک مرحله که input_tokens: 4000 را گزارش میدهد، یک مرحله 4,000 توکنی نیست، و سه فیلدی که با هم جمع میشوند، اندازه پرامپتی است که این فرمول میخواهد.
سپس مقایسه کنید. اگر ماه اندازهگیری شده شما به وضوح زیر هزینه طرح قرار گرفت، از کنتور استفاده کنید. اگر به وضوح بالاتر بود، از طرح استفاده کنید، تا زمانی که سهمیه آن یک روز کاری عادی برای شما را پوشش دهد. اگر نزدیک خط بود، از طرح استفاده کنید، زیرا یک طرح نمیتواند شما را غافلگیر کند اما یک کنتور میتواند.
FAQ
آیا Claude API ارزانتر از Claude Pro یا Max است؟
بستگی به حجم استفاده دارد و هیچ نقطه سربهسر منتشر شدهای برای جستجو وجود ندارد، زیرا اشتراکها به جای سهمیه توکن، به صورت بازههای استفاده فروخته میشوند. قیمت یک مرحله معمولی را از نرخهای منتشر شده هر توکن محاسبه کنید، آن را در تعداد مراحل در روز فعال و تعداد روزهای فعال در ماه ضرب کنید، و سپس آن عدد را با هزینه طرح مقایسه کنید. در یک مثال حل شده، یک مرحله 60,000 توکنی Sonnet 5 حدود 0.035 دلار، یا تقریباً 83 دلار در ماه با 120 مرحله در روز طی 20 روز بود: بالاتر از هزینه Pro، پایینتر از هزینه پایه Max.
چگونه هزینه ماهانه Claude API خود را محاسبه کنم؟
برای جمعآوری تعداد توکنهای واقعی، یک هفته /usage را در Claude Code اجرا کنید، یا اگر از قبل حساب API دارید، صفحه usage را در Claude Console بخوانید. سپس یک مرحله را قیمتگذاری کنید: ورودی بدون cache با نرخ پایه، نوشتن در cache با 1.25 برابر نرخ پایه ورودی، خواندن از cache با 0.1 برابر نرخ پایه ورودی، و خروجی با نرخ خروجی، با احتساب توکنهای تفکر به عنوان خروجی. آن را در تعداد مراحل در روز فعال و تعداد روزهای فعال در ماه ضرب کنید.
چه چیزی صورتحساب Claude API را بیشتر تغییر میدهد؟
Prompt caching، بیش از هر چیز دیگری. یک مرحله 60,000 توکنی در Sonnet 5 وقتی پیشوند از cache خوانده شود حدود 0.035 دلار هزینه دارد و وقتی خوانده نشود حدود 0.132 دلار. انتخاب مدل در مرحله بعد است: همان مرحله در Opus 4.8 حدود 0.086 دلار هزینه دارد. طول نشست در مرحله سوم است، زیرا API بدون حالت است و هر مرحله کل گفتگو را به عنوان ورودی صورتحساب شده مجدداً ارسال میکند.
آیا اشتراک Claude شامل دسترسی API است؟
با آنها به عنوان دو حساب با دو صورتحساب مجزا برخورد کنید. فراخوانیهای API بر اساس توکن در حسابی که در Console ایجاد میکنید صورتحساب میشوند و هیچچیز در مستنداتی که من بررسی کردم نمیگوید که اشتراک شامل اعتبار API است. واضحترین نشانه اینکه آنها سطوح جداگانه هستند، دستور /usage-credits در Claude Code است که "با احراز هویت API key در دسترس نیست". بسیاری از توسعهدهندگان هر دو را دارند: یک طرح برای کدنویسی تعاملی، و یک کلید برای چیزهایی که میسازند.