هزینه و قیمت استفاده از مدل Claude Fable 5
هزینه Claude Fable 5 به ازای هر میلیون توکن ورودی 10 دلار و خروجی 50 دلار است. این راهنما به شما کمک میکند تا هزینههای واقعی پروژههای خود را محاسبه کنید.
هزینه Claude Fable 5 چقدر است؟
هزینه Claude Fable 5 در Claude API به ازای هر میلیون توکن ورودی $10 و به ازای هر میلیون توکن خروجی $50 است. اینها نرخهای رسمی منتشرشده توسط Anthropic هستند که در تاریخ 3 اوت 2026 از صفحه قیمتگذاری استخراج شدهاند. شناسه مدل API برابر با claude-fable-5 است. این مدل در تاریخ 9 ژوئن 2026 در Claude API، Amazon Bedrock، Claude Platform روی AWS، Google Cloud و Microsoft Foundry بهصورت عمومی در دسترس قرار گرفت.
The data behind this chart
[
{
"label": "Claude Fable 5",
"input": "10",
"output": "50",
"cache_read": "1",
"batch_input": "5",
"batch_output": "25"
},
{
"label": "Claude Opus 5",
"input": "5",
"output": "25",
"cache_read": "0.50",
"batch_input": "2.50",
"batch_output": "12.50"
},
{
"label": "Claude Sonnet 5 (intro rate)",
"input": "2",
"output": "10",
"cache_read": "0.20",
"batch_input": "1",
"batch_output": "5"
},
{
"label": "Claude Sonnet 5 (from 1 Sep)",
"input": "3",
"output": "15",
"cache_read": "0.30",
"batch_input": "1.50",
"batch_output": "7.50"
},
{
"label": "Claude Haiku 4.5",
"input": "1",
"output": "5",
"cache_read": "0.10",
"batch_input": "0.50",
"batch_output": "2.50"
}
]این موضوع را مانند یک نردبان در نظر بگیرید. قیمت Fable 5 دو برابر Claude Opus 5، پنج برابر نرخ فعلی Claude Sonnet 5 و ده برابر Claude Haiku 4.5 است. این نسبت در هر دو سمت صورتحساب یکسان است، زیرا هر مدل در این جدول، قیمت خروجی را دقیقاً پنج برابر نرخ ورودی خود تعیین میکند. بنابراین اگر نسبت توکنهای ورودی و خروجی یک کار را بدانید، با یک ضرب ساده میتوانید قیمت را به مدلهای دیگر تبدیل کنید.
یک تاریخ، محاسبات را تغییر میدهد. Sonnet 5 تا تاریخ 31 اوت 2026 با قیمت مقدماتی $2 برای ورودی و $10 برای خروجی به ازای هر میلیون توکن ارائه میشود. از تاریخ 1 سپتامبر 2026، قیمت آن به $3 برای ورودی و $15 برای خروجی تغییر مییابد. قیمت Fable 5 تغییری نمیکند، بنابراین فاصله بین این دو مدل در آن تاریخ از پنج برابر به کمی بیش از سه برابر کاهش مییابد. اگر در حال تدوین بودجه برای پاییز هستید، از اعداد جدیدتر Sonnet استفاده کنید.
تخفیفها و تنها ضریبی که هزینه را افزایش میدهد
کش کردن پرامپت (Prompt caching) بزرگترین اهرم کاهش هزینه است. هزینه خواندن از کش، یکدهم قیمت ورودی پایه است که برای Fable 5 برابر با $1 به ازای هر میلیون توکن میباشد. نوشتن در کش، هزینهای بیشتر از یک توکن ورودی معمولی دارد: 1.25 برابر قیمت پایه برای کش 5 دقیقهای و 2 برابر قیمت پایه برای کش 1 ساعته. کش 5 دقیقهای پس از یک بار خواندن و کش 1 ساعته پس از دو بار خواندن، هزینه خود را جبران میکنند. این محاسبات، تمام دلیل اهمیت محاسبه نقطه سربهسر کش کردن پرامپت پیش از فعالسازی سراسری آن است.
Batch API پنجاه درصد تخفیف برای هر دو سمت (ورودی و خروجی) اعمال میکند، بنابراین هزینه پردازشهای دستهای در Fable 5 به $5 برای ورودی و $25 برای خروجی به ازای هر میلیون توکن میرسد. درخواستهای دستهای بهصورت ناهمگام (asynchronous) هستند، بنابراین این روش فقط برای کارهایی مفید است که نیازی به پاسخ فوری ندارند. این دو تخفیف با هم ترکیب میشوند، که باعث میشود یک پردازش کششده و دستهای، از هر دو جهت ارزان تمام شود.
پنجره کانتکست 1 میلیون توکنی با نرخهای استاندارد در Claude 4.6 و مدلهای بعدی گنجانده شده است. هیچ هزینه اضافی برای کانتکست طولانی وجود ندارد، بنابراین یک درخواست 900 هزار توکنی با همان نرخ هر توکن محاسبه میشود که یک درخواست 9 هزار توکنی محاسبه میگردد.
ضریبی که صورتحساب را افزایش میدهد، محل اقامت داده (data residency) است. تنظیم inference_geo: "us" برای نگهداری پردازش استنتاج (inference) در داخل ایالات متحده، یک ضریب 1.1 بر روی تمامی دستههای توکن، شامل خواندن و نوشتن در کش، اعمال میکند. مسیریابی جهانی پیشفرض را تغییر ندهید مگر اینکه قرارداد شما الزام دیگری داشته باشد.
یک قانون صورتحساب مختص این مدل است. Fable 5 دارای طبقهبندیکنندههای ایمنی است که میتوانند یک درخواست را رد کنند. هنگامی که این اتفاق میافتد، Messages API مقدار stop_reason: "refusal" را بهعنوان یک پاسخ موفق HTTP 200 برمیگرداند (نه یک خطا) و هزینهای برای درخواستی که پیش از تولید هرگونه خروجی رد شده است، از شما دریافت نمیشود. اگر همان پرامپت را روی مدل دیگری از Claude دوباره امتحان کنید، اعتبار بازگشتی (fallback credit)، هزینه کش پرامپتِ جابهجایی را جبران میکند تا مجبور نباشید برای گرم کردن مجدد همان کش، دوباره هزینه بپردازید.
کدام طرحها شامل Claude Fable 5 هستند؟
از تاریخ 3 اوت 2026، صفحه Claude Fable در وبسایت Anthropic اعلام کرده است که این مدل برای کاربران Pro، Max، Team و Enterprise در دسترس است. طرح رایگان در این لیست نام برده نشده است. طرح Pro ارزانترین اشتراک در این لیست است، بنابراین هزینه طرح Pro و محدودیتهای استفاده از آن کف قیمت برای هر مسیر اشتراکی جهت دسترسی به Fable را تعیین میکند. اگر دسترسی به Fable دلیل اصلی شما برای ارتقای طرح است، ابتدا ارزش خرید اشتراک Pro بر اساس میزان استفاده شخصی خود را بررسی کنید، زیرا سهمیه محدود Fable به تنهایی توجیه اقتصادی مناسبی برای اشتراک نیست. برای توسعهدهندگان، این مدل بهطور کلی در Claude API و از طریق بازارهای ابری ذکر شده در بالا در دسترس است. در این مسیر هیچ سطح رایگانی وجود ندارد، بنابراین اعتبار اندکی که Anthropic هنگام ثبتنام ارائه میدهد تنها چیزی است که پیش از شروع محاسبه هزینه دریافت میکنید.
در دسترس بودن یک قابلیت در یک plan با included بودن آن بدون محدودیت یکسان نیست. subscription نیز مانند API بهصورت metered محاسبه نمیشود، زیرا یک Pro seat هیچ token quota اعلامشدهای ندارد و در عوض میزان استفاده را بر اساس تعداد messageها در یک بازهٔ زمانی لغزان محاسبه میکند؛ بنابراین هیچیک از موارد موجود در یک plan بهصورت دقیق به ارقام per million بالا تبدیل نمیشود. جدول مقایسهٔ planها در صفحهٔ pricing شرکت Anthropic، دسترسی به Fable را برای برخی seatها به سهمی از محدودیتهای هفتگی استفاده و برای برخی دیگر به usage creditها مشروط میکند. این سازوکار در طول July 2026 بیش از یک بار تغییر کرد. در بیانیهٔ خود Anthropic دربارهٔ redeploy کردن Fable 5 آمده بود که این model تا 50% از محدودیتهای هفتگی استفاده را در Pro، Max، Team و برخی planهای Enterprise، تا 7 July 2026 شامل میشد و پس از آن تاریخ با usage creditها ارائه میشد. گزارشهای منتشرشده در ادامهٔ July نیز از تمدیدهای بیشتر و تفکیک میان انواع seat خبر میدادند.
بنابراین، این صفحه محدودیتهای دقیق هر طرح را درج نمیکند. هیچ عددی که در طول آن ماه منتشر شد بیش از دو هفته معتبر نماند و درج یک عدد قدیمی در اینجا، بدتر از عدم درج آن است. در روزی که تصمیم نهایی خود را میگیرید، ردیف با برچسب Fable را در جدول مقایسه طرحها باز کنید و هر عددی که در مقالات خبری میبینید را منقضی تلقی کنید. اگر اشتراکی را برای دسترسی به Fable تهیه کردید و سهمیه آن کمتر از چیزی بود که جدول نشان میداد، کاهش سطح اشتراک پیش از تمدید بعدی باعث میشود ماهی که قبلاً پرداخت کردهاید، بدون تغییر باقی بماند.
آنچه ثابت است، نرخ API است. در هر مسیری، پس از اتمام سهمیه گنجانده شده، استفاده بیشتر از Fable 5 بر اساس قیمتهای جدول بالا محاسبه میشود. طرح Enterprise این ساختار را شفاف میکند، زیرا هزینه اشتراک Enterprise دسترسی را فراهم میکند، در حالی که توکنها همچنان با نرخ API محاسبه میشوند. این موضوع باعث میشود لیست قیمت، عددی باشد که باید برای برنامهریزی در نظر بگیرید؛ این همان نتیجهای است که هنگام مقایسه صورتحساب API با اشتراک برای هر مدل دیگر Claude به آن میرسید. اگر هنوز طرحی را انتخاب نکردهاید، از اینکه کدام طرح Claude با میزان استفاده شما مطابقت دارد شروع کنید. اگر این اشتراک قرار است دستیار روزمره شما باشد و نه فقط راهی برای دسترسی به Fable، پیش از نهایی کردن انتخاب، مقایسه قیمت طرحهای Claude با ChatGPT را بررسی کنید.
چرا صورتحساب شما بیش از نسبت قیمتِ اعلامشده است
دو مکانیزم مستند وجود دارد که باعث میشود هزینه Fable 5 بیش از آن چیزی باشد که مقایسه مستقیم قیمت نشان میدهد.
اولین مورد، توکنایزر (tokenizer) است. Fable 5 از توکنایزری استفاده میکند که با Claude Opus 4.7 معرفی شد. در مقایسه با مدلهایی که پیش از Opus 4.7 عرضه شدهاند، متن یکسان حدود 30% توکن بیشتری تولید میکند و میزان دقیق این افزایش به محتوا بستگی دارد. Haiku 4.5 پیش از آن توکنایزر عرضه شده است، بنابراین شکاف ده برابری در لیست قیمت، زمانی که یک بلوک متن یکسان را به هر دو مدل میدهید، به حدود سیزده برابر نزدیکتر میشود. Sonnet 5 از توکنایزر جدیدتر استفاده میکند، بنابراین مقایسه Fable با Sonnet بر اساس هر توکن، مقایسهای منصفانه است، اما مقایسه Fable با Haiku اینطور نیست.
دومین مورد، تفکر (thinking) است. تفکر تطبیقی (adaptive thinking) در Fable 5 همیشه فعال است و thinking: {"type": "disabled"} پشتیبانی نمیشود. توکنهای تفکر به عنوان توکنهای خروجی و با نرخ کامل خروجی محاسبه میشوند. زنجیره تفکر خام در این مدل هرگز بازگردانده نمیشود و thinking.display بهطور پیشفرض روی "omitted" تنظیم شده است؛ این یعنی یک پاسخ کوتاه و قابلمشاهده میتواند تعداد توکن خروجیِ محاسبهشدهٔ زیادی داشته باشد. مستندات Anthropic بهصراحت بیان میکند: تعداد توکن خروجیِ محاسبهشده با تعداد توکن قابلمشاهده در پاسخ مطابقت ندارد.
بهجای حدسزدن، جزئیات را بررسی کنید. فیلد usage.output_tokens_details.thinking_tokens گزارش میدهد که چه تعداد از توکنهای خروجیِ محاسبهشده صرف استدلال شده است:
{
"usage": {
"input_tokens": 25,
"output_tokens": 348,
"output_tokens_details": {
"thinking_tokens": 312
}
}
}در آن مثال که از مستندات تفکر Anthropic گرفته شده است، 312 توکن از 348 توکن خروجیِ محاسبهشده، مربوط به استدلالی بوده که هیچکس آن را ندیده است. هنگام استریم (streaming)، این جزئیات فقط در رویداد نهایی message_delta ارسال میشود، بنابراین کلاینتی که خواندن را در آخرین بخش متنی متوقف کند، هرگز آن را ثبت نخواهد کرد.
کنترل آن effort است که روی output_config.effort تنظیم میشود و سطوح آن شامل low، medium، high (پیشفرض)، xhigh و max است.
{
"model": "claude-fable-5",
"max_tokens": 32000,
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "..." }]
}توصیه Anthropic برای این مدل این است که با high شروع کنید، فقط برای کارهای بسیار حساس به توانایی، سطح را به xhigh افزایش دهید و برای کارهای روتین به medium یا low کاهش دهید؛ چرا که تلاش کمتر در Fable 5 اغلب از xhigh در مدلهای قدیمیتر بهتر عمل میکند. دو تله در این مورد وجود دارد. تغییر میزان تلاش بین درخواستها، کشِ پرامپت (prompt cache) شما را باطل میکند، زیرا مقدار تلاشِ تعیینشده در پرامپت رندر میشود؛ بنابراین برای هر حجم کاری یک سطح را انتخاب کرده و آن را ثابت نگه دارید. همچنین max_tokens یک سقف سخت برای مجموع خروجی، شامل متن تفکر و پاسخ است، بنابراین سقفی که برای پاسخی بدون تفکر تنظیم شده باشد، باعث برش خوردن متن میشود. مشاهده stop_reason: "max_tokens" به این معنی است که یا باید سقف را افزایش دهید یا سطح تلاش را کاهش دهید.
هزینه به ازای هر وظیفه تکمیلشده، نه هزینه به ازای هر توکن
The data behind this chart
[
{
"label": "Short answer (5k in, 1k out)",
"fable_5": "0.10",
"opus_5": "0.05",
"sonnet_5": "0.02",
"haiku_4_5": "0.01"
},
{
"label": "Coding session (300k in, 40k out)",
"fable_5": "5.00",
"opus_5": "2.50",
"sonnet_5": "1.00",
"haiku_4_5": "0.50"
},
{
"label": "Long agent run (2M in, 400k out)",
"fable_5": "40.00",
"opus_5": "20.00",
"sonnet_5": "8.00",
"haiku_4_5": "4.00"
}
]آن 3 ردیف، محاسبات ریاضی هستند، نه یک بنچمارک. نرخها منتشر شدهاند. حجم توکنها فرضیاتی هستند که باید آنها را با ارقام حاصل از دادههای مصرفی خود جایگزین کنید. یک جلسه کدنویسی که مشابه ردیف میانی باشد، در مدل Fable 5 هزینه $5.00 و در مدل Sonnet 5 هزینه $1.00 دارد. اجرای طولانیمدت به ترتیب $40.00 در برابر $8.00 هزینه خواهد داشت. ستون Haiku در آن ردیف آخر صرفاً یک محاسبه ریاضی است: Haiku 4.5 دارای پنجره کانتکست 200k توکنی است، بنابراین اصلاً نمیتواند آن کار را مدیریت کند.
هزینه به ازای هر توکن، واحد اشتباهی برای تصمیمگیری است. هزینه به ازای هر وظیفه تکمیلشده، برابر است با هزینه هر تلاش ضربدر تعداد تلاشها. با نرخهای امروز، یک تلاش Fable 5 همهزینه با پنج تلاش Sonnet 5 است، بنابراین تعداد دفعات تلاش مجدد بهتنهایی تقریباً هرگز ارتقا به مدل گرانتر را توجیه نمیکند. Sonnet باید بیش از چهار بار از هر پنج بار شکست بخورد تا مسیر ارزانتر از نظر مصرف توکن بازنده شود.
آنچه این ارتقا را توجیه میکند، تمام مواردی است که در صورتحساب توکن نادیده گرفته شده است. اختلاف بین دو اجرای طولانیمدت در جدول، از هزینه یک ساعت زمان مهندس در اکثر بازارها کمتر است. اگر مدل گرانتر یک ساعت از زمان بررسی را ذخیره کند یا از یک مهاجرت بد که بعداً مجبور به اصلاح آن هستید جلوگیری کند، هزینه خود را در صورتحسابی که هرگز این صرفهجویی را نشان نمیدهد، بازپرداخت کرده است. مقایسه را بر اساس پول به ازای هر نتیجه پذیرفتهشده انجام دهید و زمان خود را نیز در مجموع لحاظ کنید. دانستن اینکه یک میلیون توکن واقعاً چه چیزی میخرد باعث میشود این برآورد بسیار کمتر انتزاعی باشد.
سه شغلی که Claude Fable 5 ارزش هزینه خود را دارد
اجرای عاملهای (agent) با افق طولانی که در آنها یک اشتباه، پرهزینه است. مدل Fable 5 برای کارهایی ساخته شده که با مقیاس ساعت اندازهگیری میشوند: پنجره متنی 1M توکنی، تا 128k توکن خروجی در هر درخواست، و سطح تلاش xhigh که برای وظایفی با زمان اجرای بیش از سی دقیقه و بودجههای توکنی در مقیاس میلیونها طراحی شده است. هزینه اجرا را در برابر هزینه پاکسازی پس از اینکه یک عامل در مرحله 40 مسیر اشتباهی را انتخاب میکند و تا مرحله 300 کسی متوجه آن نمیشود، بسنجید.
مهاجرت یا حسابرسی (audit) که یکبار روی یک کدبیس بزرگ اجرا میکنید. کارهای یکباره حجم کافی برای سرشکن کردن هزینهها ندارند، بنابراین حقبیمه هر توکن در یک فاکتور واحد لحاظ میشود و کل کار ممکن است در یک پنجره متنی جای بگیرد. اگر کار بتواند بهصورت غیرهمگام (asynchronous) اجرا شود، Batch API هزینه آن را به $25 به ازای هر میلیون توکن خروجی کاهش میدهد.
وظیفهای که یک مدل ارزانتر قبلاً دو بار در آن شکست خورده است. دو تلاش ناموفق بهعلاوه زمان دیباگ کردن شما، بیش از یک تلاش با Fable در حجمهای ذکر شده در نمودار بالا هزینه دارد. ارتقا به مدل بالاتر، شاخه ارزانتر است و این دقیقاً همان کاری است که نردبان مدلها (model ladder) برای آن ساخته شده است. اگر همچنان در حال انتخاب بین سطوح مختلف هستید، مقایسه قابلیتهای سطوح مختلف مدل Claude به پرسشی متفاوت از این صفحه پاسخ میدهد.
سه شغلی که در آنها Sonnet 5 یا Haiku 4.5 پاسخ صادقانهای هستند
دستهبندی و استخراج با حجم بالا. این کارها بر اساس نرخ خروجی و هزینه واحد ارزیابی میشوند و سقف کیفیت بهقدری پایین است که یک مدل ارزانقیمت به آن میرسد. در حالی که Haiku 4.5 وظیفه را بهدرستی انجام میدهد، پرداخت ده برابر هزینه برای Fable 5 هیچ دستاورد قابلاندازهگیری برای شما نخواهد داشت.
کارهای تعاملی که در آنها تأخیر (latency) محصول اصلی است. جدول مدلهای Anthropic، تأخیر نسبی Fable 5 را بیشتر نشان میدهد و قابلیت تفکر (thinking) در آن قابل غیرفعالسازی نیست. در یک کادر چت یا تکمیل خودکار ویرایشگر، مدل قدرتمندتر حس بدتری ایجاد میکند، زیرا کاربران پیش از آنکه متوجه کیفیت شوند، متوجه زمان انتظار میشوند.
هر چیزی که به رویدادهای پس از ژانویه 2026 وابسته باشد. تاریخ قطع دانش (knowledge cutoff) قابلاطمینان برای Fable 5 ژانویه 2026 است. این تاریخ برای Opus 5 ماه مه 2026 است. مدل گرانتر، مدل قدیمیتر است؛ بنابراین در پرسشهای مربوط به تازهترین رویدادها، اگر ابزارهای جستجو یا fetch را در اختیار مدل قرار ندهید، عملاً دو برابر هزینه پرداخت میکنید تا به دانشی قدیمیتر دست یابید.
یک محدودیت وجود دارد که کاملاً خارج از بحث هزینه است. Fable 5 دارای سیاست نگهداری داده 30 روزه است و تحت شرایط «عدم نگهداری داده» (zero data retention) در دسترس نیست، زیرا بهعنوان یک مدل تحت پوشش (Covered Model) تعیین شده است. اگر توافقنامه شما مستلزم عدم نگهداری داده باشد، Fable 5 به هیچ قیمتی گزینهای مناسب نیست و هیچ تخفیفی این موضوع را تغییر نمیدهد.
مخازن fable-method چه چیزی را نشان میدهند و چه چیزی را نشان نمیدهند
متخصصان مخازنی را منتشر کردهاند که نحوه عملکرد رویکردهای Fable 5 را به مهارتهایی تبدیل میکند که یک مدل ارزانتر نیز میتواند از آنها پیروی کند. مخزن fable-method یک مهارت تفکر، یک حلقه ارکستراسیون و یک تاییدکننده تقابلی (adversarial verifier) را توصیف میکند که بهجای خواندن گزارش خودِ عامل (agent)، هر بررسی ادعا شده را دوباره اجرا میکند. فایل README آن مستقیماً میگوید: «این یک عصارهگیری جامعهمحور است، نه یک محصول رسمی از Anthropic.»
با آن دقیقاً به همین شکل برخورد کنید. این مخزن شواهدی از نحوه هدایت مدل توسط کاربران است و مستنداتی از نحوه عملکرد درونی مدل نیست. هیچچیز در آن توسط Anthropic تایید نشده است و چندین فورک تقریباً یکسان با عبارات متفاوت وجود دارد که دقیقاً همان چیزی است که از یک دانش عامیانه (folklore) انتظار میرود، نه یک مشخصات فنی (spec).
نکته قابلتوجه برای تصمیمگیری در مورد هزینهها این است که بخشهایی که افراد ارزش کپیکردن داشتهاند، رویهای (procedural) هستند. وظیفه را دستهبندی کنید، بررسیای که اثبات میکند کار انجام شده است را نامگذاری کنید، پیش از تصمیمگیری شواهد را جمعآوری کنید و سپس بهجای خواندن یک خلاصه، از طریق مشاهده تایید کنید. یک مدل ارزانتر که چکلیست صریح و مرحله تایید به آن داده شده باشد، بخشی از این شکاف را پر میکند؛ بنابراین پیش از استانداردسازی روی مدل گرانقیمت، آن آزمایش را روی مجموعه ارزیابی خود اجرا کنید. نتیجه به وظایف شما بستگی دارد و به همین دلیل است که اعداد و ارقام دیگران برای شما ارزش چندانی ندارد.
پیش از تخصیص بودجه، اعداد خود را بررسی کنید
- در هر پاسخ،
usageرا بخوانید وoutput_tokens_details.thinking_tokensرا جدا از خروجی قابلمشاهده ثبت کنید. استدلالی که نمیبینید، همان ردیف هزینهای است که افراد را غافلگیر میکند. - به جای پذیرش مقدار پیشفرض،
effortرا بهطور صریح تنظیم کنید و در هر مکالمهای که به prompt caching وابسته است، آن را ثابت نگه دارید. - پیشوند ثابت خود را پیش از نقطه شکست کش (cache breakpoint) قرار دهید. خواندن از کش با قیمتی معادل یکدهم ورودی پایه، بیش از اکثر تغییر مدلها به مدلهای ارزانتر، صرفهجویی به همراه دارد.
- هر چیزی که به پاسخ فوری نیاز ندارد را به Batch API منتقل کنید.
- جایگزینها را صادقانه قیمتگذاری کنید. مقایسه قیمتگذاری API مدلهای Claude و ChatGPT روی حجم کاری خودتان، پیش از تعهدات طولانیمدت، ارزش صرف یک بعدازظهر زمان را دارد.
اگر حجم کاری مربوط به عاملی (agent) است که روی سرور شخصی شما اجرا میشود، کنترلهایی که بیشترین اهمیت را دارند خارج از انتخاب مدل قرار میگیرند. کنترل هزینههای عامل روی VPS محدودیتهای حلقه و سقف هزینه را پوشش میدهد که از اجرای بیرویه نشستها جلوگیری میکند، و محل واقعی مصرف توکنها در Claude Code اعدادی را که در داشبورد استفاده خود میبینید، توضیح میدهد.
FAQ
هزینه Claude Fable 5 به ازای هر میلیون توکن چقدر است؟
مدل Claude Fable 5 در API شرکت Anthropic، طبق بررسی صفحه قیمتگذاری در تاریخ 3 اوت 2026، با قیمت $10 به ازای هر میلیون توکن ورودی و $50 به ازای هر میلیون توکن خروجی ارائه میشود. هزینه خواندن از حافظه کش (cache read) برابر با $1 به ازای هر میلیون توکن است که یکدهم نرخ پایه ورودی محسوب میشود. Batch API با اعمال 50 درصد تخفیف در هر دو بخش، قیمت را برای پردازشهای غیرهمزمان به $5 و $25 به ازای هر میلیون توکن میرساند. نگهداری پردازش استنتاج در داخل ایالات متحده با استفاده از پارامتر inference_geo، ضریب 1.1 برابر را به تمامی دستهها اضافه میکند.
آیا Claude Fable 5 در اشتراک Claude Pro گنجانده شده است؟
صفحه Claude Fable در وبسایت Anthropic، این مدل را برای کاربران طرحهای Pro، Max، Team و Enterprise در دسترس اعلام کرده و نامی از طرح رایگان نبرده است. دسترسی گنجاندهشده در اشتراک، نامحدود نیست. برخی کاربران از طریق سهمیه محدودیت استفاده هفتگی به Fable دسترسی دارند و برخی دیگر از طریق اعتبار مصرف (usage credits)؛ این سازوکار در طول ماه ژوئیه 2026 بیش از یک بار تغییر کرده است. بهجای اعتماد به ارقام ذکرشده در مقالات، ردیف مربوط به Fable را در جدول مقایسه طرحها در صفحه قیمتگذاری Anthropic در همان روز تصمیمگیری بررسی کنید. پس از اتمام سهمیه مجاز، استفاده بیشتر بر اساس نرخ API محاسبه و صورتحساب میشود.
چرا صورتحساب Claude Fable 5 من از آنچه در خروجی مشاهده میشود، بیشتر است؟
قابلیت Adaptive thinking در Claude Fable 5 همیشه فعال است؛ توکنهای تفکر (thinking tokens) به عنوان توکنهای خروجی محاسبه میشوند و زنجیره تفکر خام هرگز به کاربر بازگردانده نمیشود. با تنظیم thinking.display روی مقدار پیشفرض omitted، شما در حالی که فیلد تفکر را خالی میبینید، هزینه تمام توکنهای استدلالی پشت آن را پرداخت میکنید. برای مشاهده تفکیک، usage.output_tokens_details.thinking_tokens را در پاسخ بررسی کنید و توجه داشته باشید که هنگام استفاده از streaming، این دادهها تنها در رویداد نهایی message_delta ارسال میشوند. اگر نسبت استدلال به پاسخ بیش از نیاز وظیفه محوله است، سطح effort را کاهش دهید.
آیا باید از Claude Fable 5 استفاده کنم یا Claude Opus 5؟
هزینه Claude Opus 5 به ازای هر توکن نصف مدل دیگر است و دارای تاریخ قطع دانش (knowledge cutoff) بهروزتر و قابلاعتمادتری است (مه 2026 در مقابل ژانویه 2026 برای Fable 5). کار را با Opus 5 شروع کنید و در صورتی که وظیفهای در آن شکست خورد یا هزینه یک پاسخ اشتباه بیش از اختلاف قیمت دو مدل بود، به سراغ Fable 5 بروید. Fable 5 انتخاب مناسبی برای کارهای عاملی (agent work) با افق طولانی است که در آنها یک شاخه اشتباه میتواند ساعتها زمان برای اصلاح نیاز داشته باشد، و همچنین برای کارهای موردی که هزینه اضافی آن به جای تکرار در هر درخواست، تنها یک بار در صورتحساب نهایی اعمال میشود.