هزینه و زمان استفاده از مدل Claude Fable 5
مدل Claude Fable 5 با قیمت 10 دلار برای هر میلیون توکن ورودی و 50 دلار برای خروجی عرضه شده است. این مطلب نحوه محاسبه هزینهها و مقایسه آن با مدلهای دیگر را بررسی میکند.
هزینه Claude Fable 5 چقدر است؟
هزینه Claude Fable 5 در Claude API به ازای هر میلیون توکن ورودی $10 و به ازای هر میلیون توکن خروجی $50 است. اینها نرخهای رسمی منتشرشده توسط Anthropic هستند که در تاریخ 3 اوت 2026 از صفحه قیمتگذاری استخراج شدهاند. شناسه مدل API برابر با claude-fable-5 است. این مدل در تاریخ 9 ژوئن 2026 در Claude API، Amazon Bedrock، Claude Platform روی AWS، Google Cloud و Microsoft Foundry بهصورت عمومی در دسترس قرار گرفت.
The data behind this chart
[
{
"label": "Claude Fable 5",
"input": "10",
"output": "50",
"cache_read": "1",
"batch_input": "5",
"batch_output": "25"
},
{
"label": "Claude Opus 5",
"input": "5",
"output": "25",
"cache_read": "0.50",
"batch_input": "2.50",
"batch_output": "12.50"
},
{
"label": "Claude Sonnet 5 (intro rate)",
"input": "2",
"output": "10",
"cache_read": "0.20",
"batch_input": "1",
"batch_output": "5"
},
{
"label": "Claude Sonnet 5 (from 1 Sep)",
"input": "3",
"output": "15",
"cache_read": "0.30",
"batch_input": "1.50",
"batch_output": "7.50"
},
{
"label": "Claude Haiku 4.5",
"input": "1",
"output": "5",
"cache_read": "0.10",
"batch_input": "0.50",
"batch_output": "2.50"
}
]این موضوع را مانند یک نردبان در نظر بگیرید. قیمت Fable 5 دو برابر Claude Opus 5، پنج برابر نرخ فعلی Claude Sonnet 5 و ده برابر Claude Haiku 4.5 است. این نسبت در هر دو بخش صورتحساب یکسان است، زیرا هر مدل در آن جدول، قیمت خروجی را دقیقاً پنج برابر نرخ ورودی خود تعیین میکند. بنابراین اگر نسبت توکنهای ورودی و خروجی یک کار را بدانید، میتوانید با ضرب، یک قیمت را به قیمت دیگر تبدیل کنید.
یک تاریخ، محاسبات را تغییر میدهد. Sonnet 5 تا تاریخ 31 اوت 2026 با قیمت مقدماتی $2 برای ورودی و $10 برای خروجی به ازای هر میلیون توکن ارائه میشود. از تاریخ 1 سپتامبر 2026، قیمت آن به $3 و $15 تغییر مییابد. قیمت Fable 5 تغییری نمیکند، بنابراین شکاف بین این دو مدل در آن تاریخ از پنج برابر به کمی بیش از سه برابر کاهش مییابد. اگر در حال تدوین بودجه برای پاییز هستید، از ارقام جدیدتر Sonnet استفاده کنید.
تخفیفها و تنها ضریبی که هزینه را افزایش میدهد
کش کردن پرامپت (Prompt caching) بزرگترین اهرم کاهش هزینه است. هزینه خواندن از کش، یکدهم قیمت ورودی پایه است که برای Fable 5 برابر با $1 به ازای هر میلیون توکن میباشد. نوشتن در کش، هزینهای بیشتر از یک توکن ورودی معمولی دارد: 1.25 برابر قیمت پایه برای کش 5 دقیقهای و 2 برابر قیمت پایه برای کش 1 ساعته. کش 5 دقیقهای پس از یک بار خواندن و کش 1 ساعته پس از دو بار خواندن، هزینه خود را جبران میکنند. همین محاسبات، تمام دلیل اهمیت محاسبه نقطه سربهسر کش کردن پرامپت پیش از فعالسازی سراسری آن است.
Batch API پنجاه درصد تخفیف برای هر دو بخش ورودی و خروجی اعمال میکند، بنابراین هزینه پردازشهای دستهای در Fable 5 به $5 برای ورودی و $25 برای خروجی به ازای هر میلیون توکن میرسد. درخواستهای دستهای بهصورت غیرهمگام (asynchronous) هستند، بنابراین این روش فقط برای کارهایی مفید است که نیازی به پاسخ فوری ندارند. این دو تخفیف با هم ترکیب میشوند، که باعث میشود یک پردازش کششده و دستهای، از هر دو جهت ارزان تمام شود.
پنجره کانتکست 1 میلیون توکنی در Claude 4.6 و مدلهای بعدی با نرخهای استاندارد ارائه میشود. هیچ هزینه اضافی برای کانتکست طولانی وجود ندارد، بنابراین یک درخواست 900 هزار توکنی با همان نرخ به ازای هر توکن محاسبه میشود که یک درخواست 9 هزار توکنی محاسبه میگردد.
ضریبی که صورتحساب را افزایش میدهد، محل اقامت داده (data residency) است. تنظیم inference_geo: "us" برای نگهداری پردازش استنتاج (inference) در داخل ایالات متحده، یک ضریب 1.1 بر روی تمام دستههای توکن، از جمله خواندن و نوشتن در کش، اعمال میکند. مگر اینکه قرارداد خاصی الزام کرده باشد، مسیریابی جهانی پیشفرض را تغییر ندهید.
یک قانون صورتحساب مختص این مدل است. Fable 5 دارای طبقهبندیکنندههای ایمنی است که میتوانند یک درخواست را رد کنند. در این صورت، Messages API مقدار stop_reason: "refusal" را بهعنوان یک پاسخ موفق HTTP 200 برمیگرداند (نه یک خطا) و هزینهای برای درخواستی که پیش از تولید هرگونه خروجی رد شده است، از شما دریافت نمیشود. اگر همان پرامپت را روی مدل دیگری از Claude دوباره امتحان کنید، اعتبار بازگشتی (fallback credit)، هزینه کش پرامپتِ تغییر مدل را جبران میکند تا مجبور نباشید برای گرم کردن مجدد همان کش، دوباره هزینه بپردازید.
کدام طرحها شامل Claude Fable 5 میشوند؟
از تاریخ 3 اوت 2026، صفحه Claude Fable در سایت Anthropic اعلام کرده است که این مدل برای کاربران Pro، Max، Team و Enterprise در دسترس است. طرح رایگان در این لیست نام برده نشده است. طرح Pro ارزانترین گزینه در این لیست است، بنابراین هزینه طرح Pro و محدودیتهای استفاده از آن کف قیمت برای هر نوع اشتراکی جهت دسترسی به Fable را تعیین میکند. برای توسعهدهندگان، این مدل بهطور کلی از طریق Claude API و بازارهای ابری ذکر شده در بالا در دسترس است. هیچ سطح رایگانی در آن مسیر وجود ندارد، بنابراین اعتبار اندکی که Anthropic هنگام ثبتنام ارائه میدهد تنها چیزی است که پیش از شروع محاسبه هزینه دریافت میکنید.
در دسترس بودن در یک طرح به معنای گنجانده شدن بدون محدودیت نیست. جدول مقایسه طرحها در صفحه قیمتگذاری Anthropic، دسترسی به Fable را برای برخی از کاربران به بخشی از محدودیتهای استفاده هفتگی و برای برخی دیگر به اعتبارات مصرفی محدود کرده است؛ این ساختار در طول ژوئیه 2026 بیش از یک بار تغییر کرد. بیانیه رسمی Anthropic در مورد بازنشر Fable 5 شامل دسترسی به این مدل تا سقف 50 درصد از محدودیتهای استفاده هفتگی تا تاریخ 7 ژوئیه 2026 برای طرحهای Pro، Max، Team و برخی طرحهای Enterprise بود و پس از آن تاریخ، از اعتبارات مصرفی استفاده شد. گزارشهای منتشر شده در ادامه ماه ژوئیه، به تمدیدهای بیشتر و تفکیک بین انواع اشتراکها اشاره داشتند.
بنابراین، این صفحه محدودیتهای هر طرح را درج نمیکند. هیچ عددی که در طول آن ماه منتشر شد، بیش از دو هفته معتبر نماند و یک عدد قدیمی در اینجا از نداشتن آن بدتر است. در روز تصمیمگیری، ردیف با برچسب Fable را در جدول مقایسه طرحها باز کنید و هر عددی که در مقالات خبری میبینید را منقضی تلقی کنید. اگر اشتراکی برای دسترسی به Fable تهیه کردید و سهمیه آن کمتر از چیزی بود که جدول نشان میداد، کاهش سطح اشتراک پیش از تمدید بعدی باعث میشود ماهی که قبلاً برای آن پرداخت کردهاید، دستنخورده باقی بماند.
آنچه ثابت است، نرخ API است. در هر مسیری، پس از اتمام سهمیه گنجانده شده، استفاده بیشتر از Fable 5 طبق قیمتهای جدول بالا محاسبه میشود. در طرح Enterprise این ساختار صریحتر است، زیرا هزینه اشتراک Enterprise دسترسی را فراهم میکند در حالی که توکنها همچنان با نرخ API محاسبه میشوند. این موضوع باعث میشود لیست قیمت، عددی باشد که در هر صورت باید بر اساس آن برنامهریزی کنید؛ این همان نتیجهای است که هنگام مقایسه صورتحساب API با یک اشتراک برای هر مدل دیگر Claude به آن میرسید. اگر هنوز سطحی را انتخاب نکردهاید، از اینکه کدام طرح Claude با میزان استفاده شما مطابقت دارد شروع کنید. اگر قرار است آن اشتراک علاوه بر دسترسی به Fable، دستیار روزمره شما نیز باشد، پیش از نهایی کردن انتخاب، بررسی مقایسه قیمت طرحهای Claude با ChatGPT ارزشمند است.
چرا صورتحساب شما بیش از نسبت قیمتِ اعلامشده است
دو مکانیزم مستند وجود دارد که باعث میشود هزینه Fable 5 بیش از آن چیزی باشد که مقایسه مستقیم قیمت نشان میدهد.
اولین مورد، توکنایزر (tokenizer) است. Fable 5 از توکنایزری استفاده میکند که با Claude Opus 4.7 معرفی شد. در مقایسه با مدلهایی که پیش از Opus 4.7 منتشر شدهاند، متن یکسان حدود 30% توکن بیشتری تولید میکند و میزان دقیق این افزایش به محتوا بستگی دارد. مدل Haiku 4.5 پیش از آن توکنایزر عرضه شده است، بنابراین وقتی یک بلوک متنی یکسان را به هر دو مدل میدهید، شکاف ده برابری در لیست قیمت، در واقع به سیزده برابر نزدیکتر میشود. Sonnet 5 از توکنایزر جدیدتر استفاده میکند، بنابراین مقایسه Fable با Sonnet بر اساس هر توکن منصفانه است، اما مقایسه Fable با Haiku اینطور نیست.
دومین مورد، تفکر (thinking) است. تفکر تطبیقی (adaptive thinking) در Fable 5 همیشه فعال است و thinking: {"type": "disabled"} پشتیبانی نمیشود. توکنهای تفکر به عنوان توکنهای خروجی و با نرخ کامل خروجی محاسبه میشوند. زنجیره تفکر خام هرگز در این مدل بازگردانده نمیشود و thinking.display بهطور پیشفرض روی "omitted" تنظیم شده است؛ این یعنی یک پاسخ کوتاه و قابلمشاهده میتواند تعداد توکن خروجیِ محاسبهشدهٔ زیادی داشته باشد. مستندات Anthropic بهصراحت بیان میکند: تعداد توکنهای خروجیِ محاسبهشده با تعداد توکنهای قابلمشاهده در پاسخ مطابقت ندارد.
بهجای حدسزدن، جزئیات را بررسی کنید. فیلد usage.output_tokens_details.thinking_tokens گزارش میدهد که چه تعداد از توکنهای خروجیِ محاسبهشده صرف استدلال شده است:
{
"usage": {
"input_tokens": 25,
"output_tokens": 348,
"output_tokens_details": {
"thinking_tokens": 312
}
}
}در آن مثال که از مستندات تفکر Anthropic گرفته شده است، 312 توکن از 348 توکن خروجیِ محاسبهشده، مربوط به استدلالی بوده که هیچکس آن را ندیده است. هنگام استریم (streaming)، این تفکیک فقط در رویداد نهایی message_delta ارسال میشود، بنابراین کلاینتی که خواندن را در آخرین تکه متن متوقف کند، هرگز آن را ثبت نخواهد کرد.
کنترل این قابلیت effort است که روی output_config.effort تنظیم میشود و سطوح آن شامل low، medium، high (پیشفرض)، xhigh و max است.
{
"model": "claude-fable-5",
"max_tokens": 32000,
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "..." }]
}راهنمای Anthropic برای این مدل این است که با high شروع کنید، فقط برای کارهایی که به بالاترین سطح توانمندی نیاز دارند به xhigh بروید، و برای کارهای روتین به medium یا low کاهش دهید؛ چرا که تلاش کمتر در Fable 5 اغلب از xhigh در مدلهای قدیمیتر بهتر عمل میکند. دو تله در این مورد وجود دارد. تغییر میزان تلاش بین درخواستها، کشِ پرامپت (prompt cache) شما را باطل میکند، زیرا مقدار تلاشِ تعیینشده در پرامپت رندر میشود؛ بنابراین برای هر حجم کاری یک سطح را انتخاب کرده و آن را ثابت نگه دارید. همچنین max_tokens یک سقف سخت برای مجموع خروجی، شامل متن تفکر و پاسخ است، بنابراین سقفی که برای پاسخی بدون تفکر تنظیم شده باشد، باعث قطعشدن متن (truncate) میشود. مشاهده stop_reason: "max_tokens" به این معنی است که یا باید سقف را افزایش دهید یا سطح تلاش را کاهش دهید.
هزینه به ازای هر وظیفه تکمیلشده، نه هزینه به ازای هر توکن
The data behind this chart
[
{
"label": "Short answer (5k in, 1k out)",
"fable_5": "0.10",
"opus_5": "0.05",
"sonnet_5": "0.02",
"haiku_4_5": "0.01"
},
{
"label": "Coding session (300k in, 40k out)",
"fable_5": "5.00",
"opus_5": "2.50",
"sonnet_5": "1.00",
"haiku_4_5": "0.50"
},
{
"label": "Long agent run (2M in, 400k out)",
"fable_5": "40.00",
"opus_5": "20.00",
"sonnet_5": "8.00",
"haiku_4_5": "4.00"
}
]آن 3 ردیف، محاسبات ریاضی هستند و نه یک بنچمارک. نرخها منتشر شدهاند. حجم توکنها فرضیاتی هستند که باید آنها را با ارقام حاصل از دادههای مصرفی خود جایگزین کنید. یک جلسه کدنویسی با الگوی ردیف میانی، در مدل Fable 5 هزینه $5.00 و در مدل Sonnet 5 هزینه $1.00 دارد. اجرای طولانیمدت به ترتیب $40.00 در مقابل $8.00 هزینه خواهد داشت. ستون Haiku در آن ردیف آخر صرفاً یک محاسبه ریاضی است: مدل Haiku 4.5 دارای پنجره کانتکست 200k توکنی است، بنابراین اصلاً نمیتواند آن کار را پردازش کند.
هزینه به ازای هر توکن، واحد اشتباهی برای تصمیمگیری است. هزینه به ازای هر وظیفه تکمیلشده، برابر است با هزینه هر تلاش ضربدر تعداد تلاشها. با نرخهای امروز، یک تلاش Fable 5 همقیمت پنج تلاش Sonnet 5 است، بنابراین تعداد دفعات تلاش مجدد بهتنهایی تقریباً هرگز ارتقا به مدل گرانتر را توجیه نمیکند. مدل Sonnet باید بیش از چهار بار از پنج بار شکست بخورد تا مسیر ارزانتر از نظر هزینه توکن بازنده شود.
آنچه این ارتقا را توجیه میکند، تمام مواردی است که در صورتحساب توکن نادیده گرفته میشود. اختلاف بین دو اجرای طولانی در جدول، از هزینه یک ساعت وقت مهندس در اکثر بازارها کمتر است. اگر مدل گرانتر یک ساعت از زمان بازبینی شما را ذخیره کند، یا از یک مهاجرت ناموفق که بعداً باید آن را اصلاح کنید جلوگیری کند، هزینه خود را از طریق صرفهجویی در هزینهای که هرگز در صورتحساب دیده نمیشود، بازگردانده است. مقایسه را بر اساس پول به ازای هر نتیجه پذیرفتهشده انجام دهید و زمان خود را نیز در مجموع لحاظ کنید. دانستن اینکه یک میلیون توکن واقعاً چه چیزی را خریداری میکند باعث میشود این برآورد بسیار کمتر انتزاعی باشد.
سه شغلی که Claude Fable 5 ارزش هزینه خود را دارد
اجرای عاملهای (agent) با افق طولانی که در آنها یک اشتباه، هزینهبر است. مدل Fable 5 برای کارهایی ساخته شده که با مقیاس ساعت اندازهگیری میشوند: پنجره متنی 1 میلیون توکنی، تا 128 هزار توکن خروجی در هر درخواست، و سطح تلاش xhigh که برای وظایفی با زمان اجرای بیش از 30 دقیقه و بودجههای توکنی در مقیاس میلیون طراحی شده است. هزینه اجرا را در برابر پاکسازی پس از آن بسنجید که یک عامل در مرحله 40 مسیر اشتباهی را انتخاب میکند و تا مرحله 300 کسی متوجه آن نمیشود.
مهاجرت یا حسابرسی (audit) که یکبار روی یک کدبیس بزرگ اجرا میکنید. کارهای یکباره حجم کافی برای سرشکن کردن هزینهها ندارند، بنابراین حقبیمه هر توکن در یک فاکتور واحد لحاظ میشود و کل کار ممکن است در یک پنجره متنی جای بگیرد. اگر کار بتواند بهصورت غیرهمگام (asynchronous) اجرا شود، Batch API هزینه را به $25 به ازای هر میلیون توکن خروجی کاهش میدهد.
وظیفهای که یک مدل ارزانتر قبلاً دو بار در آن شکست خورده است. دو تلاش ناموفق بهعلاوه زمان دیباگ کردن شما، بیش از یک تلاش با Fable در حجمهای ذکر شده در جدول بالا هزینه دارد. ارتقا به مدل بالاتر، شاخه ارزانتر است و مدل ladder دقیقاً برای همین منظور طراحی شده است. اگر همچنان در حال انتخاب بین سطوح مختلف هستید، مقایسه توانمندی بین سطوح مدل Claude به پرسشی متفاوت از این صفحه پاسخ میدهد.
سه شغلی که Sonnet 5 یا Haiku 4.5 پاسخ صادقانهای برای آنهاست
طبقهبندی و استخراج با حجم بالا. این کارها بر اساس نرخ خروجی (throughput) و هزینه واحد ارزیابی میشوند و سقف کیفیت بهقدری پایین است که یک مدل ارزانقیمت به آن دست مییابد. در مقایسه با هزینهای ده برابر بیشتر برای کاری که Haiku 4.5 بهدرستی انجام میدهد، Fable 5 هیچ ارزش قابلاندازهگیریای ارائه نمیدهد.
کارهای تعاملی که در آنها تأخیر (latency) محصول اصلی است. جدول مدلهای Anthropic، تأخیر نسبی Fable 5 را بیشتر نشان میدهد و قابلیت تفکر (thinking) در آن قابل غیرفعالسازی نیست. در یک کادر چت یا تکمیل خودکار ویرایشگر، مدل قدرتمندتر حس بدتری ایجاد میکند، زیرا کاربران پیش از آنکه متوجه کیفیت شوند، متوجه انتظار (wait) میشوند.
هر چیزی که به رویدادهای پس از ژانویه 2026 وابسته باشد. تاریخ قطع دانش قابلاتکای Fable 5 ژانویه 2026 است. این تاریخ برای Opus 5 ماه مه 2026 است. مدل گرانتر، مدل قدیمیتر است؛ بنابراین در پرسشهای مربوط به تازگی اطلاعات، اگر ابزارهای جستجو یا fetch را در اختیار مدل قرار ندهید، دو برابر هزینه پرداخت میکنید تا دانشی قدیمیتر دریافت کنید.
یک محدودیت وجود دارد که کاملاً خارج از بحث هزینه است. Fable 5 دارای سیاست نگهداری داده 30 روزه است و تحت شرایط «عدم نگهداری داده» (zero data retention) در دسترس نیست، زیرا بهعنوان یک مدل تحت پوشش (Covered Model) تعیین شده است. اگر توافقنامه شما مستلزم عدم نگهداری داده باشد، Fable 5 به هیچ قیمتی گزینهای مناسب نیست و هیچ تخفیفی این موضوع را تغییر نمیدهد.
مخازن fable-method چه چیزی را نشان میدهند و چه چیزی را نشان نمیدهند
متخصصان مخازنی را منتشر کردهاند که نحوه رویکرد Fable 5 به کارها را به مهارتهایی تبدیل میکند که یک مدل ارزانتر نیز قادر به دنبال کردن آنها باشد. مخزن fable-method یک مهارت تفکر، یک حلقه ارکستراسیون و یک تاییدکننده تقابلی را توصیف میکند که به جای خواندن گزارش خودِ عامل (agent)، هر بررسی ادعا شده را مجدداً اجرا میکند. فایل README آن مستقیماً میگوید: «این یک عصارهگیری جامعهمحور است، نه یک محصول رسمی از Anthropic.»
با آن دقیقاً به همین شکل برخورد کنید. این مخزن شواهدی از نحوه هدایت مدل توسط کاربران است و مستنداتی از نحوه عملکرد درونی مدل نیست. هیچ بخشی از آن توسط Anthropic تایید نشده است و چندین فورک تقریباً یکسان با عبارات متفاوت وجود دارد که دقیقاً همان چیزی است که از یک دانش عامیانه انتظار میرود، نه یک مشخصات فنی (spec).
نکته قابل توجه برای تصمیمگیری در مورد هزینهها این است که بخشهایی که مردم ارزش کپی کردن داشتهاند، رویهای (procedural) هستند. وظیفه را دستهبندی کنید، بررسیای که اثبات میکند کار انجام شده است را نامگذاری کنید، پیش از تصمیمگیری شواهد را جمعآوری کنید و سپس به جای خواندن یک خلاصه، از طریق مشاهده تایید کنید. یک مدل ارزانتر که چکلیست صریح و مرحله تایید به آن داده شده باشد، بخشی از شکاف عملکرد را پر میکند؛ بنابراین پیش از استانداردسازی روی مدل گرانقیمت، این آزمایش را روی مجموعه ارزیابی خود اجرا کنید. نتیجه به وظایف شما بستگی دارد و به همین دلیل است که اعداد و ارقام دیگران برای شما ارزش چندانی ندارد.
پیش از تخصیص بودجه، اعداد خود را بررسی کنید
- در هر پاسخ،
usageرا بخوانید وoutput_tokens_details.thinking_tokensرا جدا از خروجی قابل مشاهده، لاگ کنید. استدلالی که نمیبینید، همان ردیف هزینهای است که باعث غافلگیری میشود. - به جای پذیرش مقدار پیشفرض،
effortرا بهطور صریح تعیین کنید و در هر گفتگویی که به prompt caching وابسته است، آن را ثابت نگه دارید. - پیشوند ثابت خود را پیش از یک cache breakpoint قرار دهید. خواندن از حافظه کش با یکدهم قیمت ورودی پایه، بیش از اکثر تغییر مدلها به مدلهای ارزانتر، صرفهجویی میکند.
- هر چیزی که نیاز به پاسخ فوری ندارد را به Batch API منتقل کنید.
- قیمت جایگزینها را صادقانه ارزیابی کنید. مقایسه قیمت API مدلهای Claude و ChatGPT روی حجم کاری خودتان، پیش از یک تعهد طولانیمدت، ارزش یک بعدازظهر وقت گذاشتن را دارد.
اگر حجم کاری مربوط به عاملی (agent) است که روی سرور شخصی شما اجرا میشود، کنترلهایی که بیشترین اهمیت را دارند خارج از انتخاب مدل قرار میگیرند. کنترل هزینههای عامل روی VPS محدودیتهای حلقه و سقف هزینه را پوشش میدهد که از اجرای بیرویه نشستها جلوگیری میکند، و محل واقعی مصرف توکنها در Claude Code اعدادی را که در داشبورد کاربری خود مشاهده خواهید کرد، توضیح میدهد.
FAQ
هزینه Claude Fable 5 به ازای هر میلیون توکن چقدر است؟
مدل Claude Fable 5 در Claude API با قیمت $10 به ازای هر میلیون توکن ورودی و $50 به ازای هر میلیون توکن خروجی قیمتگذاری شده است؛ این ارقام در تاریخ 3 اوت 2026 از صفحه قیمتگذاری Anthropic استخراج شدهاند. هزینه خواندن از حافظه کش (cache read) برابر با $1 به ازای هر میلیون توکن است که یکدهم نرخ پایه ورودی محسوب میشود. Batch API با اعمال 50 درصد تخفیف روی هر دو بخش، قیمت را برای پردازشهای غیرهمزمان به $5 و $25 به ازای هر میلیون توکن میرساند. نگهداری پردازش (inference) در داخل ایالات متحده با استفاده از پارامتر inference_geo، ضریب 1.1 را به تمامی دستهها اعمال میکند.
آیا Claude Fable 5 در اشتراک Claude Pro گنجانده شده است؟
صفحه Claude Fable در وبسایت Anthropic این مدل را برای کاربران Pro، Max، Team و Enterprise در دسترس اعلام کرده و نامی از طرح رایگان نبرده است. دسترسی گنجاندهشده در اشتراک، نامحدود نیست. برخی کاربران از طریق سهمیه استفاده هفتگی به Fable دسترسی دارند و برخی دیگر از طریق اعتبار مصرف (usage credits)؛ این سازوکار در طول ماه ژوئیه 2026 بیش از یک بار تغییر کرده است. بهجای اعتماد به ارقام موجود در مقالات، در روز تصمیمگیری، ردیف مربوط به Fable را در جدول مقایسه طرحها در صفحه قیمتگذاری Anthropic مطالعه کنید. پس از اتمام سهمیه گنجاندهشده، استفاده بیشتر بر اساس نرخ API محاسبه و صورتحساب میشود.
چرا صورتحساب Claude Fable 5 من از آنچه در خروجی مشاهده میشود، بیشتر است؟
قابلیت تفکر تطبیقی (adaptive thinking) در Claude Fable 5 همیشه فعال است؛ توکنهای تفکر (thinking tokens) به عنوان توکن خروجی محاسبه میشوند و زنجیره تفکر خام هرگز به کاربر بازگردانده نمیشود. با تنظیم thinking.display روی مقدار پیشفرض omitted، شما در حالی که هزینه تمام توکنهای استدلالی پشت صحنه را میپردازید، فیلد تفکر را خالی میبینید. برای مشاهده تفکیک، usage.output_tokens_details.thinking_tokens را در پاسخ بررسی کنید و توجه داشته باشید که هنگام استریم، این دادهها فقط در رویداد نهایی message_delta ارسال میشوند. اگر نسبت استدلال به پاسخ بیش از نیاز وظیفه محوله است، سطح effort را کاهش دهید.
آیا باید از Claude Fable 5 استفاده کنم یا Claude Opus 5؟
هزینه Claude Opus 5 به ازای هر توکن نصف مدل دیگر است و تاریخ قطع دانش (knowledge cutoff) مطمئنتری دارد؛ مه 2026 در مقابل ژانویه 2026 برای Fable 5. با Opus 5 شروع کنید و در صورتی که وظیفهای در آن شکست خورد یا هزینه یک پاسخ اشتباه بیش از اختلاف قیمت دو مدل بود، به سراغ Fable 5 بروید. Fable 5 برای کارهای عاملی (agent work) با افق زمانی طولانی که در آن یک شاخه اشتباه منجر به ساعتها پاکسازی میشود، و همچنین برای کارهای موردی که هزینه اضافی آن به جای تکرار در هر درخواست، تنها یک بار در صورتحساب نهایی اعمال میشود، گزینه مناسبتری است.