SSD Nodes Learn Hosting plans →
راهنماها Matt Connorتوسط Matt Connor · به‌روزرسانی شده 2026-09-06

هزینه و قیمت استفاده از مدل Claude Fable 5

هزینه Claude Fable 5 به ازای هر میلیون توکن ورودی 10 دلار و خروجی 50 دلار است. این راهنما به شما کمک می‌کند تا هزینه‌های واقعی پروژه‌های خود را محاسبه کنید.

هزینه Claude Fable 5 چقدر است؟

هزینه Claude Fable 5 در Claude API به ازای هر میلیون توکن ورودی $10 و به ازای هر میلیون توکن خروجی $50 است. این‌ها نرخ‌های رسمی منتشرشده توسط Anthropic هستند که در تاریخ 3 اوت 2026 از صفحه قیمت‌گذاری استخراج شده‌اند. شناسه مدل API برابر با claude-fable-5 است. این مدل در تاریخ 9 ژوئن 2026 در Claude API، Amazon Bedrock، Claude Platform روی AWS، Google Cloud و Microsoft Foundry به‌صورت عمومی در دسترس قرار گرفت.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

این موضوع را مانند یک نردبان در نظر بگیرید. قیمت Fable 5 دو برابر Claude Opus 5، پنج برابر نرخ فعلی Claude Sonnet 5 و ده برابر Claude Haiku 4.5 است. این نسبت در هر دو سمت صورت‌حساب یکسان است، زیرا هر مدل در این جدول، قیمت خروجی را دقیقاً پنج برابر نرخ ورودی خود تعیین می‌کند. بنابراین اگر نسبت توکن‌های ورودی و خروجی یک کار را بدانید، با یک ضرب ساده می‌توانید قیمت را به مدل‌های دیگر تبدیل کنید.

یک تاریخ، محاسبات را تغییر می‌دهد. Sonnet 5 تا تاریخ 31 اوت 2026 با قیمت مقدماتی $2 برای ورودی و $10 برای خروجی به ازای هر میلیون توکن ارائه می‌شود. از تاریخ 1 سپتامبر 2026، قیمت آن به $3 برای ورودی و $15 برای خروجی تغییر می‌یابد. قیمت Fable 5 تغییری نمی‌کند، بنابراین فاصله بین این دو مدل در آن تاریخ از پنج برابر به کمی بیش از سه برابر کاهش می‌یابد. اگر در حال تدوین بودجه برای پاییز هستید، از اعداد جدیدتر Sonnet استفاده کنید.

تخفیف‌ها و تنها ضریبی که هزینه را افزایش می‌دهد

کش کردن پرامپت (Prompt caching) بزرگ‌ترین اهرم کاهش هزینه است. هزینه خواندن از کش، یک‌دهم قیمت ورودی پایه است که برای Fable 5 برابر با $1 به ازای هر میلیون توکن می‌باشد. نوشتن در کش، هزینه‌ای بیشتر از یک توکن ورودی معمولی دارد: 1.25 برابر قیمت پایه برای کش 5 دقیقه‌ای و 2 برابر قیمت پایه برای کش 1 ساعته. کش 5 دقیقه‌ای پس از یک بار خواندن و کش 1 ساعته پس از دو بار خواندن، هزینه خود را جبران می‌کنند. این محاسبات، تمام دلیل اهمیت محاسبه نقطه سربه‌سر کش کردن پرامپت پیش از فعال‌سازی سراسری آن است.

Batch API پنجاه درصد تخفیف برای هر دو سمت (ورودی و خروجی) اعمال می‌کند، بنابراین هزینه پردازش‌های دسته‌ای در Fable 5 به $5 برای ورودی و $25 برای خروجی به ازای هر میلیون توکن می‌رسد. درخواست‌های دسته‌ای به‌صورت ناهمگام (asynchronous) هستند، بنابراین این روش فقط برای کارهایی مفید است که نیازی به پاسخ فوری ندارند. این دو تخفیف با هم ترکیب می‌شوند، که باعث می‌شود یک پردازش کش‌شده و دسته‌ای، از هر دو جهت ارزان تمام شود.

پنجره کانتکست 1 میلیون توکنی با نرخ‌های استاندارد در Claude 4.6 و مدل‌های بعدی گنجانده شده است. هیچ هزینه اضافی برای کانتکست طولانی وجود ندارد، بنابراین یک درخواست 900 هزار توکنی با همان نرخ هر توکن محاسبه می‌شود که یک درخواست 9 هزار توکنی محاسبه می‌گردد.

ضریبی که صورت‌حساب را افزایش می‌دهد، محل اقامت داده (data residency) است. تنظیم inference_geo: "us" برای نگهداری پردازش استنتاج (inference) در داخل ایالات متحده، یک ضریب 1.1 بر روی تمامی دسته‌های توکن، شامل خواندن و نوشتن در کش، اعمال می‌کند. مسیریابی جهانی پیش‌فرض را تغییر ندهید مگر اینکه قرارداد شما الزام دیگری داشته باشد.

یک قانون صورت‌حساب مختص این مدل است. Fable 5 دارای طبقه‌بندی‌کننده‌های ایمنی است که می‌توانند یک درخواست را رد کنند. هنگامی که این اتفاق می‌افتد، Messages API مقدار stop_reason: "refusal" را به‌عنوان یک پاسخ موفق HTTP 200 برمی‌گرداند (نه یک خطا) و هزینه‌ای برای درخواستی که پیش از تولید هرگونه خروجی رد شده است، از شما دریافت نمی‌شود. اگر همان پرامپت را روی مدل دیگری از Claude دوباره امتحان کنید، اعتبار بازگشتی (fallback credit)، هزینه کش پرامپتِ جابه‌جایی را جبران می‌کند تا مجبور نباشید برای گرم کردن مجدد همان کش، دوباره هزینه بپردازید.

کدام طرح‌ها شامل Claude Fable 5 هستند؟

از تاریخ 3 اوت 2026، صفحه Claude Fable در وب‌سایت Anthropic اعلام کرده است که این مدل برای کاربران Pro، Max، Team و Enterprise در دسترس است. طرح رایگان در این لیست نام برده نشده است. طرح Pro ارزان‌ترین اشتراک در این لیست است، بنابراین هزینه طرح Pro و محدودیت‌های استفاده از آن کف قیمت برای هر مسیر اشتراکی جهت دسترسی به Fable را تعیین می‌کند. اگر دسترسی به Fable دلیل اصلی شما برای ارتقای طرح است، ابتدا ارزش خرید اشتراک Pro بر اساس میزان استفاده شخصی خود را بررسی کنید، زیرا سهمیه محدود Fable به تنهایی توجیه اقتصادی مناسبی برای اشتراک نیست. برای توسعه‌دهندگان، این مدل به‌طور کلی در Claude API و از طریق بازارهای ابری ذکر شده در بالا در دسترس است. در این مسیر هیچ سطح رایگانی وجود ندارد، بنابراین اعتبار اندکی که Anthropic هنگام ثبت‌نام ارائه می‌دهد تنها چیزی است که پیش از شروع محاسبه هزینه دریافت می‌کنید.

در دسترس بودن یک قابلیت در یک plan با included بودن آن بدون محدودیت یکسان نیست. subscription نیز مانند API به‌صورت metered محاسبه نمی‌شود، زیرا یک Pro seat هیچ token quota اعلام‌شده‌ای ندارد و در عوض میزان استفاده را بر اساس تعداد messageها در یک بازهٔ زمانی لغزان محاسبه می‌کند؛ بنابراین هیچ‌یک از موارد موجود در یک plan به‌صورت دقیق به ارقام per million بالا تبدیل نمی‌شود. جدول مقایسهٔ planها در صفحهٔ pricing شرکت Anthropic، دسترسی به Fable را برای برخی seatها به سهمی از محدودیت‌های هفتگی استفاده و برای برخی دیگر به usage creditها مشروط می‌کند. این سازوکار در طول July 2026 بیش از یک بار تغییر کرد. در بیانیهٔ خود Anthropic دربارهٔ redeploy کردن Fable 5 آمده بود که این model تا 50% از محدودیت‌های هفتگی استفاده را در Pro، Max، Team و برخی planهای Enterprise، تا 7 July 2026 شامل می‌شد و پس از آن تاریخ با usage creditها ارائه می‌شد. گزارش‌های منتشرشده در ادامهٔ July نیز از تمدیدهای بیشتر و تفکیک میان انواع seat خبر می‌دادند.

بنابراین، این صفحه محدودیت‌های دقیق هر طرح را درج نمی‌کند. هیچ عددی که در طول آن ماه منتشر شد بیش از دو هفته معتبر نماند و درج یک عدد قدیمی در اینجا، بدتر از عدم درج آن است. در روزی که تصمیم نهایی خود را می‌گیرید، ردیف با برچسب Fable را در جدول مقایسه طرح‌ها باز کنید و هر عددی که در مقالات خبری می‌بینید را منقضی تلقی کنید. اگر اشتراکی را برای دسترسی به Fable تهیه کردید و سهمیه آن کمتر از چیزی بود که جدول نشان می‌داد، کاهش سطح اشتراک پیش از تمدید بعدی باعث می‌شود ماهی که قبلاً پرداخت کرده‌اید، بدون تغییر باقی بماند.

آنچه ثابت است، نرخ API است. در هر مسیری، پس از اتمام سهمیه گنجانده شده، استفاده بیشتر از Fable 5 بر اساس قیمت‌های جدول بالا محاسبه می‌شود. طرح Enterprise این ساختار را شفاف می‌کند، زیرا هزینه اشتراک Enterprise دسترسی را فراهم می‌کند، در حالی که توکن‌ها همچنان با نرخ API محاسبه می‌شوند. این موضوع باعث می‌شود لیست قیمت، عددی باشد که باید برای برنامه‌ریزی در نظر بگیرید؛ این همان نتیجه‌ای است که هنگام مقایسه صورت‌حساب API با اشتراک برای هر مدل دیگر Claude به آن می‌رسید. اگر هنوز طرحی را انتخاب نکرده‌اید، از اینکه کدام طرح Claude با میزان استفاده شما مطابقت دارد شروع کنید. اگر این اشتراک قرار است دستیار روزمره شما باشد و نه فقط راهی برای دسترسی به Fable، پیش از نهایی کردن انتخاب، مقایسه قیمت طرح‌های Claude با ChatGPT را بررسی کنید.

چرا صورت‌حساب شما بیش از نسبت قیمتِ اعلام‌شده است

دو مکانیزم مستند وجود دارد که باعث می‌شود هزینه Fable 5 بیش از آن چیزی باشد که مقایسه مستقیم قیمت نشان می‌دهد.

اولین مورد، توکنایزر (tokenizer) است. Fable 5 از توکنایزری استفاده می‌کند که با Claude Opus 4.7 معرفی شد. در مقایسه با مدل‌هایی که پیش از Opus 4.7 عرضه شده‌اند، متن یکسان حدود 30% توکن بیشتری تولید می‌کند و میزان دقیق این افزایش به محتوا بستگی دارد. Haiku 4.5 پیش از آن توکنایزر عرضه شده است، بنابراین شکاف ده برابری در لیست قیمت، زمانی که یک بلوک متن یکسان را به هر دو مدل می‌دهید، به حدود سیزده برابر نزدیک‌تر می‌شود. Sonnet 5 از توکنایزر جدیدتر استفاده می‌کند، بنابراین مقایسه Fable با Sonnet بر اساس هر توکن، مقایسه‌ای منصفانه است، اما مقایسه Fable با Haiku این‌طور نیست.

دومین مورد، تفکر (thinking) است. تفکر تطبیقی (adaptive thinking) در Fable 5 همیشه فعال است و thinking: {"type": "disabled"} پشتیبانی نمی‌شود. توکن‌های تفکر به عنوان توکن‌های خروجی و با نرخ کامل خروجی محاسبه می‌شوند. زنجیره تفکر خام در این مدل هرگز بازگردانده نمی‌شود و thinking.display به‌طور پیش‌فرض روی "omitted" تنظیم شده است؛ این یعنی یک پاسخ کوتاه و قابل‌مشاهده می‌تواند تعداد توکن خروجیِ محاسبه‌شدهٔ زیادی داشته باشد. مستندات Anthropic به‌صراحت بیان می‌کند: تعداد توکن خروجیِ محاسبه‌شده با تعداد توکن قابل‌مشاهده در پاسخ مطابقت ندارد.

به‌جای حدس‌زدن، جزئیات را بررسی کنید. فیلد usage.output_tokens_details.thinking_tokens گزارش می‌دهد که چه تعداد از توکن‌های خروجیِ محاسبه‌شده صرف استدلال شده است:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

در آن مثال که از مستندات تفکر Anthropic گرفته شده است، 312 توکن از 348 توکن خروجیِ محاسبه‌شده، مربوط به استدلالی بوده که هیچ‌کس آن را ندیده است. هنگام استریم (streaming)، این جزئیات فقط در رویداد نهایی message_delta ارسال می‌شود، بنابراین کلاینتی که خواندن را در آخرین بخش متنی متوقف کند، هرگز آن را ثبت نخواهد کرد.

کنترل آن effort است که روی output_config.effort تنظیم می‌شود و سطوح آن شامل low، medium، high (پیش‌فرض)، xhigh و max است.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

توصیه Anthropic برای این مدل این است که با high شروع کنید، فقط برای کارهای بسیار حساس به توانایی، سطح را به xhigh افزایش دهید و برای کارهای روتین به medium یا low کاهش دهید؛ چرا که تلاش کمتر در Fable 5 اغلب از xhigh در مدل‌های قدیمی‌تر بهتر عمل می‌کند. دو تله در این مورد وجود دارد. تغییر میزان تلاش بین درخواست‌ها، کشِ پرامپت (prompt cache) شما را باطل می‌کند، زیرا مقدار تلاشِ تعیین‌شده در پرامپت رندر می‌شود؛ بنابراین برای هر حجم کاری یک سطح را انتخاب کرده و آن را ثابت نگه دارید. همچنین max_tokens یک سقف سخت برای مجموع خروجی، شامل متن تفکر و پاسخ است، بنابراین سقفی که برای پاسخی بدون تفکر تنظیم شده باشد، باعث برش خوردن متن می‌شود. مشاهده stop_reason: "max_tokens" به این معنی است که یا باید سقف را افزایش دهید یا سطح تلاش را کاهش دهید.

هزینه به ازای هر وظیفه تکمیل‌شده، نه هزینه به ازای هر توکن

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

آن 3 ردیف، محاسبات ریاضی هستند، نه یک بنچمارک. نرخ‌ها منتشر شده‌اند. حجم توکن‌ها فرضیاتی هستند که باید آن‌ها را با ارقام حاصل از داده‌های مصرفی خود جایگزین کنید. یک جلسه کدنویسی که مشابه ردیف میانی باشد، در مدل Fable 5 هزینه $5.00 و در مدل Sonnet 5 هزینه $1.00 دارد. اجرای طولانی‌مدت به ترتیب $40.00 در برابر $8.00 هزینه خواهد داشت. ستون Haiku در آن ردیف آخر صرفاً یک محاسبه ریاضی است: Haiku 4.5 دارای پنجره کانتکست 200k توکنی است، بنابراین اصلاً نمی‌تواند آن کار را مدیریت کند.

هزینه به ازای هر توکن، واحد اشتباهی برای تصمیم‌گیری است. هزینه به ازای هر وظیفه تکمیل‌شده، برابر است با هزینه هر تلاش ضرب‌در تعداد تلاش‌ها. با نرخ‌های امروز، یک تلاش Fable 5 هم‌هزینه با پنج تلاش Sonnet 5 است، بنابراین تعداد دفعات تلاش مجدد به‌تنهایی تقریباً هرگز ارتقا به مدل گران‌تر را توجیه نمی‌کند. Sonnet باید بیش از چهار بار از هر پنج بار شکست بخورد تا مسیر ارزان‌تر از نظر مصرف توکن بازنده شود.

آنچه این ارتقا را توجیه می‌کند، تمام مواردی است که در صورت‌حساب توکن نادیده گرفته شده است. اختلاف بین دو اجرای طولانی‌مدت در جدول، از هزینه یک ساعت زمان مهندس در اکثر بازارها کمتر است. اگر مدل گران‌تر یک ساعت از زمان بررسی را ذخیره کند یا از یک مهاجرت بد که بعداً مجبور به اصلاح آن هستید جلوگیری کند، هزینه خود را در صورت‌حسابی که هرگز این صرفه‌جویی را نشان نمی‌دهد، بازپرداخت کرده است. مقایسه را بر اساس پول به ازای هر نتیجه پذیرفته‌شده انجام دهید و زمان خود را نیز در مجموع لحاظ کنید. دانستن اینکه یک میلیون توکن واقعاً چه چیزی می‌خرد باعث می‌شود این برآورد بسیار کمتر انتزاعی باشد.

سه شغلی که Claude Fable 5 ارزش هزینه خود را دارد

اجرای عامل‌های (agent) با افق طولانی که در آن‌ها یک اشتباه، پرهزینه است. مدل Fable 5 برای کارهایی ساخته شده که با مقیاس ساعت اندازه‌گیری می‌شوند: پنجره متنی 1M توکنی، تا 128k توکن خروجی در هر درخواست، و سطح تلاش xhigh که برای وظایفی با زمان اجرای بیش از سی دقیقه و بودجه‌های توکنی در مقیاس میلیون‌ها طراحی شده است. هزینه اجرا را در برابر هزینه پاکسازی پس از اینکه یک عامل در مرحله 40 مسیر اشتباهی را انتخاب می‌کند و تا مرحله 300 کسی متوجه آن نمی‌شود، بسنجید.

مهاجرت یا حسابرسی (audit) که یک‌بار روی یک کدبیس بزرگ اجرا می‌کنید. کارهای یک‌باره حجم کافی برای سرشکن کردن هزینه‌ها ندارند، بنابراین حق‌بیمه هر توکن در یک فاکتور واحد لحاظ می‌شود و کل کار ممکن است در یک پنجره متنی جای بگیرد. اگر کار بتواند به‌صورت غیرهمگام (asynchronous) اجرا شود، Batch API هزینه آن را به $25 به ازای هر میلیون توکن خروجی کاهش می‌دهد.

وظیفه‌ای که یک مدل ارزان‌تر قبلاً دو بار در آن شکست خورده است. دو تلاش ناموفق به‌علاوه زمان دیباگ کردن شما، بیش از یک تلاش با Fable در حجم‌های ذکر شده در نمودار بالا هزینه دارد. ارتقا به مدل بالاتر، شاخه ارزان‌تر است و این دقیقاً همان کاری است که نردبان مدل‌ها (model ladder) برای آن ساخته شده است. اگر همچنان در حال انتخاب بین سطوح مختلف هستید، مقایسه قابلیت‌های سطوح مختلف مدل Claude به پرسشی متفاوت از این صفحه پاسخ می‌دهد.

سه شغلی که در آن‌ها Sonnet 5 یا Haiku 4.5 پاسخ صادقانه‌ای هستند

دسته‌بندی و استخراج با حجم بالا. این کارها بر اساس نرخ خروجی و هزینه واحد ارزیابی می‌شوند و سقف کیفیت به‌قدری پایین است که یک مدل ارزان‌قیمت به آن می‌رسد. در حالی که Haiku 4.5 وظیفه را به‌درستی انجام می‌دهد، پرداخت ده برابر هزینه برای Fable 5 هیچ دستاورد قابل‌اندازه‌گیری برای شما نخواهد داشت.

کارهای تعاملی که در آن‌ها تأخیر (latency) محصول اصلی است. جدول مدل‌های Anthropic، تأخیر نسبی Fable 5 را بیشتر نشان می‌دهد و قابلیت تفکر (thinking) در آن قابل غیرفعال‌سازی نیست. در یک کادر چت یا تکمیل خودکار ویرایشگر، مدل قدرتمندتر حس بدتری ایجاد می‌کند، زیرا کاربران پیش از آنکه متوجه کیفیت شوند، متوجه زمان انتظار می‌شوند.

هر چیزی که به رویدادهای پس از ژانویه 2026 وابسته باشد. تاریخ قطع دانش (knowledge cutoff) قابل‌اطمینان برای Fable 5 ژانویه 2026 است. این تاریخ برای Opus 5 ماه مه 2026 است. مدل گران‌تر، مدل قدیمی‌تر است؛ بنابراین در پرسش‌های مربوط به تازه‌ترین رویدادها، اگر ابزارهای جستجو یا fetch را در اختیار مدل قرار ندهید، عملاً دو برابر هزینه پرداخت می‌کنید تا به دانشی قدیمی‌تر دست یابید.

یک محدودیت وجود دارد که کاملاً خارج از بحث هزینه است. Fable 5 دارای سیاست نگهداری داده 30 روزه است و تحت شرایط «عدم نگهداری داده» (zero data retention) در دسترس نیست، زیرا به‌عنوان یک مدل تحت پوشش (Covered Model) تعیین شده است. اگر توافق‌نامه شما مستلزم عدم نگهداری داده باشد، Fable 5 به هیچ قیمتی گزینه‌ای مناسب نیست و هیچ تخفیفی این موضوع را تغییر نمی‌دهد.

مخازن fable-method چه چیزی را نشان می‌دهند و چه چیزی را نشان نمی‌دهند

متخصصان مخازنی را منتشر کرده‌اند که نحوه عملکرد رویکردهای Fable 5 را به مهارت‌هایی تبدیل می‌کند که یک مدل ارزان‌تر نیز می‌تواند از آن‌ها پیروی کند. مخزن fable-method یک مهارت تفکر، یک حلقه ارکستراسیون و یک تاییدکننده تقابلی (adversarial verifier) را توصیف می‌کند که به‌جای خواندن گزارش خودِ عامل (agent)، هر بررسی ادعا شده را دوباره اجرا می‌کند. فایل README آن مستقیماً می‌گوید: «این یک عصاره‌گیری جامعه‌محور است، نه یک محصول رسمی از Anthropic.»

با آن دقیقاً به همین شکل برخورد کنید. این مخزن شواهدی از نحوه هدایت مدل توسط کاربران است و مستنداتی از نحوه عملکرد درونی مدل نیست. هیچ‌چیز در آن توسط Anthropic تایید نشده است و چندین فورک تقریباً یکسان با عبارات متفاوت وجود دارد که دقیقاً همان چیزی است که از یک دانش عامیانه (folklore) انتظار می‌رود، نه یک مشخصات فنی (spec).

نکته قابل‌توجه برای تصمیم‌گیری در مورد هزینه‌ها این است که بخش‌هایی که افراد ارزش کپی‌کردن داشته‌اند، رویه‌ای (procedural) هستند. وظیفه را دسته‌بندی کنید، بررسی‌ای که اثبات می‌کند کار انجام شده است را نام‌گذاری کنید، پیش از تصمیم‌گیری شواهد را جمع‌آوری کنید و سپس به‌جای خواندن یک خلاصه، از طریق مشاهده تایید کنید. یک مدل ارزان‌تر که چک‌لیست صریح و مرحله تایید به آن داده شده باشد، بخشی از این شکاف را پر می‌کند؛ بنابراین پیش از استانداردسازی روی مدل گران‌قیمت، آن آزمایش را روی مجموعه ارزیابی خود اجرا کنید. نتیجه به وظایف شما بستگی دارد و به همین دلیل است که اعداد و ارقام دیگران برای شما ارزش چندانی ندارد.

پیش از تخصیص بودجه، اعداد خود را بررسی کنید

  • در هر پاسخ، usage را بخوانید و output_tokens_details.thinking_tokens را جدا از خروجی قابل‌مشاهده ثبت کنید. استدلالی که نمی‌بینید، همان ردیف هزینه‌ای است که افراد را غافلگیر می‌کند.
  • به جای پذیرش مقدار پیش‌فرض، effort را به‌طور صریح تنظیم کنید و در هر مکالمه‌ای که به prompt caching وابسته است، آن را ثابت نگه دارید.
  • پیشوند ثابت خود را پیش از نقطه شکست کش (cache breakpoint) قرار دهید. خواندن از کش با قیمتی معادل یک‌دهم ورودی پایه، بیش از اکثر تغییر مدل‌ها به مدل‌های ارزان‌تر، صرفه‌جویی به همراه دارد.
  • هر چیزی که به پاسخ فوری نیاز ندارد را به Batch API منتقل کنید.
  • جایگزین‌ها را صادقانه قیمت‌گذاری کنید. مقایسه قیمت‌گذاری API مدل‌های Claude و ChatGPT روی حجم کاری خودتان، پیش از تعهدات طولانی‌مدت، ارزش صرف یک بعدازظهر زمان را دارد.

اگر حجم کاری مربوط به عاملی (agent) است که روی سرور شخصی شما اجرا می‌شود، کنترل‌هایی که بیشترین اهمیت را دارند خارج از انتخاب مدل قرار می‌گیرند. کنترل هزینه‌های عامل روی VPS محدودیت‌های حلقه و سقف هزینه را پوشش می‌دهد که از اجرای بی‌رویه نشست‌ها جلوگیری می‌کند، و محل واقعی مصرف توکن‌ها در Claude Code اعدادی را که در داشبورد استفاده خود می‌بینید، توضیح می‌دهد.

FAQ

هزینه Claude Fable 5 به ازای هر میلیون توکن چقدر است؟

مدل Claude Fable 5 در API شرکت Anthropic، طبق بررسی صفحه قیمت‌گذاری در تاریخ 3 اوت 2026، با قیمت $10 به ازای هر میلیون توکن ورودی و $50 به ازای هر میلیون توکن خروجی ارائه می‌شود. هزینه خواندن از حافظه کش (cache read) برابر با $1 به ازای هر میلیون توکن است که یک‌دهم نرخ پایه ورودی محسوب می‌شود. Batch API با اعمال 50 درصد تخفیف در هر دو بخش، قیمت را برای پردازش‌های غیرهمزمان به $5 و $25 به ازای هر میلیون توکن می‌رساند. نگهداری پردازش استنتاج در داخل ایالات متحده با استفاده از پارامتر inference_geo، ضریب 1.1 برابر را به تمامی دسته‌ها اضافه می‌کند.

آیا Claude Fable 5 در اشتراک Claude Pro گنجانده شده است؟

صفحه Claude Fable در وب‌سایت Anthropic، این مدل را برای کاربران طرح‌های Pro، Max، Team و Enterprise در دسترس اعلام کرده و نامی از طرح رایگان نبرده است. دسترسی گنجانده‌شده در اشتراک، نامحدود نیست. برخی کاربران از طریق سهمیه محدودیت استفاده هفتگی به Fable دسترسی دارند و برخی دیگر از طریق اعتبار مصرف (usage credits)؛ این سازوکار در طول ماه ژوئیه 2026 بیش از یک بار تغییر کرده است. به‌جای اعتماد به ارقام ذکرشده در مقالات، ردیف مربوط به Fable را در جدول مقایسه طرح‌ها در صفحه قیمت‌گذاری Anthropic در همان روز تصمیم‌گیری بررسی کنید. پس از اتمام سهمیه مجاز، استفاده بیشتر بر اساس نرخ API محاسبه و صورت‌حساب می‌شود.

چرا صورت‌حساب Claude Fable 5 من از آنچه در خروجی مشاهده می‌شود، بیشتر است؟

قابلیت Adaptive thinking در Claude Fable 5 همیشه فعال است؛ توکن‌های تفکر (thinking tokens) به عنوان توکن‌های خروجی محاسبه می‌شوند و زنجیره تفکر خام هرگز به کاربر بازگردانده نمی‌شود. با تنظیم thinking.display روی مقدار پیش‌فرض omitted، شما در حالی که فیلد تفکر را خالی می‌بینید، هزینه تمام توکن‌های استدلالی پشت آن را پرداخت می‌کنید. برای مشاهده تفکیک، usage.output_tokens_details.thinking_tokens را در پاسخ بررسی کنید و توجه داشته باشید که هنگام استفاده از streaming، این داده‌ها تنها در رویداد نهایی message_delta ارسال می‌شوند. اگر نسبت استدلال به پاسخ بیش از نیاز وظیفه محوله است، سطح effort را کاهش دهید.

آیا باید از Claude Fable 5 استفاده کنم یا Claude Opus 5؟

هزینه Claude Opus 5 به ازای هر توکن نصف مدل دیگر است و دارای تاریخ قطع دانش (knowledge cutoff) به‌روزتر و قابل‌اعتمادتری است (مه 2026 در مقابل ژانویه 2026 برای Fable 5). کار را با Opus 5 شروع کنید و در صورتی که وظیفه‌ای در آن شکست خورد یا هزینه یک پاسخ اشتباه بیش از اختلاف قیمت دو مدل بود، به سراغ Fable 5 بروید. Fable 5 انتخاب مناسبی برای کارهای عاملی (agent work) با افق طولانی است که در آن‌ها یک شاخه اشتباه می‌تواند ساعت‌ها زمان برای اصلاح نیاز داشته باشد، و همچنین برای کارهای موردی که هزینه اضافی آن به جای تکرار در هر درخواست، تنها یک بار در صورت‌حساب نهایی اعمال می‌شود.

#claude#fable#model-selection#pricing#tokens