SSD Nodes Learn 🎉 VPS از $5.50/ماه
راهنماها Matt Connorتوسط Matt Connor · به‌روزرسانی شده 2026-08-13

هزینه و زمان استفاده از مدل Claude Fable 5

مدل Claude Fable 5 با قیمت 10 دلار برای هر میلیون توکن ورودی و 50 دلار برای خروجی عرضه شده است. این مطلب نحوه محاسبه هزینه‌ها و مقایسه آن با مدل‌های دیگر را بررسی می‌کند.

هزینه Claude Fable 5 چقدر است؟

هزینه Claude Fable 5 در Claude API به ازای هر میلیون توکن ورودی $10 و به ازای هر میلیون توکن خروجی $50 است. این‌ها نرخ‌های رسمی منتشرشده توسط Anthropic هستند که در تاریخ 3 اوت 2026 از صفحه قیمت‌گذاری استخراج شده‌اند. شناسه مدل API برابر با claude-fable-5 است. این مدل در تاریخ 9 ژوئن 2026 در Claude API، Amazon Bedrock، Claude Platform روی AWS، Google Cloud و Microsoft Foundry به‌صورت عمومی در دسترس قرار گرفت.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

این موضوع را مانند یک نردبان در نظر بگیرید. قیمت Fable 5 دو برابر Claude Opus 5، پنج برابر نرخ فعلی Claude Sonnet 5 و ده برابر Claude Haiku 4.5 است. این نسبت در هر دو بخش صورت‌حساب یکسان است، زیرا هر مدل در آن جدول، قیمت خروجی را دقیقاً پنج برابر نرخ ورودی خود تعیین می‌کند. بنابراین اگر نسبت توکن‌های ورودی و خروجی یک کار را بدانید، می‌توانید با ضرب، یک قیمت را به قیمت دیگر تبدیل کنید.

یک تاریخ، محاسبات را تغییر می‌دهد. Sonnet 5 تا تاریخ 31 اوت 2026 با قیمت مقدماتی $2 برای ورودی و $10 برای خروجی به ازای هر میلیون توکن ارائه می‌شود. از تاریخ 1 سپتامبر 2026، قیمت آن به $3 و $15 تغییر می‌یابد. قیمت Fable 5 تغییری نمی‌کند، بنابراین شکاف بین این دو مدل در آن تاریخ از پنج برابر به کمی بیش از سه برابر کاهش می‌یابد. اگر در حال تدوین بودجه برای پاییز هستید، از ارقام جدیدتر Sonnet استفاده کنید.

تخفیف‌ها و تنها ضریبی که هزینه را افزایش می‌دهد

کش کردن پرامپت (Prompt caching) بزرگ‌ترین اهرم کاهش هزینه است. هزینه خواندن از کش، یک‌دهم قیمت ورودی پایه است که برای Fable 5 برابر با $1 به ازای هر میلیون توکن می‌باشد. نوشتن در کش، هزینه‌ای بیشتر از یک توکن ورودی معمولی دارد: 1.25 برابر قیمت پایه برای کش 5 دقیقه‌ای و 2 برابر قیمت پایه برای کش 1 ساعته. کش 5 دقیقه‌ای پس از یک بار خواندن و کش 1 ساعته پس از دو بار خواندن، هزینه خود را جبران می‌کنند. همین محاسبات، تمام دلیل اهمیت محاسبه نقطه سربه‌سر کش کردن پرامپت پیش از فعال‌سازی سراسری آن است.

Batch API پنجاه درصد تخفیف برای هر دو بخش ورودی و خروجی اعمال می‌کند، بنابراین هزینه پردازش‌های دسته‌ای در Fable 5 به $5 برای ورودی و $25 برای خروجی به ازای هر میلیون توکن می‌رسد. درخواست‌های دسته‌ای به‌صورت غیرهمگام (asynchronous) هستند، بنابراین این روش فقط برای کارهایی مفید است که نیازی به پاسخ فوری ندارند. این دو تخفیف با هم ترکیب می‌شوند، که باعث می‌شود یک پردازش کش‌شده و دسته‌ای، از هر دو جهت ارزان تمام شود.

پنجره کانتکست 1 میلیون توکنی در Claude 4.6 و مدل‌های بعدی با نرخ‌های استاندارد ارائه می‌شود. هیچ هزینه اضافی برای کانتکست طولانی وجود ندارد، بنابراین یک درخواست 900 هزار توکنی با همان نرخ به ازای هر توکن محاسبه می‌شود که یک درخواست 9 هزار توکنی محاسبه می‌گردد.

ضریبی که صورت‌حساب را افزایش می‌دهد، محل اقامت داده (data residency) است. تنظیم inference_geo: "us" برای نگهداری پردازش استنتاج (inference) در داخل ایالات متحده، یک ضریب 1.1 بر روی تمام دسته‌های توکن، از جمله خواندن و نوشتن در کش، اعمال می‌کند. مگر اینکه قرارداد خاصی الزام کرده باشد، مسیریابی جهانی پیش‌فرض را تغییر ندهید.

یک قانون صورت‌حساب مختص این مدل است. Fable 5 دارای طبقه‌بندی‌کننده‌های ایمنی است که می‌توانند یک درخواست را رد کنند. در این صورت، Messages API مقدار stop_reason: "refusal" را به‌عنوان یک پاسخ موفق HTTP 200 برمی‌گرداند (نه یک خطا) و هزینه‌ای برای درخواستی که پیش از تولید هرگونه خروجی رد شده است، از شما دریافت نمی‌شود. اگر همان پرامپت را روی مدل دیگری از Claude دوباره امتحان کنید، اعتبار بازگشتی (fallback credit)، هزینه کش پرامپتِ تغییر مدل را جبران می‌کند تا مجبور نباشید برای گرم کردن مجدد همان کش، دوباره هزینه بپردازید.

کدام طرح‌ها شامل Claude Fable 5 می‌شوند؟

از تاریخ 3 اوت 2026، صفحه Claude Fable در سایت Anthropic اعلام کرده است که این مدل برای کاربران Pro، Max، Team و Enterprise در دسترس است. طرح رایگان در این لیست نام برده نشده است. طرح Pro ارزان‌ترین گزینه در این لیست است، بنابراین هزینه طرح Pro و محدودیت‌های استفاده از آن کف قیمت برای هر نوع اشتراکی جهت دسترسی به Fable را تعیین می‌کند. برای توسعه‌دهندگان، این مدل به‌طور کلی از طریق Claude API و بازارهای ابری ذکر شده در بالا در دسترس است. هیچ سطح رایگانی در آن مسیر وجود ندارد، بنابراین اعتبار اندکی که Anthropic هنگام ثبت‌نام ارائه می‌دهد تنها چیزی است که پیش از شروع محاسبه هزینه دریافت می‌کنید.

در دسترس بودن در یک طرح به معنای گنجانده شدن بدون محدودیت نیست. جدول مقایسه طرح‌ها در صفحه قیمت‌گذاری Anthropic، دسترسی به Fable را برای برخی از کاربران به بخشی از محدودیت‌های استفاده هفتگی و برای برخی دیگر به اعتبارات مصرفی محدود کرده است؛ این ساختار در طول ژوئیه 2026 بیش از یک بار تغییر کرد. بیانیه رسمی Anthropic در مورد بازنشر Fable 5 شامل دسترسی به این مدل تا سقف 50 درصد از محدودیت‌های استفاده هفتگی تا تاریخ 7 ژوئیه 2026 برای طرح‌های Pro، Max، Team و برخی طرح‌های Enterprise بود و پس از آن تاریخ، از اعتبارات مصرفی استفاده شد. گزارش‌های منتشر شده در ادامه ماه ژوئیه، به تمدیدهای بیشتر و تفکیک بین انواع اشتراک‌ها اشاره داشتند.

بنابراین، این صفحه محدودیت‌های هر طرح را درج نمی‌کند. هیچ عددی که در طول آن ماه منتشر شد، بیش از دو هفته معتبر نماند و یک عدد قدیمی در اینجا از نداشتن آن بدتر است. در روز تصمیم‌گیری، ردیف با برچسب Fable را در جدول مقایسه طرح‌ها باز کنید و هر عددی که در مقالات خبری می‌بینید را منقضی تلقی کنید. اگر اشتراکی برای دسترسی به Fable تهیه کردید و سهمیه آن کمتر از چیزی بود که جدول نشان می‌داد، کاهش سطح اشتراک پیش از تمدید بعدی باعث می‌شود ماهی که قبلاً برای آن پرداخت کرده‌اید، دست‌نخورده باقی بماند.

آنچه ثابت است، نرخ API است. در هر مسیری، پس از اتمام سهمیه گنجانده شده، استفاده بیشتر از Fable 5 طبق قیمت‌های جدول بالا محاسبه می‌شود. در طرح Enterprise این ساختار صریح‌تر است، زیرا هزینه اشتراک Enterprise دسترسی را فراهم می‌کند در حالی که توکن‌ها همچنان با نرخ API محاسبه می‌شوند. این موضوع باعث می‌شود لیست قیمت، عددی باشد که در هر صورت باید بر اساس آن برنامه‌ریزی کنید؛ این همان نتیجه‌ای است که هنگام مقایسه صورت‌حساب API با یک اشتراک برای هر مدل دیگر Claude به آن می‌رسید. اگر هنوز سطحی را انتخاب نکرده‌اید، از اینکه کدام طرح Claude با میزان استفاده شما مطابقت دارد شروع کنید. اگر قرار است آن اشتراک علاوه بر دسترسی به Fable، دستیار روزمره شما نیز باشد، پیش از نهایی کردن انتخاب، بررسی مقایسه قیمت طرح‌های Claude با ChatGPT ارزشمند است.

چرا صورت‌حساب شما بیش از نسبت قیمتِ اعلام‌شده است

دو مکانیزم مستند وجود دارد که باعث می‌شود هزینه Fable 5 بیش از آن چیزی باشد که مقایسه مستقیم قیمت نشان می‌دهد.

اولین مورد، توکنایزر (tokenizer) است. Fable 5 از توکنایزری استفاده می‌کند که با Claude Opus 4.7 معرفی شد. در مقایسه با مدل‌هایی که پیش از Opus 4.7 منتشر شده‌اند، متن یکسان حدود 30% توکن بیشتری تولید می‌کند و میزان دقیق این افزایش به محتوا بستگی دارد. مدل Haiku 4.5 پیش از آن توکنایزر عرضه شده است، بنابراین وقتی یک بلوک متنی یکسان را به هر دو مدل می‌دهید، شکاف ده برابری در لیست قیمت، در واقع به سیزده برابر نزدیک‌تر می‌شود. Sonnet 5 از توکنایزر جدیدتر استفاده می‌کند، بنابراین مقایسه Fable با Sonnet بر اساس هر توکن منصفانه است، اما مقایسه Fable با Haiku این‌طور نیست.

دومین مورد، تفکر (thinking) است. تفکر تطبیقی (adaptive thinking) در Fable 5 همیشه فعال است و thinking: {"type": "disabled"} پشتیبانی نمی‌شود. توکن‌های تفکر به عنوان توکن‌های خروجی و با نرخ کامل خروجی محاسبه می‌شوند. زنجیره تفکر خام هرگز در این مدل بازگردانده نمی‌شود و thinking.display به‌طور پیش‌فرض روی "omitted" تنظیم شده است؛ این یعنی یک پاسخ کوتاه و قابل‌مشاهده می‌تواند تعداد توکن خروجیِ محاسبه‌شدهٔ زیادی داشته باشد. مستندات Anthropic به‌صراحت بیان می‌کند: تعداد توکن‌های خروجیِ محاسبه‌شده با تعداد توکن‌های قابل‌مشاهده در پاسخ مطابقت ندارد.

به‌جای حدس‌زدن، جزئیات را بررسی کنید. فیلد usage.output_tokens_details.thinking_tokens گزارش می‌دهد که چه تعداد از توکن‌های خروجیِ محاسبه‌شده صرف استدلال شده است:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

در آن مثال که از مستندات تفکر Anthropic گرفته شده است، 312 توکن از 348 توکن خروجیِ محاسبه‌شده، مربوط به استدلالی بوده که هیچ‌کس آن را ندیده است. هنگام استریم (streaming)، این تفکیک فقط در رویداد نهایی message_delta ارسال می‌شود، بنابراین کلاینتی که خواندن را در آخرین تکه متن متوقف کند، هرگز آن را ثبت نخواهد کرد.

کنترل این قابلیت effort است که روی output_config.effort تنظیم می‌شود و سطوح آن شامل low، medium، high (پیش‌فرض)، xhigh و max است.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

راهنمای Anthropic برای این مدل این است که با high شروع کنید، فقط برای کارهایی که به بالاترین سطح توانمندی نیاز دارند به xhigh بروید، و برای کارهای روتین به medium یا low کاهش دهید؛ چرا که تلاش کمتر در Fable 5 اغلب از xhigh در مدل‌های قدیمی‌تر بهتر عمل می‌کند. دو تله در این مورد وجود دارد. تغییر میزان تلاش بین درخواست‌ها، کشِ پرامپت (prompt cache) شما را باطل می‌کند، زیرا مقدار تلاشِ تعیین‌شده در پرامپت رندر می‌شود؛ بنابراین برای هر حجم کاری یک سطح را انتخاب کرده و آن را ثابت نگه دارید. همچنین max_tokens یک سقف سخت برای مجموع خروجی، شامل متن تفکر و پاسخ است، بنابراین سقفی که برای پاسخی بدون تفکر تنظیم شده باشد، باعث قطع‌شدن متن (truncate) می‌شود. مشاهده stop_reason: "max_tokens" به این معنی است که یا باید سقف را افزایش دهید یا سطح تلاش را کاهش دهید.

هزینه به ازای هر وظیفه تکمیل‌شده، نه هزینه به ازای هر توکن

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

آن 3 ردیف، محاسبات ریاضی هستند و نه یک بنچمارک. نرخ‌ها منتشر شده‌اند. حجم توکن‌ها فرضیاتی هستند که باید آن‌ها را با ارقام حاصل از داده‌های مصرفی خود جایگزین کنید. یک جلسه کدنویسی با الگوی ردیف میانی، در مدل Fable 5 هزینه $5.00 و در مدل Sonnet 5 هزینه $1.00 دارد. اجرای طولانی‌مدت به ترتیب $40.00 در مقابل $8.00 هزینه خواهد داشت. ستون Haiku در آن ردیف آخر صرفاً یک محاسبه ریاضی است: مدل Haiku 4.5 دارای پنجره کانتکست 200k توکنی است، بنابراین اصلاً نمی‌تواند آن کار را پردازش کند.

هزینه به ازای هر توکن، واحد اشتباهی برای تصمیم‌گیری است. هزینه به ازای هر وظیفه تکمیل‌شده، برابر است با هزینه هر تلاش ضرب‌در تعداد تلاش‌ها. با نرخ‌های امروز، یک تلاش Fable 5 هم‌قیمت پنج تلاش Sonnet 5 است، بنابراین تعداد دفعات تلاش مجدد به‌تنهایی تقریباً هرگز ارتقا به مدل گران‌تر را توجیه نمی‌کند. مدل Sonnet باید بیش از چهار بار از پنج بار شکست بخورد تا مسیر ارزان‌تر از نظر هزینه توکن بازنده شود.

آنچه این ارتقا را توجیه می‌کند، تمام مواردی است که در صورت‌حساب توکن نادیده گرفته می‌شود. اختلاف بین دو اجرای طولانی در جدول، از هزینه یک ساعت وقت مهندس در اکثر بازارها کمتر است. اگر مدل گران‌تر یک ساعت از زمان بازبینی شما را ذخیره کند، یا از یک مهاجرت ناموفق که بعداً باید آن را اصلاح کنید جلوگیری کند، هزینه خود را از طریق صرفه‌جویی در هزینه‌ای که هرگز در صورت‌حساب دیده نمی‌شود، بازگردانده است. مقایسه را بر اساس پول به ازای هر نتیجه پذیرفته‌شده انجام دهید و زمان خود را نیز در مجموع لحاظ کنید. دانستن اینکه یک میلیون توکن واقعاً چه چیزی را خریداری می‌کند باعث می‌شود این برآورد بسیار کمتر انتزاعی باشد.

سه شغلی که Claude Fable 5 ارزش هزینه خود را دارد

اجرای عامل‌های (agent) با افق طولانی که در آن‌ها یک اشتباه، هزینه‌بر است. مدل Fable 5 برای کارهایی ساخته شده که با مقیاس ساعت اندازه‌گیری می‌شوند: پنجره متنی 1 میلیون توکنی، تا 128 هزار توکن خروجی در هر درخواست، و سطح تلاش xhigh که برای وظایفی با زمان اجرای بیش از 30 دقیقه و بودجه‌های توکنی در مقیاس میلیون طراحی شده است. هزینه اجرا را در برابر پاکسازی پس از آن بسنجید که یک عامل در مرحله 40 مسیر اشتباهی را انتخاب می‌کند و تا مرحله 300 کسی متوجه آن نمی‌شود.

مهاجرت یا حسابرسی (audit) که یک‌بار روی یک کدبیس بزرگ اجرا می‌کنید. کارهای یک‌باره حجم کافی برای سرشکن کردن هزینه‌ها ندارند، بنابراین حق‌بیمه هر توکن در یک فاکتور واحد لحاظ می‌شود و کل کار ممکن است در یک پنجره متنی جای بگیرد. اگر کار بتواند به‌صورت غیرهمگام (asynchronous) اجرا شود، Batch API هزینه را به $25 به ازای هر میلیون توکن خروجی کاهش می‌دهد.

وظیفه‌ای که یک مدل ارزان‌تر قبلاً دو بار در آن شکست خورده است. دو تلاش ناموفق به‌علاوه زمان دیباگ کردن شما، بیش از یک تلاش با Fable در حجم‌های ذکر شده در جدول بالا هزینه دارد. ارتقا به مدل بالاتر، شاخه ارزان‌تر است و مدل ladder دقیقاً برای همین منظور طراحی شده است. اگر همچنان در حال انتخاب بین سطوح مختلف هستید، مقایسه توانمندی بین سطوح مدل Claude به پرسشی متفاوت از این صفحه پاسخ می‌دهد.

سه شغلی که Sonnet 5 یا Haiku 4.5 پاسخ صادقانه‌ای برای آن‌هاست

طبقه‌بندی و استخراج با حجم بالا. این کارها بر اساس نرخ خروجی (throughput) و هزینه واحد ارزیابی می‌شوند و سقف کیفیت به‌قدری پایین است که یک مدل ارزان‌قیمت به آن دست می‌یابد. در مقایسه با هزینه‌ای ده برابر بیشتر برای کاری که Haiku 4.5 به‌درستی انجام می‌دهد، Fable 5 هیچ ارزش قابل‌اندازه‌گیری‌ای ارائه نمی‌دهد.

کارهای تعاملی که در آن‌ها تأخیر (latency) محصول اصلی است. جدول مدل‌های Anthropic، تأخیر نسبی Fable 5 را بیشتر نشان می‌دهد و قابلیت تفکر (thinking) در آن قابل غیرفعال‌سازی نیست. در یک کادر چت یا تکمیل خودکار ویرایشگر، مدل قدرتمندتر حس بدتری ایجاد می‌کند، زیرا کاربران پیش از آنکه متوجه کیفیت شوند، متوجه انتظار (wait) می‌شوند.

هر چیزی که به رویدادهای پس از ژانویه 2026 وابسته باشد. تاریخ قطع دانش قابل‌اتکای Fable 5 ژانویه 2026 است. این تاریخ برای Opus 5 ماه مه 2026 است. مدل گران‌تر، مدل قدیمی‌تر است؛ بنابراین در پرسش‌های مربوط به تازگی اطلاعات، اگر ابزارهای جستجو یا fetch را در اختیار مدل قرار ندهید، دو برابر هزینه پرداخت می‌کنید تا دانشی قدیمی‌تر دریافت کنید.

یک محدودیت وجود دارد که کاملاً خارج از بحث هزینه است. Fable 5 دارای سیاست نگهداری داده 30 روزه است و تحت شرایط «عدم نگهداری داده» (zero data retention) در دسترس نیست، زیرا به‌عنوان یک مدل تحت پوشش (Covered Model) تعیین شده است. اگر توافق‌نامه شما مستلزم عدم نگهداری داده باشد، Fable 5 به هیچ قیمتی گزینه‌ای مناسب نیست و هیچ تخفیفی این موضوع را تغییر نمی‌دهد.

مخازن fable-method چه چیزی را نشان می‌دهند و چه چیزی را نشان نمی‌دهند

متخصصان مخازنی را منتشر کرده‌اند که نحوه رویکرد Fable 5 به کارها را به مهارت‌هایی تبدیل می‌کند که یک مدل ارزان‌تر نیز قادر به دنبال کردن آن‌ها باشد. مخزن fable-method یک مهارت تفکر، یک حلقه ارکستراسیون و یک تاییدکننده تقابلی را توصیف می‌کند که به جای خواندن گزارش خودِ عامل (agent)، هر بررسی ادعا شده را مجدداً اجرا می‌کند. فایل README آن مستقیماً می‌گوید: «این یک عصاره‌گیری جامعه‌محور است، نه یک محصول رسمی از Anthropic.»

با آن دقیقاً به همین شکل برخورد کنید. این مخزن شواهدی از نحوه هدایت مدل توسط کاربران است و مستنداتی از نحوه عملکرد درونی مدل نیست. هیچ بخشی از آن توسط Anthropic تایید نشده است و چندین فورک تقریباً یکسان با عبارات متفاوت وجود دارد که دقیقاً همان چیزی است که از یک دانش عامیانه انتظار می‌رود، نه یک مشخصات فنی (spec).

نکته قابل توجه برای تصمیم‌گیری در مورد هزینه‌ها این است که بخش‌هایی که مردم ارزش کپی کردن داشته‌اند، رویه‌ای (procedural) هستند. وظیفه را دسته‌بندی کنید، بررسی‌ای که اثبات می‌کند کار انجام شده است را نام‌گذاری کنید، پیش از تصمیم‌گیری شواهد را جمع‌آوری کنید و سپس به جای خواندن یک خلاصه، از طریق مشاهده تایید کنید. یک مدل ارزان‌تر که چک‌لیست صریح و مرحله تایید به آن داده شده باشد، بخشی از شکاف عملکرد را پر می‌کند؛ بنابراین پیش از استانداردسازی روی مدل گران‌قیمت، این آزمایش را روی مجموعه ارزیابی خود اجرا کنید. نتیجه به وظایف شما بستگی دارد و به همین دلیل است که اعداد و ارقام دیگران برای شما ارزش چندانی ندارد.

پیش از تخصیص بودجه، اعداد خود را بررسی کنید

  • در هر پاسخ، usage را بخوانید و output_tokens_details.thinking_tokens را جدا از خروجی قابل مشاهده، لاگ کنید. استدلالی که نمی‌بینید، همان ردیف هزینه‌ای است که باعث غافلگیری می‌شود.
  • به جای پذیرش مقدار پیش‌فرض، effort را به‌طور صریح تعیین کنید و در هر گفتگویی که به prompt caching وابسته است، آن را ثابت نگه دارید.
  • پیشوند ثابت خود را پیش از یک cache breakpoint قرار دهید. خواندن از حافظه کش با یک‌دهم قیمت ورودی پایه، بیش از اکثر تغییر مدل‌ها به مدل‌های ارزان‌تر، صرفه‌جویی می‌کند.
  • هر چیزی که نیاز به پاسخ فوری ندارد را به Batch API منتقل کنید.
  • قیمت جایگزین‌ها را صادقانه ارزیابی کنید. مقایسه قیمت API مدل‌های Claude و ChatGPT روی حجم کاری خودتان، پیش از یک تعهد طولانی‌مدت، ارزش یک بعدازظهر وقت گذاشتن را دارد.

اگر حجم کاری مربوط به عاملی (agent) است که روی سرور شخصی شما اجرا می‌شود، کنترل‌هایی که بیشترین اهمیت را دارند خارج از انتخاب مدل قرار می‌گیرند. کنترل هزینه‌های عامل روی VPS محدودیت‌های حلقه و سقف هزینه را پوشش می‌دهد که از اجرای بی‌رویه نشست‌ها جلوگیری می‌کند، و محل واقعی مصرف توکن‌ها در Claude Code اعدادی را که در داشبورد کاربری خود مشاهده خواهید کرد، توضیح می‌دهد.

FAQ

هزینه Claude Fable 5 به ازای هر میلیون توکن چقدر است؟

مدل Claude Fable 5 در Claude API با قیمت $10 به ازای هر میلیون توکن ورودی و $50 به ازای هر میلیون توکن خروجی قیمت‌گذاری شده است؛ این ارقام در تاریخ 3 اوت 2026 از صفحه قیمت‌گذاری Anthropic استخراج شده‌اند. هزینه خواندن از حافظه کش (cache read) برابر با $1 به ازای هر میلیون توکن است که یک‌دهم نرخ پایه ورودی محسوب می‌شود. Batch API با اعمال 50 درصد تخفیف روی هر دو بخش، قیمت را برای پردازش‌های غیرهمزمان به $5 و $25 به ازای هر میلیون توکن می‌رساند. نگهداری پردازش (inference) در داخل ایالات متحده با استفاده از پارامتر inference_geo، ضریب 1.1 را به تمامی دسته‌ها اعمال می‌کند.

آیا Claude Fable 5 در اشتراک Claude Pro گنجانده شده است؟

صفحه Claude Fable در وب‌سایت Anthropic این مدل را برای کاربران Pro، Max، Team و Enterprise در دسترس اعلام کرده و نامی از طرح رایگان نبرده است. دسترسی گنجانده‌شده در اشتراک، نامحدود نیست. برخی کاربران از طریق سهمیه استفاده هفتگی به Fable دسترسی دارند و برخی دیگر از طریق اعتبار مصرف (usage credits)؛ این سازوکار در طول ماه ژوئیه 2026 بیش از یک بار تغییر کرده است. به‌جای اعتماد به ارقام موجود در مقالات، در روز تصمیم‌گیری، ردیف مربوط به Fable را در جدول مقایسه طرح‌ها در صفحه قیمت‌گذاری Anthropic مطالعه کنید. پس از اتمام سهمیه گنجانده‌شده، استفاده بیشتر بر اساس نرخ API محاسبه و صورت‌حساب می‌شود.

چرا صورت‌حساب Claude Fable 5 من از آنچه در خروجی مشاهده می‌شود، بیشتر است؟

قابلیت تفکر تطبیقی (adaptive thinking) در Claude Fable 5 همیشه فعال است؛ توکن‌های تفکر (thinking tokens) به عنوان توکن خروجی محاسبه می‌شوند و زنجیره تفکر خام هرگز به کاربر بازگردانده نمی‌شود. با تنظیم thinking.display روی مقدار پیش‌فرض omitted، شما در حالی که هزینه تمام توکن‌های استدلالی پشت صحنه را می‌پردازید، فیلد تفکر را خالی می‌بینید. برای مشاهده تفکیک، usage.output_tokens_details.thinking_tokens را در پاسخ بررسی کنید و توجه داشته باشید که هنگام استریم، این داده‌ها فقط در رویداد نهایی message_delta ارسال می‌شوند. اگر نسبت استدلال به پاسخ بیش از نیاز وظیفه محوله است، سطح effort را کاهش دهید.

آیا باید از Claude Fable 5 استفاده کنم یا Claude Opus 5؟

هزینه Claude Opus 5 به ازای هر توکن نصف مدل دیگر است و تاریخ قطع دانش (knowledge cutoff) مطمئن‌تری دارد؛ مه 2026 در مقابل ژانویه 2026 برای Fable 5. با Opus 5 شروع کنید و در صورتی که وظیفه‌ای در آن شکست خورد یا هزینه یک پاسخ اشتباه بیش از اختلاف قیمت دو مدل بود، به سراغ Fable 5 بروید. Fable 5 برای کارهای عاملی (agent work) با افق زمانی طولانی که در آن یک شاخه اشتباه منجر به ساعت‌ها پاک‌سازی می‌شود، و همچنین برای کارهای موردی که هزینه اضافی آن به جای تکرار در هر درخواست، تنها یک بار در صورت‌حساب نهایی اعمال می‌شود، گزینه مناسب‌تری است.

#claude#fable#model-selection#pricing#tokens