Claude Fable 5 fiyatı ve ne zaman kullanılmalı
Claude Fable 5, milyon giriş token'ı için $10, çıkış token'ı için $50 olarak listelenir. Yayınlanan fiyatların çalıştırılan işlere etkisi açıklanır.
Claude Fable 5 ne kadar?
Claude Fable 5, Claude API üzerinde milyon giriş token'ı başına $10, milyon çıkış token'ı başına $50 tutarındadır. Bunlar, 3 August 2026 tarihinde fiyatlandırma sayfasından alınan Anthropic tarafından yayımlanmış liste fiyatlarıdır. API model kimliği claude-fable-5 şeklindedir. Model, 9 June 2026 tarihinde Claude API, Amazon Bedrock, AWS üzerindeki Claude Platform, Google Cloud ve Microsoft Foundry üzerinde genel kullanıma sunulmuştur.
The data behind this chart
[
{
"label": "Claude Fable 5",
"input": "10",
"output": "50",
"cache_read": "1",
"batch_input": "5",
"batch_output": "25"
},
{
"label": "Claude Opus 5",
"input": "5",
"output": "25",
"cache_read": "0.50",
"batch_input": "2.50",
"batch_output": "12.50"
},
{
"label": "Claude Sonnet 5 (intro rate)",
"input": "2",
"output": "10",
"cache_read": "0.20",
"batch_input": "1",
"batch_output": "5"
},
{
"label": "Claude Sonnet 5 (from 1 Sep)",
"input": "3",
"output": "15",
"cache_read": "0.30",
"batch_input": "1.50",
"batch_output": "7.50"
},
{
"label": "Claude Haiku 4.5",
"input": "1",
"output": "5",
"cache_read": "0.10",
"batch_input": "0.50",
"batch_output": "2.50"
}
]Bu fiyatları bir basamaklandırma olarak değerlendirilmelidir. Fable 5'in liste fiyatı Claude Opus 5'in iki katı, mevcut Claude Sonnet 5 fiyatının beş katı ve Claude Haiku 4.5'in on katıdır. Her model, çıkış token'larını kendi giriş token'ı fiyatının tam beş katı üzerinden fiyatlandırdığı için bu oran faturanın her iki tarafında da aynıdır. Bu nedenle bir işin giriş ve çıkış token dağılımı biliniyorsa, bir fiyat diğerine çarpma yoluyla dönüştürülebilir.
Bir tarih aritmetiği değiştirir. Sonnet 5 için 31 August 2026 tarihine kadar milyon token başına $2 ve $10 tutarında tanıtım fiyatı uygulanır. 1 September 2026 tarihinden itibaren liste fiyatı $3 ve $15 olur. Fable 5'in kendi fiyatı değişmez. Bu nedenle iki model arasındaki fark, o gün beş kattan biraz fazla seviyeden üç katın biraz üzerine iner. Sonbahar için bütçe hazırlanıyorsa sonraki Sonnet fiyatları kullanılmalıdır.
İndirimler ve ters yönde çalışan tek çarpan
Prompt caching en büyük tasarruf kalemidir. Cache read işlemi, temel input fiyatının onda birine mal olur. Fable 5 için bu fiyat milyon token başına $1 değerindedir. Cache yazma işlemi ise normal bir input token'dan daha pahalıdır: beş dakikalık cache için temel fiyatın 1.25 katı, bir saatlik cache için 2 katı uygulanır. Beş dakikalık cache tek bir okumadan sonra, bir saatlik cache ise iki okumadan sonra maliyetini karşılar. Bu hesap, her yerde etkinleştirmeden önce prompt caching için başabaş noktasının belirlenmesinin neden gerekli olduğunu açıklar.
Batch API her iki tarafta da 50% indirim sağlar. Bu nedenle toplu Fable 5 işlemlerinde milyon token başına $5 input ve $25 output ücreti uygulanır. Batch istekleri asenkron olduğundan bu özellik yalnızca yanıtın hemen alınmasının gerekmediği işlemlerde fayda sağlar. İki indirim birlikte uygulanır. Böylece cache kullanılan ve toplu yürütülen bir iş, hem input hem de output tarafında düşük maliyetli olur.
1M token context window, Claude 4.6 ve sonraki modellerde standart fiyatlara dahildir. Uzun context için ek ücret alınmaz. Bu nedenle 900k token içeren bir istek, token başına 9k token içeren bir istekle aynı tarifeden ücretlendirilir.
Faturayı artıran çarpan data residency ayarıdır. Çıkarım işlemlerini United States içinde tutmak için inference_geo: "us" ayarlandığında, cache read ve cache write dahil her token kategorisine 1.1 kat çarpan uygulanır. Bir sözleşme bunu gerektirmediği sürece varsayılan global yönlendirmeyi kullanmaya devam edin.
Bu modele özgü bir faturalandırma kuralı vardır. Fable 5, bir isteği reddedebilen safety classifier bileşenleriyle birlikte gelir. Böyle bir durumda Messages API, hata yerine başarılı bir HTTP 200 yanıtı olarak stop_reason: "refusal" değerini döndürür. Herhangi bir output üretilmeden önce reddedilen istekler için ücret alınmaz. Aynı prompt başka bir Claude modeli üzerinde yeniden denenirse fallback credit, model değişikliğinin prompt cache maliyetini iade eder. Böylece aynı cache'i iki kez ısıtmak için ücret ödemezsiniz.
Claude Fable 5 hangi planlarda sunuluyor?
3 Ağustos 2026 itibarıyla Anthropic'in Claude Fable sayfasında modelin Pro, Max, Team ve Enterprise kullanıcılarına sunulduğu belirtiliyor. Free planın adı geçmiyor. Geliştiriciler için model, Claude API üzerinde ve yukarıda listelenen cloud marketplace'lerde genel kullanıma açık.
Bir planda sunulması, sınırsız olarak dahil olduğu anlamına gelmez. Anthropic'in pricing sayfasındaki plan karşılaştırma tablosunda Fable, bazı seat türlerinde haftalık kullanım limitlerinin belirli bir payıyla, bazılarında ise usage credit'leriyle sınırlandırılıyor. Bu düzenleme Temmuz 2026 boyunca birden fazla kez değişti. Anthropic'in Fable 5'i yeniden kullanıma sunma açıklamasında, Pro, Max, Team ve belirli Enterprise planlarında 7 Temmuz 2026 tarihine kadar haftalık kullanım limitinin en fazla %50'si dahil edildi; bu tarihten sonra usage credit'leri uygulanmaya başladı. Temmuzun geri kalanındaki haberlerde daha fazla uzatma ve seat türleri arasında ayrım yapıldığı bildirildi.
Bu nedenle bu sayfada plan başına bir limit verilmeyecek. O ay yayımlanan hiçbir rakam iki hafta boyunca geçerli kalmadı. Burada eski bir rakam vermek, hiç rakam vermemekten daha yanıltıcı olur. Karar verdiğiniz gün plan karşılaştırma tablosunda Fable etiketli satırı açın. Bir haber makalesindeki rakamı güncel değilmiş gibi değerlendirin.
Sabit kalan unsur API rate bilgisidir. Her route üzerinde dahil edilen kullanım hakkı tükendiğinde, sonraki Fable 5 kullanımı yukarıdaki chart'ta belirtilen fiyatlar üzerinden ücretlendirilir. Bu nedenle her iki durumda da planlama yapılacak temel değer price list'tir. Aynı sonuca, diğer Claude modellerinde olduğu gibi API faturalandırmasını abonelikle karşılaştırırken de ulaşırsınız. Henüz bir tier seçmediyseniz kullanımınıza uygun Claude planından başlayın.
Fiyat oranının gösterdiğinden daha yüksek fatura oluşmasının nedeni
Belgelenmiş iki mekanizma, Fable 5 maliyetinin doğrudan fiyat karşılaştırmasının gösterdiğinden daha yüksek olmasına neden olur.
İlki tokenizer'dır. Fable 5, Claude Opus 4.7 ile sunulan tokenizer'ı kullanır. Opus 4.7'den önce yayımlanan modellerle karşılaştırıldığında aynı metin yaklaşık 30% daha fazla token üretir. Kesin artış içeriğe bağlıdır. Haiku 4.5 bu tokenizer'dan önce yayımlandığı için fiyat listesindeki on katlık fark, her iki modele de aynı metin bloğu verildiğinde yaklaşık on üç kata çıkar. Sonnet 5 yeni tokenizer'ı kullanır. Bu nedenle Fable ile Sonnet arasındaki token başına karşılaştırma adildir. Fable ile Haiku arasındaki karşılaştırma adil değildir.
İkincisi thinking özelliğidir. Adaptive thinking, Fable 5 için her zaman açıktır ve thinking: {"type": "disabled"} desteklenmez. Thinking token'ları tam output oranı üzerinden output token'ı olarak ücretlendirilir. Ham chain of thought bu modelde hiçbir zaman döndürülmez. thinking.display değeri varsayılan olarak "omitted" olur. Bu nedenle kısa görünen bir yanıt, yüksek sayıda ücretlendirilen output token içerebilir. Anthropic belgelerinde bu durum açıkça belirtilir: ücretlendirilen output token sayısı, yanıtta görünen token sayısıyla eşleşmez.
Tahmin yürütmek yerine dökümü inceleyin. usage.output_tokens_details.thinking_tokens alanı, ücretlendirilen output token'larının kaç tanesinin reasoning için kullanıldığını bildirir:
{
"usage": {
"input_tokens": 25,
"output_tokens": 348,
"output_tokens_details": {
"thinking_tokens": 312
}
}
}Anthropic'in thinking belgelerinden alınan bu örnekte, ücretlendirilen 348 output token'ın 312'si kimsenin görmediği reasoning içeriğidir. Streaming kullanıldığında bu döküm yalnızca son message_delta event'inde gelir. Bu nedenle son text chunk'ında okumayı bırakan bir client bu bilgiyi hiçbir zaman kaydetmez.
Denetim effort değeridir. Bu değer output_config.effort konumunda ayarlanır ve low, medium, high (varsayılan), xhigh ve max seviyelerine sahiptir.
{
"model": "claude-fable-5",
"max_tokens": 32000,
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "..." }]
}Anthropic'in bu model için önerisi high seviyesinde başlamaktır. Yalnızca capability hassasiyetinin en yüksek olduğu işler için xhigh seviyesine çıkılmalıdır. Rutin işler için medium veya low seviyesine inilmelidir. Bunun nedeni, Fable 5 üzerinde daha düşük effort seviyesinin çoğu zaman önceki modellerdeki xhigh değerinden daha iyi sonuç vermesidir. Bununla ilgili iki tuzak vardır. İstekler arasında effort seviyesinin değiştirilmesi prompt cache'i geçersiz kılar. Çünkü çözümlenen effort değeri prompt içine yazılır. Bu nedenle her iş yükü için bir seviye seçilmeli ve sabit tutulmalıdır. Ayrıca max_tokens, thinking ve response text birlikte olmak üzere toplam output için uygulanan kesin bir üst sınırdır. Bu nedenle thinking içermeyen bir yanıt için belirlenen sınır, yanıtın kesilmesine neden olabilir. stop_reason: "max_tokens" görülüyorsa sınır yükseltilmeli veya effort seviyesi düşürülmelidir.
Tamamlanan görev başına maliyet, token başına maliyet değil
The data behind this chart
[
{
"label": "Short answer (5k in, 1k out)",
"fable_5": "0.10",
"opus_5": "0.05",
"sonnet_5": "0.02",
"haiku_4_5": "0.01"
},
{
"label": "Coding session (300k in, 40k out)",
"fable_5": "5.00",
"opus_5": "2.50",
"sonnet_5": "1.00",
"haiku_4_5": "0.50"
},
{
"label": "Long agent run (2M in, 400k out)",
"fable_5": "40.00",
"opus_5": "20.00",
"sonnet_5": "8.00",
"haiku_4_5": "4.00"
}
]Bu 3 satır bir benchmark değildir; aritmetik hesaplamadır. Oranlar yayımlanmıştır. Token hacimleri varsayımdır; bunları kendi kullanım verilerinizden elde ettiğiniz rakamlarla değiştirmelisiniz. Orta satırdaki çalışmaya benzeyen bir kodlama oturumu Fable 5 üzerinde $5.00, Sonnet 5 üzerinde ise $1.00 tutar. Uzun çalışma için maliyetler sırasıyla $40.00 ve $8.00 olur. Son satırdaki Haiku sütunu yalnızca aritmetik amaçlıdır: Haiku 4.5, 200k token bağlam penceresine sahiptir; bu nedenle bu işi hiçbir şekilde barındıramaz.
Token başına maliyet, karar vermek için yanlış ölçü birimidir. Tamamlanan görev başına maliyet, deneme başına maliyetin deneme sayısıyla çarpılmasıdır. Bugünkü oranlarda bir Fable 5 denemesi, beş Sonnet 5 denemesiyle aynı maliyete sahiptir. Bu nedenle yalnızca yeniden deneme sayısı, yükseltmeyi neredeyse hiçbir zaman haklı çıkarmaz. Ucuz yolun token maliyetinde dezavantajlı hale gelmesi için Sonnet'in beş denemenin dördünden fazlasında başarısız olması gerekir.
Yükseltmeyi haklı çıkaran unsur, token faturasının dışında kalan her şeydir. Grafikteki iki uzun çalışma arasındaki maliyet farkı, çoğu pazarda bir saatlik mühendislik çalışmasının maliyetinden daha düşüktür. Daha pahalı model inceleme süresinden bir saat tasarruf sağlarsa veya sonradan düzeltmeniz gereken hatalı bir migration işlemini önlerse, tasarruf faturada görünmese bile maliyetini karşılamış olur. Karşılaştırmayı kabul edilen sonuç başına maliyet üzerinden yapın ve toplam maliyete kendi zamanınızı da dahil edin. Bir milyon tokenın gerçekte ne satın aldığını bilmek bu tahmini çok daha somut hale getirir.
Claude Fable 5'in ücretini karşılamasını sağlayan üç iş
Yanlış bir dönüşün maliyetinin yüksek olduğu, uzun süre çalışan agent görevleri. Fable 5, saatlerle ölçülen işler için tasarlanmıştır: 1M token bağlam penceresi, istek başına en fazla 128k çıktı token'ı ve milyonlarca token bütçesiyle otuz dakikadan uzun süren görevleri hedefleyen xhigh effort level sunar. Bir agent'ın 40. adımda yanlış dala ilerlemesini ve bunu kimsenin 300. adıma kadar fark etmemesini takiben gereken temizleme çalışmasını da hesaba katın.
Büyük bir codebase genelinde bir kez çalıştırılan migration veya audit. Tek seferlik işlerde maliyeti dağıtacak bir işlem hacmi bulunmaz. Bu nedenle token başına ek ücret tek bir faturaya yansır ve işin tamamı tek bir context window içine sığabilir. İş asynchronous olarak çalıştırılabiliyorsa Batch API, bir milyon output token başına ücreti $25 seviyesine indirir.
Daha ucuz bir modelin zaten iki kez başarısız olduğu görev. İki başarısız deneme ve debugging için harcadığınız süre, yukarıdaki grafikteki hacimlerde tek bir Fable denemesinden daha pahalıya mal olur. Bir üst modele geçmek daha ucuz seçenektir; model ladder bunun için kullanılır. Genel olarak hâlâ tier'lar arasında seçim yapıyorsanız, Claude model tier'ları arasındaki capability karşılaştırması bu sayfadan farklı bir soruyu yanıtlar.
Sonnet 5 veya Haiku 4.5'ın doğru tercih olduğu üç iş
Yüksek hacimli sınıflandırma ve veri çıkarma. Bu işler throughput ve birim maliyet üzerinden değerlendirilir. Kalite tavanı, ucuz bir modelin bu seviyeye ulaşabileceği kadar düşüktür. Haiku 4.5'ın doğru biçimde tamamladığı bir görev için on kat fazla ödeme yapıldığında Fable 5, ölçülebilir bir katkı sağlamaz.
Gecikmenin ürünün kendisi olduğu etkileşimli işler. Anthropic'in model tablosunda Fable 5 için karşılaştırmalı gecikme süresi daha yüksek gösterilir ve thinking devre dışı bırakılamaz. Chat kutusu veya editör tamamlama özelliği, daha yetenekli modelde daha kötü bir deneyim sunar. Bunun nedeni, kullanıcıların kaliteyi fark etmeden önce bekleme süresini fark etmesidir.
January 2026 sonrasındaki olaylara bağlı her şey. Fable 5'ın güvenilir bilgi kesim tarihi January 2026'dır. Opus 5'ınki ise May 2026'dır. Daha pahalı model daha güncel değildir. Bu nedenle güncellik gerektiren sorularda search veya fetch araçları sağlanmadığı sürece daha eski bilgi için iki kat ödeme yapılır.
Bir kısıt maliyetten tamamen bağımsızdır. Fable 5, 30 günlük veri saklama süresi uygular ve zero data retention kapsamında kullanılamaz. Bunun nedeni Covered Model olarak sınıflandırılmasıdır. Sözleşme zero retention gerektiriyorsa Fable 5 hiçbir fiyata seçenek değildir. İndirim yapılması da bu durumu değiştirmez.
Fable-method depolarının gösterdikleri ve göstermedikleri
Uygulamacılar, Fable 5 yaklaşımlarının nasıl işlediğini daha düşük maliyetli bir modelin uygulayabileceği becerilere indirgeyen depolar yayımladı. fable-method repo, bir düşünme becerisini, bir orkestrasyon döngüsünü ve her iddia edilen denetimi aracının kendi raporunu okumak yerine yeniden çalıştıran karşıt doğrulayıcıyı açıklar. README dosyasında bu durum doğrudan belirtilir: "Bu bir topluluk damıtmasıdır; Anthropic ürünü değildir."
Bunu tam olarak bu şekilde değerlendirmek gerekir. Bu depo, insanların modeli nasıl yönlendirdiğini gösteren bir kanıttır; modelin nasıl çalıştığına ilişkin bir dokümantasyon değildir. İçindeki hiçbir bilgi Anthropic tarafından doğrulanmamıştır. Ayrıca farklı ifadeler kullanan, neredeyse aynı birkaç fork bulunmaktadır. Bu durum, bir spesifikasyondan çok sözlü aktarımdan beklenir.
Maliyet kararı açısından alınması gereken sinyal, insanların kopyalamaya değer bulduğu bölümlerin prosedürel olmasıdır. Görevi sınıflandırın, tamamlandığını kanıtlayan denetimi tanımlayın, karar vermeden önce kanıt toplayın ve ardından bir özeti okumak yerine gözlem yoluyla doğrulama yapın. Daha düşük maliyetli bir modele açık bir kontrol listesi ve doğrulama adımı verildiğinde aradaki farkın bir bölümü kapanır. Bu nedenle pahalı modeli standartlaştırmadan önce bu deneyi kendi değerlendirme kümeniz üzerinde çalıştırın. Sonuç görevlerinize bağlıdır. Bu nedenle başkasının elde ettiği sayı sizin için fazla anlam taşımaz.
Bütçe ayırmadan önce kendi rakamlarınızı kontrol edin
- Her yanıtta
usagedeğerini okuyun veoutput_tokens_details.thinking_tokensdeğerini görünen çıktıdan ayrı olarak kaydedin. Görmediğiniz akıl yürütme, beklenmedik maliyet kalemidir. - Varsayılan değeri kabul etmek yerine
effortdeğerini açıkça belirleyin. Prompt caching kullanan konuşmalarda bu değeri sabit tutun. - Önce sabit prefix'inizi bir cache breakpoint sonrasına yerleştirin. Temel input fiyatının onda biri üzerinden yapılan bir cache okuması, çoğu model düşürme işleminden daha fazla tasarruf sağlar.
- Anında yanıt gerektirmeyen işlemleri Batch API'ye taşıyın.
- Alternatifin maliyetini gerçekçi biçimde hesaplayın. Kendi iş yükünüz için Claude ve ChatGPT API fiyatlarını karşılaştırmak, uzun vadeli bir taahhütte bulunmadan önce bir öğleden sonrayı ayırmaya değer.
İş yükü kendi sunucunuzda çalışan bir agent ise en önemli denetimler model seçiminden bağımsızdır. VPS üzerinde agent maliyetlerini kontrol altında tutma, kontrolden çıkan bir oturumu durduran döngü sınırlarını ve harcama üst sınırlarını açıklar. Claude Code token'ları gerçekte nerede harcıyor, kullanım panonuzda göreceğiniz rakamları açıklar.
FAQ
Claude Fable 5'in milyon token başına maliyeti nedir?
Claude Fable 5, Claude API üzerinde milyon input token başına $10 ve milyon output token başına $50 fiyatıyla sunulmaktadır. Bu bilgiler, Anthropic'in fiyatlandırma sayfası 3 August 2026 tarihinde kontrol edilerek alınmıştır. Cache read işlemi milyon token başına $1 tutarındadır ve temel input ücretinin onda biridir. Batch API her iki taraf için de %50 indirim uygular. Böylece asenkron işlemlerde milyon token başına $5 ve $25 ücretleri geçerlidir. Inference işleminin inference_geo parametresiyle Amerika Birleşik Devletleri içinde tutulması, her kategoriye 1.1 kat çarpan ekler.
Claude Fable 5, Claude Pro aboneliğine dahil midir?
Anthropic'in Claude Fable sayfasında modelin Pro, Max, Team ve Enterprise kullanıcılarına sunulduğu belirtilir. Ücretsiz plandan söz edilmez. Dahil erişim sınırsız değildir. Bazı kullanıcılar Fable'a haftalık kullanım limitlerinden ayrılan bir pay üzerinden, bazıları ise kullanım kredileri üzerinden erişir. Bu düzenleme July 2026 boyunca birden fazla kez değişmiştir. Karar verdiğiniz gün Anthropic'in fiyatlandırma sayfasındaki plan karşılaştırma tablosunda Fable olarak etiketlenmiş satırı okuyun. Bir makaledeki rakama güvenmeyin. Dahil kullanım kotası tükendiğinde sonraki kullanım API ücretlendirmesine göre faturalandırılır.
Claude Fable 5 faturam neden görünen output miktarından daha yüksek?
Claude Fable 5 için Adaptive thinking her zaman açıktır. Thinking token'ları output token olarak ücretlendirilir. Ham chain of thought hiçbir zaman döndürülmez. thinking.display varsayılan olarak omitted olduğunda boş bir thinking alanı görürsünüz. Buna rağmen arka plandaki tüm reasoning token'ları için ücret ödersiniz. Yanıttaki dağılımı görmek için usage.output_tokens_details.thinking_tokens alanını okuyun. Streaming kullanıldığında bu alan yalnızca son message_delta event içinde gelir. Reasoning ile yanıt arasındaki oran görev için gerekenden yüksekse effort seviyesini düşürün.
Claude Fable 5 mi, yoksa Claude Opus 5 mi kullanılmalı?
Claude Opus 5 token başına yarı fiyatındadır ve Fable 5'in January 2026 tarihine karşılık daha güncel ve güvenilir bir bilgi kesim tarihine, May 2026'ya sahiptir. Önce Opus 5 ile başlayın. Görev burada başarısız olduğunda veya yanlış yanıtın maliyeti fiyat farkından yüksek olduğunda Fable 5'e geçin. Fable 5, hatalı bir dalın saatlerce cleanup gerektirdiği uzun ufuklu agent işlemleri için doğru tercihtir. Ayrıca premium ücretin her isteğe sürekli yansımak yerine tek bir faturada oluştuğu tek seferlik işler için de uygundur.