Hangi Claude modelini seçmeliyim? Güncel maliyet rehberi
Claude Opus 4.8, Sonnet 5 ve Haiku 4.5 modelleri arasındaki fiyat farklarını inceleyin. 100.000 işlem üzerinden yapılan maliyet karşılaştırması ve faturaları etkileyen ayarlar.
Hangi Claude modelini kullanmalıyım?
Hangi Claude modelini kullanmanız gerektiğine dair kısa cevap şudur: Claude Opus 4.8 ile başlayın ve ancak somut bir gerekçeniz olduğunda başka bir modele geçin. Anthropic'in yönlendirmesi de aynı doğrultudadır: "Hangi modeli kullanacağınızdan emin değilseniz, karmaşık aracı tabanlı kodlama ve kurumsal işler için Claude Opus 4.8 ile başlayın." Görev iyi tanımlanmışsa ve günde birçok kez çalıştırıyorsanız Claude Sonnet 5 modeline geçin. Doğru cevabın neye benzediğini bildiğiniz mekanik ve yüksek hacimli işler için ise Claude Haiku 4.5 modeline inin. Claude Fable 5, uzun süreli çalışan aracılar için bunların hepsinin üzerinde yer alır.
Bu seçimin bir maliyeti vardır. 23 Temmuz 2026 itibarıyla Claude API (uygulama programlama arayüzü) fiyatları, dokümantasyonda MTok olarak belirtilen milyon token başına şu şekildedir:
- Claude Fable 5 (
claude-fable-5): Giriş 10$, çıkış 50$ / MTok. 1M bağlam. - Claude Opus 4.8 (
claude-opus-4-8): Giriş 5$, çıkış 25$ / MTok. 1M bağlam. - Claude Opus 4.7 (
claude-opus-4-7): Giriş 5$, çıkış 25$ / MTok. 1M bağlam. - Claude Sonnet 5 (
claude-sonnet-5): 31 Ağustos 2026'ya kadar tanıtım fiyatı ile giriş 2$, çıkış 10$. Standart fiyat olan giriş 3$, çıkış 15$ ise 1 Eylül 2026'da yürürlüğe girer. 1M bağlam. - Claude Haiku 4.5 (
claude-haiku-4-5): Giriş 1$, çıkış 5$ / MTok. 200K bağlam.
Bu tanımlayıcılar yazıldığı şekliyle tamdır. Sonlarına herhangi bir ekleme yapılmaz.
1M-token modellerinde istek boyutuna ek bir ücret uygulanmaz: "900k-token bir istek, 9k-token bir istekle aynı token başı ücret üzerinden faturalandırılır." Bu ücretler API ile sınırlı değildir; çünkü Claude Enterprise, koltuk ücretine ek olarak kullanımı API ücretleri üzerinden ölçer. Bu nedenle aşağıdaki hesaplama, seat plan kullanan bir ekip için de aynıdır. Sabit ücretli abonelik ölçüm yöntemini değiştirir, ancak bu kararı değiştirmez; çünkü her iki Claude Max katmanı da aynı modelleri içerir ve yalnızca kullanım miktarı bakımından farklıdır. Aynı basamakta daha aşağıda, Claude Pro'nun aylık $20 ücreti token başı bir oran yerine bir kullanım kotası sağlar; bu nedenle burada sizi durduran şey fatura değil, limitin yenilenmesidir. Şu anda bu plandaysanız, aşağıdaki hesaplamalara geçmeden önce hangi kullanım penceresini beklediğinizi belirlemek gerekir; çünkü çözüm daha düşük bir oran değil, daha küçük bir model, daha küçük bir context veya API'ye geçiştir. Henüz ödeme yapmaya başlamadıysanız, ilk etapta Pro'nun $20 değerinde olup olmadığı yukarıdaki oranlara göre değil, ücretsiz limitin sizi ne sıklıkla durdurduğuna göre belirlenir.
Her modelin asıl kullanım amacı
Anthropic, ürün gamını her model için tek bir satırla tanımlar ve bu tanımlar herhangi bir liderlik tablosundan daha iyi yol gösterir.
- Claude Fable 5: "Uzun süreli çalışan ajanlar için yeni nesil zeka." Dört model arasında gecikme süresi açısından en yavaş olanı olarak derecelendirilmiştir.
- Claude Opus 4.8: "Karmaşık ajan tabanlı kodlama ve kurumsal işler için." Orta düzey gecikme süresi.
- Claude Sonnet 5: "Hız ve zekanın en iyi kombinasyonu." Hızlı.
- Claude Haiku 4.5: "Sınır seviyesine yakın zekaya sahip en hızlı model."
Fable 5, bu karşılaştırmada hiçbir iş yükü için fiyatlandırılmayan tek modeldir ve Opus 4.8 oranının iki katı maliyetle, hangi işlerin 10 dolar girdi ve 50 dolar çıktı değerinde olduğu sorusu kendi başına bir yanıt gerektirir.
Haiku 4.5 ayrıca, fiyattan önce işe uygunluğunu belirleyen sınırlamalara sahiptir. Bağlam penceresi 1M yerine 200K token'dır; bu nedenle büyük bir depo veya uzun bir ajan dökümü sığmayacaktır. Senkron Messages API üzerindeki maksimum çıktı kapasitesi diğerlerinde
Gerçek bir iş yükünde bu seçimin maliyeti nedir?
Ürün grubundaki her model, çıktı ücretini girdi oranının beş katı olarak fiyatlandırır. Opus 4.8 için girdi 5 dolar, çıktı 25 dolardır. Haiku 4.5 için girdi 1 dolar, çıktı 5 dolardır. Bu oran tüm seri boyunca korunduğu için, seçiminiz en çok yüksek miktarda çıktı üreten işlerde önem kazanır.
Ajan tabanlı (agentic) işler bu tür işlerdendir; çünkü düşünme token'ları çıktı token'ı olarak faturalandırılır ve metin size ulaşmasa bile max_tokens dahilinde sayılır. Fable 5, Opus 4.8, Opus 4.7 ve Sonnet 5 modellerinde düşünme özeti varsayılan olarak gizlenir, bu nedenle thinking alanı boş döner. Faturalandırma değişmez: "Her iki durumda da blok aynı şekilde faturalandırılır ve çok turlu konuşmalarda aynı şekilde geri iletilir." Claude token faturasını gerçekte ne oluşturur bu sayacı tüm detaylarıyla inceler.
Düşünme sürecinin çalışıp çalışmadığı, karşılaştırdığınız modellere göre değişiklik gösterir; bu durumu gözden kaçırırsanız maliyet testiniz hatalı sonuçlanır. Sonnet 5 ve Fable 5 modellerinde düşünme özelliği zaten açıktır ve herhangi bir yapılandırma gerektirmez. Opus 4.8 ve Opus 4.7 modellerinde ise siz thinking: {type: "adaptive"} ayarını yapana kadar bu özellik kapalıdır. Rakamları yorumlamadan önce her iki taraftaki yapılandırmanın eşleştiğinden emin olun.
En ucuz model neden en pahalısı olabilir
Kendi içinde tutarlı bir kodlama görevi ele alalım. İstek 60,000 token bağlam içeriyor ve model, düşünme süreci dahil 8,000 token çıktı üretiyor. Önbellekleme (caching) kullanılmadığı için aritmetik işlem görünür kalıyor.
Opus 4.8 üzerinde: 5 dolar birim fiyatla 0.06 MTok girdi 0.30 dolar, 25 dolar birim fiyatla 0.008 MTok çıktı ise 0.20 dolar tutar. Deneme toplamda 0.50 dolara mal olur. Haiku 4.5 üzerinde aynı deneme 0.06 dolar artı 0.04 dolar ile 0.10 dolara gelir.
Haiku deneme başına beş kat daha ucuzdur; bu da başarısız bir denemenin neye yol açtığını görene kadar büyük bir tasarruf alanı gibi görünür. Yanlış cevabı okursunuz, bu da zamanınıza mal olur. Yanlış cevabı tekrar denemede bağlam olarak geri gönderirsiniz, dolayısıyla her deneme bir öncekinden daha büyük olur. Üçüncü deneme de başarısız olduğunda yine de bir üst modele geçersiniz: 0.30 dolarlık Haiku artı 0.50 dolarlık Opus toplamda 0.80 dolar eder; bu da Opus'u tek seferde çalıştırmaktan %60 daha pahalıdır.
Bu durumda belirleyici soru, cevabı ne kadar ucuza kontrol edebildiğinizdir. Yanlış bir cevap bir saniyede bariz bir şekilde anlaşılabiliyorsa, küçük model bir kazançtır. Ancak bir hatayı tespit etmek, bir diff dosyasını dikkatlice incelemeyi gerektiriyorsa, küçük model size faturada asla görünmeyen bir zaman maliyeti yükler.
Daha küçük bir modelin kesinlikle üstün olduğu durumlar
Aşağıdaki durumlarda en doğru seçenek Haiku 4.5 modelidir:
- Mekanik alt temsilci (subagent) işleri. Dosyaları yeniden adlandıran veya arama sonuçlarını toplayan bir alt temsilcinin, sınırları zorlayan bir muhakeme yeteneğine ihtiyacı yoktur. Claude ile bir yapay zeka temsilcisi oluşturduğunuzda ve ona yardımcılar atadığınızda standart model budur.
- Günlük (log) triyajı. Bir satırın gürültü mü yoksa insan müdahalesine değer mi olduğuna karar vermek, belirgin bir hata modu olan dar kapsamlı bir yargıdır.
- Sabit bir etiket kümesine göre sınıflandırma. Çıktı kısadır ve doğruluk payı bir örneklem üzerinde ölçülebilir.
- Yüksek hacimli üretim çağrıları. Günde 100.000 çalıştırma yapıldığında, token başına maliyet farkı ihmal edilebilir bir hata payı olmaktan çıkar. Bu, n8n'e entegre edilmiş yapay zeka iş akışlarının genel yapısıdır.
- Yanıt hızının kullanıcı için önemli olduğu her durum. Haiku 4.5, ürün ailesindeki en hızlı model olarak derecelendirilmiştir.
Haiku'ya özgü bir sınırlama mevcuttur. Opus 4.8 ve Sonnet 5 modellerinde 1.024 token olan minimum önbelleğe alınabilir istem boyutu, Haiku'da 4.096 tokendır. Bu minimum değerin altında "bu sayıdan daha az token önbelleğe alma istekleri, önbelleğe alınmadan işlenir ve herhangi bir hata döndürülmez". Sonnet 5 üzerinde önbelleğe alınan 1.500 tokenlık bir talimat bloğu, Haiku 4.5 üzerinde sessizce önbelleğe alınmaz. Bunun göstergesi, her zaman açık bir temsilcinin maliyetlerini düşük tutma yöntemleri ve önbellek kaybına yol açan diğer durumlarla birlikte ele alınan, cache_creation_input_tokens ve cache_read_input_tokens değerlerinin her ikisinin de sıfır olmasıdır.
Yanıtı değiştiren kaldıraçlar
Bunların her biri, bir faturayı model adının değiştirebileceğinden daha fazla etkiler.
Efor (Effort). output_config.effort, modelin yanıt vermeden önce ne kadar çalışma yapacağını kontrol eder. Seviyeler low, medium, high, xhigh ve max şeklindedir; high varsayılan değerdir: "effort parametresini high olarak ayarlamak, effort parametresini tamamen atlamakla tam olarak aynı davranışı üretir." Bu parametre, isteğin en üst seviyesinde yer almak yerine output_config içinde yuvalanır:
response = client.messages.create(
model="claude-sonnet-5",
max_tokens=4096,
output_config={"effort": "medium"},
messages=messages,
)Efor, yanıttaki her bir token'a dokunur: "Araç çağrıları dahil olmak üzere tüm token harcamasını etkileyebilir. Örneğin, daha düşük efor, Claude'un daha az araç çağrısı yapması anlamına gelir." Bu durum, bir aracı döngüsünde (agentic loop) katlanarak artar. Bu bir token sınırı değildir: "Efor, davranışsal bir sinyaldir, katı bir token bütçesi değildir." Anthropic, seviye başına bir maliyet çarpanı yayınlamaz ve kendi kullanım durumunuzu test etmenizi önerir; bu nedenle high seviyesinde bir Sonnet 5 çalışması ile low seviyesinde bir Opus 4.8 çalışmasını karşılaştırmak, bu öğleden sonra yapabileceğiniz gerçek bir kıyaslamadır. Haiku 4.5, eforu destekleyen modeller listesinde yer almamaktadır.
Prompt önbelleğe alma (Prompt caching). Bir önbellek okuması, temel giriş ücretinin 0.1 katına mal olur ve model seçimini belirleyen sayı, bunun katmanlar genelinde ne yaptığıdır. Opus 4.8 üzerinde bir önbellek isabeti (cache hit) 1 MTok başına $0.50 maliyetindeyken, Haiku 4.5 üzerinde önbelleğe alınmamış giriş 1 MTok başına $1 maliyetindedir; bu nedenle iyi önbelleğe alınmış bir Opus öneki, soğuk bir Haiku isteminden giriş token'ı başına daha ucuzdur. Büyük ve sabit bir öneki tekrar gönderen her türlü iş yükünde oturum hijyeni, model seçiminden daha etkilidir.
Toplu işlemler (Batches). Yanıtın hemen gelmesi gerekmiyorsa, Message Batches API aynı modelleri "hem giriş hem de çıkış token'larında %50 indirimle" çalıştırır. Bu, aşağıdaki karşılaştırmanın her satırını yarıya indirir ve katmanlar genelinde çalışır: Toplu bir Opus 4.8 işi, 1 Eylül 2026 tarihinden itibaren standart fiyattan yapılan senkron bir Sonnet 5 işinden daha az maliyetlidir; aynı bütçeyle gecikme süresinden feragat edilerek yetenek artırılmış olur.
İş yükü maliyet karşılaştırması
İş yükü: 100.000 destek e-postasını sınıflandırmak; her çağrı için 2.000 girdi token'ı ve 300 çıktı token'ı. Bu, 200 MTok girdi ve 30 MTok çıktı anlamına gelir.
- Haiku 4.5: 200 x $1 = $200 girdi, 30 x $5 = $150 çıktı. Toplam $350.
- Sonnet 5, giriş fiyatı: 200 x $2 = $400 girdi, 30 x $10 = $300 çıktı. Toplam $700.
- Sonnet 5, 1 Eylül 2026'dan itibaren: 200 x $3 = $600 girdi, 30 x $15 = $450 çıktı. Toplam $1.050.
- Opus 4.8: 200 x $5 = $1.000 girdi, 30 x $25 = $750 çıktı. Toplam $1.750.
Yarınki fiyatlarla yeniden hesaplamak için dört sayıyı değiştirin. Aşağıdaki ayarlamalar, sonucu model isminin değiştirdiğinden daha fazla etkiler:
- Batching her satırı yarıya indirir: $175, $350, $525 ve $875. Gece yapılan sınıflandırma işlemlerinde bekleme süresi kritik olmadığından, bu yöntemi kullanmamak için bir neden yoktur.
- Paylaşılan öneki önbelleğe alma. 2.000 girdi token'ının 1.200'ünün her seferinde aynı talimat bloğu olduğunu varsayalım. Sonnet 5'in giriş fiyatı üzerinden, bu token'lar $2 / MTok yerine önbellek isabeti olarak $0,20 / MTok maliyetle işlenir; yani 120 MTok $240 yerine $24'a mal olur. Buna $2 fiyatından 80 MTok yeni girdi ($160) ve $300 çıktı maliyeti eklendiğinde, Sonnet 5 maliyeti $700 yerine yaklaşık $484 olur. Aynı yöntem Haiku 4.5 üzerinde işe yaramaz, çünkü 1.200 token, modelin 4.096 token'lık minimum sınırının altındadır.
- Yeniden denemeler. Haiku'nun yanıtlarını e-postaların %8'inde reddettiğinizi ve bunları Opus 4.8 üzerinde tekrar çalıştırdığınızı varsayalım. $350'ye 0,08 x $1.750 = $140 eklenir ve sonuç $490 olur. Benim oranlarımı kullanmak yerine kendi ret oranınızı ölçün.
- İşlem araç tanımları. Bu araçların oluşturduğu sistem istemi,
tool_choicedeğeriautoolarak ayarlandığında Opus 4.8 üzerinde 290 token, Sonnet 5 üzerinde 354 token ve Haiku 4.5 üzerinde 496 token'dır. En ucuz model, en yüksek sabit ek yükü taşır.
$490 maliyetli Haiku (yükseltme yolu ile) ve $484 maliyetli önbelleğe alınmış Sonnet 5 hemen hemen aynı maliyete sahiptir; ancak bunlardan biri işi tek geçişte tamamlar. Model seçimi, sorunun tamamı değildir.
Oturum ortasında model değiştirmek tasarruf sağlar mı?
Tasarruf token başına hesaplandığından ve riske attığınız şey tüm önbelleğe alınmış önek (prefix) olduğundan, bu durum etiket fiyatlarının düşündürdüğünden daha az sıklıkla gerçekleşir.
Anthropic, nelerin önbelleği geçersiz kıldığını belgeler. Önekler tools, ardından system ve son olarak messages sırasıyla oluşturulur; "her seviyedeki değişiklik, o seviyeyi ve sonraki tüm seviyeleri geçersiz kılar." İki istek ayarı da bu listededir: "Düşünme yapılandırması ve çözümlenmiş effort seviyesi doğrudan istemin içine işlenir, bu nedenle bunlardan herhangi birini değiştirmek yeni bir önbellek öneki başlatır." Dokümanlar çaba (effort) konusunda daha da ileri giderek şunu belirtir: "çaba ayarını, önbellek isabetine dayanan bir konuşma içinde değil, iş yükleri arasında değiştirin."
Model bu belgeli listede yer almaz, bu yüzden herhangi bir varsayımda bulunmayın. Bir geçişten sonraki ilk istekte cache_read_input_tokens değerini okuyun ve cevabı rakamların vermesine izin verin. 150.000 token'lık bir Opus 4.8 önekinde, bir önbellek okuması yaklaşık 0,08 dolar, yeni bir yazma işlemi ise yaklaşık 0,94 dolar maliyet üretir; bu da peşinde olduğunuz token başına farkın birkaç turundan daha fazladır.
Bu nedenle bu değişiklikleri bir konuşmanın içinde değil, görevler arasında yapın. Claude Code özelinde bu, önbelleğin zaten atılacağı bir aşama olan /clear komutunu, ardından /model veya /effort komutlarını kullanmak anlamına gelir. Bunların her ikisi de CLI üzerinden yazılır; bu nedenle Linux üzerinde çalışıyorsanız, Anthropic'in Linux için yerel olarak sunduğu çözüm, oturmuş bir CLI'yı hala beta aşamasında olan bir masaüstü uygulamasıyla eşleştirdiği için terminal sürümünü kurmaya değerdir. Değişikliğin faturaya yansıyıp yansımayacağı, o oturum için nasıl ödeme yaptığınıza bağlıdır; çünkü Claude Code ya sabit aylık plan ya da token başına API kredisi ile çalışır ve sadece ikincisinde model değişikliği dolar bazında fiyatlandırılır.
Kendi iş yükünüz üzerinde yanıtı nasıl test edersiniz
Bir istemi, farklı bir modelden alınan sayıya göre boyutlandırmayın. Token sayma uç noktası ücretsizdir ve belirttiğiniz modelin tokenizer'ını kullanır; bu nedenle kullanmayı planladığınız modeli belirtin. Bu uç nokta, platformun ücretlendirme yapmayan nadir bölümlerinden biridir ve ücret ödemeden başka neleri çalıştırabileceğiniz konusu, gerçek kredi harcamadan önce karşılaştırma yapmak için kontrol edilmeye değerdir. Opus 4.7 ve sonraki sürümler, Fable 5 ve Sonnet 5, "aynı metin için yaklaşık %30 daha fazla token üreten" daha yeni bir tokenizer kullanır; bu nedenle eski bir modelde ölçülen bütçe, token başına değişmeyen bir oranda yeni bir modelde düşük kalacaktır.
Ardından dönen yanıtı okuyun. input_tokens yalnızca önbelleğe alınmamış kısımdır, bu nedenle gerçek istem boyutu bu alan ile cache_creation_input_tokens ve cache_read_input_tokens toplamıdır. Bir VPS üzerinde ilk Claude API uygulaması, bu ölçümü yapmak için en küçük ve dürüst başlangıç noktasıdır; hangi Claude planının kullanımınıza uygun olduğu ise token başına ödeme yapıp yapmayacağınıza dair ayrı bir karardır. Eğer konu bir aboneliğe sahip olup olmamaktan ziyade hangi aboneliği tutacağınızla ilgiliyse, Claude'un ChatGPT ile kıyaslamalı fiyatlandırma katmanları, aynı kodlama işinin diğer sağlayıcının koltuklarında ne kadara mal olduğunu açıklar. Eğer ölçüm sonucunda işinizi kalıcı olarak API'ye taşırsanız, aboneliği bir alt katmana düşürmek veya tamamen iptal etmek, halihazırda ödemesini yaptığınız dönemi kullanmanıza engel olmaz; bu nedenle veriler netleştiğinde karar vermenin bir cezası yoktur.
FAQ
Kodlama için en iyi Claude modeli hangisidir?
Claude Opus 4.8, karmaşık ve ajan tabanlı kodlama süreçleri için Temmuz 2026 itibarıyla 1 milyon girdi token'ı başına 5 dolar ve 1 milyon çıktı token'ı başına 25 dolar maliyetle belgelenmiş başlangıç noktasıdır. Claude Sonnet 5, hız ve zekanın en iyi kombinasyonu olarak konumlandırılmıştır ve 31 Ağustos 2026 tarihine kadar 2 dolar / 10 dolar fiyatlandırmasıyla maliyeti yarıdan daha azdır. Aynı görevi her iki modelde de çalıştırın, düşünme (thinking) yapılandırmasını sabit tutun ve response.usage üzerinden toplam token harcamasını karşılaştırın.
Claude Haiku 4.5, Sonnet 5'in yerini alacak kadar ucuz mu?
Token başına bakıldığında evet: Tanıtım fiyatlandırmasında Sonnet 5 için 2 dolar / 10 dolar olan maliyet, Haiku 4.5 için 1 dolar / 5 dolardır; 1 Eylül 2026'dan itibaren ise bu oran 3 dolar / 15 dolar olacaktır. Kararı limitler belirler. Haiku 4.5, 1 milyon yerine 200 bin token'lık bir bağlam penceresine, senkron Messages API üzerinde 64 bin maksimum çıktı limitine, Şubat 2025 güvenilir bilgi kesim tarihine, output_config.effort desteğinin olmamasına ve kısa sistem istemlerinde önbelleğe almayı sessizce devre dışı bırakan 4.096 token'lık minimum önbelleklenebilir istem sınırına sahiptir.
Oturum ortasında daha ucuz bir Claude modeline geçmek tasarruf sağlar mı?
Göründüğünden daha az sıklıkla. Anthropic, önbellek geçersiz kılıcıları; tools, system veya messages önekindeki değişiklikler, düşünme yapılandırmasındaki değişiklikler ve output_config.effort içindeki değişiklikler olarak belgeler. Model değişikliğinin mevcut bir önbelleğe ne yaptığı belgelenmemiştir, bu nedenle durumu bilinmeyen olarak kabul edin ve sonrasındaki ilk istekte cache_read_input_tokens değerini okuyun. Risk değerini bilmek önemlidir: 150.000 token'lık bir Opus 4.8 öneki üzerinde önbellek okuması yaklaşık 0,08 dolara, yeni bir yazma işlemi ise yaklaşık 0,94 dolara mal olur; bu da token başına sağlanan birkaç turluk tasarruftan daha fazladır. Model değişikliğini görevler arasında veya Claude Code içinde /clear sonrasında, yani önbelleğin zaten atılacağı durumlarda yapın.
output_config.effort ayarı faturamı nasıl etkiler?
Bu ayar, modelin metin, araç çağrıları ve düşünme süreçleri genelinde kaç token harcayacağını değiştirir. Düşük çaba (effort) daha az araç çağrısı yapılmasına neden olur; bu durum ajan döngülerinde birikimli etki yaratır çünkü her araç sonucu sonraki turlarda tekrar gönderilir. Seviyeler low, medium, high, xhigh ve max şeklindedir ve varsayılan değer high'dir. Anthropic, çabayı bir token bütçesinden ziyade davranışsal bir sinyal olarak tanımladığı için seviye başına bir maliyet çarpanı yayınlamamaktadır; bu nedenle kendi göreviniz üzerinde ölçüm yapın.
Claude Batches API ne kadar tasarruf sağlar?
Asenkron teslimat karşılığında hem girdi hem de çıktı token'larında %50 tasarruf sağlar. Temmuz 2026 itibarıyla bu, Opus 4.8'i girdi için 2,50 dolar / çıktı için 12,50 dolar, Sonnet 5'i tanıtım fiyatlandırmasında 1 dolar / 5 dolar ve Haiku 4.5'i 0,50 dolar / 2,50 dolar seviyesine getirir. Dikkat edilmesi gereken karşılaştırma katmanlar arasındadır: Toplu (batched) bir Opus 4.8 işi, 1 Eylül 2026'dan itibaren standart tarifedeki senkron bir Sonnet 5 işinden daha ucuza mal olur; dolayısıyla toplu işlem, aynı paraya daha güçlü bir model kullanmanızı sağlar.