Claude API mı yoksa abonelik mi daha ucuz?
Token başına ücretler ile sabit plan maliyetlerini karşılaştırarak hangi kullanım hacminde API kullanmanın daha ekonomik olduğunu matematiksel olarak inceleyin.
Claude API, abonelikten daha mı ucuz?
Claude API, belirli bir kullanım hacminin altında abonelikten daha ucuz, bu hacmin üzerinde ise daha pahalıdır. Gün boyu etkileşimli kod yazan bir geliştirici için sabit plan genellikle daha avantajlıdır. Kendi çağrılarını yapan bir program için ise API tek seçenektir, bu yüzden maliyet belirleyici olmaz. Geri kalanı on dakikada yapabileceğiniz bir aritmetik işlemidir.
Aranabilecek resmi bir başabaş noktası sayısı yoktur. Abonelik tarafı, token miktarı yerine kullanım pencereleri olarak satılır; bu nedenle iki çizginin nerede kesiştiğini söyleyen yayınlanmış bir rakam yoktur. Aşağıda, mevcut token başına ücretler üzerinden hesaplanmış formül ve plan ücretinden çok daha fazla fark yaratan kullanım alışkanlıklarınız yer almaktadır. Aşağıdaki tüm başabaş noktaları, yayınlanmış oranlar ve belirtilen varsayımlardan benim yaptığım aritmetik işlemlerdir, belgelenmiş rakamlar değildir.
Hangi planı satın alacağınıza hala karar veremediyseniz, hangi Claude planının çalışma şeklinize uygun olduğu sorusunun cevabı buradadır. Bu yazı, hangi planı satın alacağınızı bildiğinizi ve aslında satın alıp almamaya karar vermek istediğinizi varsayar.
Aynı yapıda olmayan iki faturalandırma modeli
Abonelik, kullanmayabileceğiniz bir kapasitedir. Sabit bir ücret ödersiniz ve belirli bir takvime göre sıfırlanan bir kullanım hakkı alırsınız. Anthropic'in Claude Code dokümantasyonu, Team ve Enterprise oturumları için yapıyı şu şekilde belirtir: kullanım, Claude chat ve Cowork ile paylaşılan, "dönen beş saatlik bir pencere ve haftalık bir pencere üzerinde sıfırlanan oturum başına bir hak üzerinden çekilir". Bir abone, "Oturum limitinize ulaştınız" ve "Haftalık limitinize ulaştınız" mesajlarını gördüğü mesaj sayısı üzerinden aynı yapıyla karşılaşır. Kullanılmayan kapasite, yine de harcanmış paradır. Kapasiteyi aşmak, pencere sıfırlanana kadar çalışmanızı durdurur ve /model ile model değiştirmek erişimi geri getirmez, çünkü pencereler modeller arasında paylaşılır.
API, asla durmayan bir sayaçtır. Pencere veya duvar yoktur. Her istek token başına fiyatlandırılır ve bazı şeyler token dışında fiyatlandırılır: web araması "Claude API'de 1.000 arama başına 10$ olarak mevcuttur". Hiçbir şey bir limit ile durmaz. Fatura sadece büyür.
23 Temmuz 2026 itibarıyla, Claude fiyatlandırma sayfasından alınan plan ücretleri: Pro, "Yıllık abonelik indirimiyle aylık 17$ (peşin ödenen 200$). Aylık faturalandırmada 20$" şeklindedir ve Claude Code'u içerir. Max, "Aylık 100$'dan başlayan" olarak listelenmiştir. Team oturumları "Yıllık faturalandırmada oturum başına 20$/ay"dan başlar. Enterprise en ilginç olanıdır çünkü her iki modeli de aynı anda çalıştırır: "Oturum fiyatı + API oranlarında kullanım 20$/oturum". Ücretler sık değişir ve her birinin arkasındaki kullanım hakkı asla token cinsinden yayınlanmaz, bu nedenle karar verdiğiniz gün fiyatlandırma sayfasını okuyun.
API'den alamayacağınız şeyler
Bir plan hakkı ve bunun etrafına inşa edilmiş arayüz. Claude Code'un /usage-credits komutu abonelik kullanım kredilerini yönetir ve siz bunu "/login üzerinden claude.ai aboneliğinizle giriş yaptıktan sonra" çalıştırırsınız; "komut, API anahtarı kimlik doğrulamasıyla kullanılamaz." /usage ekranı da faturalandırma moduna göre farklılık gösterir: Session bloğu "API token kullanımını gösterir ve API kullanıcıları için tasarlanmıştır", aboneler ise bunun yerine plan kullanım çubuklarını ve kullanım dökümünü görür.
Claude Code'da daha uzun bir prompt cache. Bu gerçek maliyet gerektirir ve gözden kaçması kolaydır. Dokümantasyon şunu söyler: "Ömür, abonelikte bir saattir ve kullanım kredilerinden yararlanmaya başladığınızda beş dakikaya düşer; bir API anahtarı veya bulut sağlayıcısında varsayılan olarak beş dakikadır". Cache süresinden daha uzun bir aradan sonraki ilk mesajınız cache'i kaçırır, bu nedenle tüm bağlamınız yeniden işlenir ve yazma fiyatlarından faturalandırılır. Bir abonelikte elli dakikalık bir toplantı yapıp geri döndüğünüzde sistem hazır kalır. Bir API anahtarında ise aynı ara, oturum ön ekinin (prefix) tam olarak yeniden yazılmasına mal olur.
Bir abonelikten alamayacağınız şeyler
Programatik erişim. Claude'u çağıran bir cron job veya bir webhook işleyicisi API anahtarı gerektirir, bu nedenle iş yükünüz buysa karşılaştırma sona ermiştir. VPS üzerinde ilk Claude API uygulamanızı oluşturmak anahtar yönetimini ve ilk çalışan betiği kapsar.
Batch API indirimi. Fiyatlandırma sayfası bunu açıkça belirtir: "Batch API, hem giriş hem de çıkış tokenlarında %50 indirimle büyük hacimli isteklerin asenkron işlenmesine olanak tanır." Bu, bir insanın beklemediği her türlü iş için sayacı yarı yarıya düşürür. Milyon token başına Batch oranları Opus 4.8 için 2.50$ giriş ve 12.50$ çıkış, tanıtım fiyatıyla Sonnet 5 için 1$ ve 5$, Haiku 4.5 için ise 0.50$ ve 2.50$'dır. Takas edilen şey gecikmedir (latency): çoğu batch bir saat içinde tamamlanır, 24 saat içinde tamamlanmayan bir batch sona erer ve streaming batch olarak işlenemez. Batch ve prompt caching birlikte çalışır ve bir batch beş dakikadan uzun sürebileceği için, içinde 1 saatlik cache kullanın.
Proje başına maliyet ataması. Her API yanıtı bir usage bloğu döndürür, böylece tek bir isteğin maliyetini kaydedebilir ve bunu bir projeye veya müşteriye atayabilirsiniz. Bir abonelik, oturumu elinde tutan kişi için tek bir çubuk seti raporlar.
Bir şeyi dikkatle belirtmek gerekir çünkü her iki yönde de varsayımda bulunmak kolaydır: bunlar ayrı faturalandırma yüzeyleridir. Anthropic'in dokümantasyonu abonelik faturalandırmasını claude.ai desteğine, Console faturalandırmasını ise API platformuna yönlendirir ve /usage-credits bir API anahtarı altında çalışmaz. Kontrol ettiğim hiçbir şey bir aboneliğin API kredisi içerdiğini söylemiyor, bu nedenle iki hesap ve iki fatura planlayın.
Başabaş noktası formülü
Bir tur fiyatlandırın, sonra bunu ölçeklendirin.
turn cost = uncached_input_tokens x base_input_price
+ cache_write_tokens x 1.25 x base_input_price
+ cache_read_tokens x 0.10 x base_input_price
+ output_tokens x output_price
monthly API cost = turn cost x turns_per_active_day x active_days_per_month
break even when: monthly API cost = flat plan feeÇarpanlar tahmin değil, yayınlanmış değerlerdir. 5 dakikalık bir cache yazımı "taban giriş fiyatının 1.25 katı" maliyetindedir, 1 saatlik yazım "taban giriş fiyatının 2 katı" maliyetindedir ve bir cache okuması "taban giriş fiyatının 0.1 katı" maliyetindedir. Düşünme (thinking) tokenları çıkış tokenları olarak faturalandırılır, bu nedenle akıl yürütme özeti göstermeyen modellerde bile output_tokens içinde yer alırlar.
Milyon token (MTok) başına taban oranlar, 23 Temmuz 2026 itibarıyla günceldir:
claude-fable-5: 10$ giriş, 50$ çıkış. Cache okuma 1$. 5 dakikalık cache yazımı 12.50$. 1M context.claude-opus-4-8veclaude-opus-4-7: 5$ giriş, 25$ çıkış. Cache okuma 0.50$. 5 dakikalık cache yazımı 6.25$. 1M context.claude-sonnet-5: 31 Ağustos 2026'ya kadar tanıtım fiyatıyla 2$ giriş, 10$ çıkış, sonra 3$ ve 15$. Tanıtım oranlarında, cache okuma 0.20$ ve 5 dakikalık cache yazımı 2.50$. 1M context.claude-haiku-4-5: 1$ giriş, 5$ çıkış. Cache okuma 0.10$. 5 dakikalık cache yazımı 1.25$. 200K context.
Uzun context için ek ücret yoktur: "900k-tokenlık bir istek, 9k-tokenlık bir istek ile aynı token başına orandan faturalandırılır."
Varsayımların yazılı olduğu uygulanmış bir örnek
Sonnet 5 üzerinde 60.000 tokenlık context taşıyan bir oturum ortası Claude Code turunu ele alalım: 55.000'i cache'den, 3.000'i yeni yazılmış cache, 2.000 tokenlık yeni cache'lenmemiş giriş ve düşünme dahil 1.200 çıkış tokenı.
- Cache okumaları: 55.000 x 0.20$/MTok = 0.0110$
- Cache yazımları: 3.000 x 2.50$/MTok = 0.0075$
- Cache'lenmemiş giriş: 2.000 x 2.00$/MTok = 0.0040$
- Çıkış: 1.200 x 10.00$/MTok = 0.0120$
Bu yaklaşık tur başına 0.035$ eder. Aktif bir günde 120 tur ile günde yaklaşık 4.14$. Ayda 20 aktif gün ile ayda yaklaşık 83$.
Bunu yukarıdaki sabit ücretlerle karşılaştırdığınızda iki şey söyler. Pro ücretinin yaklaşık dört katıdır, yani Pro planı, günlük 120 Sonnet turunu karşılayabiliyorsa kağıt üzerinde daha ucuzdur. Bu şart, hiçbir yayınlanmış rakamın sizin için netleştiremeyeceği şeydir. Aynı 83$ değeri, giriş seviyesi Max ücretinin altındadır, yani burada sayaç Max'tan daha iyidir.
Şimdi varsayımları tek tek değiştirin ve plan ücretinin nasıl belirleyici olmaktan çıktığını izleyin.
Başabaş noktasını plan fiyatından daha fazla etkileyen üç şey
Prompt caching. Aynı 60.000 tokenlık turu cache olmadan çalıştırın; tüm prompt yeni giriş olarak faturalandırılır: 60.000 x 2.00$/MTok = 0.12$, artı 0.012$ çıkış, yani tur başına 0.132$. Bu, cache'li turun yaklaşık dört katıdır ve aylık 83$'ı yaklaşık 317$'a çıkarır. Bu, Anthropic'in yayınladığı tek başabaş noktasıdır çünkü iş yükünüze bağlı değildir: "Bir cache hit, standart giriş fiyatının %10'una mal olur; bu da caching'in sadece 5 dakikalık süre için bir cache okumasıyla (1.25x yazım) veya 1 saatlik süre için iki cache okumasıyla kendini amorti ettiği anlamına gelir."
Sizin haberiniz olmadan caching'i kapatan iki hata modu vardır. Birincisi, modelin minimum cache'lenebilir uzunluğundan kısa bir ön ek (prefix): Fable 5'te 512 token, Opus 4.8 ve Sonnet 5'te 1.024, Opus 4.7'de 2.048 ve Haiku 4.5'te 4.096 token. Daha kısa bir prefix cache'lenmez ve hata verilmez. İkincisi, paralel isteklerdir, çünkü "bir cache girişi ancak ilk yanıttan sonra kullanılabilir hale gelir." Aynı anda gönderilen on adet özdeş istek, hepsinde tam giriş fiyatı öder. Her ikisinin de belirtisi, cache_read_input_tokens'un sıfırda durmasıdır.
Model seçimi. Aynı turu Opus 4.8 üzerinde, 5$ giriş ve 25$ çıkış, 0.50$ cache okuma ve 6.25$ 5-dakikalık yazım ile fiyatlandırın: okumalar 0.0275$, yazımlar 0.0188$, cache'lenmemiş giriş 0.0100$, çıkış 0.0300$. Bu yaklaşık tur başına 0.086$ eder, Sonnet turunun 2.5 katıdır ve aynı hacimde ayda yaklaşık 207$ eder. Tek bir model seçimi, aynı işi giriş seviyesi Max ücretinin altından, iki katından fazlasına taşımıştır. Haiku 4.5, 1$ ve 5$ ile log ayıklama gibi mekanik işler için durumu tersine çevirir.
Çaba düzeyi model seçimine bağlıdır, çünkü düşünme tokenları çıkış oranlarından faturalandırılır. Opus 4.8'de API varsayılanı high'dir ve kodlama ile ajan tabanlı işler için belgelenmiş başlangıç noktası daha maliyetli olan xhigh'dir. Claude Code içinde /effort veya API üzerinde output_config.effort ile bunu düşürün. Bir şey daha eski tahminleri değiştiriyor: yeni modeller, "aynı metin için yaklaşık %30 daha fazla token üreten" daha yeni bir tokenizer kullanır, bu nedenle eski bir model üzerinde ölçülen bir sayım, aynı metni bugün eksik gösterir.
Oturum hijyeni. API durumsuzdur (stateless), bu nedenle her tur tüm konuşmayı faturalandırılan giriş olarak yeniden gönderir. Bu nedenle uzun bir oturum, yeni bir oturuma göre mesaj başına daha fazla maliyet çıkarır; bu, çoğu sürpriz faturanın arkasındaki mekanizmadır ve Claude Code oturumunda aslında tokenleri neyin tükettiği konusunda ayrıntılı olarak işlenmiştir. İlgisiz görevler arasında /clear çalıştırın, çünkü bayatlamış bağlam her sonraki mesajda yeniden gönderilir ve yeniden faturalandırılır. Tek bir uzun görev içinde /compact çalıştırın, böylece geçmiş tam olarak taşınmak yerine özetlenir. Sürekli aralıklarla çalışın, çünkü varsayılan cache "5 dakikalık bir ömre sahiptir" ve "cache'lenen içerik her kullanıldığında ek bir maliyet olmadan yenilenir". Her on dakikada bir dokunduğunuz bir oturum, her seferinde bir yeniden yazım maliyeti öder. VPS üzerinde tmux'ta çalışan bir Claude Code oturumu boşta dururken neredeyse hiçbir şey harcamaz, ancak cache ömrünü aşan boşta kalma durumu yine de sıcak prefix'in kaybedilmesine neden olur.
Karar vermeden önce kendi kullanımınızı ölçün
Benim örneğimden karar vermeyin. Kendi bir haftanızdan karar verin.
Claude Code'da, bir hafta boyunca her oturumun sonunda /usage çalıştırın (/cost aynı ekran için bir takma addır). Oturumun token sayımlarını ve bir maliyet tahmini raporlar, ancak dokümantasyondan bir uyarı vardır: "Dolar tutarı, token sayılarından yerel olarak hesaplanan bir tahmindir ve gerçek faturanızdan farklı olabilir." /clear çalıştırdığınızda toplamlar sıfırlanır, bu nedenle önce ekranı okuyun. Bir abonelikte bu dolar tutarı faturanız değildir, ancak arkasındaki token sayıları bu formülün ihtiyaç duyduğu şeydir. /context pencimayı neyin doldurduğunu gösterir.
Bir API hesabında, Claude Console'daki kullanım sayfası yetkili kayıttır. Bir prompt'u göndermeden önce fiyatlandırmak için, client.messages.count_tokens() "ücretsizdir ancak kullanım kademenize bağlı olarak dakika başına istek limitlerine tabidir" ve bu, gerçekten faturalandırılacağınız tokenizer'ı kullanan tek sayıdır.
Bir çağrıdan sonra, kullanım bloğunu okuyun ve doğru okuyun:
u = response.usage
total_input = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokensinput_tokens sadece cache'lenmemiş kalanı sayar, bu da "son cache kesme noktasından sonraki tokenlar" olarak belgelenmiştir. input_tokens: 4000 bildiren bir tur, 4.000 tokenlık bir tur değildir; üç alanın toplamı bu formülün istediği prompt boyutudur.
Sonra karşılaştırın. Ölçülen ayınız açıkça plan ücretinin altındaysa, sayacı kullanın. Eğer açıkça üzerindeyse, planınızın kullanım hakkı sizin için normal bir iş gününü karşılıyorsa planı kullanın. Eğer çizgiye yakınsa, planı kullanın; çünkü bir plan sizi şaşırtamaz ama bir sayaç şaşırtabilir.
FAQ
Claude API, Claude Pro veya Max'tan daha mı ucuz?
Hacme bağlıdır ve aranabilecek yayınlanmış bir başabaş noktası yoktur, çünkü abonelikler token miktarı yerine kullanım pencereleri olarak satılır. Yayınlanmış token başına oranlardan tipik bir tur fiyatlandırın, bunu aktif gün başına tur sayınız ve ay başına aktif gün sayınızla çarpın, ardından bu rakamı plan ücretiyle karşılaştırın. Uygulanmış bir örnekte, 60.000 tokenlık bir Sonnet 5 turu yaklaşık 0.035$ tutmuştur; yani günde 120 tur ile 20 gün boyunca ayda yaklaşık 83$. Pro ücretinin üzerinde, giriş seviyesi Max ücretinin altındadır.
Aylık Claude API maliyetimi nasıl hesaplarım?
Gerçek token sayılarını toplamak için bir hafta boyunca Claude Code'da /usage çalıştırın veya zaten bir API hesabınız varsa Claude Console'daki kullanım sayfasını okuyun. Sonra bir tur fiyatlandırın: temel orandan cache'lenmemiş giriş, temel girişın 1.25 katı cache yazımları, temel girişin 0.1 katı cache okumaları ve düşünme tokenlarını çıkış olarak sayarak çıkış oranıyla çıkış. Aktif gün başına tur sayısı ve ay başına aktif gün sayısı ile çarpın.
Claude API faturasını en çok ne değiştirir?
Her şeyden çok, prompt caching. Prefix cache'den sağlanıyorsa 60.000 tokenlık bir Sonnet 5 turu yaklaşık 0.035$ iken, sağlanmıyorsa yaklaşık 0.132$'dır. Sonra model seçimi gelir: aynı tur Opus 4.8 üzerinde yaklaşık 0.086$ tutar. Üçüncü sırada oturum uzunluğu gelir, çünkü API durumsuzdur ve her tur tüm konuşmayı faturalandırılan giriş olarak yeniden gönderir.
Bir Claude aboneliği API erişimi içerir mi?
Bunları iki faturası olan iki ayrı hesap olarak değerlendirin. API çağrıları, Console'da oluşturduğunuz bir hesaba karşı token başına faturalandırılır ve kontrol ettiğim hiçbir dokümantasyon bir aboneliğin API kredisi sağladığını söylemiyor. Onların ayrı yüzeyler olduğunun en net işareti, Claude Code'un "API anahtarı kimlik doğrulamasıyla kullanılamayan" /usage-credits komutudur. Birçok geliştirici her ikisine de sahiptir: etkileşimli kodlama için bir plan, inşa ettikleri şeyler için bir anahtar.