Claude mu ChatGPT API mi: Hangisi Daha Ucuz?
Claude ve ChatGPT API maliyetlerini karşılaştırın. Token aritmetiğini öğrenin ve üç farklı iş yükü üzerinden hangi modelin daha ekonomik olduğunu fatura verileriyle inceleyin.
Kısa cevap
Claude ve ChatGPT API fiyatlandırmasında tek bir kazanan yoktur; çünkü her iki sağlayıcı da her katmanda girdi ve çıktı için farklı fiyatlandırma uygular. Ağustos 2026 itibarıyla, üst iki Claude katmanı, OpenAI muadilleriyle aynı girdi token ücretini alırken, çıktı token ücretinde daha düşük bir maliyet sunar; bu nedenle Claude, çıktı ağırlıklı işlerde biraz daha avantajlıdır. Küçük katmanda ise Claude, aynı iş için birkaç kat daha fazla maliyet çıkarır. Bir katman ve token karışımı belirtmeyen her yanıt, tahminden ibarettir.
Bu sayfa, önce aritmetik hesaplamayı, ardından token karışımlarıyla birlikte üç farklı maliyetli iş yükünü ve son olarak gerçek faturayı liste fiyatından daha fazla etkileyen çarpanları sunmaktadır.
İhtiyacınız olan tek formül
Her iki API de metin ücretlendirmesini aynı şekilde yapar. Gönderdiğiniz tokenlar için ödeme yaparsınız; modelin geri yazdığı tokenlar için ise daha yüksek bir tarife uygulanır.
cost = (input tokens / 1,000,000) * input rate + (output tokens / 1,000,000) * output rate
Bir token yaklaşık 4 İngilizce karakter veya 0,75 kelimeye denk gelir. Bunu yalnızca ilk tahminleriniz için kullanın. Gerçek faturalandırma için her yanıtın usage nesnesinde dönen sayıları esas almalısınız.
# Rates are US dollars per million tokens.
def cost(in_tok, out_tok, in_rate, out_rate):
return in_tok / 1e6 * in_rate + out_tok / 1e6 * out_rate
# One support-chat turn: 1,400 tokens in, 220 tokens out, on a $2 / $10 model.
print(round(cost(1400, 220, 2.0, 10.0), 6))Betik, işlem başına yarım sente denk gelen 0.005 değerini yazdırır. Bu değeri bir ay içinde beklediğiniz işlem sayısıyla çarparak bütçenizi oluşturabilirsiniz. Eğer paydadaki bir milyon token birimi size soyut geliyorsa, Claude'da bir milyon token ile neler yapabileceğiniz bağlantısı, bu miktarın somut olarak ne kadar metne karşılık geldiğini gösterir. Bu formülü öğrendiğinizde, gelecekteki tüm fiyat değişiklikleri yeni bir analiz gerektirmeden tek satırlık bir düzenleme ile güncellenebilir.
Ağustos 2026 yayınlanan fiyatlar
Bunlar, her iki sağlayıcının 1 Ağustos 2026 tarihinde yayınladığı liste fiyatlarıdır. Bu blok, gönderide fiyatın yazılı olduğu tek yerdir. Bütçe ayırmadan önce bu fiyatları claude.com/pricing ve OpenAI fiyatlandırma sayfası ile karşılaştırın.
The data behind this chart
[
{
"label": "Frontier",
"claude_input": 5,
"claude_output": 25,
"openai_input": 5,
"openai_output": 30
},
{
"label": "Workhorse",
"claude_input": 2,
"claude_output": 10,
"openai_input": 2,
"openai_output": 12
},
{
"label": "Workhorse from September",
"claude_input": 3,
"claude_output": 15,
"openai_input": 2,
"openai_output": 12
},
{
"label": "Small",
"claude_input": 1,
"claude_output": 5,
"openai_input": 0.2,
"openai_output": 1.2
}
]Eşleştirmeler popülariteye göre değil, her ürün grubundaki konuma göre yapılmıştır. Frontier kategorisinde Claude Opus 5 ile gpt-5.6-sol, Workhorse kategorisinde Claude Sonnet 5 ile gpt-5.6-terra, Small kategorisinde ise Claude Haiku 4.5 ile gpt-5.6-luna yer almaktadır. Her iki sağlayıcı da bu bloğun üzerinde daha üst katmanlar satmaktadır ve OpenAI, eski nesilleri orijinal fiyatlarıyla listelemeye devam etmektedir. Claude tarafında bu katman Fable 5'tir; her iki bacakta da frontier satırının iki katı fiyatlandırılırken aynı beş kat çıktı oranını korur. Bu nedenle, Opus 5'in faturanızın en üst noktası olduğunu varsaymadan önce Fable 5'in maliyeti ve bu fiyatı ne zaman hak ettiği konusunu okumakta fayda vardır. Bir taraftaki amiral gemisi modeli diğer taraftaki bütçe dostu bir modelle karşılaştırmak anlamsız bir sonuç doğurur; yayınlanan çoğu karşılaştırmanın manşetlerini bu yöntem belirler.
Bu blokta açıkça belirtilmesi gereken iki husus bulunmaktadır. Sonnet 5'in 2 ve 10 değerleri giriş fiyatlarıdır ve Anthropic, bu fiyatların 31 Ağustos 2026 tarihinde sona ereceğini belirtmektedir. Bu tarihten sonra Sonnet 5, 3 ve 15 üzerinden ücretlendirilecektir. Bu tek değişiklik, workhorse katmanını Claude'un az farkla önde olduğu bir durumdan OpenAI'ın net bir şekilde önde olduğu bir duruma getirir ve bu durum gönderinin geçerlilik süresi içinde gerçekleşecektir.
İkinci husus ise ezberlenmesi gereken bir kalıptır: Claude, yukarıdaki her satırda çıktı fiyatını kendi girdi fiyatının tam olarak 5 katı, OpenAI ise 6 katı olarak belirlemektedir. Kazananı token dağılımınıza göre değiştiren şey mutlak fiyat değil, bu orandır.
Milyon token başına düşen ücret neden sağlayıcılar arasında karşılaştırılamaz
Ücret, token başına düşen dolar tutarıdır. Fatura, token başına ücretin token sayısı ile çarpılmasıdır; bir metnin token sayısı ise metnin değil, modelin bir özelliğidir.
Anthropic bunu doğrudan belgelendirmiştir: Claude Opus 5 ve Claude Sonnet 5 dahil olmak üzere Claude 4.7 ve sonraki modeller, aynı metin için Claude Sonnet 4.6 ve önceki modellere göre yaklaşık %30 daha fazla token üreten yeni bir tokenizer kullanır. Ücret değişmemiştir ancak fatura değişmiştir.
Dolayısıyla, aynı görünen iki ücret, aynı fatura anlamına gelmez. Herhangi bir karşılaştırmaya (buna dahil olmak üzere) güvenmeden önce, kendi metninizle her iki taraftaki token sayısını hesaplayın.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5",
"messages": [{"role": "user", "content": "Summarise the attached contract."}]
}'Sağlıklı bir yanıt, input_tokens değerini tutan küçük bir JSON nesnesidir. 401 hatası, anahtar değişkenin shell ortamınızda boş olduğu anlamına gelir. Aynı metni diğer sağlayıcının tokenizer'ından geçirin, bir sayıyı diğerine bölün ve elde ettiğiniz oranı karşılaştırma yapmadan önce yayınlanan ücretle çarpın. Eğer oran bir sağlayıcı lehine yaklaşık 1.2'den fazlaysa, bu durum yukarıdaki blokta yer alan tüm ücret farklarından daha belirleyici olacaktır.
Senaryo bir: sohbet özelliği
Bir web uygulaması içindeki destek asistanı. Ayda 120.000 etkileşim. Her etkileşim bir sistem istemi, araç şemaları, iki adet getirilmiş yardım masası parçası ve birkaç önceki mesajı gönderir; yaklaşık 1.400 girdi token'ı içerir ve model yaklaşık 220 token ile yanıt verir. Etkileşimli olduğu için toplu işlem indirimi burada asla uygulanamaz. Bunu iş yükü katmanında çalıştırın.
The data behind this chart
[
{
"label": "List price",
"claude_usd": "600.00",
"openai_usd": "652.80"
},
{
"label": "Cached prefix",
"claude_usd": "427.20",
"openai_usd": "480.00"
},
{
"label": "Small tier, cached",
"claude_usd": "213.60",
"openai_usd": "48.00"
}
]Liste fiyatı üzerinden Claude, OpenAI'ın 652.80 tutarına karşılık 600.00 faturalandırır. Girdi oranları aynı olduğu için girdi bacakları da aynıdır. Farkın tamamı çıktıdan kaynaklanır ve Claude bunu, bir sağlayıcı seçimi yapmaya değmeyecek kadar küçük bir farkla kazanır.
Şimdi bu 1.400 girdi token'ının 800 tanesini sabit bir önek olarak işaretleyin: etkileşimler arasında değişmeyen sistem istemi ve araç şemaları. Her iki sağlayıcı da önbellek isabeti için temel girdi oranlarının %10'unu ücretlendirir. Claude'un faturası 427.20 seviyesine, OpenAI'ınki ise 480.00 seviyesine düşer. Önbellekleme, sağlayıcı seçiminden daha değerlidir ve her iki platform da bunu sunar.
Claude'un kaybettiği nokta burasıdır. Çoğu destek yanıtı bir iş yükü modeli gerektirmez. Aynı trafiği küçük katmana taşıdığınızda Claude 213.60 faturalandırırken, OpenAI 48.00 faturalandırır. Birini diğerine böldüğünüzde, aynı iş için Claude yaklaşık dört buçuk kat daha maliyetlidir. Claude Haiku 4.5, milyon girdi token'ı başına 1 ücret alırken, gpt-5.6-luna 0.2 ücret alır ve hiçbir önbellekleme miktarı beş katlık bir farkı kapatamaz. İş yükünüz küçük bir modele uygunsa, OpenAI daha ucuzdur ve aradaki fark büyüktür.
Senaryo iki: uzun bağlamlı belge işleme hattı
Ayda 25.000 sözleşme. Her istek aynı 9.000 token'lık talimatı ve JSON şemasını, ardından 12.000 token'lık sözleşme metnini taşır ve model yaklaşık 700 token'lık yapılandırılmış alan döndürür. Çıktı, bu işteki token'ların %4'ünden azdır ve karşılaştırmayı belirleyen tek gerçek budur.
The data behind this chart
[
{
"label": "Chat feature",
"claude_usd": "427.20",
"openai_usd": "480.00"
},
{
"label": "Document pipeline",
"claude_usd": "820.00",
"openai_usd": "855.00"
},
{
"label": "Coding agent",
"claude_usd": "116.10",
"openai_usd": "124.20"
}
]9.000 token'lık önek her iki tarafta da önbelleğe alındığında, Claude 820.00 tutarında, OpenAI ise 855.00 tutarında faturalandırma yapar. Girdi bacakları kuruşu kuruşuna eşleşir, çünkü Ağustos 2026 itibarıyla ana iş yükü girdi oranları aynıdır. Tüm fark, Claude'da girdi fiyatının 5 katı, OpenAI'da ise 6 katı olarak fiyatlandırılan çıktı bacağından kaynaklanır.
Bu iş aynı zamanda toplu (batch) işlemeye de uygundur. Her iki sağlayıcı da asenkron işler için girdi ve çıktı maliyetlerinde %50 indirim uygular, bu nedenle her iki toplam tutar da yarıya iner ve aradaki fark korunur. Toplu işleme, her iki platformdaki en büyük tekil indirimdir ve gece çalışan bir belge işleme hattı bunu her zaman kullanabilir.
Claude'un kaybettiği nokta, öncekiyle aynı katman mantığıdır. Sabit bir şemaya karşı alan çıkarma işlemi, küçük bir modelin tam olarak iyi yaptığı iştir ve burada girdi, token'ların %97'sini oluşturur. Bir alt katmana geçmek, OpenAI girdi oranını 0,1 ile, Claude girdi oranını ise 0,5 ile çarpar. Daha büyük bir modele ihtiyacınız olduğunu varsaymadan önce, bir iş için doğru Claude katmanını seçme konusunda uygulayacağınız değerlendirmenin aynısını kullanarak küçük modeli 200 belge üzerinde test edin.
Senaryo üç: sürekli çalışan bir kodlama ajanı
Bir geliştirici, bir VPS üzerinde ayda yaklaşık 900 model etkileşimi gerçekleştiren bir ajan çalıştırıyor. Her etkileşim, depo bağlamı olarak yaklaşık 60.000 girdi token'ı taşıyor; bunun %80'i önbellek isabeti (cache hit) sağlıyor ve yaklaşık 1.800 token'lık düzenleme ve açıklama çıktısı üretiyor. Kodlama, yetenek farkının gerçek maliyet yarattığı bir alan olduğu için fiyatlandırmayı en üst seviye (frontier tier) üzerinden yapın.
Claude, OpenAI'ın 124.20 tutarına karşılık 116.10 faturalandırıyor. Aynı girdi oranı ve aynı önbellek okuma oranıyla, Claude'un daha düşük çıktı oranı yaklaşık %7'lik bir avantaj sağlıyor.
Bu %7'lik fark, daha önce belirtilen tokenleştirici hata payı dahilinde kaldığından, bu senaryoyu maliyet açısından bir beraberlik olarak değerlendirin. Beraberlik olmayan tek konu faturalandırma modelidir. Bu hacimdeki bir geliştirici için abonelik tabanlı bir koltuk maliyeti, genellikle metrik tabanlı API çağrılarından daha düşüktür ve bir abonelik dahil edildiğinde tüm karşılaştırma değişir. Bir ajanı metrik tabanlı faturalandırmaya geçirmeden önce bu durumu API ile abonelik maliyeti karşılaştırması üzerinden hesaplayın. Eğer metrik tabanlı faturalandırmayı tercih ederseniz, token'ların nereye gittiğini önceden öğrenin; çünkü bir kodlama ajanının token kullanımı, yazdığı koddan ziyade her etkileşimde yeniden gönderilen bağlam tarafından domine edilir.
Faturayı belirleyen çarpanlar
Liste fiyatı, bu listedeki en küçük kalemdir. Aşağıdakilerin her biri, aynı katmandaki iki sağlayıcı arasındaki farktan daha fazla gerçek bir faturayı değiştirir.
Önbelleğe alınmış girdi. Her iki sağlayıcı da önbellek isabeti (cache hit) için temel girdi ücretinin %10'unu tahsil eder. Anthropic ayrıca önbelleğe yazma işlemi için de ücret alır: beş dakikalık bir giriş için temel girdinin 1,25 katı, bir saatlik giriş için ise 2 katı. Daha sonraki bir isabet, o girişi okuma fiyatı üzerinden yeniler. Dolayısıyla beş dakikalık bir giriş, bir okumadan sonra kendi maliyetini karşılar. İstekler arasında uzun boşluklar olan bir iş yükü, okuduğundan daha sık yazma yapar; bu durumda önbelleğe alma, tasarruf sağlamaktan çok maliyet yaratır. Sürekli trafik önbelleklemede iyi sonuç verir. Düzensiz (bursty) trafik ise vermez.
Toplu işlem indirimleri. Her iki platformda da yalnızca eşzamansız (asynchronous) işler için girdi ve çıktı üzerinden %50 indirim uygulanır. İşin bekleme süresi varsa, bu durum her iki sağlayıcıda da faturayı yarıya indirir ve önbelleğe alma ile birleştirilebilir.
Çıktı payı. Claude, çıktı için girdi oranının 5 katını tahsil eder. OpenAI ise 6 katını tahsil eder. Token'larınızın ne kadarı okumadan ziyade yazılıyorsa, Claude eşit bir girdi oranında o kadar avantajlı görünür; girdi ağırlıklı işlerde ise durum tam tersidir.
Yeniden denemeler. Bir yeniden deneme, tüm girdinin tekrar ödenmesine neden olur ve kullanılabilir hiçbir sonuç döndürmez. Çağrılarınızın %6'sı şema doğrulamasında başarısız olup yeniden deneniyorsa, girdi maliyetiniz planladığınızdan %6 daha fazladır. Yeniden denemeleri bir hata satırı olarak değil, bir maliyet kalemi olarak kaydedin. Ekipler bu çarpanı en son fark eder ve bu çarpan, genellikle üzerinde bir hafta tartıştıkları sağlayıcı farkından daha büyüktür.
Hangi taraf kaybediyor ve nerede
Claude, küçük ölçekli katmanda doğrudan kaybediyor. gpt-5.6-luna, milyon girdi token'ı başına 0.2 ücret alırken, Claude Haiku 4.5 1 ücret almaktadır; çıktı tarafında ise 1.2 karşılığında 5 söz konusudur. Yüksek hacimli sınıflandırma ve kısa metin çıkarma işlemleri Claude üzerinde yaklaşık dört kat daha maliyetlidir.
Claude, giriş seviyesi fiyatlandırmanın sona erdiği ve Sonnet 5'in 3 ve 15 seviyelerine yükseldiği 1 Eylül 2026 tarihinden itibaren, değişmeyen gpt-5.6-terra karşısında ana iş yükü katmanını kaybediyor. Claude, çıktı oranında sınır katmanını kazanıyor ancak bu fark, kendi token sayımlarınızla ortadan kalkabilecek düzeydedir. Ağustos 2026'da her iki taraf da girdi odaklı işlerde kazançlı çıkmıyor; çünkü her iki tarafta da milyon başına 2 maliyet ile girdi bacakları aynı sayısal değere sahip.
Kendi trafiğinizde bu ölçüm nasıl yapılır
Her yanıttaki usage nesnesini okuyun ve her istek için dört sayı kaydedin: girdi belirteçleri (input tokens), çıktı belirteçleri (output tokens), önbellek okuma belirteçleri (cache read tokens) ve önbellek yazma belirteçleri (cache write tokens). Claude API üzerinde bunlar input_tokens, output_tokens, cache_read_input_tokens ve cache_creation_input_tokens olarak gelir. Bunları günlük olarak toplayın, güncel fiyatlarla çarpın ve toplamınızı faturanızla karşılaştırın. İkisi arasındaki fark genellikle yeniden denemelerden veya sürdüğünüzü unuttuğunuz bir kod yolundan kaynaklanır.
Karşılaştırmayı örnek bir istem (prompt) yerine bir haftalık gerçek trafik üzerinde çalıştırın ve belirteç başına maliyet yerine tamamlanan görev başına maliyeti kıyaslayın. İki katı fiyata tek seferde yanıt veren bir model, yarı fiyatına üç deneme gerektiren bir modelden daha ucuzdur. Belirteç başına maliyet bir orandır. Tamamlanan görev başına maliyet ise faturanızdır.
Herhangi bir şeyi çalışır durumda bırakmadan önce katı bir harcama tavanı belirleyin. Her iki platform da konsollarında harcama limitleri sunar; yeniden deneme döngüsünde sıkışan bir aracı, bir aylık bütçeyi bir gecede tüketebilir. Bunu, her zaman açık bir aracıda maliyet kontrolü için yapacağınız gibi yapılandırın. İlk sürümü kendi sunucunuzda oluşturuyorsanız, bir VPS üzerinde ilk Claude API uygulaması, anahtar yönetimi ve bu aritmetiğin üzerine oturduğu istek döngüsünü kapsar.
FAQ
Claude API, ChatGPT API'den daha mı ucuz?
Her zaman değil. Ağustos 2026 itibarıyla, frontier ve workhorse katmanları her iki tarafta da giriş token'ı başına aynı ücreti almaktadır; Claude çıkış token'ı başına daha az ücret aldığı için çıkış ağırlıklı işlerde birkaç yüzde oranında daha ucuza gelmektedir. Küçük katmanda ise OpenAI'ın gpt-5.6-luna modeli, giriş token'ı başına Claude Haiku 4.5'in beşte biri kadar maliyetlidir; bu nedenle yüksek hacimli sınıflandırma işlemleri OpenAI tarafında çok daha ucuzdur. Kendi token dağılımınıza göre maliyetinizi hesaplayın; bu kadar küçük bir fark fiyat listesinden ziyade iş yükünüz tarafından belirlenir.
Neden aynı kelimeler her API'de farklı sayıda token olarak ücretlendiriliyor?
Çünkü her modelin kendi tokenizer yapısı vardır ve token sayısı modelin bir özelliğidir. Anthropic, Claude 4.7 ve sonraki modellerin aynı metin için Claude Sonnet 4.6 ve önceki modellere göre yaklaşık %30 daha fazla token ürettiğini belirtmektedir. Kendi metninizi her sağlayıcının token sayma uç noktasına gönderin, bir sayıyı diğerine bölün ve karşılaştırma yapmadan önce bu oranı yayınlanan fiyatla çarpın. %20'lik bir token farkı, yayınlanan fiyat farklarının çoğundan daha etkilidir.
Prompt caching faturayı hiç büyütür mü?
Evet, Anthropic üzerinde büyütür. Beş dakikalık bir giriş için önbelleğe yazma işlemi temel giriş ücretinin 1.25 katına, bir saatlik giriş için ise 2 katına mal olur; bir isabet (hit) ise 0.1 katına mal olur. Trafiğiniz, girişlerin çoğu okunmadan önce sona erecek kadar düzensizse, yazma primini öder ancak okuma avantajı elde edemezsiniz. Loglarınızdaki cache_creation_input_tokens değerini cache_read_input_tokens ile karşılaştırın. Oran 1'e yakınsa önbelleğe alma size para kaybettiriyor demektir; bu durumda giriş süresini uzatın veya önbelleğe almayı devre dışı bırakın.
Kodlama aracısını API üzerinden mi yoksa abonelikle mi çalıştırmalıyım?
Normal hacimdeki tek bir geliştirici için abonelik ücreti genellikle ölçümlü API faturalandırmasından daha düşüktür; çünkü bir kodlama aracısı her adımda büyük bir bağlamı yeniden gönderir ve bu bağlam her seferinde ücretlendirilir. Önce bir hafta boyunca ölçüm yapın, ardından API toplamını abonelik fiyatıyla karşılaştırın. Kullanım düzensiz olduğunda veya aboneliğin sağlamadığı programatik erişime ihtiyaç duyduğunuzda API daha avantajlıdır. Sizi API'ye yönlendiren şey fiyat değil de kullanım limitine takılmaksa, Claude kullanım limitinden çıkış yolları arasında metrik faturalandırmaya geçmekten daha düşük maliyetli seçenekler mevcuttur.