SSD Nodes Learn Hosting plans →
Rehberler Matt ConnorYazan Matt Connor · Güncellendi 2026-08-27

Claude 1 milyon token maliyeti hesaplama

Claude API fiyatlandırması girdi ve çıktı token sayısına göre farklılık gösterir. 1 milyon token için güncel model maliyetlerini ve fatura tahminleme yöntemini inceleyin.

Claude'da 1M token ne kadardır?

1M token, bir milyon token anlamına gelir ve her Claude API (uygulama programlama arayüzü) fiyatının üzerinden hesaplandığı birimdir. Bunun için tek bir fiyat yoktur; çünkü girdi ve çıktı farklı oranlarda ücretlendirilir ve her modelin kendine ait bir fiyat çifti bulunur. Ağustos 2026 itibarıyla, bir milyon girdi token'ı Claude Haiku 4.5 üzerinde $1, Claude Sonnet 5 üzerinde $2 ve Claude Opus 5 üzerinde $5 maliyete sahiptir.

Çıktı, maliyetin daha yüksek olan kısmıdır. Mevcut tüm modellerde çıktı oranı, girdi oranının beş katıdır; bu nedenle fatura tutarınızı ana rakamdan ziyade bu ikisi arasındaki dağılım belirler. Uzun belgeler gönderip kısa yanıtlar alan bir uygulama ile kısa bir istemden uzun yanıtlar üreten bir uygulama, maliyet açısından birbirinden çok farklı davranır.

Bu sayfa birim ekonomisi hakkındadır: bir token'ın maliyeti nedir ve geliştirme yapmadan önce fatura tahmini nasıl yapılır. Çalışma sırasında token'ların gerçekte nereye gittiğini öğrenmek için Claude Code oturumunda token'ların nereye gittiği bölümünü okuyun.

1M token neye benzer

Token, modelin okuduğu veya yazdığı bir metin parçasıdır. Anthropic'in genel kılavuzuna göre bir token yaklaşık 4 karakter veya İngilizce dilinde 0,75 kelimeye denk gelir. Dolayısıyla bir milyon token, yaklaşık 750.000 kelime veya 4 MB düz metin demektir.

Yaygın girdiler için yayınlanan tahminler, ölçeği daha iyi anlamanızı sağlar.

ChartApproximate input token counts for common content, published estimates
The data behind this chart
[
  {
    "label": "Average web page (10 kB)",
    "tokens": "2,500"
  },
  {
    "label": "Documentation page (100 kB)",
    "tokens": "25,000"
  },
  {
    "label": "Research paper PDF (500 kB)",
    "tokens": "125,000"
  }
]

Bu oranlara göre 1M token, bir kez okunan yaklaşık 400 ortalama web sayfasına veya bu boyutta sekiz araştırma makalesine eşittir. Bu, orta ölçekli bir kod tabanının bir kez taranması veya bir kişi için bir aylık hafif sohbet kullanımı anlamına gelir.

Tüm bunları bir tahmin olarak değerlendirin. Kod, JSON ve İngilizce dışındaki dillerdeki metinler, bir token içine daha az kelime sığdırdığından 0,75 oranı iyimser bir sınırdır. Sayımı değiştiren bir diğer husus şudur: Opus 5 ve Sonnet 5'i içeren Claude Opus 4.7 ve sonrası, aynı metin için Sonnet 4.6 ve öncesine göre yaklaşık yüzde 30 daha fazla token üreten daha yeni bir tokenizer kullanır. Claude Haiku 4.5 ise eski tokenizer'ı kullanır. Bu nedenle, Haiku 4.5 üzerinde ölçtüğünüz bir sayı, aynı girdi için Sonnet 5 üzerindeki sayıyı düşük gösterecektir; bu da bu sınır boyunca doğrudan milyon başına fiyat karşılaştırması yapmanın adil olmadığı anlamına gelir. Karar vermeden önce aynı istemi her iki modelde de saydırın.

Claude için milyon token başına ücretlendirme

ChartClaude API list price in USD per million tokens, August 2026
The data behind this chart
[
  {
    "label": "Haiku 4.5",
    "input_usd": 1,
    "output_usd": 5
  },
  {
    "label": "Sonnet 5 (to 31 Aug 2026)",
    "input_usd": 2,
    "output_usd": 10
  },
  {
    "label": "Sonnet 5 (from 1 Sep 2026)",
    "input_usd": 3,
    "output_usd": 15
  },
  {
    "label": "Opus 5",
    "input_usd": 5,
    "output_usd": 25
  }
]

Claude Sonnet 5, 31 Ağustos 2026 tarihine kadar giriş için $2 ve çıkış için $10 tutarında tanıtım fiyatlandırmasına sahiptir. 1 Eylül 2026 tarihinden itibaren standart tarife geçerli olacaktır: giriş için $3 ve çıkış için $15. Claude Opus 5 ise giriş için $5 ve çıkış için $25 olarak fiyatlandırılmıştır. Bu tablonun tamamen dışında kalan bir model daha mevcuttur: Claude Fable 5, giriş için $10 ve çıkış için $50 olarak listelenmiştir; dolayısıyla bu ücretlerin ödenmeye değer olup olmadığı, modeli hangi işlerde kullandığınıza bağlıdır.

Fiyatlar değişebilir. Bu sayfadaki her rakamı Ağustos 2026 tarihli bir örnek çalışma olarak değerlendirin ve bütçeyi onaylamadan önce resmi fiyatlandırma sayfasından güncel rakamları teyit edin.

Bu oranlar Claude'un maliyetini belirtir ancak iş yükünüz için daha ucuz seçenek olup olmadığını göstermez; hem Claude hem de ChatGPT üzerinde maliyetlendirilmiş üç iş örneği, hangi API'nin nerede daha avantajlı olduğunu ortaya koymaktadır.

Ücretlendirmeyi değiştirmeyen tek unsur bağlam uzunluğudur. Claude 4.6 ve sonraki sürümlerde, 1M token'lık tam bağlam penceresi standart fiyatlandırma üzerinden faturalandırılır; bu nedenle 900.000 token'lık bir istek, token başına 9.000 token'lık bir istekle aynı maliyete sahiptir. Uzun bir istem (prompt) daha fazla token içerdiği için daha maliyetlidir, ancak uzun bağlam için ayrıca uygulanan farklı bir fiyat tarifesi bulunmamaktadır.

Fiyat değişikliğinden etkilenmeyen aritmetik

Her fatura iki çarpma ve bir toplama işleminden oluşur.

cost = (input_tokens  / 1,000,000) * input_rate
     + (output_tokens / 1,000,000) * output_rate

Çalıştırılabilir kod olarak yazımı:

INPUT_RATE = 2.00    # USD per million input tokens, Sonnet 5, August 2026
OUTPUT_RATE = 10.00  # USD per million output tokens

def cost(input_tokens, output_tokens):
    return (input_tokens * INPUT_RATE + output_tokens * OUTPUT_RATE) / 1_000_000

print(f"{cost(4300, 400):.4f}")

Bu kod 0.0126 çıktısını verir. 4,300 girdi token'ı gönderen ve 400 çıktı token'ı alan bir istek, Sonnet 5 üzerinde yaklaşık 1.3 cent tutar. İki fiyat oranını kodunuzda tek bir yerde tutun. Fiyat değiştiğinde iki satırı düzenlemeniz yeterlidir; sisteminizdeki tüm tahminler bu değişikliğe göre güncellenir.

Gerçek bir uygulama için hesaplanmış bir tahmin

Bir destek asistanı düşünün. Sistem istemi ve ürün dokümantasyonu 4.000 token tutuyor ve Messages API durumsuz (stateless) olduğu ve model çağrılar arasında hiçbir şeyi hatırlamadığı için her istekte bu veriler gönderiliyor. Bir kullanıcı sorusu yaklaşık 300 token ekliyor. Bir yanıt ise yaklaşık 400 token sürüyor. Bu da istek başına 4.300 girdi ve 400 çıktı tokeni demektir.

Bir milyon girdi tokeni, bu yapıda yaklaşık 232 isteği karşılar. Günde 1.000 istek alan uygulama günlük 4,3 milyon girdi tokeni tüketir; yani "1M token" altı saatlik trafikten daha az bir süreye denk gelir.

ChartEstimated cost per 1,000 requests at 4,300 input and 400 output tokens
The data behind this chart
[
  {
    "label": "Opus 5, list rates",
    "cost_per_1k_usd": "31.50"
  },
  {
    "label": "Sonnet 5, list rates",
    "cost_per_1k_usd": "12.60"
  },
  {
    "label": "Sonnet 5, Batch API",
    "cost_per_1k_usd": "6.30"
  },
  {
    "label": "Haiku 4.5, list rates",
    "cost_per_1k_usd": "6.30"
  },
  {
    "label": "Sonnet 5, warm prompt cache",
    "cost_per_1k_usd": "5.40"
  }
]

Claude Opus 5 üzerinde bu trafik, 1.000 istek başına $31.50 maliyet oluşturur. Sonnet 5 üzerinde bu tutar $12.60 seviyesindedir. Claude Haiku 4.5 modeline geçmek maliyeti $6.30 seviyesine düşürür; Sonnet 5 üzerinde aktif bir prompt cache kullanımı ise maliyeti $5.40 ile daha da aşağı çeker.

Bu trafiğin bir aylık maliyeti için 30 ile çarpın. Sonnet 5 liste fiyatlarıyla aylık yaklaşık 378 dolar tutar. Aynı uygulama, aktif bir önbellek ile yaklaşık 162 dolara mal olur. Model tercihiniz ve önbellekleme kararınızın her biri, bu hacimde müzakere edeceğiniz herhangi bir orandan daha değerlidir. Hangi modelin çalıştırılacağı ayrı bir konudur; değerlendirmelerinizden başarıyla geçen en ucuz model kazanan modeldir: Opus, Sonnet ve Haiku arasında seçim yapma bölümü, bunun nasıl doğru şekilde test edileceğini açıklar.

Prompt caching tekrarlanan kısmı azaltır

4.000 token'lık önek her istekte aynıdır ve her seferinde tam girdi ücreti ödersiniz. Prompt caching, işlenmiş öneki saklar ve yeniden kullanım için indirimli bir ücret uygular.

Bir önbellek okuması, temel girdi ücretinin 0.1 katına mal olur. Önbelleğe yazma işlemi, 5 dakikalık ömür için temel ücretin 1.25 katına, 1 saatlik ömür için ise 2 katına mal olur. Dolayısıyla 5 dakikalık önbellek, bir okumadan sonra kendini amorti eder; çünkü yazma işlemi 0.25 ekstra maliyet getirirken, her okuma 0.9 tasarruf sağlar. 1 saatlik önbelleğin maliyetini çıkarması için iki okuma gerekir.

Bunu etkinleştirmenin en basit yolu tek bir üst düzey alan kullanmaktır:

curl https://api.anthropic.com/v1/messages \
  -H "content-type: application/json" \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-opus-5",
    "max_tokens": 1024,
    "cache_control": {"type": "ephemeral"},
    "system": "You are a helpful assistant.",
    "messages": [
      {"role": "user", "content": "What are the key themes in Pride and Prejudice?"}
    ]
  }'

Ardından dönen usage bloğunu okuyun:

{
  "usage": {
    "cache_creation_input_tokens": 5120,
    "cache_read_input_tokens": 1800,
    "input_tokens": 50,
    "output_tokens": 503
  }
}

Bu üç girdi sayacı üç farklı oranda faturalandırılır ve toplamları gerçek girdi hacminizi oluşturur: total_input_tokens = cache_read_input_tokens + cache_creation_input_tokens + input_tokens. Yalnızca input_tokens değerini okuyan bir maliyet tahmini, önbellekleme açıldığında ciddi şekilde hatalı olacaktır.

Önbelleğin verimli olmasını engelleyen iki durum vardır ve her ikisi de sessizce başarısız olur.

Önek bayt bazında aynı olmalıdır. Önbellek araması bir önek eşleşmesidir; bu nedenle sistem isteminizin en üstündeki bir zaman damgası veya kullanıcı adı, her istekte öneki değiştirir. Bu durumda her seferinde temel girdi ücretinin 1.25 katını ödersiniz ve hiçbir zaman okuma yapamazsınız. Belirtisi, cache_creation_input_tokens değerinin yüksek kalması, cache_read_input_tokens değerinin ise 0 olmasıdır. cache_control ifadesini, içeriği istekler arasında aynı kalan son bloğun üzerine yerleştirin ve değişen her şeyi ondan sonraya koyun. tools tanımlarınızı değiştirmek, altındaki tüm önbelleği geçersiz kılar; çünkü geçersiz kılma işlemi araçlar, sistem ve mesajlar sırasıyla aşağıya doğru çalışır.

Önek yeterince uzun olmalıdır. Minimum önbelleklenebilir uzunluk Opus 5 modelinde 512 token, Sonnet 5 modelinde 1.024 token ve Haiku 4.5 modelinde 4.096 token'dır. Daha kısa bir istem önbelleğe alınmaz ve herhangi bir hata döndürülmez. Yukarıdaki örnekte yer alan 4.000 token'lık önek, Sonnet 5 üzerinde önbelleğe alınır ancak Haiku 4.5 üzerinde alınmaz; çünkü 4.000 değeri bu modelin alt sınırının altındadır. Her iki sayaç da 0 değerini gösterdiğinde, hiçbir şey önbelleğe alınmamış demektir.

Toplu işleme oranı yarıya indirir

Batch API, istekleri hem girdi hem de çıktı maliyetlerinde yüzde 50 indirimle asenkron olarak işler. Yukarıdaki örnekte bu durum, 1.000 istek başına 12.60 tutarındaki maliyeti 6.30 seviyesine düşürür. İndirim, prompt caching ile birleştirilebilir; bu nedenle önbelleğe alınmış bir toplu iş, büyük ölçekli çalışmaları yürütmenin en ekonomik yoludur.

Bu yöntemde feragat edilen unsur gecikme süresidir; bu da toplu işlemeyi, bir kullanıcının yanıt beklediği süreçler için uygunsuz kılar. Gece yapılan sınıflandırma işlemleri ve toplu belge işleme görevleri için uygundur.

Sohbet maliyetleri neden tek bir görüşme içerisinde artar

API herhangi bir durum bilgisi tutmadığı için, istemciniz her adımda tüm görüşmeyi yeniden gönderir. Bu nedenle tek bir sohbet içerisindeki token kullanımı, doğrusal bir şekilde değil, uzunluğunun karesiyle orantılı olarak artar.

Ortalama 500 token uzunluğundaki adımları ele alalım. 1. adım 500 girdi tokenı gönderir. 2. adım 1.000 gönderir. 20. adım ise 10.000 gönderir. Bunu n(n+1)/2 formülüyle topladığınızda, 20 adımlık bir görüşme yaklaşık 105.000 girdi tokenı göndermiş olur; oysa görüşme dökümünün kendisi yalnızca 10.000 token uzunluğundadır.

Sohbet özelliğinin maliyetinin dökümünden beklenenden daha yüksek olmasının ve uzun görüşmelerde sabit ön ekin önbelleğe alınmasının veya eski adımların özetlenmesinin maliyet açısından avantajlı olmasının nedeni budur. Araç çağrıları arasında döngüye giren bir aracı (agent) aynı yapıya sahiptir, hatta daha kötüdür: her araç sonucu geçmişte kalır ve sonraki her adımda yeniden gönderilir. Kendi çalıştırdığınız bir aracıya katı bir harcama limiti koymak burada en önemli konudur, çünkü bu büyüme otomatiktir ve kimse tarafından izlenmez.

Tahmin etmeden önce token sayısını hesaplayın

Token sayılarını kelime sayılarından türetmeyi bırakın. API, mesaj oluşturma hız sınırından bağımsız bir sınırla, bu sayımı sizin için ücretsiz olarak yapar.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "content-type: application/json" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-opus-5",
    "system": "You are a scientist",
    "messages": [{
      "role": "user",
      "content": "Hello, Claude"
    }]
  }'

Yanıt tek bir alan içerir:

{ "input_tokens": 14 }

Buraya gerçek sistem isteminizi (system prompt) ve araç tanımlarınızı, temsili bir kullanıcı mesajıyla birlikte besleyin, ardından çıkan sayıyı yukarıdaki maliyet fonksiyonuna yerleştirin. Uç nokta, bir mesaj isteğiyle aynı gövde yapısını kabul eder; bu nedenle görseller ve PDF dosyaları da doğru şekilde sayılır. İki önemli uyarı mevcuttur. Sayım bir tahmindir ve faturalandırılan rakamdan küçük farklılıklar gösterebilir. Ayrıca, kullandığınız modelin tokenizer'ı ile ölçülür; bu nedenle mutlaka gerçekte çalıştıracağınız modeli belirtin.

Çıktı token'ları henüz var olmadıkları için önceden sayılamazlar. Bunları max_tokens ile sınırlayın, ardından canlı trafikte usage.output_tokens üzerinden gerçek dağılımı ölçün.

Faturaya başka neler yansır

Faturanın büyük kısmını tokenlar oluşturur. Token olmayan birkaç kalem daha vardır ve bunlar kullanıcıları şaşırtabilir.

  • Araç tanımları, her istekte girdi tokenı olarak hesaba katılır. Yalnızca araç kullanım sistem istemi, kendi şemalarınızdan önce Opus 5 üzerinde 286 ila 406 arası token ekler. On adet ayrıntılı araç açıklaması, küçük bir istemin boyutunu ikiye katlayabilir.
  • Web araması, sonuçların bağlama girdiği sırada tükettiği tokenlara ek olarak, 1.000 arama başına 10 dolar üzerinden ücretlendirilir.
  • Web üzerinden veri çekme (web fetch) işlemi için ayrıca bir ücret alınmaz, ancak çekilen sayfa girdi tokenı haline gelir. 100 kB boyutundaki bir dokümantasyon sayfası yaklaşık 25,000 tokena denk gelir.
  • Claude 4.6 ve sonraki sürümlerde inference_geo ile yalnızca ABD tabanlı çıkarım talep etmek, önbellek okuma ve yazma işlemleri dahil olmak üzere her token kategorisine 1.1 çarpanı uygular.

API satın almanın doğru bir tercih olup olmadığı tamamen kullanım hacminize bağlıdır. Bir planda kullanım sınırına ulaşmak genellikle bu soruyu tetikler ve sınırlardan kurtulma yolları, bekleme süresinin dolmasını beklemekten iş yükünü metrik tabanlı API çağrılarına taşımaya kadar uzanır. Belirli bir kullanım seviyesinin altında sabit aylık planlar daha avantajlıdır ve Claude aboneliği ile API karşılaştırması, bu kıyaslamayı gerçek rakamlarla ortaya koyar.

FAQ

Claude üzerinde 1M token maliyeti ne kadardır?

Bu, kullanılan modele ve tokenların giriş mi yoksa çıkış mı olduğuna bağlıdır. Ağustos 2026 itibarıyla bir milyon giriş tokenı Claude Haiku 4.5 üzerinde $1, tanıtım fiyatlandırması kapsamında Claude Sonnet 5 üzerinde $2 ve Claude Opus 5 üzerinde $5 maliyete sahiptir. Çıkış maliyetleri, bu modellerin her birinde giriş oranının beş katıdır. Sonnet 5, 1 Eylül 2026 tarihinde $3 giriş ve $15 çıkış fiyatlandırmasına geçecektir. Fiyatlar değişebildiği için, bir bütçe planlaması yapmadan önce resmi fiyatlandırma sayfasından güncel oranları teyit edin.

1M token ile 1M kelime aynı şey midir?

Hayır. Bir token yaklaşık 4 İngilizce karakter veya 0,75 kelimeye denk gelir; dolayısıyla bir milyon token yaklaşık 750.000 kelime eder. Bu oran yalnızca bir kılavuzdur. Kod, JSON ve İngilizce dışındaki diller kelime başına daha fazla token kullanır. Claude Opus 4.7 ve sonraki sürümler, Claude Sonnet 4.6 ve önceki sürümlere kıyasla aynı metin için yaklaşık yüzde 30 daha fazla token üreten daha yeni bir tokenizer kullanır; bu nedenle token sayıları model nesilleri arasında taşınabilir değildir. Kullanmayı planladığınız modeli belirterek ücretsiz /v1/messages/count_tokens uç noktası ile ölçüm yapın.

Prompt caching her zaman tasarruf sağlar mı?

Hayır. 5 dakikalık bir önbellek yazma işlemi, temel giriş oranının 1,25 katına mal olur; bu nedenle yazılan ancak hiç okunmayan bir önek, metni doğrudan göndermekten yüzde 25 daha pahalıya gelir. Önbellek, ilk okumadan itibaren kendini amorti eder. İki şekilde başarısız olur ve her ikisi de sessizdir. Önbelleğe alınan önek istekler arasında değişirse, tam bir önek eşleşmesi arandığı için arama asla eşleşmez. Önek, Sonnet 5 üzerinde 1.024 ve Haiku 4.5 üzerinde 4.096 token olan modelin minimum önbelleklenebilir uzunluğundan kısaysa, hiçbir şey önbelleğe alınmaz ve hata döndürülmez. cache_creation_input_tokens ve cache_read_input_tokens değerlerinin her ikisi de 0 okuduğunda, önbellek işlevsiz durumdadır.

Faturam neden mesaj sayımdan daha hızlı arttı?

Çünkü tüm konuşma her adımda yeniden gönderilir. Messages API durum bilgisi tutmaz; bu nedenle bir sohbetin 20. adımı, önceki 19 adımın tamamını tekrar giriş olarak taşır. Adım başına ortalama 500 token kullanıldığında, 20 adımlık bir konuşma yaklaşık 105.000 giriş tokenı gönderir, oysa transkript sadece 10.000 token uzunluğundadır. Ajan döngüleri de aynı şekilde davranır, çünkü her araç sonucu geçmişte kalmaya devam eder. Sabit öneki önbelleğe alın veya eski adımları özetleyerek istekten çıkarın.