Claude'da 1M Token Ne Kadar Tutar?
Claude API'de 1M token için tek fiyat yoktur: girdi ve çıktı ayrı ücretlendirilir. Model tarifelerini ve aylık fatura hesabını netleştirin.
Claude'da 1M tokenun maliyeti nedir?
1M token, bir milyon token anlamına gelir ve her Claude API (application programming interface) fiyatının belirtildiği birimdir. Tek bir fiyat yoktur. Bunun nedeni, girdi ve çıktının farklı tarifeler üzerinden ücretlendirilmesi ve her modelin kendine ait bir tarife çiftinin bulunmasıdır. Ağustos 2026 itibarıyla bir milyon girdi tokenunun maliyeti Claude Haiku 4.5 üzerinde $1, Claude Sonnet 5 üzerinde $2 ve Claude Opus 5 üzerinde $5 tutarındadır.
Çıktı daha pahalı kısımdır. Güncel tüm modellerde çıktı tarifesi, girdi tarifesinin beş katıdır. Bu nedenle faturayı başlıkta belirtilen rakamdan çok, girdi ve çıktı arasındaki dağılım belirler. Uzun belgeler gönderip kısa yanıtlar alan bir uygulama, kısa bir istemden uzun yanıtlar üreten bir uygulamadan çok farklı maliyet gösterir.
Bu sayfa birim ekonomisini açıklar: bir tokenun maliyetini ve uygulamayı geliştirmeden önce faturanın nasıl tahmin edileceğini ele alır. Çalışma sırasında tokenların gerçekte nereye gittiğini görmek için Claude Code oturumunda tokenların nereye gittiğini okuyun.
1M token neye karşılık gelir
Token, modelin okuduğu veya yazdığı bir metin parçasıdır. Anthropic'in yaklaşık kuralına göre 4 karakterde 1 token veya İngilizcede yaklaşık 0.75 kelime bulunur. Bu nedenle 1 milyon token yaklaşık 750,000 kelimeye veya kabaca 4 MB düz metne karşılık gelir.
Yaygın girdiler için yayımlanan tahminler, ölçeği daha iyi anlamayı sağlar.
The data behind this chart
[
{
"label": "Average web page (10 kB)",
"tokens": "2,500"
},
{
"label": "Documentation page (100 kB)",
"tokens": "25,000"
},
{
"label": "Research paper PDF (500 kB)",
"tokens": "125,000"
}
]Bu oranlarda 1M token, bir kez okunan yaklaşık 400 ortalama web sayfasına veya bu boyuttaki sekiz araştırma makalesine karşılık gelir. Orta boyutlu bir kod tabanının bir kez taranması veya bir kişinin bir ay boyunca düşük yoğunlukta sohbet kullanımı kadardır.
Bunların tümü tahmin olarak değerlendirilmelidir. Kod, JSON ve İngilizce dışındaki dillerdeki metinler bir token içine daha az kelime sığdırır. Bu nedenle 0.75 oranı iyimser üst sınırdır. Sayımı etkileyen başka bir nokta daha vardır: Opus 5 ve Sonnet 5'i de içeren Claude Opus 4.7 ve sonraki sürümler, aynı metin için Sonnet 4.6 ve önceki sürümlere göre yaklaşık yüzde 30 daha fazla token üreten yeni bir tokenizer kullanır. Claude Haiku 4.5 ise eski tokenizer'ı kullanır. Bu nedenle Haiku 4.5 üzerinde ölçtüğünüz bir sayı, aynı girdi için Sonnet 5 üzerindeki sayıyı olduğundan düşük gösterir. Bu da bu sınırın iki tarafındaki token başına milyon fiyat karşılaştırmasının doğrudan ve adil olmadığı anlamına gelir. Karar vermeden önce aynı istemi her iki modelde de sayın.
Claude milyon token başına ne kadar ücretlendiriyor
The data behind this chart
[
{
"label": "Haiku 4.5",
"input_usd": 1,
"output_usd": 5
},
{
"label": "Sonnet 5 (to 31 Aug 2026)",
"input_usd": 2,
"output_usd": 10
},
{
"label": "Sonnet 5 (from 1 Sep 2026)",
"input_usd": 3,
"output_usd": 15
},
{
"label": "Opus 5",
"input_usd": 5,
"output_usd": 25
}
]Claude Sonnet 5 için 31 August 2026 tarihine kadar giriş ücretinde $2, çıkış ücretinde ise $10 tutarında tanıtım fiyatı uygulanır. 1 September 2026 tarihinden itibaren standart ücret geçerli olur: giriş için $3, çıkış için $15. Claude Opus 5 için ücretler sırasıyla $5 ve $25 düzeyindedir.
Ücretler değişebilir. Bu sayfadaki her tutar August 2026 tarihli bir hesaplama örneği olarak değerlendirilmelidir. Bütçeyi kesinleştirmeden önce güncel tutarlar resmi fiyatlandırma sayfasından doğrulanmalıdır.
Bağlam uzunluğu ücreti değiştirmez. Claude 4.6 ve sonraki sürümlerde 1M tokenlık tam bağlam penceresi standart fiyatlandırma üzerinden ücretlendirilir. Bu nedenle 900,000 tokenlık bir istek, token başına 9,000 tokenlık bir istekle aynı ücrete mal olur. Uzun bir istem daha fazla token içerdiği için daha pahalıdır. Ayrı bir uzun bağlam ücreti uygulanmaz.
Fiyat değişikliğinde de geçerli olan hesaplama
Her fatura, iki çarpma ve bir toplama işleminden oluşur.
cost = (input_tokens / 1,000,000) * input_rate
+ (output_tokens / 1,000,000) * output_rateÇalıştırabileceğiniz kod olarak:
INPUT_RATE = 2.00 # USD per million input tokens, Sonnet 5, August 2026
OUTPUT_RATE = 10.00 # USD per million output tokens
def cost(input_tokens, output_tokens):
return (input_tokens * INPUT_RATE + output_tokens * OUTPUT_RATE) / 1_000_000
print(f"{cost(4300, 400):.4f}")Bu işlem 0.0126 değerini yazdırır. 4,300 giriş belirteci gönderip 400 çıkış belirteci alan bir istek, Sonnet 5 üzerinde yaklaşık 1.3 sente mal olur. İki ücreti kodunuzda tek bir yerde tutun. Fiyat değiştiğinde iki satırı düzenlemeniz yeterlidir; sisteminizdeki tüm tahminler buna göre güncellenir.
Gerçek bir uygulama için örnek hesaplama
Bir destek asistanı ele alınsın. Sistem istemi ve ürün belgeleri toplam 4.000 token tutar. Messages API durum bilgisi tutmadığı ve model çağrılar arasında hiçbir şeyi hatırlamadığı için bunlar her istekte gönderilir. Kullanıcı sorusu yaklaşık 300 token ekler. Bir yanıt yaklaşık 400 token tutar. Bu durumda istek başına 4.300 giriş ve 400 çıkış tokenı kullanılır.
Bir milyon giriş tokenı, bu yapıdaki yaklaşık 232 istek için yeterlidir. Uygulama günde 1.000 istek alıyorsa günlük 4,3 milyon giriş tokenı tüketir. Bu nedenle "1M tokens", altı saatten kısa süreli ağ trafiğine karşılık gelir.
The data behind this chart
[
{
"label": "Opus 5, list rates",
"cost_per_1k_usd": "31.50"
},
{
"label": "Sonnet 5, list rates",
"cost_per_1k_usd": "12.60"
},
{
"label": "Sonnet 5, Batch API",
"cost_per_1k_usd": "6.30"
},
{
"label": "Haiku 4.5, list rates",
"cost_per_1k_usd": "6.30"
},
{
"label": "Sonnet 5, warm prompt cache",
"cost_per_1k_usd": "5.40"
}
]Claude Opus 5 üzerinde bu ağ trafiğinin 1.000 istek başına maliyeti $31.50 olur. Sonnet 5 üzerinde maliyet $12.60 olur. Claude Haiku 4.5'e geçildiğinde maliyet $6.30 seviyesine iner. Sonnet 5 üzerinde önbelleğe alınmış ve etkin bir istem ile maliyet $5.40 seviyesine kadar düşer.
Bu ağ trafiğinin aylık maliyetini hesaplamak için 30 ile çarpın. Liste fiyatlarıyla Sonnet 5 için aylık maliyet yaklaşık $378 olur. Aynı uygulamanın önbellek etkin durumdaki maliyeti yaklaşık $162 olur. Bu kullanım hacminde model seçimi ve önbellekleme kararı, pazarlıkla elde edilebilecek herhangi bir indirimden daha fazla tasarruf sağlar. Hangi modelin kullanılacağı ayrı bir konudur. Değerlendirmeleri geçen en ucuz model seçilmelidir: Opus, Sonnet ve Haiku arasında seçim bu testin doğru şekilde nasıl yapılacağını açıklar.
İstem önbelleğe alma, tekrarlanan kısmı azaltır
Bu 4,000 tokenlık ön ek her istekte aynıdır ve bunun için her seferinde tam giriş ücreti ödenir. İstem önbelleğe alma, işlenmiş ön eki saklar ve yeniden kullanım için daha düşük ücret uygular.
Önbellekten okuma, temel giriş ücretinin 0.1 katına mal olur. Önbelleğe yazma işlemi, 5 dakikalık yaşam süresi için temel ücretin 1.25 katına, 1 saatlik yaşam süresi için 2 katına mal olur. Bu nedenle 5 dakikalık önbellek, tek bir okumadan sonra maliyetini karşılar. Yazma işlemi 0.25 ek ücrete mal olurken her okuma 0.9 tasarruf sağlar. 1 saatlik önbelleğin başa baş noktası iki okumadır.
Etkinleştirmenin en basit yolu, üst düzey tek bir alan eklemektir:
curl https://api.anthropic.com/v1/messages \
-H "content-type: application/json" \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-5",
"max_tokens": 1024,
"cache_control": {"type": "ephemeral"},
"system": "You are a helpful assistant.",
"messages": [
{"role": "user", "content": "What are the key themes in Pride and Prejudice?"}
]
}'Ardından dönen usage bloğu okunmalıdır:
{
"usage": {
"cache_creation_input_tokens": 5120,
"cache_read_input_tokens": 1800,
"input_tokens": 50,
"output_tokens": 503
}
}Bu üç giriş sayacı üç farklı ücret üzerinden faturalandırılır ve gerçek giriş hacmini oluşturmak üzere toplanır: total_input_tokens = cache_read_input_tokens + cache_creation_input_tokens + input_tokens. Yalnızca input_tokens değerini kullanan bir maliyet tahmini, önbelleğe alma etkinleştirildiğinde ciddi biçimde hatalı olur.
Önbelleğin maliyet avantajı sağlamasını engelleyen iki durum vardır. Her ikisi de sessizce gerçekleşir.
Ön ek, bayt düzeyinde aynı olmalıdır. Önbellek araması ön ek eşleştirmesi yapar. Bu nedenle sistem isteminin başına bir zaman damgası veya kullanıcının adını eklemek, ön eki her istekte değiştirir. Böylece her seferinde temel giriş ücretinin 1.25 katı ödenir ve hiçbir zaman okuma yapılmaz. Belirti, cache_creation_input_tokens değerinin yüksek kalırken cache_read_input_tokens değerinin 0 olarak kalmasıdır. İstekler arasında içeriği aynı olan son bloğa cache_control eklenmeli ve değişken tüm içerik bunun sonrasına yerleştirilmelidir. tools tanımlarının değiştirilmesi, altlarındaki önbelleğin tamamını geçersiz kılar. Çünkü geçersiz kılma sırasıyla tools, system ve messages üzerinden aşağı doğru yürütülür.
Ön ek yeterince uzun olmalıdır. Önbelleğe alınabilecek minimum uzunluk Opus 5 için 512 token, Sonnet 5 için 1,024 token ve Haiku 4.5 için 4,096 tokendir. Daha kısa bir istem önbelleğe alınmaz ve hata döndürülmez. Yukarıdaki örnekteki 4,000 tokenlık ön ek Sonnet 5 üzerinde önbelleğe alınır, Haiku 4.5 üzerinde ise alınmaz. Çünkü 4,000, bu modelin alt sınırının altındadır. Her iki sayaç da 0 gösteriyorsa hiçbir içerik önbelleğe alınmamıştır.
Toplu işleme ücreti yarıya indirir
Batch API, istekleri eşzamansız olarak işler. Hem giriş hem de çıkış için yüzde 50 indirim uygulanır. Yukarıdaki örnekte, 1.000 istek başına 12.60 ABD dolarını 6.30 ABD dolarına düşürür. Bu indirim prompt caching ile birleştirilebilir. Bu nedenle toplu işleri çalıştırmanın en düşük maliyetli yolu, önbelleğe alınmış bir toplu iştir.
Bunun karşılığında gecikme süresi artar. Bu nedenle batch, bir kişinin başında beklediği işlemler için uygun değildir. Gece boyunca yapılan sınıflandırma ve belgelerin geriye dönük işlenmesi için uygundur.
Tek bir görüşme içinde sohbet maliyetleri neden artar
API durum bilgisi tutmadığı için istemciniz her turda görüşmenin tamamını yeniden gönderir. Bu nedenle tek bir sohbet içindeki token kullanımı doğrusal değil, sohbet uzunluğunun karesiyle artar.
Ortalama 500 token içeren turlar ele alınsın. 1. turda 500 giriş tokenı gönderilir. 2. turda 1.000 token gönderilir. 20. turda 10.000 token gönderilir. Bu değerler n(n+1)/2 ile toplandığında, 20 turluk bir görüşmede yaklaşık 105.000 giriş tokenı gönderilmiş olur. Oysa görüşmenin dökümü yalnızca 10.000 token uzunluğundadır.
Bu nedenle bir sohbet özelliğinin maliyeti, dökümün gösterdiğinden daha yüksektir. Uzun yazışmalarda kararlı öneki önbelleğe almak veya eski turları özetlemek bu nedenle maliyetini karşılar. Araç çağrıları arasında döngüye giren bir agent da aynı yapıya sahiptir ve durum daha kötüdür: her araç sonucu geçmişte kalır ve sonraki her turda yeniden gönderilir. Kendi çalıştırdığınız bir agent için kesin bir harcama sınırı belirlemek özellikle burada önemlidir. Çünkü bu artış otomatik gerçekleşir ve bunu izleyen kimse olmayabilir.
Tahmin etmeden önce token sayısını hesaplayın
Token sayılarını sözcük sayılarına göre türetmeyi bırakın. API bunları ücretsiz olarak hesaplar. Bu işlem, mesaj oluşturma işleminden ayrı bir hız sınırına tabidir.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-5",
"system": "You are a scientist",
"messages": [{
"role": "user",
"content": "Hello, Claude"
}]
}'Yanıt tek bir alan içerir:
{ "input_tokens": 14 }Gerçek system prompt'unuzu ve tool tanımlarınızı temsili bir user mesajıyla birlikte gönderin. Ardından bu sayıyı yukarıdaki maliyet işlevine ekleyin. Endpoint, message isteğiyle aynı gövdeyi kabul eder. Bu nedenle görseller ve PDF dosyaları da doğru şekilde hesaba katılır. İki noktaya dikkat edilmelidir. Bu sayı bir tahmindir ve faturalandırılan değerden küçük ölçüde farklı olabilir. Ayrıca ölçüm, gönderdiğiniz modelin tokenizer'ı kullanılarak yapılır. Bu nedenle gerçekten çalıştıracağınız modeli gönderin.
Output token'ları önceden hesaplanamaz. Çünkü henüz mevcut değildirler. Bunları max_tokens ile sınırlandırın. Ardından canlı trafikte usage.output_tokens üzerinden gerçek dağılımı ölçün.
Faturaya eklenen diğer kalemler
Faturanın büyük bölümünü token'lar oluşturur. Bazı kalemler token değildir ve kullanıcılar bunları genellikle beklemez.
- Araç tanımları her istekte giriş token'larına dönüşür. Yalnızca araç kullanımına ilişkin sistem istemi, kendi şemalarınız eklenmeden önce, Opus 5 üzerinde 286 ile 406 token ekler. Ayrıntılı on araç açıklaması, küçük bir istemin boyutunu iki katına çıkarabilir.
- Web araması, sonuçların bağlama eklenmesiyle tüketilen token'lara ek olarak 1.000 arama başına $10 ücretlendirilir.
- Web fetch kendi başına ücret oluşturmaz, ancak getirilen sayfa giriş token'larına dönüşür. 100 kB boyutundaki bir dokümantasyon sayfası yaklaşık 25,000 giriş token'ı içerir.
- Claude 4.6 ve sonraki sürümlerde
inference_geoile yalnızca US bölgesinde çıkarım istenmesi, önbellek okuma ve yazma işlemleri dahil olmak üzere her token kategorisine 1.1 katsayısı uygular.
API'nin satın alınması gereken seçenek olup olmadığı kullanım hacmine bağlıdır. Belirli bir kullanım düzeyinin altında sabit aylık plan açıkça daha avantajlıdır ve Claude aboneliğiyle karşılaştırılan API bu karşılaştırmayı gerçek sayılarla yapar.
FAQ
Claude'da 1M tokenun maliyeti nedir?
Bu maliyet modele ve tokenların giriş veya çıkış olmasına bağlıdır. Ağustos 2026 itibarıyla bir milyon giriş tokenu Claude Haiku 4.5'te $1, giriş fiyatlandırmasına yönelik tanıtım dönemi kapsamında Claude Sonnet 5'te $2 ve Claude Opus 5'te $5 tutarındadır. Bu modellerin her birinde çıkış maliyeti, giriş ücretinin 5 katıdır. Sonnet 5 için giriş ücreti 1 Eylül 2026'da $3, çıkış ücreti ise $15 olacaktır. Ücretler değişebilir. Bu nedenle bir bütçeye rakam eklemeden önce resmi fiyatlandırma sayfasından ücretleri doğrulayın.
1M token, 1M kelimeyle aynı mıdır?
Hayır. Bir token İngilizcede yaklaşık 4 karaktere veya yaklaşık 0.75 kelimeye karşılık gelir. Bu nedenle bir milyon token yaklaşık 750,000 kelimedir. Bu oran yalnızca yaklaşık bir kılavuzdur. Kod, JSON ve İngilizce dışındaki diller kelime başına daha fazla token kullanır. Claude Opus 4.7 ve sonraki sürümler, aynı metin için Claude Sonnet 4.6 ve önceki sürümlere kıyasla yaklaşık yüzde 30 daha fazla token üreten daha yeni bir tokenizer da kullanır. Bu nedenle sayılar model nesilleri arasında doğrudan karşılaştırılamaz. Çalıştırmayı planladığınız modeli belirterek ücretsiz /v1/messages/count_tokens endpoint'ini kullanarak ölçüm yapın.
Prompt caching her zaman maliyet tasarrufu sağlar mı?
Hayır. 5 dakikalık önbellek yazma işlemi, temel giriş ücretinin 1.25 katına mal olur. Bu nedenle yazılan ancak hiç okunmayan bir prefix, açık şekilde gönderilmesine kıyasla yüzde 25 daha pahalıdır. İlk okumadan itibaren maliyetini karşılar. Bu işlem 2 şekilde başarısız olabilir ve her ikisi de sessizdir. İstekler arasında önbelleğe alınan prefix değişirse arama eşleşmez. Bunun nedeni eşleşmenin tam prefix eşleşmesi olmasıdır. Prefix, modelin önbelleğe alınabilir minimum uzunluğundan kısaysa hiçbir veri önbelleğe alınmaz ve hata döndürülmez. Bu minimum uzunluk Sonnet 5 için 1,024 token, Haiku 4.5 için 4,096 tokendir. cache_creation_input_tokens ve cache_read_input_tokens değerlerinin her ikisi de 0 olduğunda önbellek hiçbir işlem yapmıyordur.
Faturam neden mesaj sayımdan daha hızlı arttı?
Çünkü her turda konuşmanın tamamı yeniden gönderilir. Messages API durum bilgisi tutmaz. Bu nedenle bir sohbetin 20. turu, önceki 19 turun tamamını yeniden giriş olarak taşır. Turların ortalama 500 token olduğu durumda, 20 turluk bir konuşma, döküm yalnızca 10,000 token uzunluğunda olsa da yaklaşık 105,000 giriş tokenu gönderir. Her araç sonucu geçmişte kaldığı için agent döngüleri de aynı şekilde çalışır. Sabit prefix'i önbelleğe alın veya eski turları özetleyip istekten çıkarın.