SSD Nodes Learn Hosting plans →
Rehberler Matt ConnorYazan Matt Connor · Güncellendi 2026-09-05

Claude Pro aylık mesaj ve token sınırı nedir?

Claude Pro aboneliğinde sabit bir token kotası bulunmaz. Kullanım, mesaj sayısı üzerinden dinamik olarak ölçülür. Uzun sohbetlerin sınırı nasıl etkilediğini öğrenin.

Claude Pro kaç token içerir?

Claude Pro belirli bir token kotası içermez ve Eylül 2026 itibarıyla Anthropic tarafından yayınlanmış bir kota bulunmamaktadır. Claude aboneliği, bakiyeden düşen tokenlar üzerinden değil, belirli bir zaman dilimi içerisindeki mesaj sayısı üzerinden sınırlandırılır. Bu zaman diliminin kapsamı; seçilen modele, görüşmenin uzunluğuna ve her bir mesajın içerdiği metin miktarına göre değişiklik gösterir.

İnsanlar bir abonelik planının API anahtarı gibi çalışmasını beklediği için bu soruya nadiren bu yanıt verilir. Bir API anahtarı, token cinsinden hesaplanan bir bakiyeyi harcar; böylece faturayı kendiniz hesaplayabilirsiniz. Bir abonelik planı ise Anthropic tarafından belirlenen ve dinamik olarak ayarlanan bir mesaj sınırına erişim satar; bu nedenle belirtilebilecek sabit bir token sayısı yoktur. Size kesin bir sayı veren herkes bunu uyduruyordur.

Bu yüzden farklı bir soru sorun. Mesajlarımı ne pahalı hale getirir? Bu sorunun gerçek bir yanıtı vardır ve bugün bu konuda aksiyon alabilirsiniz.

Aboneliklerde neden token sayısı için fiyat teklifi verilemez

API, her isteği token üzerinden faturalandırır. Giriş tokenları gönderdiğiniz her şeyi, çıkış tokenları ise modelin geri yazdığı her şeyi kapsar. Bu iki türün ücretlendirmesi farklıdır; bu nedenle herhangi bir tahmin yapmadan önce giriş ve çıkış tokenlarının maliyetleri farklıdır konusunu incelemelisiniz.

Tüketici planlarında harcanabilecek bir bakiye bulunmaz. Anthropic, ilk mesajınızla başlayan ve belirli bir saat sonra kapanan hareketli bir pencere içerisinde gönderebileceğiniz mesaj sayısını sınırlar. Ücretli planlarda ise hafta bazında ölçülen ikinci ve daha uzun bir sınır daha mevcuttur. Bir mesaj sabit boyutta değildir; dolayısıyla aynı mesaj sayısı, iki farklı kullanıcı için çok farklı miktarda iş yükü anlamına gelebilir. Anthropic'in yardım sayfaları, sınırları kısa bir sohbet için yaklaşık mesaj sayısı üzerinden tanımlar ve ardından uzun sohbetlerin veya büyük eklerin kotayı daha hızlı tüketeceği konusunda uyarır. Bu uyarı durumun tamamını özetler; ancak bu mekanizmanın arka planı neredeyse hiçbir zaman açıklanmaz.

Bir sohbetin 20. adımının 1. adımdan neden çok daha maliyetli olduğu

Model, istekler arasında herhangi bir bellek tutmaz. Durumsuzdur (stateless); bu nedenle her adımda tüm konuşma yeniden gönderilir: sistem istemi (system prompt), yazdığınız her önceki mesaj, Claude'dan gelen her önceki yanıt ve eklediğiniz her dosya. Yeni sorunuz yirmi kelime olabilir ancak bu soruyu taşıyan istek, tüm konuşma dökümünü içerir.

Bu nedenle bir adımın maliyeti, sohbetin uzunluğuyla doğru orantılı olarak artar. Aşağıdaki satırlar, varsayımsal bir senaryo üzerinden bu aritmetiği göstermektedir: yaklaşık 1.000 tokenlık bir sistem istemi, her biri yaklaşık 1.000 token olan mesajlarınız ve her biri yaklaşık 1.200 token olan yanıtlar. Bunlar mekanizmayı açıklamak içindir; hesabınıza ait bir ölçüm değildir.

ChartInput tokens per turn as one conversation grows (illustration)
The data behind this chart
[
  {
    "label": "Turn 1",
    "sent_this_turn": "2,000",
    "cumulative_input": "2,000"
  },
  {
    "label": "Turn 5",
    "sent_this_turn": "10,800",
    "cumulative_input": "32,000"
  },
  {
    "label": "Turn 10",
    "sent_this_turn": "21,800",
    "cumulative_input": "119,000"
  },
  {
    "label": "Turn 20",
    "sent_this_turn": "43,800",
    "cumulative_input": "458,000"
  }
]

Birinci adımda 2,000 girdi tokenı gönderilir. 20. adıma gelindiğinde, aynı kısa soru için 43,800 token gönderilir; bu, sizin tarafınızdan yapılan aynı miktardaki yazışma için yirmi katından fazla veri demektir. Konuşmanın tamamı boyunca toplam 458,000 girdi tokenı göndermiş olursunuz ve bunun büyük bir kısmı, tekrar tekrar gönderilen aynı metinlerden oluşur.

Yirmi adet ayrı tek adımlık sohbet, yukarıdaki ilk satırın yirmi katını gönderirdi ve başka hiçbir şey göndermezdi. Aynı sorular, yükün sadece bir kısmı. Ekler bu farkı daha da açar; çünkü ikinci adımda eklediğiniz bir PDF, konuşma artık onunla ilgili olsun ya da olmasın, üçüncü, dördüncü ve sonraki her adımda yeniden gönderilir.

Aynı plana sahip iki kişinin tamamen farklı kullanım sonuçları bildirmesinin nedeni budur. Biri tüm hafta boyunca tek bir sohbet dizisini açık tutar ve Çarşamba günü limite ulaşır. Diğeri ise her görev için yeni bir sohbet açar ve limite nadiren ulaşır. İkisi de yanlış bir şey yapmamaktadır. Token harcamaları, alışkanlıkları farklı olduğu için bir büyüklük mertebesi kadar farklılık gösterir.

API üzerinde, isteğin değişmeyen ön kısmını saklayan ve sonraki çağrıların o kısım için indirimli girdi oranından ücretlendirilmesini sağlayan prompt caching ile tekrar maliyetini düşürebilirsiniz. Aboneliklerde önbelleğe alma (caching) üzerinde kontrolünüz yoktur, bu nedenle elinizdeki asıl araç konuşma uzunluğudur. Aynı mekanizma, dosya içeriklerinin ve araç tanımlarının her adımda taşındığı kodlama oturumlarında da baskındır; bu yüzden bir kodlama oturumunun bağlamını küçük tutmak, herhangi bir ayardan daha fazla limit tasarrufu sağlar ve Claude Code oturumundaki tokenların gerçekte nereye gittiği konusunu, planı suçlamadan önce okumakta fayda vardır.

Her plan seviyesinin sağladığı imkanlar, göreceli terimlerle

Hiçbir seviye için mutlak bir kullanım kotası yayınlanmamaktadır. Yayınlanan veriler görecelidir ve seçim yapmak için bu göreceli tablo yeterlidir. Free seviyesi en altta yer alır ve hizmet üzerindeki talep yüksek olduğunda Free kapasitesi daralabilir. Pro seviyesi bunun üzerinde konumlanır. Max ise Pro kullanımının katları olarak tanımlanan iki boyutta satılır; bunlar kabaca beş katı ve yirmi katı kadardır. Team ve Enterprise planları kullanıcı başına fiyatlandırılır ve kendi sınırlarına sahiptir.

Bu çarpanları bir sözleşmeden ziyade bir niyet beyanı olarak değerlendirin. Anthropic sınırları sürekli ayarlar ve bu ayarlamalar önceden duyurulmaz; dürüst hiçbir sayfanın size kesin bir token sayısı verememesinin bir diğer nedeni de budur. Karşılaştırmanın maliyet tarafı için Pro maliyeti ve sınırları ve iki Max seviyesi arasındaki fark konuları incelenebilir; Free planın gerçekte neleri kapsadığı ise alt sınırı belirler.

Model seçimi, seviyenin üzerinde ikinci bir çarpan olarak işlev görür. Aynı soru, en büyük modelde en küçük modele göre daha fazla kota tüketir; çünkü daha ağır bir modelin token başına çalıştırma maliyeti daha yüksektir. Rutin işleri Opus yerine Sonnet veya Haiku ile yapmak, genellikle bir üst plana geçmekten daha fazla çalışma süresi kazandırır. Bu nedenle, sürekli kota sınırına takılıyorsanız ilk yapmanız gereken modeli işe göre eşleştirmektir.

Tahmin etmek yerine kendi kullanımınızı nasıl görürsünüz

Kendi hesabınız tek yetkili kaynaktır ve sadece iki tıklama uzağınızdadır. claude.ai üzerinde Ayarlar (Settings), ardından Kullanım (Usage) kısmını açın. Mevcut pencerede ne kadar tükettiğinizi ve bu pencerenin ne zaman sıfırlanacağını gösterir. Yanıtlar reddedilmeye başladığında bir kez ve uzun bir oturumdan sonra bir kez kontrol edin; kendi kullanım düzeninizi, yayınlanmış herhangi bir verinin öğretebileceğinden daha hızlı öğrenirsiniz.

Claude Code içerisinde iki eğik çizgi komutu, terminalden aynı işi yapar. /usage plan kullanımını ve sıfırlama zamanını raporlar. /context şu anda bağlam penceresini neyin doldurduğunu; sistem istemini, araç tanımlarını, dosyaları ve konuşma geçmişini ayırarak detaylandırır. /context eski konuşmanın baskın olduğunu gösterdiğinde, /clear yeni bir oturum başlatır ve tur başına maliyet yukarıdaki tablonun ilk satırına doğru düşer.

API üzerinde sayım kesindir ve herhangi bir şey göndermeden önce bunu talep edebilirsiniz:

curl https://api.anthropic.com/v1/messages/count_tokens \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-sonnet-5",
    "messages": [{"role": "user", "content": "Summarise the attached report."}]
  }'

Sağlıklı bir yanıt tek bir alandan oluşur ve bu, faturalandırmanın kullanacağı sayıdır:

{"input_tokens": 14}

Tamamlanan her istek, bittiğinde aynı muhasebe bilgisini raporlar:

{"usage": {"input_tokens": 21430, "output_tokens": 512}}

Yeni bir istek olarak kısa bir soru gönderin, ardından aynı soruyu uzun bir iş parçacığının sonunda gönderin ve iki input_tokens değerini karşılaştırın. Aradaki fark, aboneliğinizin ölçümlediği etkinin tam olarak kendisidir ve bir sayı olarak yazılmıştır.

Limit bir görev ortasında dolduğunda ne yapılmalı

  1. Pencerenin açılmasını bekleyin. Uygulama sıfırlama zamanını gösterir; bekleme süresi genellikle geçici çözümlerden daha kısadır. Acil bir işiniz yoksa en doğru yöntem budur.
  2. Daha hafif bir modele geçin. Daha küçük bir model, her planda işlem başına daha ucuzdur ve bazı planlarda ayrı bir kotadan harcama yapar; böylece ağır model dinlenirken işiniz devam eder.
  3. Yalnızca bir sonraki adım için gerekenleri içeren yeni bir sohbet başlatın. Tüm konuşma geçmişini değil, sadece ulaşılan sonucu yapıştırın. İşlem başına maliyet anında düşer ve model binlerce token'lık eski tartışmaları değerlendirmek zorunda kalmadığı için yanıtlar genellikle iyileşir.
  4. İşi, token'ların istek başına sayıldığı ve token başına faturalandırıldığı API'ye taşıyın. Beklemeniz gereken bir pencere yoktur ve her çağrının maliyetini işlem öncesinde ve sonrasında görebilirsiniz.

Hangi seçeneğin uygun olduğu, sorunun zamandan mı yoksa iş yükünden mi kaynaklandığına bağlıdır. Tek seferlik bir yoğunluk, bir zamanlama sorunudur. Her Çarşamba çarptığınız bir duvar ise iş yükü sorunudur; bu durumda daha iyi bir zamanlamadan ziyade API veya daha geniş kapsamlı bir plan gerekir. limit bir görev ortasında dolduğunda yapılacaklar kontrol listesi, kurtarma sürecini adım adım açıklar; kayan pencerelerin nasıl açılıp sıfırlandığı ise zamanlayıcının neden bu şekilde çalıştığını anlatır. Eğer API'ye geçmeyi düşünüyorsanız önce maliyet hesabı yapın: aynı iş yükü için API ile aboneliğin karşılaştırılması ve bir milyon token'ın gerçek maliyeti, geçiş yapmadan önce ihtiyacınız olan aritmetik verileri sağlar.

FAQ

Claude Pro ne kadar token içerir?

Anthropic, Pro aboneliği için bir token kotası yayınlamamaktadır ve Eylül 2026 itibarıyla referans verilebilecek böyle bir sayı bulunmamaktadır. Pro, kayan bir pencere içindeki mesaj sayısı üzerinden ölçülür ve haftalık bazda daha uzun bir sınır uygulanır; kaç mesajın bu sınıra sığacağı ise kullanılan modele ve konuşmanın uzunluğuna göre değişir. Pro için belirli bir aylık token miktarı belirten her sayfa tahminde bulunmaktadır. Kendi kullanımınızı ve sıfırlanma zamanınızı görmek için claude.ai üzerinde Settings, ardından Usage menüsünü açın.

Yeni bir sohbet başlatmak kullanım limitimi sıfırlar mı?

Hayır. Kullanım, hesabınız için belirli bir pencere genelinde hesaplanır; bu nedenle yeni bir sohbet, daha önce harcadığınız hakkı geri vermez. Yeni bir sohbetin değiştirdiği şey, o noktadan itibaren her bir etkileşimin maliyetidir. Yeni bir sohbetin yeniden gönderilecek bir geçmişi yoktur, bu yüzden yukarıdaki grafiğin üst kısımlarına tırmanmak yerine en düşük seviyeden başlar. Konu değiştiğinde yeni bir sohbet açmak, herhangi bir planda uygulanabilecek en ekonomik alışkanlıktır.

Neden limite bugün dünden daha hızlı ulaştım?

Genellikle bugünkü çalışmalarınız tek bir uzun sohbet dizisi içinde gerçekleştiği için. Her etkileşim, tüm konuşmayı ve ekli dosyaları yeniden gönderir; bu nedenle mesaj sayısı size aynı görünse de mesaj başına maliyet istikrarlı bir şekilde artar. Diğer yaygın neden ise model seçimidir: daha ağır modeller, etkileşim başına kotayı daha hızlı tüketir; bu nedenle en büyük modelle geçirilen bir öğleden sonra, daha küçük bir modelle geçirilen bir sabahtan daha kısa sürede sona erer.

Gerçek token sayımı için API'ye geçmeli miyim?

Sayılara veya öngörülebilirliğe ihtiyacınız varsa geçiş yapın. API, her çağrıda girdi ve çıktı tokenlarını sayar, göndermeden önce çalıştırabileceğiniz bir token sayma uç noktası sunar ve beklemeniz gereken bir pencere süresi yoktur. Token başına faturalandırma yapar; bu nedenle yoğun kullanım sabit bir abonelikten daha maliyetli, hafif kullanım ise çok daha ucuz olabilir. Geçiş yapmadan önce gerçek iş yükünüzü mevcut planınızla kıyaslayın, çünkü sonuç gönderdiğiniz token miktarına bağlı olarak değişecektir.