Claude kullanım limitleri ve çözüm yolları
Claude abonelik limitleri ile API 429 rate limit farklarını öğrenin. Model değiştirmenin neden işe yaramadığını ve kısıtlamaların nasıl çözüleceğini inceleyin.
Claude kullanım limitleri nelerdir?
Claude kullanım limitleri iki ayrı sistemden oluşur. İlk adım, hangi sistemin kısıtlamaya neden olduğunu belirlemektir. Bir Claude aboneliği (Pro, Max, Team veya Enterprise), modeller arasında paylaşılan ve Claude chat ile ortak kullanılan hareketli bir kullanım hakkı sunar; bu durumda You've hit your session limit · resets 3:45pm şeklinde bir mesajla kısıtlama uygulanır. Claude API ise farklı bir metrik ölçer: isteklerin ve tokenların dakikada ne kadar hızlı gönderildiğini hesaplar. Bu durumda rate_limit_error tipinde bir HTTP 429 hatası ve kaç saniye beklenmesi gerektiğini belirten bir retry-after başlığı ile kısıtlama uygulanır.
Bu iki durumun çözüm yöntemleri birbirinden tamamen farklıdır. Abonelik limiti, belirli bir zaman dilimi içinde ne kadar kullanım yapıldığıyla ilgilidir; bu nedenle sıfırlanmanın gerçekleşmesi beklenmeli veya daha fazla kullanım satın alınmalıdır. API hız limiti (rate limit) ise mevcut hızınızla ilgilidir ve hızı düşürdüğünüzde saniyeler içinde düzelir.
Plan kullanım hakları ve hız limiti kademe numaraları sık sık değişmektedir. Yanlış bir numara bilmek, hiç numara olmamasından daha risklidir; bu nedenle burada herhangi bir numara verilmemiştir. Kendi limitlerinizi aşağıda yer alan komutlarla öğrenebilirsiniz.
Hangi sınıra takıldınız? Tam mesajı okuyun
Claude Code, yazdırdığı metin içerisinde sistemi belirtir. Herhangi bir değişiklik yapmadan önce sizinkini tespit edin.
You've hit your session limit · resets 3:45pmbir abonelik sınırıdır. Planınızın bu zaman dilimi için geçerli olan hareketli kotası dolmuştur.You've hit your weekly limit · resets Mon 12:00amaynı sistemin daha uzun zaman dilimi için geçerli olan halidir.You've hit your Opus limit · resets 3:45pmyalnızca Opus istekleri için geçerli olan bir abonelik sınırıdır. Model değiştirmek bu durumda işe yarar.API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.bir API hız sınırıdır (rate limit). API anahtarınız, Amazon Bedrock veya Google Cloud projeniz için yapılandırılan sınıra ulaştınız.API Error: Server is temporarily limiting requests (not your usage limit)plan kotanızla ilgisi olmayan, kısa süreli bir kısıtlamadır (throttle). Claude Code, bu satırı göstermeden önce otomatik olarak bekleme süresiyle (backoff) tekrar deneme yapar.
Abonelik limitleri: oturum, haftalık ve Opus penceresi
Bir abonelik planı, sürekli yenilenen bir kullanım hakkı içerir. Hak tükendiğinde, Claude Code mesajda gösterilen sıfırlama zamanına kadar yeni istekleri engeller. Bu kullanım hakkının iki özelliği karmaşaya neden olmaktadır.
- Claude chat ile ortaktır. claude.ai üzerinde yapılan çalışmalar terminaldeki çalışmalarla aynı hakkı kullanır; dolayısıyla chat üzerinde yoğun bir öğleden sonra, kodlama akşamınızı kısaltır.
- Modeller arasında ortaktır. Oturum ve haftalık limitler, Opus limiti hariç olmak üzere, modele özel bir bütçe içermez.
Claude for Teams ve Enterprise sürümlerinde tanımlanan yapı; beş saatlik sürekli bir pencere ve haftalık bir pencere ile sıfırlanan, Claude chat ve Cowork ile paylaşılan ve koltuk kademesine (Standard veya Premium) göre belirlenen koltuk başına bir kullanım hakkıdır. Pro ve Max sürümlerinde, mesajda yazan sıfırlama zamanı ve kendi /usage çubuklarınız, bir blog yazısından alınan rakamlar değil, güvenilir verilerdir. Eğer hala bir kademe seçmeye çalışıyorsanız, hangi Claude planına ihtiyacınız olduğu her bir planın neleri kısıtladığını karşılaştırmaktadır.
/model komutu ile model değiştirmek neden erişimi geri getirmez
Bu en yaygın hatalı işlemdir ve dokümantasyon bu konuda nettir: oturum ve haftalık limitler tüm modeller arasında ortaktır, bu nedenle model değiştirmek erişimi geri getirmez. Oturum süresi dolduktan sonra daha küçük bir model seçmek, yalnızca yanıt verecek olan modeli değiştirir. Kalan kullanım miktarını değiştirmez; çünkü kullanım hakkı modele özel tutulmaz, dolayısıyla geçiş yapıldığında serbest bırakılacak bir limit bulunmaz.
İstisna, modele özgü bir üst sınır olan Opus limitidir. Eğer mesajda You've hit your Opus limit ifadesi yer alıyorsa, çözüm /model işlemidir. Başka bir modele geçerek çalışmaya devam edilebilir, çünkü yalnızca Opus istekleri engellenmiştir.
Limiti bir hata olarak değerlendirmek ikinci hatalı işlemdir. Yeniden kurulum yapmak veya yeniden kimlik doğrulaması yapmak durumu değiştirmez. Kullanım hakkı, zaman dilimi sıfırlandığında veya kullanım kredisi satın alındığında geri gelir.
Abonelik limitine ulaşıldığında yapılacaklar
- Sıfırlanma süresini kontrol edin. Oturum penceresi kısadır. Haftalık pencere için masa başında beklemeye gerek yoktur.
- Eğer Opus limitine ulaşıldıysa,
/modelkomutunu çalıştırın ve başka bir model seçin. - Plan limitlerini, kullanım miktarlarını ve sıfırlanma zamanlarını görmek için
/usagekomutunu çalıştırın./costkomutu aynı ekran için bir takma addır. - Limitlerin ötesinde çalışmaya devam etmek için
/usage-creditskomutunu çalıştırın. Pro ve Max planlarında ödeme ayarlarını açar. Team ve Enterprise planlarında organizasyonun kullanım ayarlarını açar veya ödeme yetkiniz yoksa yöneticilere talep gönderir. - Her hafta aynı limite takılıyorsanız, mevcut plan çalışma şekliniz için uygun değildir.
/usage-credits kullanımı için /login üzerinden oturum açılmış bir claude.ai aboneliği gereklidir. API key kimlik doğrulaması ile kullanılamaz; çünkü API key'in genişletilebilecek bir plan kotası yoktur.
Kullanım kredilerinin bilinmesi gereken bir yan etkisi vardır. Aboneliklerde prompt cache ömrü bir saattir; krediler kullanılmaya başlandığında ise beş dakikaya düşer. Bu durum, daha fazla etkileşimin sıfırdan başlamasına ve aynı iş için Claude Code token usage miktarının artmasına neden olur.
Kullanım limitlerine benzeyen ancak limit olmayan mesajlar
Dört adet Claude Code hatası kullanım limiti olarak raporlanır ancak bunlar limit değildir.
- Bir context veya auto-compact uyarısı kullanım limiti değildir. Sohbet modelin context window değerini geçtiğinde
Context exceeds the 200k-token limit by 94k tokens — run /compact or /clear to continue.gibi bir satır/contexttarafından yazdırılır. Eski geçmiş, alan boşaltmak için özetlenir ve plan kotanız etkilenmez. Error during compaction: Conversation too long. Press esc twice to go up a few messages and try again.,/compact'un kendisinin başarısız olduğu anlamına gelir; çünkü oluşturulacak özeti tutacak kadar boş context kalmamıştır.Credit balance is too low, Console organizasyonunuzun ön ödemeli kredilerinin bittiği anlamına gelir. platform.claude.com/settings/billing adresinden kredi ekleyin; bu adres otomatik yükleme seçeneği de sunar.API Error: Usage credits required for 1M context · run /usage-credits to turn them on, or /model to switch to standard contextbir yetki kontrolüdür, tükenmiş bir kota değildir.[1m]soneki olmayan model varyantını seçin veyaCLAUDE_CODE_DISABLE_1M_CONTEXT=1ayarını yapın.
Bir hata daha API'den kaynaklanır. 413 request_too_large bir hız limiti değil, tek bir istek için boyut limitidir.
API rate limits: 429 hatasının gerçek nedeni
Messages API, her bir model sınıfı için üç farklı metrik ölçer.
- dakika başına istek sayısı (RPM)
- dakika başına girdi token sayısı (ITPM)
- dakika başına çıktı token sayısı (OTPM)
Organizasyonunuzun ayrıca bir harcama limiti vardır; bu farklı bir konudur: API kullanımı için belirlenen maksimum aylık maliyet. Mevcut kademenizin (tier) harcama sınırına ulaşıldığında, daha yüksek bir limit talep edilmediği sürece API kullanımı bir sonraki aya kadar durdurulur. Hiçbir yeniden deneme döngüsü (retry loop) bu durumu çözmez.
429 hatasının ne zaman geleceğini dört mekanizma belirler.
- Limitler model sınıfı bazlıdır. Limitler her modele ayrı ayrı uygulanır; bu sayede farklı modelleri kendi limitleri dahilinde aynı anda kullanabilirsiniz. Bazı aileler ortak bir havuzu paylaşır: Opus rate limiti Claude Opus 4.8, Opus 4.7, Opus 4.6 ve Opus 4.5 modellerinin toplamıdır; Claude Sonnet 5 ise kendi limitine sahiptir.
- Kapasite sürekli yenilenir. API, token bucket algoritmasını kullanır; bu nedenle kapasite sabit bir zamanda sıfırlanmak yerine sürekli olarak dolar. Dakikada 60 istek limiti, saniyede bir istek şeklinde uygulanabilir; bu durumda aynı anda gönderilen 60 istek hata verecektir.
- Çoğu modelde sadece önbelleğe alınmamış (uncached) girdiler ITPM değerini etkiler.
input_tokensvecache_creation_input_tokenssayılır. Çoğu Claude modelindecache_read_input_tokenssayılmaz; Claude Haiku 3.5 bu konuda belgelenmiş tek istisnadır. Bu nedenle önbelleğe alma (caching), hem indirim sağlar hem de rate limit için pay bırakır. Çıktı tarafında ise yüksekmax_tokensdeğeri OTPM değerini etkilemez, çünkü OTPM yalnızca fiilen üretilen tokenları sayar. - Limitler organizasyon düzeyindedir. Bir çalışma alanına (workspace) daha düşük bir limit tanımlanabilir; organizasyon genelindeki limitler, çalışma alanı limitlerinin toplamı daha yüksek olsa bile her zaman geçerlidir. Bir çalışma alanında geçersiz kılınmayan (override) limitler, sınırsız bırakılmak yerine organizasyondan devralınır.
Start, Build, Scale ve Custom olarak adlandırılan kademeler, kullanım geçmişiniz ve hesap durumunuza göre otomatik olarak atanan gerçek sayıları belirler. Yeni organizasyonlar, yayınlanmış standart limitlerin altında başlayabilir; bu nedenle ilk 429 hatası bir tablodan daha erken gelebilir. Kullanımdaki ani artışlar hızlanma limitlerini (acceleration limits) tetikler; bu durum, kademenizin içinde olsanız bile 429 hatası almanıza neden olur, bu yüzden trafiği kademeli olarak artırın. Yayınlanan tüm rakamlar bir üst sınırdır: belgelenen limitler garanti edilen minimum değerler değil, izin verilen maksimum kullanım miktarlarıdır. Daha fazla limit talep etmek için Claude Console üzerindeki Limits sayfasında bulunan "Request rate limit increase" kontrolünü kullanın.
429: retry-after, header'lar ve SDK denemelerini okuma
Her API hatası aynı kapsayıcıyı döndürür: türü ve mesajı taşıyan iç içe geçmiş bir error nesnesi ve üst düzey bir request_id.
{
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "<names the rate limit you exceeded>"
},
"request_id": "req_011CSHoEeqs5C35K2UUqR7Fy"
}Diğer bilgiler header'larda yer alır.
retry-after, isteğin tekrar denenebileceği saniye sayısıdır. Erken yapılan denemeler başarısız olacaktır.anthropic-ratelimit-requests-limit,anthropic-ratelimit-requests-remainingveanthropic-ratelimit-requests-resetistek bütçesini tanımlar.anthropic-ratelimit-input-tokens-*veanthropic-ratelimit-output-tokens-*, ITPM ve OTPM için aynı limit, kalan ve sıfırlama (reset) sonekleriyle aynı işlemi yapar.anthropic-ratelimit-tokens-*, şu an geçerli olan en kısıtlayıcı limit değerlerini gösterir.
Sıfırlama (reset) header'ları RFC 3339 zaman damgalarıdır. Kalan token header'ları en yakın bin sayısına yuvarlanır, bu nedenle bunlar bir gösterge olarak okunmalıdır. Hızlı modun (fast mode) kendi havuzu ve kendi anthropic-fast-* header'ları vardır. Başarılı olan herhangi bir çağrıdan tüm header'lar okunabilir:
curl -s -D - -o /dev/null https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-5","max_tokens":16,"messages":[{"role":"user","content":"hi"}]}' \
| grep -i 'ratelimit\|retry-after\|request-id'Her yanıt ayrıca req_018EeWyXxfu5pfWkrYcMdjWG gibi benzersiz bir request-id header'ı taşır. Bu, hata gövdelerinde request_id olarak, Python ve TypeScript SDK yanıtlarında ise _request_id olarak görünür. Destek ekibiyle iletişime geçerken bu değeri belirtin.
Bir backoff döngüsü yazmadan önce buna gerçekten ihtiyacınız olup olmadığını kontrol edin. Resmi SDK'lar; bağlantı hataları, hız limitleri ve 5xx sunucu hataları dahil olmak üzere geçici hataları, varsayılan olarak iki kez, retry-after header'ı mevcut olduğunda bu header'a uyarak üstel geri çekilme (exponential backoff) ile otomatik olarak tekrar dener. Her istemci, bu davranışı değiştirmek veya devre dışı bırakmak için bir maximum-retries seçeneği kabul eder.
import anthropic
client = anthropic.Anthropic(max_retries=5) # the SDK default is 2
try:
msg = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "hello"}],
)
except anthropic.RateLimitError as err:
headers = err.response.headers
print("still limited after retries; wait", headers.get("retry-after"), "seconds")
print("request id:", headers.get("request-id"))529 overloaded_error sizin hatanız değildir
429 hatası, istek hızının çok yüksek olduğunu belirtir. 529 overloaded_error hatası ise API'nin geçici olarak aşırı yüklendiğini belirtir; bu durum, tüm kullanıcılar genelinde yüksek trafik oluştuğunda meydana gelebilir. Bu hata, API anahtarınızdan veya kodunuzdan kaynaklanmaz. SDK'lar 5xx yanıtları için zaten uygulanan exponential backoff yöntemiyle isteği tekrar deneyin ve sorun düzelmezse status.claude.com adresini kontrol edin. 500 api_error bir iç hatadır ve aynı şekilde tekrar denenmelidir; her iki hata da rate limit (hız sınırı) değildir.
Bir tablo yerine kendi limitlerinizi okuyun
Bir abonelikte, önemli olan ekran /usage ekranıdır. Bu ekran plan kullanım çubuklarını ve tüketim detaylarını gösterir; d veya w ile son 24 saat ile son 7 gün arasında geçiş yapılabilir. İki önemli nokta bulunmaktadır. Session bloğu API token kullanımını gösterir ve API kullanıcıları içindir; bu nedenle aboneler buradaki dolar tutarını dikkate almayabilir. Veriler, ilgili makinedeki yerel oturum geçmişinden gelir; bu yüzden başka bir cihazdan veya claude.ai üzerinden yapılan kullanımlar eksik görünür.
API tarafında, Claude Console içindeki Usage sayfası iki grafik çizer: "Rate Limit - Input Tokens" ve "Rate Limit - Output Tokens". Giriş grafiği, dakikadaki önbelleğe alınmamış (uncached) giriş tokenı saatlik maksimum değerini mevcut ITPM limitinizle karşılaştırarak gösterir; yan tarafında ise cache oranınız yer alır. Bu sayede, üretim ortamında limite çarpmak yerine limite yaklaşma durumunu takip edebilirsiniz.
Yapılandırılmış limitlerinizi programatik olarak okumak için:
curl -s https://api.anthropic.com/v1/organizations/rate_limits \
-H "x-api-key: $ANTHROPIC_ADMIN_KEY" \
-H "anthropic-version: 2023-06-01"Bir Admin API anahtarı gereklidir; GET /v1/organizations/workspaces/{workspace_id}/rate_limits ise her workspace için aynı işlemi gerçekleştirir. Her ikisi de salt okunurdur: bir limiti değiştirmek için Console içindeki Limits sekmesini kullanın.
Daha az kullanım ile limitlere takılmayın
Her iki sistem de altyapıda aynı metrikleri ölçer, bu nedenle bu yöntemler her ikisinde de geçerlidir.
- Tur başına daha az token harcayın. Sürekli işlemler cache belleğini sıcak tutar; ilgisiz görevler arasındaki
/clearherhangi bir maliyet oluşturmaz. Claude Code token kullanımı bu yöntemlerin tamamını kapsamaktadır. - Efor seviyesini düşürün. Seviyeler
low,medium,high,xhighvemaxşeklindedir./effortmenüsü ayrıca harcamayı düşürmek yerine artıranultracodeseçeneğini de sunar. Mekanik bir yeniden adlandırma işlemi için derin akıl yürütme (deep reasoning) kullanmak gereksizdir. - 429 hatasından sonra eşzamanlılığı azaltın.
CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCYdeğerini düşürün ve çok sayıda paralel alt ajan (subagent) kullanımından kaçının. Ayrıca/statusişlemini de gerçekleştirin: hatalı birANTHROPIC_API_KEYisteği, aboneliğiniz yerine düşük seviyeli bir anahtar üzerinden yönlendirir. - Etkileşim gerektirmeyen işları Message Batches API'ye taşıyın. Bu API, büyük hacimli işlemleri giriş ve çıkış tokenlarında %50 indirimle ve kendi hız limitleri dahilinde asenkron olarak çalıştırır; böylece gece çalışan işler oturumunuzla rekabet etmez.
Bir kişi yerine bir program tarafından yürütülen ani iş yükleri, en baştan bir API anahtarı ile yapılmalıdır. Bir VPS üzerinde ilk Claude API uygulamanız anahtar yönetimi ve yeniden denemeleri kapsar; ayrıca tmux içinde Claude Code çalıştırmak bağlantı kesilmelerine karşı uzun süreli ajan çalıştırmalarını korur.
FAQ
Model değiştirmek Claude kullanım limitimi neden düzeltmez?
Oturum ve haftalık limitler tüm modeller arasında ortaktır. Kullanım hakkı modele değil, plana aittir; bu nedenle /model işlemi sadece yanıt verecek modeli değiştirir, kalan kullanım miktarını değiştirmez. Tek istisna, yalnızca Opus istekleri için geçerli olan You've hit your Opus limit durumudur. Bu durumda model değiştirmek belgelenmiş çözüm yoludur.
429 rate_limit_error ne anlama gelir ve ne kadar beklemeliyim?
Bu hata, hesabınızın ilgili model sınıfı için belirlenen bir hız limitine ulaştığını gösterir: dakika başına istek sayısı, dakika başına girdi token sayısı veya dakika başına çıktı token sayısı. Yanıt, beklenmesi gereken saniye miktarını içeren bir retry-after başlığı taşır ve önceki denemeler başarısız olur. Resmi SDK'lar, bu başlığa uyarak hız limitlerini ve 5xx hatalarını varsayılan olarak iki kez üstel geri çekilme (exponential backoff) ile zaten tekrar dener. Plan limitleriniz dahilindeyken alınan bir 429 hatası, ani bir artış nedeniyle hız limitine takıldığınızı gösterir.
Claude kullanım limitlerimi ve sıfırlanma zamanlarını nasıl görebilirim?
Claude Code içerisinde; plan çubuklarını, sıfırlanma zamanlarını ve kullanım dökümünü görmek için /usage komutunu çalıştırın; /cost bir takma addır (alias), d veya w ise son 24 saat ile son 7 gün arasında geçiş yapar. Bu veriler yerel oturum geçmişinden gelir; bu nedenle diğer cihazlardaki veya claude.ai üzerindeki kullanımları kapsamaz. API tarafında, Console hız limitlerinizi grafiksel olarak gösterir, GET /v1/organizations/rate_limits ise bir Admin API anahtarı ile yapılandırılmış limitlerinizi döndürür.
Claude plan limitime ulaştıktan sonra çalışmaya devam edebilir miyim?
Bazen. Pro ve Max planlarında limiti aşan kullanım satın almak için /usage-credits komutunu, Team ve Enterprise planlarında ise bir yöneticiden talep etmek için kullanın; bu işlem /login üzerinden bir claude.ai girişi gerektirir ve API anahtarı kimlik doğrulaması ile kullanılamaz. Aksi takdirde sıfırlanma zamanını bekleyin, Opus limiti ise model değiştirin veya iş yükünü, zaman aralığı yerine dakika başına ölçüm yapan bir API anahtarına taşıyın.