SSD Nodes Learn
Panduan Matt ConnorOleh Matt Connor · Diperbarui 2026-07-24

Cara Mengatasi Batasan Penggunaan Claude

Pahami perbedaan limit langganan Claude dan error HTTP 429 pada API. Ketahui solusi tepat saat kuota habis atau saat terkena rate limit agar bisa segera lanjut.

Apa saja batasan penggunaan Claude?

Batasan penggunaan Claude terdiri dari dua sistem terpisah. Langkah pertama adalah menentukan sistem mana yang menghentikan Anda. Langganan Claude (Pro, Max, Team, atau Enterprise) memberikan kuota penggunaan berjalan yang dibagi antar model dan dibagikan dengan chat Claude, sehingga Anda akan menerima pesan seperti You've hit your session limit · resets 3:45pm. Claude API mengukur hal lain: seberapa cepat Anda mengirim permintaan dan token, yang dihitung per menit. API akan menghentikan Anda dengan error HTTP 429 tipe rate_limit_error dan header retry-after yang menyatakan berapa detik Anda harus menunggu.

Solusi untuk keduanya sangat berbeda. Batasan langganan berkaitan dengan jumlah penggunaan dalam satu jendela waktu, sehingga Anda harus menunggu reset atau membeli kuota tambahan. Batasan rate limit API berkaitan dengan kecepatan Anda saat ini, dan akan pulih dalam hitungan detik setelah Anda memperlambat kecepatan.

Angka kuota paket dan tingkatan rate limit sering berubah. Memberikan angka yang salah lebih buruk daripada tidak memberikan angka sama sekali, oleh karena itu tidak ada angka yang dicantumkan di sini. Periksa angka Anda sendiri dengan perintah di bawah ini.

Batas mana yang Anda lampaui? Baca pesan tepatnya

Claude Code menyebutkan nama sistem di dalam teks yang dicetak. Cocokkan dengan sistem Anda sebelum melakukan perubahan apa pun.

  • You've hit your session limit · resets 3:45pm adalah batas langganan. Kuota berjalan untuk jendela waktu ini pada paket Anda telah habis.
  • You've hit your weekly limit · resets Mon 12:00am adalah sistem yang sama untuk jendela waktu yang lebih panjang.
  • You've hit your Opus limit · resets 3:45pm adalah batas langganan yang hanya berlaku untuk permintaan Opus. Ini adalah satu-satunya kasus di mana mengganti model dapat membantu.
  • API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com. adalah batas rate API. Anda telah mencapai batas yang dikonfigurasi untuk API key Anda, atau untuk proyek Amazon Bedrock atau Google Cloud Anda.
  • API Error: Server is temporarily limiting requests (not your usage limit) adalah throttle jangka pendek yang tidak terkait dengan kuota paket Anda. Claude Code akan mencoba kembali secara otomatis dengan backoff sebelum menampilkan baris tersebut.

Batas langganan: sesi, mingguan, dan jendela Opus

Paket langganan mencakup kuota penggunaan berjalan. Jika kuota habis, Claude Code akan memblokir permintaan selanjutnya hingga waktu reset yang tertera pada pesan. Dua properti dari kuota tersebut sering menyebabkan kebingungan.

  • Kuota ini digunakan bersama dengan chat Claude. Pekerjaan yang Anda lakukan di claude.ai menggunakan kuota yang sama dengan pekerjaan di terminal, sehingga penggunaan chat yang intensif akan mengurangi kuota coding Anda.
  • Kuota ini digunakan bersama antar model. Batas sesi dan mingguan tidak memiliki anggaran per model, kecuali untuk batas Opus.

Pada Claude for Teams dan Enterprise, skema yang didokumentasikan adalah kuota per-kursi yang direset pada jendela lima jam berjalan dan jendela mingguan, digunakan bersama dengan chat Claude dan Cowork, serta ditentukan oleh tingkatan kursi (Standard atau Premium). Pada Pro dan Max, waktu reset yang tercetak pada pesan dan bar /usage Anda adalah angka yang akurat, bukan angka yang disalin dari postingan blog. Jika Anda masih memilih tingkatan, rencana Claude mana yang Anda butuhkan membandingkan batasan pada setiap paket.

Mengapa beralih model dengan /model tidak memulihkan akses

Ini adalah kesalahan yang paling umum, dan dokumentasi menyatakannya dengan jelas: batas sesi dan mingguan berlaku untuk semua model, sehingga beralih model tidak memulihkan akses. Memilih model yang lebih kecil setelah jendela sesi habis hanya mengubah model yang akan menjawab. Hal ini tidak mengubah sisa kuota, karena kuota tidak ditentukan per model, sehingga peralihan tidak melepaskan batasan apa pun.

Pengecualiannya adalah batas Opus, yang merupakan batasan khusus model. Jika pesan menunjukkan You've hit your Opus limit, maka /model adalah solusi yang tepat. Beralihlah ke model lain dan lanjutkan pekerjaan, karena hanya permintaan Opus yang diblokir.

Menganggap batasan ini sebagai bug adalah kesalahan kedua. Melakukan instalasi ulang atau autentikasi ulang tidak mengubah apa pun. Kuota akan kembali saat jendela waktu direset, atau saat Anda membeli kredit penggunaan.

Apa yang harus dilakukan saat mencapai batas langganan

  1. Periksa waktu reset. Jendela sesi sangat singkat. Jendela mingguan bukan sesuatu yang bisa Anda tunggu di depan meja kerja.
  2. Jika Anda mencapai batas Opus, jalankan /model dan pilih model lain.
  3. Jalankan /usage untuk melihat batas paket, kuota Anda, dan kapan kuota tersebut direset. /cost adalah alias untuk layar yang sama.
  4. Jalankan /usage-credits untuk terus bekerja melampaui batas. Pada paket Pro dan Max, perintah ini membuka pengaturan penagihan Anda. Pada paket Team dan Enterprise, perintah ini membuka pengaturan penggunaan organisasi Anda, atau mengirimkan permintaan ke admin jika Anda tidak memiliki akses penagihan.
  5. Jika Anda selalu mencapai batas yang sama setiap minggu, paket Anda tidak sesuai dengan pola kerja Anda.

/usage-credits memerlukan langganan claude.ai yang masuk melalui /login. Fitur ini tidak tersedia dengan autentikasi API key, karena API key tidak memiliki kuota paket untuk diperluas.

Kredit penggunaan memiliki satu efek samping yang perlu diketahui terlebih dahulu. Masa berlaku prompt cache adalah satu jam pada paket langganan dan turun menjadi lima menit setelah Anda menggunakan kredit, sehingga lebih banyak giliran (turns) dimulai dari kondisi awal (cold) dan penggunaan token Claude Code meningkat untuk beban kerja yang sama.

Pesan yang menyerupai batas penggunaan padahal bukan

Empat error Claude Code dilaporkan sebagai batas penggunaan, namun sebenarnya bukan.

  • Peringatan context atau auto-compact bukanlah batas penggunaan. /context mencetak baris seperti Context exceeds the 200k-token limit by 94k tokens — run /compact or /clear to continue. setelah percakapan melebihi context window model. Riwayat lama akan diringkas untuk mengosongkan ruang, dan kuota paket Anda tidak berkurang.
  • Error during compaction: Conversation too long. Press esc twice to go up a few messages and try again. berarti /compact itu sendiri gagal, karena tidak ada sisa context yang cukup untuk menampung ringkasan yang akan dihasilkan.
  • Credit balance is too low berarti organisasi Console Anda telah kehabisan kredit prabayar. Tambahkan kredit di platform.claude.com/settings/billing, yang juga menyediakan fitur auto-reload.
  • API Error: Usage credits required for 1M context · run /usage-credits to turn them on, or /model to switch to standard context adalah pemeriksaan hak akses (entitlement check), bukan kuota yang habis. Pilih varian model tanpa suffix [1m], atau atur CLAUDE_CODE_DISABLE_1M_CONTEXT=1.

Satu pesan lainnya berasal dari API. 413 request_too_large adalah batas ukuran pada satu request, bukan rate limit.

Batas rate limit API: apa yang sebenarnya dihitung oleh 429

Messages API mengukur tiga hal secara terpisah untuk setiap kelas model.

  • requests per minute (RPM)
  • input tokens per minute (ITPM)
  • output tokens per minute (OTPM)

Organisasi Anda juga memiliki batas pengeluaran, yang merupakan hal berbeda: biaya maksimum bulanan untuk penggunaan API. Setelah Anda mencapai batas pengeluaran tier Anda, penggunaan API akan berhenti hingga bulan berikutnya kecuali Anda meminta batas yang lebih tinggi. Loop retry tidak dapat menyelesaikan masalah ini.

Empat mekanisme menentukan kapan error 429 muncul.

  • Batas berlaku per kelas model. Batas ini diterapkan secara terpisah untuk setiap model, sehingga Anda dapat menggunakan model yang berbeda hingga batas masing-masing secara bersamaan. Beberapa keluarga berbagi kuota: rate limit Opus adalah total dari Claude Opus 4.8, Opus 4.7, Opus 4.6, dan Opus 4.5, sedangkan Claude Sonnet 5 memiliki batasnya sendiri.
  • Kapasitas terisi kembali secara kontinu. API menggunakan algoritma token bucket, sehingga kapasitas terisi kembali secara terus-menerus alih-alih diatur ulang pada waktu tertentu. Batas 60 request per minute dapat diterapkan sebagai satu request per detik, sehingga 60 request yang dikirim sekaligus tetap akan gagal.
  • Hanya input tanpa cache yang dihitung dalam ITPM pada sebagian besar model. input_tokens dan cache_creation_input_tokens dihitung. cache_read_input_tokens tidak dihitung pada sebagian besar model Claude, dengan Claude Haiku 3.5 sebagai pengecualian yang terdokumentasi. Oleh karena itu, caching memberikan ruang tambahan pada rate limit serta diskon. Pada sisi output, max_tokens yang tinggi tidak dihitung terhadap OTPM, karena OTPM hanya menghitung token yang benar-benar dihasilkan.
  • Batas berlaku pada level organisasi. Sebuah workspace dapat diberikan batas yang lebih rendah, dan batas seluruh organisasi selalu berlaku meskipun total batas workspace lebih besar. Batas yang tidak Anda ubah pada sebuah workspace akan diwarisi dari organisasi, bukan dibiarkan tanpa batas.

Tier bernama Start, Build, Scale, dan Custom menetapkan angka sebenarnya, yang diberikan secara otomatis berdasarkan riwayat penggunaan dan status akun Anda. Organisasi baru mungkin memulai di bawah batas standar yang dipublikasikan, sehingga error 429 pertama dapat muncul lebih awal dari prediksi tabel. Peningkatan penggunaan yang drastis memicu batas akselerasi, yang mengembalikan error 429 meskipun Anda masih dalam batas tier Anda, jadi tingkatkan trafik secara bertahap. Setiap angka yang dipublikasikan adalah plafon: batas yang terdokumentasi adalah penggunaan maksimum yang diizinkan, bukan jaminan minimum. Untuk meminta lebih banyak, gunakan kontrol "Request rate limit increase" pada halaman Limits di Claude Console.

Membaca 429: retry-after, header, dan retry pada SDK

Setiap error API mengembalikan envelope yang sama: objek error bersarang yang berisi tipe dan pesan, ditambah request_id pada level teratas.

{
  "type": "error",
  "error": {
    "type": "rate_limit_error",
    "message": "<names the rate limit you exceeded>"
  },
  "request_id": "req_011CSHoEeqs5C35K2UUqR7Fy"
}

Header berisi informasi lainnya.

  • retry-after adalah jumlah detik untuk menunggu sebelum Anda dapat mencoba kembali permintaan tersebut. Percobaan lebih awal akan gagal.
  • anthropic-ratelimit-requests-limit, anthropic-ratelimit-requests-remaining, dan anthropic-ratelimit-requests-reset menjelaskan budget permintaan Anda.
  • anthropic-ratelimit-input-tokens-* dan anthropic-ratelimit-output-tokens-* melakukan hal yang sama untuk ITPM dan OTPM, dengan suffix limit, remaining, dan reset yang sama.
  • anthropic-ratelimit-tokens-* menampilkan nilai untuk limit paling ketat yang sedang berlaku.

Header reset adalah timestamp RFC 3339. Header remaining token dibulatkan ke ribuan terdekat, jadi bacalah sebagai indikator. Fast mode memiliki pool sendiri dan header anthropic-fast-* sendiri. Baca semua header tersebut dari panggilan yang berhasil:

curl -s -D - -o /dev/null https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{"model":"claude-sonnet-5","max_tokens":16,"messages":[{"role":"user","content":"hi"}]}' \
  | grep -i 'ratelimit\|retry-after\|request-id'

Setiap respons juga menyertakan header request-id yang unik, seperti req_018EeWyXxfu5pfWkrYcMdjWG. Header ini muncul sebagai request_id pada body error dan sebagai _request_id pada respons SDK Python dan TypeScript. Sertakan header ini saat Anda menghubungi dukungan teknis.

Periksa apakah Anda benar-benar memerlukan backoff loop sebelum Anda membuatnya. SDK resmi secara otomatis melakukan retry pada kegagalan transien, termasuk error koneksi, rate limits, dan error server 5xx, menggunakan exponential backoff, sebanyak dua kali secara default, dengan mematuhi header retry-after jika tersedia. Setiap client menerima opsi maximum-retries untuk mengubah atau menonaktifkan perilaku tersebut.

import anthropic

client = anthropic.Anthropic(max_retries=5)  # the SDK default is 2

try:
    msg = client.messages.create(
        model="claude-sonnet-5",
        max_tokens=1024,
        messages=[{"role": "user", "content": "hello"}],
    )
except anthropic.RateLimitError as err:
    headers = err.response.headers
    print("still limited after retries; wait", headers.get("retry-after"), "seconds")
    print("request id:", headers.get("request-id"))

529 overloaded_error bukan kesalahan Anda

Error 429 berarti Anda melakukan permintaan terlalu cepat. Error 529 overloaded_error berarti API sedang mengalami beban berlebih untuk sementara waktu. Hal ini dapat terjadi saat API menerima trafik tinggi dari seluruh pengguna. Masalah ini bukan disebabkan oleh kunci API atau kode Anda. Lakukan percobaan ulang dengan metode exponential backoff, yang sudah diterapkan oleh SDK untuk respons 5xx, dan periksa status.claude.com jika masalah berlanjut. Error 500 api_error adalah kesalahan internal yang cara penanganannya sama, dan keduanya bukan merupakan pembatasan laju (rate limit).

Baca limit Anda sendiri alih-alih menggunakan tabel

Pada langganan, /usage adalah layar yang paling penting. Layar ini menampilkan bar penggunaan paket Anda dan rincian konsumsi sumber daya, serta sakelar d atau w untuk beralih antara 24 jam terakhir dan 7 hari terakhir. Ada dua catatan. Blok Session menampilkan penggunaan token API dan ditujukan untuk pengguna API, sehingga pelanggan dapat mengabaikan angka dolarnya. Data tersebut berasal dari riwayat sesi lokal pada mesin tersebut, sehingga penggunaan dari perangkat lain atau dari claude.ai tidak akan muncul.

Pada sisi API, halaman Usage di Claude Console menampilkan dua grafik, "Rate Limit - Input Tokens" dan "Rate Limit - Output Tokens". Grafik input memplot nilai maksimum per jam dari token input tanpa cache per menit terhadap limit ITPM Anda saat ini, dengan laju cache di sampingnya, sehingga Anda dapat memantau pendekatan limit sebelum terjadi masalah di produksi.

Untuk membaca limit yang telah dikonfigurasi secara terprogram:

curl -s https://api.anthropic.com/v1/organizations/rate_limits \
  -H "x-api-key: $ANTHROPIC_ADMIN_KEY" \
  -H "anthropic-version: 2023-06-01"

Anda memerlukan API key Admin, dan GET /v1/organizations/workspaces/{workspace_id}/rate_limits melakukan hal yang sama per workspace. Keduanya bersifat read-only: untuk mengubah limit, gunakan tab Limits di Console.

Menggunakan less, agar Anda menghadapi lebih sedikit batasan

Kedua sistem mengukur hal yang sama, sehingga pengaturan ini berlaku untuk keduanya.

  • Gunakan token lebih sedikit per giliran. Sesi yang berkelanjutan menjaga cache tetap hangat, dan /clear di antara tugas yang tidak terkait tidak memerlukan biaya tambahan. Penggunaan token Claude Code menjelaskan pengaturan tersebut secara lengkap.
  • Kurangi beban kerja. Tingkatan yang tersedia adalah low, medium, high, xhigh dan max. Menu /effort juga menawarkan ultracode, yang meningkatkan penggunaan alih-alih menguranginya. Penalaran mendalam untuk perubahan nama mekanis tidak memberikan keuntungan.
  • Kurangi konkurensi setelah muncul error 429. Turunkan CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY dan hindari penggunaan banyak subagent secara paralel. Jalankan /status juga: ANTHROPIC_API_KEY yang tidak teratur akan mengarahkan permintaan melalui kunci tier rendah, bukan melalui langganan Anda.
  • Pindahkan pekerjaan non-interaktif ke Message Batches API. API ini menjalankan volume besar secara asinkron dengan diskon 50% pada token input dan output, di bawah batasan rate limit tersendiri, sehingga pekerjaan rutin malam hari tidak mengganggu sesi Anda.

Pekerjaan yang bersifat bursty dan dijalankan oleh program, bukan manusia, sebaiknya menggunakan API key sejak awal. Aplikasi Claude API pertama Anda di VPS membahas penanganan kunci dan percobaan ulang (retries), dan proses agent yang lama akan tetap berjalan meskipun koneksi terputus jika Anda tetap menjalankan Claude Code di VPS di dalam tmux.

FAQ

Mengapa mengganti model tidak memperbaiki batas penggunaan Claude saya?

Karena batas sesi dan mingguan digunakan bersama oleh semua model. Kuota tersebut terikat pada paket langganan, bukan pada model tertentu, sehingga /model hanya mengubah model yang menjawab dan tidak mengubah sisa kuota. Satu-satunya pengecualian adalah You've hit your Opus limit, yang hanya berlaku untuk permintaan Opus. Untuk kasus tersebut, mengganti model adalah solusi yang telah didokumentasikan.

Apa arti error 429 rate_limit_error, dan berapa lama saya harus menunggu?

Ini berarti akun Anda telah mencapai batas kecepatan untuk kelas model tersebut: permintaan per menit, token input per menit, atau token output per menit. Respon tersebut menyertakan header retry-after yang berisi jumlah detik waktu tunggu, dan percobaan ulang sebelumnya akan gagal. SDK resmi sudah melakukan percobaan ulang otomatis untuk rate limit dan error 5xx dengan metode exponential backoff, sebanyak dua kali secara default, dengan mengikuti header tersebut. Error 429 yang muncul saat Anda masih dalam batas tier menunjukkan adanya limit akselerasi akibat lonjakan permintaan yang tiba-tiba.

Bagaimana cara melihat batas penggunaan Claude saya dan kapan batas tersebut direset?

Di Claude Code, jalankan /usage untuk melihat grafik paket, waktu reset, dan rincian penggunaan; /cost adalah alias, dan d atau w digunakan untuk beralih antara data 24 jam terakhir dan 7 hari terakhir. Data tersebut diambil dari riwayat sesi lokal, sehingga tidak mencakup penggunaan dari perangkat lain atau dari claude.ai. Pada API, Console menyediakan grafik rate limit, dan GET /v1/organizations/rate_limits mengembalikan konfigurasi limit Anda menggunakan API key Admin.

Bisakah saya tetap bekerja setelah mencapai batas paket Claude saya?

Bisa dalam beberapa kondisi. Jalankan /usage-credits untuk membeli tambahan penggunaan setelah mencapai batas pada paket Pro dan Max, atau untuk memintanya kepada admin pada paket Team dan Enterprise; ini memerlukan login claude.ai melalui /login dan tidak tersedia dengan autentikasi API key. Jika tidak, tunggulah hingga waktu reset, ganti model jika yang tercapai adalah limit Opus, atau pindahkan pekerjaan ke API key, yang menggunakan perhitungan per menit alih-alih per jendela waktu.