SSD Nodes Learn Hosting plans →
Panduan Matt ConnorOleh Matt Connor · Diperbarui 2026-09-09

Berapa Token yang Didapat di Claude Pro?

Claude Pro tidak memiliki kuota token resmi. Penggunaan dihitung berdasarkan pesan dalam jendela bergulir, dan percakapan panjang menghabiskan batas lebih cepat. Cek batas Anda di sini.

Berapa banyak token yang disertakan dalam Claude Pro?

Claude Pro tidak menyertakan alokasi token, dan hingga September 2026 Anthropic tidak menerbitkan angka tersebut. Langganan Claude diukur berdasarkan jumlah pesan dalam jendela waktu bergulir, bukan berdasarkan token yang diambil dari suatu saldo. Batas dalam jendela tersebut bergantung pada model yang Anda pilih, panjang percakapan, dan jumlah teks yang disertakan pada setiap giliran.

Inilah jawaban yang jarang diberikan untuk pertanyaan ini karena orang mengira paket berfungsi seperti API key. API key menggunakan saldo yang dihitung dalam token, sehingga Anda dapat menghitung sendiri total tagihannya. Paket memberikan akses hingga batas yang ditetapkan dan disesuaikan oleh Anthropic. Batas tersebut dinyatakan dalam jumlah pesan, sehingga tidak ada angka token tetap yang dapat disebutkan. Siapa pun yang memberikan angka tersebut berarti mengada-adakannya.

Jadi, ajukan pertanyaan yang berbeda. Apa yang membuat pesan saya membutuhkan lebih banyak sumber daya? Pertanyaan itu memiliki jawaban yang jelas, dan Anda dapat menindaklanjutinya sekarang.

Mengapa langganan tidak dapat menyebutkan jumlah token

API mengenakan biaya untuk setiap permintaan berdasarkan token. Token input mencakup semua yang Anda kirim, sedangkan token output mencakup semua yang ditulis model sebagai respons. Keduanya memiliki tarif yang berbeda. Karena itu, biaya token input dan output berbeda sebelum Anda membuat estimasi.

Paket konsumen tidak memiliki saldo untuk dibelanjakan. Anthropic membatasi jumlah pesan yang dapat Anda kirim dalam jendela bergulir. Jendela ini dimulai saat Anda mengirim pesan pertama dan berakhir setelah jumlah jam tertentu. Paket berbayar juga memiliki batas kedua yang lebih panjang, yang dihitung dalam rentang satu minggu. Ukuran pesan tidak tetap. Karena itu, jumlah pesan yang sama dapat mewakili beban kerja yang sangat berbeda bagi dua orang. Halaman bantuan Anthropic menjelaskan batas tersebut dalam perkiraan jumlah pesan untuk percakapan singkat, lalu memperingatkan bahwa percakapan panjang dan lampiran besar menggunakan kuota lebih cepat. Peringatan itu menjelaskan keseluruhan mekanismenya, tetapi mekanisme yang mendasarinya hampir tidak pernah dijelaskan.

Mengapa turn 20 dalam chat jauh lebih mahal daripada turn 1

Model tidak menyimpan memori antarpanggilan. Model bersifat stateless, sehingga setiap turn mengirim ulang seluruh percakapan: system prompt, setiap pesan sebelumnya yang Anda tulis, setiap balasan sebelumnya dari Claude, dan setiap file yang Anda lampirkan. Pertanyaan baru Anda mungkin hanya terdiri dari dua puluh kata. Namun, request yang membawanya berisi seluruh transkrip.

Karena itu, biaya sebuah turn bertambah seiring panjang chat, dan pertambahannya bersifat linear. Baris di bawah menunjukkan perhitungan tersebut berdasarkan satu set asumsi pembulatan: system prompt sekitar 1.000 token, setiap pesan Anda sekitar 1.000 token, dan setiap balasan sekitar 1.200 token. Angka-angka ini hanya menggambarkan mekanismenya. Angka tersebut bukan pengukuran untuk akun Anda.

ChartInput tokens per turn as one conversation grows (illustration)
The data behind this chart
[
  {
    "label": "Turn 1",
    "sent_this_turn": "2,000",
    "cumulative_input": "2,000"
  },
  {
    "label": "Turn 5",
    "sent_this_turn": "10,800",
    "cumulative_input": "32,000"
  },
  {
    "label": "Turn 10",
    "sent_this_turn": "21,800",
    "cumulative_input": "119,000"
  },
  {
    "label": "Turn 20",
    "sent_this_turn": "43,800",
    "cumulative_input": "458,000"
  }
]

Pada turn pertama, 2,000 token input dikirim. Pada turn 20, pertanyaan singkat yang sama mengirim 43,800, lebih dari dua puluh kali lipat, meskipun jumlah teks yang Anda ketik sama. Sepanjang percakapan, Anda telah mengirim 458,000 token input, dan sebagian besarnya adalah teks yang sama, dikirim berulang kali.

Dua puluh chat satu-turn yang terpisah akan mengirim dua puluh kali jumlah pada baris pertama di atas, tanpa tambahan lainnya. Pertanyaannya sama, tetapi bebannya hanya sebagian kecil. Lampiran memperlebar perbedaan tersebut karena PDF yang Anda lampirkan pada turn kedua dikirim ulang pada turn ketiga, turn keempat, dan setiap turn berikutnya, terlepas dari apakah percakapan masih membahasnya.

Inilah sebabnya dua orang dengan paket yang sama dapat melaporkan penggunaan yang sangat berbeda. Salah satunya membiarkan satu thread tetap terbuka sepanjang minggu dan mencapai batas pada hari Rabu. Yang lain membuka chat baru untuk setiap tugas dan jarang mencapai batas. Tidak ada yang melakukan kesalahan. Penggunaan token mereka berbeda hingga satu orde magnitudo karena kebiasaan mereka berbeda.

Pada API, Anda dapat mengurangi biaya pengulangan dengan prompt caching. Fitur ini menyimpan bagian awal request yang tidak berubah, sehingga panggilan berikutnya untuk bagian tersebut dikenai tarif input yang lebih rendah. Pada subscription, Anda tidak mengendalikan caching. Karena itu, panjang percakapan adalah faktor yang benar-benar dapat Anda kendalikan. Mekanisme yang sama sangat berpengaruh pada sesi coding karena isi file dan definisi tool ikut dikirim pada setiap turn. Oleh karena itu, menjaga context sesi coding tetap kecil lebih membantu mempertahankan batas penggunaan daripada pengaturan apa pun. Anda juga sebaiknya membaca ke mana token sesi Claude Code sebenarnya digunakan sebelum menyalahkan paket yang Anda gunakan.

Relatif: apa yang didapatkan dari setiap tingkat paket

Tidak ada tingkat paket yang mencantumkan kuota absolut. Informasi yang tersedia bersifat relatif, dan gambaran relatif tersebut sudah cukup untuk menentukan pilihan. Free berada pada tingkat paling bawah, dan kapasitas gratis dapat berkurang ketika permintaan terhadap layanan sedang tinggi. Pro berada di atasnya. Max tersedia dalam dua ukuran, yang dijelaskan sebagai kelipatan penggunaan Pro, yaitu kira-kira lima kali dan kira-kira dua puluh kali. Team dan Enterprise dihargai per seat serta memiliki batasnya sendiri.

Anggap kelipatan tersebut sebagai gambaran tujuan, bukan kontrak. Anthropic menyesuaikan batasnya, dan penyesuaian itu tidak diumumkan sebelumnya. Karena itu, halaman yang jujur tidak dapat memberikan jumlah token yang pasti. Untuk aspek biaya dalam perbandingan yang sama, biaya Pro dan batasnya serta perbedaan antara dua tingkat Max membahasnya, sedangkan batas sebenarnya pada paket gratis menjelaskan tingkat paling dasar.

Pemilihan model menjadi pengali kedua di atas tingkat paket. Pertanyaan yang sama menggunakan porsi window yang lebih besar pada model terbesar dibandingkan model terkecil, karena biaya menjalankan model yang lebih berat per token juga lebih tinggi. Memindahkan pekerjaan rutin dari Opus ke Sonnet atau Haiku sering kali memberikan waktu kerja tambahan yang lebih besar daripada melakukan upgrade. Karena itu, menyesuaikan model dengan pekerjaan adalah langkah pertama yang perlu dicoba ketika Anda terus kehabisan kapasitas.

Cara melihat penggunaan Anda sendiri tanpa menebak

Akun Anda sendiri adalah sumber yang paling otoritatif, dan informasinya dapat diakses hanya dengan dua klik. Di claude.ai, buka Settings, lalu Usage. Di sana ditampilkan jumlah yang telah Anda gunakan dalam window saat ini dan waktu window tersebut di-reset. Periksa sekali saat balasan mulai ditolak, lalu sekali lagi setelah sesi yang panjang. Dengan demikian, Anda dapat memahami pola penggunaan sendiri lebih cepat daripada yang dapat dijelaskan oleh angka publik mana pun.

Di Claude Code, dua perintah slash melakukan hal yang sama dari terminal. /usage melaporkan penggunaan paket dan waktu reset. /context menguraikan bagian yang saat ini memenuhi context window, dengan memisahkan system prompt, definisi tool, file, dan riwayat percakapan. Saat /context menunjukkan bahwa percakapan lama mendominasi, /clear memulai sesi baru dan biaya per giliran turun kembali mendekati baris pertama pada diagram di atas.

Pada API, jumlahnya akurat, dan Anda dapat memintanya sebelum mengirim apa pun:

curl https://api.anthropic.com/v1/messages/count_tokens \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-sonnet-5",
    "messages": [{"role": "user", "content": "Summarise the attached report."}]
  }'

Respons yang normal berisi satu field, dan nilainya adalah angka yang akan digunakan untuk penagihan:

{"input_tokens": 14}

Setiap request yang selesai melaporkan perhitungan yang sama saat prosesnya berakhir:

{"usage": {"input_tokens": 21430, "output_tokens": 512}}

Kirim satu pertanyaan singkat sebagai request baru, lalu kirim pertanyaan yang sama di akhir thread yang panjang, dan bandingkan kedua nilai input_tokens tersebut. Selisihnya menunjukkan secara tepat dampak yang diukur oleh subscription Anda, dalam bentuk angka.

Apa yang harus dilakukan ketika batas tercapai di tengah tugas

  1. Tunggu hingga jendela dibuka kembali. Aplikasi menampilkan waktu reset, dan waktu tunggu sering kali lebih singkat daripada solusi sementara. Pilihan ini tepat jika tidak ada tugas yang mendesak.
  2. Beralih ke model yang lebih ringan. Model yang lebih kecil lebih murah untuk setiap giliran pada semua paket. Pada beberapa paket, model tersebut menggunakan kuota terpisah sehingga pekerjaan dapat berlanjut saat model berat menunggu reset.
  3. Mulai chat baru dengan hanya membawa hal yang dibutuhkan untuk langkah berikutnya. Tempelkan kesimpulan, bukan transkrip. Biaya per giliran langsung berkurang, dan jawaban biasanya membaik karena model tidak lagi harus mempertimbangkan ribuan token dari pembahasan yang sudah selesai.
  4. Pindahkan pekerjaan ke API. Di sana, token dihitung per permintaan dan ditagihkan per token. Anda tidak perlu menunggu jendela dibuka kembali, dan dapat melihat harga setiap pemanggilan sebelum dan sesudah permintaan dibuat.

Pilihan yang sesuai bergantung pada apakah masalah Anda adalah waktu atau beban kerja. Situasi mendesak yang hanya terjadi sekali merupakan masalah waktu. Batas yang Anda capai setiap hari Rabu merupakan masalah beban kerja. Dalam kasus itu, Anda memerlukan API atau paket yang lebih besar, bukan pengaturan waktu yang lebih baik. daftar periksa lengkap untuk batas yang tercapai di tengah tugas menjelaskan langkah pemulihan secara berurutan, sedangkan cara jendela bergulir dibuka dan direset menjelaskan alasan jam tersebut berperilaku seperti itu. Jika Anda berencana menggunakan API, hitung biayanya terlebih dahulu: perbandingan API dengan langganan untuk beban kerja yang sama dan biaya sebenarnya untuk satu juta token memberikan perhitungannya sebelum Anda beralih.

FAQ

Berapa banyak token yang termasuk dalam Claude Pro?

Anthropic tidak memublikasikan alokasi token untuk Pro, dan per September 2026 tidak ada angka yang dapat dikutip. Pro diukur berdasarkan jumlah pesan dalam jendela bergulir, dengan batas yang lebih panjang dihitung dalam periode satu minggu. Jumlah pesan yang dapat dikirim bergantung pada model dan panjang percakapan Anda. Halaman mana pun yang mencantumkan jumlah token bulanan tertentu untuk Pro hanya berspekulasi. Buka Settings, lalu Usage di claude.ai untuk melihat penggunaan Anda dan waktu reset.

Apakah memulai chat baru mereset penggunaan saya?

Tidak. Penggunaan dihitung untuk akun Anda di seluruh jendela, sehingga chat baru tidak mengembalikan kuota yang sudah digunakan. Perubahannya adalah biaya setiap giliran setelah itu. Chat baru tidak memiliki transkrip yang harus dikirim ulang, sehingga dimulai dari bagian bawah grafik di atas, bukan terus meningkat. Membuka chat baru saat topik berubah adalah kebiasaan yang paling hemat pada paket apa pun.

Mengapa hari ini saya mencapai batas lebih cepat daripada kemarin?

Biasanya karena pekerjaan hari ini berlangsung dalam satu thread panjang. Setiap giliran mengirim ulang seluruh percakapan beserta file yang dilampirkan, sehingga biaya per pesan terus meningkat meskipun jumlah pesan yang terlihat oleh Anda tetap sama. Penyebab umum lainnya adalah model yang digunakan. Model yang lebih berat menghabiskan alokasi lebih cepat pada setiap giliran, sehingga penggunaan model terbesar sepanjang sore berakhir lebih cepat daripada penggunaan model yang lebih kecil pada pagi hari.

Apakah saya sebaiknya beralih ke API untuk mendapatkan penghitungan token yang sebenarnya?

Beralihlah jika Anda memerlukan angka yang jelas atau penggunaan yang lebih dapat diprediksi. API menghitung token input dan output pada setiap panggilan, menyediakan endpoint penghitungan token yang dapat dijalankan sebelum pengiriman, dan tidak memiliki jendela yang harus ditunggu hingga berakhir. API menagih berdasarkan token, sehingga penggunaan berat lebih mahal daripada langganan tarif tetap, sedangkan penggunaan ringan jauh lebih murah. Hitung biaya berdasarkan beban kerja Anda yang sebenarnya dan bandingkan dengan paket saat ini sebelum beralih, karena hasilnya bergantung pada jumlah token yang Anda kirim.