Claude API vs Langganan Mana Lebih Murah?
Bandingkan biaya per-token Claude API dengan biaya paket bulanan. Pelajari cara menghitung titik impas penggunaan agar Anda tidak salah memilih metode bayar.
Apakah Claude API lebih murah daripada langganan?
Claude API lebih murah daripada langganan jika penggunaan berada di bawah volume tertentu, dan lebih mahal jika di atasnya. Untuk satu pengembang yang melakukan coding secara interaktif sepanjang hari, paket flat biasanya lebih menguntungkan. Untuk program yang melakukan pemanggilan sendiri, API adalah satu-satunya pilihan, sehingga biaya bukan menjadi penentu. Sisanya adalah perhitungan aritmatika yang dapat Anda lakukan dalam sepuluh menit.
Tidak ada angka titik impas (break-even) resmi untuk dicari. Sisi langganan dijual dalam bentuk jendela penggunaan, bukan kuota token, sehingga tidak ada angka yang dipublikasikan untuk menunjukkan di mana kedua garis tersebut berpotongan. Berikut adalah rumusnya, berdasarkan tarif per-token saat ini, ditambah faktor perilaku Anda sendiri yang dapat mengubah hasil jauh lebih besar daripada biaya paket. Setiap angka titik impas di bawah ini adalah perhitungan saya sendiri dari tarif yang dipublikasikan dan asumsi yang dinyatakan, bukan angka resmi yang terdokumentasi.
Jika Anda masih memutuskan paket mana yang akan dibeli, paket Claude mana yang sesuai dengan cara kerja Anda menjawab hal tersebut. Postingan ini mengasumsikan Anda sudah tahu paket mana yang akan dibeli, dan ingin tahu apakah sebaiknya Anda membelinya atau tidak.
Dua model penagihan dengan bentuk yang berbeda
Langganan adalah kapasitas yang mungkin tidak Anda gunakan. Anda membayar biaya tetap dan mendapatkan kuota yang diatur ulang sesuai jadwal. Dokumentasi Claude Code dari Anthropic menyatakan bentuk untuk slot Team dan Enterprise: penggunaan "mengambil dari kuota per-slot yang diatur ulang pada jendela lima jam yang berjalan dan jendela mingguan", yang dibagikan dengan Claude chat dan Cowork. Pelanggan paket langganan menghadapi bentuk yang sama melalui jumlah pesan yang mereka capai, yang berbunyi "You've hit your session limit" dan "You've hit your weekly limit". Kapasitas yang tidak Anda gunakan adalah uang yang tetap Anda keluarkan. Kapasitas yang terlampaui akan menghentikan pekerjaan Anda hingga jendela diatur ulang, dan mengganti model dengan /model tidak memulihkan akses, karena jendela tersebut dibagikan di seluruh model.
API adalah meteran yang tidak pernah berhenti. Tidak ada jendela dan tidak ada batas. Setiap permintaan dihargai per token, dan beberapa hal dihargai di luar token: pencarian web "tersedia pada Claude API seharga $10 per 1.000 pencarian". Tidak ada yang berhenti pada batas tertentu. Tagihan Anda hanya akan terus bertambah.
Biaya paket per 23 Juli 2026, dikutip dari halaman harga Claude: Pro adalah "$17 Per bulan dengan diskon langganan tahunan ($200 ditagih di muka). $20 jika ditagih bulanan", dan sudah termasuk Claude Code. Max terdaftar sebagai "Mulai dari $100 Per bulan". Slot Team mulai dari "$20 Per slot / bulan jika ditagih tahunan". Enterprise adalah yang paling menarik, karena menjalankan kedua model sekaligus: "Harga slot + penggunaan pada tarif API $20/slot". Biaya sering berubah, dan kuota di balik setiap paket tidak pernah dipublikasikan dalam token, jadi bacalah halaman harga pada hari Anda memutuskan.
Apa yang tidak bisa Anda dapatkan dari API
Kuota paket, dan antarmuka yang dibangun di sekitarnya. Perintah /usage-credits pada Claude Code mengelola kredit penggunaan langganan, dan Anda menjalankannya "setelah masuk dengan langganan claude.ai Anda melalui /login; perintah ini tidak tersedia dengan autentikasi API key." Layar /usage juga berbeda berdasarkan mode penagihan: blok Session-nya "menampilkan penggunaan token API dan ditujukan untuk pengguna API", sedangkan pelanggan melihat bilah penggunaan paket dan rincian penggunaan sebagai gantinya.
Cache prompt yang lebih lama di Claude Code. Hal ini memerlukan biaya nyata dan mudah terlewatkan. Dokumentasi menyatakan "Masa aktifnya adalah satu jam pada langganan dan turun menjadi lima menit setelah Anda menggunakan kredit penggunaan; pada API key atau penyedia cloud, secara default adalah lima menit". Pesan pertama Anda setelah jeda yang lebih lama dari masa aktif cache akan kehilangan cache, sehingga seluruh konteks Anda diproses ulang dan ditagih dengan harga penulisan (write). Pada langganan, Anda dapat melakukan rapat selama lima puluh menit dan kembali dengan kondisi cache masih ada. Pada API key, jeda yang sama akan memakan biaya penulisan ulang seluruh prefix sesi.
Apa yang tidak bisa Anda dapatkan dari langganan
Akses programatik. Pekerjaan cron atau penangan webhook yang memanggil Claude memerlukan API key, jadi jika itu adalah beban kerja Anda, maka perbandingannya sudah selesai. Membangun aplikasi Claude API pertama Anda di VPS membahas penanganan key dan skrip kerja pertama.
Diskon Batch API. Halaman harga menyatakannya dengan jelas: "Batch API memungkinkan pemrosesan asinkron untuk volume permintaan yang besar dengan diskon 50% pada token input dan output." Hal ini memotong biaya meteran untuk pekerjaan apa pun yang tidak memerlukan respon instan dari manusia. Tarif Batch per satu juta token adalah $2.50 untuk input dan $12.50 untuk output pada Opus 4.8, $1 dan $5 pada Sonnet 5 pada harga perkenalan, dan $0.50 dan $2.50 pada Haiku 4.5. Kompensasinya adalah latensi: sebagian besar batch selesai dalam satu jam, batch yang tidak selesai dalam 24 jam akan kedaluwarsa, dan streaming tidak dapat dilakukan secara batch. Batch dan prompt caching dapat digunakan bersamaan, dan karena batch dapat berjalan lebih lama dari lima menit, gunakan cache 1-jam di dalamnya.
Atribusi biaya per proyek. Setiap respons API mengembalikan blok usage, sehingga Anda dapat mencatat biaya untuk satu permintaan dan mengatribusikinya ke proyek atau pelanggan tertentu. Langganan hanya melaporkan satu set bilah untuk pemegang slot tersebut.
Satu hal perlu diperhatikan dengan saksama, karena mudah untuk berasumsi secara salah ke salah satu arah: ini adalah permukaan penagihan yang terpisah. Dokumentasi Anthropic mengarahkan penagihan langganan ke dukungan claude.ai dan penagihan Console ke platform API, dan /usage-credits tidak berfungsi di bawah API key. Tidak ada yang saya periksa menyatakan bahwa langganan mencakup kredit API, jadi rencanakan dua akun dan dua tagihan.
Rumus titik impas
Hitung harga satu putaran, lalu kalikan skalanya.
turn cost = uncached_input_tokens x base_input_price
+ cache_write_tokens x 1.25 x base_input_price
+ cache_read_tokens x 0.10 x base_input_price
+ output_tokens x output_price
monthly API cost = turn cost x turns_per_active_day x active_days_per_month
break even when: monthly API cost = flat plan feePengali (multiplier) telah dipublikasikan, bukan estimasi. Penulisan cache 5 menit berbiaya "1.25x harga input dasar", penulisan 1 jam berbiaya "2x harga input dasar", dan pembacaan cache berbiaya "0.1x harga input dasar". Token pemikiran (thinking tokens) ditagih sebagai token output, jadi mereka termasuk dalam output_tokens bahkan pada model yang tidak menampilkan ringkasan penalaran.
Tarif dasar per satu juta token (MTok), berlaku saat ini pada 23 Juli 2026:
claude-fable-5: $10 input, $50 output. Cache read $1. 5-minute cache write $12.50. 1M context.claude-opus-4-8danclaude-opus-4-7: $5 input, $25 output. Cache read $0.50. 5-minute cache write $6.25. 1M context.claude-sonnet-5: $2 input, $10 output pada harga perkenalan hingga 31 Agustus 2026, kemudian $3 dan $15. Pada tarif perkenalan, cache read $0.20 dan 5-minute cache write $2.50. 1M context.claude-haiku-4-5: $1 input, $5 output. Cache read $0.10. 5-minute cache write $1.25. 200K context.
Tidak ada biaya tambahan untuk konteks panjang: "Permintaan 900k-token ditagih dengan tarif per-token yang sama dengan permintaan 9k-token."
Contoh perhitungan, dengan asumsi yang tertulis
Ambil satu putaran Claude Code menengah pada Sonnet 5 dengan 60.000 token konteks: 55.000 diambil dari cache, 3.000 baru ditulis ke cache, 2.000 token input baru tanpa cache, dan 1.200 token output termasuk thinking.
- Cache reads: 55,000 x $0.20/MTok = $0.0110
- Cache writes: 3,000 x $2.50/MTok = $0.0075
- Uncached input: 2,000 x $2.00/MTok = $0.0040
- Output: 1,200 x $10.00/MTok = $0.0120
Itu sekitar $0.035 per putaran. Dengan 120 putaran pada hari kerja aktif, sekitar $4.14 per hari. Dengan 20 hari aktif sebulan, sekitar $83 sebulan.
Bandingkan dengan biaya flat di atas dan hasilnya menunjukkan dua hal sekaligus. Itu sekitar empat kali biaya Pro, jadi Pro lebih murah di atas kertas, asalkan kuotanya mencukupi 120 putaran Sonnet per hari. Syarat tersebut adalah hal yang tidak bisa dipastikan oleh angka publik mana pun. Angka $83 yang sama berada di bawah biaya masuk Max, jadi di sini meteran lebih murah daripada Max.
Sekarang ubah satu asumsi pada satu waktu, dan lihat bagaimana biaya paket berhenti menjadi angka penentu.
Tiga hal yang mengubah titik impas lebih besar daripada harga paket
Prompt caching. Jalankan putaran 60.000-token yang sama tanpa caching dan seluruh prompt ditagih sebagai input baru: 60,000 x $2.00/MTok = $0.12, ditambah $0.012 output, sehingga menjadi $0.132 per putaran. Itu hampir empat kali lipat dari putaran dengan cache, dan mengubah biaya $83 sebulan menjadi sekitar $317. Inilah satu titik impas yang dipublikasikan oleh Anthropic, karena tidak bergantung pada beban kerja Anda: "Cache hit berbiaya 10% dari harga input standar, yang berarti caching menguntungkan setelah hanya satu kali pembacaan cache untuk durasi 5 menit (1.25x write), atau setelah dua kali pembacaan cache untuk durasi 1 jam (2x write)."
Dua mode kegagalan dapat mematikan caching tanpa memberi tahu Anda. Pertama adalah prefix yang lebih pendek dari panjang minimum yang dapat di-cache oleh model: 512 token pada Fable 5, 1.024 pada Opus 4.8 dan Sonnet 5, 2.048 pada Opus 4.7, dan 4.096 pada Haiku 4.5. Prefix yang lebih pendek tidak akan di-cache, dan tidak ada error yang muncul. Kedua adalah permintaan paralel, karena "entri cache baru tersedia setelah respons pertama dimulai." Sepuluh permintaan identik yang dikirim secara bersamaan semuanya membayar harga input penuh. Tanda untuk keduanya adalah cache_read_input_tokens yang bernilai nol.
Pilihan model. Hitung putaran identik pada Opus 4.8, dengan $5 input dan $25 output, dengan cache read pada $0.50 dan 5-minute write pada $6.25 per MTok: reads $0.0275, writes $0.0188, uncached input $0.0100, output $0.0300. Itu sekitar $0.086 per putaran, 2,5 kali lipat dari putaran Sonnet, dan sekitar $207 sebulan dengan volume yang sama. Satu pilihan model memindahkan pekerjaan yang sama dari di bawah biaya masuk Max menjadi lebih dari dua kali lipatnya. Haiku 4.5 pada $1 dan $5 memindahkannya ke arah sebaliknya untuk pekerjaan mekanis seperti triase log.
Tingkat upaya (effort level) bergantung pada pilihan model, karena token pemikiran ditagih dengan tarif output. Pada Opus 4.8, default API adalah high, dan titik awal yang didokumentasikan untuk coding dan pekerjaan agentic adalah xhigh yang lebih mahal. Turunkan dengan /effort di Claude Code atau dengan output_config.effort pada API. Satu hal lagi mengubah estimasi lama: model yang lebih baru menggunakan tokenizer yang lebih baru yang "menghasilkan sekitar 30% lebih banyak token untuk teks yang sama", sehingga jumlah yang diukur pada model lama akan meremehkan jumlah teks yang sama saat ini.
Kebersihan sesi. API bersifat stateless, sehingga setiap putaran mengirim ulang seluruh percakapan sebagai input yang ditagih. Sesi yang panjang oleh karena itu memakan biaya lebih besar per pesan daripada sesi baru, yang merupakan mekanisme di balik sebagian besar tagihan yang mengejutkan dan dibahas secara detail dalam apa yang sebenarnya mengonsumsi token dalam sesi Claude Code. Jalankan /clear di antara tugas yang tidak terkait, karena konteks yang usang akan dikirim ulang dan ditagih ulang pada setiap pesan berikutnya. Jalankan /compact di dalam satu tugas panjang, sehingga riwayat diringkas alih-alih dibawa secara penuh. Bekerjalah dalam rentang waktu yang berkelanjutan, karena cache default "memiliki masa aktif 5 menit" dan "diperbarui tanpa biaya tambahan setiap kali konten yang di-cache digunakan". Sesi yang Anda sentuh setiap sepuluh menit akan membayar penulisan ulang setiap kalinya. Sesi Claude Code yang berjalan di tmux pada VPS yang terpisah hampir tidak menghabiskan biaya saat sedang menganggur, tetapi menganggur melewati masa aktif cache tetap akan menghilangkan prefix yang sudah ada.
Ukur penggunaan Anda sendiri sebelum memutuskan
Jangan memutuskan berdasarkan contoh saya. Putuskan berdasarkan satu minggu Anda sendiri.
Di Claude Code, jalankan /usage di akhir setiap sesi selama seminggu (/cost adalah alias untuk layar yang sama). Ini melaporkan jumlah token sesi dan estimasi biaya, dengan satu catatan dari dokumentasi: "Angka dolar adalah estimasi yang dihitung secara lokal dari jumlah token dan mungkin berbeda dari tagihan aktual Anda." Total diatur ulang saat Anda menjalankan /clear, jadi bacalah layar terlebih dahulu. Pada langganan, angka dolar tersebut bukan tagihan Anda, tetapi jumlah token di baliknya adalah apa yang dibutuhkan oleh formula ini. /context menunjukkan apa yang mengisi jendela tersebut.
Pada akun API, halaman penggunaan di Claude Console adalah catatan yang otoritatif. Untuk menghitung harga prompt sebelum Anda mengirimnya, client.messages.count_tokens() "gratis untuk digunakan tetapi tunduk pada batasan rate per menit berdasarkan tingkatan penggunaan Anda", dan itu adalah satu-satunya penghitungan yang menggunakan tokenizer yang akan ditagih kepada Anda.
Setelah panggilan, baca blok penggunaan, dan bacalah dengan benar:
u = response.usage
total_input = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokensinput_tokens hanya menghitung sisa yang tidak di-cache, yang didokumentasikan sebagai "token setelah breakpoint cache terakhir". Putaran yang melaporkan input_tokens: 4000 bukanlah putaran 4.000-token, dan tiga bidang yang dijumlahkan adalah ukuran prompt yang diinginkan formula ini.
Kemudian bandingkan. Jika pengukuran bulanan Anda jelas berada di bawah biaya paket, gunakanlah meteran. Jika jelas di atasnya, gunakanlah paket, selama kuotanya mencukupi untuk hari kerja normal Anda. Jika berada di dekat garis batas, gunakanlah paket, karena paket tidak dapat mengejutkan Anda sementara meteran bisa.
FAQ
Apakah Claude API lebih murah daripada Claude Pro atau Max?
Tergantung pada volume, dan tidak ada titik impas yang dipublikasikan untuk dicari, karena langganan dijual dalam bentuk jendela penggunaan, bukan kuota token. Hitung satu putaran tipikal dari tarif per-token yang dipublikasikan, kalikan dengan jumlah putaran Anda per hari kerja aktif dan hari kerja aktif per bulan, lalu bandingkan angka tersebut dengan biaya paket. Dalam satu contoh perhitungan, satu putaran Sonnet 5 sebesar 60.000-token menjadi sekitar $0.035, atau sekitar $83 sebulan dengan 120 putaran sehari selama 20 hari: di atas biaya Pro, di bawah biaya masuk Max.
Bagaimana cara menghitung biaya Claude API saya per bulan?
Jalankan /usage di Claude Code selama seminggu untuk mengumpulkan jumlah token yang nyata, atau baca halaman penggunaan di Claude Console jika Anda sudah memiliki akun API. Kemudian hitung harga satu putaran: input tanpa cache pada tarif dasar, penulisan cache pada 1,25 kali input dasar, pembacaan cache pada 0,1 kali input dasar, dan output pada tarif output, dengan menghitung token pemikiran sebagai output. Kalikan dengan jumlah putaran per hari kerja aktif dan hari kerja aktif per bulan.
Apa yang paling mengubah tagihan Claude API?
Prompt caching, lebih dari hal lainnya. Satu putaran 60.000-token pada Sonnet 5 berbiaya sekitar $0.035 ketika prefix dilayani dari cache dan sekitar $0.132 ketika tidak. Pilihan model menyusul berikutnya: putaran yang sama pada Opus 4.8 berbiaya sekitar $0.086. Panjang sesi berada di urutan ketiga, karena API bersifat stateless dan setiap putaran mengirim ulang seluruh percakapan sebagai input yang ditagih.
Apakah langganan Claude mencakup akses API?
Anggaplah keduanya sebagai dua akun dengan dua tagihan. Panggilan API ditagih per token terhadap akun yang Anda buat di Console, dan tidak ada dalam dokumentasi yang saya periksa menyatakan bahwa langganan memberikan kredit API. Tanda paling jelas bahwa keduanya adalah permukaan yang terpisah adalah perintah /usage-credits Claude Code, yang "tidak tersedia dengan autentikasi API key". Banyak pengembang memiliki keduanya: paket untuk coding interaktif, dan key untuk hal-hal yang mereka bangun.