SSD Nodes Learn Hosting plans →
Panduan Matt ConnorOleh Matt Connor · Diperbarui 2026-08-26

Claude API Lebih Murah daripada Subscription?

Bandingkan biaya API berbasis token dengan paket tetap Claude, lalu hitung titik impas berdasarkan tarif saat ini dan pola penggunaan Anda.

Apakah Claude API lebih murah daripada subscription?

Claude API lebih murah daripada subscription jika volume penggunaan berada di bawah batas tertentu, tetapi lebih mahal jika melebihi batas tersebut. Untuk satu developer yang melakukan coding secara interaktif sepanjang hari, paket berbiaya tetap biasanya lebih menguntungkan. Untuk program yang melakukan panggilan sendiri, API adalah satu-satunya pilihan, sehingga biaya tidak menentukan keputusan. Selebihnya adalah perhitungan yang dapat Anda lakukan dalam sepuluh menit.

Tidak ada angka resmi titik impas yang dapat dicari. Subscription dijual berdasarkan jendela penggunaan, bukan alokasi token, sehingga tidak ada angka yang dipublikasikan untuk menunjukkan titik perpotongan kedua biaya tersebut. Bagian berikut menjelaskan rumus berdasarkan tarif per token saat ini, serta aspek perilaku penggunaan Anda yang dapat memengaruhi hasil jauh lebih besar daripada biaya paket. Semua angka titik impas di bawah ini adalah hasil perhitungan saya sendiri berdasarkan tarif yang dipublikasikan dan asumsi yang dinyatakan, bukan angka yang didokumentasikan.

Jika Anda masih menentukan paket yang akan dibeli, paket Claude yang sesuai dengan cara Anda bekerja menjawab pertanyaan tersebut. Tulisan ini mengasumsikan bahwa Anda sudah tahu paket yang akan dibeli dan ingin mengetahui apakah paket itu memang perlu dibeli.

Dua model penagihan yang bentuknya tidak sama

Langganan adalah kapasitas yang mungkin tidak Anda gunakan. Anda membayar biaya tetap dan memperoleh alokasi yang direset sesuai jadwal. Dokumentasi Claude Code dari Anthropic menjelaskan model untuk seat Team dan Enterprise: penggunaan "mengurangi alokasi per-seat yang direset dalam jendela lima jam bergulir dan jendela mingguan", yang digunakan bersama Claude chat dan Cowork. Pelanggan mengalami model yang sama melalui pesan yang mereka terima, yaitu "Batas sesi Anda telah tercapai" dan "Batas mingguan Anda telah tercapai". Kapasitas yang tidak Anda gunakan tetap menjadi biaya yang sudah Anda bayarkan. Kapasitas yang Anda lampaui menghentikan pekerjaan sampai jendela direset, dan mengganti model dengan /model tidak memulihkan akses karena jendela tersebut digunakan bersama oleh semua model. Jika saat ini Anda melihat salah satu pesan tersebut, tentukan jendela mana yang sedang Anda tunggu sebelum melakukan perhitungan apa pun, karena batas lima jam dan batas mingguan memerlukan tindakan yang berbeda.

API adalah meter yang tidak pernah berhenti. Tidak ada jendela dan tidak ada batas penghentian. Setiap request dihargai berdasarkan token, dan beberapa hal dihargai di luar token: web search "tersedia di Claude API dengan harga $10 per 1.000 pencarian". Tidak ada proses yang berhenti karena batas. Invoice hanya terus bertambah. Tidak ada free tier di dalamnya, meskipun kredit pendaftaran dan bagian yang tidak dikenai biaya dapat digunakan untuk eksperimen pertama sebelum perhitungan apa pun ini diperlukan.

Biaya paket per 23 Juli 2026, berdasarkan halaman harga Claude: Pro adalah "$17 Per bulan dengan diskon langganan tahunan ($200 ditagihkan di muka). $20 jika ditagihkan bulanan", dan sudah mencakup Claude Code. Max tercantum sebagai "Mulai dari $100 Per bulan". Harga seat Team mulai dari "$20 Per seat / bulan jika ditagihkan tahunan". Enterprise menarik karena menjalankan kedua model sekaligus: "Harga seat + penggunaan dengan tarif API $20/seat". Jika model hybrid ini yang sedang Anda pertimbangkan, cakupan sebenarnya dari biaya seat Enterprise menjelaskan minimum seat dan bagian yang hanya tersedia melalui penawaran yang dinegosiasikan. Jika yang Anda hitung secara khusus adalah biaya alat coding, bukan Claude secara keseluruhan, biaya Claude Code pada setiap paket membandingkan biaya yang sama dengan estimasi bulanan. Jika sisi tarif tetap dari perbandingan ini belum diputuskan untuk Claude, perbandingan tier ini dengan ChatGPT Go, Plus, dan Pro merupakan bagian lain dari keputusan tersebut. Biaya sering berubah, dan alokasi di balik setiap paket tidak pernah dipublikasikan dalam token. Karena itu, baca halaman harga pada hari Anda mengambil keputusan.

Yang tidak dapat Anda peroleh dari API

Alokasi paket dan antarmuka yang dibangun di sekelilingnya. Perintah /usage-credits Claude Code mengelola kredit penggunaan langganan. Anda menjalankannya "setelah masuk dengan langganan claude.ai melalui /login; perintah ini tidak tersedia untuk autentikasi dengan kunci API." Layar /usage juga berbeda berdasarkan mode penagihan: blok Session "menampilkan penggunaan token API dan ditujukan bagi pengguna API", sedangkan pelanggan melihat bilah penggunaan paket dan rincian penggunaan.

Cache prompt yang lebih lama di Claude Code. Fitur ini memerlukan biaya nyata dan mudah terlewatkan. Dokumentasi menyatakan, "Masa aktifnya adalah satu jam untuk langganan dan turun menjadi lima menit setelah Anda menggunakan kredit penggunaan; pada kunci API atau penyedia cloud, masa aktifnya secara default adalah lima menit." Pesan pertama setelah jeda yang lebih lama daripada masa aktif cache tidak menggunakan cache. Akibatnya, seluruh konteks diproses ulang dan ditagihkan dengan harga penulisan. Dengan langganan, Anda dapat mengikuti rapat selama lima puluh menit lalu kembali tanpa kehilangan cache. Dengan kunci API, jeda yang sama menimbulkan biaya penulisan ulang penuh untuk awalan sesi.

Hal yang tidak dapat diperoleh dari langganan

Akses terprogram. Tugas cron atau handler webhook yang memanggil Claude memerlukan kunci API. Jika itu adalah beban kerja Anda, perbandingan ini selesai. Membangun aplikasi Claude API pertama Anda pada VPS membahas pengelolaan kunci dan skrip pertama yang berfungsi.

Diskon Batch API. Halaman harga menyatakannya dengan jelas: "Batch API memungkinkan pemrosesan asinkron atas permintaan dalam jumlah besar dengan diskon 50% untuk token input dan output." Hal ini mengurangi separuh biaya untuk pekerjaan yang tidak perlu ditunggu manusia. Tarif Batch per juta token adalah $2.50 untuk input dan $12.50 untuk output pada Opus 4.8, $1 dan $5 pada Sonnet 5 dengan harga perkenalan, serta $0.50 dan $2.50 pada Haiku 4.5. Imbalannya adalah latensi: sebagian besar batch selesai dalam waktu kurang dari satu jam, batch yang belum selesai dalam 24 jam akan kedaluwarsa, dan streaming tidak dapat diproses sebagai batch. Batch dan caching prompt dapat digunakan bersamaan. Karena batch dapat berjalan lebih dari lima menit, gunakan cache 1 jam di dalamnya.

Atribusi biaya per proyek. Setiap respons API mengembalikan blok usage. Dengan demikian, Anda dapat mencatat biaya satu permintaan dan mengatribusikannya ke suatu proyek atau pelanggan. Langganan hanya melaporkan satu rangkaian bilah untuk pengguna yang memegang seat.

Perhatikan satu hal berikut karena asumsi yang keliru dapat muncul di kedua arah: keduanya adalah permukaan penagihan yang terpisah. Dokumentasi Anthropic mengarahkan penagihan langganan ke dukungan claude.ai dan penagihan Console ke platform API, sedangkan /usage-credits tidak berfungsi dengan kunci API. Tidak ada informasi yang saya periksa yang menyatakan bahwa langganan mencakup kredit API. Karena itu, siapkan dua akun dan dua tagihan.

Rumus titik impas

Hitung biaya satu putaran, lalu skalakan.

turn cost = uncached_input_tokens x base_input_price
          + cache_write_tokens    x 1.25 x base_input_price
          + cache_read_tokens     x 0.10 x base_input_price
          + output_tokens         x output_price

monthly API cost = turn cost x turns_per_active_day x active_days_per_month

break even when: monthly API cost = flat plan fee

Pengalinya dipublikasikan, bukan hasil perkiraan. Penulisan cache selama 5 menit dikenai biaya "1.25x base input price", penulisan selama 1 jam dikenai biaya "2x base input price", dan pembacaan cache dikenai biaya "0.1x base input price". Token penalaran ditagihkan sebagai token output, sehingga termasuk dalam output_tokens meskipun model tidak menampilkan ringkasan penalaran.

Tarif dasar per juta token (MTok), berlaku pada 23 July 2026:

  • claude-fable-5: input $10, output $50. Pembacaan cache $1. Penulisan cache 5 menit $12.50. Konteks 1M.
  • claude-opus-4-8 dan claude-opus-4-7: input $5, output $25. Pembacaan cache $0.50. Penulisan cache 5 menit $6.25. Konteks 1M.
  • claude-sonnet-5: input $2, output $10 dengan harga perkenalan hingga 31 August 2026, kemudian menjadi $3 dan $15. Pada tarif perkenalan, pembacaan cache $0.20 dan penulisan cache 5 menit $2.50. Konteks 1M.
  • claude-haiku-4-5: input $1, output $5. Pembacaan cache $0.10. Penulisan cache 5 menit $1.25. Konteks 200K.

Tidak ada biaya tambahan untuk konteks panjang: "Permintaan dengan 900k token ditagihkan dengan tarif per token yang sama seperti permintaan dengan 9k token."

Contoh perhitungan, dengan asumsi yang dicatat

Ambil satu giliran Claude Code di tengah sesi pada Sonnet 5 dengan konteks 60,000 token: 55,000 disajikan dari cache, 3,000 token baru ditulis ke cache, 2,000 token merupakan input baru yang tidak di-cache, dan 1,200 token merupakan output termasuk proses berpikir.

  • Pembacaan cache: 55,000 x $0.20/MTok = $0.0110
  • Penulisan cache: 3,000 x $2.50/MTok = $0.0075
  • Input yang tidak di-cache: 2,000 x $2.00/MTok = $0.0040
  • Output: 1,200 x $10.00/MTok = $0.0120

Totalnya sekitar $0.035 per giliran. Dengan 120 giliran pada hari yang aktif, biayanya sekitar $4.14 per hari. Dengan 20 hari aktif per bulan, biayanya sekitar $83 per bulan.

Bandingkan angka itu dengan biaya tetap di atas. Hasilnya menunjukkan dua hal sekaligus. Biaya tersebut sekitar empat kali biaya Pro, sehingga Pro lebih murah secara teori, asalkan kuotanya mencakup 120 giliran Sonnet per hari. Syarat tersebut tidak dapat dipastikan oleh angka yang dipublikasikan. Hal yang paling mendekati jawabannya adalah pembahasan lebih lanjut tentang apa saja yang termasuk dalam Pro dan batas yang dapat menghentikan Anda, yang sebaiknya dibaca sebelum menganggap biaya yang lebih rendah selalu lebih menguntungkan. Angka $83 yang sama masih di bawah biaya Max tingkat awal, sehingga dalam kasus ini tarif berdasarkan pemakaian lebih murah daripada Max. Kata tingkat awal penting dalam kalimat terakhir itu, karena Max dijual dengan dua harga, dan tingkat Max mana yang sebenarnya akan Anda beli mengubah biaya pembanding sebesar $100 per bulan.

Sekarang ubah satu asumsi setiap kali, lalu perhatikan bahwa biaya paket tidak lagi menjadi angka penentu.

Tiga hal yang lebih memengaruhi titik impas daripada harga paket

Caching prompt. Jalankan turn yang sama dengan 60,000 token tanpa caching. Seluruh prompt ditagihkan sebagai input baru: 60,000 x $2.00/MTok = $0.12, ditambah output sebesar $0.012, sehingga biayanya $0.132 per turn. Biaya ini hampir empat kali turn dengan cache dan meningkatkan biaya bulanan $83 menjadi sekitar $317. Inilah satu-satunya titik impas yang dipublikasikan Anthropic, karena tidak bergantung pada beban kerja Anda: "Cache hit dikenai biaya 10% dari harga input standar. Artinya, caching mulai menguntungkan setelah satu pembacaan cache untuk durasi 5 menit (penulisan 1.25x), atau setelah dua pembacaan cache untuk durasi 1 jam (penulisan 2x)."

Dua kondisi kegagalan dapat menonaktifkan caching tanpa memberi tahu Anda. Yang pertama adalah prefix yang lebih pendek daripada panjang minimum yang dapat di-cache oleh model: 512 token pada Fable 5, 1,024 pada Opus 4.8 dan Sonnet 5, 2,048 pada Opus 4.7, serta 4,096 pada Haiku 4.5. Prefix yang lebih pendek tidak di-cache dan tidak menghasilkan error. Yang kedua adalah request paralel, karena "entri cache baru tersedia setelah respons pertama dimulai." Sepuluh request identik yang dikirim sekaligus semuanya dikenai harga input penuh. Indikator untuk kedua kondisi ini adalah cache_read_input_tokens yang bernilai nol.

Pemilihan model. Hitung biaya turn identik pada Opus 4.8, dengan harga $5 untuk input dan $25 untuk output, pembacaan cache seharga $0.50, serta penulisan 5 menit seharga $6.25 per MTok: pembacaan $0.0275, penulisan $0.0188, input tanpa cache $0.0100, dan output $0.0300. Biayanya sekitar $0.086 per turn, atau 2.5 kali turn pada Sonnet, sehingga menjadi sekitar $207 per bulan pada volume yang sama. Satu pilihan model mengubah biaya pekerjaan yang sama dari di bawah biaya Max tingkat awal menjadi lebih dari dua kali lipatnya. Haiku 4.5 dengan harga $1 dan $5 mengarah ke biaya yang lebih rendah untuk pekerjaan mekanis seperti triase log. Fable 5 menaikkan biaya lebih jauh, dengan harga $10 untuk input dan $50 untuk output. Karena itu, baca pekerjaan mana yang benar-benar sebanding dengan tarif Fable 5 sebelum menjadikannya model default.

Tingkat effort merupakan bagian dari pemilihan model karena token untuk proses berpikir ditagihkan dengan tarif output. Pada Opus 4.8, default API adalah high, sedangkan titik awal yang didokumentasikan untuk pekerjaan coding dan agentic adalah xhigh yang lebih mahal. Turunkan nilainya dengan /effort di Claude Code atau dengan output_config.effort pada API. Ada faktor lain yang mengubah perkiraan lama: model yang lebih baru menggunakan tokenizer yang lebih baru dan "menghasilkan sekitar 30% lebih banyak token untuk teks yang sama". Karena itu, jumlah token yang diukur pada model lama akan meremehkan jumlah untuk teks yang sama saat ini.

Kebersihan sesi. API bersifat stateless, sehingga setiap turn mengirim ulang seluruh percakapan sebagai input yang ditagihkan. Karena itu, sesi yang panjang lebih mahal per pesan daripada sesi baru. Mekanisme ini menjadi penyebab utama tagihan yang tidak terduga dan dibahas secara terperinci dalam apa yang sebenarnya mengonsumsi token dalam sesi Claude Code. Jalankan /clear di antara tugas yang tidak berkaitan, karena konteks lama dikirim ulang dan ditagihkan kembali pada setiap pesan berikutnya. Jalankan /compact di dalam satu tugas panjang agar riwayat diringkas, bukan dikirim secara utuh. Kerjakan tugas dalam rentang waktu yang berkelanjutan karena cache default "memiliki masa berlaku 5 menit" dan "diperbarui tanpa biaya tambahan setiap kali konten yang di-cache digunakan". Sesi yang Anda akses sekali setiap sepuluh menit akan membayar penulisan ulang setiap kali. Sesi Claude Code yang berjalan di tmux pada VPS secara detached hampir tidak menimbulkan biaya saat idle, tetapi kondisi idle yang melewati masa berlaku cache tetap menghilangkan prefix yang masih hangat.

Ukur penggunaan Anda sendiri sebelum mengambil keputusan

Jangan mengambil keputusan berdasarkan contoh saya. Gunakan data dari penggunaan Anda sendiri selama satu minggu.

Di Claude Code, jalankan /usage pada akhir setiap sesi selama satu minggu (/cost adalah alias untuk tampilan yang sama). Perintah ini menampilkan jumlah token sesi dan perkiraan biaya, dengan satu catatan dari dokumentasi: "Angka dalam dolar adalah perkiraan yang dihitung secara lokal dari jumlah token dan dapat berbeda dari tagihan aktual Anda." Total direset saat Anda menjalankan /clear, jadi baca tampilan tersebut terlebih dahulu. Pada paket berlangganan, angka dalam dolar itu bukan tagihan Anda, tetapi jumlah token di baliknya adalah data yang diperlukan formula ini. /context menunjukkan apa saja yang memenuhi window.

Pada akun API, halaman penggunaan di Claude Console adalah catatan otoritatif. Untuk menghitung harga prompt sebelum mengirimkannya, client.messages.count_tokens() "gratis digunakan, tetapi tunduk pada batas permintaan per menit berdasarkan tingkat penggunaan Anda", dan hanya perintah ini yang menggunakan tokenizer yang benar-benar menjadi dasar penagihan Anda.

Setelah melakukan panggilan, baca blok penggunaan dan pahami nilainya dengan benar:

u = response.usage
total_input = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokens

input_tokens hanya menghitung sisa yang tidak di-cache, yang didokumentasikan sebagai "token setelah titik cache terakhir". Sesi yang melaporkan input_tokens: 4000 bukan sesi dengan 4,000 token, dan ketiga bidang tersebut jika dijumlahkan merupakan ukuran prompt yang dibutuhkan formula ini.

Kemudian bandingkan. Jika hasil pengukuran Anda jelas berada di bawah biaya paket, pilih penggunaan berbasis meter. Jika jelas berada di atasnya, pilih paket, selama alokasinya mencukupi untuk hari kerja normal Anda. Jika hasilnya mendekati batas, pilih paket karena paket tidak dapat menimbulkan biaya tak terduga, sedangkan penggunaan berbasis meter dapat menyebabkannya. Jika hasilnya jauh di bawah biaya Pro, tentukan apakah paket berbayar lebih menguntungkan daripada tingkat gratis untuk cara kerja Anda sebelum membeli salah satunya, karena penggunaan yang sangat ringan mungkin tidak cukup sering mencapai batas gratis untuk membenarkan biaya apa pun. Tidak satu pun pilihan ini bersifat permanen, karena membatalkan atau menurunkan tingkat paket tidak mengurangi sisa masa berlaku bulan yang sudah Anda bayar jika penggunaan nyata selama beberapa minggu berikutnya bertentangan dengan perkiraan Anda. Apa pun pilihan Anda, perhitungan ini hanya menentukan model penagihan yang lebih murah, sedangkan apakah pengeluaran tersebut terbayar melalui waktu yang berhasil dihemat perlu dihitung secara terpisah berdasarkan tarif per jam Anda.

FAQ

Apakah Claude API lebih murah daripada Claude Pro atau Max?

Hal ini bergantung pada volume penggunaan. Tidak ada titik impas yang dipublikasikan untuk dirujuk karena langganan dijual sebagai jangka waktu penggunaan, bukan alokasi token. Hitung harga satu giliran penggunaan berdasarkan tarif per token yang dipublikasikan, kalikan dengan jumlah giliran per hari aktif dan jumlah hari aktif per bulan, lalu bandingkan hasilnya dengan biaya paket. Dalam satu contoh perhitungan, satu giliran Sonnet 5 dengan 60,000 token berbiaya sekitar $0.035, atau kira-kira $83 per bulan dengan 120 giliran per hari selama 20 hari: lebih tinggi daripada biaya Pro, tetapi lebih rendah daripada biaya Max tingkat awal.

Bagaimana cara menghitung biaya Claude API per bulan?

Jalankan /usage di Claude Code selama satu minggu untuk mengumpulkan jumlah token aktual. Anda juga dapat membaca halaman penggunaan di Claude Console jika sudah memiliki akun API. Kemudian hitung harga satu giliran: input yang tidak di-cache menggunakan tarif dasar, penulisan cache menggunakan 1.25 kali input dasar, pembacaan cache menggunakan 0.1 kali input dasar, dan output menggunakan tarif output. Token untuk proses berpikir dihitung sebagai output. Kalikan hasilnya dengan jumlah giliran per hari aktif dan jumlah hari aktif per bulan.

Apa yang paling memengaruhi tagihan Claude API?

Caching prompt, lebih daripada faktor lainnya. Satu giliran dengan 60,000 token pada Sonnet 5 berbiaya sekitar $0.035 ketika prefiks disajikan dari cache, dan sekitar $0.132 ketika tidak di-cache. Pilihan model berada di urutan berikutnya: giliran yang sama pada Opus 4.8 berbiaya sekitar $0.086. Panjang sesi berada di urutan ketiga karena API bersifat stateless dan setiap giliran mengirim ulang seluruh percakapan sebagai input yang ditagihkan.

Apakah langganan Claude mencakup akses API?

Perlakukan keduanya sebagai dua akun dengan dua tagihan. Panggilan API ditagihkan per token ke akun yang Anda buat di Console. Tidak ada keterangan dalam dokumentasi yang saya periksa bahwa langganan memberikan kredit API. Tanda paling jelas bahwa keduanya merupakan antarmuka terpisah adalah perintah /usage-credits milik Claude Code, yang "tidak tersedia dengan autentikasi kunci API". Banyak developer menggunakan keduanya: paket untuk coding interaktif dan kunci untuk aplikasi yang mereka buat.