SSD Nodes Learn RAM 8GB — $66/tahun
Panduan Matt ConnorOleh Matt Connor

Claude vs ChatGPT API: Mana yang Lebih Murah?

Claude tidak selalu lebih murah. Pelajari rumus token, bandingkan tiga beban kerja dengan biaya nyata, dan lihat kapan tagihan Claude menjadi lebih tinggi.

Jawaban singkat

Harga API Claude dibandingkan dengan ChatGPT tidak memiliki pemenang tunggal, karena kedua penyedia menetapkan harga input dan output secara berbeda pada setiap tingkat. Per Agustus 2026, dua tingkat Claude teratas mengenakan biaya per token input yang sama dengan padanan OpenAI-nya dan biaya per token output yang lebih rendah. Karena itu, Claude sedikit lebih unggul untuk beban kerja yang didominasi output. Pada tingkat terendah, Claude berbiaya beberapa kali lipat untuk pekerjaan yang sama. Jawaban apa pun yang tidak menyebutkan tingkat dan komposisi token adalah perkiraan.

Halaman ini menyajikan perhitungannya terlebih dahulu, kemudian tiga beban kerja beserta komposisi tokennya, lalu pengali yang dapat membuat tagihan aktual jauh berbeda dari tarif utama.

Satu-satunya rumus yang Anda perlukan

Kedua API menagih teks dengan cara yang sama. Anda membayar token yang dikirim dan tarif yang lebih tinggi untuk token yang ditulis model.

cost = (input tokens / 1,000,000) * input rate + (output tokens / 1,000,000) * output rate

Satu token berisi sekitar 4 karakter dalam bahasa Inggris, atau hampir 0.75 kata. Gunakan angka ini hanya untuk perkiraan awal. Untuk tagihan sebenarnya, gunakan jumlah yang dikembalikan setiap API dalam objek usage pada setiap respons.

# Rates are US dollars per million tokens.
def cost(in_tok, out_tok, in_rate, out_rate):
    return in_tok / 1e6 * in_rate + out_tok / 1e6 * out_rate

# One support-chat turn: 1,400 tokens in, 220 tokens out, on a $2 / $10 model.
print(round(cost(1400, 220, 2.0, 10.0), 6))

Skrip mencetak 0.005, yaitu setengah sen untuk setiap giliran. Kalikan dengan jumlah giliran yang Anda perkirakan dalam sebulan untuk mendapatkan anggaran. Pelajari satu rumus ini, dan setiap perubahan harga setelah hari ini cukup dilakukan dengan mengubah satu baris, bukan melakukan analisis baru.

Tarif yang dipublikasikan, Agustus 2026

Berikut adalah harga daftar yang dipublikasikan oleh kedua vendor pada 1 Agustus 2026. Blok ini adalah satu-satunya tempat dalam artikel ini yang mencantumkan harga. Periksa kembali dengan claude.com/pricing dan halaman harga OpenAI sebelum menetapkan anggaran.

ChartList prices in US dollars per million tokens, August 2026
The data behind this chart
[
  {
    "label": "Frontier",
    "claude_input": 5,
    "claude_output": 25,
    "openai_input": 5,
    "openai_output": 30
  },
  {
    "label": "Workhorse",
    "claude_input": 2,
    "claude_output": 10,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Workhorse from September",
    "claude_input": 3,
    "claude_output": 15,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Small",
    "claude_input": 1,
    "claude_output": 5,
    "openai_input": 0.2,
    "openai_output": 1.2
  }
]

Pasangan model ditentukan berdasarkan posisi dalam setiap jajaran, bukan berdasarkan popularitas. Kelas frontier membandingkan Claude Opus 5 dengan gpt-5.6-sol. Kelas workhorse membandingkan Claude Sonnet 5 dengan gpt-5.6-terra. Kelas small membandingkan Claude Haiku 4.5 dengan gpt-5.6-luna. Kedua vendor juga menjual tingkatan yang lebih tinggi di atas blok ini, dan OpenAI tetap mencantumkan generasi lama dengan tarif awalnya. Membandingkan model flagship di satu sisi dengan model anggaran di sisi lain menghasilkan angka yang tidak bermakna. Itulah penyebab sebagian besar perbandingan yang dipublikasikan menonjolkan angka tersebut sebagai judul utama.

Ada dua hal dalam blok itu yang perlu ditegaskan. Tarif 2 dan 10 untuk Sonnet 5 adalah tarif perkenalan. Anthropic menyatakan bahwa tarif tersebut berakhir pada 31 Agustus 2026. Setelah itu, Sonnet 5 mengenakan tarif 3 dan 15. Perubahan tersebut mengubah kelas workhorse dari keunggulan tipis Claude menjadi keunggulan jelas OpenAI. Perubahan itu terjadi dalam periode relevansi artikel ini.

Hal kedua adalah pola yang perlu diingat: Claude menetapkan harga output tepat 5 kali tarif inputnya sendiri pada setiap baris di atas, sedangkan OpenAI menetapkan harga output sebesar 6 kali tarif inputnya. Rasio tersebut, bukan tarif absolutnya, menentukan perubahan pemenang berdasarkan komposisi token Anda.

Mengapa tarif per satu juta token tidak dapat dibandingkan antarvendor

Tarif adalah dolar per token. Tagihan adalah dolar per token dikalikan jumlah token, dan jumlah token untuk suatu teks merupakan karakteristik model, bukan teksnya.

Anthropic menyatakan hal ini secara langsung: model Claude 4.7 dan yang lebih baru, termasuk Claude Opus 5 dan Claude Sonnet 5, menggunakan tokenizer yang lebih baru dan menghasilkan sekitar 30% lebih banyak token untuk teks yang sama dibandingkan Claude Sonnet 4.6 dan yang lebih lama. Tarifnya tidak berubah. Tagihannya berubah.

Jadi, dua tarif yang tampak sama bukan berarti dua tagihan yang sama. Hitung token di kedua sisi menggunakan teks Anda sendiri sebelum mempercayai perbandingan apa pun, termasuk perbandingan ini.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "messages": [{"role": "user", "content": "Summarise the attached contract."}]
  }'

Respons yang benar adalah objek JSON kecil yang berisi input_tokens. 401 berarti variabel kunci kosong di shell Anda. Jalankan teks yang sama melalui tokenizer milik vendor lain, bagi satu jumlah token dengan jumlah token lainnya, lalu kalikan rasio tersebut dengan tarif yang dipublikasikan sebelum membandingkannya. Jika rasio tersebut menguntungkan salah satu vendor lebih dari sekitar 1.2, pengaruhnya lebih besar daripada setiap perbedaan tarif pada blok di atas.

Skenario satu: fitur obrolan

Asisten dukungan di dalam aplikasi web. 120,000 giliran per bulan. Setiap giliran mengirimkan prompt sistem, skema alat, dua cuplikan pusat bantuan yang diambil, dan beberapa pesan sebelumnya, sekitar 1,400 token input, lalu model menjawab dengan sekitar 220 token. Karena bersifat interaktif, diskon batch tidak pernah berlaku di sini. Jalankan pada tingkat workhorse.

ChartChat feature, monthly cost in US dollars, 120,000 turns
The data behind this chart
[
  {
    "label": "List price",
    "claude_usd": "600.00",
    "openai_usd": "652.80"
  },
  {
    "label": "Cached prefix",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Small tier, cached",
    "claude_usd": "213.60",
    "openai_usd": "48.00"
  }
]

Pada harga daftar, Claude menagih 600.00, sedangkan OpenAI menagih 652.80. Komponen input identik karena tarif input identik. Seluruh selisih berasal dari output, dan Claude unggul dengan selisih yang terlalu kecil untuk menentukan pilihan vendor.

Sekarang tandai 800 dari 1,400 token input tersebut sebagai prefiks stabil: prompt sistem dan skema alat, yang tidak berubah antargiliran. Kedua vendor mengenakan biaya 10% dari tarif input dasar untuk cache hit. Tagihan Claude turun menjadi 427.20, sedangkan tagihan OpenAI menjadi 480.00. Caching lebih bernilai daripada pilihan vendor, dan kedua platform menyediakannya.

Di sinilah Claude kalah. Sebagian besar jawaban dukungan tidak memerlukan model workhorse. Pindahkan lalu lintas yang sama ke tingkat small, dan Claude menagih 213.60, sedangkan OpenAI menagih 48.00. Bagi salah satunya dengan yang lain, dan biaya Claude sekitar empat setengah kali lebih tinggi untuk pekerjaan yang sama. Claude Haiku 4.5 mengenakan biaya 1 per juta token input, sedangkan gpt-5.6-luna mengenakan 0.2, dan caching sebanyak apa pun tidak dapat menutup selisih lima kali lipat. Jika beban kerja Anda sesuai untuk model small, OpenAI lebih murah dan selisihnya besar.

Skenario kedua: pipeline dokumen dengan konteks panjang

25,000 kontrak per bulan. Setiap permintaan membawa instruksi dan skema JSON yang sama sepanjang 9,000 token, lalu 12,000 token teks kontrak. Model mengembalikan sekitar 700 token dalam bentuk kolom terstruktur. Output kurang dari 4% token dalam pekerjaan ini, dan fakta tersebut menentukan perbandingannya.

ChartMonthly cost in US dollars, three workloads, cached and paired like-for-like
The data behind this chart
[
  {
    "label": "Chat feature",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Document pipeline",
    "claude_usd": "820.00",
    "openai_usd": "855.00"
  },
  {
    "label": "Coding agent",
    "claude_usd": "116.10",
    "openai_usd": "124.20"
  }
]

Dengan prefix sepanjang 9,000 token yang di-cache di kedua sisi, Claude mengenakan biaya 820.00, sedangkan OpenAI mengenakan biaya 855.00. Biaya input sama persis hingga sen terakhir karena tarif input utama keduanya sama pada Agustus 2026. Seluruh perbedaannya berasal dari biaya output, yang ditetapkan sebesar 5 kali biaya input pada Claude dan 6 kali pada OpenAI.

Pekerjaan ini juga dapat diproses secara batch. Kedua vendor memberikan diskon 50% untuk input dan output dalam pekerjaan asinkron, sehingga kedua total biaya menjadi setengahnya dan selisihnya tetap serupa. Batch adalah diskon tunggal terbesar di kedua platform, dan pipeline dokumen malam hari selalu dapat menggunakannya.

Claude mengalami kerugian karena logika tingkatannya sama seperti sebelumnya. Ekstraksi kolom berdasarkan skema tetap adalah pekerjaan yang dapat ditangani model kecil dengan baik, dan input mencakup 97% token di sini. Beralih turun satu tingkat mengalikan tarif input OpenAI dengan 0.1 dan tarif input Claude dengan 0.5. Uji model kecil pada 200 dokumen sebelum menganggap Anda memerlukan model yang lebih besar, menggunakan evaluasi yang sama seperti yang akan Anda jalankan untuk memilih tingkat Claude yang tepat untuk suatu pekerjaan.

Skenario tiga: agen coding yang selalu aktif

Satu developer menjalankan agen di VPS, dengan sekitar 900 giliran model per bulan. Setiap giliran membawa sekitar 60,000 token input konteks repositori, dengan 80% di antaranya merupakan cache hit, serta menghasilkan sekitar 1,800 token pengeditan dan penjelasan. Gunakan harga tingkat frontier, karena pada coding, kesenjangan kemampuan dapat menimbulkan biaya nyata.

Claude mengenakan biaya 116.10, sedangkan OpenAI mengenakan 124.20. Tarif input dan tarif pembacaan cache sama, sedangkan tarif output Claude yang lebih rendah menghasilkan penghematan sekitar 7%.

Angka 7% tersebut masih berada dalam rentang kesalahan tokenizer yang dibahas sebelumnya, jadi anggap skenario ini setara dari sisi tarif. Perbedaannya terletak pada model penagihan. Untuk satu developer dengan volume ini, seat subscription biasanya lebih murah daripada panggilan API yang ditagihkan berdasarkan penggunaan. Perbandingan keseluruhan berubah setelah subscription diperhitungkan. Analisis perbandingan biaya API dan subscription terlebih dahulu sebelum menempatkan agen pada penagihan berdasarkan penggunaan. Jika Anda menggunakan penagihan berdasarkan penggunaan, pahami terlebih dahulu ke mana token digunakan, karena penggunaan token agen coding terutama didominasi oleh konteks yang dikirim ulang pada setiap giliran, bukan oleh kode yang ditulisnya.

Pengali yang menentukan tagihan

Tarif utama adalah komponen terkecil dalam daftar ini. Setiap faktor di bawah ini dapat mengubah tagihan aktual lebih besar daripada selisih antara kedua vendor pada tingkat yang sama.

Input yang di-cache. Kedua vendor mengenakan biaya sebesar 10% dari input dasar untuk cache hit. Anthropic juga mengenakan biaya untuk menulis cache: 1.25 kali input dasar untuk entri berdurasi lima menit dan 2 kali untuk entri berdurasi satu jam. Cache hit berikutnya memperbarui entri tersebut dengan harga baca. Jadi, entri berdurasi lima menit menutup biayanya setelah satu kali baca. Beban kerja dengan jeda panjang antarpermintaan lebih sering menulis daripada membaca. Dalam kondisi ini, caching lebih mahal daripada penghematannya. Traffic yang stabil cocok untuk caching. Traffic yang bersifat bursty tidak.

Diskon batch. Diskon 50% untuk input dan output pada kedua platform, hanya untuk pekerjaan asinkron. Jika pekerjaan dapat ditunda, biaya pada kedua vendor menjadi setengah, dan diskon ini dapat digabungkan dengan caching.

Porsi output. Claude mengenakan tarif output 5 kali tarif input. OpenAI mengenakan tarif 6 kali. Semakin banyak token yang Anda tulis dibandingkan yang Anda baca, semakin baik posisi Claude pada tarif input yang sama. Hal sebaliknya berlaku untuk pekerjaan yang didominasi input.

Percobaan ulang. Setiap percobaan ulang membayar seluruh input sekali lagi dan tidak menghasilkan apa pun yang dapat digunakan. Jika 6% panggilan Anda gagal dalam validasi skema dan harus dicoba ulang, komponen input Anda 6% lebih besar daripada yang tercantum dalam rencana. Catat percobaan ulang sebagai komponen biaya, bukan sebagai komponen error. Tim biasanya menemukan pengali ini paling akhir, dan nilainya sering lebih besar daripada selisih vendor yang mereka perdebatkan selama seminggu.

Pihak mana yang kalah, dan di mana

Claude kalah telak pada tier kecil. gpt-5.6-luna mengenakan biaya 0.2 per juta token input, sedangkan Claude Haiku 4.5 mengenakan 1, dengan biaya output masing-masing 1.2 dan 5. Klasifikasi volume tinggi dan ekstraksi singkat biayanya kira-kira empat kali lebih mahal pada Claude.

Claude kalah pada tier workhorse mulai 1 September 2026, ketika tarif perkenalan berakhir dan Sonnet 5 berubah menjadi 3 dan 15, sedangkan tarif gpt-5.6-terra tetap. Claude unggul pada tier frontier dalam tarif output, dengan selisih yang dapat dihapus oleh jumlah token Anda sendiri. Tidak ada pihak yang unggul untuk pekerjaan yang didominasi input pada Agustus 2026, karena pada 2 per juta di kedua pihak, biaya inputnya sama.

Cara mengukur ini pada traffic Anda sendiri

Baca objek usage pada setiap respons dan simpan empat angka untuk setiap permintaan: token input, token output, token yang dibaca dari cache, dan token yang ditulis ke cache. Pada Claude API, data tersebut muncul sebagai input_tokens, output_tokens, cache_read_input_tokens, dan cache_creation_input_tokens. Jumlahkan semuanya per hari, kalikan dengan tarif saat ini, lalu bandingkan totalnya dengan tagihan. Selisih antara keduanya biasanya disebabkan oleh percobaan ulang atau jalur kode yang lupa Anda rilis.

Lakukan perbandingan menggunakan traffic nyata selama satu minggu, bukan menggunakan prompt sampel. Bandingkan biaya per tugas yang selesai, bukan biaya per token. Model yang menjawab dalam satu percobaan dengan tarif dua kali lebih tinggi lebih murah daripada model yang memerlukan tiga percobaan dengan tarif setengahnya. Biaya per token adalah tarif. Biaya per tugas yang selesai adalah tagihan Anda.

Tetapkan batas pengeluaran maksimum sebelum membiarkan apa pun berjalan tanpa pengawasan. Kedua platform menyediakan batas pengeluaran di konsolnya. Agent yang terjebak dalam loop percobaan ulang dapat menghabiskan anggaran satu bulan dalam semalam. Terapkan pengaturan tersebut seperti yang Anda lakukan untuk pengendalian biaya pada agent yang selalu aktif. Jika Anda membangun versi pertama pada server milik sendiri, aplikasi Claude API pertama pada VPS menjelaskan penanganan key dan loop permintaan yang menjadi dasar perhitungan ini.

FAQ

Apakah Claude API lebih murah daripada ChatGPT API?

Tidak secara konsisten. Pada Agustus 2026, tingkat frontier dan workhorse mengenakan biaya yang sama per token input pada kedua layanan, sedangkan Claude mengenakan biaya lebih rendah per token output. Karena itu, Claude beberapa persen lebih murah untuk pekerjaan yang didominasi output. Pada tingkat kecil, OpenAI gpt-5.6-luna berbiaya seperlima dari Claude Haiku 4.5 per token input, sehingga klasifikasi bervolume tinggi jauh lebih murah di OpenAI. Hitung biaya Anda sendiri berdasarkan campuran token Anda, karena selisih sekecil itu ditentukan oleh beban kerja, bukan oleh daftar harga.

Mengapa kata-kata yang sama memerlukan jumlah token yang berbeda pada setiap API?

Karena setiap model memiliki tokenizer sendiri, dan jumlah token merupakan karakteristik model tersebut. Anthropic mendokumentasikan bahwa Claude 4.7 dan model yang lebih baru menghasilkan sekitar 30% lebih banyak token untuk teks yang sama dibandingkan Claude Sonnet 4.6 dan model yang lebih lama. Kirim teks Anda sendiri ke endpoint penghitungan token milik setiap vendor, bagi salah satu jumlah token dengan jumlah lainnya, lalu kalikan rasio tersebut dengan tarif yang dipublikasikan sebelum membandingkan. Perbedaan token sebesar 20% mengimbangi sebagian besar perbedaan tarif yang dipublikasikan.

Apakah caching prompt dapat membuat tagihan menjadi lebih besar?

Ya, pada Anthropic. Penulisan cache dikenai biaya 1.25 kali tarif input dasar untuk entri lima menit dan 2 kali untuk entri satu jam, sedangkan cache hit dikenai biaya 0.1 kali tarif tersebut. Jika lalu lintas Anda cukup bursty sehingga sebagian besar entri kedaluwarsa sebelum dibaca, Anda membayar biaya tambahan untuk penulisan dan tidak memperoleh pembacaan. Bandingkan cache_creation_input_tokens dengan cache_read_input_tokens di log Anda. Rasio yang mendekati 1 berarti caching membuat biaya Anda lebih besar. Perpanjang masa berlaku entri atau hapus caching tersebut.

Sebaiknya saya menjalankan coding agent melalui API atau langganan?

Untuk satu developer dengan volume penggunaan normal, seat langganan biasanya lebih murah daripada penagihan API berdasarkan penggunaan. Coding agent mengirim ulang konteks yang besar pada setiap giliran, dan konteks tersebut ditagihkan setiap kali. Ukur penggunaannya selama satu minggu terlebih dahulu, lalu bandingkan total biaya API dengan harga seat. API lebih menguntungkan jika penggunaan tidak merata, atau jika Anda memerlukan akses terprogram yang tidak tersedia melalui seat.

#claude#openai#api-pricing#tokens#cost-comparison