SSD Nodes Learn 🎉 VPS mulai $5.50/bln
Panduan Matt ConnorOleh Matt Connor · Diperbarui 2026-08-13

Harga Claude Fable 5 dan Kapan Sebaiknya Dipakai

Claude Fable 5 berharga $10 per juta token input dan $50 per juta output. Simak arti tarif resmi ini untuk pekerjaan yang benar-benar Anda jalankan.

Berapa biaya Claude Fable 5?

Biaya Claude Fable 5 adalah $10 per juta token input dan $50 per juta token output di Claude API. Itu adalah tarif resmi yang dipublikasikan Anthropic, yang diambil dari halaman harga pada 3 August 2026. ID model API adalah claude-fable-5. Model ini tersedia secara umum sejak 9 June 2026 di Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud, dan Microsoft Foundry.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

Anggap perbandingan ini sebagai tingkatan harga. Harga Fable 5 adalah dua kali harga Claude Opus 5, lima kali tarif Claude Sonnet 5 saat ini, dan sepuluh kali harga Claude Haiku 4.5. Rasionya sama untuk input dan output karena setiap model dalam tabel tersebut menetapkan harga output tepat lima kali tarif inputnya sendiri. Jadi, jika Anda mengetahui pembagian token input dan output untuk suatu pekerjaan, Anda dapat mengonversi satu harga ke harga lainnya dengan perkalian.

Satu tanggal mengubah perhitungannya. Sonnet 5 menggunakan harga perkenalan sebesar $2 dan $10 per juta token hingga 31 August 2026. Mulai 1 September 2026, harganya menjadi $3 dan $15. Harga Fable 5 sendiri tidak berubah, sehingga selisih harganya menyempit dari lima kali menjadi sedikit lebih dari tiga kali pada tanggal tersebut. Jika Anda menyusun anggaran untuk musim gugur, gunakan angka Sonnet yang berlaku kemudian.

Diskon dan satu pengali yang menaikkan biaya

Prompt caching adalah tuas penghematan terbesar. Pembacaan cache dikenai biaya sepersepuluh dari harga input dasar, yaitu $1 per juta token pada Fable 5. Penulisan ke cache biayanya lebih tinggi daripada token input biasa: 1.25 kali harga dasar untuk cache lima menit dan 2 kali harga dasar untuk cache satu jam. Cache lima menit menutup biayanya setelah satu kali pembacaan, sedangkan cache satu jam menutup biayanya setelah dua kali pembacaan. Perhitungan ini menjadi dasar untuk menentukan titik impas prompt caching sebelum Anda mengaktifkannya di semua tempat.

Batch API memberikan diskon 50% untuk input dan output. Dengan demikian, pekerjaan Fable 5 secara batch dikenai biaya $5 dan $25 per juta token. Permintaan batch berjalan secara asinkron, sehingga fitur ini hanya membantu pekerjaan yang tidak memerlukan jawaban segera. Kedua diskon tersebut dapat digabungkan, sehingga pekerjaan yang menggunakan cache dan batch menjadi murah pada kedua sisi.

Jendela konteks 1M token sudah termasuk dalam tarif standar pada Claude 4.6 dan model yang lebih baru. Tidak ada biaya tambahan untuk konteks panjang. Jadi, permintaan 900k token dikenai tarif per token yang sama dengan permintaan 9k token.

Pengali yang menaikkan tagihan berkaitan dengan residensi data. Menetapkan inference_geo: "us" agar inferensi tetap berlangsung di Amerika Serikat menerapkan pengali 1.1 kali pada setiap kategori token, termasuk pembacaan dan penulisan cache. Pertahankan perutean global default, kecuali kontrak mengharuskan sebaliknya.

Satu aturan penagihan khusus berlaku untuk model ini. Fable 5 dilengkapi pengklasifikasi keamanan yang dapat menolak permintaan. Jika hal itu terjadi, Messages API mengembalikan stop_reason: "refusal" sebagai respons HTTP 200 yang berhasil, bukan sebagai error. Anda tidak dikenai biaya untuk permintaan yang ditolak sebelum output apa pun dibuat. Jika Anda mencoba kembali prompt yang sama pada model Claude lain, kredit fallback mengembalikan biaya cache prompt dari perpindahan tersebut. Dengan demikian, Anda tidak membayar untuk mengisi cache yang sama dua kali.

Paket mana yang mencakup Claude Fable 5?

Per 3 August 2026, halaman Claude Fable milik Anthropic menyatakan bahwa model ini tersedia bagi pengguna Pro, Max, Team, dan Enterprise. Paket gratis tidak disebutkan. Pro adalah paket per pengguna termurah dalam daftar tersebut. Karena itu, biaya Pro dan batas penggunaan yang berlaku menjadi batas minimum untuk setiap opsi berlangganan ke Fable. Bagi developer, model ini tersedia secara umum melalui Claude API dan marketplace cloud yang tercantum di atas. Tidak ada free tier untuk jalur tersebut. Jadi, kredit kecil yang diberikan Anthropic saat pendaftaran adalah seluruh akses gratis yang Anda dapatkan sebelum penggunaan mulai ditagihkan.

Tersedia dalam suatu paket tidak sama dengan tersedia tanpa batas. Tabel perbandingan paket pada halaman harga Anthropic membatasi akses ke Fable berdasarkan sebagian batas penggunaan mingguan untuk beberapa jenis seat, dan berdasarkan kredit penggunaan untuk jenis lainnya. Ketentuan tersebut berubah lebih dari satu kali selama July 2026. Pernyataan Anthropic sendiri tentang peluncuran ulang Fable 5 mencakup model tersebut hingga 50% dari batas penggunaan mingguan sampai 7 July 2026 untuk paket Pro, Max, Team, dan paket Enterprise tertentu, dengan kredit penggunaan setelah tanggal tersebut. Laporan sepanjang sisa July menyebutkan perpanjangan tambahan dan perbedaan berdasarkan jenis seat.

Karena itu, halaman ini tidak mencantumkan batas per paket. Tidak ada angka yang diterbitkan selama bulan tersebut yang tetap berlaku selama dua minggu. Angka yang sudah kedaluwarsa di sini lebih buruk daripada tidak mencantumkan angka sama sekali. Buka baris berlabel Fable pada tabel perbandingan paket di hari Anda mengambil keputusan, dan anggap angka dalam artikel berita sudah kedaluwarsa. Jika Anda mengambil seat untuk mengakses Fable, tetapi batas penggunaannya ternyata lebih kecil daripada yang Anda perkirakan dari tabel, menurunkan paket sebelum perpanjangan berikutnya akan mempertahankan akses selama bulan yang sudah Anda bayar.

Yang tetap stabil adalah tarif API. Pada setiap jalur, setelah jatah yang disertakan habis, penggunaan Fable 5 berikutnya ditagihkan berdasarkan harga pada bagan di atas. Enterprise memperjelas struktur ini, karena biaya seat Enterprise memberikan akses, sementara token tetap ditagihkan dengan tarif API di luar biaya tersebut. Dengan demikian, daftar harga adalah angka yang perlu dijadikan dasar perencanaan dalam kedua skenario. Kesimpulan yang sama berlaku saat membandingkan penagihan API dengan langganan untuk model Claude lainnya. Jika Anda belum memilih tier, mulai dari paket Claude yang sesuai dengan penggunaan Anda. Jika seat tersebut juga akan digunakan sebagai asisten sehari-hari, bukan hanya sebagai akses ke Fable, sebaiknya periksa perbandingan harga paket Claude dengan ChatGPT sebelum mengambil keputusan.

Mengapa tagihan Anda lebih tinggi daripada yang ditunjukkan oleh rasio harga

Dua mekanisme yang terdokumentasi membuat Fable 5 lebih mahal daripada yang ditunjukkan oleh perbandingan harga langsung.

Yang pertama adalah tokenizer. Fable 5 menggunakan tokenizer yang diperkenalkan bersama Claude Opus 4.7. Dibandingkan dengan model yang dirilis sebelum Opus 4.7, teks yang sama menghasilkan sekitar 30% lebih banyak token, dan peningkatan pastinya bergantung pada isi teks. Haiku 4.5 dirilis sebelum tokenizer tersebut, sehingga selisih sepuluh kali lipat pada daftar harga menjadi lebih mendekati tiga belas kali lipat ketika kedua model menerima blok teks yang sama. Sonnet 5 menggunakan tokenizer yang lebih baru, sehingga perbandingan Fable dengan Sonnet berdasarkan token tetap adil. Perbandingan Fable dengan Haiku tidak demikian.

Yang kedua adalah thinking. Adaptive thinking selalu aktif pada Fable 5, dan thinking: {"type": "disabled"} tidak didukung. Token thinking ditagihkan sebagai token output dengan tarif output penuh. Rangkaian pemikiran mentah tidak pernah dikembalikan oleh model ini, dan thinking.display secara default bernilai "omitted". Artinya, jawaban terlihat yang singkat dapat memiliki jumlah output yang ditagihkan dalam jumlah besar. Dokumentasi Anthropic menyatakannya dengan jelas: jumlah token output yang ditagihkan tidak sama dengan jumlah token yang terlihat dalam respons.

Baca rinciannya, jangan menebak. Kolom usage.output_tokens_details.thinking_tokens melaporkan jumlah token output yang ditagihkan untuk reasoning:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

Dalam contoh tersebut, yang diambil dari dokumentasi thinking Anthropic, 312 dari 348 token output yang ditagihkan digunakan untuk reasoning yang tidak pernah dilihat pengguna. Saat Anda melakukan streaming, rincian ini hanya diterima pada event message_delta terakhir. Karena itu, klien yang berhenti membaca setelah potongan teks terakhir tidak akan pernah mencatatnya.

Pengaturannya adalah effort, yang ditetapkan pada output_config.effort, dengan level low, medium, high (default), xhigh, dan max.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

Panduan Anthropic untuk model ini adalah memulai dari high, menaikkannya ke xhigh hanya untuk pekerjaan yang sangat sensitif terhadap kemampuan, dan menurunkannya ke medium atau low untuk pekerjaan rutin. Alasannya, effort yang lebih rendah pada Fable 5 sering kali mengungguli xhigh pada model sebelumnya. Ada dua hal yang perlu diperhatikan. Mengubah effort antarpermintaan membatalkan prompt cache karena nilai effort yang telah ditetapkan akan dimasukkan ke dalam prompt. Karena itu, pilih satu level untuk setiap beban kerja dan gunakan level tersebut secara konsisten. Selain itu, max_tokens merupakan batas maksimum untuk total output, yang mencakup thinking dan teks respons. Jadi, batas yang cukup untuk jawaban tanpa thinking dapat menyebabkan respons terpotong. Jika melihat stop_reason: "max_tokens", Anda harus menaikkan batas tersebut atau menurunkan effort.

Biaya per tugas yang selesai, bukan biaya per token

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

Baris 3 tersebut adalah perhitungan aritmetika, bukan tolok ukur. Tarifnya dipublikasikan. Volume tokennya merupakan asumsi yang harus Anda ganti dengan angka dari data penggunaan Anda sendiri. Sesi coding dengan pola seperti baris tengah berbiaya $5.00 pada Fable 5, dibandingkan dengan $1.00 pada Sonnet 5. Proses panjang berbiaya $40.00, dibandingkan dengan $8.00. Kolom Haiku pada baris terakhir hanya merupakan perhitungan aritmetika: Haiku 4.5 memiliki jendela konteks 200k token, sehingga sama sekali tidak dapat menampung tugas tersebut.

Biaya per token bukan satuan yang tepat untuk pengambilan keputusan. Biaya per tugas yang selesai adalah biaya per percobaan dikalikan jumlah percobaan. Dengan tarif saat ini, satu percobaan Fable 5 berbiaya sama dengan lima percobaan Sonnet 5, sehingga jumlah percobaan ulang saja hampir tidak pernah cukup untuk membenarkan upgrade. Sonnet harus gagal lebih dari empat kali dari lima percobaan sebelum opsi yang lebih murah kalah berdasarkan penggunaan token.

Yang membenarkan pilihan tersebut adalah semua hal yang tidak tercakup dalam tagihan token. Selisih antara dua proses panjang pada grafik lebih kecil daripada biaya satu jam waktu engineer di sebagian besar pasar. Jika model yang lebih mahal menghemat satu jam waktu peninjauan, atau mencegah satu migrasi yang bermasalah dan harus Anda uraikan kembali, model tersebut sudah membayar biayanya sendiri melalui penghematan yang tidak pernah terlihat pada tagihan. Lakukan perbandingan berdasarkan biaya per hasil yang diterima, dan masukkan waktu Anda sendiri ke dalam total biaya. Memahami manfaat sebenarnya dari satu juta token membuat estimasi tersebut jauh lebih konkret.

Tiga pekerjaan yang membuat harga Claude Fable 5 sepadan

Proses agent jangka panjang yang kesalahan kecilnya mahal untuk diperbaiki. Fable 5 dirancang untuk pekerjaan yang berlangsung selama berjam-jam: context window 1M token, hingga 128k output token per permintaan, serta tingkat xhigh effort yang ditujukan untuk tugas yang berjalan lebih dari tiga puluh menit dengan anggaran token dalam jutaan. Bandingkan biaya proses tersebut dengan pekerjaan pembersihan setelah agent mengambil cabang yang salah pada langkah 40, tetapi tidak ada yang menyadarinya hingga langkah 300.

Migrasi atau audit yang dijalankan satu kali pada codebase besar. Pekerjaan satu kali tidak memiliki volume untuk mengompensasi biaya, sehingga biaya tambahan per token dibebankan pada satu invoice, dan seluruh pekerjaan mungkin dapat dimuat dalam satu context window. Jika dapat dijalankan secara asynchronous, Batch API memangkas biayanya menjadi $25 per juta output token.

Tugas yang sudah dua kali gagal dijalankan oleh model yang lebih murah. Dua upaya yang gagal, ditambah waktu debugging Anda, lebih mahal daripada satu upaya dengan Fable pada volume dalam tabel di atas. Eskalasi adalah pilihan yang lebih murah, dan itulah fungsi model ladder. Jika Anda masih memilih tier secara umum, perbandingan kemampuan antara tier model Claude menjawab pertanyaan yang berbeda dari halaman ini.

Tiga pekerjaan ketika Sonnet 5 atau Haiku 4.5 adalah pilihan yang tepat

Klasifikasi dan ekstraksi volume tinggi. Pekerjaan ini dinilai berdasarkan throughput dan biaya per unit, sementara batas kualitasnya cukup rendah sehingga model murah sudah dapat mencapainya. Jika suatu tugas dapat diselesaikan dengan benar oleh Haiku 4.5 dengan biaya sepersepuluhnya, Fable 5 tidak memberikan manfaat yang dapat diukur.

Pekerjaan interaktif ketika latensi adalah bagian dari produk. Tabel model Anthropic mencantumkan latensi komparatif Fable 5 sebagai lebih lambat, dan fitur thinking tidak dapat dinonaktifkan. Kotak chat atau penyelesaian otomatis di editor terasa lebih buruk pada model yang lebih mampu karena pengguna merasakan waktu tunggu sebelum menyadari kualitasnya.

Apa pun yang bergantung pada peristiwa setelah January 2026. Batas pengetahuan andal Fable 5 adalah January 2026. Batas pengetahuan Opus 5 adalah May 2026. Model yang lebih mahal justru memiliki informasi yang lebih lama. Jadi, untuk pertanyaan tentang informasi terbaru, Anda membayar dua kali lipat untuk pengetahuan yang lebih lama, kecuali Anda memberinya tool pencarian atau pengambilan data.

Ada satu batasan yang sepenuhnya berada di luar biaya. Fable 5 menerapkan retensi data selama 30 hari dan tidak tersedia dengan zero data retention karena ditetapkan sebagai Covered Model. Jika perjanjian Anda mewajibkan zero retention, Fable 5 bukan pilihan pada harga berapa pun, dan diskon apa pun tidak mengubah hal tersebut.

Apa yang ditunjukkan repositori fable-method, dan apa yang tidak ditunjukkannya

Praktisi telah menerbitkan repositori yang merangkum cara kerja pendekatan Fable 5 menjadi keterampilan yang dapat diikuti model yang lebih murah. Repositori fable-method menjelaskan keterampilan berpikir, loop orkestrasi, dan verifier adversarial yang menjalankan ulang setiap pemeriksaan yang diklaim, alih-alih membaca laporan dari agent itu sendiri. README-nya menyatakan hal tersebut secara langsung: "Ini adalah rangkuman komunitas, bukan artefak Anthropic."

Perlakukan repositori tersebut tepat seperti itu. Repositori itu merupakan bukti tentang cara orang mengarahkan model, bukan dokumentasi tentang cara kerja model. Tidak ada bagian di dalamnya yang divalidasi oleh Anthropic. Selain itu, terdapat beberapa fork yang hampir identik dengan redaksi berbeda. Hal ini lebih sesuai dengan karakteristik pengetahuan yang berkembang dari praktik daripada spesifikasi.

Sinyal yang berguna untuk mengambil keputusan biaya adalah bahwa bagian-bagian yang dianggap layak disalin oleh orang-orang bersifat prosedural. Klasifikasikan tugas, tentukan pemeriksaan yang membuktikan bahwa tugas tersebut selesai, kumpulkan bukti sebelum mengambil keputusan, lalu lakukan verifikasi melalui observasi, bukan dengan membaca ringkasan. Model yang lebih murah akan menutup sebagian kesenjangan jika diberi checklist eksplisit dan langkah verifikasi. Karena itu, jalankan eksperimen tersebut pada set evaluasi Anda sendiri sebelum menetapkan model yang mahal sebagai standar. Hasilnya bergantung pada tugas Anda. Itu sebabnya angka dari pihak lain tidak banyak berguna bagi Anda.

Periksa angka Anda sendiri sebelum menetapkan anggaran

  • Baca usage pada setiap respons, dan catat output_tokens_details.thinking_tokens secara terpisah dari output yang terlihat. Penalaran yang tidak pernah Anda lihat adalah komponen biaya yang sering mengejutkan pengguna.
  • Tetapkan effort secara eksplisit, alih-alih menerima nilai default, dan pertahankan nilainya selama percakapan apa pun yang mengandalkan prompt caching.
  • Tempatkan prefix yang stabil di balik breakpoint cache terlebih dahulu. Pembacaan cache dengan harga sepersepuluh dari harga input dasar menghemat lebih banyak biaya daripada kebanyakan penurunan tingkat model.
  • Pindahkan semua pekerjaan yang tidak memerlukan jawaban segera ke Batch API.
  • Hitung harga alternatif secara realistis. Membandingkan harga API Claude dan ChatGPT berdasarkan beban kerja Anda sendiri layak dilakukan selama satu sore sebelum membuat komitmen jangka panjang.

Jika beban kerja tersebut adalah agent yang berjalan di server Anda sendiri, kontrol yang paling penting berada di luar pilihan model. Mengendalikan biaya agent pada VPS membahas batas loop dan batas pengeluaran yang menghentikan sesi yang berjalan tanpa kendali, sedangkan tempat Claude Code sebenarnya menggunakan token menjelaskan angka yang akan Anda lihat di dasbor penggunaan.

FAQ

Berapa biaya Claude Fable 5 per juta token?

Claude Fable 5 tercantum dengan harga $10 per juta token input dan $50 per juta token output pada Claude API, berdasarkan pemeriksaan halaman harga Anthropic pada 3 Agustus 2026. Pembacaan cache dikenai biaya $1 per juta token, yaitu sepersepuluh tarif input dasar. Batch API memberikan potongan 50% untuk keduanya, sehingga biayanya menjadi $5 dan $25 per juta token untuk pekerjaan asinkron. Mempertahankan inference di dalam Amerika Serikat dengan parameter inference_geo menambahkan pengali 1.1 pada setiap kategori.

Apakah Claude Fable 5 termasuk dalam langganan Claude Pro?

Halaman Claude Fable milik Anthropic mencantumkan model ini sebagai tersedia bagi pengguna Pro, Max, Team, dan Enterprise, tetapi tidak mencantumkan paket gratis. Akses yang termasuk dalam paket tidak tidak terbatas. Sebagian seat mendapatkan akses ke Fable sebagai bagian dari batas penggunaan mingguan, sedangkan seat lainnya menggunakannya melalui kredit penggunaan. Pengaturan tersebut berubah lebih dari sekali selama Juli 2026. Baca baris berlabel Fable pada tabel perbandingan paket di halaman harga Anthropic pada hari Anda mengambil keputusan, bukan mengandalkan angka dari sebuah artikel. Setelah jatah yang termasuk dalam paket habis, penggunaan berikutnya ditagihkan dengan tarif API.

Mengapa tagihan Claude Fable 5 saya lebih tinggi daripada yang terlihat dari output?

Adaptive thinking selalu aktif pada Claude Fable 5. Token thinking ditagihkan sebagai token output, dan chain of thought mentah tidak pernah dikembalikan. Dengan thinking.display pada nilai default omitted, Anda melihat bidang thinking yang kosong, tetapi tetap membayar setiap token reasoning di baliknya. Baca usage.output_tokens_details.thinking_tokens dalam response untuk melihat rinciannya. Dalam mode streaming, data tersebut hanya tiba pada event message_delta terakhir. Turunkan level effort jika rasio reasoning terhadap jawaban lebih tinggi daripada yang diperlukan tugas tersebut.

Sebaiknya saya menggunakan Claude Fable 5 atau Claude Opus 5?

Claude Opus 5 berbiaya setengah dari Claude Fable 5 per token dan memiliki cutoff pengetahuan andal yang lebih baru, yaitu Mei 2026 dibandingkan Januari 2026 untuk Fable 5. Mulailah dengan Opus 5 dan eskalasikan ke Fable 5 jika tugas gagal di sana, atau jika biaya jawaban yang salah lebih besar daripada selisih harga. Fable 5 lebih tepat untuk pekerjaan agen dengan horizon panjang, ketika satu cabang yang salah dapat menyebabkan berjam-jam cleanup, serta untuk pekerjaan satu kali yang biayanya muncul pada satu invoice, bukan pada setiap request selamanya.

#claude#fable#model-selection#pricing#tokens