SSD Nodes Learn Hosting plans →
Panduan Matt ConnorOleh Matt Connor · Diperbarui 2026-09-06

Harga Claude Fable 5 dan Kapan Sebaiknya Dipakai

Claude Fable 5 berharga $10 per juta token input dan $50 per juta token output. Pahami tarif resmi serta pekerjaan yang paling sesuai untuk model ini.

Berapa biaya Claude Fable 5?

Biaya Claude Fable 5 adalah $10 per juta token input dan $50 per juta token output pada Claude API. Angka tersebut merupakan tarif resmi yang dipublikasikan Anthropic, yang diambil dari halaman harga pada 3 August 2026. ID model API adalah claude-fable-5. Model ini tersedia secara umum sejak 9 June 2026 pada Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud, dan Microsoft Foundry.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

Anggap informasi tersebut sebagai tingkatan harga. Harga Fable 5 tercantum dua kali lipat dari Claude Opus 5, lima kali tarif Claude Sonnet 5 saat ini, dan sepuluh kali tarif Claude Haiku 4.5. Rasionya sama untuk input dan output karena setiap model dalam tabel tersebut menetapkan harga output tepat lima kali tarif inputnya sendiri. Jadi, jika Anda mengetahui pembagian token input dan output untuk suatu pekerjaan, satu harga dapat dikonversi ke harga lainnya melalui perkalian.

Satu tanggal mengubah perhitungannya. Sonnet 5 menggunakan harga perkenalan sebesar $2 dan $10 per juta token hingga 31 August 2026. Mulai 1 September 2026, harganya tercantum sebesar $3 dan $15. Harga Fable 5 sendiri tidak berubah, sehingga selisih antara keduanya pada tanggal tersebut menyempit dari lima kali menjadi sedikit lebih dari tiga kali. Jika Anda menyusun anggaran untuk musim gugur, gunakan angka Sonnet yang berlaku kemudian.

Diskon dan satu pengali yang meningkatkan biaya

Prompt caching adalah faktor penghematan terbesar. Pembacaan cache dikenai biaya sepersepuluh dari harga input dasar, yaitu $1 per juta token pada Fable 5. Penulisan ke cache lebih mahal daripada token input biasa: 1.25 kali harga dasar untuk cache lima menit dan 2 kali harga dasar untuk cache satu jam. Cache lima menit balik modal setelah satu kali pembacaan, sedangkan cache satu jam balik modal setelah dua kali pembacaan. Perhitungan ini menjadi dasar untuk menentukan titik impas prompt caching sebelum mengaktifkannya di semua tempat.

Batch API memberikan diskon 50% untuk input dan output, sehingga pekerjaan Fable 5 dalam batch dikenai biaya $5 dan $25 per juta token. Permintaan batch berjalan secara asinkron, sehingga fitur ini hanya membantu pekerjaan yang tidak memerlukan jawaban segera. Kedua diskon tersebut dapat digabungkan, sehingga pekerjaan yang menggunakan cache dan batch menjadi murah dari kedua sisi.

Jendela konteks 1M token sudah termasuk dalam tarif standar pada Claude 4.6 dan model yang lebih baru. Tidak ada biaya tambahan untuk konteks panjang, sehingga permintaan 900k token dikenai tarif per token yang sama dengan permintaan 9k token.

Pengali yang meningkatkan tagihan adalah residensi data. Menetapkan inference_geo: "us" agar inferensi tetap berlangsung di Amerika Serikat menerapkan pengali 1.1 kali pada setiap kategori token, termasuk pembacaan dan penulisan cache. Gunakan perutean global default, kecuali kontrak mengharuskan sebaliknya.

Satu aturan penagihan khusus berlaku untuk model ini. Fable 5 merilis safety classifier yang dapat menolak permintaan. Jika hal itu terjadi, Messages API mengembalikan stop_reason: "refusal" sebagai respons HTTP 200 yang berhasil, bukan sebagai error, dan Anda tidak dikenai biaya untuk permintaan yang ditolak sebelum output apa pun dihasilkan. Jika Anda mencoba kembali prompt yang sama pada model Claude lain, fallback credit mengembalikan biaya cache prompt akibat perpindahan tersebut, sehingga Anda tidak membayar untuk memanaskan cache yang sama dua kali.

Paket mana yang mencakup Claude Fable 5?

Per 3 Agustus 2026, halaman Claude Fable milik Anthropic menyatakan bahwa model ini tersedia bagi pengguna Pro, Max, Team, dan Enterprise. Paket gratis tidak disebutkan. Pro adalah paket per pengguna termurah dalam daftar tersebut. Karena itu, biaya Pro dan batas penggunaannya menjadi batas bawah untuk setiap pilihan berlangganan Fable. Jika akses ke Fable menjadi alasan utama Anda melakukan upgrade, pelajari terlebih dahulu apakah paket Pro layak dibayar berdasarkan penggunaan Anda sendiri, karena kuota Fable yang kecil bukan alasan yang kuat untuk berlangganan. Bagi developer, model ini umumnya tersedia melalui Claude API dan marketplace cloud yang tercantum di atas. Jalur tersebut tidak memiliki tingkat gratis. Jadi, kredit kecil yang diberikan Anthropic saat pendaftaran adalah seluruh akses gratis yang Anda dapatkan sebelum penggunaan mulai ditagihkan.

Tersedia dalam suatu paket tidak berarti tersedia tanpa batas. Langganan juga tidak dihitung dengan meteran seperti API, karena seat Pro sama sekali tidak memiliki kuota token yang dipublikasikan dan penggunaan dihitung dalam jumlah pesan pada jendela waktu bergulir. Oleh karena itu, tidak ada komponen paket yang dapat dikonversi secara langsung menjadi angka per satu juta token di atas. Tabel perbandingan paket pada halaman harga Anthropic membatasi akses ke Fable berdasarkan sebagian batas penggunaan mingguan untuk beberapa seat dan berdasarkan kredit penggunaan untuk seat lainnya. Pengaturan tersebut berubah lebih dari sekali selama Juli 2026. Dalam pernyataan Anthropic sendiri tentang penerapan kembali Fable 5, model ini tersedia hingga 50% dari batas penggunaan mingguan sampai 7 Juli 2026 pada paket Pro, Max, Team, dan paket Enterprise tertentu, lalu menggunakan kredit penggunaan setelah tanggal tersebut. Laporan sepanjang sisa Juli menyebutkan perpanjangan tambahan dan perbedaan berdasarkan jenis seat.

Karena itu, halaman ini tidak mencantumkan batas per paket. Tidak ada angka yang diterbitkan selama bulan tersebut yang tetap berlaku selama dua minggu. Angka yang sudah tidak berlaku akan lebih buruk daripada tidak mencantumkan angka sama sekali. Pada hari Anda memutuskan, buka baris berlabel Fable dalam tabel perbandingan paket. Anggap angka dalam artikel berita sudah tidak berlaku. Jika Anda memilih sebuah akun untuk mengakses Fable dan kuotanya ternyata lebih kecil daripada yang Anda perkirakan berdasarkan tabel, menurunkan paket sebelum perpanjangan berikutnya akan mempertahankan akses selama bulan yang sudah Anda bayar.

Hal yang stabil adalah tarif API. Pada setiap jalur, setelah kuota yang termasuk dalam paket habis, penggunaan Fable 5 berikutnya ditagihkan berdasarkan harga pada tabel di atas. Enterprise membuat struktur tersebut terlihat jelas. Biaya akun Enterprise membayar akses, sedangkan token tetap ditagihkan dengan tarif API di luar biaya tersebut. Karena itu, daftar harga adalah angka yang perlu dijadikan dasar perencanaan dalam kedua skenario. Kesimpulan yang sama berlaku saat membandingkan penagihan API dengan langganan untuk model Claude lainnya. Jika Anda belum memilih tingkat paket, mulai dari paket Claude yang sesuai dengan penggunaan Anda. Jika akun tersebut juga akan menjadi asisten sehari-hari Anda, bukan hanya sarana untuk mengakses Fable, periksa perbandingan harga paket Claude dan ChatGPT sebelum menentukan pilihan.

Mengapa tagihan Anda lebih tinggi daripada yang ditunjukkan oleh perbandingan harga

Dua mekanisme yang terdokumentasi membuat biaya Fable 5 lebih tinggi daripada yang ditunjukkan oleh perbandingan harga langsung.

Yang pertama adalah tokenizer. Fable 5 menggunakan tokenizer yang diperkenalkan bersama Claude Opus 4.7. Dibandingkan dengan model yang dirilis sebelum Opus 4.7, teks yang sama menghasilkan sekitar 30% lebih banyak token, dan peningkatan pastinya bergantung pada isi teks. Haiku 4.5 dirilis sebelum tokenizer tersebut, sehingga selisih harga sepuluh kali lipat pada daftar harga menjadi lebih mendekati tiga belas kali lipat setelah kedua model menerima blok teks yang sama. Sonnet 5 menggunakan tokenizer yang lebih baru, sehingga perbandingan biaya per token antara Fable dan Sonnet bersifat setara. Perbandingan antara Fable dan Haiku tidak setara.

Yang kedua adalah thinking. Adaptive thinking selalu aktif pada Fable 5, dan thinking: {"type": "disabled"} tidak didukung. Token thinking ditagihkan sebagai token output, dengan tarif output penuh. Rangkaian pemikiran mentah tidak pernah dikembalikan oleh model ini, dan thinking.display secara default diatur ke "omitted". Artinya, jawaban yang terlihat singkat dapat memiliki jumlah output yang ditagihkan jauh lebih besar. Dokumentasi Anthropic menyatakannya secara jelas: jumlah token output yang ditagihkan tidak sama dengan jumlah token yang terlihat dalam respons.

Baca rinciannya, bukan menebak. Kolom usage.output_tokens_details.thinking_tokens melaporkan jumlah token output yang ditagihkan untuk penalaran:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

Dalam contoh tersebut, yang diambil dari dokumentasi thinking Anthropic, 312 dari 348 token output yang ditagihkan digunakan untuk penalaran yang tidak pernah dilihat pengguna. Saat melakukan streaming, rincian ini hanya dikirim pada event message_delta terakhir. Karena itu, client yang berhenti membaca setelah potongan teks terakhir tidak akan pernah mencatatnya.

Pengaturannya adalah effort, yang ditetapkan pada output_config.effort, dengan level low, medium, high (default), xhigh, dan max.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

Panduan Anthropic untuk model ini adalah memulai dengan high, menaikkannya ke xhigh hanya untuk pekerjaan yang sangat sensitif terhadap kemampuan, dan menurunkannya ke medium atau low untuk pekerjaan rutin. Alasannya, effort yang lebih rendah pada Fable 5 sering kali mengungguli xhigh pada model sebelumnya. Ada dua hal yang perlu diperhatikan. Perubahan effort antar-request membatalkan prompt cache karena nilai effort yang telah ditetapkan dimasukkan ke dalam prompt. Karena itu, pilih satu level untuk setiap workload dan gunakan level tersebut secara konsisten. Selain itu, max_tokens merupakan batas keras untuk total output, yang mencakup thinking dan teks respons. Batas yang ditentukan untuk jawaban tanpa thinking akan menyebabkan respons terpotong. Jika Anda melihat stop_reason: "max_tokens", naikkan batas tersebut atau turunkan effort.

Biaya per tugas yang selesai, bukan biaya per token

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

Baris 3 tersebut adalah perhitungan aritmetika, bukan benchmark. Tarifnya dipublikasikan. Volume tokennya merupakan asumsi yang harus Anda ganti dengan angka dari data penggunaan Anda sendiri. Sesi coding dengan pola seperti baris tengah berbiaya $5.00 pada Fable 5, dibandingkan dengan $1.00 pada Sonnet 5. Eksekusi panjang berbiaya $40.00 dibandingkan dengan $8.00. Kolom Haiku pada baris terakhir itu hanya perhitungan aritmetika: Haiku 4.5 memiliki jendela konteks 200k token, sehingga sama sekali tidak dapat menampung tugas tersebut.

Biaya per token adalah satuan yang keliru untuk mengambil keputusan. Biaya per tugas yang selesai adalah biaya per percobaan dikalikan jumlah percobaan. Dengan tarif saat ini, satu percobaan Fable 5 berbiaya sama dengan lima percobaan Sonnet 5, sehingga jumlah percobaan ulang hampir tidak pernah cukup untuk membenarkan upgrade. Sonnet harus gagal lebih dari empat kali dari setiap lima percobaan sebelum opsi yang lebih murah menghasilkan kerugian dari sisi token.

Alasan yang membenarkan penggunaan model yang lebih mahal adalah semua hal yang tidak tercakup dalam tagihan token. Selisih antara dua eksekusi panjang pada grafik lebih kecil daripada biaya satu jam waktu engineer di sebagian besar pasar. Jika model yang lebih mahal menghemat satu jam waktu peninjauan, atau mencegah satu migrasi buruk yang kemudian harus Anda perbaiki, model tersebut sudah menutup biayanya sendiri melalui penghematan yang tidak pernah terlihat pada tagihan. Lakukan perbandingan berdasarkan biaya per hasil yang diterima, dan masukkan waktu Anda sendiri ke dalam total biaya. Memahami manfaat sebenarnya dari satu juta token membuat perkiraan tersebut jauh lebih konkret.

Tiga tugas yang membuat Claude Fable 5 sepadan dengan harganya

Proses agent dengan rentang waktu panjang yang biaya kesalahannya tinggi. Fable 5 dirancang untuk pekerjaan yang berlangsung selama berjam-jam: jendela konteks 1M token, hingga 128k token output per permintaan, dan tingkat upaya xhigh yang ditujukan untuk tugas yang berjalan lebih dari tiga puluh menit dengan anggaran token dalam jutaan. Bandingkan biaya proses tersebut dengan pekerjaan pembersihan setelah agent mengambil cabang yang salah pada langkah 40 dan tidak ada yang menyadarinya hingga langkah 300.

Migrasi atau audit yang dijalankan satu kali pada codebase besar. Pekerjaan satu kali tidak memiliki volume untuk mengompensasi biaya, sehingga premi per token dibebankan pada satu invoice, dan seluruh pekerjaan mungkin dapat dimuat dalam satu jendela konteks. Jika dapat dijalankan secara asinkron, Batch API memangkas biayanya menjadi $25 per satu juta token output.

Tugas yang sudah dua kali gagal dijalankan oleh model yang lebih murah. Dua percobaan yang gagal, ditambah waktu debugging Anda, biayanya lebih besar daripada satu percobaan Fable pada volume dalam grafik di atas. Menaikkan tingkat model adalah pilihan yang lebih murah, dan itulah fungsi model ladder. Jika Anda masih memilih antara tier secara umum, perbandingan kemampuan antara tier model Claude menjawab pertanyaan yang berbeda dari halaman ini.

Tiga pekerjaan ketika Sonnet 5 atau Haiku 4.5 adalah pilihan yang tepat

Klasifikasi dan ekstraksi bervolume tinggi. Pekerjaan ini dinilai berdasarkan throughput dan biaya per unit, sementara batas kualitasnya cukup rendah sehingga model murah sudah dapat mencapainya. Jika suatu tugas dapat diselesaikan dengan benar oleh Haiku 4.5 dengan biaya sepersepuluhnya, Fable 5 tidak memberikan manfaat terukur.

Pekerjaan interaktif ketika latensi adalah bagian dari produk. Tabel model Anthropic mencantumkan latensi komparatif Fable 5 sebagai lebih lambat, dan mode thinking tidak dapat dinonaktifkan. Kotak chat atau pelengkapan pada editor terasa lebih buruk pada model yang lebih mampu karena pengguna menyadari waktu tunggu sebelum menyadari kualitasnya.

Apa pun yang bergantung pada peristiwa setelah January 2026. Batas pengetahuan andal Fable 5 adalah January 2026. Batas pengetahuan Opus 5 adalah May 2026. Model yang lebih mahal justru memiliki informasi yang lebih lama, sehingga untuk pertanyaan tentang informasi terbaru Anda membayar dua kali lipat untuk pengetahuan yang lebih usang, kecuali Anda memberinya alat search atau fetch.

Satu batasan tidak berkaitan dengan biaya. Fable 5 menyimpan data selama 30 day dan tidak tersedia dengan zero data retention karena ditetapkan sebagai Covered Model. Jika perjanjian Anda mewajibkan zero retention, Fable 5 bukan pilihan pada harga berapa pun, dan diskon apa pun tidak mengubah hal tersebut.

Apa yang ditunjukkan repositori fable-method, dan apa yang tidak ditunjukkannya

Praktisi telah menerbitkan repositori yang merangkum cara kerja pendekatan Fable 5 menjadi skill yang dapat diikuti model yang lebih murah. Repositori fable-method menjelaskan skill berpikir, loop orkestrasi, dan verifier adversarial yang menjalankan ulang setiap pemeriksaan yang diklaim, bukan membaca laporan dari agent itu sendiri. README-nya menyatakan hal tersebut secara langsung: "Ini adalah rangkuman komunitas, bukan artefak Anthropic."

Perlakukan repositori itu sesuai kenyataannya. Repositori tersebut menjadi bukti tentang cara orang mengarahkan model, bukan dokumentasi tentang cara model bekerja. Tidak ada bagian di dalamnya yang divalidasi oleh Anthropic. Selain itu, terdapat beberapa fork yang hampir identik dengan redaksi berbeda. Hal ini lebih sesuai dengan pengetahuan yang berkembang secara informal daripada spesifikasi.

Hal yang relevan untuk keputusan biaya adalah bahwa bagian yang dianggap layak disalin oleh banyak orang bersifat prosedural. Klasifikasikan tugas, tentukan pemeriksaan yang membuktikan bahwa tugas selesai, kumpulkan bukti sebelum mengambil keputusan, lalu lakukan verifikasi melalui observasi, bukan dengan membaca ringkasan. Model yang lebih murah dapat menutup sebagian kesenjangan jika diberi checklist eksplisit dan langkah verifikasi. Karena itu, jalankan eksperimen tersebut pada set evaluasi Anda sendiri sebelum menetapkan model yang mahal sebagai standar. Hasilnya bergantung pada tugas Anda. Oleh sebab itu, angka dari pihak lain tidak banyak berguna bagi Anda.

Periksa angka Anda sendiri sebelum menetapkan anggaran

  • Baca usage pada setiap respons, dan catat output_tokens_details.thinking_tokens secara terpisah dari output yang terlihat. Penalaran yang tidak pernah Anda lihat adalah komponen biaya yang sering mengejutkan.
  • Tetapkan effort secara eksplisit, bukan menerima nilai default, dan pertahankan nilainya selama percakapan apa pun yang mengandalkan caching prompt.
  • Tempatkan prefix yang stabil di belakang cache breakpoint terlebih dahulu. Pembacaan cache dengan harga sepersepuluh dari harga input dasar menghemat lebih banyak biaya daripada sebagian besar penurunan model.
  • Pindahkan semua pekerjaan yang tidak memerlukan jawaban segera ke Batch API.
  • Hitung harga alternatif secara realistis. Membandingkan harga API Claude dan ChatGPT berdasarkan workload Anda sendiri layak dilakukan selama satu sore sebelum membuat komitmen jangka panjang.

Jika workload tersebut adalah agent yang berjalan di server Anda sendiri, kontrol yang paling penting berada di luar pilihan model. Menjaga biaya agent tetap terkendali pada VPS membahas batas loop dan batas pengeluaran yang menghentikan sesi yang berjalan tanpa kendali, sedangkan di mana Claude Code sebenarnya menggunakan token menjelaskan angka yang akan Anda lihat di dashboard penggunaan.

FAQ

Berapa biaya Claude Fable 5 per satu juta token?

Claude Fable 5 tercantum dengan harga $10 per satu juta token input dan $50 per satu juta token output pada Claude API, berdasarkan pemeriksaan pada halaman harga Anthropic tanggal 3 August 2026. Pembacaan cache dikenai biaya $1 per satu juta token, yaitu sepersepuluh tarif input dasar. Batch API memberikan potongan 50% untuk kedua jenis token, sehingga tarifnya menjadi $5 dan $25 per satu juta token untuk pekerjaan asinkron. Menjalankan inferensi hanya di Amerika Serikat dengan parameter inference_geo menambahkan pengali 1.1 pada setiap kategori.

Apakah Claude Fable 5 termasuk dalam langganan Claude Pro?

Halaman Claude Fable milik Anthropic mencantumkan model ini sebagai tersedia bagi pengguna Pro, Max, Team, dan Enterprise, tetapi tidak menyebutkan paket gratis. Akses yang termasuk dalam paket tidak tidak terbatas. Beberapa seat mendapatkan Fable sebagai bagian dari batas penggunaan mingguan, sedangkan yang lain mendapatkannya melalui kredit penggunaan. Pengaturan tersebut telah berubah lebih dari sekali selama July 2026. Baca baris berlabel Fable pada tabel perbandingan paket di halaman harga Anthropic pada hari Anda mengambil keputusan. Jangan mengandalkan angka dari sebuah artikel. Setelah kuota yang termasuk dalam paket habis, penggunaan berikutnya ditagihkan dengan tarif API.

Mengapa tagihan Claude Fable 5 saya lebih tinggi daripada yang terlihat dari output?

Adaptive thinking selalu aktif pada Claude Fable 5. Token thinking ditagihkan sebagai token output, dan chain of thought mentah tidak pernah dikembalikan. Dengan thinking.display pada nilai default omitted, Anda melihat kolom thinking yang kosong, tetapi tetap membayar setiap token penalaran di baliknya. Baca usage.output_tokens_details.thinking_tokens dalam respons untuk melihat rinciannya. Saat menggunakan streaming, informasi tersebut hanya tiba pada event message_delta terakhir. Turunkan level effort jika rasio penalaran terhadap jawaban lebih tinggi daripada kebutuhan tugas.

Sebaiknya saya menggunakan Claude Fable 5 atau Claude Opus 5?

Claude Opus 5 berbiaya setengah dari Fable 5 per token dan memiliki cutoff pengetahuan andal yang lebih baru, yaitu May 2026 dibandingkan January 2026 untuk Fable 5. Mulailah dengan Opus 5 dan beralih ke model yang lebih tinggi jika tugas gagal di sana, atau jika biaya jawaban yang salah lebih besar daripada selisih harga. Fable 5 tepat untuk pekerjaan agen dengan horizon panjang, ketika satu cabang yang salah dapat memerlukan waktu berjam-jam untuk dibersihkan, dan untuk pekerjaan satu kali yang biayanya lebih baik dibebankan pada satu invoice daripada pada setiap request secara permanen.

#claude#fable#model-selection#pricing#tokens