SSD Nodes Learn Hosting plans →
Panduan Matt ConnorOleh Matt Connor · Dikemas kini 2026-09-06

Harga Claude Fable 5 dan bila patut menggunakannya

Claude Fable 5 berharga $10 bagi sejuta token input dan $50 bagi output. Semak maksud kadar terbitan ini untuk tugas sebenar yang anda jalankan.

Berapakah kos Claude Fable 5?

Claude Fable 5 berharga $10 bagi setiap sejuta token input dan $50 bagi setiap sejuta token output pada Claude API. Itu ialah kadar senarai yang diterbitkan oleh Anthropic, berdasarkan halaman harga pada 3 August 2026. ID model API ialah claude-fable-5. Model ini tersedia secara umum mulai 9 June 2026 pada Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud dan Microsoft Foundry.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

Anggap harga itu sebagai satu skala. Harga senarai Fable 5 ialah dua kali ganda Claude Opus 5, lima kali ganda kadar semasa Claude Sonnet 5 dan sepuluh kali ganda Claude Haiku 4.5. Nisbahnya sama bagi kedua-dua komponen bil kerana setiap model dalam jadual itu menetapkan harga output tepat lima kali ganda kadar inputnya sendiri. Jadi, jika anda mengetahui pecahan token input dan output bagi sesuatu tugas, anda boleh menukar satu harga kepada harga yang lain melalui pendaraban.

Satu tarikh mengubah pengiraan. Sonnet 5 menggunakan harga pengenalan $2 dan $10 bagi setiap sejuta token sehingga 31 August 2026. Mulai 1 September 2026, harga senarainya ialah $3 dan $15. Harga Fable 5 sendiri tidak berubah, jadi jurang antara kedua-duanya mengecil daripada lima kali ganda kepada sedikit lebih tiga kali ganda pada tarikh tersebut. Jika anda menyediakan belanjawan untuk musim luruh, gunakan angka Sonnet yang kemudian.

Diskaun dan satu pengganda yang meningkatkan kos

Caching prompt ialah tuil terbesar untuk mengurangkan kos. Bacaan cache berharga satu persepuluh daripada harga input asas, iaitu $1 bagi setiap sejuta token pada Fable 5. Penulisan ke cache berharga lebih tinggi daripada token input biasa: 1.25 kali ganda kadar asas untuk cache lima minit dan 2 kali ganda kadar asas untuk cache satu jam. Cache lima minit membayar kosnya selepas satu bacaan, manakala cache satu jam selepas dua bacaan. Pengiraan itu merupakan asas untuk menentukan titik pulang modal caching prompt sebelum anda mengaktifkannya di semua tempat.

Batch API memberikan diskaun 50% pada kedua-dua bahagian, jadi kerja Fable 5 secara kelompok berharga $5 bagi input dan $25 bagi output untuk setiap sejuta token. Permintaan kelompok diproses secara tak segerak. Oleh itu, ciri ini hanya membantu kerja yang tidak memerlukan jawapan serta-merta. Kedua-dua diskaun boleh digabungkan, menjadikan kerja berkelompok yang menggunakan cache murah dari segi input dan output.

Tetingkap konteks 1M token disertakan pada kadar standard untuk Claude 4.6 dan model yang lebih baharu. Tiada surcaj konteks panjang. Oleh itu, permintaan 900k token dikenakan kadar setiap token yang sama seperti permintaan 9k token.

Pengganda yang meningkatkan bil ialah penempatan data. Menetapkan inference_geo: "us" supaya inferens kekal di Amerika Syarikat mengenakan pengganda 1.1 kali ganda pada setiap kategori token, termasuk bacaan cache dan penulisan cache. Kekalkan penghalaan global lalai kecuali kontrak menetapkan sebaliknya.

Satu peraturan pengebilan khusus untuk model ini. Fable 5 disertakan pengelas keselamatan yang boleh menolak permintaan. Apabila itu berlaku, Messages API mengembalikan stop_reason: "refusal" sebagai respons HTTP 200 yang berjaya, bukannya ralat. Anda tidak dikenakan bayaran untuk permintaan yang ditolak sebelum sebarang output dijana. Jika anda mencuba semula prompt yang sama pada model Claude lain, kredit fallback memulangkan kos cache prompt bagi pertukaran tersebut. Oleh itu, anda tidak membayar untuk memanaskan cache yang sama dua kali.

Pelan manakah yang merangkumi Claude Fable 5?

Setakat 3 August 2026, halaman Claude Fable Anthropic menyatakan bahawa model ini tersedia kepada pengguna Pro, Max, Team dan Enterprise. Pelan percuma tidak dinyatakan. Pro ialah seat paling murah dalam senarai itu. Oleh itu, kos Pro dan had penggunaannya menjadi asas bagi mana-mana laluan langganan kepada Fable. Jika akses kepada Fable ialah sebab utama anda mahu menaik taraf, teliti dahulu sama ada seat Pro berbaloi berdasarkan penggunaan anda sendiri, kerana elaun Fable yang kecil tidak mencukupi sebagai alasan tunggal untuk melanggan. Bagi pembangun, model ini tersedia secara umum melalui Claude API dan cloud marketplace yang disenaraikan di atas. Laluan itu tidak mempunyai free tier. Oleh itu, kredit kecil yang Anthropic berikan semasa pendaftaran ialah jumlah yang anda terima sebelum caj penggunaan bermula.

Tersedia dalam sesuatu pelan tidak bermaksud ciri itu disertakan tanpa had. Langganan juga tidak diukur dengan cara yang sama seperti API, kerana seat Pro tidak mempunyai kuota token yang diterbitkan dan sebaliknya mengira penggunaan dalam bentuk mesej sepanjang tetingkap bergulir. Oleh itu, tiada ciri dalam sesuatu pelan yang boleh ditukar secara terus kepada angka bagi setiap juta token di atas. Jadual perbandingan pelan pada halaman harga Anthropic mengehadkan akses kepada Fable berdasarkan sebahagian daripada had penggunaan mingguan bagi sesetengah seat, dan berdasarkan kredit penggunaan bagi seat lain. Susunan ini berubah lebih daripada sekali sepanjang Julai 2026. Kenyataan Anthropic sendiri tentang penggunaan semula Fable 5 menyatakan bahawa model itu disertakan sehingga 50% daripada had penggunaan mingguan hingga 7 Julai 2026 pada pelan Pro, Max, Team dan Enterprise terpilih, dengan kredit penggunaan selepas tarikh tersebut. Laporan sepanjang baki Julai menyatakan bahawa tempoh itu dilanjutkan lagi dan akses dibahagikan mengikut jenis seat.

Oleh itu, halaman ini tidak akan menyenaraikan had bagi setiap pelan. Tiada angka yang diterbitkan sepanjang bulan tersebut kekal sah selama dua minggu, dan angka yang sudah lapuk di sini lebih buruk daripada tiada angka. Buka baris berlabel Fable dalam jadual perbandingan pelan pada hari anda membuat keputusan, dan anggap sebarang angka dalam artikel berita sebagai sudah lapuk. Jika anda mengambil seat untuk akses kepada Fable tetapi elaun sebenar lebih kecil daripada jangkaan berdasarkan jadual, menurunkan pelan sebelum pembaharuan seterusnya membolehkan anda mengekalkan bulan yang telah dibayar.

Kadar API ialah perkara yang kekal. Pada semua laluan, selepas elaun yang termasuk dalam pelan digunakan sepenuhnya, penggunaan Fable 5 seterusnya dicaj mengikut harga dalam carta di atas. Enterprise menjadikan struktur ini jelas kerana yuran seat Enterprise memberikan akses, manakala token masih dicaj mengikut kadar API di sampingnya. Oleh itu, senarai harga ialah angka yang perlu digunakan untuk perancangan dalam kedua-dua keadaan. Kesimpulan yang sama diperoleh apabila membandingkan pengebilan API dengan langganan untuk mana-mana model Claude yang lain. Jika anda belum memilih tier, mulakan dengan pelan Claude yang sepadan dengan penggunaan anda. Jika seat itu juga akan menjadi pembantu harian anda, bukan sekadar cara untuk mendapatkan akses kepada Fable, semak perbandingan harga pelan Claude dengan ChatGPT sebelum membuat komitmen.

Mengapa bil anda lebih tinggi daripada yang ditunjukkan oleh nisbah harga

Dua mekanisme yang didokumenkan menyebabkan Fable 5 berharga lebih tinggi daripada yang tersirat oleh perbandingan harga secara langsung.

Mekanisme pertama ialah tokenizer. Fable 5 menggunakan tokenizer yang diperkenalkan bersama Claude Opus 4.7. Berbanding model yang dikeluarkan sebelum Opus 4.7, teks yang sama menghasilkan kira-kira 30% lebih banyak token, dan peningkatan tepat bergantung pada kandungan. Haiku 4.5 mendahului tokenizer itu, jadi jurang sepuluh kali ganda dalam senarai harga lebih hampir kepada tiga belas kali ganda apabila kedua-dua model menerima blok teks yang sama. Sonnet 5 menggunakan tokenizer yang lebih baharu, jadi perbandingan Fable dengan Sonnet berdasarkan token adalah adil. Perbandingan Fable dengan Haiku tidak.

Mekanisme kedua ialah thinking. Adaptive thinking sentiasa diaktifkan untuk Fable 5, dan thinking: {"type": "disabled"} tidak disokong. Token thinking dibilkan sebagai token output pada kadar output penuh. Rantaian pemikiran mentah tidak pernah dikembalikan oleh model ini, dan thinking.display ditetapkan kepada "omitted" secara lalai. Ini bermakna jawapan yang kelihatan ringkas boleh mempunyai jumlah output yang dibilkan dengan banyak. Dokumentasi Anthropic menyatakannya dengan jelas: jumlah token output yang dibilkan tidak sama dengan jumlah token yang kelihatan dalam respons.

Baca pecahan penggunaan dan jangan membuat andaian. Medan usage.output_tokens_details.thinking_tokens melaporkan jumlah token output yang dibilkan untuk reasoning:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

Dalam contoh itu, yang diambil daripada dokumentasi thinking Anthropic, 312 daripada 348 token output yang dibilkan ialah reasoning yang tidak pernah dilihat oleh sesiapa. Apabila anda menggunakan streaming, pecahan ini hanya tiba dalam event message_delta terakhir. Oleh itu, klien yang berhenti membaca selepas chunk teks terakhir tidak akan merekodkannya.

Kawalan tersebut ialah effort, yang ditetapkan pada output_config.effort, dengan tahap low, medium, high (lalai), xhigh dan max.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

Panduan Anthropic untuk model ini adalah bermula pada high, meningkat kepada xhigh hanya untuk kerja yang paling sensitif terhadap keupayaan, dan menurunkannya kepada medium atau low untuk kerja rutin. Ini kerana effort yang lebih rendah pada Fable 5 sering mengatasi xhigh pada model terdahulu. Terdapat dua perangkap. Menukar effort antara permintaan akan membatalkan prompt cache kerana nilai effort yang telah diselesaikan dimasukkan ke dalam prompt. Oleh itu, pilih satu tahap bagi setiap beban kerja dan kekalkan tahap itu. Selain itu, max_tokens ialah had keras untuk jumlah output yang merangkumi thinking dan teks respons. Had yang ditetapkan berdasarkan jawapan tanpa thinking akan menyebabkan respons terpotong. Jika anda melihat stop_reason: "max_tokens", tingkatkan had tersebut atau rendahkan effort.

Kos bagi setiap tugas yang diselesaikan, bukan kos bagi setiap token

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

3 baris itu ialah pengiraan aritmetik, bukannya penanda aras. Kadar tersebut diterbitkan. Jumlah token ialah andaian yang perlu digantikan dengan angka daripada data penggunaan anda sendiri. Sesi pengekodan yang menyerupai baris tengah berharga $5.00 pada Fable 5 berbanding $1.00 pada Sonnet 5. Proses yang panjang berharga $40.00 berbanding $8.00. Lajur Haiku pada baris terakhir itu hanyalah pengiraan aritmetik: Haiku 4.5 mempunyai tetingkap konteks 200k token, jadi ia langsung tidak dapat memuatkan tugas tersebut.

Kos bagi setiap token ialah unit yang salah untuk membuat keputusan. Kos bagi setiap tugas yang diselesaikan ialah kos bagi setiap percubaan didarab dengan jumlah percubaan. Pada kadar semasa, satu percubaan Fable 5 berharga sama seperti lima percubaan Sonnet 5. Oleh itu, jumlah percubaan semula sahaja hampir tidak pernah menjadi alasan untuk menaik taraf. Sonnet perlu gagal lebih daripada empat kali daripada lima percubaan sebelum pilihan yang murah itu menjadi lebih mahal dari segi token.

Yang menjadi alasan ialah semua perkara yang tidak termasuk dalam bil token. Perbezaan antara dua proses panjang dalam carta itu lebih kecil daripada kos satu jam masa jurutera di kebanyakan pasaran. Jika model yang lebih mahal menjimatkan satu jam semakan, atau mengelakkan satu migrasi yang bermasalah dan perlu anda betulkan semula, model itu sudah membayar kosnya sendiri melalui penjimatan yang tidak pernah dipaparkan pada bil. Buat perbandingan berdasarkan kos bagi setiap hasil yang diterima, dan masukkan masa anda sendiri dalam jumlah keseluruhan. Mengetahui nilai sebenar sejuta token menjadikan anggaran itu jauh kurang abstrak.

Tiga tugas yang menjadikan Claude Fable 5 berbaloi

Pelaksanaan agen jangka panjang yang kesilapannya mahal untuk diperbetulkan. Fable 5 dibina untuk tugas yang diukur dalam jam: tetingkap konteks 1M token, sehingga 128k token output bagi setiap permintaan, serta tahap usaha xhigh yang disasarkan kepada tugas yang berjalan melebihi tiga puluh minit dengan belanjawan token berjuta-juta. Bandingkan kos pelaksanaan dengan kerja pembersihan selepas agen mengambil cabang yang salah pada langkah 40 dan tiada sesiapa menyedarinya sehingga langkah 300.

Migrasi atau audit yang dijalankan sekali merentas pangkalan kod yang besar. Kerja sekali sahaja tidak mempunyai jumlah penggunaan untuk mengagihkan kos, jadi premium setiap token dikenakan pada satu invois, dan keseluruhan tugas mungkin muat dalam satu tetingkap konteks. Jika tugas itu boleh dijalankan secara tak segerak, Batch API mengurangkan kos sebanyak separuh kepada $25 bagi setiap juta token output.

Tugas yang telah gagal dua kali dengan model yang lebih murah. Dua percubaan yang gagal, ditambah masa anda untuk menyahpepijat, berharga lebih tinggi daripada satu percubaan Fable pada jumlah penggunaan dalam carta di atas. Menaik taraf ialah pilihan yang lebih murah, dan itulah tujuan model ladder. Jika anda masih memilih antara peringkat secara umum, perbandingan keupayaan antara peringkat model Claude menjawab soalan yang berbeza daripada halaman ini.

Tiga tugas yang jawapan jujurnya ialah Sonnet 5 atau Haiku 4.5

Pengelasan dan pengekstrakan volum tinggi. Tugas ini dinilai berdasarkan throughput dan kos seunit, manakala had kualitinya cukup rendah sehingga model murah boleh mencapainya. Jika harganya sepuluh kali ganda untuk tugas yang dapat diselesaikan dengan betul oleh Haiku 4.5, Fable 5 tidak memberikan sebarang manfaat yang boleh diukur.

Kerja interaktif yang latensinya menjadi produk. Jadual model Anthropic menyenaraikan latensi perbandingan Fable 5 sebagai lebih perlahan, dan fungsi pemikiran tidak boleh dimatikan. Kotak sembang atau pelengkapan dalam editor terasa lebih teruk pada model yang lebih berkeupayaan kerana pengguna menyedari masa menunggu sebelum mereka menyedari kualitinya.

Apa-apa sahaja yang bergantung pada peristiwa selepas January 2026. Tarikh cutoff pengetahuan Fable 5 yang boleh dipercayai ialah January 2026. Bagi Opus 5, tarikhnya ialah May 2026. Model yang lebih mahal itu kurang terkini, jadi untuk soalan tentang kemutakhiran, anda membayar dua kali ganda untuk pengetahuan yang lebih lama kecuali anda memberikannya alat carian atau fetch.

Satu kekangan tidak berkaitan dengan kos sama sekali. Fable 5 menyimpan data selama 30 day dan tidak tersedia dengan zero data retention kerana model ini ditetapkan sebagai Covered Model. Jika perjanjian anda memerlukan zero retention, Fable 5 bukan pilihan pada apa-apa harga pun, dan tiada diskaun dapat mengubahnya.

Perkara yang ditunjukkan oleh repositori fable-method, dan perkara yang tidak ditunjukkannya

Pengamal telah menerbitkan repositori yang merumuskan cara kerja pendekatan Fable 5 menjadi kemahiran yang boleh diikuti oleh model yang lebih murah. Repositori fable-method menerangkan kemahiran berfikir, gelung orkestrasi dan pengesah adversarial yang menjalankan semula setiap semakan yang didakwa, bukannya membaca laporan ejen itu sendiri. README repositori tersebut menyatakannya dengan jelas: "Ini ialah rumusan komuniti, bukan artifak Anthropic."

Anggap perkara itu tepat seperti yang dinyatakan. Repositori tersebut menunjukkan cara orang mengarahkan model, bukan dokumentasi tentang cara model berfungsi. Anthropic tidak mengesahkan mana-mana kandungannya. Beberapa fork yang hampir serupa juga wujud dengan perkataan yang berbeza. Ini lebih menyerupai pengetahuan lisan daripada spesifikasi.

Isyarat yang berguna untuk membuat keputusan kos ialah bahawa bahagian yang dianggap berbaloi untuk disalin oleh orang ramai bersifat prosedural. Kelaskan tugasan, nyatakan semakan yang membuktikan tugasan itu selesai, kumpulkan bukti sebelum membuat keputusan, kemudian sahkan melalui pemerhatian dan bukannya dengan membaca ringkasan. Model yang lebih murah, jika diberikan senarai semak yang jelas serta langkah pengesahan, boleh mengurangkan sebahagian jurang prestasi. Oleh itu, jalankan eksperimen tersebut pada set penilaian anda sendiri sebelum menjadikan model yang mahal sebagai piawaian. Hasilnya bergantung pada tugasan anda. Sebab itu angka milik orang lain biasanya tidak banyak nilainya untuk anda.

Semak angka anda sendiri sebelum memperuntukkan bajet

  • Baca usage dalam setiap respons, dan catat output_tokens_details.thinking_tokens secara berasingan daripada output yang kelihatan. Penaakulan yang tidak anda lihat ialah komponen kos yang sering mengejutkan pengguna.
  • Tetapkan effort secara eksplisit dan jangan terima nilai lalai. Kekalkan nilai itu sepanjang perbualan yang bergantung pada prompt caching.
  • Letakkan awalan stabil anda di belakang cache breakpoint terlebih dahulu. Bacaan cache pada satu persepuluh harga input asas menjimatkan lebih banyak kos berbanding kebanyakan penurunan taraf model.
  • Alihkan apa-apa yang tidak memerlukan jawapan segera ke Batch API.
  • Nilai alternatif dengan jujur. Perbandingan harga API Claude dan ChatGPT berdasarkan beban kerja anda sendiri berbaloi dilakukan selama satu petang sebelum membuat komitmen jangka panjang.

Jika beban kerja itu ialah ejen yang berjalan pada pelayan anda sendiri, kawalan yang paling penting berada di luar pilihan model. Mengawal kos ejen pada VPS menerangkan had gelung dan siling perbelanjaan yang menghentikan sesi yang tidak terkawal, manakala tempat Claude Code sebenarnya menggunakan token menerangkan angka yang akan anda lihat pada papan pemuka penggunaan anda.

FAQ

Berapakah kos Claude Fable 5 bagi setiap juta token?

Claude Fable 5 disenaraikan pada harga $10 bagi setiap juta token input dan $50 bagi setiap juta token output dalam Claude API, berdasarkan semakan pada halaman harga Anthropic pada 3 Ogos 2026. Bacaan cache berharga $1 bagi setiap juta token, iaitu satu persepuluh daripada kadar input asas. Batch API memberikan diskaun 50% untuk kedua-dua kategori, iaitu $5 dan $25 bagi setiap juta token untuk kerja tak segerak. Mengekalkan inferens di dalam Amerika Syarikat dengan parameter inference_geo menambah pengganda 1.1 kali kepada setiap kategori.

Adakah Claude Fable 5 disertakan dalam langganan Claude Pro?

Halaman Claude Fable Anthropic menyenaraikan model ini sebagai tersedia untuk pengguna Pro, Max, Team dan Enterprise, tetapi tidak menyebut pelan percuma. Akses yang disertakan bukan tanpa had. Sesetengah seat mencapai Fable sebagai sebahagian daripada had penggunaan mingguan, manakala yang lain menggunakannya melalui kredit penggunaan. Susunan itu berubah lebih daripada sekali sepanjang Julai 2026. Baca baris berlabel Fable dalam jadual perbandingan pelan pada halaman harga Anthropic pada hari anda membuat keputusan. Jangan bergantung pada angka daripada artikel. Selepas peruntukan yang disertakan habis digunakan, penggunaan seterusnya dicaj pada kadar API.

Mengapakah bil Claude Fable 5 saya lebih tinggi daripada yang ditunjukkan oleh output?

Adaptive thinking sentiasa dihidupkan untuk Claude Fable 5. Token pemikiran dicaj sebagai token output, dan rantaian pemikiran mentah tidak pernah dikembalikan. Dengan thinking.display pada nilai lalainya, iaitu omitted, anda melihat medan pemikiran yang kosong tetapi tetap dicaj untuk setiap token penaakulan di sebaliknya. Baca usage.output_tokens_details.thinking_tokens dalam respons untuk melihat pecahan tersebut. Jika menggunakan penstriman, pecahan itu hanya tiba dalam peristiwa message_delta terakhir. Kurangkan tahap effort jika nisbah penaakulan kepada jawapan lebih tinggi daripada keperluan tugas.

Patutkah saya menggunakan Claude Fable 5 atau Claude Opus 5?

Claude Opus 5 berharga separuh daripada Claude Fable 5 bagi setiap token dan mempunyai tarikh pemotongan pengetahuan yang boleh dipercayai dan lebih baharu, iaitu Mei 2026 berbanding Januari 2026 untuk Fable 5. Mulakan dengan Opus 5 dan beralih kepada Fable apabila tugas gagal dengannya, atau apabila kos jawapan yang salah melebihi perbezaan harga. Fable 5 sesuai untuk kerja ejen dengan horizon panjang, apabila satu cabang yang salah menyebabkan kerja pembersihan selama berjam-jam, serta untuk tugas sekali sahaja yang kos premiumnya muncul pada satu invois, bukannya pada setiap permintaan selama-lamanya.

#claude#fable#model-selection#pricing#tokens