SSD Nodes Learn 🎉 VPS kutoka $4.99/mwezi
Mwongozo Matt ConnorNa Matt Connor

Claude Fable 5: Bei na Wakati wa Kuitumia

Claude Fable 5 hugharimu $10 kwa tokeni milioni moja za ingizo na $50 kwa towe. Jua maana ya viwango hivyo kwa kazi unazofanya.

Claude Fable 5 inagharimu kiasi gani?

Claude Fable 5 inagharimu $10 kwa kila tokeni milioni moja za ingizo na $50 kwa kila tokeni milioni moja za towe kwenye Claude API. Hizo ni bei rasmi zilizochapishwa na Anthropic, zilizosomwa kutoka kwenye ukurasa wa bei tarehe 3 August 2026. Kitambulisho cha modeli kwenye API ni claude-fable-5. Ilipatikana kwa ujumla tarehe 9 June 2026 kwenye Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud na Microsoft Foundry.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

Ichukulie hiyo kama ngazi ya bei. Fable 5 ina bei iliyo mara mbili ya Claude Opus 5, mara tano ya bei ya sasa ya Claude Sonnet 5, na mara kumi ya Claude Haiku 4.5. Uwiano ni huo huo kwa pande zote mbili za bili, kwa sababu kila modeli kwenye jedwali hilo hutoza towe kwa bei iliyo mara tano hasa ya bei yake ya ingizo. Kwa hiyo, ukijua mgawanyo wa tokeni za ingizo na towe kwa kazi fulani, unaweza kubadilisha bei moja kuwa nyingine kwa kuzidisha.

Tarehe moja hubadilisha hesabu. Sonnet 5 iko kwenye bei ya utangulizi ya $2 na $10 kwa kila tokeni milioni moja hadi 31 August 2026. Kuanzia 1 September 2026, bei yake itakuwa $3 na $15. Bei ya Fable 5 yenyewe haibadiliki, kwa hiyo pengo kati ya modeli hizo mbili litapungua kutoka mara tano hadi zaidi kidogo ya mara tatu siku hiyo. Ikiwa unaandaa bajeti ya msimu wa vuli, tumia bei za baadaye za Sonnet.

Punguzo, na kizidishi kimoja kinachoongeza gharama

Prompt caching ndiyo njia kubwa zaidi ya kupunguza gharama. Kusoma kwenye cache hugharimu sehemu ya kumi ya bei ya msingi ya input, yaani $1 kwa kila token milioni kwenye Fable 5. Kuandika kwenye cache hugharimu zaidi ya token ya kawaida ya input: mara 1.25 ya bei ya msingi kwa cache ya dakika tano, na mara 2 ya bei ya msingi kwa cache ya saa moja. Cache ya dakika tano hujilipia baada ya usomaji mmoja, na cache ya saa moja baada ya usomaji miwili. Hesabu hiyo ndiyo sababu ya kuhesabu mahali prompt caching huanza kuleta faida kabla ya kuiwasha kila mahali.

Batch API hupunguza 50% kutoka pande zote mbili, kwa hiyo kazi ya Fable 5 inayotumwa kwa batch hugharimu $5 na $25 kwa kila token milioni. Maombi ya batch hushughulikiwa bila kusubiri jibu la papo hapo, kwa hiyo hii husaidia tu kazi ambazo hazihitaji jibu mara moja. Punguzo hilo mawili yanaweza kutumika pamoja, hivyo kazi iliyowekwa kwenye cache na batch huwa nafuu kwa vipengele vyote viwili.

Dirisha la muktadha la token 1M linajumuishwa kwa viwango vya kawaida kwenye Claude 4.6 na miundo ya baadaye. Hakuna ada ya ziada kwa muktadha mrefu, kwa hiyo ombi la token 900k hutozwa kwa kiwango kilekile cha kila token kama ombi la token 9k.

Kizidishi kinachoongeza bili ni mahali data inapohifadhiwa na kushughulikiwa. Kuweka inference_geo: "us" ili inference ibaki ndani ya United States hutumia kizidishi cha mara 1.1 kwenye kila aina ya token, ikiwemo usomaji na uandishi wa cache. Acha routing ya kimataifa iliyo chaguo-msingi isipokuwa mkataba unahitaji vinginevyo.

Sheria moja ya bili ni ya modeli hii pekee. Fable 5 husafirisha safety classifiers zinazoweza kukataa ombi. Hilo linapotokea, Messages API hurudisha stop_reason: "refusal" kama jibu la mafanikio la HTTP 200 badala ya error, na hutozwi kwa ombi lililokataliwa kabla ya output yoyote kuzalishwa. Ukijaribu tena prompt hiyo kwenye modeli nyingine ya Claude, fallback credit hurejesha gharama ya prompt cache iliyotokana na kubadili modeli, hivyo hulipii kuandaa cache hiyo hiyo mara mbili.

Ni mipango ipi inayojumuisha Claude Fable 5?

Kufikia 3 August 2026, ukurasa wa Anthropic wa Claude Fable unasema kuwa modeli hii inapatikana kwa watumiaji wa Pro, Max, Team na Enterprise. Mpango wa bure haujatajwa. Kwa wasanidi programu, kwa ujumla inapatikana kupitia Claude API na marketplaces za cloud zilizoorodheshwa hapo juu.

Modeli kupatikana kwenye mpango si sawa na kujumuishwa bila kikomo. Jedwali la kulinganisha mipango kwenye ukurasa wa bei wa Anthropic huweka Fable chini ya sehemu ya vikomo vya matumizi ya kila wiki kwa baadhi ya seats, na chini ya usage credits kwa nyingine. Mpangilio huo ulibadilika zaidi ya mara moja wakati wa July 2026. Taarifa ya Anthropic kuhusu kupeleka tena Fable 5 ilijumuisha modeli hiyo kwa hadi 50% ya vikomo vya matumizi ya kila wiki hadi 7 July 2026 kwenye mipango ya Pro, Max, Team na baadhi ya mipango ya Enterprise, huku usage credits zikitumika baada ya tarehe hiyo. Taarifa zilizotolewa katika kipindi kilichosalia cha July zilieleza nyongeza zaidi na mgawanyo kati ya aina za seats.

Kwa hiyo, ukurasa huu hautachapisha kikomo cha kila mpango. Hakuna nambari iliyochapishwa wakati wa mwezi huo iliyodumu hata wiki mbili, na nambari iliyopitwa na wakati hapa ingekuwa mbaya kuliko kutoweka nambari kabisa. Fungua row yenye lebo ya Fable kwenye jedwali la kulinganisha mipango siku unapoamua, na ichukulie nambari yoyote iliyo kwenye makala ya habari kuwa imepitwa na wakati.

Kinachobaki thabiti ni kiwango cha API. Kwenye route yoyote, allowance iliyojumuishwa ikiisha, matumizi zaidi ya Fable 5 hutozwa kwa bei zilizo kwenye chart hapo juu. Hilo linaifanya orodha ya bei kuwa nambari ya kupanga bajeti nayo kwa hali yoyote. Hiyo ndiyo hitimisho lilelile unalofikia unapofanya ulinganisho wa malipo ya API na usajili kwa modeli nyingine yoyote ya Claude. Ikiwa bado hujachagua tier, anza kwa mpango wa Claude unaolingana na matumizi yako.

Kwa nini bili yako huwa kubwa kuliko uwiano wa bei unavyoashiria

Kuna mifumo miwili iliyoandikwa kwenye nyaraka inayofanya Fable 5 igarimu zaidi ya inavyoonekana kwenye ulinganisho wa moja kwa moja wa bei.

Ya kwanza ni tokenizer. Fable 5 hutumia tokenizer iliyoletwa pamoja na Claude Opus 4.7. Ikilinganishwa na modeli zilizotolewa kabla ya Opus 4.7, maandishi yale yale huzalisha takribani tokens 30% zaidi, na ongezeko kamili hutegemea maudhui. Haiku 4.5 ilitangulia tokenizer hiyo, kwa hiyo tofauti ya mara kumi kwenye orodha ya bei huwa karibu mara kumi na tatu unapowasilisha kizuizi kilekile cha maandishi kwa modeli zote mbili. Sonnet 5 hutumia tokenizer mpya zaidi, kwa hiyo ulinganisho wa gharama kwa kila token kati ya Fable na Sonnet ni sahihi. Ulinganisho kati ya Fable na Haiku si sahihi.

Ya pili ni thinking. Adaptive thinking huwa imewashwa kila wakati kwenye Fable 5, na thinking: {"type": "disabled"} haitumiki. Thinking tokens hutozwa kama output tokens, kwa kiwango kamili cha output. Raw chain of thought hairudishwi kamwe kwenye modeli hii, na thinking.display huwa "omitted" kwa chaguo-msingi. Hii inamaanisha kuwa jibu fupi linaloonekana linaweza kuwa na idadi kubwa ya output tokens zinazotozwa. Nyaraka za Anthropic zinaeleza wazi: idadi ya output tokens inayotozwa hailingani na idadi ya tokens zinazoonekana kwenye jibu.

Soma mgawanyo badala ya kukisia. Sehemu usage.output_tokens_details.thinking_tokens huonyesha idadi ya billed output tokens zilizotumika kwa reasoning:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

Katika mfano huo, uliotolewa kwenye nyaraka za Anthropic kuhusu thinking, kati ya billed output tokens 348, tokens 312 zilitumika kwa reasoning ambayo hakuna mtu aliyeiona. Unapotumia streaming, mgawanyo huu hufika tu kwenye event ya mwisho ya message_delta. Kwa hiyo, client inayoacha kusoma baada ya text chunk ya mwisho haitawahi kuuhifadhi.

Udhibiti ni effort, unaowekwa kwenye output_config.effort, ukiwa na viwango low, medium, high (chaguo-msingi), xhigh na max.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

Mwongozo wa Anthropic kwa modeli hii ni kuanza na high, kupanda hadi xhigh kwa kazi ambazo zinahitaji uwezo wa juu zaidi, na kushuka hadi medium au low kwa kazi za kawaida. Sababu ni kwamba effort ya chini kwenye Fable 5 mara nyingi huwa bora kuliko xhigh kwenye modeli za awali. Kuna mitego miwili hapa. Kubadilisha effort kati ya maombi hubatilisha prompt cache yako, kwa sababu thamani ya effort iliyotatuliwa huwekwa ndani ya prompt. Kwa hiyo, chagua kiwango kimoja kwa kila workload na ukidumishe bila kukibadilisha. Pia, max_tokens ni kikomo cha juu cha jumla ya output, kinachojumuisha thinking na maandishi ya jibu. Kwa hiyo, cap iliyowekwa kwa jibu lisilo na thinking inaweza kusababisha jibu likatwe. Kuona stop_reason: "max_tokens" kunamaanisha kuwa unapaswa kuongeza cap au kupunguza effort.

Gharama kwa kila kazi iliyokamilika, si gharama kwa kila tokeni

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

Hizo safu 3 ni hesabu, si kipimo cha utendaji. Viwango vimechapishwa. Kiasi cha tokeni ni makadirio unayopaswa kubadilisha kwa takwimu kutoka kwenye data yako mwenyewe ya matumizi. Session ya coding iliyo na muundo kama safu ya kati inagharimu $5.00 kwenye Fable 5, ikilinganishwa na $1.00 kwenye Sonnet 5. Run ndefu inagharimu $40.00 ikilinganishwa na $8.00. Safu ya Haiku kwenye safu hiyo ya mwisho ni hesabu pekee: Haiku 4.5 ina context window ya tokeni 200k, hivyo haiwezi kushughulikia kazi hiyo kabisa.

Gharama kwa kila tokeni si kipimo sahihi cha kufanya uamuzi. Gharama kwa kila kazi iliyokamilika ni gharama kwa kila jaribio ikizidishwa kwa idadi ya majaribio. Kwa viwango vya leo, jaribio moja la Fable 5 linagharimu sawa na majaribio matano ya Sonnet 5, kwa hiyo idadi ya retry karibu haiwezi kuhalalisha upgrade yenyewe. Sonnet ingelazimika kushindwa zaidi ya mara nne kati ya tano kabla ya njia ya bei nafuu kuwa ghali zaidi kwa tokeni.

Kinachohalalisha uamuzi huo ni kila kitu ambacho bili ya tokeni haionyeshi. Tofauti kati ya run mbili ndefu kwenye chart ni ndogo kuliko saa moja ya muda wa engineer katika masoko mengi. Ikiwa model ghali itaokoa saa moja ya review, au iepushe migration moja mbaya ambayo baadaye ungelazimika kuirekebisha, tayari imejilipia kwenye bili ambayo haionyeshi akiba hiyo. Fanya ulinganisho kwa kutumia fedha kwa kila matokeo yaliyokubaliwa, na ujumuishe muda wako mwenyewe katika jumla. Kujua tokeni milioni moja hununua nini hasa hufanya makadirio hayo yaonekane dhahiri zaidi.

Kazi tatu ambazo Claude Fable 5 inahalalisha gharama yake

Uendeshaji wa agent wa muda mrefu ambapo kuchagua njia isiyo sahihi kuna gharama kubwa. Fable 5 imeundwa kwa kazi zinazopimwa kwa saa: ina context window ya token 1M, hadi output tokens 128k kwa ombi moja, na kiwango cha juhudi cha xhigh kinacholenga kazi zinazoendelea kwa zaidi ya dakika thelathini, zikiwa na token budgets za mamilioni. Linganisha uendeshaji huo na usafishaji unaohitajika baada ya agent kuchagua branch isiyo sahihi kwenye hatua ya 40, bila mtu kugundua hadi hatua ya 300.

Migration au audit unayoendesha mara moja kwenye codebase kubwa. Kazi ya mara moja haina ujazo wa kutosha wa kupunguza gharama kwa wastani, kwa hiyo premium ya kila token huingia kwenye invoice moja, na kazi yote inaweza kutoshea ndani ya context window moja. Ikiwa inaweza kuendeshwa asynchronously, Batch API hupunguza gharama hiyo kwa nusu hadi $25 kwa kila token milioni moja ya output.

Kazi ambayo model ya bei nafuu tayari imeshindwa mara mbili. Majaribio mawili yaliyoshindwa pamoja na muda wako wa debugging hugharimu zaidi ya jaribio moja la Fable kwa ujazo ulio kwenye chati hapo juu. Kuongeza kiwango cha model ndiyo njia ya bei nafuu, na hilo ndilo lengo la model ladder. Ikiwa bado unachagua kati ya tiers kwa ujumla, ulinganisho wa uwezo kati ya Claude model tiers unajibu swali tofauti na linalojibiwa na ukurasa huu.

Kazi tatu ambapo Sonnet 5 au Haiku 4.5 ndilo jibu sahihi

Uainishaji na uchukuaji wa data kwa kiwango cha juu. Kazi hizi hupimwa kwa throughput na gharama kwa kila kitengo, na kiwango cha juu cha ubora ni cha chini kiasi kwamba model ya bei nafuu hukifikia. Kwa bei mara kumi zaidi kwa kazi ambayo Haiku 4.5 huikamilisha kwa usahihi, Fable 5 haiongezi faida yoyote inayoweza kupimika.

Kazi shirikishi ambapo latency ndiyo bidhaa. Jedwali la Anthropic la models linaonyesha kuwa latency linganishi ya Fable 5 ni ya polepole zaidi, na thinking haiwezi kuzimwa. Chat box au ukamilishaji wa maandishi kwenye editor huhisi kuwa mbaya zaidi kwenye model yenye uwezo mkubwa, kwa sababu watumiaji hutambua muda wa kusubiri kabla hawajatambua ubora.

Kitu chochote kinachotegemea matukio baada ya January 2026. Reliable knowledge cutoff ya Fable 5 ni January 2026. Ya Opus 5 ni May 2026. Model yenye gharama kubwa zaidi ndiyo yenye taarifa za zamani zaidi, kwa hiyo kwenye maswali kuhusu upya wa taarifa unalipia mara mbili kwa maarifa ya zamani isipokuwa uipe search au fetch tools.

Kuna kizuizi kimoja ambacho hakihusiani kabisa na gharama. Fable 5 huhifadhi data kwa siku 30 na haipatikani chini ya zero data retention, kwa sababu imeteuliwa kuwa Covered Model. Ikiwa makubaliano yako yanahitaji zero retention, Fable 5 si chaguo kwa bei yoyote, na punguzo lolote haliwezi kubadilisha hilo.

Kile ambacho repos za fable-method zinaonyesha, na kile ambacho hazionyeshi

Wataalamu wamechapisha repos zinazoeleza kwa muhtasari jinsi mbinu za Fable 5 zinavyofanya kazi, ili modeli ya gharama nafuu iweze kuzifuata. repo ya fable-method inaeleza skill ya kufikiri, loop ya orchestration, na verifier ya adversarial inayorudia kila check iliyodaiwa badala ya kusoma ripoti ya agent yenyewe. README yake inasema hivyo moja kwa moja: "Hii ni muhtasari uliotayarishwa na jamii, si artifact ya Anthropic."

Ichukulie hivyo hasa. Ni ushahidi wa jinsi watu wanavyoielekeza modeli, si documentation ya jinsi modeli inavyofanya kazi. Hakuna kilicho ndani yake kilichothibitishwa na Anthropic, na kuna forks kadhaa zinazokaribiana sana zenye wording tofauti. Hilo ndilo unalotarajia kutoka kwenye simulizi zinazosambazwa na watu, si spec.

Jambo lenye umuhimu kwa uamuzi wa gharama ni kwamba sehemu ambazo watu wameona zinafaa kunakiliwa ni za kiutaratibu. Classify task, taja check inayothibitisha kuwa imekamilika, kusanya evidence kabla ya kuamua, kisha verify kwa observation badala ya kusoma summary. Model ya gharama nafuu ikipewa checklist iliyo wazi na verification step inaweza kupunguza sehemu ya tofauti hiyo. Kwa hiyo, fanya experiment hiyo kwenye evaluation set yako mwenyewe kabla ya kuanza kutumia model ya gharama kubwa kama kiwango chako. Matokeo yanategemea tasks zako, ndiyo maana number ya mtu mwingine haina thamani kubwa kwako.

Kagua namba zako kabla ya kutenga bajeti

  • Soma usage katika kila jibu, na uweke output_tokens_details.thinking_tokens kwenye kumbukumbu tofauti na matokeo yanayoonekana. Hoja usizoziona ndizo kipengele cha gharama kinachowashangaza watu.
  • Weka effort wazi badala ya kukubali thamani chaguo-msingi, na iweke bila kubadilika ndani ya mazungumzo yoyote yanayotegemea prompt caching.
  • Weka kiambishi awali chako thabiti nyuma ya cache breakpoint kwanza. Kusoma kutoka kwenye cache kwa moja ya kumi ya bei ya input ya msingi huokoa zaidi kuliko kushusha daraja la model mara nyingi.
  • Hamishia kwenye Batch API jambo lolote ambalo halihitaji jibu la papo hapo.
  • Kadiria kwa uaminifu mbadala huo. Kulinganisha bei za Claude na ChatGPT API kwenye workload yako mwenyewe kunastahili muda wa alasiri kabla ya kujifunga kwa muda mrefu.

Ikiwa workload ni agent inayoendesha kwenye seva yako mwenyewe, vidhibiti muhimu zaidi viko nje ya uchaguzi wa model. Kudhibiti gharama za agent kwenye VPS inaeleza mipaka ya mizunguko na viwango vya juu vya matumizi vinavyozuia session isiyodhibitiwa, na Claude Code hutumia tokeni wapi hasa inaeleza namba utakazoona kwenye dashibodi yako ya matumizi.

FAQ

Claude Fable 5 inagharimu kiasi gani kwa kila token milioni?

Claude Fable 5 ina bei ya $10 kwa kila token milioni za ingizo na $50 kwa kila token milioni za towe kwenye Claude API, kulingana na ukaguzi wa ukurasa wa bei wa Anthropic tarehe 3 Agosti 2026. Usomaji wa cache unagharimu $1 kwa kila token milioni, yaani sehemu ya kumi ya kiwango cha msingi cha ingizo. Batch API hupunguza bei kwa 50% kwa pande zote mbili, hivyo kazi za asynchronous hugharimu $5 na $25 kwa kila token milioni. Kuweka inference ndani ya Marekani kwa kutumia kigezo inference_geo huongeza multiplier ya mara 1.1 kwa kila aina ya bei.

Je, Claude Fable 5 imejumuishwa katika usajili wa Claude Pro?

Ukurasa wa Anthropic wa Claude Fable unaorodhesha model hii kuwa inapatikana kwa watumiaji wa Pro, Max, Team na Enterprise, na hautaji plan ya bure. Ufikiaji uliojumuishwa hauna kikomo. Baadhi ya seats huipata Fable kama sehemu ya vikomo vya matumizi ya kila wiki, na nyingine huipata kupitia usage credits. Mpangilio huo ulibadilika zaidi ya mara moja wakati wa Julai 2026. Soma safu iliyoandikwa Fable katika jedwali la kulinganisha plans kwenye ukurasa wa bei wa Anthropic siku unapoamua, badala ya kutegemea takwimu kutoka kwenye makala. Kiwango kilichojumuishwa kikishaisha, matumizi ya ziada hutozwa kwa kiwango cha API.

Kwa nini bili yangu ya Claude Fable 5 ni kubwa kuliko towe linaloonekana?

Adaptive thinking huwa imewashwa kila wakati kwa Claude Fable 5. Thinking tokens hutozwa kama output tokens, na raw chain of thought hairudishwi kamwe. Kwa thinking.display ikiwa na thamani yake ya msingi ya omitted, unaona sehemu tupu ya thinking huku ukilipia kila reasoning token iliyo nyuma yake. Soma usage.output_tokens_details.thinking_tokens katika response ili kuona mgawanyo huo. Unapotumia streaming, taarifa hiyo hufika tu katika event ya mwisho ya message_delta. Punguza kiwango cha effort ikiwa uwiano wa reasoning dhidi ya jibu ni mkubwa kuliko mahitaji ya task.

Je, nitumie Claude Fable 5 au Claude Opus 5?

Claude Opus 5 hugharimu nusu ya bei kwa kila token na ina reliable knowledge cutoff ya hivi karibuni zaidi: Mei 2026, ikilinganishwa na Januari 2026 kwa Fable 5. Anza na Opus 5 na uhamie Fable pale task inaposhindwa humo, au pale jibu lisilo sahihi linapogharimu zaidi ya tofauti ya bei. Fable 5 inafaa kwa agent work ya long horizon ambapo branch moja mbaya inaweza kusababisha saa za cleanup, na kwa jobs za one-off ambazo gharama yake ya ziada inaonekana kwenye invoice moja badala ya kila request milele.

#claude#fable#model-selection#pricing#tokens