Wat kost Claude Fable 5 per miljoen tokens?
Claude Fable 5 kost 10 dollar per miljoen input-tokens en 50 dollar per miljoen output-tokens. Ontdek wat deze tarieven betekenen voor uw specifieke API-gebruik en kosten.
Wat kost Claude Fable 5?
Claude Fable 5 kost $10 per miljoen input-tokens en $50 per miljoen output-tokens via de Claude API. Dit zijn de gepubliceerde tarieven van Anthropic, zoals vermeld op de prijspagina op 3 augustus 2026. Het model-ID voor de API is claude-fable-5. Het model is algemeen beschikbaar sinds 9 juni 2026 via de Claude API, Amazon Bedrock, Claude Platform op AWS, Google Cloud en Microsoft Foundry.
The data behind this chart
[
{
"label": "Claude Fable 5",
"input": "10",
"output": "50",
"cache_read": "1",
"batch_input": "5",
"batch_output": "25"
},
{
"label": "Claude Opus 5",
"input": "5",
"output": "25",
"cache_read": "0.50",
"batch_input": "2.50",
"batch_output": "12.50"
},
{
"label": "Claude Sonnet 5 (intro rate)",
"input": "2",
"output": "10",
"cache_read": "0.20",
"batch_input": "1",
"batch_output": "5"
},
{
"label": "Claude Sonnet 5 (from 1 Sep)",
"input": "3",
"output": "15",
"cache_read": "0.30",
"batch_input": "1.50",
"batch_output": "7.50"
},
{
"label": "Claude Haiku 4.5",
"input": "1",
"output": "5",
"cache_read": "0.10",
"batch_input": "0.50",
"batch_output": "2.50"
}
]Beschouw dit als een hiërarchie. Fable 5 is twee keer zo duur als Claude Opus 5, vijf keer zo duur als het huidige tarief van Claude Sonnet 5, en tien keer zo duur als Claude Haiku 4.5. De verhouding is aan beide zijden van de factuur gelijk, aangezien elk model in die tabel de output precies vijf keer zo hoog prijst als de eigen input-rate. Als u de verdeling tussen input- en output-tokens voor een taak kent, kunt u de prijs eenvoudig omrekenen door middel van vermenigvuldiging.
Eén datum verandert de berekening. Voor Sonnet 5 geldt een introductieprijs van $2 en $10 per miljoen tokens tot en met 31 augustus 2026. Vanaf 1 september 2026 bedraagt de prijs $3 en $15. De prijs van Fable 5 wijzigt niet, waardoor het prijsverschil tussen beide modellen op die dag afneemt van vijf keer naar iets meer dan drie keer. Als u een budget opstelt voor het najaar, gebruik dan de latere cijfers voor Sonnet.
De kortingen en de ene vermenigvuldiger die de andere kant op werkt
Prompt caching is de belangrijkste factor. Een cache-read kost een tiende van de standaard invoerprijs, wat neerkomt op $1 per miljoen tokens op Fable 5. Schrijven naar de cache kost meer dan een standaard invoertoken: 1,25 keer de basisprijs voor de cache van vijf minuten en 2 keer de basisprijs voor de cache van een uur. Een cache van vijf minuten verdient zichzelf terug na één keer lezen, en een cache van een uur na twee keer lezen. Die rekensom vormt het volledige argument voor het berekenen van het break-evenpunt voor prompt caching voordat u dit overal inschakelt.
De Batch API biedt 50% korting op beide onderdelen, waardoor batch-verwerking met Fable 5 $5 en $25 per miljoen tokens kost. Batch-verzoeken zijn asynchroon, dus dit is alleen nuttig voor werkzaamheden waarvoor niet direct een antwoord nodig is. De twee kortingen zijn cumulatief, wat een gecachte, gebatcheerde taak op beide vlakken goedkoop maakt.
Het contextvenster van 1M tokens is inbegrepen tegen standaardtarieven bij Claude 4.6 en latere modellen. Er is geen toeslag voor een lange context, dus een verzoek van 900k tokens wordt gefactureerd tegen hetzelfde tarief per token als een verzoek van 9k.
De vermenigvuldiger die de rekening verhoogt, is datalocatie. Het instellen van inference_geo: "us" om inferentie binnen de Verenigde Staten te houden, past een vermenigvuldiger van 1,1 toe op elke tokencategorie, inclusief cache-reads en cache-writes. Laat de standaard wereldwijde routering actief, tenzij een contract anders vereist.
Eén factureringsregel is specifiek voor dit model. Fable 5 levert veiligheidsclassificaties die een verzoek kunnen afwijzen. Wanneer dat gebeurt, retourneert de Messages API stop_reason: "refusal" als een succesvolle HTTP 200-respons in plaats van een foutmelding, en worden er geen kosten in rekening gebracht voor een verzoek dat is geweigerd voordat er enige output is gegenereerd. Als u dezelfde prompt opnieuw probeert op een ander Claude-model, vergoedt het fallback-tegoed de kosten van de prompt-cache voor de overstap, zodat u niet betaalt voor het tweemaal opwarmen van dezelfde cache.
Welke abonnementen bevatten Claude Fable 5?
Sinds 3 augustus 2026 vermeldt de Claude Fable-pagina van Anthropic dat het model beschikbaar is voor Pro-, Max-, Team- en Enterprise-gebruikers. Het gratis abonnement wordt niet genoemd. Pro is de goedkoopste optie op die lijst, dus wat Pro kost en waar de gebruikslimieten liggen bepaalt de ondergrens voor elke abonnementsvorm die toegang geeft tot Fable. Voor ontwikkelaars is het model algemeen beschikbaar via de Claude API en de hierboven genoemde cloud-marktplaatsen. Er is geen gratis laag via dat kanaal, dus het kleine tegoed dat Anthropic bij aanmelding verstrekt is alles wat u krijgt voordat de teller gaat lopen.
Beschikbaarheid in een abonnement is niet hetzelfde als onbeperkte toegang. De vergelijkingstabel op de prijspagina van Anthropic beperkt Fable bij sommige abonnementen tot een deel van de wekelijkse gebruikslimieten en bij andere tot gebruikstegoeden; deze regeling is in juli 2026 meermaals gewijzigd. De verklaring van Anthropic over de herintroductie van Fable 5 omvatte toegang tot het model voor maximaal 50% van de wekelijkse gebruikslimieten tot 7 juli 2026 voor Pro-, Max-, Team- en geselecteerde Enterprise-abonnementen, met gebruikstegoeden na die datum. Berichten gedurende de rest van juli beschreven verdere verlengingen en een onderscheid tussen de verschillende typen abonnementen.
Deze pagina vermeldt daarom geen limiet per abonnement. Geen enkel cijfer dat in die maand werd gepubliceerd, bleef langer dan twee weken geldig, en een verouderd getal is hier minder nuttig dan geen informatie. Open de rij met het label Fable in de vergelijkingstabel op de dag dat u een besluit neemt en beschouw elk cijfer in een nieuwsartikel als verouderd. Als u een abonnement afsluit voor Fable-toegang en de limiet blijkt lager dan de tabel deed vermoeden, dan blijft het abonnement opzeggen vóór de volgende verlenging de maand die u al heeft betaald intact.
Wat wel stabiel is, is het API-tarief. Zodra een inbegrepen tegoed is verbruikt, wordt verder gebruik van Fable 5 gefactureerd tegen de prijzen in de bovenstaande tabel. Bij Enterprise is deze structuur expliciet, omdat de Enterprise-abonnementskosten toegang bieden, terwijl de tokens zelf nog steeds tegen API-tarieven worden afgerekend. Dat maakt de prijslijst het getal om mee te plannen, wat dezelfde conclusie is als wanneer u API-facturering vergelijkt met een abonnement voor elk ander Claude-model. Als u nog geen laag heeft gekozen, begin dan bij welk Claude-abonnement past bij uw gebruik. Als dat abonnement ook uw dagelijkse assistent zou zijn in plaats van alleen een toegangspoort tot Fable, is het de moeite waard om te controleren hoe de Claude-abonnementen zich verhouden tot die van ChatGPT voordat u zich vastlegt.
Waarom uw factuur hoger uitvalt dan de prijsverhouding suggereert
Twee gedocumenteerde mechanismen zorgen ervoor dat Fable 5 meer kost dan een directe prijsvergelijking doet vermoeden.
De eerste is de tokenizer. Fable 5 gebruikt de tokenizer die werd geïntroduceerd met Claude Opus 4.7. Vergeleken met modellen die vóór Opus 4.7 zijn uitgebracht, produceert dezelfde tekst ongeveer 30% meer tokens; de exacte toename hangt af van de inhoud. Haiku 4.5 dateert van vóór die tokenizer, dus het prijsverschil van factor tien is in de praktijk dichter bij factor dertien zodra u beide modellen hetzelfde tekstblok voert. Sonnet 5 gebruikt de nieuwere tokenizer, dus Fable versus Sonnet is een eerlijke vergelijking per token. Fable versus Haiku is dat niet.
De tweede is thinking. Adaptief denken staat altijd aan voor Fable 5 en thinking: {"type": "disabled"} wordt niet ondersteund. Thinking-tokens worden gefactureerd als output-tokens, tegen het volledige output-tarief. De ruwe chain of thought wordt nooit geretourneerd bij dit model en thinking.display staat standaard op "omitted", wat betekent dat een kort zichtbaar antwoord een groot aantal gefactureerde output-tokens kan bevatten. De documentatie van Anthropic stelt dit duidelijk: het aantal gefactureerde output-tokens komt niet overeen met het aantal zichtbare tokens in het antwoord.
Bekijk de uitsplitsing in plaats van te gokken. Het veld usage.output_tokens_details.thinking_tokens rapporteert hoeveel gefactureerde output-tokens naar redenering zijn gegaan:
{
"usage": {
"input_tokens": 25,
"output_tokens": 348,
"output_tokens_details": {
"thinking_tokens": 312
}
}
}In dat voorbeeld, afkomstig uit de documentatie over thinking van Anthropic, waren 312 van de 348 gefactureerde output-tokens redenering die niemand ooit heeft gezien. Wanneer u streamt, arriveert deze uitsplitsing pas bij het laatste message_delta-event, dus een client die stopt met lezen bij het laatste tekstblok zal dit nooit registreren.
De instelling is effort, ingesteld op output_config.effort, met niveaus low, medium, high (de standaard), xhigh en max.
{
"model": "claude-fable-5",
"max_tokens": 32000,
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "..." }]
}Het advies van Anthropic voor dit model is om te beginnen bij high, alleen voor het meest capaciteitsgevoelige werk naar xhigh te gaan en voor routinewerk terug te schakelen naar medium of low, op basis van het feit dat minder inspanning op Fable 5 vaak beter presteert dan xhigh op eerdere modellen. Hierbij zijn twee valkuilen. Het wijzigen van de inspanning tussen verzoeken maakt uw prompt cache ongeldig, omdat de opgeloste inspanningswaarde in de prompt wordt verwerkt; kies dus een niveau per workload en houd dit constant. En max_tokens is een harde limiet op de totale output, inclusief thinking- en antwoordtekst, dus een limiet die is afgestemd op een antwoord zonder thinking zal resulteren in afkapping. Het zien van stop_reason: "max_tokens" betekent dat u de limiet moet verhogen of de inspanning moet verlagen.
Kosten per voltooide taak, niet kosten per token
The data behind this chart
[
{
"label": "Short answer (5k in, 1k out)",
"fable_5": "0.10",
"opus_5": "0.05",
"sonnet_5": "0.02",
"haiku_4_5": "0.01"
},
{
"label": "Coding session (300k in, 40k out)",
"fable_5": "5.00",
"opus_5": "2.50",
"sonnet_5": "1.00",
"haiku_4_5": "0.50"
},
{
"label": "Long agent run (2M in, 400k out)",
"fable_5": "40.00",
"opus_5": "20.00",
"sonnet_5": "8.00",
"haiku_4_5": "4.00"
}
]Die 3 rijen zijn rekenkundig, geen benchmark. De tarieven zijn openbaar. De tokenvolumes zijn aannames die u moet vervangen door cijfers uit uw eigen gebruiksgegevens. Een programmeersessie met de omvang van de middelste rij kost $5.00 op Fable 5 tegenover $1.00 op Sonnet 5. De lange run kost $40.00 tegenover $8.00. De kolom voor Haiku in die laatste rij is puur rekenkundig: Haiku 4.5 heeft een contextvenster van 200k tokens en kan die taak dus helemaal niet verwerken.
Kosten per token is de verkeerde eenheid voor een beslissing. Kosten per voltooide taak zijn de kosten per poging vermenigvuldigd met het aantal pogingen. Tegen de huidige tarieven kost één Fable 5-poging evenveel als vijf Sonnet 5-pogingen; het aantal retries rechtvaardigt de upgrade daarom bijna nooit. Sonnet zou in meer dan vier van de vijf gevallen moeten falen voordat het goedkopere pad op basis van tokens verliest.
Wat de kosten wel rechtvaardigt, is alles wat buiten de tokenrekening valt. Het verschil tussen de twee lange runs in de tabel is kleiner dan één uur aan ingenieursuren in de meeste markten. Als het duurdere model een uur aan revisietijd bespaart, of één slechte migratie voorkomt die u vervolgens weer moet terugdraaien, heeft het zichzelf al terugverdiend op een rekening die de besparing niet toont. Maak de vergelijking in geld per geaccepteerd resultaat en neem uw eigen tijd op in het totaal. Weten wat een miljoen tokens daadwerkelijk oplevert maakt die schatting veel minder abstract.
Drie taken waarbij Claude Fable 5 zijn prijs waard is
Langlopende agent-runs waarbij een verkeerde afslag kostbaar is. Fable 5 is ontworpen voor werk dat in uren wordt gemeten: een contextvenster van 1M tokens, tot 128k output-tokens per verzoek, en een xhigh inspanningsniveau gericht op taken die langer dan dertig minuten duren met tokenbudgetten in de miljoenen. Weeg de run af tegen de opruimwerkzaamheden nadat een agent bij stap 40 een verkeerde afslag neemt die pas bij stap 300 wordt opgemerkt.
Een migratie of audit die u eenmalig uitvoert over een grote codebase. Eenmalig werk heeft geen volume om de kosten te spreiden, waardoor de premie per token op één factuur terechtkomt, en de gehele taak mogelijk in één contextvenster past. Als het asynchroon kan draaien, halveert de Batch API de kosten naar $25 per miljoen output-tokens.
De taak die een goedkoper model al twee keer heeft laten mislukken. Twee mislukte pogingen plus uw tijd voor debugging kosten meer dan één Fable-poging bij de volumes in de bovenstaande tabel. Escaleren is de goedkopere optie, en dat is waar een model-ladder voor dient. Als u in het algemeen nog kiest tussen verschillende niveaus, beantwoordt de vergelijking van de mogelijkheden tussen de Claude-modelniveaus een andere vraag dan deze pagina.
Drie taken waar Sonnet 5 of Haiku 4.5 het eerlijke antwoord is
Classificatie en extractie met een hoog volume. Deze taken worden beoordeeld op doorvoer en eenheidskosten, en het kwaliteitsplafond is laag genoeg dat een goedkoop model dit bereikt. Bij een tien keer hogere prijs voor een taak die Haiku 4.5 correct uitvoert, levert Fable 5 niets op dat u kunt meten.
Interactief werk waarbij latentie het product is. De modeltabel van Anthropic vermeldt de vergelijkende latentie van Fable 5 als trager, en het denkproces kan niet worden uitgeschakeld. Een chatvenster of een editor-aanvulling voelt minder prettig aan op het krachtigere model, omdat gebruikers de wachttijd eerder opmerken dan de kwaliteit.
Alles wat afhankelijk is van gebeurtenissen na januari 2026. De betrouwbare kennisgrens van Fable 5 is januari 2026. Die van Opus 5 is mei 2026. Het duurdere model is het minst actuele, dus bij vragen over recente gebeurtenissen betaalt u dubbel voor oudere kennis, tenzij u het model voorziet van zoek- of ophaaltools.
Eén beperking staat volledig los van de kosten. Fable 5 hanteert een gegevensbewaartermijn van 30 dagen en is niet beschikbaar onder een beleid van nul gegevensbewaring, omdat het is aangemerkt als een Covered Model. Als uw overeenkomst nul bewaring vereist, is Fable 5 tegen geen enkele prijs een optie, en geen enkele korting verandert dat.
Wat de fable-method repositories laten zien, en wat ze niet doen
Beoefenaars hebben repositories gepubliceerd die destilleren hoe Fable 5-benaderingen kunnen worden vertaald naar vaardigheden die een goedkoper model kan volgen. De fable-method repo beschrijft een denkvaardigheid, een orchestratielus en een adversariële verificateur die elke geclaimde controle opnieuw uitvoert in plaats van het eigen rapport van de agent te lezen. De README stelt dit direct: "Dit is een distillatie door de community, geen officieel product van Anthropic."
Behandel het precies zo. Het is bewijs van hoe mensen het model aansturen, en het is geen documentatie van hoe het model werkt. Niets hierin is gevalideerd door Anthropic, en er bestaan verschillende nagenoeg identieke forks met andere bewoordingen; dit is wat u mag verwachten van folklore in plaats van een specificatie.
Het relevante signaal voor een kostenbeslissing is dat de onderdelen die mensen de moeite waard vonden om te kopiëren, procedureel zijn. Classificeer de taak, benoem de controle die bewijst dat deze is voltooid, verzamel bewijs voordat u een besluit neemt en verifieer vervolgens door observatie in plaats van door een samenvatting te lezen. Een goedkoper model dat een expliciete checklist en een verificatiestap krijgt, dicht een deel van het gat. Voer dat experiment daarom uit op uw eigen evaluatieset voordat u standaardiseert op het dure model. Het resultaat hangt af van uw taken, en daarom zijn de cijfers van anderen voor u van weinig waarde.
Controleer uw eigen cijfers voordat u budget toewijst
- Lees
usagebij elke respons en logoutput_tokens_details.thinking_tokensafzonderlijk van de zichtbare output. Redeneringen die u niet ziet, zijn de posten die mensen verrassen. - Stel
effortexpliciet in in plaats van de standaardwaarde te accepteren, en houd deze constant tijdens elk gesprek dat afhankelijk is van prompt caching. - Plaats uw stabiele prefix vóór een cache-breakpoint. Een cache-read tegen een tiende van de basisprijs voor input levert meer besparing op dan de meeste model-downgrades.
- Verplaats alles waarvoor geen direct antwoord nodig is naar de Batch API.
- Prijs het alternatief eerlijk. Vergelijking van de API-prijzen van Claude en ChatGPT voor uw eigen werklast is een middag werk waard voordat u een langdurige verplichting aangaat.
Als de werklast een agent is die op uw eigen server draait, liggen de controles die het meest van belang zijn buiten de modelkeuze. Agentkosten onder controle houden op een VPS behandelt de luslimieten en uitgavenplafonds die een op hol geslagen sessie stoppen, en waar Claude Code daadwerkelijk tokens verbruikt legt de cijfers uit die u in uw gebruiksdashboard zult zien.
FAQ
Wat kost Claude Fable 5 per miljoen tokens?
Claude Fable 5 staat genoteerd op $10 per miljoen input-tokens en $50 per miljoen output-tokens via de Claude API, gecontroleerd op de prijspagina van Anthropic op 3 augustus 2026. Een cache-read kost $1 per miljoen tokens, wat een tiende is van het basistarief voor input. De Batch API biedt 50% korting op beide onderdelen, wat neerkomt op $5 en $25 per miljoen tokens voor asynchrone verwerking. Het beperken van inferentie tot de Verenigde Staten met de parameter inference_geo voegt een vermenigvuldigingsfactor van 1,1 toe aan elke categorie.
Is Claude Fable 5 inbegrepen bij een Claude Pro-abonnement?
De Claude Fable-pagina van Anthropic vermeldt dat het model beschikbaar is voor Pro-, Max-, Team- en Enterprise-gebruikers; het gratis abonnement wordt niet genoemd. De inbegrepen toegang is niet onbeperkt. Sommige accounts krijgen toegang tot Fable als onderdeel van wekelijkse gebruikslimieten, terwijl andere dit via gebruikscredits doen; deze regeling is in juli 2026 meermaals gewijzigd. Raadpleeg de rij met het label Fable in de vergelijkingstabel op de prijspagina van Anthropic op de dag dat u een besluit neemt, in plaats van te vertrouwen op cijfers uit een artikel. Zodra het inbegrepen tegoed is verbruikt, wordt verder gebruik gefactureerd tegen het API-tarief.
Waarom is mijn rekening voor Claude Fable 5 hoger dan het zichtbare resultaat suggereert?
Adaptive thinking staat altijd ingeschakeld voor Claude Fable 5. Thinking-tokens worden gefactureerd als output-tokens en de ruwe chain of thought wordt nooit geretourneerd. Met thinking.display op de standaardwaarde omitted ziet u een leeg thinking-veld terwijl u betaalt voor elk reasoning-token dat daarachter zit. Lees usage.output_tokens_details.thinking_tokens in het antwoord om de verdeling te zien en houd er rekening mee dat dit bij streaming pas bij het laatste message_delta-event aankomt. Verlaag het niveau van effort als de verhouding tussen redenering en antwoord hoger is dan de taak vereist.
Moet ik Claude Fable 5 of Claude Opus 5 gebruiken?
Claude Opus 5 kost de helft per token en heeft een recentere betrouwbare kennisgrens: mei 2026 tegenover januari 2026 voor Fable 5. Begin met Opus 5 en schaal op wanneer een taak daar faalt, of wanneer een foutief antwoord meer kost dan het prijsverschil. Fable 5 is de juiste keuze voor agent-taken met een lange horizon waarbij één verkeerde vertakking uren aan herstelwerk kost, en voor eenmalige opdrachten waarbij de meerprijs op één factuur terechtkomt in plaats van op elk verzoek voor altijd.