SSD Nodes Learn Hosting plans →
Gidsen Matt ConnorDoor Matt Connor · Bijgewerkt 2026-09-06

Wat kost Claude Fable 5 per miljoen tokens?

Claude Fable 5 kost 10 dollar per miljoen input-tokens en 50 dollar per miljoen output-tokens. Ontdek wat deze tarieven betekenen voor uw API-gebruik en de kosten per taak.

Wat kost Claude Fable 5?

Claude Fable 5 kost $10 per miljoen input-tokens en $50 per miljoen output-tokens via de Claude API. Dit zijn de gepubliceerde tarieven van Anthropic, zoals vermeld op de prijspagina op 3 augustus 2026. Het model-ID voor de API is claude-fable-5. Het model is sinds 9 juni 2026 algemeen beschikbaar via de Claude API, Amazon Bedrock, Claude Platform op AWS, Google Cloud en Microsoft Foundry.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

Zie dit als een hiërarchie. Fable 5 kost twee keer zoveel als Claude Opus 5, vijf keer het huidige tarief van Claude Sonnet 5 en tien keer dat van Claude Haiku 4.5. De verhouding is aan beide zijden van de factuur gelijk, omdat elk model in die tabel de output-prijs op precies vijf keer het eigen input-tarief stelt. Als u de verdeling tussen input- en output-tokens voor een taak kent, kunt u de ene prijs dus eenvoudig naar de andere omrekenen door middel van vermenigvuldiging.

Eén datum verandert de berekening. Voor Sonnet 5 geldt een introductieprijs van $2 en $10 per miljoen tokens tot en met 31 augustus 2026. Vanaf 1 september 2026 bedraagt de prijs $3 en $15. De prijs van Fable 5 zelf wijzigt niet, waardoor het prijsverschil tussen beide modellen op die dag afneemt van vijf keer naar iets meer dan drie keer. Gebruik voor het opstellen van een budget voor het najaar de latere cijfers van Sonnet.

De kortingen en de ene vermenigvuldiger die de andere kant op werkt

Prompt caching is de grootste besparingsfactor. Een cache-read kost een tiende van de standaard inputprijs, wat neerkomt op $1 per miljoen tokens op Fable 5. Schrijven naar de cache kost meer dan een gewoon input-token: 1,25 keer de basisprijs voor de cache van vijf minuten en 2 keer de basisprijs voor de cache van een uur. Een cache van vijf minuten verdient zichzelf terug na één keer lezen, en een cache van een uur na twee keer lezen. Die berekening vormt het volledige argument voor het bepalen van het break-evenpunt voor prompt caching voordat u dit overal inschakelt.

De Batch API biedt 50% korting op beide zijden, waardoor batch-verwerking met Fable 5 $5 en $25 per miljoen tokens kost. Batch-verzoeken zijn asynchroon, dus dit is alleen nuttig voor werkzaamheden waarbij niet direct een antwoord vereist is. De twee kortingen zijn cumulatief, waardoor een gecachte, gebatchte taak op beide vlakken goedkoop is.

Het contextvenster van 1M tokens is inbegrepen tegen standaardtarieven bij Claude 4.6 en latere modellen. Er is geen toeslag voor een lange context, dus een verzoek van 900k tokens wordt gefactureerd tegen hetzelfde tarief per token als een verzoek van 9k.

De vermenigvuldiger die de rekening verhoogt, is datalocatie. Het instellen van inference_geo: "us" om inferentie binnen de Verenigde Staten te houden, past een vermenigvuldiger van 1,1 toe op elke token-categorie, inclusief cache-reads en cache-writes. Laat de standaard globale routering staan, tenzij een contract anders vereist.

Eén factureringsregel is specifiek voor dit model. Fable 5 bevat veiligheidsclassificaties die een verzoek kunnen afwijzen. Wanneer dat gebeurt, retourneert de Messages API stop_reason: "refusal" als een succesvolle HTTP 200-respons in plaats van een foutmelding, en worden er geen kosten in rekening gebracht voor een verzoek dat is geweigerd voordat er output werd gegenereerd. Als u dezelfde prompt opnieuw probeert op een ander Claude-model, vergoedt het fallback-tegoed de kosten voor de prompt-cache van de overstap, zodat u niet betaalt voor het tweemaal opwarmen van dezelfde cache.

Welke abonnementen bevatten Claude Fable 5?

Sinds 3 augustus 2026 vermeldt de Claude Fable-pagina van Anthropic dat het model beschikbaar is voor Pro-, Max-, Team- en Enterprise-gebruikers. Het gratis abonnement wordt niet genoemd. Pro is de goedkoopste optie op die lijst, dus wat Pro kost en waar de gebruikslimieten u beperken vormt de ondergrens voor elke abonnementsvorm die toegang geeft tot Fable. Als toegang tot Fable de voornaamste reden is om te upgraden, overweeg dan eerst of een Pro-licentie de kosten waard is voor uw eigen gebruik, aangezien een beperkte Fable-toegang op zichzelf een zwak argument is voor een abonnement. Voor ontwikkelaars is het model algemeen beschikbaar via de Claude API en via de hierboven genoemde cloud-marktplaatsen. Er is geen gratis laag voor die route, dus het kleine tegoed dat Anthropic bij aanmelding verstrekt is alles wat u krijgt voordat de facturering begint.

Beschikbaar binnen een plan is niet hetzelfde als onbeperkt inbegrepen. Ook wordt een abonnement niet op dezelfde manier afgerekend als de API. een Pro-seat heeft namelijk helemaal geen gepubliceerde tokenlimiet en telt het gebruik in plaats daarvan in berichten binnen een voortschrijdend venster. Daardoor kan niets binnen een plan rechtstreeks worden omgerekend naar de bovenstaande bedragen per miljoen tokens. De tabel met planvergelijkingen op de prijspagina van Anthropic koppelt Fable bij sommige seats aan een aandeel van de wekelijkse gebruikslimieten en bij andere aan gebruikstegoeden. Die regeling is in juli 2026 meerdere keren gewijzigd. In de eigen verklaring van Anthropic over de herintroductie van Fable 5 stond dat het model tot en met 7 juli 2026 beschikbaar was voor maximaal 50% van de wekelijkse gebruikslimieten binnen Pro-, Max-, Team- en bepaalde Enterprise-plannen. Daarna golden gebruikstegoeden. Verslaggeving gedurende de rest van juli beschreef verdere verlengingen en een onderscheid tussen seattypen.

Deze pagina vermeldt daarom geen limiet per abonnement. Geen enkel cijfer dat in die maand werd gepubliceerd, bleef langer dan twee weken geldig, en een verouderd getal zou hier schadelijker zijn dan geen informatie. Open de rij met het label Fable in de vergelijkingstabel op de dag dat u een besluit neemt en beschouw elk cijfer in een nieuwsartikel als verouderd. Als u een licentie neemt voor Fable-toegang en de limiet blijkt lager dan de tabel deed vermoeden, dan blijft het terugschalen vóór de volgende verlenging de maand waarvoor u al heeft betaald intact.

Wat wel stabiel is, is het API-tarief. Zodra een inbegrepen limiet is verbruikt, wordt verder Fable 5-gebruik op elke route gefactureerd tegen de prijzen in de bovenstaande tabel. Enterprise maakt die structuur expliciet, omdat de Enterprise-licentievergoeding toegang biedt, terwijl de tokens zelf nog steeds tegen API-tarieven worden afgerekend bovenop de vaste kosten. Dat maakt de prijslijst het getal om mee te plannen, wat dezelfde conclusie is als wanneer u API-facturering vergelijkt met een abonnement voor elk ander Claude-model. Als u nog geen abonnement heeft gekozen, begin dan bij welk Claude-abonnement aansluit bij uw gebruik. Als die licentie ook uw dagelijkse assistent zou zijn in plaats van enkel een toegangspoort tot Fable, is het de moeite waard om te controleren hoe de Claude-abonnementen zich verhouden tot die van ChatGPT voordat u zich vastlegt.

Waarom uw factuur hoger uitvalt dan de prijsverhouding doet vermoeden

Er zijn twee gedocumenteerde mechanismen waardoor Fable 5 meer kost dan een directe prijsvergelijking suggereert.

De eerste is de tokenizer. Fable 5 gebruikt de tokenizer die werd geïntroduceerd met Claude Opus 4.7. Vergeleken met modellen die vóór Opus 4.7 zijn uitgebracht, produceert dezelfde tekst ongeveer 30% meer tokens; de exacte toename hangt af van de inhoud. Haiku 4.5 dateert van vóór die tokenizer, dus het prijsverschil van factor tien in de prijslijst is in de praktijk dichter bij factor dertien wanneer u beide modellen hetzelfde tekstblok voert. Sonnet 5 gebruikt de nieuwere tokenizer, dus een vergelijking tussen Fable en Sonnet is een eerlijke vergelijking per token. Een vergelijking tussen Fable en Haiku is dat niet.

De tweede is het denkproces. Adaptief denken staat bij Fable 5 altijd aan en thinking: {"type": "disabled"} wordt niet ondersteund. Denktokens worden gefactureerd als output-tokens, tegen het volledige output-tarief. De ruwe gedachtegang wordt bij dit model nooit geretourneerd en thinking.display staat standaard op "omitted", wat betekent dat een kort zichtbaar antwoord een groot gefactureerd output-aantal kan bevatten. De documentatie van Anthropic stelt het duidelijk: het gefactureerde aantal output-tokens komt niet overeen met het zichtbare aantal tokens in het antwoord.

Bekijk de specificatie in plaats van te gissen. Het veld usage.output_tokens_details.thinking_tokens rapporteert hoeveel gefactureerde output-tokens naar redenering zijn gegaan:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

In dat voorbeeld, afkomstig uit de documentatie over het denkproces van Anthropic, waren 312 van de 348 gefactureerde output-tokens redeneringen die niemand ooit heeft gezien. Wanneer u streamt, arriveert deze specificatie pas bij het laatste message_delta-event, dus een client die stopt met lezen bij het laatste tekstblok zal dit nooit registreren.

De instelling is effort, ingesteld op output_config.effort, met niveaus low, medium, high (de standaard), xhigh en max.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

Het advies van Anthropic voor dit model is om te beginnen bij high, alleen voor het meest capaciteitsgevoelige werk op te schalen naar xhigh, en voor routinewerk terug te schakelen naar medium of low, op basis van het feit dat minder inspanning op Fable 5 vaak beter presteert dan xhigh op eerdere modellen. Hierbij zijn twee valkuilen. Het wijzigen van de inspanning tussen verzoeken maakt uw prompt-cache ongeldig, omdat de vastgestelde inspanningswaarde in de prompt wordt verwerkt; kies dus een niveau per werklast en houd dit constant. Daarnaast is max_tokens een harde limiet op de totale output, inclusief denkproces en antwoordtekst; een limiet die is afgestemd op een antwoord zonder denkproces zal dus leiden tot afkapping. Het zien van stop_reason: "max_tokens" betekent dat u de limiet moet verhogen of de inspanning moet verlagen.

Kosten per voltooide taak, niet kosten per token

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

Die 3 rijen zijn rekenkundig van aard, niet bedoeld als benchmark. De tarieven zijn openbaar. De tokenvolumes zijn aannames die u moet vervangen door cijfers uit uw eigen gebruiksgegevens. Een programmeersessie zoals weergegeven in de middelste rij kost $5.00 op Fable 5 tegenover $1.00 op Sonnet 5. De lange run kost $40.00 tegenover $8.00. De kolom voor Haiku in die laatste rij is puur rekenkundig: Haiku 4.5 heeft een contextvenster van 200k tokens en kan die taak dus helemaal niet verwerken.

Kosten per token is de verkeerde eenheid voor een besluitvormingsproces. Kosten per voltooide taak zijn de kosten per poging vermenigvuldigd met het aantal pogingen. Tegen de huidige tarieven kost één Fable 5-poging evenveel als vijf Sonnet 5-pogingen; het aantal retries rechtvaardigt de upgrade dus bijna nooit op zichzelf. Sonnet zou in meer dan vier van de vijf gevallen moeten falen voordat het goedkopere pad op basis van tokens verliest.

Wat de kosten wel rechtvaardigt, is alles wat de tokenrekening buiten beschouwing laat. Het verschil tussen de twee lange runs in de tabel is kleiner dan één uur aan ingenieursuren in de meeste markten. Als het duurdere model een uur aan revisietijd bespaart, of één mislukte migratie voorkomt die u anders zou moeten herstellen, heeft het zichzelf al terugverdiend op een factuur die de besparing niet toont. Baseer de vergelijking op geld per geaccepteerd resultaat en neem uw eigen tijd op in het totaal. Weten wat een miljoen tokens daadwerkelijk oplevert maakt die schatting veel minder abstract.

Drie taken waar Claude Fable 5 zijn prijs waard is

Agent-runs met een lange horizon waarbij een verkeerde afslag kostbaar is. Fable 5 is ontworpen voor werk dat in uren wordt gemeten: een contextvenster van 1M tokens, tot 128k output-tokens per verzoek en een xhigh inspanningsniveau gericht op taken die langer dan dertig minuten duren met tokenbudgetten in de miljoenen. Weeg de uitvoering af tegen de opruimwerkzaamheden nadat een agent bij stap 40 een verkeerde afslag neemt die pas bij stap 300 wordt opgemerkt.

Een migratie of audit die u eenmalig uitvoert op een grote codebase. Eenmalig werk heeft geen volume om de kosten te spreiden, waardoor de premie per token op één factuur terechtkomt, en de gehele taak mogelijk in één contextvenster past. Als het asynchroon kan worden uitgevoerd, halveert de Batch API de kosten naar $25 per miljoen output-tokens.

De taak waar een goedkoper model al twee keer in heeft gefaald. Twee mislukte pogingen plus uw tijd voor het debuggen kosten meer dan één Fable-poging bij de volumes in de bovenstaande tabel. Escaleren is de goedkopere optie, en dat is waar een model-ladder voor dient. Als u in het algemeen nog kiest tussen verschillende niveaus, beantwoordt de vergelijking van de mogelijkheden tussen de Claude-modelniveaus een andere vraag dan deze pagina.

Drie taken waarvoor Sonnet 5 of Haiku 4.5 het juiste antwoord is

Classificatie en extractie met een hoog volume. Deze taken worden beoordeeld op doorvoer en eenheidskosten, en de kwaliteitsgrens is laag genoeg dat een goedkoop model deze bereikt. Bij een tienvoudige prijs voor een taak die Haiku 4.5 correct uitvoert, levert Fable 5 geen meetbaar voordeel op.

Interactief werk waarbij latentie het product is. De modeltabel van Anthropic geeft de vergelijkende latentie van Fable 5 als trager aan, en het denkproces kan niet worden uitgeschakeld. Een chatvenster of editor-aanvulling voelt minder prettig aan bij het krachtigere model, omdat gebruikers de wachttijd eerder opmerken dan de kwaliteit.

Alles wat afhankelijk is van gebeurtenissen na januari 2026. De betrouwbare kennisgrens van Fable 5 ligt in januari 2026. Die van Opus 5 ligt in mei 2026. Het duurdere model is het minst actuele model; bij vragen over recente gebeurtenissen betaalt u dus dubbel voor verouderde kennis, tenzij u het model voorziet van zoek- of ophaaltools.

Eén beperking staat volledig los van de kosten. Fable 5 hanteert een gegevensbewaartermijn van 30 dagen en is niet beschikbaar onder een beleid van nul gegevensbewaring, omdat het is aangemerkt als een Covered Model. Als uw overeenkomst nul bewaring vereist, is Fable 5 tegen geen enkele prijs een optie, en geen enkele korting verandert dat.

Wat de fable-method repositories laten zien, en wat ze niet doen

Beoefenaars hebben repositories gepubliceerd die destilleren hoe de Fable 5-benadering werkt in vaardigheden die een goedkoper model kan volgen. De fable-method repo beschrijft een denkvaardigheid, een orchestratielus en een adversariële verificateur die elke geclaimde controle opnieuw uitvoert in plaats van het eigen rapport van de agent te lezen. De README stelt dit direct: "Dit is een distillatie door de community, geen Anthropic-artifact."

Behandel het precies zo. Het is bewijs van hoe mensen het model aansturen, en het is geen documentatie van hoe het model werkt. Niets hierin is gevalideerd door Anthropic, en er bestaan verschillende vrijwel identieke forks met andere bewoordingen, wat u mag verwachten van folklore in plaats van een specificatie.

Het relevante signaal voor een kostenbeslissing is dat de onderdelen die mensen de moeite waard vonden om te kopiëren, procedureel zijn. Classificeer de taak, benoem de controle die bewijst dat deze is voltooid, verzamel bewijs voordat u beslist, en verifieer vervolgens door observatie in plaats van door een samenvatting te lezen. Een goedkoper model dat een expliciete checklist en een verificatiestap krijgt aangereikt, dicht een deel van de kloof. Voer dat experiment daarom uit op uw eigen evaluatieset voordat u standaardiseert op het dure model. Het resultaat hangt af van uw taken, en daarom zijn de cijfers van anderen voor u van weinig waarde.

Controleer uw eigen cijfers voordat u budget toewijst

  • Lees usage bij elke reactie en log output_tokens_details.thinking_tokens afzonderlijk van de zichtbare output. Redeneringen die u niet ziet, zijn vaak de posten die voor verrassingen zorgen.
  • Stel effort expliciet in in plaats van de standaardwaarde te accepteren, en houd deze constant tijdens elk gesprek dat afhankelijk is van prompt caching.
  • Plaats uw stabiele prefix vóór een cache-breakpoint. Een cache-read tegen een tiende van de basisprijs voor input bespaart meer dan de meeste downgrades naar een goedkoper model.
  • Verplaats alles waarvoor geen direct antwoord nodig is naar de Batch API.
  • Bereken de kosten van alternatieven op eerlijke wijze. Vergelijking van API-prijzen tussen Claude en ChatGPT voor uw eigen werklast is de moeite van een middag werk waard voordat u zich voor langere tijd vastlegt.

Als de werklast een agent is die op uw eigen server draait, liggen de belangrijkste beheersmaatregelen buiten de keuze voor het model. Agentkosten op een VPS onder controle houden behandelt de luslimieten en uitgavenplafonds die een op hol geslagen sessie stoppen, en waar Claude Code daadwerkelijk tokens verbruikt legt de cijfers uit die u in uw gebruiksdashboard zult zien.

FAQ

Wat kost Claude Fable 5 per miljoen tokens?

Claude Fable 5 staat genoteerd voor $10 per miljoen input-tokens en $50 per miljoen output-tokens via de Claude API, gecontroleerd op de prijspagina van Anthropic op 3 augustus 2026. Een cache-read kost $1 per miljoen tokens, wat een tiende is van het basistarief voor input. De Batch API biedt 50% korting op beide zijden, wat neerkomt op $5 en $25 per miljoen tokens voor asynchrone taken. Het beperken van inferentie tot de Verenigde Staten met de inference_geo-parameter voegt een vermenigvuldiger van 1,1 toe aan elke categorie.

Is Claude Fable 5 inbegrepen bij een Claude Pro-abonnement?

De Claude Fable-pagina van Anthropic vermeldt dat het model beschikbaar is voor Pro-, Max-, Team- en Enterprise-gebruikers; het gratis abonnement wordt niet genoemd. De inbegrepen toegang is niet onbeperkt. Sommige accounts krijgen toegang tot Fable als onderdeel van wekelijkse gebruikslimieten, terwijl andere dit via gebruikstegoeden bereiken. Deze regeling is in juli 2026 meermaals gewijzigd. Raadpleeg de rij met het label Fable in de vergelijkingstabel op de prijspagina van Anthropic op de dag dat u een besluit neemt, in plaats van te vertrouwen op cijfers uit een artikel. Zodra het inbegrepen tegoed is verbruikt, wordt verder gebruik gefactureerd tegen het API-tarief.

Waarom is mijn rekening voor Claude Fable 5 hoger dan de zichtbare output suggereert?

Adaptief denken staat bij Claude Fable 5 altijd aan. Denktokens worden gefactureerd als output-tokens en de ruwe 'chain of thought' wordt nooit geretourneerd. Met thinking.display op de standaardwaarde omitted ziet u een leeg denkveld terwijl u betaalt voor elk redeneertoken dat daarachter schuilgaat. Lees usage.output_tokens_details.thinking_tokens in het antwoord om de verdeling te zien en houd er rekening mee dat deze bij streaming pas verschijnt bij het laatste message_delta-event. Verlaag het effort-niveau als de verhouding tussen redenering en antwoord hoger is dan de taak vereist.

Moet ik Claude Fable 5 of Claude Opus 5 gebruiken?

Claude Opus 5 kost de helft per token en heeft een recentere betrouwbare kennisgrens: mei 2026 tegenover januari 2026 voor Fable 5. Begin met Opus 5 en schaal op wanneer een taak daar faalt, of wanneer een foutief antwoord meer kost dan het prijsverschil. Fable 5 is de juiste keuze voor agent-taken met een lange horizon waarbij één verkeerde vertakking uren aan herstelwerk kost, en voor eenmalige opdrachten waarbij de meerprijs op één factuur terechtkomt in plaats van op elk verzoek voor altijd.

#claude#fable#model-selection#pricing#tokens