Claude Fable 5 : prix et cas d’usage
Claude Fable 5 coûte 10 $ par million de tokens d’entrée et 50 $ en sortie. Découvrez ce que ces tarifs Anthropic impliquent pour vos tâches réelles.
Combien coûte Claude Fable 5 ?
Claude Fable 5 coûte $10 par million de tokens d’entrée et $50 par million de tokens de sortie sur l’API Claude. Il s’agit des tarifs catalogue publiés par Anthropic, relevés sur la page des tarifs le 3 août 2026. L’identifiant du modèle dans l’API est claude-fable-5. Le modèle est devenu généralement disponible le 9 juin 2026 sur l’API Claude, Amazon Bedrock, Claude Platform on AWS, Google Cloud et Microsoft Foundry.
The data behind this chart
[
{
"label": "Claude Fable 5",
"input": "10",
"output": "50",
"cache_read": "1",
"batch_input": "5",
"batch_output": "25"
},
{
"label": "Claude Opus 5",
"input": "5",
"output": "25",
"cache_read": "0.50",
"batch_input": "2.50",
"batch_output": "12.50"
},
{
"label": "Claude Sonnet 5 (intro rate)",
"input": "2",
"output": "10",
"cache_read": "0.20",
"batch_input": "1",
"batch_output": "5"
},
{
"label": "Claude Sonnet 5 (from 1 Sep)",
"input": "3",
"output": "15",
"cache_read": "0.30",
"batch_input": "1.50",
"batch_output": "7.50"
},
{
"label": "Claude Haiku 4.5",
"input": "1",
"output": "5",
"cache_read": "0.10",
"batch_input": "0.50",
"batch_output": "2.50"
}
]Considérez ces tarifs comme une échelle. Le tarif catalogue de Fable 5 est deux fois supérieur à celui de Claude Opus 5, cinq fois supérieur au tarif actuel de Claude Sonnet 5 et dix fois supérieur à celui de Claude Haiku 4.5. Le ratio est identique pour les deux types de tokens, car tous les modèles de ce tableau facturent les tokens de sortie exactement cinq fois plus cher que leurs tokens d’entrée. Si vous connaissez la répartition entre tokens d’entrée et de sortie d’une tâche, vous pouvez donc convertir un tarif vers n’importe quel autre par multiplication.
Une date modifie le calcul. Sonnet 5 bénéficie d’un tarif de lancement de $2 et $10 par million de tokens jusqu’au 31 août 2026. À partir du 1er septembre 2026, son tarif catalogue sera de $3 et $15. Le tarif de Fable 5 ne change pas. L’écart entre les deux passe donc de cinq fois à un peu plus de trois fois ce jour-là. Si vous préparez un budget pour l’automne, utilisez les tarifs ultérieurs de Sonnet.
Les réductions, et le seul multiplicateur qui augmente le montant
La mise en cache du prompt est le levier le plus important. La lecture du cache coûte un dixième du tarif d’entrée de base, soit $1 par million de tokens avec Fable 5. L’écriture dans le cache coûte plus cher qu’un token d’entrée ordinaire : 1,25 fois le tarif de base pour le cache de cinq minutes et 2 fois le tarif de base pour le cache d’une heure. Un cache de cinq minutes est amorti après une seule lecture, et un cache d’une heure après deux lectures. Ce calcul suffit à justifier le calcul du seuil de rentabilité de la mise en cache du prompt avant de l’activer partout.
La Batch API applique une réduction de 50 % aux deux catégories. Un traitement Fable 5 par lots coûte donc $5 et $25 par million de tokens. Les requêtes Batch sont asynchrones. Cette réduction ne s’applique donc qu’aux traitements qui ne nécessitent pas de réponse immédiate. Les deux réductions se cumulent, ce qui rend un traitement mis en cache et exécuté par lots peu coûteux dans les deux catégories.
La fenêtre de contexte de 1M tokens est incluse aux tarifs standard sur Claude 4.6 et les modèles ultérieurs. Aucun supplément ne s’applique aux contextes longs. Une requête de 900k tokens est donc facturée au même tarif par token qu’une requête de 9k tokens.
Le multiplicateur qui augmente la facture concerne la résidence des données. Définir inference_geo: "us" pour maintenir l’inférence aux États-Unis applique un multiplicateur de 1,1 à chaque catégorie de tokens, y compris les lectures et les écritures du cache. Conservez le routage global par défaut, sauf si un contrat impose une autre configuration.
Une règle de facturation est propre à ce modèle. Fable 5 embarque des classificateurs de sécurité qui peuvent refuser une requête. Dans ce cas, l’API Messages renvoie stop_reason: "refusal" avec une réponse HTTP 200 indiquant un succès, et la requête refusée avant la génération de toute sortie n’est pas facturée. Si vous réessayez le même prompt avec un autre modèle Claude, le crédit de fallback rembourse le coût de la mise en cache du prompt lié au changement de modèle. Vous ne payez donc pas deux fois le remplissage du même cache.
Quels forfaits incluent Claude Fable 5 ?
Au 3 août 2026, la page Claude Fable d’Anthropic indique que le modèle est disponible pour les utilisateurs Pro, Max, Team et Enterprise. Le forfait gratuit n’est pas mentionné. Pro est le forfait par utilisateur le moins cher de cette liste. Le prix de Pro et les limites d’utilisation définissent donc le seuil minimal de toute souscription donnant accès à Fable. Si l’accès à Fable est la raison principale de votre passage à un forfait payant, commencez par examiner si un siège Pro vaut le coût selon votre usage, car une limite Fable réduite justifie difficilement la souscription à elle seule. Pour les développeurs, le modèle est généralement disponible via la Claude API et les marketplaces cloud listées plus haut. Cette voie ne propose pas de niveau gratuit. Le petit crédit accordé par Anthropic lors de l’inscription est donc le seul montant dont vous disposez avant la facturation à l’usage.
Être disponible dans une offre ne signifie pas être inclus sans limite. Un abonnement n’est pas non plus décompté comme l’API, car un siège Pro n’a aucun quota de tokens publié et comptabilise plutôt l’usage en messages sur une fenêtre glissante. Rien dans une offre ne se convertit donc directement en montants par million de tokens comme ceux indiqués plus haut. Le tableau comparatif des offres sur la page tarifaire d’Anthropic conditionne l’accès à Fable à une part des limites d’utilisation hebdomadaires pour certains sièges, et à des crédits d’utilisation pour d’autres. Ces modalités ont changé plusieurs fois en juillet 2026. Selon la propre annonce d’Anthropic sur le redéploiement de Fable 5, le modèle était inclus à hauteur de 50% des limites d’utilisation hebdomadaires jusqu’au 7 juillet 2026 dans les offres Pro, Max, Team et certaines offres Enterprise, puis fonctionnait avec des crédits d’utilisation après cette date. Les informations publiées pendant le reste du mois de juillet faisaient état de nouvelles prolongations et d’une distinction entre les types de sièges.
Cette page n’affichera donc pas de limite par forfait. Aucun chiffre publié pendant ce mois n’est resté valable deux semaines, et un nombre obsolète serait plus trompeur que l’absence de chiffre. Consultez la ligne Fable du tableau comparatif des forfaits le jour où vous prenez votre décision, et considérez tout chiffre publié dans un article d’actualité comme obsolète. Si vous prenez un siège pour accéder à Fable et que la limite s’avère inférieure à ce que le tableau vous laissait prévoir, repasser à un forfait inférieur avant le prochain renouvellement vous permet de conserver le mois déjà payé.
Le tarif de l’API, lui, reste stable. Quelle que soit la voie choisie, une fois la limite incluse épuisée, l’utilisation supplémentaire de Fable 5 est facturée aux tarifs du tableau ci-dessus. Enterprise rend cette structure explicite, car les frais du siège Enterprise achètent l’accès, tandis que les tokens restent facturés aux tarifs de l’API en supplément. Dans les deux cas, la grille tarifaire est donc la référence à utiliser pour établir votre budget. C’est aussi la conclusion à laquelle vous arrivez en comparant la facturation de l’API à celle d’un abonnement pour tout autre modèle Claude. Si vous n’avez pas encore choisi de niveau, commencez par identifier le forfait Claude adapté à votre usage. Si ce siège doit également vous servir d’assistant au quotidien, et pas seulement vous donner accès à Fable, vérifiez comment les forfaits Claude se comparent aux tarifs de ChatGPT avant de vous engager.
Pourquoi votre facture dépasse le ratio de prix attendu
Deux mécanismes documentés expliquent pourquoi Fable 5 coûte plus cher qu’une simple comparaison des prix ne le laisse penser.
Le premier concerne le tokenizer. Fable 5 utilise le tokenizer introduit avec Claude Opus 4.7. Par rapport aux modèles sortis avant Opus 4.7, un même texte produit environ 30% de tokens supplémentaires, et l’augmentation exacte dépend du contenu. Haiku 4.5 est antérieur à ce tokenizer. L’écart de dix fois indiqué dans la liste des prix est donc plus proche de treize fois lorsque vous transmettez le même bloc de texte aux deux modèles. Sonnet 5 utilise le nouveau tokenizer. La comparaison du prix par token entre Fable et Sonnet est donc pertinente. Elle ne l’est pas entre Fable et Haiku.
Le second concerne le thinking. Le thinking adaptatif est toujours activé pour Fable 5, et thinking: {"type": "disabled"} n’est pas pris en charge. Les tokens de thinking sont facturés comme des tokens de sortie, au tarif complet des tokens de sortie. La chaîne de pensée brute n’est jamais renvoyée par ce modèle, et thinking.display prend par défaut la valeur "omitted". Une réponse visible courte peut donc correspondre à un nombre élevé de tokens de sortie facturés. La documentation d’Anthropic l’indique clairement : le nombre de tokens de sortie facturés ne correspond pas au nombre de tokens visibles dans la réponse.
Consultez le détail au lieu de faire des suppositions. Le champ usage.output_tokens_details.thinking_tokens indique combien de tokens de sortie facturés ont été consacrés au raisonnement :
{
"usage": {
"input_tokens": 25,
"output_tokens": 348,
"output_tokens_details": {
"thinking_tokens": 312
}
}
}Dans cet exemple, tiré de la documentation d’Anthropic sur le thinking, 312 des 348 tokens de sortie facturés correspondaient à un raisonnement que personne n’a jamais vu. En streaming, ce détail n’arrive que dans l’événement message_delta final. Un client qui cesse de lire après le dernier bloc de texte ne l’enregistrera donc jamais.
Le contrôle est effort, défini à output_config.effort, avec les niveaux low, medium, high (la valeur par défaut), xhigh et max.
{
"model": "claude-fable-5",
"max_tokens": 32000,
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "..." }]
}Anthropic recommande, pour ce modèle, de commencer à high, de passer à xhigh uniquement pour les tâches les plus sensibles aux capacités, puis de redescendre à medium ou low pour les tâches courantes. Selon Anthropic, un effort moindre sur Fable 5 donne souvent de meilleurs résultats que xhigh sur les modèles précédents. Deux pièges sont à retenir. Modifier l’effort entre les requêtes invalide votre prompt cache, car la valeur d’effort résolue est intégrée au prompt. Choisissez donc un niveau par charge de travail et conservez-le. Par ailleurs, max_tokens impose une limite stricte à la sortie totale, qui combine le thinking et le texte de la réponse. Une limite définie pour une réponse sans thinking risque donc de tronquer la sortie. Si vous voyez stop_reason: "max_tokens", augmentez la limite ou réduisez l’effort.
Coût par tâche terminée, et non coût par token
The data behind this chart
[
{
"label": "Short answer (5k in, 1k out)",
"fable_5": "0.10",
"opus_5": "0.05",
"sonnet_5": "0.02",
"haiku_4_5": "0.01"
},
{
"label": "Coding session (300k in, 40k out)",
"fable_5": "5.00",
"opus_5": "2.50",
"sonnet_5": "1.00",
"haiku_4_5": "0.50"
},
{
"label": "Long agent run (2M in, 400k out)",
"fable_5": "40.00",
"opus_5": "20.00",
"sonnet_5": "8.00",
"haiku_4_5": "4.00"
}
]Ces 3 lignes relèvent de l’arithmétique, pas d’un benchmark. Les tarifs sont publiés. Les volumes de tokens sont des hypothèses que vous devez remplacer par les chiffres de vos propres données d’utilisation. Une session de développement correspondant à la ligne du milieu coûte $5.00 avec Fable 5, contre $1.00 avec Sonnet 5. La longue exécution coûte $40.00 contre $8.00. La colonne Haiku de cette dernière ligne relève uniquement de l’arithmétique : Haiku 4.5 dispose d’une fenêtre de contexte de 200k tokens et ne peut donc pas contenir cette tâche.
Le coût par token n’est pas la bonne unité pour prendre une décision. Le coût par tâche terminée correspond au coût d’une tentative multiplié par le nombre de tentatives. Aux tarifs actuels, une tentative avec Fable 5 coûte autant que cinq tentatives avec Sonnet 5. Le seul nombre de retries justifie donc presque jamais le passage à l’offre supérieure. Sonnet devrait échouer plus de quatre fois sur cinq pour que l’option la moins chère devienne plus coûteuse en tokens.
Ce qui justifie ce choix, c’est tout ce que la facture de tokens ne prend pas en compte. L’écart entre les deux longues exécutions du graphique est inférieur au coût d’une heure de travail d’un ingénieur sur la plupart des marchés. Si le modèle le plus coûteux vous fait gagner une heure de revue ou évite une migration incorrecte que vous devriez ensuite annuler, il est déjà rentabilisé, même si la facture ne montre pas cette économie. Faites la comparaison en coût par résultat accepté et incluez votre propre temps dans le total. Comprendre ce qu’achète réellement un million de tokens rend cette estimation beaucoup moins abstraite.
Trois tâches pour lesquelles Claude Fable 5 justifie son prix
Les exécutions d’agents à long horizon, lorsqu’une mauvaise décision coûte cher. Fable 5 est conçu pour les tâches qui durent plusieurs heures : une fenêtre de contexte de 1M tokens, jusqu’à 128k tokens de sortie par requête et un niveau d’effort xhigh destiné aux tâches de plus de trente minutes, avec des budgets de plusieurs millions de tokens. Comparez le coût de l’exécution avec celui du nettoyage nécessaire après qu’un agent a pris une mauvaise direction à l’étape 40, sans que personne ne s’en aperçoive avant l’étape 300.
Une migration ou un audit exécuté une seule fois sur une base de code volumineuse. Une tâche ponctuelle ne permet pas d’amortir les coûts par le volume. La majoration par token est donc facturée sur une seule facture, et toute la tâche peut tenir dans une seule fenêtre de contexte. Si elle peut s’exécuter de manière asynchrone, la Batch API divise par deux le coût, qui passe à $25 par million de tokens de sortie.
La tâche qui a déjà échoué deux fois avec un modèle moins cher. Deux tentatives infructueuses, auxquelles s’ajoute votre temps de débogage, coûtent plus cher qu’une tentative avec Fable aux volumes indiqués dans le graphique ci-dessus. Passer au niveau supérieur est donc l’option la moins coûteuse, et c’est précisément l’objectif d’une hiérarchie de modèles. Si vous hésitez encore globalement entre plusieurs niveaux, la comparaison des capacités entre les niveaux de modèles Claude répond à une autre question que cette page.
Trois tâches pour lesquelles Sonnet 5 ou Haiku 4.5 est le choix raisonnable
Classification et extraction à haut volume. Ces tâches sont évaluées selon le débit et le coût unitaire, et leur niveau de qualité maximal est suffisamment bas pour qu’un modèle économique l’atteigne. Si une tâche est correctement traitée par Haiku 4.5 à un dixième du prix, Fable 5 n’apporte aucun gain mesurable.
Travail interactif où la latence est le produit. Le tableau des modèles d’Anthropic indique que la latence comparative de Fable 5 est plus élevée, et il est impossible de désactiver le raisonnement. Une boîte de dialogue ou la complétion dans un éditeur donne une moins bonne expérience avec le modèle le plus puissant, car les utilisateurs perçoivent l’attente avant de percevoir la qualité.
Tout ce qui dépend d’événements postérieurs à January 2026. La date limite fiable des connaissances de Fable 5 est January 2026. Celle d’Opus 5 est May 2026. Le modèle le plus cher est le moins à jour : pour les questions d’actualité, vous payez deux fois plus pour des connaissances plus anciennes, sauf si vous lui fournissez des outils de recherche ou de récupération.
Une contrainte est totalement indépendante du coût. Fable 5 conserve les données pendant 30 days et n’est pas disponible avec une conservation nulle des données, car il est désigné comme Covered Model. Si votre contrat impose une conservation nulle, Fable 5 n’est une option à aucun prix, et aucune remise ne change cette contrainte.
Ce que montrent les dépôts consacrés à la méthode fable, et ce qu’ils ne montrent pas
Des praticiens ont publié des dépôts qui synthétisent la manière dont fonctionnent les approches Fable 5, sous forme de compétences qu’un modèle moins coûteux peut suivre. Le dépôt fable-method décrit une compétence de raisonnement, une boucle d’orchestration et un vérificateur adversarial qui réexécute chaque contrôle revendiqué au lieu de lire le propre compte rendu de l’agent. Son README l’indique directement : « Il s’agit d’une synthèse communautaire, pas d’un artefact d’Anthropic. »
Considérez-le exactement comme tel. Il montre comment des utilisateurs pilotent le modèle, mais ne documente pas son fonctionnement. Rien de ce dépôt n’a été validé par Anthropic. Plusieurs forks presque identiques existent avec des formulations différentes. C’est ce que l’on attend d’un savoir transmis par la pratique, pas d’une spécification.
Pour décider si le coût en vaut la peine, retenez surtout que les éléments que les utilisateurs ont jugé utile de copier sont procéduraux. Classez la tâche. Nommez le contrôle qui prouve qu’elle est terminée. Rassemblez les éléments probants avant de décider. Vérifiez ensuite par observation plutôt qu’en lisant un résumé. Un modèle moins coûteux auquel vous fournissez une checklist explicite et une étape de vérification peut réduire une partie de l’écart. Exécutez donc cette expérience sur votre propre jeu d’évaluation avant de standardiser l’utilisation du modèle coûteux. Le résultat dépend de vos tâches. C’est pourquoi le chiffre obtenu par quelqu’un d’autre vous sera rarement utile.
Vérifiez vos propres chiffres avant d’engager un budget
- Lisez
usagedans chaque réponse et journalisezoutput_tokens_details.thinking_tokensséparément de la sortie visible. Le raisonnement que vous ne voyez jamais est le poste qui réserve les mauvaises surprises. - Définissez explicitement
effortau lieu d’accepter la valeur par défaut et conservez-le inchangé dans toute conversation qui utilise le prompt caching. - Placez d’abord votre préfixe stable derrière un point de cache. Une lecture depuis le cache à un dixième du prix de base des entrées permet d’économiser davantage que la plupart des changements vers un modèle moins coûteux.
- Déplacez vers la Batch API tout ce qui ne nécessite pas de réponse immédiate.
- Évaluez honnêtement l’alternative. Comparer la tarification des API Claude et ChatGPT sur votre propre charge de travail vaut un après-midi avant de vous engager pour longtemps.
Si la charge de travail correspond à un agent exécuté sur votre propre serveur, les contrôles les plus importants se situent en dehors du choix du modèle. Maîtriser les coûts d’un agent sur un VPS présente les limites de boucle et les plafonds de dépenses qui arrêtent une session hors de contrôle, tandis que où Claude Code consomme réellement des tokens explique les chiffres affichés dans votre tableau de bord d’utilisation.
FAQ
Combien coûte Claude Fable 5 par million de tokens ?
Claude Fable 5 est proposé à $10 par million de tokens d’entrée et à $50 par million de tokens de sortie sur l’API Claude, d’après les tarifs d’Anthropic vérifiés le 3 août 2026. La lecture du cache coûte $1 par million de tokens, soit un dixième du tarif de base des entrées. La Batch API applique une remise de 50 % aux deux catégories, soit $5 et $25 par million de tokens pour les traitements asynchrones. Maintenir l’inférence aux États-Unis avec le paramètre inference_geo applique un multiplicateur de 1.1 à chaque catégorie.
Claude Fable 5 est-il inclus dans un abonnement Claude Pro ?
La page Claude Fable d’Anthropic indique que le modèle est disponible pour les utilisateurs Pro, Max, Team et Enterprise, sans mentionner le forfait gratuit. L’accès inclus n’est pas illimité. Certaines licences donnent accès à Fable dans le cadre des limites d’utilisation hebdomadaires, tandis que d’autres utilisent des crédits d’utilisation. Ces modalités ont changé plusieurs fois en juillet 2026. Consultez la ligne Fable dans le tableau comparatif des forfaits sur la page des tarifs d’Anthropic le jour où vous prenez votre décision, au lieu de vous fier à un chiffre publié dans un article. Une fois le quota inclus épuisé, l’utilisation supplémentaire est facturée au tarif de l’API.
Pourquoi ma facture Claude Fable 5 est-elle supérieure à ce que suggère la sortie visible ?
Le raisonnement adaptatif est toujours activé pour Claude Fable 5. Les tokens de raisonnement sont facturés comme des tokens de sortie, et la chaîne de raisonnement brute n’est jamais renvoyée. Avec thinking.display réglé sur sa valeur par défaut, omitted, vous voyez un champ de raisonnement vide, mais chaque token de raisonnement est facturé. Consultez usage.output_tokens_details.thinking_tokens dans la réponse pour voir la répartition. En streaming, cette information arrive uniquement dans l’événement message_delta final. Réduisez le niveau effort si la proportion entre le raisonnement et la réponse dépasse ce que la tâche nécessite.
Dois-je utiliser Claude Fable 5 ou Claude Opus 5 ?
Claude Opus 5 coûte deux fois moins cher par token et dispose d’une date de coupure des connaissances fiables plus récente : mai 2026, contre janvier 2026 pour Fable 5. Commencez avec Opus 5 et passez à un modèle supérieur lorsqu’une tâche échoue avec celui-ci, ou lorsqu’une réponse incorrecte coûte plus cher que la différence de tarif. Fable 5 convient aux tâches d’agent à long horizon, lorsqu’une mauvaise branche entraînerait plusieurs heures de nettoyage, ainsi qu’aux tâches ponctuelles dont le surcoût apparaît sur une seule facture plutôt que sur chaque requête de manière récurrente.