Claude Fable 5: prezzo e quando usarlo
Claude Fable 5 costa 10 $ per milione di token in input e 50 $ in output. Scopri cosa significano le tariffe pubblicate per i lavori che esegui davvero.
Quanto costa Claude Fable 5?
Claude Fable 5 costa $10 per milione di token di input e $50 per milione di token di output sulla Claude API. Sono le tariffe pubblicate da Anthropic, rilevate dalla pagina dei prezzi il 3 agosto 2026. L'ID del modello API è claude-fable-5. Il modello è diventato generalmente disponibile il 9 giugno 2026 sulla Claude API, su Amazon Bedrock, su Claude Platform on AWS, su Google Cloud e su Microsoft Foundry.
The data behind this chart
[
{
"label": "Claude Fable 5",
"input": "10",
"output": "50",
"cache_read": "1",
"batch_input": "5",
"batch_output": "25"
},
{
"label": "Claude Opus 5",
"input": "5",
"output": "25",
"cache_read": "0.50",
"batch_input": "2.50",
"batch_output": "12.50"
},
{
"label": "Claude Sonnet 5 (intro rate)",
"input": "2",
"output": "10",
"cache_read": "0.20",
"batch_input": "1",
"batch_output": "5"
},
{
"label": "Claude Sonnet 5 (from 1 Sep)",
"input": "3",
"output": "15",
"cache_read": "0.30",
"batch_input": "1.50",
"batch_output": "7.50"
},
{
"label": "Claude Haiku 4.5",
"input": "1",
"output": "5",
"cache_read": "0.10",
"batch_input": "0.50",
"batch_output": "2.50"
}
]Considerate questi prezzi come una scala. Fable 5 ha un prezzo doppio rispetto a Claude Opus 5, cinque volte superiore alla tariffa corrente di Claude Sonnet 5 e dieci volte superiore a Claude Haiku 4.5. Il rapporto è identico per input e output, perché ogni modello nella tabella applica all'output una tariffa esattamente cinque volte superiore alla propria tariffa di input. Quindi, se conoscete la suddivisione tra token di input e di output di un'attività, potete convertire un prezzo in qualsiasi altro moltiplicandolo.
Una data modifica il calcolo. Sonnet 5 ha una tariffa promozionale di $2 e $10 per milione di token fino al 31 agosto 2026. Dal 1 settembre 2026 sarà disponibile al prezzo di $3 e $15. Il prezzo di Fable 5 non cambia, quindi quel giorno la differenza tra i due modelli si riduce da cinque volte a poco più di tre volte. Se state preparando un budget per l'autunno, usate i valori successivi di Sonnet.
Gli sconti e l’unico moltiplicatore che aumenta il costo
La cache dei prompt è il fattore con il maggiore impatto. Una lettura dalla cache costa un decimo del prezzo base dell’input, ovvero $1 per milione di token su Fable 5. La scrittura nella cache costa più di un normale token di input: 1,25 volte il prezzo base per la cache di cinque minuti e 2 volte il prezzo base per la cache di un’ora. Una cache di cinque minuti si ripaga dopo una sola lettura, mentre una cache di un’ora si ripaga dopo due letture. Questo calcolo è sufficiente per determinare quando la cache dei prompt raggiunge il pareggio prima di abilitarla ovunque.
La Batch API applica uno sconto del 50% a entrambi i lati, quindi i processi Fable 5 eseguiti in batch costano $5 per i token di input e $25 per i token di output, per milione di token. Le richieste batch sono asincrone, quindi questa soluzione è utile solo per i processi che non richiedono una risposta immediata. I due sconti si sommano, rendendo economico su entrambi gli assi un processo eseguito in batch con contenuto nella cache.
La finestra di contesto da 1M di token è inclusa alle tariffe standard su Claude 4.6 e sui modelli successivi. Non è previsto alcun sovrapprezzo per il contesto esteso, quindi una richiesta di 900k token viene fatturata alla stessa tariffa per token di una richiesta da 9k token.
Il moltiplicatore che aumenta il costo è la residenza dei dati. Impostando inference_geo: "us" per mantenere l’inferenza all’interno degli Stati Uniti si applica un moltiplicatore di 1,1 a ogni categoria di token, comprese le letture e le scritture nella cache. Mantieni il routing globale predefinito, a meno che un contratto non richieda diversamente.
Una regola di fatturazione è specifica per questo modello. Fable 5 include classificatori di sicurezza che possono rifiutare una richiesta. In questo caso, la Messages API restituisce stop_reason: "refusal" con una risposta HTTP 200 corretta invece di un errore e non viene addebitato alcun costo per una richiesta rifiutata prima della generazione dell’output. Se riprovi lo stesso prompt su un altro modello Claude, il credito di fallback rimborsa il costo della cache del prompt dovuto al passaggio, quindi non paghi due volte per riscaldare la stessa cache.
Quali piani includono Claude Fable 5?
Al 3 agosto 2026, la pagina di Anthropic dedicata a Claude Fable indica che il modello è disponibile per gli utenti Pro, Max, Team ed Enterprise. Il piano gratuito non è menzionato. Pro è il piano con il costo per postazione più basso nell’elenco, quindi quanto costa Pro e dove si fermano i suoi limiti di utilizzo definisce il costo minimo di qualsiasi abbonamento che consenta di usare Fable. Se l’accesso a Fable fosse il motivo principale per effettuare l’upgrade, valuta prima se vale la pena pagare una postazione Pro in base al tuo utilizzo, perché una disponibilità limitata di Fable non giustifica da sola l’abbonamento. Per gli sviluppatori, il modello è generalmente disponibile tramite Claude API e attraverso i marketplace cloud elencati sopra. Questa modalità non prevede un livello gratuito, quindi il piccolo credito che Anthropic assegna alla registrazione è tutto ciò che puoi utilizzare prima che inizi la fatturazione a consumo.
La disponibilità in un piano non significa che l’uso sia incluso senza limiti. Inoltre, un abbonamento non viene conteggiato nello stesso modo dell’API, perché una postazione Pro non ha alcuna quota di token pubblicata e misura invece l’utilizzo in messaggi su una finestra temporale mobile. Di conseguenza, nessun piano può essere convertito facilmente nei valori per milione di token riportati sopra. La tabella comparativa dei piani nella pagina dei prezzi di Anthropic limita Fable a una parte dei limiti di utilizzo settimanali per alcune postazioni e lo vincola ai crediti di utilizzo per altre. Questa configurazione è cambiata più volte nel corso di luglio 2026. Nella comunicazione di Anthropic sulla nuova disponibilità di Fable 5, il modello era incluso fino al 50% dei limiti di utilizzo settimanali fino al 7 luglio 2026 per i piani Pro, Max, Team e alcuni piani Enterprise, con crediti di utilizzo dopo quella data. Le informazioni pubblicate nel resto di luglio hanno descritto ulteriori proroghe e una distinzione tra i tipi di postazione.
Per questo motivo, questa pagina non riporta un limite per piano. Nessun valore pubblicato durante quel mese è rimasto valido per due settimane, e un numero non aggiornato sarebbe peggiore dell’assenza di indicazioni. Apri la riga Fable nella tabella comparativa dei piani il giorno in cui decidi e considera non aggiornato qualsiasi valore riportato in un articolo di news. Se acquisti una postazione per accedere a Fable e la disponibilità risulta inferiore a quella prevista dalla tabella, tornare al piano precedente prima del rinnovo successivo mantiene intatto il mese che hai già pagato.
La tariffa API è invece stabile. In qualsiasi modalità, una volta esaurita la disponibilità inclusa, l’utilizzo aggiuntivo di Fable 5 viene fatturato ai prezzi riportati nel grafico sopra. Enterprise rende esplicita questa struttura, perché il costo della postazione Enterprise acquista l’accesso, mentre i token continuano a essere conteggiati alle tariffe API separatamente. In entrambi i casi, il listino è quindi il valore da usare per la pianificazione. È la stessa conclusione a cui arrivi confrontando la fatturazione API con un abbonamento per qualsiasi altro modello Claude. Se non hai ancora scelto un livello, parti da quale piano Claude corrisponde al tuo utilizzo. Se la postazione sarebbe anche il tuo assistente quotidiano, invece di servire soltanto per accedere a Fable, conviene verificare come si confrontano i prezzi dei piani Claude con quelli di ChatGPT prima di procedere.
Perché la fattura è più alta di quanto suggerisca il rapporto tra i prezzi
Due meccanismi documentati fanno costare Fable 5 più di quanto lasci intendere un semplice confronto dei prezzi.
Il primo è il tokenizer. Fable 5 usa il tokenizer introdotto con Claude Opus 4.7. Rispetto ai modelli rilasciati prima di Opus 4.7, lo stesso testo produce circa il 30% di token in più; l'aumento esatto dipende dal contenuto. Haiku 4.5 è precedente a quel tokenizer, quindi il divario di dieci volte indicato nel listino è più vicino a tredici volte quando si fornisce a entrambi i modelli lo stesso blocco di testo. Sonnet 5 usa il tokenizer più recente, quindi il confronto tra Fable e Sonnet è corretto a livello di costo per token. Il confronto tra Fable e Haiku non lo è.
Il secondo è il thinking. Il thinking adattivo è sempre attivo per Fable 5 e thinking: {"type": "disabled"} non è supportato. I token di thinking vengono fatturati come token di output, alla tariffa completa dell'output. Il chain of thought grezzo non viene mai restituito da questo modello e thinking.display ha come valore predefinito "omitted"; di conseguenza, una risposta visibile breve può comportare un numero elevato di token di output fatturati. La documentazione di Anthropic lo afferma chiaramente: il numero di token di output fatturati non corrisponde al numero di token visibili nella risposta.
Consultare il dettaglio invece di fare supposizioni. Il campo usage.output_tokens_details.thinking_tokens indica quanti token di output fatturati sono stati usati per il ragionamento:
{
"usage": {
"input_tokens": 25,
"output_tokens": 348,
"output_tokens_details": {
"thinking_tokens": 312
}
}
}Nell'esempio, tratto dalla documentazione di Anthropic sul thinking, 312 dei 348 token di output fatturati erano token di ragionamento che nessuno ha mai visto. Durante lo streaming, questo dettaglio arriva soltanto nell'evento finale message_delta; un client che smette di leggere all'ultimo blocco di testo non lo registrerà mai.
Il controllo è effort, impostato su output_config.effort, con i livelli low, medium, high (il valore predefinito), xhigh e max.
{
"model": "claude-fable-5",
"max_tokens": 32000,
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "..." }]
}Le indicazioni di Anthropic per questo modello sono di iniziare da high, passare a xhigh soltanto per le attività in cui le capacità sono più importanti e scendere a medium o low per le attività di routine, perché su Fable 5 un effort inferiore spesso supera xhigh dei modelli precedenti. Questo comporta due rischi. Cambiare l'effort tra una richiesta e l'altra invalida la cache del prompt, perché il valore di effort risolto viene inserito nel prompt. Occorre quindi scegliere un livello per ogni carico di lavoro e mantenerlo costante. Inoltre, max_tokens è un limite rigido sull'output totale, che comprende thinking e testo della risposta. Un limite dimensionato per una risposta senza thinking può quindi troncare l'output. La presenza di stop_reason: "max_tokens" indica che è necessario aumentare il limite oppure ridurre l'effort.
Costo per attività completata, non costo per token
The data behind this chart
[
{
"label": "Short answer (5k in, 1k out)",
"fable_5": "0.10",
"opus_5": "0.05",
"sonnet_5": "0.02",
"haiku_4_5": "0.01"
},
{
"label": "Coding session (300k in, 40k out)",
"fable_5": "5.00",
"opus_5": "2.50",
"sonnet_5": "1.00",
"haiku_4_5": "0.50"
},
{
"label": "Long agent run (2M in, 400k out)",
"fable_5": "40.00",
"opus_5": "20.00",
"sonnet_5": "8.00",
"haiku_4_5": "4.00"
}
]Le righe 3 contengono calcoli aritmetici, non un benchmark. Le tariffe sono pubblicate. I volumi di token sono ipotesi che dovresti sostituire con i dati del tuo utilizzo. Una sessione di sviluppo con caratteristiche simili a quelle della riga centrale costa $5.00 su Fable 5, contro $1.00 su Sonnet 5. L'esecuzione lunga costa $40.00 contro $8.00. Il valore della colonna Haiku nell'ultima riga è soltanto aritmetico: Haiku 4.5 ha una finestra di contesto di 200k token, quindi non può contenere affatto quel lavoro.
Il costo per token è l'unità di misura sbagliata per prendere una decisione. Il costo per attività completata è il costo per tentativo moltiplicato per il numero di tentativi. Alle tariffe odierne, un tentativo con Fable 5 costa quanto cinque tentativi con Sonnet 5; quindi il solo numero di ritentativi giustifica quasi mai l'upgrade. Sonnet dovrebbe fallire più di quattro volte su cinque prima che il percorso più economico risulti sfavorevole in termini di token.
A giustificare la scelta sono invece tutti gli elementi che la fattura dei token non include. Nella maggior parte dei mercati, la differenza tra le due esecuzioni lunghe nel grafico è inferiore al costo di un'ora di lavoro di un tecnico. Se il modello più costoso fa risparmiare un'ora di revisione o evita una migrazione errata che dovresti poi correggere, si è già ripagato, anche se la fattura non mostra questo risparmio. Confronta i costi in denaro per risultato accettato e includi nel totale anche il tuo tempo. Capire cosa si ottiene realmente con un milione di token rende questa stima molto meno astratta.
Tre attività per cui Claude Fable 5 giustifica il prezzo
Esecuzioni agentiche di lunga durata, nelle quali una scelta errata è costosa. Fable 5 è progettato per attività misurate in ore: una finestra di contesto da 1M di token, fino a 128k token di output per richiesta e un livello di impegno xhigh pensato per attività che durano più di trenta minuti e usano budget di token nell’ordine dei milioni. Confronta il costo dell’esecuzione con il lavoro di ripristino necessario dopo che un agente ha seguito un ramo errato al passaggio 40, senza che nessuno se ne accorgesse fino al passaggio 300.
Una migrazione o un audit eseguito una sola volta su una codebase di grandi dimensioni. Un’attività una tantum non consente di distribuire il costo su un volume elevato, quindi il sovrapprezzo per token ricade su un’unica fattura e l’intero lavoro potrebbe rientrare in una sola finestra di contesto. Se può essere eseguita in modo asincrono, la Batch API dimezza il costo a $25 per ogni milione di token di output.
Un’attività per cui un modello meno costoso ha già fallito due volte. Due tentativi falliti, oltre al tempo dedicato al debugging, costano più di un tentativo con Fable ai volumi indicati nel grafico sopra. Passare a un modello di livello superiore è la scelta meno costosa: è questo lo scopo di una model ladder. Se stai ancora scegliendo tra i diversi livelli in generale, il confronto delle funzionalità tra i livelli dei modelli Claude risponde a una domanda diversa da quella trattata in questa pagina.
Tre attività in cui Sonnet 5 o Haiku 4.5 sono la scelta corretta
Classificazione ed estrazione ad alto volume. Queste attività vengono valutate in base alla velocità di elaborazione e al costo unitario, mentre il livello qualitativo richiesto è abbastanza basso da poter essere raggiunto da un modello economico. Se Haiku 4.5 completa correttamente un'attività, pagare dieci volte tanto per Fable 5 non produce alcun vantaggio misurabile.
Attività interattive in cui la latenza è parte essenziale del prodotto. La tabella dei modelli di Anthropic indica che la latenza relativa di Fable 5 è maggiore e il ragionamento non può essere disattivato. Una casella di chat o il completamento in un editor risultano meno reattivi con il modello più potente, perché gli utenti percepiscono l'attesa prima della qualità.
Qualsiasi attività che dipenda da eventi successivi a January 2026. La data limite affidabile delle conoscenze di Fable 5 è January 2026. Per Opus 5 è May 2026. Il modello più costoso è quello meno aggiornato. Per le domande sulla recenza si paga quindi il doppio per informazioni più vecchie, a meno di non fornirgli strumenti di ricerca o recupero.
Un vincolo non riguarda direttamente i costi. Fable 5 conserva i dati per 30 day e non è disponibile con zero data retention, perché è classificato come Covered Model. Se il contratto richiede zero retention, Fable 5 non è un'opzione a nessun prezzo e nessuno sconto può modificare questa condizione.
Cosa mostrano i repository del metodo fable e cosa non mostrano
Alcuni professionisti hanno pubblicato repository che sintetizzano il funzionamento degli approcci Fable in competenze che un modello meno costoso può seguire. Il repository fable-method descrive una competenza di ragionamento, un ciclo di orchestrazione e un verificatore avversariale che ripete ogni controllo dichiarato invece di leggere il report prodotto dall'agente. Il README lo dichiara esplicitamente: "Questa è una sintesi della community, non un prodotto di Anthropic."
Consideratelo esattamente per quello che è. È una prova di come le persone guidano il modello, non una documentazione del suo funzionamento. Nulla al suo interno è stato validato da Anthropic e ne esistono diverse fork quasi identiche con formulazioni differenti. Questo è ciò che ci si aspetterebbe da una tradizione informale, non da una specifica.
Il dato utile per una decisione sui costi è che le parti che le persone hanno ritenuto opportuno copiare sono procedurali. Classificate l'attività, indicate il controllo che dimostra che è conclusa, raccogliete le prove prima di decidere, quindi verificate tramite osservazione invece di leggere un riepilogo. Un modello meno costoso a cui viene fornita una checklist esplicita e un passaggio di verifica può colmare una parte del divario. Eseguite quindi questo esperimento sul vostro set di valutazione prima di standardizzare l'uso del modello più costoso. Il risultato dipende dalle vostre attività. Per questo, il numero ottenuto da altri ha per voi un valore limitato.
Verifica i tuoi numeri prima di impegnare il budget
- Leggi
usagein ogni risposta e registraoutput_tokens_details.thinking_tokensseparatamente dall'output visibile. Il ragionamento che non vedi è la voce di costo che riserva più sorprese. - Imposta esplicitamente
effortinvece di accettare il valore predefinito e mantienilo costante all'interno delle conversazioni che si basano sul prompt caching. - Posiziona prima il prefisso stabile dietro un punto di interruzione della cache. Una lettura dalla cache a un decimo del prezzo dell'input di base consente di risparmiare più della maggior parte dei downgrade del modello.
- Sposta nella Batch API tutto ciò che non richiede una risposta immediata.
- Valuta onestamente l'alternativa. Confrontare i prezzi delle API di Claude e ChatGPT sul tuo carico di lavoro vale un pomeriggio di lavoro prima di assumere un impegno a lungo termine.
Se il carico di lavoro consiste in un agent eseguito sul tuo server, i controlli più importanti sono esterni alla scelta del modello. Tenere sotto controllo i costi degli agent su un VPS illustra i limiti del ciclo e i massimali di spesa che impediscono a una sessione fuori controllo di generare costi eccessivi, mentre dove Claude Code utilizza effettivamente i token spiega i numeri che vedrai nel dashboard di utilizzo.
FAQ
Quanto costa Claude Fable 5 per milione di token?
Claude Fable 5 è disponibile a $10 per milione di token di input e $50 per milione di token di output sulla Claude API, secondo i prezzi verificati nella pagina dei prezzi di Anthropic il 3 agosto 2026. La lettura dalla cache costa $1 per milione di token, cioè un decimo della tariffa base per l'input. La Batch API applica uno sconto del 50% a entrambe le componenti, con un costo di $5 e $25 per milione di token per i processi asincroni. Mantenere l'inferenza negli Stati Uniti tramite il parametro inference_geo aggiunge un moltiplicatore di 1.1 a ogni categoria.
Claude Fable 5 è incluso in un abbonamento Claude Pro?
La pagina di Anthropic dedicata a Claude Fable indica il modello come disponibile per gli utenti Pro, Max, Team ed Enterprise e non menziona il piano gratuito. L'accesso incluso non è illimitato. Alcuni account ricevono Fable come quota dei limiti di utilizzo settimanali, mentre altri lo utilizzano tramite crediti, e questa modalità è cambiata più di una volta nel corso di luglio 2026. Consulta la riga denominata Fable nella tabella di confronto dei piani sulla pagina dei prezzi di Anthropic il giorno in cui prendi la decisione, invece di affidarti a un valore riportato in un articolo. Una volta esaurita la quota inclusa, l'utilizzo aggiuntivo viene addebitato alla tariffa API.
Perché la fattura di Claude Fable 5 è più alta di quanto suggerisca l'output visibile?
Il ragionamento adattivo è sempre attivo in Claude Fable 5; i token di ragionamento vengono fatturati come token di output e la catena di pensiero grezza non viene mai restituita. Con thinking.display impostato sul valore predefinito omitted, vedi un campo di ragionamento vuoto, ma paghi ogni token utilizzato per il ragionamento sottostante. Leggi usage.output_tokens_details.thinking_tokens nella risposta per vedere la suddivisione e considera che, durante lo streaming, questo campo arriva soltanto nell'evento message_delta finale. Riduci il livello effort se il rapporto tra ragionamento e risposta è superiore a quanto richiede l'attività.
Devo usare Claude Fable 5 o Claude Opus 5?
Claude Opus 5 costa la metà per token e ha un cutoff di conoscenza affidabile più recente: maggio 2026 rispetto a gennaio 2026 per Fable 5. Inizia con Opus 5 e passa a Fable quando un'attività non riesce con il primo modello o quando una risposta errata costerebbe più della differenza di prezzo. Fable 5 è la scelta corretta per il lavoro agentico su orizzonti temporali lunghi, in cui un ramo errato richiede ore di pulizia, e per i processi una tantum il cui sovrapprezzo viene addebitato su una sola fattura invece che su ogni richiesta a tempo indefinito.