SSD Nodes Learn 🎉 VPS da $5.50/mese
Guide Matt ConnorDi Matt Connor · Aggiornato 2026-08-13

Claude API ha un piano gratuito? Costi e crediti

Claude API non ha un piano gratuito: include solo un piccolo credito iniziale. Scopri cosa resta gratis, le tariffe di luglio 2026 e il costo di una prima app.

L'API di Claude ha un piano gratuito?

L'API di Claude non offre un piano gratuito. Non esiste una quota mensile di token gratuiti né un piano con costo pari a $0. Un nuovo account riceve una piccola quantità di crediti gratuiti per testare l'API, ma Anthropic non ne pubblica l'importo. Una volta esauriti questi crediti, ogni richiesta utilizza un saldo prepagato.

Questa è la risposta diretta. Il resto della guida spiega cosa comporta: quali componenti della piattaforma non hanno alcun costo, perché questa è una questione diversa dal piano gratuito delle app Claude e qual è il modo più economico, senza costi nascosti, per far funzionare il primo programma.

Cosa è gratuito in un account Claude API

Alcune funzionalità della piattaforma non comportano costi in token. Sono più importanti di quanto possa sembrare.

  • Conteggio dei token. L'endpoint per il conteggio dei token è gratuito. Ha un proprio limite di richieste al minuto, separato dalla creazione dei messaggi. Misurare un prompt non riduce quindi il budget disponibile per inviarlo.
  • La Console. La creazione di un'organizzazione, la consultazione della pagina dei consumi e l'apertura di Workbench sono gratuite. L'esecuzione di un prompt in Workbench è una normale richiesta API. I token vengono quindi addebitati come per qualsiasi altra chiamata.
  • Operazioni sui file. Il caricamento, l'elenco e l'eliminazione dei file tramite Files API sono gratuiti. Si paga soltanto quando il contenuto di un file viene incluso in una richiesta come token di input.
  • Recupero dal Web. Lo strumento di recupero dal Web non comporta costi aggiuntivi oltre ai token dei contenuti che importa nella conversazione. La ricerca sul Web non è gratuita: a luglio 2026 costa $10 per 1,000 ricerche.
  • Esecuzione del codice, entro certi limiti. A luglio 2026 ogni organizzazione riceve 1,550 ore gratuite di container al mese. In seguito il costo è di $0.05 all'ora per container. L'esecuzione del codice non comporta costi aggiuntivi quando viene eseguita insieme alla ricerca sul Web o al recupero dal Web.

Niente di tutto questo costituisce un piano gratuito. Significa che la misurazione dei consumi è trasparente: si paga l'inferenza, non i componenti di supporto che la rendono possibile.

Calcola il costo prima di pagare

Poiché il conteggio è gratuito, puoi conoscere prima la dimensione esatta di una richiesta. Questo è lo stesso endpoint utilizzato dagli SDK e accetta lo stesso body di un messaggio reale.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "content-type: application/json" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-haiku-4-5",
    "system": "You are a scientist",
    "messages": [{"role": "user", "content": "Hello, Claude"}]
  }'

Una risposta corretta è una sola riga JSON: {"input_tokens": 14}. Moltiplica questo valore per la tariffa di input del tuo modello per conoscere il costo della richiesta prima di inviarla. Se ricevi HTTP 401 con authentication_error, la chiave è errata o è stata revocata. Il conteggio funziona anche con un account senza credito residuo, perché non viene generato alcun contenuto.

Perché questa è una domanda diversa dal piano gratuito delle app

Molti cercano informazioni su entrambe le opzioni, ma hanno quasi nulla in comune. Il piano gratuito delle app Claude è un prodotto completo che si può usare a lungo senza carta di pagamento; il consumo viene calcolato su una finestra mobile e cosa include realmente il piano gratuito di Claude descrive cosa comprende e quando si reimposta. L'API usa invece una contabilizzazione prepagata e non prevede un piano equivalente.

La conseguenza che causa più confusione è che un abbonamento e una chiave API sono portafogli separati. Pagare Pro non finanzia una chiave e i crediti API non aumentano il limite di utilizzo della chat. Se stai scegliendo tra le due opzioni, invece di cercare semplicemente di non pagare, costo dell'API Claude rispetto a un abbonamento analizza i costi su carichi di lavoro reali. L'eccezione è Claude Enterprise, che riunisce nella stessa fattura un prezzo per postazione e il consumo di token calcolato alle tariffe API; come funziona il prezzo delle postazioni Enterprise spiega cosa include il costo minimo della postazione prima dell'inizio della contabilizzazione a consumo.

Cosa costa una richiesta una volta esauriti i crediti

Queste sono le tariffe delle API di prima parte aggiornate a luglio 2026, per milione di token.

ChartClaude API rates per million tokens, July 2026
The data behind this chart
[
  {
    "label": "Haiku 4.5",
    "input_usd": 1,
    "output_usd": 5
  },
  {
    "label": "Sonnet 5, intro rate",
    "input_usd": 2,
    "output_usd": 10
  },
  {
    "label": "Opus 5",
    "input_usd": 5,
    "output_usd": 25
  }
]

Haiku 4.5 addebita 1 dollari per milione di token di input e 5 dollari per milione di token di output. Opus 5 addebita 5 e 25 per gli stessi volumi, quindi il modello scelto può moltiplicare per 5 il costo prima ancora di ottimizzare il prompt. La tariffa di Sonnet 5 è promozionale e resta valida fino al 31 agosto 2026, dopodiché tornerà a $3 e $15. Per tutti i modelli, l'output costa cinque volte più dell'input. Questo è il dato più utile di questa pagina: una risposta prolissa costa più di una domanda lunga. quale modello Claude usare li confronta con un esempio pratico. Fable 5 ha una tariffa superiore a quella di tutti e tre: $10 per milione di token di input e $50 per milione di token di output. Perciò conviene chiarire che cosa acquistano realmente queste tariffe prima di assegnargli attività ordinarie.

I percorsi più economici per fare prove

Quattro leve coprono quasi tutte le esigenze e nessuna richiede uno sconto.

  • Inizia con il modello più piccolo che supera il test. Classificazione, estrazione, assegnazione di tag e instradamento raramente richiedono un modello all’avanguardia. Haiku 4.5 costa un quinto rispetto a Opus 5 e risponde più velocemente.
  • Imposta un limite a max_tokens. È il limite massimo rigido per i token generati, e l’output è la parte più costosa. Un classificatore che risponde con una parola non dovrebbe avere un budget di 16,000 token.
  • Memorizza nella cache la parte del prompt che non cambia mai. Una lettura dalla cache costa il 10% del prezzo di base dell’input, mentre una scrittura nella cache con durata di cinque minuti costa 1.25x. La cache si ripaga quindi dopo una sola lettura. Il caching usa una corrispondenza sul prefisso: il testo stabile deve comparire prima e la domanda variabile per ultima. In caso contrario non viene trovata alcuna corrispondenza e si paga inutilmente il sovrapprezzo di scrittura.
  • Usa l’elaborazione in batch per tutto ciò che non è interattivo. La Message Batches API applica uno sconto del 50% sia sull’input sia sull’output e la maggior parte dei batch termina entro un’ora. I job notturni, i backfill e le esecuzioni di valutazione devono usare questa modalità.

Un esempio di costo per una prima applicazione di piccole dimensioni

Consideriamo uno script per il riepilogo dei log: 1,000 chiamate, ognuna con circa 800 token di input contenenti righe di log e circa 200 token di output contenenti il riepilogo. In totale sono 800,000 token di input e 200,000 token di output con Haiku 4.5.

Chart1,000 calls at 800 input and 200 output tokens, Haiku 4.5
The data behind this chart
[
  {
    "label": "Standard rates",
    "cost_usd": "1.80"
  },
  {
    "label": "Same job on the Batch API",
    "cost_usd": "0.90"
  }
]

Il calcolo è 0.8 milioni di token di input a $1 più 0.2 milioni di token di output a $5, per un totale di 1.80 dollari. Inviato invece come batch, lo stesso lavoro costa 0.90. Un credito iniziale consente di eseguire molti test a questa scala; per questo l'assenza di un piano gratuito si fa sentire molto più tardi di quanto ci si aspetti. Per la procedura completa su un server di tua proprietà, creazione di una prima applicazione Claude API su un VPS illustra la gestione delle chiavi, lo streaming e i percorsi di errore.

I livelli di utilizzo sono limiti massimi, non importi disponibili

L'API assegna automaticamente ogni organizzazione a un livello di utilizzo, in base alla cronologia d'uso e allo stato dell'account. I livelli sono Start, Build, Scale e Custom; ciascuno definisce limiti di frequenza e un tetto di spesa mensile. A luglio 2026 i tetti sono $500 per Start, $1,000 per Build e $200,000 per Scale, mentre Custom non ha alcun tetto.

Consideratelo un limite, non un credito disponibile. Il livello Start non significa che avete $500 da spendere. Significa che non potete spendere più di $500 in un mese di calendario; raggiunto il limite, l'utilizzo viene sospeso fino al mese successivo. Potete anche impostare un limite di spesa personale inferiore al tetto del livello. Questa è la prima operazione da eseguire su qualsiasi account associato a una carta, perché un loop incontrollato è un modo molto più comune di perdere denaro rispetto al prezzo per token.

Cosa fare se la gratuità è un requisito imprescindibile

Se il budget è realmente pari a zero e deve rimanere tale, l'API non è lo strumento adatto e confrontare le fasce tariffarie non cambia il risultato. Restano due opzioni corrette. Usare il piano gratuito nelle app Claude per il lavoro interattivo, accettando che l'utilizzo sia limitato per finestra temporale e che non sia disponibile alcun endpoint programmabile. Oppure eseguire un modello open-weights su hardware noleggiato, sostituendo un costo per token con il costo di un server sotto il proprio controllo: eseguire Ollama su un VPS per eseguire autonomamente un LLM descrive la memoria richiesta da ogni dimensione del modello e le attività che i modelli più piccoli possono realmente svolgere. Se il vero limite è la finestra di utilizzo e non il denaro, Claude Pro a $20 al mese aumenta questo limite nelle app a un costo inferiore rispetto a molte prime fatture API, ma non offre comunque alcun metodo per effettuare chiamate dal codice. Se si confrontano provider diversi invece di piani della stessa offerta, piani Claude e ChatGPT a confronto dei prezzi mette a confronto i livelli gratuiti e a pagamento di entrambi, indicando anche quale risulta più economico per le attività di programmazione. Se una sottoscrizione già pagata rientra nelle spese che si stanno cercando di azzerare, annullare o ridurre quel piano consente di utilizzare il mese già acquistato e impedisce il rinnovo successivo.

Per qualsiasi situazione intermedia, la soluzione pratica è una chiave con fondi, un limite di spesa ridotto, un modello piccolo e il prompt caching attivato fin dal primo giorno.

FAQ

L'API Claude è gratuita?

No. Non esiste un piano gratuito né una disponibilità mensile di token senza costi. I nuovi account ricevono una piccola quantità di crediti gratuiti per testare l'API. In seguito, ogni richiesta utilizza il credito prepagato o la carta registrata. Alcune funzioni della piattaforma sono gratuite, tra cui il conteggio dei token, il caricamento e l'eliminazione dei file e lo strumento di recupero dei contenuti dal Web, esclusi i token dei contenuti recuperati.

Ricevo crediti gratuiti quando mi registro all'API Claude?

Sì, ma si tratta di una quantità ridotta e Anthropic non pubblica il valore esatto. Considerala sufficiente per verificare che l'integrazione funzioni, non come un budget su cui basare lo sviluppo. I crediti di prova estesi per le valutazioni aziendali vengono concordati tramite il reparto vendite di Anthropic e non sono assegnati automaticamente.

Il pagamento di Claude Pro o Max include l'accesso all'API?

No. Un abbonamento e una API key vengono fatturati separatamente e utilizzano sistemi di misurazione diversi. I piani Pro e Max aumentano la disponibilità nelle applicazioni Claude. Una API key utilizza crediti prepagati ed è soggetta a limiti al minuto per numero di richieste e quantità di token. Se ti servono entrambi, devi pagare entrambi.

Qual è il modo più economico per testare l'API Claude?

Conta prima i token, perché quell'endpoint è gratuito. Esegui quindi il test con Haiku 4.5 usando un max_tokens ridotto, memorizza nella cache il prompt di sistema fisso, così le chiamate ripetute vengono fatturate al 10% del prezzo dell'input, e invia tramite Batch API tutto ciò che non richiede interazione, a metà prezzo. Con queste impostazioni, a luglio 2026, mille chiamate di piccole dimensioni costano poco più di un dollaro.