Limite strumenti Claude: cosa significa e come continuare
L’errore indica che Claude ha esaurito le chiamate agli strumenti del turno, non la quota del piano. Scopri come continuare senza perdere il lavoro già svolto.
Cosa significa il limite di utilizzo degli strumenti per questo turno
Un limite di utilizzo degli strumenti per questo turno significa che Claude si è fermato a metà di una risposta perché ha esaurito le chiamate agli strumenti disponibili per quella risposta, non perché il tuo account abbia esaurito l'utilizzo. Tutto ciò che aveva trovato prima di fermarsi è ancora presente nella conversazione. Invia un altro messaggio chiedendo di continuare: si aprirà un nuovo turno con un nuovo budget.
Un turno è un ciclo completo all'interno di un loop dell'agente. Claude produce un output contenente chiamate agli strumenti, il client esegue tali strumenti e i risultati vengono restituiti a Claude per la decisione successiva. Il ciclo si ripete senza restituire il controllo all'utente. Il turno termina quando Claude produce una risposta senza chiamate agli strumenti. Un limite sul turno stabilisce quante di queste interazioni può contenere una singola risposta.
Il limite di utilizzo del piano è un controllo separato
Il limite del piano conteggia ciò che hai utilizzato in un determinato intervallo di tempo. La pagina del centro assistenza di Anthropic relativa ai messaggi di errore, consultata il 18 agosto 2026, indica il primo messaggio come Approaching 5-hour limit. quando ti stai avvicinando al limite e 5-hour limit reached - resets [time]. dopo averlo superato. Il messaggio specifica un orario. Attendere fino a quell'orario risolve il problema; nel frattempo, ciò che digiti non produce alcun effetto.
Il messaggio relativo all'utilizzo dello strumento funziona invece in modo opposto. Compare durante un'attività e un singolo messaggio successivo consente di continuare immediatamente il lavoro. La quota residua non viene modificata. Questo è il test da eseguire: se attendere non risolve il problema e continuare consente di procedere, non avevi ancora raggiunto la quota. Per il caso della quota, cosa fare quando Claude indica che il limite è stato raggiunto elenca le opzioni, mentre come vengono conteggiati i limiti di utilizzo di Claude spiega gli intervalli alla base del conteggio.
Perché esiste un budget di strumenti per ogni turno
Ogni chiamata a uno strumento consuma contesto. La chiamata viene eseguita, lo strumento elabora la richiesta e l’intero risultato viene reinserito nella conversazione. La lettura di un file di grandi dimensioni o l’esecuzione di un comando con un output molto esteso può consumare migliaia di token in un singolo passaggio, e il testo resta nel contesto per il resto della sessione. La documentazione del ciclo degli agenti di Anthropic espone chiaramente la conseguenza: il contesto si accumula tra i turni, quindi una sessione con molte chiamate agli strumenti contiene molto più testo di una sessione breve.
Il budget per turno interrompe un ciclo che non sta più facendo progressi. Un agente che esegue una ricerca, legge i risultati, cerca di nuovo e continua a non trovare nulla proseguirà fino a quando qualcosa non lo interrompe. Il budget svolge questa funzione. Ti restituisce il controllo in un punto in cui puoi riorientare il lavoro, con un costo molto inferiore rispetto a lasciare che il ciclo prosegua fino a esaurire la finestra di contesto.
Dove questo limite è visibile nell'API
La documentazione pubblica degli errori di Anthropic non indica un numero di chiamate agli strumenti per turno per l'app di chat Claude. Pertanto, qualsiasi valore esatto letto in merito è soltanto un'ipotesi. Per l'API (application programming interface) è documentato un limite dello stesso tipo, ed è nella documentazione dell'API che il comportamento effettivo risulta visibile.
Il campo stop_reason in una risposta della Messages API indica il motivo per cui la generazione si è interrotta. I valori documentati sono end_turn, max_tokens, stop_sequence, tool_use, pause_turn, refusal e model_context_window_exceeded. Due di questi descrivono la situazione trattata in questa guida.
pause_turn viene restituito quando il ciclo di campionamento lato server raggiunge il limite di iterazioni durante l'esecuzione di strumenti lato server, come la ricerca web. Al 18 August 2026, la pagina sui motivi di interruzione indica come valore predefinito 10 iterazioni per richiesta. La correzione documentata consiste nel reinviare la risposta senza modificarla come messaggio dell'assistant, in modo che Claude riprenda dal punto in cui si era fermato. Questa è la versione API dell'inserimento di "continue" in una finestra di chat.
max_tokens indica che la risposta ha raggiunto il limite di token di output impostato nella richiesta. Se la risposta viene troncata all'interno di un blocco di utilizzo di uno strumento non completo, la chiamata allo strumento non può essere eseguita. La soluzione documentata consiste nel ripetere la richiesta con un valore max_tokens più alto.
Leggere i valori correnti nella pagina sui motivi di interruzione, invece di affidarsi a quelli riportati qui. I valori predefiniti indicati in quella pagina possono cambiare, e un numero non aggiornato è peggio di nessun numero.
Cosa esaurisce le chiamate agli strumenti in una chat
- Una domanda senza un punto di arresto naturale. «Trova tutto ciò che è stato scritto su X» non fornisce al modello alcuna indicazione per capire quando la ricerca è terminata.
- La lettura ripetuta dello stesso materiale, perché la risposta non si trova nel punto in cui il modello si aspettava di trovarla.
- Risultati molto estesi degli strumenti. Una pagina web lunga o un file di grandi dimensioni occupano lo spazio necessario per il resto del turno.
- Più attività indipendenti nello stesso messaggio. Ogni attività richiede le proprie chiamate agli strumenti, che vengono tutte conteggiate nello stesso budget.
- Connettori e server MCP (model context protocol) che non servono per questa attività. Le relative definizioni degli strumenti vengono caricate nella richiesta e offrono al modello più possibilità di consumare il budget del turno.
Come portare a termine la risposta
Rispondi con "continue" oppure, meglio ancora, con una breve istruzione che indichi ciò che manca. Si apre così un nuovo turno con un nuovo budget. La conversazione precedente resta nel contesto, quindi Claude riprende il lavoro senza ripetere le chiamate agli strumenti già eseguite.
Se si blocca due volte nello stesso punto, l'attività è troppo ampia per un solo turno. Suddividila. Invece di chiedere un audit completo di un repository, chiedi prima l'elenco dei file, quindi chiedi di analizzare un file per messaggio. Quattro turni brevi completano un'attività che un unico turno esteso non riuscirebbe a portare a termine.
Limita ciò che il modello deve cercare. Indica il percorso esatto del file oppure la stringa di errore esatta e, se lo hai già, incolla il log. Incollare un log costa un messaggio. Chiedere al modello di trovare quel log richiede diverse chiamate agli strumenti e potrebbe fargli individuare quello sbagliato.
Disattiva i connettori che al momento non ti servono. Ogni strumento connesso aggiunge la propria definizione a ogni richiesta, consumando contesto e ampliando l'insieme delle azioni che il modello può scegliere. Lo stesso principio vale per una lunga sessione di programmazione, in cui mantenere ridotto il contesto di una sessione di Claude Code fa la differenza tra un agente che completa il lavoro e uno che si interrompe a metà.
Imposta autonomamente il budget dei turni quando esegui un agent
Se utilizzi Claude dal tuo codice, il budget per turno è un'impostazione sotto il tuo controllo. Il Claude Agent SDK (kit di sviluppo software) espone max_turns in Python e maxTurns in TypeScript; la documentazione li definisce come il numero massimo di cicli di andata e ritorno per l'utilizzo degli strumenti. Per impostazione predefinita, non è previsto alcun limite.
Quando viene raggiunto questo limite, l'SDK restituisce un risultato in cui subtype è error_max_turns, mentre una chiamata singola query() genera un errore contenente il testo Reached maximum number of turns. Il risultato contiene comunque num_turns e session_id, quindi puoi riprendere la stessa sessione con un limite più alto invece di riavviare l'attività.
Dalla CLI (interfaccia a riga di comando), lo stesso controllo è un flag e si applica soltanto alla modalità print:
claude -p --max-turns 3 "summarise the failing tests"Il riferimento dei flag indica che, quando viene raggiunto il limite, il comando termina con un errore e che per impostazione predefinita non esiste alcun limite. Esiste anche una variante basata sui costi: max_budget_usd in Python e maxBudgetUsd in TypeScript interrompono il ciclo al superamento di una soglia di spesa anziché dopo un determinato numero di turni; la spesa dei subagent contribuisce al totale. Se esegui agent su un server per cui paghi un canone mensile, vale la pena configurare il controllo dei costi di un agent AI su un VPS prima del primo avvio prolungato.
Una pausa in attesa di approvazione è un caso diverso. Se l'agent si arresta e non viene sostenuta alcuna spesa, consulta permission_mode invece del conteggio dei turni, perché uno strumento è in attesa di una risposta dell'utente che non arriva. La modalità automatica e le impostazioni delle autorizzazioni di Claude Code spiega quali modalità richiedono conferma e quali procedono senza richiederla.
Come verificare autonomamente il comportamento attuale
Il comportamento può cambiare senza preavviso. Considerate quindi tutti i numeri di questa guida come riferimenti datati, non come valori fissi. Due fonti mostrano la situazione attuale.
- La documentazione API sui motivi di arresto, che indica il valore predefinito dell'iterazione dello strumento server e il modo per proseguire oltre tale limite.
- La pagina del centro assistenza di Anthropic sui messaggi di errore, che riporta la formulazione relativa ai limiti di utilizzo. Verificata il 18 agosto 2026, la pagina documenta i messaggi relativi all'utilizzo su cinque ore e su base settimanale, ma non menziona alcun limite degli strumenti per singolo turno. Per questo motivo, qui non viene indicato alcun valore ufficiale per l'app di chat.
Misurate invece le vostre esecuzioni. In Claude Code, /context visualizza l'utilizzo attuale del contesto con una griglia colorata e indica gli strumenti che ne consumano la maggior parte; /compact riassume la conversazione fino a quel momento per liberare spazio. Nell'Agent SDK, ogni risultato contiene num_turns. Potete così verificare quanti passaggi di andata e ritorno richiede realmente un'attività tipica prima di scegliere un limite. Un valore ricavato dal vostro carico di lavoro è più utile di quello riportato in un post su un forum.
FAQ
Il limite di utilizzo degli strumenti è uguale al mio limite di utilizzo di Claude?
No. Il limite di utilizzo conteggia quanto hai consumato durante un intervallo di tempo e indica quando viene ripristinato, quindi la soluzione consiste nell'attendere. Il messaggio relativo all'utilizzo degli strumenti interrompe la risposta a metà perché quella risposta ha esaurito le chiamate agli strumenti consentite. L'invio di un altro messaggio avvia subito un nuovo turno con un nuovo budget. Se la continuazione funziona immediatamente, il problema non era la quota. come viene conteggiato il limite di utilizzo di Claude descrive in dettaglio il caso della quota.
Come posso fare in modo che Claude completi un'attività che ha interrotto a metà?
Invia un altro messaggio. "Continue" funziona, ma un'istruzione che specifichi ciò che manca funziona meglio, perché evita che il modello ricostruisca il contesto che già possiede. Se si interrompe di nuovo nello stesso punto, suddividi l'attività in parti più piccole e invia una parte per messaggio. Specificare i percorsi esatti dei file o incollare direttamente il contenuto elimina la ricerca che aveva consumato il budget iniziale.
Che cosa significa "límite de uso de herramientas" o "limite de uso de ferramentas"?
Sono le versioni in spagnolo e portoghese dello stesso messaggio, che di solito appare come "límite de uso de herramientas en este turno" o "limite de uso de ferramentas neste turno". Il significato è identico in tutte le lingue: Claude ha esaurito le chiamate agli strumenti consentite all'interno di una singola risposta e la quota del tuo piano non è coinvolta. Anche la soluzione è la stessa. Rispondi chiedendo di continuare oppure suddividi la richiesta in passaggi più piccoli. Il limite di fatturazione è indicato in un messaggio separato, che specifica l'orario del ripristino.
L'upgrade del piano aumenta il limite di utilizzo degli strumenti per un turno?
Il livello del piano e il budget degli strumenti per singolo turno sono controlli distinti. L'upgrade aumenta la quantità di utilizzo consentita durante un intervallo di tempo, cioè il limite che indica l'orario del ripristino. Il numero di chiamate agli strumenti che una singola risposta può effettuare dipende dal ciclo che esegue il modello e Anthropic non pubblica questo valore per l'app di chat. Suddividere l'attività in turni più piccoli è ciò che aiuta realmente, indipendentemente dal piano.
Perché il mio agent si interrompe dopo poche chiamate agli strumenti?
Verifica di non avere impostato un limite. Claude Agent SDK usa max_turns in Python e maxTurns in TypeScript. L'interfaccia a riga di comando usa --max-turns in modalità print. Quando viene raggiunto uno di questi limiti, SDK restituisce un risultato con un subtype di error_max_turns e un errore contenente il testo Reached maximum number of turns. Per impostazione predefinita, in entrambi i casi non è previsto alcun limite. Se non è impostato alcun limite e l'esecuzione si interrompe comunque, controlla stop_reason nel risultato: max_tokens indica che è stato raggiunto il limite di output, mentre pause_turn indica che il ciclo degli strumenti sul server ha raggiunto il limite di iterazioni e richiede l'invio della risposta per poter continuare.