Limite d’outils Claude atteinte pour ce tour : que faire ?
Le message indique que Claude a atteint la limite d’appels d’outils de ce tour, pas votre quota. Découvrez pourquoi et comment reprendre la tâche dans un nouveau tour.
Ce que signifie la limite d’utilisation des outils pour ce tour
Une limite d’utilisation des outils pour ce tour signifie que Claude s’est arrêté en cours de réponse parce que cette réponse avait atteint sa limite d’appels d’outils, et non parce que votre compte avait épuisé son quota. Tout ce qu’il a trouvé avant son arrêt reste dans la conversation. Envoyez un nouveau message pour lui demander de continuer : un nouveau tour démarrera avec un nouveau quota.
Un tour correspond à un aller-retour dans une boucle d’agent. Claude produit une réponse contenant des appels d’outils, le client exécute ces outils, puis les résultats sont renvoyés à Claude pour qu’il prenne la décision suivante. Le cycle se répète sans vous redonner le contrôle. Le tour se termine lorsque Claude produit une réponse qui ne contient aucun appel d’outil. La limite du tour correspond au nombre maximal d’allers-retours autorisés pour une même réponse.
La limite d’utilisation de votre forfait est un contrôle distinct
La limite du forfait comptabilise ce que vous avez utilisé pendant une période donnée. La page du centre d’aide d’Anthropic consacrée aux messages d’erreur, consultée le 18 août 2026, indique Approaching 5-hour limit. lorsque vous êtes sur le point de l’atteindre, puis 5-hour limit reached - resets [time]. une fois qu’elle est dépassée. Elle précise une heure. Attendre jusqu’à cette heure résout le problème ; rien de ce que vous saisissez entre-temps ne peut aider.
Le message concernant l’utilisation d’un outil se comporte à l’inverse. Il apparaît au milieu d’une tâche, et un seul message de suivi permet de poursuivre immédiatement le travail. Votre quota restant n’est pas modifié. C’est le test à effectuer : si attendre ne change rien et que poursuivre fonctionne, vous n’aviez pas atteint votre quota. Pour le cas du quota, que faire lorsque Claude indique que la limite est atteinte présente les options, et comment sont comptabilisées les limites d’utilisation de Claude explique les périodes correspondantes.
Pourquoi un tour dispose d’un budget d’outils
Chaque appel d’outil consomme du contexte. L’appel est envoyé, l’outil s’exécute, puis l’intégralité du résultat revient dans la conversation. La lecture d’un fichier volumineux ou l’exécution d’une commande produisant une sortie longue peut consommer des milliers de tokens en une seule étape, et ce texte reste dans le contexte pour le reste de la session. La documentation de la boucle d’agent d’Anthropic l’indique clairement : le contexte s’accumule au fil des tours, si bien qu’une session comportant de nombreux appels d’outils contient beaucoup plus d’informations qu’une session courte.
Le budget du tour permet d’arrêter une boucle qui ne progresse plus. Un agent qui effectue une recherche, lit des fichiers, recommence la recherche et ne trouve toujours rien continuera ainsi jusqu’à une interruption. Le budget constitue cette interruption. Il vous rend le contrôle à un moment où vous pouvez réorienter le travail, ce qui coûte beaucoup moins cher que de laisser la boucle remplir toute la fenêtre de contexte.
Où cette limite est visible dans l’API
La documentation publique des erreurs d’Anthropic ne donne aucun nombre d’appels d’outils par tour pour l’application de chat Claude. Toute valeur exacte que vous lirez à ce sujet n’est donc qu’une estimation. Une limite de même nature est documentée pour l’API (interface de programmation d’application). C’est dans cette documentation que le comportement réel est visible.
Le champ stop_reason d’une réponse de l’API Messages indique pourquoi la génération s’est arrêtée. Les valeurs documentées sont end_turn, max_tokens, stop_sequence, tool_use, pause_turn, refusal et model_context_window_exceeded. Deux d’entre elles décrivent la situation présentée dans ce guide.
pause_turn est renvoyé lorsque la boucle d’échantillonnage côté serveur atteint sa limite d’itérations pendant l’exécution d’outils côté serveur, comme la recherche web. Au 18 August 2026, la page consacrée au traitement des raisons d’arrêt indique une valeur par défaut de 10 itérations par requête. La correction documentée consiste à renvoyer la réponse sans la modifier comme message de l’assistant, afin que Claude reprenne là où il s’était arrêté. C’est l’équivalent, dans l’API, de saisir « continue » dans une fenêtre de chat.
max_tokens signifie que la réponse a atteint la limite de tokens de sortie définie dans la requête. Si la troncature intervient au milieu d’un bloc d’utilisation d’outil incomplet, l’appel d’outil ne peut pas être exécuté. La réponse documentée consiste alors à réessayer avec une valeur max_tokens plus élevée.
Consultez les valeurs actuelles sur la page consacrée au traitement des raisons d’arrêt, plutôt que de vous fier à celles indiquées ici. Les valeurs par défaut de cette page changent, et un nombre obsolète vaut moins que l’absence de nombre.
Ce qui épuise les appels d’outils d’une conversation
- Une question sans point d’arrêt naturel. « Trouvez tout ce qui a été écrit sur X » ne donne au modèle aucun élément indiquant que la recherche est terminée.
- La lecture répétée du même contenu, parce que la réponse ne se trouve pas à l’endroit prévu par le modèle.
- Des résultats d’outils volumineux. Une longue page web ou un gros fichier consomme l’espace nécessaire au reste du tour.
- Plusieurs tâches indépendantes dans un même message. Chaque tâche nécessite ses propres appels d’outils, qui utilisent tous le même budget.
- Les connecteurs et les serveurs MCP (model context protocol) que vous n’utilisez pas pour cette tâche. Leurs définitions d’outils sont chargées dans la requête et offrent au modèle davantage de moyens de consommer le budget du tour.
Terminer la réponse
Répondez par « continue », ou mieux, par une instruction courte indiquant ce qui manque encore. Cela ouvre un nouveau tour avec un nouveau budget. La conversation précédente reste dans le contexte, donc Claude reprend là où il s’est arrêté au lieu de répéter les appels d’outils déjà effectués.
S’il bloque deux fois au même endroit, la tâche est trop vaste pour un seul tour. Découpez-la. Au lieu de demander un audit complet d’un dépôt, demandez d’abord la liste des fichiers, puis posez une question sur un fichier par message. Quatre petits tours permettent de terminer un travail qu’un seul grand tour ne peut pas mener à bien.
Réduisez ce que le modèle doit rechercher. Indiquez le chemin exact du fichier ou la chaîne d’erreur exacte, et collez directement le journal si vous l’avez déjà. Coller un journal coûte un message. Demander au modèle de le rechercher entraîne plusieurs appels d’outils, et il peut trouver le mauvais.
Désactivez les connecteurs dont vous n’avez pas besoin pour le moment. Chaque outil connecté ajoute sa définition à chaque requête, ce qui consomme du contexte et élargit l’ensemble des actions possibles pour le modèle. Le même raisonnement s’applique à une longue session de développement : garder le contexte d’une session Claude Code réduit la différence entre un agent qui termine le travail et un agent qui s’arrête à mi-chemin.
Définir vous-même la limite de tours lors de l’exécution d’un agent
Si vous pilotez Claude depuis votre propre code, vous contrôlez la limite par tour. Le Claude Agent SDK (kit de développement logiciel) expose max_turns en Python et maxTurns en TypeScript. La documentation les décrit comme le nombre maximal d’allers-retours d’utilisation des outils. Par défaut, la documentation indique qu’il n’y a aucune limite.
Lorsque cette limite est atteinte, le SDK renvoie un résultat dont subtype vaut error_max_turns. Un appel query() en mode single shot lève alors une erreur contenant le texte Reached maximum number of turns. Le résultat contient toujours num_turns et session_id. Vous pouvez donc reprendre la même session avec une limite plus élevée, au lieu de relancer la tâche.
Depuis la CLI (interface de ligne de commande), le même contrôle se fait avec un flag. Il s’applique uniquement au print mode :
claude -p --max-turns 3 "summarise the failing tests"La documentation du flag indique qu’une erreur est renvoyée lorsque la limite est atteinte et qu’il n’y a aucune limite par défaut. Il existe une variante du même principe basée sur le coût : max_budget_usd en Python et maxBudgetUsd en TypeScript arrêtent la boucle lorsqu’un seuil de dépenses est atteint, plutôt qu’après un nombre de tours. Les dépenses des subagents sont incluses dans ce total. Si vous exécutez des agents sur un serveur facturé au mois, contrôler le coût d’un agent IA sur un VPS mérite d’être configuré avant la première longue exécution.
Une pause en attente d’une approbation est différente. Si votre agent s’arrête alors qu’aucune dépense n’est engagée, consultez permission_mode plutôt que le nombre de tours, car un outil attend une réponse humaine qui n’arrive pas. Le mode automatique et les paramètres d’autorisation de Claude Code explique quels modes demandent une confirmation et lesquels s’exécutent sans en demander.
Comment vérifier vous-même le comportement actuel
Le comportement peut changer sans annonce. Considérez donc chaque nombre de ce guide comme une valeur datée, et non comme une valeur fixe. Deux sources indiquent ce qui est vrai aujourd’hui.
- La documentation de l’API sur les raisons d’arrêt. Elle indique la valeur par défaut de l’itération de l’outil serveur et explique comment la dépasser.
- La page du centre d’aide d’Anthropic sur les messages d’erreur. Elle donne le libellé associé à la limite d’utilisation. Vérifiée le 18 August 2026, cette page documente les messages d’utilisation sur cinq heures et sur une semaine, mais ne mentionne aucune limite d’outils par tour. C’est pourquoi aucun chiffre officiel pour l’application de chat n’est cité ici.
Mesurez plutôt vos propres exécutions. Dans Claude Code, /context affiche l’utilisation actuelle du contexte sous forme de grille colorée et indique les outils qui en consomment le plus ; /compact résume la conversation jusqu’ici pour libérer de l’espace. Dans l’Agent SDK, chaque résultat contient num_turns. Vous pouvez ainsi voir combien d’allers-retours une tâche type nécessite réellement avant de définir une limite. Une valeur issue de votre propre charge de travail est plus utile qu’un chiffre trouvé dans un message de forum.
FAQ
La limite d’utilisation des outils est-elle la même que ma limite d’utilisation de Claude ?
Non. La limite d’utilisation comptabilise ce que vous avez consommé pendant une période donnée et vous indique quand elle est réinitialisée. Dans ce cas, il suffit d’attendre. Le message concernant l’utilisation des outils interrompt une réponse en cours parce que cette réponse a épuisé ses appels d’outils. Envoyer un autre message démarre immédiatement un nouveau tour avec un nouveau budget. Si la continuation fonctionne immédiatement, votre quota n’était pas en cause. comment les limites d’utilisation de Claude sont comptabilisées explique en détail le fonctionnement du quota.
Comment faire en sorte que Claude termine une tâche qu’il a interrompue ?
Envoyez un message supplémentaire. « Continue » fonctionne, mais une instruction qui précise ce qui manque encore est plus efficace, car elle évite au modèle de reconstruire le contexte qu’il possède déjà. S’il s’arrête une deuxième fois au même endroit, découpez la tâche en plusieurs parties et envoyez une partie par message. Indiquer les chemins complets des fichiers ou coller directement leur contenu évite les recherches qui ont épuisé le budget initial.
Que signifient « límite de uso de herramientas » et « limite de uso de ferramentas » ?
Ce sont les formulations espagnole et portugaise du même message. Elles apparaissent généralement sous la forme « límite de uso de herramientas en este turno » ou « limite de uso de ferramentas neste turno ». Le sens est identique dans toutes les langues : Claude a épuisé les appels d’outils autorisés au cours d’une seule réponse, et le quota de votre forfait n’est pas concerné. La solution est également la même. Répondez en lui demandant de continuer ou découpez la demande en étapes plus petites. La limite de facturation correspond à un autre message, qui indique l’heure de réinitialisation.
Une mise à niveau de mon forfait augmente-t-elle la limite d’utilisation des outils pour un tour ?
Le niveau du forfait et le budget d’outils par tour sont deux paramètres différents. Une mise à niveau augmente la quantité que vous pouvez utiliser pendant une période donnée. C’est cette limite qui indique l’heure de réinitialisation. Le nombre d’appels d’outils qu’une seule réponse peut effectuer dépend de la boucle qui exécute le modèle. Anthropic ne publie pas cette valeur pour l’application de chat. Sur n’importe quel forfait, le découpage de la tâche en plusieurs tours est la solution réellement efficace.
Pourquoi mon propre agent s’arrête-t-il après seulement quelques appels d’outils ?
Vérifiez si vous avez défini une limite. Le Claude Agent SDK utilise max_turns en Python et maxTurns en TypeScript. L’interface de ligne de commande utilise --max-turns en mode print. Lorsque l’une de ces limites est atteinte, le SDK renvoie un résultat avec un subtype de error_max_turns et une erreur contenant le texte Reached maximum number of turns. La valeur par défaut est illimitée dans les deux cas. Si aucune limite n’est définie et que l’exécution s’arrête malgré tout, consultez stop_reason dans le résultat : max_tokens signifie que la limite de sortie a été atteinte, tandis que pause_turn signifie que la boucle d’outils du serveur a atteint sa limite d’itérations et demande que la réponse lui soit renvoyée pour pouvoir continuer.