SSD Nodes Learn 🎉 VPS vanaf $5.50/mnd
Gidsen Matt ConnorDoor Matt Connor · Bijgewerkt 2026-08-21

Claude limiet voor toolgebruik per beurt oplossen

Krijgt u de melding dat Claude de limiet voor toolgebruik in deze beurt heeft bereikt? Dit is geen abonnementsfout. Lees hier hoe u het proces hervat met een simpel vervolgbericht.

Wat de limiet voor toolgebruik in deze beurt betekent

Een limiet voor toolgebruik in deze beurt betekent dat Claude halverwege een antwoord is gestopt omdat dat antwoord het aantal toegestane tool-aanroepen heeft overschreden, niet omdat uw account het gebruikslimiet heeft bereikt. Alles wat Claude heeft gevonden voordat het proces stopte, staat nog steeds in het gesprek. Stuur nog één bericht met het verzoek om door te gaan; hiermee opent u een nieuwe beurt met een nieuw budget.

Een beurt is één volledige cyclus binnen een agent-loop. Claude genereert output met tool-aanroepen, de client voert deze tools uit en de resultaten worden teruggekoppeld naar Claude voor de volgende beslissing. Deze cyclus herhaalt zich zonder de controle terug te geven aan u. De beurt eindigt wanneer Claude een antwoord geeft zonder tool-aanroepen. Een limiet op de beurt is een limiet op het aantal van deze cycli dat één antwoord mag bevatten.

Uw abonnementslimiet is een afzonderlijke controle

De abonnementslimiet telt wat u heeft verbruikt binnen een bepaald tijdsbestek. De helppagina van Anthropic over foutmeldingen, gecontroleerd op 18 augustus 2026, vermeldt dat dit Approaching 5-hour limit. is wanneer u de limiet nadert, en 5-hour limit reached - resets [time]. zodra u deze overschrijdt. Er wordt een tijdstip genoemd. Wachten tot dat tijdstip lost het probleem op; niets wat u in de tussentijd typt, helpt.

Het bericht over toolgebruik gedraagt zich op de tegenovergestelde manier. Dit verschijnt midden in een taak en één vervolgbericht laat het werk onmiddellijk doorgaan. Uw resterende quotum blijft onaangetast. Dat is de test die u moet uitvoeren: als wachten niets uithaalt en doorgaan wel werkt, zat u nooit aan uw quotum. Voor het geval van het quotum somt wat u moet doen wanneer Claude aangeeft dat de limiet is bereikt de opties op, en hoe Claude-gebruikslimieten worden geteld legt de vensters uit die hieraan ten grondslag liggen.

Waarom een beurt een toolbudget heeft

Elke tool-aanroep kost context. De aanroep wordt verzonden, de tool wordt uitgevoerd en het volledige resultaat keert terug in het gesprek. Het lezen van één groot bestand of het uitvoeren van één commando met een lange output kan duizenden tokens in een enkele stap verbruiken, en die tekst blijft voor de rest van de sessie in de context aanwezig. De documentatie over de agent-loop van Anthropic stelt de consequentie duidelijk: context stapelt zich op over beurten heen, waardoor een sessie met veel tool-aanroepen veel meer verbruikt dan een korte sessie.

Een budget per beurt is wat een loop stopt die geen vooruitgang meer boekt. Een agent die zoekt, leest, opnieuw zoekt en nog steeds niets vindt, zal dit blijven doen totdat iets het onderbreekt. Het budget is de onderbreking. Het geeft de controle aan u terug op een punt waarop u het werk kunt bijsturen, wat veel minder kost dan de loop tot het einde van het contextvenster te laten draaien.

Waar deze limiet zichtbaar is in de API

De openbare foutdocumentatie van Anthropic vermeldt geen limiet voor het aantal tool calls per beurt voor de Claude-chat-app; elk exact cijfer dat u hierover leest, is dus speculatie. Voor de API (application programming interface) is een vergelijkbare limiet gedocumenteerd, en in die documentatie is het werkelijke gedrag zichtbaar.

Het veld stop_reason in een Messages API-antwoord geeft aan waarom de generatie is gestopt. De gedocumenteerde waarden zijn end_turn, max_tokens, stop_sequence, tool_use, pause_turn, refusal en model_context_window_exceeded. Twee daarvan beschrijven de situatie in deze handleiding.

pause_turn wordt geretourneerd wanneer de sampling-loop aan de serverzijde zijn iteratielimiet bereikt tijdens het uitvoeren van servertools zoals web search. Sinds 18 augustus 2026 geeft de pagina over stopredenen aan dat dit standaard 10 iteraties per verzoek is. De gedocumenteerde oplossing is om het antwoord ongewijzigd terug te sturen als het assistant-bericht, zodat Claude doorgaat vanaf het punt waar het proces pauzeerde. Dit is de API-versie van het typen van "continue" in een chatvenster.

max_tokens betekent dat het antwoord het plafond voor output-tokens heeft bereikt dat in het verzoek is ingesteld. Als de tekst wordt afgekapt binnen een onvolledig tool use-blok, kan de tool call niet worden uitgevoerd. Het gedocumenteerde antwoord is om het opnieuw te proberen met een hogere max_tokens.

Lees de actuele waarden op de pagina over stopredenen in plaats van te vertrouwen op de waarden die hier staan geschreven. Standaardinstellingen op die pagina veranderen, en een verouderd getal is slechter dan helemaal geen getal.

Waarom een chat geen tool calls meer kan uitvoeren

  • Een vraag zonder natuurlijk eindpunt. "Zoek alles wat over X is geschreven" geeft het model geen indicatie dat de zoekopdracht voltooid is.
  • Herhaaldelijk lezen van hetzelfde materiaal, omdat het antwoord niet op de verwachte plek staat.
  • Grote resultaten van tools. Eén lange webpagina of een groot bestand verbruikt de ruimte die de rest van de beurt nodig heeft.
  • Meerdere onafhankelijke taken in één bericht. Elke taak vereist eigen tool calls, en deze putten allemaal uit hetzelfde budget.
  • Connectors en MCP (model context protocol) servers die u niet gebruikt voor deze taak. Hun tooldefinities worden in het verzoek geladen en bieden het model meer manieren om de beurt te verbruiken.

Hoe u het antwoord voltooit

Antwoord met "continue", of beter nog, geef een korte instructie aan over wat er nog ontbreekt. Dit opent een nieuwe beurt met een nieuw budget. Het eerdere gesprek blijft in de context, waardoor Claude verdergaat in plaats van de reeds uitgevoerde tool-aanroepen te herhalen.

Als het proces twee keer op hetzelfde punt stopt, is de taak te omvangrijk voor één beurt; splits deze dan op. Vraag in plaats van een volledige audit van een repository eerst om de bestandslijst en vraag daarna per bericht naar één bestand. Vier kleine beurten voltooien werk dat in één grote beurt niet lukt.

Beperk waar het model naar moet zoeken. Geef het exacte bestandspad of de exacte foutmelding en plak de log erbij wanneer u deze al heeft. Een geplakte log kost één bericht. Het model zelf de log laten opzoeken kost meerdere tool-aanroepen en het risico bestaat dat het de verkeerde vindt.

Schakel connectoren uit die u op dit moment niet nodig heeft. Elke verbonden tool voegt zijn definitie toe aan elk verzoek, wat context verbruikt en het aantal keuzemogelijkheden voor het model vergroot. Dezelfde redenering geldt voor een lange programmeersessie, waarbij het klein houden van de context van een Claude Code-sessie het verschil maakt tussen een agent die zijn werk afmaakt en een agent die halverwege stopt.

Stel zelf het turn-budget in wanneer u een agent uitvoert

Als u Claude aanstuurt vanuit uw eigen code, is het per-turn-budget een instelling die u zelf beheert. De Claude Agent SDK (software development kit) stelt max_turns beschikbaar in Python en maxTurns in TypeScript, gedocumenteerd als het maximale aantal round-trips voor toolgebruik. De gedocumenteerde standaardwaarde is geen limiet.

Wanneer dat maximum is bereikt, retourneert de SDK een resultaat waarvan de subtype gelijk is aan error_max_turns, en een single shot query()-aanroep genereert vervolgens een foutmelding met de tekst Reached maximum number of turns. Het resultaat bevat nog steeds num_turns en session_id, zodat u dezelfde sessie kunt hervatten met een hogere limiet in plaats van de taak opnieuw te starten.

Vanaf de CLI (command line interface) is dezelfde controle een flag, en deze is alleen van toepassing op de print-modus:

claude -p --max-turns 3 "summarise the failing tests"

De flag-referentie vermeldt dat het programma met een foutmelding afsluit wanneer de limiet is bereikt, en dat er standaard geen limiet is. Er bestaat een kosten-gebaseerde variant van hetzelfde idee: max_budget_usd in Python en maxBudgetUsd in TypeScript stoppen de lus bij een uitgavenlimiet in plaats van een turn-aantal, waarbij de uitgaven van subagents meetellen voor dat totaal. Als u agents uitvoert op een server waarvoor u maandelijks betaalt, is het beheersen van de kosten van een AI-agent op een VPS de moeite waard om in te stellen vóór de eerste langdurige uitvoering.

Een pauze in afwachting van goedkeuring is iets anders. Als uw agent stopt en er worden geen kosten gemaakt, lees dan permission_mode in plaats van naar het turn-aantal te kijken, omdat een tool wacht op een menselijk antwoord dat nooit komt. De auto-modus en permissie-instellingen van Claude Code behandelt welke modi om toestemming vragen en welke zonder vragen worden uitgevoerd.

Hoe u het huidige gedrag zelf kunt controleren

Het gedrag verandert hier zonder aankondiging. Beschouw elk getal in deze handleiding daarom als verouderd in plaats van vaststaand. Twee bronnen tonen de huidige situatie.

  • De API-documentatie over stopredenen, waarin de standaardwaarde voor servertool-iteraties wordt genoemd en de manier om deze te overschrijden.
  • De helpcentrum-pagina van Anthropic over foutmeldingen, die de bewoordingen voor gebruikslimieten bevat. Gecontroleerd op 18 augustus 2026: die pagina documenteert de berichten over het vijf-uurs- en wekelijkse gebruik en vermeldt niets over een tool-limiet per beurt. Vanwege die afwezigheid wordt hier geen officieel cijfer voor de chat-app genoemd.

Meet uw eigen runs. In Claude Code tekent /context het huidige contextgebruik als een gekleurd raster en wijst het de tools aan die de meeste ruimte innemen, en /compact vat het gesprek tot nu toe samen om ruimte vrij te maken. In de Agent SDK bevat elk resultaat num_turns, zodat u kunt zien hoeveel round-trips een typische taak werkelijk vereist voordat u een limiet kiest. Een getal uit uw eigen werklast is waardevoller dan een getal uit een forumpost.

FAQ

Is de limiet voor toolgebruik hetzelfde als mijn Claude-gebruikslimiet?

Nee. De gebruikslimiet telt wat u binnen een bepaald tijdsbestek heeft verbruikt en geeft aan wanneer deze wordt gereset; wachten is dan de oplossing. De melding over toolgebruik stopt een antwoord halverwege omdat dat antwoord het aantal toegestane tool-aanroepen heeft verbruikt. Het versturen van een nieuw bericht start direct een nieuwe beurt met een nieuw budget. Als doorgaan direct werkt, was uw quotum nooit het probleem. hoe Claude-gebruikslimieten worden geteld behandelt de quotum-situatie volledig.

Hoe zorg ik dat Claude een taak afmaakt die halverwege is gestopt?

Stuur nog één bericht. "Ga door" werkt, maar een instructie die benoemt wat er nog ontbreekt werkt beter, omdat het voorkomt dat het model de context die het al heeft opnieuw moet opbouwen. Als het op hetzelfde punt voor de tweede keer stopt, breek de taak dan op in kleinere delen en geef één deel per bericht. Het opgeven van exacte bestandspaden, of het direct plakken van de inhoud, verwijdert het zoekproces dat het budget in de eerste plaats heeft verbruikt.

Wat betekent "límite de uso de herramientas" of "limite de uso de ferramentas"?

Dit zijn de Spaanse en Portugese bewoordingen van dezelfde melding, meestal gezien als "límite de uso de herramientas en este turno" of "limite de uso de ferramentas neste turno". De betekenis is in elke taal identiek: Claude heeft het aantal toegestane tool-aanroepen binnen één antwoord verbruikt en uw abonnementsquotum is hierbij niet betrokken. De oplossing is eveneens hetzelfde. Antwoord met het verzoek om door te gaan, of splits het verzoek op in kleinere stappen. De facturatielimiet is een aparte melding en die geeft wel een reset-tijd aan.

Verhoogt het upgraden van mijn abonnement de limiet voor toolgebruik per beurt?

Het abonnementsniveau en het toolbudget per beurt zijn verschillende instellingen. Upgraden verhoogt hoeveel u kunt gebruiken over een tijdsbestek, wat de limiet is die een reset-tijd aangeeft. Hoeveel tool-aanroepen één antwoord mag doen, is een eigenschap van de lus die het model aanstuurt, en Anthropic publiceert dat cijfer niet voor de chat-app. Het opsplitsen van de taak in kleinere beurten is wat daadwerkelijk helpt, op elk abonnement.

Waarom stopt mijn eigen agent na slechts enkele tool-aanroepen?

Controleer of u een limiet heeft ingesteld. De Claude Agent SDK gebruikt max_turns in Python en maxTurns in TypeScript, en de command line interface gebruikt --max-turns in de print-modus. Wanneer een van deze wordt bereikt, retourneert de SDK een resultaat met een subtype van error_max_turns en een foutmelding die de tekst Reached maximum number of turns bevat. De standaardinstelling in beide is geen limiet. Als er niets is begrensd en de uitvoering toch stopt, lees dan stop_reason in het resultaat: max_tokens betekent dat het output-plafond is bereikt, en pause_turn betekent dat de server-tool-lus de iteratielimiet heeft bereikt en wil dat het antwoord wordt teruggestuurd zodat deze kan doorgaan.