Limite de ferramentas do Claude nesta interação
A mensagem indica que Claude esgotou as chamadas de ferramentas permitidas nesta interação, não a cota do plano. Saiba como continuar a tarefa.
O que significa o limite de utilização de ferramentas nesta interação
Um limite de utilização de ferramentas nesta interação significa que Claude parou a meio de uma resposta porque essa resposta esgotou o número de chamadas de ferramentas permitido, e não porque a sua conta esgotou a utilização. Tudo o que encontrou antes de parar continua na conversa. Envie mais uma mensagem a pedir que continue. Isso inicia uma nova interação com um novo limite.
Uma interação é uma ronda completa dentro de um ciclo de agente. Claude produz uma resposta que contém chamadas de ferramentas, o cliente executa essas ferramentas e os resultados são devolvidos a Claude para a decisão seguinte. O ciclo repete-se sem devolver o controlo ao utilizador. A interação termina quando Claude produz uma resposta sem chamadas de ferramentas. O limite da interação define quantas dessas rondas uma única resposta pode executar.
O limite de utilização do seu plano é um controlo separado
O limite do plano contabiliza o que utilizou durante uma janela de tempo. A página do centro de ajuda da Anthropic sobre mensagens de erro, consultada em 18 August 2026, indica Approaching 5-hour limit. quando está perto desse limite e 5-hour limit reached - resets [time]. depois de o ultrapassar. A mensagem indica uma hora. Esperar até essa hora resolve o problema, e nada do que escrever entretanto ajuda.
A mensagem de utilização de ferramentas funciona de forma oposta. Surge a meio de uma tarefa, e uma única mensagem de seguimento permite continuar o trabalho imediatamente. A quota restante não é afetada. Esse é o teste a executar: se esperar não fizer nada e continuar funcionar, nunca atingiu a sua quota. No caso da quota, o que fazer quando Claude diz que o limite foi atingido apresenta as opções, e como são contabilizados os limites de utilização do Claude explica as janelas subjacentes.
Por que uma interação tem um orçamento de ferramentas
Cada chamada de ferramenta consome contexto. A chamada é enviada, a ferramenta é executada e todo o resultado volta para a conversa. Ler um ficheiro grande ou executar um comando com uma saída extensa pode consumir milhares de tokens num único passo, e esse texto permanece no contexto durante o resto da sessão. A documentação do loop de agentes da Anthropic indica claramente a consequência: o contexto acumula-se entre interações, por isso uma sessão com muitas chamadas de ferramentas contém muito mais informação do que uma sessão curta.
Um orçamento para a interação impede um loop que já não está a progredir. Um agente que pesquisa, lê, pesquisa novamente e continua sem encontrar nada prosseguirá até ser interrompido. O orçamento faz essa interrupção. Devolve o controlo quando ainda pode redirecionar o trabalho, o que custa muito menos do que deixar o loop chegar ao fim da janela de contexto.
Onde este limite é visível na API
A documentação pública de erros da Anthropic não fornece um número de chamadas de ferramentas por turno para a aplicação de chat Claude. Portanto, qualquer valor exato que encontre para essa aplicação é uma estimativa. A API (interface de programação de aplicações) documenta um limite com a mesma estrutura. É nessa documentação que o comportamento real fica visível.
O campo stop_reason numa resposta da Messages API indica por que motivo a geração foi interrompida. Os valores documentados são end_turn, max_tokens, stop_sequence, tool_use, pause_turn, refusal e model_context_window_exceeded. Dois deles descrevem a situação deste guia.
pause_turn é devolvido quando o ciclo de amostragem no lado do servidor atinge o limite de iterações ao executar ferramentas do servidor, como a pesquisa na Web. Em 18 August 2026, a página sobre os motivos de paragem do processamento indica um valor predefinido de 10 iterações por pedido. A correção documentada consiste em enviar a resposta de volta sem alterações como mensagem do assistant, para que Claude continue a partir do ponto em que parou. Esta é a versão na API de escrever "continue" numa janela de chat.
max_tokens significa que a resposta atingiu o limite de tokens de saída definido no pedido. Se a truncagem ocorrer dentro de um bloco incompleto de utilização de ferramenta, a chamada da ferramenta não pode ser executada. A resposta documentada é repetir o pedido com um max_tokens mais elevado.
Consulte os valores atuais na página sobre os motivos de paragem do processamento, em vez de confiar nos valores apresentados aqui. Os valores predefinidos dessa página podem mudar, e um número desatualizado é pior do que não indicar nenhum número.
O que faz uma conversa esgotar as chamadas de ferramentas
- Uma pergunta sem um ponto de paragem natural. "Encontre tudo o que foi escrito sobre X" não dá ao modelo nenhuma indicação de que a pesquisa terminou.
- Leituras repetidas do mesmo material, porque a resposta não está onde o modelo esperava encontrá-la.
- Resultados grandes de ferramentas. Uma página Web longa ou um ficheiro grande ocupa o espaço necessário para o restante da resposta.
- Várias tarefas independentes na mesma mensagem. Cada tarefa precisa das suas próprias chamadas de ferramentas, mas todas usam o mesmo limite.
- Conectores e servidores MCP (model context protocol) que não estão a ser usados nesta tarefa. As respetivas definições de ferramentas são carregadas no pedido e dão ao modelo mais formas de gastar as chamadas disponíveis.
Como concluir a resposta
Responda com "continue" ou, melhor ainda, com uma instrução curta que indique o que falta. Isso abre um novo turno com um novo orçamento. A conversa anterior continua no contexto, por isso o Claude prossegue em vez de repetir as chamadas de ferramenta que já fez.
Se parar no mesmo ponto duas vezes, a tarefa é demasiado ampla para um único turno. Divida-a. Em vez de pedir uma auditoria completa de um repositório, peça primeiro a lista de ficheiros e, depois, pergunte sobre um ficheiro por mensagem. Quatro turnos pequenos concluem um trabalho que um turno grande não consegue concluir.
Limite o que o modelo tem de procurar. Indique o caminho exato do ficheiro ou a mensagem de erro exata e cole o log quando já o tiver. Colar um log custa uma mensagem. Fazer o modelo procurar esse log custa várias chamadas de ferramenta e pode levá-lo a encontrar o log errado.
Desative os conectores de que não precisa neste momento. Cada ferramenta ligada adiciona a sua definição a todos os pedidos, consumindo contexto e alargando o conjunto de ações que o modelo pode escolher. O mesmo se aplica a uma sessão de programação longa, em que manter pequeno o contexto de uma sessão do Claude Code faz a diferença entre um agente que conclui o trabalho e um que para a meio.
Defina o limite de turnos ao executar um agente
Se executar o Claude a partir do seu próprio código, o limite por turno é uma definição sob o seu controlo. O Claude Agent SDK (kit de desenvolvimento de software) disponibiliza max_turns em Python e maxTurns em TypeScript. A documentação define estes parâmetros como o número máximo de ciclos de utilização de ferramentas. Por predefinição, não existe limite.
Quando esse limite é atingido, o SDK devolve um resultado cujo subtype é error_max_turns. Numa chamada única query(), é então gerado um erro que contém o texto Reached maximum number of turns. O resultado inclui também num_turns e session_id. Assim, pode retomar a mesma sessão com um limite superior, em vez de iniciar a tarefa novamente.
Na CLI (interface de linha de comandos), o mesmo controlo é uma flag. Aplica-se apenas ao modo de impressão:
claude -p --max-turns 3 "summarise the failing tests"A referência da flag indica que o comando termina com um erro quando o limite é atingido e que, por predefinição, não existe limite. Existe uma variante do mesmo mecanismo baseada no custo: max_budget_usd em Python e maxBudgetUsd em TypeScript terminam o ciclo ao atingir um limite de despesa, em vez de um número de turnos. A despesa dos subagentes também é contabilizada nesse total. Se executar agentes num servidor cujo custo é mensal, vale a pena configurar o controlo do custo de um agente de IA num VPS antes da primeira execução longa.
Uma pausa à espera de aprovação é outra situação. Se o agente parar e não houver consumo de recursos, consulte permission_mode em vez do número de turnos. Nesse caso, uma ferramenta está à espera de uma resposta humana que nunca chega. O modo automático e as definições de permissões do Claude Code explica quais os modos que pedem confirmação e quais executam sem a pedir.
Como verificar o comportamento atual por conta própria
O comportamento pode mudar sem aviso. Por isso, trate todos os números deste guia como valores datados, não como valores fixos. Há dois locais que mostram o estado atual.
- A documentação da API sobre motivos de interrupção, que indica o valor predefinido da iteração da ferramenta do servidor e como continuar depois de o atingir.
- A página do centro de ajuda da Anthropic sobre mensagens de erro, que apresenta o texto do limite de utilização. Consultada em 18 August 2026, essa página documenta as mensagens de utilização de cinco horas e semanal, mas não menciona um limite de ferramentas por turno. É por isso que não é indicado aqui nenhum valor oficial para a aplicação de chat.
Em vez disso, meça as suas próprias execuções. No Claude Code, /context apresenta a utilização atual do contexto como uma grelha colorida e indica as ferramentas que mais espaço consomem. /compact resume a conversa até ao momento para libertar espaço. No Agent SDK, cada resultado inclui num_turns, para que possa ver quantas viagens de ida e volta uma tarefa típica realmente exige antes de escolher um limite. Um número obtido da sua própria carga de trabalho vale mais do que um número publicado numa mensagem de fórum.
FAQ
O limite de uso de ferramentas é igual ao meu limite de utilização do Claude?
Não. O limite de utilização contabiliza o que gastou durante uma janela de tempo e indica quando é reposto, por isso a solução é esperar. A mensagem sobre o uso de ferramentas interrompe uma resposta a meio porque essa resposta esgotou as chamadas de ferramentas disponíveis. Enviar outra mensagem inicia imediatamente uma nova interação com um novo orçamento. Se a continuação funcionar logo, a sua quota nunca foi o problema. como são contabilizados os limites de utilização do Claude explica o caso da quota em detalhe.
Como faço para o Claude terminar uma tarefa que interrompeu a meio?
Envie mais uma mensagem. "Continue" funciona, mas uma instrução que indique o que ainda falta funciona melhor, porque evita que o modelo reconstrua o contexto que já tem. Se parar novamente no mesmo ponto, divida a tarefa em partes menores e envie uma parte por mensagem. Indicar os caminhos exatos dos ficheiros ou colar diretamente o conteúdo elimina a pesquisa que esgotou o orçamento inicial.
O que significa "límite de uso de herramientas" ou "limite de uso de ferramentas"?
Estas são as versões em espanhol e português da mesma mensagem, normalmente apresentadas como "límite de uso de herramientas en este turno" ou "limite de uso de ferramentas neste turno". O significado é idêntico em qualquer idioma: o Claude esgotou as chamadas de ferramentas permitidas numa única resposta, e a quota do seu plano não está envolvida. A solução também é a mesma. Responda a pedir que continue ou divida o pedido em passos menores. O limite de faturação é uma mensagem diferente, que indica uma hora de reposição.
A atualização do meu plano aumenta o limite de uso de ferramentas numa interação?
O nível do plano e o orçamento de ferramentas por interação são controlos diferentes. A atualização aumenta o volume que pode utilizar durante uma janela de tempo, que é o limite que indica uma hora de reposição. O número de chamadas de ferramentas que uma única resposta pode fazer é uma propriedade do ciclo que executa o modelo, e a Anthropic não publica esse valor para a aplicação de chat. Dividir a tarefa em interações menores é o que realmente ajuda, independentemente do plano.
Por que razão o meu próprio agente para depois de apenas algumas chamadas de ferramentas?
Verifique se definiu um limite. O Claude Agent SDK utiliza max_turns em Python e maxTurns em TypeScript. A interface de linha de comandos utiliza --max-turns no modo de impressão. Quando um desses limites é atingido, o SDK devolve um resultado com subtype de error_max_turns e um erro que contém o texto Reached maximum number of turns. O valor predefinido em ambos os casos é sem limite. Se não houver nenhum limite definido e a execução continuar a parar, consulte stop_reason no resultado: max_tokens significa que o limite de saída foi atingido, e pause_turn significa que o ciclo de ferramentas do servidor atingiu o limite de iterações e pretende que a resposta seja enviada para poder continuar.