Limite de uso do Claude atingido: como resolver
Recebeu o erro de limite do Claude? Entenda a diferença entre janelas de sessão e semanais. Saiba como contornar bloqueios trocando de modelo ou migrando para a API oficial.
Qual limite do Claude você atingiu
Uma mensagem de limite atingido do Claude nomeia a janela de tempo pela qual você está aguardando, e essa janela determina o que você pode fazer em seguida. Os limites de sessão e semanais abrangem todos os modelos simultaneamente, portanto, alternar entre modelos não restaura o seu acesso. Um limite que nomeia um modelo específico é a exceção: alterne os modelos e você continuará trabalhando enquanto aquele modelo específico permanece bloqueado.
O Claude Code exibe a janela e o seu horário de reinicialização na mesma linha:
You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pmA janela de sessão é um período móvel de cinco horas. As janelas semanais são reiniciadas em um horário fixo a cada semana, atribuído à sua conta, de modo que o dia e a hora permanecem os mesmos de uma semana para a outra. Um plano Pro possui a janela de sessão de cinco horas mais um limite semanal que se aplica a todos os modelos. Um plano Max adiciona um segundo limite semanal que se aplica a uma família de modelos específica. Os limites em si estão detalhados em detalhamento completo dos limites de uso do Claude. Esta página começa onde aquela termina.
Aqui está o ponto que confunde os usuários. Cada solicitação conta contra a janela de sessão e a janela semanal ao mesmo tempo; portanto, uma tarde de uso intenso pode esgotar a cota semanal enquanto a janela de cinco horas ainda possui espaço. Verifique o horário de reinicialização antes de planejar o restante do seu dia. Uma reinicialização às 15:45 é apenas uma pausa para o café. Uma reinicialização na segunda-feira à meia-noite, não.
Verifique o medidor antes de supor
No claude.ai, abra Settings e depois Usage. As barras de progresso mostram quanto da janela de sessão de cinco horas e de cada janela semanal você consumiu, permitindo identificar qual delas está esgotada em vez de apenas supor.
No Claude Code, execute /usage. Ele exibe as mesmas barras de plano, além de um detalhamento de para onde o uso recente foi direcionado, atribuído a skills, subagentes, plugins e servidores MCP (model context protocol) individuais como uma porcentagem do total. Pressione d para as últimas 24 horas e w para os últimos 7 dias. Ele também sinaliza qualquer padrão que represente 10% ou mais do uso recente, sendo os dois que você verá com mais frequência o contexto longo e as falhas de cache (cache misses).
Duas ressalvas. O detalhamento é calculado a partir do histórico de sessão armazenado nessa máquina, portanto, o trabalho realizado em outro laptop ou no claude.ai não aparece nele. E o valor em dólares no bloco Session no topo é precificado de acordo com as taxas de lista padrão para usuários de API (application programming interface), o que significa que não é o valor da sua fatura quando você possui uma assinatura.
Mudar para um modelo menor ajuda?
Apenas quando a mensagem especifica um modelo. Após You've hit your Opus limit, execute /model, escolha Sonnet ou Haiku, e a sessão continuará com todo o contexto. Após You've hit your session limit ou You've hit your weekly limit, /model não altera nada, pois essas janelas são compartilhadas entre todos os modelos.
A troca é muito mais vantajosa antes de atingir o limite do que depois. O Sonnet lida com a maior parte do trabalho de programação por uma fração do custo do Opus, portanto, manter o Opus como padrão é um dos dois hábitos responsáveis pela maioria dos usos inesperados. O outro é uma sessão que nunca é limpa. Delegue edições mecânicas e triagem de logs ao Haiku, e reserve o Opus para decisões de design nas quais você esteja genuinamente travado. Escolhendo entre Opus, Sonnet e Haiku detalha onde cada um justifica o seu custo.
Pare de pagar por contexto que você não usa mais
O Claude Code envia toda a sua conversa a cada solicitação, e cada vez que o Claude usa uma ferramenta, ele envia outra solicitação contendo esse lote de resultados. O prompt caching significa que o histórico é relido à taxa de cache em vez da taxa de entrada completa, o que o torna mais barato, mas não gratuito. Portanto, uma pergunta de uma linha em uma sessão que você mantém aberta desde a manhã ainda consome uso de toda a conversa.
/context
/clear
/compact Focus on the failing tests and the files we changed/clear não custa nada, pois descarta o contexto em vez de lê-lo. /compact precisa ler a conversa que resume, então compactar um contexto muito grande é, por si só, uma solicitação grande. Use /clear quando mudar para um trabalho não relacionado, e /compact apenas quando estiver no meio de uma tarefa e precisar que o thread sobreviva. Execute /rename antes de limpar para que você possa encontrar a sessão novamente com /resume.
O tempo de vida do cache importa mais do que a maioria das pessoas imagina. Em uma assinatura, o cache dura uma hora. Ele cai para cinco minutos assim que você começa a usar créditos de uso, e cinco minutos também é o padrão em uma API key. Sua primeira mensagem após um longo almoço perde o cache e reprocessa todo o contexto pelo preço total de entrada, e é por isso que o uso frequentemente aumenta sem motivo aparente. Onde o prompt caching compensa cobre os cálculos.
Três alavancas adicionais estão no mesmo lugar. /mcp lista seus servidores configurados para que você possa desativar aqueles que esta tarefa não precisa. Um CLAUDE.md longo é carregado no início da sessão, independentemente de o trabalho precisar dele ou não; portanto, mova instruções especializadas para skills, que são carregadas apenas quando invocadas. E o extended thinking é cobrado como tokens de saída, que é a metade cara; portanto, reduza-o com /effort, desative-o em /config ou defina MAX_THINKING_TOKENS=8000 em um modelo com um orçamento de pensamento fixo.
Divida a tarefa para que caiba numa única janela
Pressione Shift+Tab para alternar para o modo de plano antes de uma alteração grande. O Claude explora a base de código e propõe uma abordagem para a sua aprovação; uma direção errada detetada nesta fase custa um plano em vez de duas horas de edições e retrabalho.
Delegue operações ruidosas a subagentes. Executar uma suite de testes ou ler um log de 10.000 linhas dentro de um subagente mantém o output bruto no contexto desse subagente, e apenas o resumo retorna à sua conversa principal.
Pressione Escape no momento em que o Claude seguir uma direção incorreta. /rewind restaura tanto a conversa quanto o código para um ponto de controlo anterior, para que não gaste recursos a desfazer um trabalho que nunca quis.
Você deve comprar créditos de uso ou usar a API?
Os créditos de uso permitem que uma conta Pro ou Max continue funcionando após o limite do plano, sendo cobrados conforme as taxas padrão da API. Ative-os em Settings e depois em Usage no claude.ai com um método de pagamento associado, ou execute /usage-credits no Claude Code, o que abrirá suas configurações de faturamento no navegador. Os créditos aplicam-se às conversas no Claude e ao uso do terminal no Claude Code, com um limite diário de resgate de $2000. O comando exige um login de assinatura, portanto não está disponível quando você se autentica com uma API key. No plano gratuito, os créditos não são oferecidos, então o primeiro passo é assinar o Pro por $20 mensais, e o que o Pro adiciona e onde seus limites impedem você detalha até onde isso leva. Se você estiver recarregando créditos na maioria das semanas, uma franquia maior costuma ser o hábito mais barato, e a diferença entre os níveis Max de $100 e $200 é um multiplicador de uso, e não uma diferença de modelos ou recursos.
A outra via é uma API key simples do Claude Console, cobrada por token, sem qualquer sessão ou janela semanal. Uma armadilha comum: um ANTHROPIC_API_KEY perdido no seu ambiente roteia o Claude Code através dessa chave em vez da sua assinatura, sem aviso prévio. Você descobre pela fatura ou por isto:
API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.Esse 429 é o limite de taxa da chave, não do seu plano. Execute /status e confirme se a credencial ativa é a que você pretendia usar.
Quanto custa uma tarde na API?
O exemplo prático abaixo representa uma tarde de codificação com agentes: 200.000 tokens de entrada sem cache, 1,8 milhão de leituras de cache e 150.000 tokens de saída. Os preços seguem as tabelas da Anthropic em agosto de 2026. Todas essas taxas são cotadas por milhão de tokens; se essa unidade ainda parece abstrata, o que um milhão de tokens realmente representa converte esse valor em uma quantidade de leitura e escrita que você consegue visualizar.
The data behind this chart
[
{
"label": "Opus 5",
"input_usd_per_mtok": 5,
"cache_read_usd_per_mtok": 0.5,
"output_usd_per_mtok": 25,
"afternoon_usd": 5.65
},
{
"label": "Sonnet 5",
"input_usd_per_mtok": 2,
"cache_read_usd_per_mtok": 0.2,
"output_usd_per_mtok": 10,
"afternoon_usd": 2.26
},
{
"label": "Haiku 4.5",
"input_usd_per_mtok": 1,
"cache_read_usd_per_mtok": 0.1,
"output_usd_per_mtok": 5,
"afternoon_usd": 1.13
}
]A mesma tarde custa $5.65 no Opus 5 e $1.13 no Haiku 4.5. A saída é o que eleva o total: a $25 por milhão de tokens no Opus 5 contra $5 no Haiku 4.5, os 150.000 tokens que o Claude escreve custam mais do que os 2 milhões de tokens que ele lê. É por isso que reduzir o orçamento de processamento economiza mais do que cortar arquivos.
Uma data importante: o Sonnet 5 está com preço promocional de $2 e $10 por milhão de tokens de entrada e saída até 31 de agosto de 2026, passando para $3 e $15 em 1 de setembro de 2026, o que eleva o custo da mesma tarde de $2.26 para cerca de $3,39.
Como cada valor da tarde é calculado
Opus 5: 200.000 tokens de entrada sem cache a $5 por milhão custam $1,00. 1,8 milhão de leituras de cache a um décimo da taxa de entrada custam $0,90. 150.000 tokens de saída a $25 por milhão custam $3,75. Total $5.65.
Sonnet 5: $0,40 de entrada sem cache, $0,36 de leituras de cache, $1,50 de saída. Total $2.26.
Haiku 4.5: $0,20 de entrada sem cache, $0,18 de leituras de cache, $0,75 de saída. Total $1.13.
Todas as 3 linhas assumem as mesmas contagens de tokens, portanto as diferenças entre elas são puramente de preço. Uma tarde real varia conforme a quantidade de contexto que permanece em cache.
Para fins de escala, a documentação da própria Anthropic situa o gasto médio com o Claude Code em implementações corporativas próximo de $13 por desenvolvedor por dia ativo, e abaixo de $30 por dia ativo para 90% dos usuários, em agosto de 2026. A cobrança por token não é automaticamente mais barata do que uma assinatura. Ela é vantajosa quando sua carga é irregular, pois dias de pouco uso não custam nada, e é desvantajosa quando você trabalha todos os dias. A API versus uma assinatura, comparada com números reais mostra o ponto de equilíbrio.
Executar tarefas longas em uma VPS durante a noite
Algumas tarefas não exigem monitoramento: uma grande refatoração, uma migração de teste ou uma varredura de documentação. Essas tarefas também não precisam da sua janela de assinatura. Coloque-as em uma VPS (servidor virtual privado) com uma API key e elas serão cobradas por token, enquanto a franquia do seu plano permanece intacta para o trabalho interativo do dia seguinte.
Instale o Claude Code em uma máquina Ubuntu e confirme se ele executa:
curl -fsSL https://claude.ai/install.sh | bash
claude --versionclaude --version deve exibir uma string de versão como 2.1.211 (Claude Code). Um command not found aqui significa que o ~/.local/bin ainda não está no seu PATH, então abra um novo shell e tente novamente.
Coloque a chave em um arquivo em vez de deixá-la no histórico do seu shell. Crie o ~/.claude-env em um editor com uma linha, export ANTHROPIC_API_KEY=sk-ant-your-key-here, depois restrinja as permissões e carregue-a:
chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10Essa última linha exibe os dez primeiros caracteres, o que é suficiente para confirmar que a variável está definida sem exibir a chave inteira na tela.
Agora inicie a tarefa dentro do tmux para que ela sobreviva ao fechamento do seu laptop:
tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
--allowedTools "Read,Edit,Bash" \
--append-system-prompt-file ./CLAUDE.md \
--output-format json > ~/overnight.jsonDesconecte com Ctrl-b seguido de d e encerre a conexão. Reconecte mais tarde com tmux attach -t overnight. Claude Code em uma sessão tmux em uma VPS cobre o gerenciamento de sessões por completo.
O --bare é importante aqui. Ele ignora a descoberta automática de hooks, skills, plugins e o CLAUDE.md, e nunca lê credenciais OAuth, portanto a execução usa apenas a API key. É isso que mantém a tarefa fora da sua assinatura. Isso também significa que as regras do projeto são ignoradas, e é por isso que o --append-system-prompt-file as fornece de volta deliberadamente. Sem o --bare, um ANTHROPIC_API_KEY definido aciona um prompt de aprovação única que uma execução autônoma não consegue responder.
Pela manhã, leia o resultado e o custo a partir do JSON:
jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.jsonO Claude Code retorna 0 em caso de sucesso e um valor diferente de zero quando a execução falha, portanto um script de wrapper pode verificar o status de saída e enviar um e-mail em caso de falha. Defina um limite de gastos no workspace no Claude Console antes de deixá-lo rodando: um agente em um loop de repetição às 3 da manhã é uma forma real de gastar dinheiro real. Reduza o CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY se você também quiser diminuir a velocidade. Controle de custos para agentes deixados em execução detalha os limites que vale a pena definir primeiro.
Dê à tarefa seu próprio usuário sem privilégios e sua própria branch git. Um agente editando um repositório sem supervisão ocasionalmente fará algo que você teria interrompido, e uma branch transforma isso em um git checkout em vez de um incidente. Executando um agente de codificação com segurança em uma VPS cobre o isolamento.
Para trabalhos em lote que não são interativos, como classificar milhares de registros, a Batch API processa solicitações de forma assíncrona com um desconto de 50% em tokens de entrada e saída. É a rota por token mais barata publicada pela Anthropic, e uma janela noturna é exatamente a latência que ela requer.
O que não recupera o seu acesso
Iniciar uma nova conversa não restaura a sua cota. O uso é contabilizado na sua conta, não na conversa. Isso torna cada mensagem subsequente mais barata, pois uma conversa nova não carrega histórico para ser relido, portanto, ainda vale a pena fazê-lo. É uma redução de custo, não uma reinicialização.
Apagar conversas antigas não reembolsa nada. Esses tokens foram gastos quando foram processados.
Trocar de modelo após uma sessão ou mensagem semanal não altera nada, pois essas janelas são compartilhadas entre todos os modelos. Apenas uma mensagem que especifica um modelo responde a /model.
Tentar novamente em loop não faz nada além de manter o seu terminal ocupado. O tempo de reinicialização exibido na mensagem é a resposta real, e /usage mostrará o mesmo relógio sem o erro.
FAQ
Quanto tempo falta para o meu limite do Claude ser reiniciado?
A mensagem informa o tempo. Os limites de sessão funcionam numa janela móvel de cinco horas e a mensagem mostra um horário, como resets 3:45pm. Os limites semanais são reiniciados num horário fixo a cada semana, atribuído à sua conta, e a mensagem mostra o dia, como resets Mon 12:00am. Para ver ambas as barras e os tempos de reinício antes de atingir qualquer limite, execute /usage no Claude Code ou abra as Configurações e depois Uso em claude.ai.
Mudar para o Sonnet faz com que eu volte a trabalhar?
Apenas quando a mensagem especifica um modelo. Após You've hit your Opus limit, execute /model, escolha um modelo diferente e a sessão continuará com o seu contexto intacto. Após You've hit your session limit ou You've hit your weekly limit, a escolha do modelo não faz diferença, pois essas janelas contabilizam todos os modelos em conjunto. Mudar para um modelo mais barato antes de atingir o limite é o que realmente estende a janela de uso.
Iniciar um novo chat reinicia o meu limite de uso?
Não. O uso é contabilizado na sua conta, portanto, um novo chat começa com a mesma franquia disponível. Isso torna cada mensagem subsequente mais barata, pois uma nova conversa não carrega histórico para o Claude reler. /clear no Claude Code faz o mesmo e não custa nada, enquanto /compact precisa ler a conversa que resume, portanto, compactar uma sessão muito grande é, por si só, uma solicitação dispendiosa.
A API é mais barata do que atualizar o meu plano?
Depende da constância do seu uso. A tarde de trabalho nesta página custa $2.26 no Sonnet 5 e $1.13 no Haiku 4.5, de acordo com as tabelas de preços de agosto de 2026. Uma assinatura é uma taxa fixa para uma franquia limitada, sendo vantajosa quando você trabalha na maioria dos dias. A cobrança por token é vantajosa quando a sua carga de trabalho é irregular, pois dias de pouco uso não lhe custam nada.
Posso manter um trabalho em execução enquanto aguardo o reinício?
Sim, se você o mover para fora da sua assinatura. Execute-o num VPS com ANTHROPIC_API_KEY definido no ambiente; assim, a cobrança será por token em vez de consumir a janela do seu plano, para que ambos nunca entrem em conflito. claude --bare -p dentro do tmux sobrevive ao fecho do seu portátil, e --output-format json escreve um campo total_cost_usd que pode verificar de manhã com jq.