Limite do Claude atingido: o que fazer agora
Veja qual janela do Claude foi atingida e escolha entre modelo menor, contexto reduzido, créditos de uso ou API, sem esperar pelo limite errado.
Qual limite do Claude você atingiu
A mensagem de limite atingido do Claude indica qual janela de tempo você está aguardando, e essa janela determina o que você pode fazer em seguida. Os limites da sessão e semanais abrangem todos os modelos ao mesmo tempo, portanto, mudar de modelo não restaura o seu acesso. Um limite que identifica um único modelo é a exceção: mude de modelo e continue a trabalhar enquanto esse modelo permanecer bloqueado.
O Claude Code mostra a janela e o horário da reposição na mesma linha:
You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pmA janela da sessão é móvel e dura cinco horas. As janelas semanais são repostas num horário fixo a cada semana, atribuído à sua conta, portanto, o dia e a hora permanecem iguais de uma semana para a seguinte. Um plano Pro tem a janela de sessão de cinco horas e um limite semanal que se aplica a todos os modelos. Um plano Max acrescenta um segundo limite semanal que se aplica apenas a uma família de modelos. Os próprios limites estão detalhados em a explicação completa dos limites de utilização do Claude. Esta página começa onde essa explicação termina.
Esta é a parte que costuma causar confusão. Cada pedido conta simultaneamente para a janela da sessão e para a janela semanal, portanto, uma tarde de utilização intensa pode esgotar a quota semanal enquanto ainda houver margem na janela de cinco horas. Consulte o horário da reposição antes de planear o resto do dia. Uma reposição às 3:45pm corresponde a uma pausa para café. Uma reposição na segunda-feira à meia-noite é diferente.
Leia o medidor antes de fazer suposições
No claude.ai, abra Settings e depois Usage. As barras de progresso mostram quanto da janela de sessão de cinco horas e de cada janela semanal você já consumiu. Assim, pode ver qual delas está esgotada em vez de fazer suposições.
No Claude Code, execute /usage. O comando mostra as mesmas barras do plano e uma discriminação da utilização recente, atribuída a skills, subagentes, plugins e servidores MCP (model context protocol) individuais, como percentagem do total. Prima d para ver as últimas 24 horas e w para ver os últimos 7 dias. O comando também assinala qualquer padrão que represente 10% ou mais da utilização recente. Os dois padrões mais comuns são contexto longo e falhas de cache.
Há duas ressalvas. A discriminação é calculada com base no histórico de sessões armazenado nessa máquina. Por isso, o trabalho feito noutro portátil ou no claude.ai não aparece. Além disso, o valor em dólares no bloco Session, no topo, é calculado com as tarifas de tabela padrão para utilizadores da API (application programming interface). Portanto, não corresponde ao valor da sua fatura quando utiliza uma subscrição.
Mudar para um modelo menor ajuda?
Apenas quando a mensagem identifica um modelo. Depois de You've hit your Opus limit, execute /model, escolha Sonnet ou Haiku e a sessão continua com todo o contexto. Depois de You've hit your session limit ou You've hit your weekly limit, /model não altera nada, porque essas janelas são partilhadas por todos os modelos.
A mudança é muito mais vantajosa antes de atingir o limite do que depois. O Sonnet executa a maior parte das tarefas de programação por uma fração do custo do Opus. Por isso, manter o Opus como modelo predefinido é um dos dois hábitos responsáveis pela maioria dos consumos inesperados. O outro é nunca limpar a sessão. Delegue edições mecânicas e a triagem de logs ao Haiku. Reserve o Opus para a decisão de arquitetura que realmente não consegue resolver. Escolher entre Opus, Sonnet e Haiku explica em que situações cada modelo justifica o seu custo.
Pare de pagar por contexto que deixou de usar
O Claude Code envia toda a sua conversa em cada pedido. Sempre que o Claude usa uma ferramenta, envia outro pedido com esse conjunto de resultados da ferramenta. O armazenamento em cache de prompts faz com que o histórico seja lido novamente à tarifa de cache, em vez da tarifa de entrada completa. Isso reduz o custo, mas não o elimina. Por isso, uma pergunta de uma linha numa sessão que está aberta desde a manhã continua a consumir utilização para toda a conversa.
/context
/clear
/compact Focus on the failing tests and the files we changed/clear não custa nada, porque elimina o contexto em vez de o ler. /compact tem de ler a conversa que resume. Por isso, compactar um contexto muito grande é, por si só, um pedido grande. Use /clear quando passar para um trabalho não relacionado. Use /compact apenas quando estiver a meio de uma tarefa e precisar de preservar o contexto. Execute /rename antes de limpar o contexto, para poder voltar a encontrar a sessão com /resume.
A duração do cache é mais importante do que a maioria das pessoas espera. Numa subscrição, o cache permanece disponível durante uma hora. Passa a cinco minutos quando começa a usar créditos de utilização. Cinco minutos também é o valor predefinido para uma API key. A primeira mensagem depois de um almoço prolongado não encontra o cache e processa novamente todo o contexto à tarifa de entrada completa. É por isso que a utilização muitas vezes aumenta sem uma razão visível. Quando o armazenamento em cache de prompts compensa explica os cálculos.
Há mais três mecanismos no mesmo local. /mcp apresenta os servidores configurados, para poder desativar os que esta tarefa não necessita. Um CLAUDE.md longo é carregado no início da sessão, seja ou não necessário para o trabalho. Por isso, mova as instruções especializadas para skills, que são carregadas apenas quando invocadas. O extended thinking é faturado como tokens de saída, que são a parte mais cara. Reduza-o com /effort, desative-o em /config ou defina MAX_THINKING_TOKENS=8000 num modelo com um orçamento fixo para o thinking.
Divida o trabalho para que caiba numa única janela
Prima Shift+Tab para alternar para o modo de planeamento antes de uma alteração extensa. Claude explora a base de código e propõe uma abordagem para sua aprovação. Corrigir uma direção errada nessa fase custa um plano, em vez de duas horas de edições e do trabalho necessário para as refazer.
Delegue operações que produzem muita saída a subagentes. Executar uma suite de testes ou ler um log com 10,000 linhas dentro de um subagente mantém a saída bruta no contexto desse subagente. Apenas o resumo regressa à conversa principal.
Prima Escape assim que Claude seguir numa direção errada. /rewind restaura a conversa e o código para um checkpoint anterior. Assim, não gasta recursos a desfazer trabalho que nunca pretendeu realizar.
Você deve comprar créditos de uso ou usar a API?
Os créditos de uso permitem que uma conta Pro ou Max continue a funcionar depois de atingir o limite do plano, com cobrança às tarifas padrão da API. Ative-os em Settings e depois em Usage no claude.ai, com um método de pagamento associado, ou execute /usage-credits no Claude Code. Esse comando abre as configurações de faturamento no navegador. Os créditos aplicam-se às conversas do Claude e ao uso do terminal do Claude Code, com um limite diário de resgate de $2000. O comando exige um login de assinatura. Por isso, não está disponível quando a autenticação é feita com uma chave de API.
A outra opção é usar uma chave de API simples do Claude Console. A cobrança é feita por token, sem qualquer janela de sessão ou semanal. Existe uma armadilha: uma variável ANTHROPIC_API_KEY esquecida no ambiente direciona o Claude Code por essa chave em vez da sua assinatura, sem indicar isso. Você só percebe pela fatura ou com este comando:
API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.Esse erro 429 é o limite de taxa da chave, não do seu plano. Execute /status e confirme se a credencial ativa é a que você pretendia usar.
Quanto custa uma tarde na API?
O exemplo calculado abaixo representa uma tarde de programação com agentes: 200,000 tokens de entrada sem cache, 1.8 milhões de leituras da cache e 150,000 tokens de saída. Os preços são as tarifas públicas da Anthropic em agosto de 2026. Todas essas tarifas são apresentadas por milhão de tokens. Se essa unidade ainda parecer abstrata, o valor real de um milhão de tokens converte-a numa quantidade de leitura e escrita que consegue visualizar.
The data behind this chart
[
{
"label": "Opus 5",
"input_usd_per_mtok": 5,
"cache_read_usd_per_mtok": 0.5,
"output_usd_per_mtok": 25,
"afternoon_usd": 5.65
},
{
"label": "Sonnet 5",
"input_usd_per_mtok": 2,
"cache_read_usd_per_mtok": 0.2,
"output_usd_per_mtok": 10,
"afternoon_usd": 2.26
},
{
"label": "Haiku 4.5",
"input_usd_per_mtok": 1,
"cache_read_usd_per_mtok": 0.1,
"output_usd_per_mtok": 5,
"afternoon_usd": 1.13
}
]A mesma tarde custa $5.65 no Opus 5 e $1.13 no Haiku 4.5. A saída é o que mais influencia o total: a $25 por milhão de tokens no Opus 5, contra $5 no Haiku 4.5, os 150,000 tokens que o Claude escreve custam mais do que os 2 milhões de tokens que lê. Por isso, reduzir o orçamento de raciocínio poupa mais do que reduzir os ficheiros.
Há uma data importante. O Sonnet 5 tem preços introdutórios de $2 e $10 por milhão de tokens de entrada e saída até 31 August 2026. Em 1 September 2026, os preços passam para $3 e $15. Com essa alteração, o custo da mesma tarde passa de $2.26 para cerca de $3.39.
Como é calculado cada valor de uma tarde
Opus 5: 200,000 tokens de entrada sem cache a $5 por milhão correspondem a $1.00. 1.8 milhões de leituras da cache, a um décimo da tarifa de entrada, correspondem a $0.90. 150,000 tokens de saída a $25 por milhão correspondem a $3.75. Total: $5.65.
Sonnet 5: $0.40 de entrada sem cache, $0.36 de leituras da cache e $1.50 de saída. Total: $2.26.
Haiku 4.5: $0.20 de entrada sem cache, $0.18 de leituras da cache e $0.75 de saída. Total: $1.13.
Todas as 3 linhas assumem as mesmas quantidades de tokens. Por isso, as diferenças entre elas resultam apenas do preço. Uma tarde real varia conforme a quantidade do contexto que permanece em cache.
Para dar uma referência de escala, a documentação da Anthropic indica que o gasto médio com Claude Code em implementações empresariais ronda os $13 por programador e por dia ativo. Para 90% dos utilizadores, fica abaixo de $30 por dia ativo, segundo os dados de agosto de 2026. A faturação por token não é automaticamente mais barata do que uma subscrição. É vantajosa quando a carga é irregular, porque os dias sem utilização não têm custo. É menos vantajosa quando trabalha todos os dias. A comparação entre a API e uma subscrição, com números reais mostra o ponto de equilíbrio.
Execute o trabalho demorado numa VPS durante a noite
Alguns trabalhos não precisam de supervisão: uma grande refatoração, uma migração de testes ou uma revisão abrangente da documentação. Esses trabalhos também não precisam de consumir a janela da sua subscrição. Coloque-os numa VPS (virtual private server) com uma chave de API. Assim, usam a faturação por token e mantêm intacta a quota do seu plano para o trabalho interativo do dia seguinte.
Instale o Claude Code numa máquina Ubuntu e confirme que funciona:
curl -fsSL https://claude.ai/install.sh | bash
claude --versionclaude --version deve apresentar uma versão, como 2.1.211 (Claude Code). Um command not found neste ponto significa que ~/.local/bin ainda não está no seu PATH. Abra uma nova shell e tente novamente.
Guarde a chave num ficheiro em vez de a deixar no histórico da shell. Crie ~/.claude-env num editor, com uma linha contendo export ANTHROPIC_API_KEY=sk-ant-your-key-here. Depois, restrinja as permissões do ficheiro e carregue-o:
chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10A última linha apresenta os primeiros dez caracteres. Isso é suficiente para confirmar que a variável está definida sem mostrar a chave completa no ecrã.
Agora inicie o trabalho dentro de tmux para que ele continue quando fechar o portátil:
tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
--allowedTools "Read,Edit,Bash" \
--append-system-prompt-file ./CLAUDE.md \
--output-format json > ~/overnight.jsonSepare-se da sessão com Ctrl-b e depois d, e feche a ligação. Volte a ligar-se mais tarde com tmux attach -t overnight. Claude Code numa sessão tmux numa VPS explica detalhadamente a gestão da sessão.
--bare é importante neste caso. Ignora a descoberta automática de hooks, skills, plugins e CLAUDE.md. Também nunca lê credenciais OAuth. Assim, a execução usa apenas a chave de API. É isso que mantém o trabalho fora da sua subscrição. Também significa que as regras do projeto deixam de estar disponíveis. Por isso, --append-system-prompt-file devolve-as explicitamente. Sem --bare, um ANTHROPIC_API_KEY definido desencadeia um pedido de aprovação único que uma execução não supervisionada não consegue responder.
De manhã, leia o resultado e o custo a partir do JSON:
jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.jsonO Claude Code termina com o código 0 quando é bem-sucedido e com um código diferente de zero quando a execução falha. Assim, um script wrapper pode verificar o estado de saída e enviar-lhe a notificação da falha por e-mail. Defina um limite de gastos para o workspace na Claude Console antes de deixar o trabalho em execução. Um agente preso num ciclo de novas tentativas às 3am pode gastar dinheiro real. Reduza CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY se também quiser limitar a velocidade. Controlo de custos para agentes deixados em execução apresenta os limites que deve definir primeiro.
Dê ao trabalho um utilizador próprio sem privilégios e uma branch própria do git. Um agente que edita um repositório sem supervisão ocasionalmente fará algo que você teria interrompido. Uma branch transforma isso num git checkout, em vez de num incidente. Execução segura de um agente de programação numa VPS explica como fazer o isolamento.
Para trabalho em massa que não é interativo, como classificar milhares de registos, a Batch API processa os pedidos de forma assíncrona com um desconto de 50% nos tokens de entrada e de saída. É a opção com menor custo por token publicada pela Anthropic, e uma execução durante a noite corresponde exatamente à latência necessária.
O que não recupera o seu acesso
Iniciar uma nova conversa não restaura a sua franquia. O uso é contabilizado na sua conta, não numa conversa. No entanto, cada mensagem seguinte fica mais barata, porque uma conversa nova não tem histórico para reler. Por isso, ainda vale a pena fazê-lo. É uma redução de custo, não uma reposição.
Eliminar conversas antigas não devolve nada. Esses tokens foram consumidos quando foram processados.
Mudar de modelo depois de atingir o limite da sessão ou das mensagens semanais não altera nada, porque essas janelas são partilhadas por todos os modelos. Apenas uma mensagem que indique um modelo responde a /model.
Repetir a tentativa num ciclo não altera nada e apenas mantém o terminal ocupado. A hora de reposição apresentada na mensagem é a resposta correta, e /usage mostra a mesma hora sem o erro.
FAQ
Quanto tempo falta para o meu limite do Claude ser reposto?
A mensagem informa-o. Os limites da sessão funcionam numa janela móvel de cinco horas, e a mensagem mostra uma hora, como resets 3:45pm. Os limites semanais são repostos numa hora fixa todas as semanas, definida para a sua conta, e a mensagem mostra o dia, como resets Mon 12:00am. Para ver ambas as barras e ambas as horas de reposição antes de atingir qualquer limite, execute /usage no Claude Code ou abra Settings e depois Usage em claude.ai.
Mudar para o Sonnet permite-me voltar a trabalhar?
Só quando a mensagem indicar um modelo. Depois de You've hit your Opus limit, execute /model, escolha outro modelo e a sessão continua com o contexto intacto. Depois de You've hit your session limit ou You've hit your weekly limit, a escolha do modelo não faz diferença, porque essas janelas contabilizam todos os modelos em conjunto. Mudar para um modelo mais barato antes de atingir o limite é o que efetivamente prolonga a janela.
Iniciar uma nova conversa repõe o meu limite de utilização?
Não. A utilização é contabilizada na sua conta, por isso uma nova conversa começa com a mesma margem disponível. No entanto, cada mensagem seguinte fica mais barata, porque uma conversa nova não tem histórico para o Claude reler. /clear no Claude Code faz o mesmo e não tem custos, enquanto /compact tem de ler a conversa que resume. Por isso, compactar uma sessão muito grande é, por si só, um pedido dispendioso.
A API é mais barata do que atualizar o meu plano?
Depende da regularidade da sua utilização. A tarde de trabalho apresentada nesta página custa $2.26 com Sonnet 5 e $1.13 com Haiku 4.5, segundo os preços de tabela de August 2026. Uma subscrição é uma taxa fixa por uma margem limitada, por isso é vantajosa quando trabalha na maioria dos dias. A faturação por token é vantajosa quando a carga é irregular, porque os dias sem utilização não têm qualquer custo.
Posso manter um trabalho em execução enquanto aguardo a reposição?
Sim, se o retirar da sua subscrição. Execute-o num VPS com ANTHROPIC_API_KEY definido no ambiente. Nesse caso, a faturação é feita por token em vez de consumir a janela do seu plano, e os dois nunca competem entre si. claude --bare -p dentro de tmux continua em execução mesmo que feche o portátil, e --output-format json escreve um campo total_cost_usd que pode verificar de manhã com jq.