Como resolver o limite de uso atingido no Claude
Recebeu a mensagem de limite atingido no Claude? Entenda a diferenca entre janelas de sessao e semanais, como alternar modelos e quando usar a API para evitar bloqueios.
Qual limite do Claude você atingiu
Uma mensagem de limite atingido do Claude indica a janela de tempo pela qual você está aguardando, e essa janela determina o que você pode fazer em seguida. Os limites de sessão e semanais abrangem todos os modelos simultaneamente, portanto, alternar entre modelos não restaura seu acesso. Um limite que especifica um único modelo é a exceção: alterne os modelos e você continuará trabalhando enquanto aquele modelo específico permanece bloqueado.
O Claude Code exibe a janela e o horário de reinicialização na mesma linha:
You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pmA janela de sessão é um período móvel de cinco horas. As janelas semanais são reiniciadas em um horário fixo a cada semana, atribuído à sua conta, de modo que o dia e a hora permanecem os mesmos de uma semana para a outra. Um plano Pro possui a janela de sessão de cinco horas, além de um limite semanal que se aplica a todos os modelos. Um plano Max adiciona um segundo limite semanal que se aplica a uma família de modelos específica. Os limites em si estão detalhados em detalhamento completo dos limites de uso do Claude. Esta página começa onde aquela termina.
Aqui está o ponto que confunde os usuários. Cada solicitação é contabilizada na janela de sessão e na janela semanal ao mesmo tempo; portanto, uma tarde de uso intenso pode esgotar a cota semanal enquanto a janela de cinco horas ainda possui capacidade disponível. Verifique o horário de reinicialização antes de planejar o restante do seu dia. Uma reinicialização às 15:45 é apenas uma pausa para o café. Uma reinicialização na segunda-feira à meia-noite, não.
Verifique o medidor antes de supor
No claude.ai, abra Settings e depois Usage. Barras de progresso mostram quanto da janela de sessão de cinco horas e de cada janela semanal você consumiu, permitindo identificar qual delas está vazia em vez de supor.
No Claude Code, execute /usage. Ele exibe as mesmas barras de plano, além de um detalhamento de onde o uso recente foi aplicado, atribuído a skills, subagentes, plugins e servidores MCP (model context protocol) individuais como uma porcentagem do total. Pressione d para as últimas 24 horas e w para os últimos 7 dias. Ele também sinaliza qualquer padrão que represente 10% ou mais do uso recente, sendo os dois que você verá com mais frequência o contexto longo e as falhas de cache (cache misses).
Duas ressalvas. O detalhamento é calculado a partir do histórico de sessão armazenado nessa máquina, portanto, o trabalho realizado em outro laptop ou no claude.ai não aparece nele, embora tenha consumido a mesma franquia, porque Claude Code e seus chats no claude.ai compartilham a mesma janela de assinatura. E o valor em dólares no bloco Session no topo é precificado pelas taxas de lista padrão para usuários de API (application programming interface), o que significa que não é o valor da sua fatura quando você está em uma assinatura.
Mudar para um modelo menor ajuda?
Apenas quando a mensagem especifica um modelo. Após You've hit your Opus limit, execute /model, escolha Sonnet ou Haiku, e a sessão continuará com todo o contexto. Após You've hit your session limit ou You've hit your weekly limit, /model não altera nada, pois essas janelas são partilhadas entre todos os modelos.
A mudança é muito mais valiosa antes de atingir o limite do que depois. O Sonnet lida com a maior parte do trabalho de programação por uma fração do custo do Opus, portanto, manter o Opus como padrão é um dos dois hábitos responsáveis pela maioria dos consumos inesperados. O outro é uma sessão que nunca é limpa. Delegue edições mecânicas e triagem de logs ao Haiku, e reserve o Opus para decisões de design nas quais esteja genuinamente bloqueado. Escolhendo entre Opus, Sonnet e Haiku detalha onde cada um justifica o seu preço.
Pare de pagar por contexto que você não utiliza mais
O Claude Code envia toda a sua conversa a cada solicitação, e sempre que o Claude utiliza uma ferramenta, ele envia outra solicitação contendo esse conjunto de resultados da ferramenta. O cache de prompt significa que o histórico é lido na taxa de cache em vez da taxa de entrada completa, o que o torna mais barato, mas não gratuito. Portanto, uma pergunta de uma linha em uma sessão que você mantém aberta desde a manhã ainda consome uso de todo o histórico da conversa.
/context
/clear
/compact Focus on the failing tests and the files we changed/clear não custa nada, pois descarta o contexto em vez de lê-lo. /compact precisa ler a conversa que resume, portanto, compactar um contexto muito grande é, por si só, uma solicitação grande. Use /clear quando mudar para um trabalho não relacionado, e /compact apenas quando estiver no meio de uma tarefa e precisar que a thread seja mantida. Execute /rename antes de limpar para que você possa encontrar a sessão novamente com /resume.
O tempo de vida do cache importa mais do que a maioria das pessoas imagina. Em uma assinatura, o cache dura uma hora. Ele cai para cinco minutos assim que você começa a usar créditos de uso, e cinco minutos também é o padrão em uma API key. Sua primeira mensagem após um longo almoço perde o cache e reprocessa todo o contexto pelo preço total de entrada, que é o motivo pelo qual o uso frequentemente aumenta sem um motivo visível. Onde o cache de prompt compensa cobre os cálculos.
Três alavancas adicionais estão no mesmo lugar. /mcp lista seus servidores configurados para que você possa desativar aqueles que esta tarefa não precisa. Um CLAUDE.md longo é carregado no início da sessão, independentemente de o trabalho precisar dele ou não; portanto, mova instruções especializadas para skills, que são carregadas apenas quando invocadas. Além disso, o extended thinking é cobrado como tokens de saída, que é a metade cara; portanto, reduza-o com /effort, desative-o em /config ou defina MAX_THINKING_TOKENS=8000 em um modelo com um orçamento de pensamento fixo.
Divida a tarefa para que caiba numa única janela
Pressione Shift+Tab para alternar para o modo de plano antes de uma alteração grande. O Claude explora a base de código e propõe uma abordagem para a sua aprovação; uma direção errada detetada nesta fase custa um plano em vez de duas horas de edições e retrabalho.
Delegue operações ruidosas para subagentes. Executar uma suíte de testes ou ler um log de 10.000 linhas dentro de um subagente mantém a saída bruta no contexto desse subagente, e apenas o resumo retorna para a sua conversa principal.
Pressione Escape no momento em que o Claude seguir uma direção errada. /rewind restaura tanto a conversa quanto o código para um ponto de verificação anterior, para que você não pague para desfazer um trabalho que nunca quis.
Você deve comprar créditos de uso ou usar a API?
Os créditos de uso permitem que uma conta Pro ou Max continue funcionando após o limite do plano, sendo cobrados conforme as taxas padrão da API. Ative-os em Settings e depois em Usage no claude.ai com um método de pagamento vinculado, ou execute /usage-credits no Claude Code, o que abrirá suas configurações de faturamento no navegador. Os créditos se aplicam às conversas no Claude e ao uso do terminal no Claude Code, com um limite diário de resgate de $2000. O comando exige um login de assinatura, portanto, não está disponível quando você se autentica com uma API key. No plano gratuito, os créditos não são oferecidos, então o primeiro passo é assinar o Pro por $20 mensais, e o que o Pro adiciona e onde seus limites o impedem detalha até onde isso o leva. Se você estiver recarregando créditos na maioria das semanas, uma franquia maior geralmente é o hábito mais barato, e a diferença entre os níveis Max de $100 e $200 é um multiplicador de uso, e não qualquer diferença em modelos ou recursos.
A outra alternativa é uma API key simples do Claude Console, cobrada por token, sem qualquer sessão ou janela semanal. Uma armadilha comum: um ANTHROPIC_API_KEY perdido no seu ambiente roteia o Claude Code através dessa chave em vez da sua assinatura, sem aviso prévio. Você descobre pela fatura ou por isto:
API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.Esse erro 429 é o limite de taxa na chave, não no seu plano. Execute /status e confirme se a credencial ativa é a que você pretendia usar.
Quanto custa uma tarde na API?
O exemplo prático abaixo representa uma tarde de codificação com agentes: 200.000 tokens de entrada não armazenados em cache, 1,8 milhão de leituras de cache e 150.000 tokens de saída. Os preços seguem as tabelas da Anthropic em agosto de 2026. Cada uma dessas taxas é cotada por milhão de tokens; se essa unidade ainda parece abstrata, o que um milhão de tokens realmente representa converte esse valor em uma quantidade de leitura e escrita que você consegue visualizar.
The data behind this chart
[
{
"label": "Opus 5",
"input_usd_per_mtok": 5,
"cache_read_usd_per_mtok": 0.5,
"output_usd_per_mtok": 25,
"afternoon_usd": 5.65
},
{
"label": "Sonnet 5",
"input_usd_per_mtok": 2,
"cache_read_usd_per_mtok": 0.2,
"output_usd_per_mtok": 10,
"afternoon_usd": 2.26
},
{
"label": "Haiku 4.5",
"input_usd_per_mtok": 1,
"cache_read_usd_per_mtok": 0.1,
"output_usd_per_mtok": 5,
"afternoon_usd": 1.13
}
]A mesma tarde custa $5.65 no Opus 5 e $1.13 no Haiku 4.5. A saída é o que eleva o total: a $25 por milhão de tokens no Opus 5 contra $5 no Haiku 4.5, os 150.000 tokens que o Claude escreve custam mais do que os 2 milhões de tokens que ele lê. É por isso que reduzir o orçamento de processamento economiza mais do que cortar arquivos. Se a dúvida é qual provedor pagar em vez de qual modelo executar, três tarefas custeadas tanto na API do Claude quanto na do ChatGPT mostra onde cada fatura se torna mais vantajosa.
Uma data importante: o Sonnet 5 está com preço promocional de $2 e $10 por milhão de tokens de entrada e saída até 31 de agosto de 2026, passando para $3 e $15 em 1 de setembro de 2026, o que eleva o custo da mesma tarde de $2.26 para cerca de $3,39.
Como cada valor da tarde é calculado
Opus 5: 200.000 tokens de entrada não armazenados em cache a $5 por milhão totalizam $1,00. 1,8 milhão de leituras de cache a um décimo da taxa de entrada totalizam $0,90. 150.000 tokens de saída a $25 por milhão totalizam $3,75. Total $5.65.
Sonnet 5: $0,40 de entrada não armazenada em cache, $0,36 de leituras de cache, $1,50 de saída. Total $2.26.
Haiku 4.5: $0,20 de entrada não armazenada em cache, $0,18 de leituras de cache, $0,75 de saída. Total $1.13.
Todas as 3 linhas assumem as mesmas contagens de tokens, portanto as diferenças entre elas são puramente de preço. Uma tarde real varia conforme a quantidade de contexto que permanece em cache.
Para fins de escala, a própria documentação da Anthropic situa o gasto médio com o Claude Code em implementações corporativas próximo de $13 por desenvolvedor por dia ativo, e abaixo de $30 por dia ativo para 90% dos usuários, em agosto de 2026. A cobrança por token não é automaticamente mais barata do que uma assinatura. Ela é vantajosa quando a carga é irregular, pois dias de pouco uso não geram custos, e torna-se desvantajosa quando você trabalha todos os dias. A API versus uma assinatura, comparada com números reais apresenta o ponto de equilíbrio.
Executar tarefas longas num VPS durante a noite
Algumas tarefas não exigem a sua supervisão: uma grande refatoração, uma migração de teste ou uma revisão de documentação. Estas tarefas também não precisam da sua janela de subscrição. Coloque-as num VPS (servidor privado virtual) com uma API key e elas utilizarão a faturação por token, enquanto a sua franquia do plano permanece intacta para o trabalho interativo do dia seguinte.
Instale o Claude Code numa máquina Ubuntu e confirme que este é executado:
curl -fsSL https://claude.ai/install.sh | bash
claude --versionO comando claude --version deve imprimir uma string de versão, como 2.1.211 (Claude Code). Um command not found aqui significa que o ~/.local/bin ainda não está no seu PATH; portanto, abra um novo shell e tente novamente. Esse mesmo instalador é o que você executaria num desktop Linux, onde a CLI funciona ao lado da aplicação desktop beta e dos plugins de editor.
Coloque a chave num ficheiro em vez de a deixar no histórico do seu shell. Crie o ~/.claude-env num editor com uma linha, export ANTHROPIC_API_KEY=sk-ant-your-key-here, depois restrinja as permissões e carregue-a:
chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10Essa última linha imprime os primeiros dez caracteres, o que é suficiente para confirmar que a variável está definida sem exibir a chave completa no ecrã.
Agora inicie a tarefa dentro do tmux para que ela sobreviva ao fecho do seu portátil:
tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
--allowedTools "Read,Edit,Bash" \
--append-system-prompt-file ./CLAUDE.md \
--output-format json > ~/overnight.jsonDesconecte-se com Ctrl-b seguido de d e feche a ligação. Reconecte-se mais tarde com tmux attach -t overnight. Claude Code numa sessão tmux num VPS aborda o manuseamento de sessões na íntegra.
O --bare é importante aqui. Ele ignora a descoberta automática de hooks, skills, plugins e do ficheiro CLAUDE.md, e nunca lê credenciais OAuth, pelo que a execução utiliza apenas a API key. É isso que mantém a tarefa fora da sua subscrição. Também significa que as regras do projeto são ignoradas, razão pela qual o --append-system-prompt-file as devolve deliberadamente. Sem o --bare, um ANTHROPIC_API_KEY definido aciona um pedido de aprovação único que uma execução não assistida não consegue responder.
De manhã, leia o resultado e o custo a partir do JSON:
jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.jsonO Claude Code termina com o código 0 em caso de sucesso e um valor diferente de zero quando a execução falha; assim, um script de suporte pode ramificar-se com base no estado de saída e enviar-lhe um e-mail em caso de falha. Defina um limite de gastos para o workspace na Claude Console antes de o deixar a correr: um agente num ciclo de reintento às 3 da manhã é uma forma real de gastar dinheiro real. Reduza o CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY se também quiser abrandar o processo. Controlo de custos para agentes que deixa a correr detalha os limites que vale a pena definir primeiro.
Dê à tarefa o seu próprio utilizador sem privilégios e a sua própria branch de git. Um agente a editar um repositório sem supervisão fará ocasionalmente algo que você teria impedido, e uma branch transforma isso num git checkout em vez de um incidente. Executar um agente de codificação em segurança num VPS aborda o isolamento.
Para trabalho em massa que não é de todo interativo, como classificar milhares de registos, a Batch API processa pedidos de forma assíncrona com um desconto de 50% tanto nos tokens de entrada como nos de saída. É a rota por token mais barata publicada pela Anthropic, e uma janela noturna é exatamente a latência que ela requer.
O que não recupera o seu acesso
Só o tempo repõe a sua cota, por isso todas as supostas formas de repor um limite de utilização do Claude deixam de funcionar quando são analisadas com atenção.
Iniciar uma nova conversa não restaura o seu limite de utilização. O uso é contabilizado na sua conta, não na conversa. Iniciar uma nova conversa torna cada mensagem subsequente mais barata, pois uma conversa nova não carrega histórico para ser reprocessado; portanto, ainda é uma prática recomendada. É uma redução de custo, não uma reinicialização.
Apagar conversas antigas não gera reembolsos. Esses tokens foram consumidos no momento em que foram processados.
Trocar de modelo após atingir o limite de sessão ou o limite semanal não surte efeito, pois essas janelas são compartilhadas entre todos os modelos. Apenas uma mensagem que especifica um modelo responde a /model.
Tentar repetir o comando em loop não faz nada além de manter o seu terminal ocupado. O tempo de reinicialização exibido na mensagem é a resposta real, e /usage mostrará o mesmo relógio sem o erro.
A atualização é a única medida que aumenta os limites. Se eles não mudarem depois do pagamento, analise por que motivo um novo plano pode manter os limites antigos antes de concluir que a franquia está com problemas.
FAQ
Quanto tempo falta para o meu limite do Claude ser reiniciado?
A mensagem informa o tempo. Os limites de sessão operam numa janela móvel de cinco horas e a mensagem apresenta uma hora específica, como resets 3:45pm. Os limites semanais são reiniciados num horário fixo semanal atribuído à sua conta, e a mensagem apresenta o dia, como resets Mon 12:00am. Para visualizar ambas as barras e os tempos de reinício antes de atingir qualquer limite, execute /usage no Claude Code ou abra as Configurações e, em seguida, Uso em claude.ai.
Mudar para o Sonnet faz com que eu volte a trabalhar?
Apenas quando a mensagem especifica um modelo. Após You've hit your Opus limit, execute /model, escolha um modelo diferente e a sessão continuará com o seu contexto intacto. Após You've hit your session limit ou You've hit your weekly limit, a escolha do modelo não faz diferença, pois essas janelas contabilizam todos os modelos em conjunto. Mudar para um modelo mais económico antes de atingir o limite é o que realmente estende a janela de utilização.
Iniciar um novo chat reinicia o meu limite de uso?
Não. O uso é contabilizado na sua conta, portanto, um novo chat começa com a mesma franquia disponível. Iniciar um novo chat torna cada mensagem subsequente mais barata, pois uma nova conversa não carrega histórico para o Claude reler. /clear no Claude Code faz o mesmo e não tem custo, enquanto /compact precisa ler a conversa que resume; portanto, compactar uma sessão muito grande é, por si só, uma solicitação dispendiosa.
A API é mais barata do que atualizar o meu plano?
Depende da regularidade do seu uso. Uma tarde de trabalho nesta página custa $2.26 no Sonnet 5 e $1.13 no Haiku 4.5, de acordo com as tabelas de preços de agosto de 2026. Uma assinatura é uma taxa fixa para uma franquia limitada, sendo vantajosa quando trabalha na maioria dos dias. A cobrança por token é vantajosa quando a sua carga de trabalho é irregular, pois dias de inatividade não geram custos.
Posso manter um trabalho em execução enquanto aguardo o reinício?
Sim, se o remover da sua assinatura. Execute-o num VPS com ANTHROPIC_API_KEY definido no ambiente; assim, a cobrança é feita por token em vez de consumir a janela do seu plano, evitando que ambos compitam. claude --bare -p dentro do tmux sobrevive ao fecho do seu portátil, e --output-format json escreve um campo total_cost_usd que pode verificar de manhã com jq.