A Claude API tem nível gratuito? Veja custos e créditos
A Claude API não tem plano gratuito: há créditos iniciais não divulgados, contagem de tokens sem custo e tarifas de julho de 2026, com exemplo para um app pequeno.
A Claude API tem um nível gratuito?
A Claude API não tem um nível gratuito. Não existe uma franquia mensal de tokens gratuitos nem um plano que possa utilizar por $0. O que uma conta nova recebe é uma pequena quantidade de créditos gratuitos para testar a API, mas a Anthropic não divulga essa quantidade. Depois de gastar esses créditos, todos os pedidos são descontados de um saldo que carregou previamente.
Essa é a resposta direta. O restante deste guia explica as consequências: que partes da plataforma não têm qualquer custo, por que esta é uma questão diferente do plano gratuito das aplicações Claude e qual é a forma mais económica e transparente de pôr um primeiro programa a funcionar.
O que é gratuito numa conta da Claude API
Vários componentes da plataforma não têm custos de tokens. São mais importantes do que pode parecer.
- Contagem de tokens. O endpoint de contagem de tokens é gratuito. Tem o seu próprio limite de pedidos por minuto, separado da criação de mensagens. Assim, medir um prompt não reduz o orçamento disponível para o enviar.
- A própria Console. Criar uma organização, consultar a página de utilização e abrir o Workbench não tem custos. Executar um prompt no Workbench é um pedido normal à API. Essa operação fatura tokens como qualquer outra chamada.
- Operações com ficheiros. Carregar, listar e eliminar ficheiros através da Files API é gratuito. Só paga quando o conteúdo de um ficheiro entra num pedido como tokens de entrada.
- Obtenção de conteúdo da Web. A ferramenta de obtenção de conteúdo da Web não acrescenta custos além dos tokens do conteúdo que introduz na conversa. A pesquisa na Web não é gratuita: custa $10 por 1,000 pesquisas desde July 2026.
- Execução de código, até certo limite. Cada organização recebe 1,550 horas gratuitas de contentores por mês desde July 2026. Depois disso, o custo é de $0.05 por hora e por contentor. A execução de código não tem custos adicionais quando é executada em conjunto com a pesquisa na Web ou com a obtenção de conteúdo da Web.
Nada disso constitui um nível gratuito. Significa que a medição é transparente: paga pela inferência, não pela infraestrutura auxiliar.
Calcule os tokens antes de pagar
Como a contagem é gratuita, pode verificar primeiro o tamanho exato de um pedido. Este é o mesmo endpoint usado pelos SDKs e aceita o mesmo corpo que uma mensagem real.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-haiku-4-5",
"system": "You are a scientist",
"messages": [{"role": "user", "content": "Hello, Claude"}]
}'Uma resposta normal é uma única linha de JSON: {"input_tokens": 14}. Multiplique esse valor pela tarifa de entrada do seu modelo para saber o custo do pedido antes de o enviar. Se receber HTTP 401 com authentication_error, a chave está incorreta ou foi revogada. A contagem funciona mesmo numa conta sem crédito, porque não é gerado conteúdo.
Por que esta é uma questão diferente do plano gratuito nos aplicativos
As pessoas pesquisam sobre os dois, mas quase não há relação entre eles. O plano gratuito dos aplicativos Claude é um produto real que pode ser usado durante bastante tempo sem cartão, com consumo medido por uma janela móvel de utilização. O que o nível gratuito do Claude realmente inclui explica o que ele oferece e quando é reposto. A API funciona com consumo pré-pago e não tem esse plano associado.
A consequência que costuma causar confusão é que uma assinatura e uma chave de API são carteiras separadas. Pagar pelo Pro não financia uma chave, e os créditos da API não aumentam o limite de utilização do chat. Se estiver a escolher entre os dois, em vez de tentar evitar qualquer pagamento, Custo da API do Claude versus uma assinatura apresenta os cálculos para cargas de trabalho reais. A exceção é o Claude Enterprise, que coloca o preço por utilizador e o consumo de tokens medido às tarifas da API na mesma fatura. Como funciona o preço por utilizador do Enterprise explica o que o mínimo de utilizadores inclui antes de o consumo começar a ser medido.
Quanto custa cada pedido depois de esgotar os créditos
Estas são as tarifas da API oficial em julho de 2026, por milhão de tokens.
The data behind this chart
[
{
"label": "Haiku 4.5",
"input_usd": 1,
"output_usd": 5
},
{
"label": "Sonnet 5, intro rate",
"input_usd": 2,
"output_usd": 10
},
{
"label": "Opus 5",
"input_usd": 5,
"output_usd": 25
}
]O Haiku 4.5 cobra 1 dólar por milhão de tokens de entrada e 5 dólares por milhão de tokens de saída. O Opus 5 cobra 5 e 25 pelos mesmos volumes, pelo que o modelo escolhido pode multiplicar uma fatura por 5 antes de qualquer ajuste do prompt. O valor do Sonnet 5 é uma tarifa introdutória válida até 31 de agosto de 2026. Depois disso, volta a $3 e $15. A saída custa cinco vezes mais do que a entrada em todos eles. Este é o facto mais útil desta página: uma resposta longa custa mais do que uma pergunta longa. qual modelo Claude deve utilizar compara-os numa tarefa concreta. O Fable 5 fica acima dos três, com $10 por milhão de tokens de entrada e $50 por milhão de tokens de saída. Por isso, vale a pena esclarecer o que essas tarifas realmente compram antes de lhe confiar qualquer tarefa rotineira.
Os caminhos reais mais baratos para experimentar
Quatro medidas resolvem quase tudo, e nenhuma depende de desconto.
- Comece pelo modelo mais pequeno que passe no seu teste. Classificação, extração, etiquetagem e encaminhamento raramente precisam de um modelo de fronteira. Haiku 4.5 custa um quinto do preço do Opus 5 e responde mais depressa.
- Defina um limite para
max_tokens. Este é o teto rígido para os tokens gerados, e a saída é a parte mais cara. Um classificador que responde com uma palavra não deve ter um orçamento de 16,000 tokens. - Armazene em cache a parte do prompt que nunca muda. Uma leitura da cache custa 10% do preço base de entrada e uma gravação de cache de cinco minutos custa 1.25x, por isso a cache compensa após uma única leitura. O armazenamento em cache usa correspondência por prefixo. O texto estável tem de vir primeiro e a pergunta variável por último. Caso contrário, nada corresponde e paga o custo adicional da gravação sem obter benefício.
- Use processamento em lote para tudo o que não seja interativo. A Message Batches API oferece um desconto de 50% tanto na entrada como na saída, e a maioria dos lotes termina em menos de uma hora. Tarefas noturnas, preenchimentos retroativos e execuções de avaliação devem ser colocados aí.
Um custo calculado para a primeira aplicação pequena
Considere um script de resumo de logs: 1,000 chamadas, cada uma enviando cerca de 800 tokens de entrada de linhas de log e recebendo cerca de 200 tokens de resumo. Isso corresponde a 800,000 tokens de entrada e 200,000 tokens de saída no Haiku 4.5.
The data behind this chart
[
{
"label": "Standard rates",
"cost_usd": "1.80"
},
{
"label": "Same job on the Batch API",
"cost_usd": "0.90"
}
]A conta é de 0.8 milhões de tokens de entrada a $1 mais 0.2 milhões de tokens de saída a $5, totalizando 1.80 dólares. Enviado como um lote, o mesmo trabalho custa 0.90. Um saldo de crédito inicial cobre muitos testes nessa escala. Por isso, a ausência de um nível gratuito afeta os custos muito mais tarde do que se espera. Para o tutorial completo num servidor que controla, criar uma primeira aplicação Claude API num VPS aborda a gestão de chaves, o streaming e os caminhos de erro.
Os níveis de utilização são limites máximos, não valores disponíveis
A API coloca automaticamente cada organização num nível de utilização, com base no histórico de utilização e na situação da conta. Os níveis chamam-se Start, Build, Scale e Custom. Cada nível define limites de taxa e um limite máximo de despesa mensal. Em julho de 2026, os limites máximos são $500 no Start, $1,000 no Build e $200,000 no Scale. O Custom não tem limite máximo.
Interprete isto como um limite, não como um crédito. Estar no nível Start não significa que tem $500 disponíveis para gastar. Significa que não pode gastar mais de $500 num mês civil. Quando atingir esse valor, a utilização fica suspensa até ao mês seguinte. Também pode definir um limite de despesa inferior ao limite máximo do nível. Essa deve ser a primeira medida em qualquer conta associada a um cartão, porque um ciclo descontrolado é uma forma muito mais comum de perder dinheiro do que o preço por token.
O que fazer quando o uso gratuito é um requisito obrigatório
Se o orçamento for realmente zero e tiver de continuar assim, a API não é a ferramenta certa, e comparar planos não muda esse facto. Restam duas opções honestas. Use o plano gratuito nas aplicações Claude para trabalho interativo, aceitando que o uso é limitado por janela e que não existe um endpoint programável. Ou execute um modelo de pesos abertos num hardware alugado. Nesse caso, substitui uma cobrança por token por uma cobrança de servidor que pode controlar: executar Ollama numa VPS para alojar um LLM localmente explica a memória necessária para cada tamanho de modelo e o que os modelos pequenos conseguem realmente fazer. Se a janela de utilização for a verdadeira limitação, e não o dinheiro, Claude Pro a $20 por mês aumenta esse limite nas aplicações por menos do que muitas primeiras faturas da API, embora continue sem disponibilizar algo que possa chamar a partir de código. Se estiver a comparar fornecedores, e não apenas planos da mesma linha, planos Claude e ChatGPT comparados pelos preços apresenta em conjunto os escalões gratuitos e pagos de ambos, incluindo qual fica mais barato para trabalho de programação. E se uma subscrição que já paga fizer parte da despesa que está a tentar eliminar, cancelar ou baixar o nível desse plano mantém o mês que já comprou e impede a cobrança do mês seguinte.
Para qualquer situação intermédia, a resposta prática é usar uma chave com saldo, definir um limite de despesa baixo, escolher um modelo pequeno e ativar o armazenamento em cache de prompts desde o primeiro dia.
FAQ
A API do Claude é gratuita?
Não. Não existe um plano gratuito nem uma franquia mensal de tokens gratuita. As contas novas recebem uma pequena quantidade de créditos gratuitos para testar a API. Depois disso, cada pedido usa créditos pré-pagos ou o cartão registado. Algumas partes da plataforma não têm custo, incluindo a contagem de tokens, o carregamento e a eliminação de ficheiros e a ferramenta de obtenção de conteúdo da Web, sem contar os tokens do conteúdo obtido.
Recebo créditos gratuitos quando crio uma conta para a API do Claude?
Sim, uma pequena quantidade. A Anthropic não publica o valor. Considere-a suficiente para confirmar que a integração funciona, não como um orçamento para desenvolver a solução. Os créditos de avaliação prolongada para avaliações empresariais são tratados através da equipa comercial da Anthropic e não são atribuídos automaticamente.
Pagar o Claude Pro ou Max inclui acesso à API?
Não. Uma subscrição e uma chave de API são faturadas separadamente e têm medição diferente. Os planos Pro e Max aumentam o limite de utilização nas aplicações Claude. Uma chave de API usa créditos pré-pagos e tem limites por minuto para pedidos e tokens. Se precisar dos dois, terá de pagar os dois.
Qual é a forma mais barata de testar a API do Claude?
Conte primeiro os tokens, porque esse endpoint é gratuito. Depois, execute o teste no Haiku 4.5 com um max_tokens rigoroso, coloque em cache qualquer prompt de sistema fixo para que as chamadas repetidas leiam 10% do preço dos tokens de entrada e envie tudo o que não for interativo através da Batch API, a metade do preço. Com essas definições, mil chamadas pequenas custam pouco mais de um dólar em julho de 2026.