A API do Claude tem nível gratuito?
Não há nível gratuito: a conta nova recebe créditos de valor não divulgado. Veja as tarifas de julho de 2026 e o custo real de um primeiro app.
A API do Claude tem um nível gratuito?
A API do Claude não tem nível gratuito. Não há uma franquia mensal de tokens gratuitos nem um plano que você possa usar por $0. Uma conta nova recebe apenas uma pequena quantidade de créditos gratuitos para testar a API, e a Anthropic não publica esse valor. Depois que esses créditos são consumidos, cada solicitação usa um saldo que você pagou.
Essa é a resposta direta. O restante deste guia mostra as consequências: quais partes da plataforma não têm custo algum, por que essa é uma questão diferente do plano gratuito nos aplicativos do Claude e qual é a maneira mais barata e realista de colocar um primeiro programa em funcionamento.
O que é gratuito em uma conta da Claude API
Vários recursos da plataforma não geram cobrança de tokens, e são mais importantes do que parecem.
- Contagem de tokens. O endpoint de contagem de tokens é gratuito. Ele tem seu próprio limite de requisições por minuto, separado da criação de mensagens. Assim, medir um prompt nunca reduz o orçamento para enviá-lo.
- O Console. Criar uma organização, consultar a página de uso e abrir o Workbench não gera cobrança. Executar um prompt no Workbench é uma requisição comum da API. Essa parte gera cobrança de tokens como qualquer outra chamada.
- Operações com arquivos. Fazer upload, listar e excluir arquivos pela Files API é gratuito. Você paga apenas quando o conteúdo de um arquivo entra em uma requisição como tokens de entrada.
- Busca na web. A ferramenta de busca na web não acrescenta cobrança além dos tokens do conteúdo que ela obtém e adiciona à conversa. A pesquisa na web não é gratuita: custa $10 por 1.000 pesquisas em julho de 2026.
- Execução de código, até certo limite. Cada organização recebe 1,550 horas gratuitas de container por mês em julho de 2026. Depois disso, o custo é de $0.05 por hora por container. A execução de código não tem custo adicional quando ocorre junto com a pesquisa na web ou a busca na web.
Nada disso constitui um plano gratuito. Isso significa que a medição é transparente: você paga pela inferência, não pelos componentes auxiliares.
Calcule o preço de um prompt antes de pagar por ele
Como a contagem é gratuita, você pode descobrir primeiro o tamanho exato de uma solicitação. Este é o mesmo endpoint usado pelos SDKs e ele recebe o mesmo corpo de uma mensagem real.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-haiku-4-5",
"system": "You are a scientist",
"messages": [{"role": "user", "content": "Hello, Claude"}]
}'Uma resposta normal é uma linha de JSON: {"input_tokens": 14}. Multiplique esse valor pela tarifa de entrada do seu modelo para saber o custo da solicitação antes de enviá-la. Se você receber HTTP 401 com authentication_error, a chave está incorreta ou foi revogada. A contagem funciona mesmo em uma conta sem crédito, porque nada é gerado.
Por que esta é uma pergunta diferente do plano gratuito nos aplicativos
As pessoas pesquisam pelos dois, mas eles quase não têm relação entre si. O plano gratuito nos aplicativos Claude é um produto real que pode ser usado por muito tempo sem cartão, com uso medido por uma janela contínua, e o que o nível gratuito do Claude realmente inclui explica o que ele oferece e quando é redefinido. A API usa cobrança pré-paga, sem esse plano associado.
A consequência que costuma causar confusão é que uma assinatura e uma chave de API são carteiras separadas. Pagar pelo Pro não financia uma chave, e os créditos da API não aumentam seu limite de uso no chat. Se você está escolhendo entre os dois, em vez de tentar evitar qualquer pagamento, custo da API do Claude versus uma assinatura apresenta os cálculos com cargas de trabalho reais.
Quanto custa uma solicitação depois que os créditos acabam
Estas são as tarifas da API do fornecedor, em julho de 2026, por milhão de tokens.
The data behind this chart
[
{
"label": "Haiku 4.5",
"input_usd": 1,
"output_usd": 5
},
{
"label": "Sonnet 5, intro rate",
"input_usd": 2,
"output_usd": 10
},
{
"label": "Opus 5",
"input_usd": 5,
"output_usd": 25
}
]O Haiku 4.5 cobra 1 dólar por milhão de tokens de entrada e 5 dólares por milhão de tokens de saída. O Opus 5 cobra 5 e 25 pelos mesmos volumes. Portanto, o modelo escolhido altera o valor da fatura em 5x antes mesmo de qualquer ajuste no prompt. O valor do Sonnet 5 é uma tarifa introdutória válida até 31 de agosto de 2026. Depois disso, volta para $3 e $15. O custo da saída é cinco vezes maior que o da entrada em todos eles. Esse é o fato mais útil desta página: uma resposta prolixa custa mais que uma pergunta longa. qual modelo Claude você deve usar compara os modelos em uma tarefa prática.
Os caminhos reais mais baratos para fazer experimentos
Quatro alavancas respondem por quase todo o resultado, e nenhuma exige desconto.
- Comece pelo menor modelo que passe no seu teste. Classificação, extração, marcação e roteamento raramente precisam de um modelo de ponta. Haiku 4.5 custa um quinto do preço do Opus 5 e responde mais rápido.
- Limite
max_tokens. Esse é o teto rígido para os tokens gerados, e a saída é a parte mais cara. Um classificador que responde com uma palavra não deve ter um orçamento de 16,000 tokens. - Armazene em cache a parte do prompt que nunca muda. Uma leitura do cache custa 10% do preço base da entrada, e uma gravação no cache de cinco minutos custa 1.25x. Portanto, o cache se paga após uma única leitura. O cache usa correspondência de prefixo. Isso significa que o texto estável deve vir primeiro e a pergunta variável, por último. Caso contrário, nada corresponde e você paga o adicional da gravação sem obter benefício.
- Coloque em lote tudo que não for interativo. A Message Batches API oferece 50% de desconto tanto na entrada quanto na saída, e a maioria dos lotes termina em menos de uma hora. Tarefas noturnas, preenchimentos retroativos e execuções de avaliação devem usar esse recurso.
Um cálculo de custo para um primeiro aplicativo pequeno
Considere um script de resumo de logs: 1,000 chamadas, cada uma enviando cerca de 800 tokens de entrada de linhas de log e recebendo cerca de 200 tokens de saída de resumo. Isso corresponde a 800,000 tokens de entrada e 200,000 tokens de saída no Haiku 4.5.
The data behind this chart
[
{
"label": "Standard rates",
"cost_usd": "1.80"
},
{
"label": "Same job on the Batch API",
"cost_usd": "0.90"
}
]O cálculo é 0.8 milhão de tokens de entrada a $1 mais 0.2 milhão de tokens de saída a $5, totalizando 1.80 dólares. Enviado como um batch, o mesmo trabalho custa 0.90. Um saldo inicial de créditos cobre muitos testes nessa escala. Por isso, a ausência de um nível gratuito só causa impacto muito mais tarde do que as pessoas esperam. Para o passo a passo completo em um servidor sob seu controle, criando um primeiro aplicativo da Claude API em um VPS aborda o gerenciamento de chaves, o streaming e os caminhos de erro.
Os níveis de uso são limites máximos, não valores disponíveis
A API coloca automaticamente cada organização em um nível de uso, com base no histórico de uso e na situação da conta. Os níveis são Start, Build, Scale e Custom. Cada nível define limites de taxa e um limite máximo de gastos mensais. Em julho de 2026, os limites são $500 no Start, $1,000 no Build e $200,000 no Scale. O Custom não tem limite.
Considere isso como um limite, não como um crédito. Estar no nível Start não significa que você tem $500 disponíveis para gastar. Significa que você não pode gastar mais de $500 em um mês do calendário. Depois disso, o uso é pausado até o mês seguinte. Você também pode definir seu próprio limite de gastos, abaixo do limite máximo do nível. Essa deve ser a primeira configuração em qualquer conta associada a um cartão, porque um loop descontrolado é uma forma muito mais comum de perder dinheiro do que o preço por token.
O que fazer se o uso gratuito for um requisito obrigatório
Se o orçamento for realmente zero e precisar continuar assim, a API é a ferramenta errada, e comparar planos não muda isso. Restam duas opções honestas. Use o plano gratuito nos aplicativos Claude para trabalho interativo, aceitando que ele é limitado por janela e não oferece um endpoint programável. Ou execute um modelo de pesos abertos no hardware que você aluga. Isso troca uma cobrança por token por uma cobrança de servidor que você controla: executar Ollama em um VPS para hospedar um LLM por conta própria explica quanta memória cada tamanho de modelo exige e o que os modelos menores conseguem fazer.
Para qualquer situação intermediária, a resposta prática é usar uma chave com saldo, definir um limite baixo de gastos, escolher um modelo pequeno e ativar o cache de prompts desde o primeiro dia.
FAQ
A Claude API é gratuita?
Não. Não existe nível gratuito nem cota mensal de tokens gratuitos. Novas contas recebem uma pequena quantidade de créditos gratuitos para testar a API. Depois disso, cada solicitação consome créditos pré-pagos ou usa o cartão cadastrado. Algumas partes da plataforma não têm custo, incluindo a contagem de tokens, o upload e a exclusão de arquivos e a ferramenta de busca na web, exceto pelos tokens do conteúdo buscado.
Recebo créditos gratuitos quando crio uma conta na Claude API?
Sim, uma pequena quantidade, mas a Anthropic não divulga o valor. Considere-a suficiente para comprovar que a integração funciona, não como um orçamento para desenvolvimento. Créditos adicionais de avaliação para empresas são negociados com a equipe de vendas da Anthropic. Eles não são concedidos automaticamente.
Pagar pelo Claude Pro ou Max inclui acesso à API?
Não. A assinatura e a chave de API são cobradas separadamente e usam métricas diferentes. Os planos Pro e Max aumentam sua cota dentro dos aplicativos Claude. Uma chave de API consome créditos pré-pagos e tem limites por minuto para solicitações e tokens. Se você precisa dos dois, deve pagar pelos dois.
Qual é a forma mais barata de testar a Claude API?
Conte seus tokens primeiro, pois esse endpoint é gratuito. Depois, execute o teste no Haiku 4.5 com um max_tokens rigoroso, armazene em cache qualquer prompt de sistema fixo para que as chamadas repetidas leiam 10% do preço de entrada e envie pela Batch API, pela metade do preço, tudo que não for interativo. Com essas configurações, mil chamadas pequenas custam pouco mais de um dólar em julho de 2026.