SSD Nodes Learn Hosting plans →
Guias Matt ConnorPor Matt Connor · Atualizado 2026-09-01

A API da Claude tem plano gratuito?

A Claude API não oferece nível gratuito: há apenas créditos iniciais não divulgados. Veja os preços de julho de 2026 e o custo calculado de um app pequeno.

A API da Claude tem um nível gratuito?

A API da Claude não tem nível gratuito. Não existe uma franquia mensal de tokens gratuitos nem um plano que possa manter por $0. Uma conta nova recebe apenas uma pequena quantidade de créditos gratuitos para testar a API, e a Anthropic não publica essa quantidade. Depois de gastar esses créditos, cada pedido utiliza um saldo que pagou antecipadamente.

Essa é a resposta direta. O restante deste guia explica as consequências: que partes da plataforma não têm qualquer custo, por que razão esta é uma questão diferente do plano gratuito das aplicações Claude e qual é a forma mais barata, sem custos ocultos, de colocar o primeiro programa a funcionar.

O que é gratuito numa conta da Claude API

Vários componentes da plataforma não têm custo de tokens, e são mais importantes do que pode parecer.

  • Contagem de tokens. O endpoint de contagem de tokens é gratuito. Tem o seu próprio limite de pedidos por minuto, separado da criação de mensagens. Por isso, medir um prompt nunca reduz o orçamento disponível para o enviar.
  • A própria Console. Criar uma organização, consultar a página de utilização e abrir o Workbench não tem custos. Executar um prompt no Workbench é um pedido normal à API. Essa parte fatura tokens como qualquer outra chamada.
  • Operações com ficheiros. Carregar, listar e eliminar ficheiros através da Files API é gratuito. Só paga quando o conteúdo de um ficheiro entra num pedido como tokens de entrada.
  • Obtenção de conteúdo da Web. A ferramenta de obtenção de conteúdo da Web não acrescenta custos além dos tokens do conteúdo que introduz na conversa. A pesquisa na Web não é gratuita: custa $10 por 1.000 pesquisas em julho de 2026.
  • Execução de código, até certo limite. Cada organização recebe 1.550 horas gratuitas de contentores por mês em julho de 2026. Depois disso, o custo é de $0.05 por hora e por contentor. A execução de código não tem custo adicional quando é executada juntamente com a pesquisa na Web ou a obtenção de conteúdo da Web.

Nada disso constitui um nível gratuito. Significa que a medição é transparente: paga pela inferência, e não pela infraestrutura que a suporta. A obtenção gratuita de conteúdo da Web funciona bem com fontes de dados que também sejam gratuitas. Executar análises de ações e opções com uma API de dados de mercado sem chave é um exemplo prático em que o único custo corresponde aos tokens que os dados obtidos acrescentam ao prompt.

Estime o custo de um prompt antes de o pagar

Como a contagem é gratuita, pode determinar primeiro o tamanho exato de um pedido. Este é o mesmo endpoint que os SDKs encapsulam e aceita o mesmo corpo que uma mensagem real.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "content-type: application/json" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-haiku-4-5",
    "system": "You are a scientist",
    "messages": [{"role": "user", "content": "Hello, Claude"}]
  }'

Uma resposta normal é uma linha de JSON: {"input_tokens": 14}. Multiplique esse valor pela tarifa de entrada do seu modelo para saber o custo do pedido antes de o enviar. Se receber HTTP 401 com authentication_error, a chave está errada ou foi revogada. Se a chave parecer correta e a chamada continuar sem autenticar, ou se estiver a aceder ao Claude através do Bedrock, Vertex ou Foundry em vez de uma chave da Anthropic, as quatro formas de autenticar um cliente explica o que cada método requer e onde guardar a credencial. A contagem funciona mesmo numa conta sem crédito disponível, porque não é gerado qualquer conteúdo.

Por que esta é uma questão diferente do plano gratuito nas aplicações

As pessoas procuram as duas coisas, mas quase não têm relação entre si. O plano gratuito das aplicações Claude é um produto real que pode utilizar durante bastante tempo sem cartão, com o consumo medido por uma janela de utilização móvel. O que o nível gratuito do Claude inclui explica o que está incluído e quando o limite é reposto. A API usa medição pré-paga e não tem esse plano associado.

A consequência que causa mais confusão é que uma subscrição e uma chave de API são carteiras separadas. Pagar pelo Pro não financia uma chave, e os créditos da API não aumentam o limite de conversação. O Claude Code é onde esta separação causa mais confusão, porque pode funcionar com qualquer uma das duas opções. Se o Claude Code está incluído no Pro explica quais os planos que o incluem e quando passa silenciosamente a faturar uma chave. Se está a escolher entre as duas opções, em vez de tentar evitar qualquer pagamento, Custo da API Claude versus uma subscrição apresenta os cálculos com cargas de trabalho reais. A exceção é o Claude Enterprise, que coloca no mesmo recibo um preço por lugar e o consumo de tokens medido às tarifas da API. Como funciona o preço dos lugares do Enterprise explica o que o mínimo de lugares inclui antes de o consumo começar a ser medido.

Quanto custa uma solicitação depois de esgotar os créditos

Estas são as tarifas da API oficial em julho de 2026, por milhão de tokens.

ChartClaude API rates per million tokens, July 2026
The data behind this chart
[
  {
    "label": "Haiku 4.5",
    "input_usd": 1,
    "output_usd": 5
  },
  {
    "label": "Sonnet 5, intro rate",
    "input_usd": 2,
    "output_usd": 10
  },
  {
    "label": "Opus 5",
    "input_usd": 5,
    "output_usd": 25
  }
]

O Haiku 4.5 cobra 1 dólar por milhão de tokens de entrada e 5 dólares por milhão de tokens de saída. O Opus 5 cobra 5 e 25 pelos mesmos volumes. Portanto, o modelo escolhido pode multiplicar a fatura por 5 antes de qualquer ajuste do prompt. O valor do Sonnet 5 é uma tarifa introdutória válida até 31 August 2026. Depois disso, volta a $3 e $15. A saída custa cinco vezes mais do que a entrada em todos eles. Este é o dado mais útil desta página: uma resposta longa custa mais do que uma pergunta longa. qual modelo Claude deve utilizar compara-os num trabalho prático. O Fable 5 fica acima dos três, com $10 por milhão de tokens de entrada e $50 por milhão de tokens de saída. Por isso, vale a pena definir o que essas tarifas realmente compram antes de lhe atribuir qualquer tarefa de rotina.

Os caminhos mais baratos para fazer experiências de verdade

Quatro medidas resolvem quase tudo, e nenhuma depende de um desconto.

  • Comece pelo modelo mais pequeno que passe no seu teste. Classificação, extração, etiquetagem e encaminhamento raramente precisam de um modelo de ponta. Haiku 4.5 custa um quinto do preço do Opus 5 e responde mais depressa.
  • Defina um limite para max_tokens. É o teto rígido dos tokens gerados, e a saída é a parte mais cara. Um classificador que responde com uma palavra não deve ter um orçamento de 16,000 tokens.
  • Coloque em cache a parte do prompt que nunca muda. Uma leitura da cache custa 10% do preço base de entrada, e uma gravação com cache de cinco minutos custa 1.25x. Por isso, a cache compensa ao fim de uma única leitura. O armazenamento em cache compara prefixos. O texto estável tem de vir primeiro e a pergunta variável por último. Caso contrário, nada corresponde e paga o acréscimo da gravação sem benefício.
  • Use processamento em lote para tudo o que não for interativo. A Message Batches API aplica um desconto de 50% tanto à entrada como à saída, e a maioria dos lotes termina em menos de uma hora. Tarefas noturnas, preenchimentos retroativos e execuções de avaliação devem usar este método.

Um cálculo de custos para uma primeira aplicação pequena

Considere um script de resumo de logs: 1,000 chamadas, cada uma a enviar cerca de 800 tokens de entrada de linhas de log e a receber cerca de 200 tokens de saída com o resumo. Isso corresponde a 800,000 tokens de entrada e 200,000 tokens de saída no Haiku 4.5.

Chart1,000 calls at 800 input and 200 output tokens, Haiku 4.5
The data behind this chart
[
  {
    "label": "Standard rates",
    "cost_usd": "1.80"
  },
  {
    "label": "Same job on the Batch API",
    "cost_usd": "0.90"
  }
]

O cálculo é de 0.8 milhões de tokens de entrada a $1 mais 0.2 milhões de tokens de saída a $5, o que totaliza 1.80 dólares. Se o mesmo trabalho for enviado como batch, o custo será 0.90. Um saldo de crédito inicial cobre muitos testes nessa escala. Por isso, a ausência de um nível gratuito só se torna um problema muito mais tarde do que as pessoas esperam. Para o guia completo num servidor que controla, criar uma primeira aplicação Claude API num VPS aborda a gestão de chaves, o streaming e os caminhos de erro.

Os níveis de utilização são limites máximos, não valores disponíveis

A API coloca automaticamente cada organização num nível de utilização, com base no histórico de utilização e na situação da conta. Os níveis chamam-se Start, Build, Scale e Custom. Cada nível define limites de taxa e um limite máximo de despesa mensal. Em julho de 2026, os limites máximos são $500 no Start, $1,000 no Build e $200,000 no Scale. O Custom não tem limite máximo.

Interprete isto como um limite, não como um crédito. Estar no nível Start não significa que tenha $500 para gastar. Significa que não pode gastar mais de $500 num mês civil. Quando atingir esse valor, a utilização fica suspensa até ao mês seguinte. Também pode definir um limite de despesa inferior ao limite máximo do nível. Essa deve ser a primeira medida em qualquer conta associada a um cartão, porque um ciclo descontrolado é uma forma muito mais comum de perder dinheiro do que o preço por token.

O que fazer quando o requisito é custo zero

Se o orçamento for realmente zero e tiver de continuar assim, a API não é a ferramenta certa. Nenhuma comparação entre planos altera esse facto. Restam duas opções honestas. Use o plano gratuito das aplicações Claude para trabalho interativo, aceitando que o uso é medido por janela e que não existe um endpoint programável. Ou execute um modelo de pesos abertos em hardware alugado. Nesse caso, troca uma cobrança por token por uma cobrança de servidor que controla: executar o Ollama numa VPS para alojar um LLM localmente explica a memória necessária para cada tamanho de modelo e o que os modelos pequenos conseguem realmente fazer. Se a janela de utilização, e não o dinheiro, for a verdadeira limitação, Claude Pro por $20 por mês aumenta esse limite nas aplicações por menos do que muitas primeiras faturas da API, embora continue sem fornecer uma forma de fazer chamadas a partir de código. Saber se vale a pena pagar esses $20 depende da frequência com que o limite gratuito realmente o impede de trabalhar. um guia de decisão para o Pro analisa essa questão com base em padrões de utilização reais. Se estiver a comparar fornecedores diferentes, e não apenas planos da mesma linha, planos Claude e ChatGPT comparados pelo preço reúne os níveis gratuitos e pagos de ambos, incluindo qual fica mais barato para trabalho de programação. Se uma subscrição que já paga fizer parte da despesa que está a tentar eliminar, cancelar ou fazer downgrade desse plano mantém o mês já pago e impede a cobrança do mês seguinte.

Para qualquer situação intermédia, a resposta prática é usar uma chave com saldo, definir um limite de despesa baixo, escolher um modelo pequeno e ativar o armazenamento em cache de prompts desde o primeiro dia.

FAQ

A Claude API é gratuita?

Não. Não existe nível gratuito nem franquia mensal de tokens sem custo. As contas novas recebem uma pequena quantidade de créditos gratuitos para testar a API. Depois disso, cada pedido usa créditos pré-pagos ou o cartão registado. Algumas partes da plataforma não têm custo, incluindo a contagem de tokens, o carregamento e a eliminação de ficheiros e a ferramenta de obtenção de conteúdo da Web, exceto os tokens do conteúdo obtido.

Recebo créditos gratuitos quando crio uma conta na Claude API?

Sim, uma pequena quantidade, mas a Anthropic não publica o valor. Considere-a suficiente para confirmar que a integração funciona, não como um orçamento para desenvolver a solução. Os créditos de avaliação prolongada para empresas são disponibilizados através da equipa comercial da Anthropic. Não são atribuídos automaticamente.

Pagar o Claude Pro ou Max inclui acesso à API?

Não. A subscrição e a chave da API são faturadas separadamente e têm medição diferente. Os planos Pro e Max aumentam o seu limite nas aplicações Claude. Uma chave da API usa créditos pré-pagos e tem limites por minuto, tanto para pedidos como para tokens. Se precisar dos dois, terá de pagar os dois.

Qual é a forma mais barata de testar a Claude API?

Conte primeiro os tokens, porque esse endpoint é gratuito. Em seguida, execute o teste no Haiku 4.5 com um max_tokens reduzido, coloque em cache qualquer prompt de sistema fixo para que as chamadas repetidas sejam cobradas a 10% do preço dos tokens de entrada e envie tudo o que não for interativo através da Batch API, com metade do preço. Com estas definições, mil chamadas pequenas custam pouco mais de um dólar em julho de 2026.