SSD Nodes Learn 🎉 VPS desde $4.99/mês
Guias Matt ConnorPor Matt Connor · Atualizado 2026-08-07

Claude ou ChatGPT API: qual custa menos?

Compare Claude e ChatGPT com a aritmética de tokens, três cargas de trabalho com custos calculados e o ponto em que a conta do Claude fica mais alta.

Resposta curta

Não há um vencedor único na comparação de preços das APIs Claude e ChatGPT, porque os dois fornecedores definem preços diferentes para tokens de entrada e de saída em cada nível. Em agosto de 2026, os dois níveis superiores do Claude cobram o mesmo preço por token de entrada que os equivalentes da OpenAI e menos por token de saída. Por isso, o Claude fica ligeiramente à frente em cargas de trabalho com muito conteúdo de saída. No nível mais baixo, o Claude custa várias vezes mais para o mesmo trabalho. Qualquer resposta que não indique um nível e uma combinação de tokens é uma estimativa.

Por isso, esta página apresenta primeiro a aritmética, depois três cargas de trabalho com custos calculados e as respetivas combinações de tokens, e, por fim, os multiplicadores que podem afetar uma fatura real mais do que a tarifa anunciada.

A única fórmula de que precisa

As duas APIs faturam o texto da mesma forma. Paga pelos tokens que envia e paga uma tarifa mais elevada pelos tokens que o modelo devolve.

cost = (input tokens / 1,000,000) * input rate + (output tokens / 1,000,000) * output rate

Um token corresponde a cerca de 4 caracteres em inglês, ou aproximadamente 0.75 de uma palavra. Use este valor apenas para uma primeira estimativa. Para obter o valor real, use as contagens devolvidas por cada API no objeto usage de cada resposta.

# Rates are US dollars per million tokens.
def cost(in_tok, out_tok, in_rate, out_rate):
    return in_tok / 1e6 * in_rate + out_tok / 1e6 * out_rate

# One support-chat turn: 1,400 tokens in, 220 tokens out, on a $2 / $10 model.
print(round(cost(1400, 220, 2.0, 10.0), 6))

O script apresenta 0.005, que corresponde a meio cêntimo por interação. Multiplique esse valor pelo número de interações previsto para um mês e terá um orçamento. Se a unidade de um milhão de tokens nesse denominador parecer abstrata, o que um milhão de tokens compra realmente no Claude apresenta uma quantidade concreta de texto. Aprenda esta fórmula e cada alteração de preços futura passa a exigir uma edição de uma linha, em vez de uma nova análise.

As tarifas publicadas, agosto de 2026

Estas são as tarifas de tabela que ambos os fornecedores publicaram em 1 de agosto de 2026. Este bloco é o único local do artigo onde é indicado um preço. Consulte-o em claude.com/pricing e na página de preços da OpenAI antes de aprovar um orçamento.

ChartList prices in US dollars per million tokens, August 2026
The data behind this chart
[
  {
    "label": "Frontier",
    "claude_input": 5,
    "claude_output": 25,
    "openai_input": 5,
    "openai_output": 30
  },
  {
    "label": "Workhorse",
    "claude_input": 2,
    "claude_output": 10,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Workhorse from September",
    "claude_input": 3,
    "claude_output": 15,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Small",
    "claude_input": 1,
    "claude_output": 5,
    "openai_input": 0.2,
    "openai_output": 1.2
  }
]

As correspondências são feitas pela posição em cada linha de produtos, não pela popularidade. Na categoria Frontier, a comparação é entre Claude Opus 5 e gpt-5.6-sol. Na categoria Workhorse, é entre Claude Sonnet 5 e gpt-5.6-terra. Na categoria Small, é entre Claude Haiku 4.5 e gpt-5.6-luna. Ambos os fornecedores também vendem níveis superiores aos deste bloco, e a OpenAI mantém as gerações anteriores listadas com as tarifas originais. Comparar um modelo topo de linha de um lado com um modelo económico do outro produz um número sem significado. É assim que a maioria das comparações publicadas chega ao título.

É preciso destacar dois pontos desse bloco. As tarifas 2 e 10 do Sonnet 5 são tarifas introdutórias. A Anthropic informa que terminam em 31 de agosto de 2026. Depois dessa data, o Sonnet 5 passa a cobrar 3 e 15. Essa única alteração transforma a categoria Workhorse de uma vantagem estreita do Claude numa vantagem clara da OpenAI. Além disso, a alteração ocorre durante o período de validade deste artigo.

O segundo ponto é um padrão que vale a pena memorizar: o Claude cobra pelo output exatamente 5 vezes a sua própria tarifa de input em todas as linhas acima, enquanto a OpenAI cobra 6 vezes. É essa proporção, e não a tarifa absoluta, que faz o vencedor mudar conforme a combinação de tokens.

Por que uma tarifa por milhão de tokens não pode ser comparada entre fornecedores

Uma tarifa é um valor em dólares por token. Uma fatura é o valor em dólares por token multiplicado pelo número de tokens, e a contagem de tokens de um texto é uma propriedade do modelo, não do texto.

A Anthropic documenta isto diretamente: os modelos Claude 4.7 e posteriores, incluindo Claude Opus 5 e Claude Sonnet 5, usam um tokenizador mais recente que produz aproximadamente 30% mais tokens para o mesmo texto do que o Claude Sonnet 4.6 e versões anteriores. A tarifa não mudou. A fatura mudou.

Por isso, duas tarifas visualmente idênticas não correspondem a duas faturas idênticas. Conte os tokens dos dois lados, usando o seu próprio texto, antes de confiar em qualquer comparação, incluindo esta.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "messages": [{"role": "user", "content": "Summarise the attached contract."}]
  }'

Uma resposta válida é um pequeno objeto JSON que contém input_tokens. Um 401 significa que a variável-chave está vazia na sua shell. Execute o mesmo texto no tokenizador do outro fornecedor, divida uma contagem pela outra e multiplique essa proporção pela tarifa publicada antes de comparar. Se a proporção favorecer um fornecedor por mais de aproximadamente 1.2, esse fator supera qualquer diferença entre as tarifas do bloco acima.

Cenário um: uma funcionalidade de chat

Um assistente de suporte integrado numa aplicação Web. 120,000 interações por mês. Cada interação envia um prompt de sistema, esquemas de ferramentas, dois excertos recuperados da base de conhecimento do suporte e algumas mensagens anteriores, num total aproximado de 1,400 tokens de entrada; o modelo responde com cerca de 220 tokens. Como é interativo, o desconto de processamento em lote nunca pode ser aplicado. Execute-o no nível de modelos robustos.

ChartChat feature, monthly cost in US dollars, 120,000 turns
The data behind this chart
[
  {
    "label": "List price",
    "claude_usd": "600.00",
    "openai_usd": "652.80"
  },
  {
    "label": "Cached prefix",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Small tier, cached",
    "claude_usd": "213.60",
    "openai_usd": "48.00"
  }
]

Ao preço de tabela, o Claude cobra 600.00, contra 652.80 da OpenAI. Os componentes de entrada são idênticos, porque as tarifas de entrada são iguais. Toda a diferença está na saída, e o Claude leva vantagem por uma margem demasiado pequena para escolher um fornecedor com base nela.

Agora marque 800 desses 1,400 tokens de entrada como um prefixo estável: o prompt de sistema e os esquemas de ferramentas, que não mudam entre interações. Ambos os fornecedores cobram 10% da tarifa de entrada base por uma entrada encontrada na cache. A fatura do Claude desce para 427.20 e a da OpenAI para 480.00. A colocação em cache vale mais do que a escolha do fornecedor, e ambas as plataformas a oferecem.

É aqui que o Claude perde. A maioria das respostas de suporte não precisa de um modelo robusto. Mova o mesmo tráfego para o nível de modelos pequenos e o Claude cobra 213.60, enquanto a OpenAI cobra 48.00. Divida um pelo outro e verá que o Claude custa cerca de quatro vezes e meia mais pelo mesmo trabalho. O Claude Haiku 4.5 cobra 1 por milhão de tokens de entrada, contra 0.2 do gpt-5.6-luna, e nenhum nível de colocação em cache elimina uma diferença de cinco vezes. Se a sua carga de trabalho for adequada para um modelo pequeno, a OpenAI é mais barata e a margem é grande.

Cenário dois: um pipeline de documentos com contexto longo

25,000 contratos por mês. Cada pedido inclui a mesma instrução de 9,000 tokens e o mesmo esquema JSON, seguidos de 12,000 tokens de texto contratual. O modelo devolve cerca de 700 tokens de campos estruturados. A saída representa menos de 4% dos tokens deste trabalho, e esse único facto determina a comparação.

ChartMonthly cost in US dollars, three workloads, cached and paired like-for-like
The data behind this chart
[
  {
    "label": "Chat feature",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Document pipeline",
    "claude_usd": "820.00",
    "openai_usd": "855.00"
  },
  {
    "label": "Coding agent",
    "claude_usd": "116.10",
    "openai_usd": "124.20"
  }
]

Com o prefixo de 9,000 tokens em cache em ambos os lados, a Claude cobra 820.00 e a OpenAI cobra 855.00. Os custos de entrada coincidem ao cêntimo, porque as tarifas de entrada dos modelos principais são iguais em agosto de 2026. Toda a diferença está no custo de saída, definido como 5 vezes o custo de entrada na Claude e 6 vezes na OpenAI.

Este trabalho também pode usar processamento em lote. Ambos os fornecedores reduzem em 50% os custos de entrada e de saída para trabalho assíncrono. Assim, ambos os totais ficam reduzidos a metade e a diferença mantém-se proporcional. O processamento em lote é o maior desconto individual em qualquer uma das plataformas, e um pipeline noturno de documentos pode utilizá-lo sempre.

A desvantagem da Claude resulta da mesma lógica de escalões referida anteriormente. A extração de campos com base num esquema fixo é precisamente o tipo de trabalho em que um modelo pequeno tem bom desempenho, e a entrada representa 97% dos tokens neste caso. Descer um escalão multiplica a tarifa de entrada da OpenAI por 0.1 e a da Claude por 0.5. Teste o modelo pequeno em 200 documentos antes de concluir que precisa do modelo maior, usando a mesma avaliação que utilizaria para escolher o escalão Claude adequado para um trabalho.

Cenário três: um agente de programação sempre ativo

Um programador a executar um agente numa VPS, com cerca de 900 interações do modelo por mês. Cada interação inclui cerca de 60,000 tokens de entrada de contexto do repositório, dos quais 80% são acertos de cache, e produz cerca de 1,800 tokens de alterações e explicações. Calcule o preço no nível frontier, porque, na programação, uma diferença de capacidade tem um custo financeiro real.

O Claude cobra 116.10, contra 124.20 da OpenAI. A mesma tarifa de entrada, a mesma tarifa de leitura de cache e a tarifa de saída mais baixa do Claude resultam numa vantagem de cerca de 7%.

Esses 7% estão dentro da margem de erro do tokenizer referida anteriormente, por isso considere este cenário um empate nas tarifas. O que não é um empate é o modelo de faturação. Para um programador com este volume, uma subscrição por utilizador normalmente custa menos do que chamadas de API faturadas por utilização, e a comparação muda completamente quando se inclui uma subscrição. Analise a comparação entre o custo da API e o custo da subscrição antes de colocar um agente em faturação por utilização. Se optar pela faturação por utilização, descubra primeiro para onde vão os tokens, porque a utilização de tokens por um agente de programação é dominada pelo contexto reenviado em cada interação, e não pelo código que escreve.

Os multiplicadores que determinam a fatura

A tarifa anunciada é o item menos importante desta lista. Cada fator abaixo altera uma fatura real mais do que a diferença entre os dois fornecedores no mesmo nível.

Entrada em cache. Ambos os fornecedores cobram 10% da entrada base quando ocorre um cache hit. A Anthropic também cobra pela gravação no cache: 1.25 vezes a entrada base para uma entrada de cinco minutos e 2 vezes para uma entrada de uma hora. Um hit posterior prolonga a validade dessa entrada ao preço de leitura. Assim, uma entrada de cinco minutos é amortizada depois de uma leitura. Uma carga de trabalho com intervalos longos entre pedidos grava mais vezes do que lê; nesse caso, o cache custa mais do que poupa. O tráfego constante aproveita bem o cache. O tráfego em rajadas não.

Descontos de batch. Há um desconto de 50% na entrada e na saída em ambas as plataformas, apenas para trabalho assíncrono. Se o trabalho puder esperar, isto reduz a fatura para metade em qualquer fornecedor e acumula com o uso de cache.

Proporção de saída. O Claude cobra 5 vezes a tarifa de entrada pela saída. A OpenAI cobra 6 vezes. Quanto mais tokens forem escritos em vez de lidos, mais vantajoso fica o Claude com a mesma tarifa de entrada. O inverso aplica-se a cargas de trabalho dominadas pela entrada.

Novas tentativas. Uma nova tentativa cobra novamente toda a entrada e não devolve nada utilizável. Se 6% das chamadas falharem na validação do schema e forem repetidas, a componente de entrada será 6% maior do que o previsto no plano. Registe as novas tentativas como uma linha de custo, não como uma linha de erro. As equipas costumam identificar este multiplicador por último, e ele é frequentemente maior do que a diferença entre fornecedores sobre a qual passaram uma semana a discutir.

Quem perde e em que ponto

Claude perde claramente no nível básico. gpt-5.6-luna cobra 0.2 por milhão de tokens de entrada, enquanto Claude Haiku 4.5 cobra 1, com a saída a 1.2 contra 5. A classificação de grande volume e a extração curta custam aproximadamente quatro vezes mais no Claude.

Claude perde no nível principal a partir de 1 September 2026, quando a tarifa introdutória termina e o Sonnet 5 passa para 3 e 15, contra um gpt-5.6-terra sem alterações. Claude ganha no nível de fronteira na tarifa de saída, mas a margem pode desaparecer com os seus próprios volumes de tokens. Nenhum dos lados ganha em cargas de trabalho dominadas pela entrada em August 2026, porque, a 2 por milhão em ambos os lados, os custos de entrada são iguais.

Como medir isto no seu próprio tráfego

Leia o objeto usage em cada resposta e armazene quatro números por pedido: tokens de entrada, tokens de saída, tokens lidos da cache e tokens escritos na cache. Na Claude API, esses valores aparecem como input_tokens, output_tokens, cache_read_input_tokens e cache_creation_input_tokens. Some-os por dia, multiplique pelas tarifas atuais e compare o total com a fatura. Uma diferença entre os dois valores é normalmente causada por novas tentativas ou por um caminho de código que se esqueceu de ter lançado.

Faça a comparação durante uma semana de tráfego real, em vez de usar um pedido de exemplo, e compare o custo por tarefa concluída, não o custo por token. Um modelo que responde à primeira tentativa com o dobro da tarifa é mais barato do que um modelo que precisa de três tentativas à metade da tarifa. O custo por token é uma tarifa. O custo por tarefa concluída é o valor da fatura.

Defina um limite máximo de despesa antes de deixar qualquer processo em execução. Ambas as plataformas disponibilizam limites de despesa nas respetivas consolas, e um agente preso num ciclo de novas tentativas pode gastar durante a noite o orçamento de um mês. Configure isso da mesma forma que configuraria o controlo de custos num agente sempre ativo. Se estiver a criar a primeira versão num servidor seu, uma primeira aplicação Claude API num VPS explica a gestão de chaves e o ciclo de pedidos em que estes cálculos assentam.

FAQ

A Claude API é mais barata do que a ChatGPT API?

Nem sempre. Em agosto de 2026, os níveis frontier e workhorse cobram o mesmo por token de entrada em ambos os serviços, e a Claude cobra menos por token de saída. Por isso, a Claude custa alguns por cento menos em tarefas com muitas saídas. No nível pequeno, o gpt-5.6-luna da OpenAI custa um quinto do preço por token de entrada do Claude Haiku 4.5. Assim, a classificação em grande volume é muito mais barata na OpenAI. Calcule o seu próprio valor com a sua própria distribuição de tokens. Uma margem tão pequena depende mais da carga de trabalho do que da tabela de preços.

Por que as mesmas palavras custam um número diferente de tokens em cada API?

Porque cada modelo tem o seu próprio tokenizador, e a contagem de tokens é uma propriedade do modelo. A Anthropic documenta que os modelos Claude 4.7 e posteriores produzem cerca de 30% mais tokens para o mesmo texto do que o Claude Sonnet 4.6 e modelos anteriores. Envie o seu próprio texto para o endpoint de contagem de tokens de cada fornecedor. Divida uma contagem pela outra e multiplique essa proporção pela tarifa publicada antes de comparar. Uma diferença de 20% no número de tokens supera a maioria das diferenças entre as tarifas publicadas.

O cache de prompts pode aumentar o valor da fatura?

Sim, na Anthropic. Uma gravação no cache custa 1,25 vezes a tarifa base de entrada para uma entrada de cinco minutos e 2 vezes para uma entrada de uma hora. Uma leitura do cache custa 0,1 vezes essa tarifa. Se o seu tráfego for suficientemente intermitente para que a maioria das entradas expire antes de ser lida, você pagará o adicional da gravação sem obter nenhuma leitura. Compare cache_creation_input_tokens com cache_read_input_tokens nos seus logs. Uma proporção próxima de 1 significa que o cache está aumentando o seu custo. Nesse caso, aumente a duração da entrada ou remova o cache.

Devo executar um agente de programação na API ou usar uma assinatura?

Para um desenvolvedor, com volume normal, uma licença de assinatura geralmente custa menos do que a cobrança por consumo da API. Isso ocorre porque um agente de programação reenvia um contexto grande a cada turno, e esse contexto é cobrado todas as vezes. Primeiro, meça o consumo durante uma semana. Depois, compare o total da API com o preço da licença. A API é mais vantajosa quando o uso é intermitente ou quando você precisa de acesso programático que uma licença não oferece.

#claude#openai#api-pricing#tokens#cost-comparison