Claude vs ChatGPT API: qual é mais barato?
Claude e ChatGPT não têm um vencedor fixo. Compare a conta por tokens em três cargas de trabalho e veja quando o Claude custa mais ou menos.
A resposta curta
Os preços das APIs Claude e ChatGPT não têm um vencedor único, porque os dois fornecedores definem preços diferentes para os tokens de entrada e de saída em cada nível. Em agosto de 2026, os dois níveis superiores do Claude cobram o mesmo valor por token de entrada que os respetivos níveis da OpenAI e menos por token de saída. Por isso, o Claude fica ligeiramente à frente em trabalhos com muitas saídas. No nível mais baixo, o Claude custa várias vezes mais para o mesmo trabalho. Qualquer resposta que não indique um nível e uma combinação de tokens é uma estimativa.
Por isso, esta página apresenta primeiro os cálculos, depois três cargas de trabalho com custos e respetivas combinações de tokens, e por fim os multiplicadores que afetam uma fatura real mais do que a tarifa anunciada.
A única fórmula de que precisa
Ambas as APIs faturam o texto da mesma forma. Paga pelos tokens que envia e paga uma tarifa mais elevada pelos tokens que o modelo devolve.
cost = (input tokens / 1,000,000) * input rate + (output tokens / 1,000,000) * output rate
Um token corresponde a cerca de 4 caracteres em inglês, ou aproximadamente 0.75 de uma palavra. Use este valor apenas para uma primeira estimativa. Para obter o valor real, use as contagens devolvidas por cada API no objeto usage de cada resposta.
# Rates are US dollars per million tokens.
def cost(in_tok, out_tok, in_rate, out_rate):
return in_tok / 1e6 * in_rate + out_tok / 1e6 * out_rate
# One support-chat turn: 1,400 tokens in, 220 tokens out, on a $2 / $10 model.
print(round(cost(1400, 220, 2.0, 10.0), 6))O script apresenta 0.005, ou seja, meio cêntimo por turno. Multiplique esse valor pelo número de turnos previstos para um mês e terá um orçamento. Se a unidade de um milhão de tokens nesse denominador parecer abstrata, o que um milhão de tokens compra realmente no Claude apresenta uma quantidade concreta de texto. Aprenda esta fórmula e cada alteração de preços futura passará a exigir uma edição de uma linha, em vez de uma nova análise.
As tarifas publicadas, agosto de 2026
Estas são as tarifas de tabela que ambos os fornecedores publicaram em 1 de agosto de 2026. Este bloco é o único local do artigo onde é indicado um preço. Confirme-o em claude.com/pricing e na página de preços da OpenAI antes de aprovar um orçamento.
The data behind this chart
[
{
"label": "Frontier",
"claude_input": 5,
"claude_output": 25,
"openai_input": 5,
"openai_output": 30
},
{
"label": "Workhorse",
"claude_input": 2,
"claude_output": 10,
"openai_input": 2,
"openai_output": 12
},
{
"label": "Workhorse from September",
"claude_input": 3,
"claude_output": 15,
"openai_input": 2,
"openai_output": 12
},
{
"label": "Small",
"claude_input": 1,
"claude_output": 5,
"openai_input": 0.2,
"openai_output": 1.2
}
]Os pares são definidos pela posição em cada linha de produtos, não pela notoriedade. Na categoria Frontier, comparamos Claude Opus 5 com gpt-5.6-sol. Na categoria Workhorse, comparamos Claude Sonnet 5 com gpt-5.6-terra. Na categoria Small, comparamos Claude Haiku 4.5 com gpt-5.6-luna. Ambos os fornecedores também vendem escalões superiores aos deste bloco, e a OpenAI mantém as gerações anteriores listadas com as tarifas originais. Do lado do Claude, esse escalão é o Fable 5, com um preço duas vezes superior ao da linha Frontier em ambas as componentes, mantendo a mesma proporção de cinco vezes para a saída. Por isso, vale a pena ler quanto custa o Fable 5 e quando esse preço se justifica antes de assumir que o Opus 5 é o modelo mais caro que poderá pagar. Comparar um modelo topo de gama de um lado com um modelo económico do outro produz um número sem significado. É assim que a maioria das comparações publicadas obtém o seu destaque.
Há duas informações desse bloco que precisam de ser explicitadas. As tarifas 2 e 10 do Sonnet 5 são tarifas introdutórias. A Anthropic documenta que terminam em 31 de agosto de 2026. Depois dessa data, o Sonnet 5 cobra 3 e 15. Essa alteração transforma o escalão Workhorse de uma vantagem limitada do Claude numa vantagem clara da OpenAI. Além disso, ocorre dentro do período de validade deste artigo.
A segunda informação é um padrão que vale a pena memorizar: o Claude cobra exatamente 5 vezes a sua própria tarifa de entrada pela saída em todas as linhas acima, enquanto a OpenAI cobra 6 vezes. É essa proporção, e não a tarifa absoluta, que faz o vencedor mudar conforme a combinação de tokens.
Por que uma tarifa por milhão de tokens não permite comparar fornecedores
Uma tarifa é um valor em dólares por token. Uma fatura é o valor em dólares por token multiplicado pelo número de tokens, e a contagem de tokens de um texto é uma propriedade do modelo, não do texto.
A Anthropic documenta isto diretamente: os modelos Claude 4.7 e posteriores, incluindo Claude Opus 5 e Claude Sonnet 5, usam um tokenizador mais recente que produz aproximadamente 30% mais tokens para o mesmo texto do que o Claude Sonnet 4.6 e versões anteriores. A tarifa não mudou. A fatura mudou.
Por isso, duas tarifas aparentemente idênticas não correspondem a duas faturas idênticas. Conte os tokens dos dois lados usando o seu próprio texto antes de confiar em qualquer comparação, incluindo esta.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5",
"messages": [{"role": "user", "content": "Summarise the attached contract."}]
}'Uma resposta válida é um pequeno objeto JSON que contém input_tokens. Um 401 significa que a variável-chave está vazia na sua shell. Passe o mesmo texto pelo tokenizador do outro fornecedor, divida uma contagem pela outra e multiplique essa proporção pela tarifa publicada antes de comparar. Se a proporção favorecer um fornecedor em mais de aproximadamente 1.2, ela supera qualquer diferença de tarifa no bloco acima.
Cenário um: uma funcionalidade de chat
Um assistente de suporte dentro de uma aplicação web. 120,000 interações por mês. Cada interação envia um prompt do sistema, esquemas de ferramentas, dois trechos de help desk recuperados e algumas mensagens anteriores, num total de cerca de 1,400 tokens de entrada. O modelo responde com cerca de 220 tokens. Como é interativo, o desconto de processamento em lote nunca pode ser aplicado aqui. Execute-o no nível workhorse.
The data behind this chart
[
{
"label": "List price",
"claude_usd": "600.00",
"openai_usd": "652.80"
},
{
"label": "Cached prefix",
"claude_usd": "427.20",
"openai_usd": "480.00"
},
{
"label": "Small tier, cached",
"claude_usd": "213.60",
"openai_usd": "48.00"
}
]Ao preço de tabela, Claude cobra 600.00, contra 652.80 da OpenAI. Os componentes de entrada são idênticos, porque as tarifas de entrada são iguais. Toda a diferença está na saída, e Claude vence por uma margem demasiado pequena para escolher um fornecedor com base nela.
Agora marque 800 desses 1,400 tokens de entrada como um prefixo estável: o prompt do sistema e os esquemas de ferramentas, que não mudam entre as interações. Ambos os fornecedores cobram 10% da tarifa de entrada base por uma utilização do cache. O custo de Claude desce para 427.20 e o da OpenAI para 480.00. O cache vale mais do que a escolha do fornecedor, e ambas as plataformas oferecem esse recurso.
É aqui que Claude perde. A maioria das respostas de suporte não precisa de um modelo workhorse. Mova o mesmo tráfego para o nível small e Claude cobra 213.60, enquanto a OpenAI cobra 48.00. Divida um pelo outro e Claude custa cerca de quatro vezes e meia mais pelo mesmo trabalho. Claude Haiku 4.5 cobra 1 por milhão de tokens de entrada, contra 0.2 do gpt-5.6-luna, e nenhum nível de cache elimina uma diferença de cinco vezes. Se a sua carga de trabalho for adequada para um modelo small, a OpenAI é mais barata e a margem é grande.
Cenário dois: um pipeline de documentos com contexto longo
25,000 contratos por mês. Cada pedido inclui a mesma instrução de 9,000 tokens e o mesmo esquema JSON, depois 12,000 tokens de texto contratual, e o modelo devolve cerca de 700 tokens de campos estruturados. A saída representa menos de 4% dos tokens deste trabalho, e esse único facto determina a comparação.
The data behind this chart
[
{
"label": "Chat feature",
"claude_usd": "427.20",
"openai_usd": "480.00"
},
{
"label": "Document pipeline",
"claude_usd": "820.00",
"openai_usd": "855.00"
},
{
"label": "Coding agent",
"claude_usd": "116.10",
"openai_usd": "124.20"
}
]Com o prefixo de 9,000 tokens em cache nos dois lados, o Claude custa 820.00 e o OpenAI custa 855.00. Os custos de entrada são iguais ao cêntimo, porque as tarifas de entrada dos modelos principais são iguais em agosto de 2026. Toda a diferença está na saída, cujo preço é 5 vezes o da entrada no Claude e 6 vezes no OpenAI.
Este trabalho também pode usar processamento em lote. Ambos os fornecedores dão um desconto de 50% na entrada e na saída para trabalho assíncrono, por isso os dois totais ficam reduzidos a metade e a diferença mantém a mesma proporção. O processamento em lote é o maior desconto individual em qualquer uma das plataformas, e um pipeline noturno de documentos pode sempre utilizá-lo.
A desvantagem do Claude é a mesma lógica de escalão descrita anteriormente. A extração de campos com um esquema fixo é precisamente o tipo de trabalho que um modelo pequeno executa bem, e a entrada representa 97% dos tokens neste caso. Descer um escalão multiplica a tarifa de entrada do OpenAI por 0.1 e a tarifa de entrada do Claude por 0.5. Teste o modelo pequeno em 200 documentos antes de assumir que precisa do modelo maior, usando a mesma avaliação que utilizaria para escolher o escalão Claude adequado para um trabalho.
Cenário três: um agente de programação sempre ativo
Um programador executa um agente numa VPS, com cerca de 900 interações do modelo por mês. Cada interação inclui cerca de 60,000 tokens de entrada de contexto do repositório, dos quais 80% são acertos de cache, e produz cerca de 1,800 tokens de alterações e explicações. Faça o cálculo com o nível frontier, porque, na programação, uma diferença de capacidade tem um custo real.
O Claude cobra 116.10, contra 124.20 da OpenAI. A mesma tarifa de entrada, a mesma tarifa de leitura da cache e a tarifa de saída mais baixa do Claude resultam numa vantagem de cerca de 7%.
Esses 7% estão dentro da margem de erro do tokenizador calculada anteriormente, por isso trate este cenário como um empate de tarifas. O que não é um empate é o modelo de cobrança. Para um programador com este volume, uma subscrição por utilizador normalmente custa menos do que chamadas à API cobradas por utilização, e a comparação muda completamente quando se inclui uma subscrição. Analise a comparação entre o custo da API e o custo da subscrição antes de colocar um agente numa API com cobrança por utilização. Se optar pela cobrança por utilização, descubra primeiro para onde vão os tokens, porque a utilização de tokens por um agente de programação é dominada pelo contexto reenviado em cada interação, e não pelo código que escreve.
Os multiplicadores que determinam a fatura
A tarifa anunciada é o item mais pequeno desta lista. Cada um dos fatores abaixo altera uma fatura real mais do que a diferença entre os dois fornecedores no mesmo nível.
Entrada em cache. Ambos os fornecedores cobram 10% da entrada base por uma leitura a partir da cache. A Anthropic também cobra pela escrita na cache: 1.25 vezes a entrada base por uma entrada de cinco minutos e 2 vezes por uma entrada de uma hora. Uma leitura posterior atualiza essa entrada ao preço de leitura. Assim, uma entrada de cinco minutos compensa o custo depois de uma leitura. Uma carga de trabalho com intervalos longos entre pedidos escreve mais vezes do que lê. Nesse caso, a cache custa mais do que poupa. O tráfego constante é bem servido pela cache. O tráfego em rajadas não é.
Descontos de batch. 50% de desconto na entrada e na saída em ambas as plataformas, apenas para trabalho assíncrono. Se o trabalho puder esperar, isto reduz a fatura para metade em qualquer fornecedor e acumula com a cache.
Proporção de saída. O Claude cobra 5 vezes a tarifa de entrada pela saída. A OpenAI cobra 6 vezes. Quanto maior for a proporção de tokens escritos em vez de lidos, mais vantajoso será o Claude com a mesma tarifa de entrada. O inverso aplica-se ao trabalho dominado pela entrada.
Repetições. Uma repetição cobra novamente toda a entrada e não devolve nada utilizável. Se 6% das suas chamadas falharem na validação do schema e forem repetidas, o componente de entrada é 6% maior do que o previsto no plano. Registe as repetições como uma linha de custo, não como uma linha de erro. As equipas costumam descobrir este multiplicador por último. Muitas vezes, ele é maior do que a diferença entre fornecedores sobre a qual passaram uma semana a discutir.
Qual lado perde e onde
A Claude perde claramente no tier pequeno. O gpt-5.6-luna cobra 0.2 por milhão de tokens de entrada, contra 1 da Claude Haiku 4.5, com a saída a 1.2, contra 5. A classificação de alto volume e a extração curta custam aproximadamente quatro vezes mais na Claude.
A Claude perde no tier de uso geral a partir de 1 de setembro de 2026, quando termina a tarifa introdutória e a Sonnet 5 passa para 3 e 15, contra um gpt-5.6-terra sem alterações. A Claude vence no tier de fronteira pela tarifa de saída, mas a margem pode desaparecer com os seus próprios volumes de tokens. Nenhum dos lados vence em cargas de trabalho dominadas pela entrada em agosto de 2026, porque, a 2 por milhão em ambos os lados, os custos de entrada são iguais.
Como medir isto no seu próprio tráfego
Leia o objeto usage em cada resposta e armazene quatro números por pedido: tokens de entrada, tokens de saída, tokens lidos da cache e tokens escritos na cache. Na Claude API, esses valores são devolvidos como input_tokens, output_tokens, cache_read_input_tokens e cache_creation_input_tokens. Some-os por dia, multiplique pelas tarifas atuais e compare o total com a fatura. Uma diferença entre os dois valores costuma dever-se a novas tentativas ou a um caminho de código que se esqueceu de que tinha colocado em produção.
Faça a comparação durante uma semana de tráfego real, e não com base num prompt de exemplo. Compare o custo por tarefa concluída, em vez do custo por token. Um modelo que responde à primeira tentativa com o dobro da tarifa é mais barato do que um modelo que precisa de três tentativas à metade da tarifa. O custo por token é uma tarifa. O custo por tarefa concluída é o valor faturado.
Defina um limite máximo de despesa antes de deixar qualquer processo em execução. Ambas as plataformas disponibilizam limites de despesa nas respetivas consolas, e um agente preso num ciclo de novas tentativas pode gastar durante a noite o orçamento de um mês. Configure esse limite da mesma forma que faria para controlar os custos de um agente sempre ativo. Se estiver a criar a primeira versão num servidor que controla, a primeira aplicação da Claude API num VPS explica a gestão da chave e o ciclo de pedidos sobre os quais este cálculo assenta.
FAQ
A Claude API é mais barata do que a API do ChatGPT?
Não de forma consistente. Em agosto de 2026, os níveis frontier e workhorse cobram o mesmo por token de entrada em ambos os serviços, e o Claude cobra menos por token de saída. Por isso, o Claude custa alguns por cento menos em tarefas com predominância de saída. No nível pequeno, o gpt-5.6-luna da OpenAI custa um quinto do Claude Haiku 4.5 por token de entrada. Assim, a classificação de grande volume é muito mais barata na OpenAI. Calcule o seu próprio valor com a sua própria combinação de tokens, porque uma margem tão pequena é determinada pela sua carga de trabalho, não pela tabela de preços.
Porque é que as mesmas palavras custam um número diferente de tokens em cada API?
Porque cada modelo tem o seu próprio tokenizador, e a contagem de tokens é uma propriedade do modelo. A Anthropic documenta que o Claude 4.7 e os modelos posteriores produzem cerca de 30% mais tokens para o mesmo texto do que o Claude Sonnet 4.6 e os modelos anteriores. Envie o seu próprio texto para o endpoint de contagem de tokens de cada fornecedor, divida uma contagem pela outra e, em seguida, multiplique essa proporção pela tarifa publicada antes de comparar. Uma diferença de 20% nos tokens supera a maioria das diferenças nas tarifas publicadas.
A colocação em cache de prompts pode aumentar o custo?
Sim, na Anthropic. Uma escrita na cache custa 1.25 vezes a tarifa base de entrada para uma entrada de cinco minutos e 2 vezes para uma entrada de uma hora, enquanto um acerto custa 0.1 vezes. Se o seu tráfego for suficientemente intermitente para que a maioria das entradas expire antes de ser lida, paga o adicional da escrita sem obter leituras. Compare cache_creation_input_tokens com cache_read_input_tokens nos seus logs. Uma proporção próxima de 1 significa que a cache está a aumentar os seus custos. Nesse caso, prolongue a validade da entrada ou remova-a.
Devo executar um agente de programação na API ou através de uma subscrição?
Para um programador com um volume normal, uma subscrição costuma custar menos do que a faturação medida da API, porque um agente de programação reenvia um contexto grande em cada turno e esse contexto é cobrado todas as vezes. Meça o consumo durante uma semana e, em seguida, compare o total da API com o preço do lugar. A API é mais vantajosa quando o uso é irregular ou quando precisa de acesso programático que um lugar não oferece. Se o que o levou a escolher a API foi atingir um limite de uso, e não o preço, as alternativas para ultrapassar um limite de uso do Claude incluem várias opções que custam menos do que mudar para a faturação medida.