Claude ou ChatGPT API: qual é mais barato?
Compare Claude e ChatGPT por tokens de entrada e saída, com três cargas de trabalho e custos calculados para descobrir quando a conta do Claude fica maior.
A resposta curta
A precificação das APIs do Claude e do ChatGPT não tem um vencedor único, porque os dois fornecedores definem preços diferentes para tokens de entrada e de saída em cada nível. Em agosto de 2026, os dois níveis superiores do Claude cobram o mesmo valor por token de entrada que seus equivalentes da OpenAI e menos por token de saída. Por isso, o Claude fica ligeiramente à frente em cargas de trabalho com muita saída. No nível menor, o Claude custa várias vezes mais para o mesmo trabalho. Qualquer resposta que não informe um nível e uma combinação de tokens é um palpite.
Por isso, esta página apresenta primeiro o cálculo, depois três cargas de trabalho com custos e suas combinações de tokens, e por fim os multiplicadores que podem alterar uma fatura real mais do que a tarifa anunciada.
A única fórmula de que você precisa
As duas APIs cobram pelo texto da mesma forma. Você paga pelos tokens enviados e paga uma tarifa mais alta pelos tokens que o modelo gera.
cost = (input tokens / 1,000,000) * input rate + (output tokens / 1,000,000) * output rate
Um token corresponde a cerca de 4 caracteres em inglês, ou aproximadamente 0.75 palavra. Use isso apenas para uma primeira estimativa. Para obter o valor real, use as contagens retornadas por cada API no objeto usage de cada resposta.
# Rates are US dollars per million tokens.
def cost(in_tok, out_tok, in_rate, out_rate):
return in_tok / 1e6 * in_rate + out_tok / 1e6 * out_rate
# One support-chat turn: 1,400 tokens in, 220 tokens out, on a $2 / $10 model.
print(round(cost(1400, 220, 2.0, 10.0), 6))O script exibe 0.005, que corresponde a meio centavo por interação. Multiplique esse valor pelo número de interações esperadas em um mês para obter um orçamento. Aprenda esta fórmula; depois de hoje, cada alteração de preço será uma edição de uma linha, sem necessidade de uma nova análise.
As tarifas publicadas, agosto de 2026
Estes são os preços de tabela publicados pelos dois fornecedores em 1 de agosto de 2026. Este bloco é o único lugar do artigo em que um preço é informado. Confira os valores em claude.com/pricing e na página de preços da OpenAI antes de aprovar um orçamento.
The data behind this chart
[
{
"label": "Frontier",
"claude_input": 5,
"claude_output": 25,
"openai_input": 5,
"openai_output": 30
},
{
"label": "Workhorse",
"claude_input": 2,
"claude_output": 10,
"openai_input": 2,
"openai_output": 12
},
{
"label": "Workhorse from September",
"claude_input": 3,
"claude_output": 15,
"openai_input": 2,
"openai_output": 12
},
{
"label": "Small",
"claude_input": 1,
"claude_output": 5,
"openai_input": 0.2,
"openai_output": 1.2
}
]As correspondências são feitas pela posição em cada linha de produtos, não pela popularidade. Na categoria Frontier, Claude Opus 5 é comparado com gpt-5.6-sol. Na categoria Workhorse, Claude Sonnet 5 é comparado com gpt-5.6-terra. Na categoria Small, Claude Haiku 4.5 é comparado com gpt-5.6-luna. Os dois fornecedores também vendem níveis superiores aos desta lista, e a OpenAI mantém gerações anteriores listadas com as tarifas originais. Comparar um modelo topo de linha de um lado com um modelo econômico do outro produz um número sem significado. É assim que a maioria das comparações publicadas chega ao título.
Há dois pontos desse bloco que precisam ser esclarecidos. As tarifas 2 e 10 do Sonnet 5 são promocionais, e a Anthropic informa que elas terminam em 31 de agosto de 2026. Depois disso, o Sonnet 5 cobrará 3 e 15. Essa única mudança transforma o nível Workhorse de uma vitória apertada do Claude em uma vitória clara da OpenAI, e ela ocorre dentro do período de validade deste artigo.
O segundo ponto é um padrão que vale memorizar: o Claude cobra exatamente 5 vezes sua própria tarifa de entrada pela saída em todas as linhas acima, enquanto a OpenAI cobra 6 vezes. Essa proporção, e não a tarifa absoluta, é o que faz o vencedor mudar conforme a combinação de tokens.
Por que uma tarifa por milhão de tokens não permite comparar fornecedores
Uma tarifa é um valor em dólares por token. Uma fatura é o valor em dólares por token multiplicado pela quantidade de tokens, e a quantidade de tokens de um texto é uma propriedade do modelo, não do texto.
A Anthropic documenta isso diretamente: os modelos Claude 4.7 e posteriores, incluindo Claude Opus 5 e Claude Sonnet 5, usam um tokenizador mais recente que produz aproximadamente 30% mais tokens para o mesmo texto do que o Claude Sonnet 4.6 e modelos anteriores. A tarifa não mudou. A fatura mudou.
Portanto, duas tarifas que parecem idênticas não correspondem a duas faturas idênticas. Conte os tokens nos dois lados, usando seu próprio texto, antes de confiar em qualquer comparação, inclusive nesta.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5",
"messages": [{"role": "user", "content": "Summarise the attached contract."}]
}'Uma resposta saudável é um pequeno objeto JSON contendo input_tokens. Um 401 significa que a variável da chave está vazia no seu shell. Execute o mesmo texto pelo tokenizador do outro fornecedor, divida uma contagem pela outra e multiplique essa proporção pela tarifa publicada antes de comparar. Se a proporção favorecer um fornecedor em mais de aproximadamente 1.2, ela supera qualquer diferença de tarifa no bloco acima.
Cenário um: um recurso de chat
Um assistente de suporte dentro de uma aplicação web. 120,000 turnos por mês. Cada turno envia um prompt do sistema, esquemas de ferramentas, dois trechos recuperados da base de suporte e algumas mensagens anteriores, com cerca de 1,400 tokens de entrada, e o modelo responde com cerca de 220 tokens. É interativo, portanto o desconto por processamento em lote nunca pode ser aplicado aqui. Execute-o na categoria workhorse.
The data behind this chart
[
{
"label": "List price",
"claude_usd": "600.00",
"openai_usd": "652.80"
},
{
"label": "Cached prefix",
"claude_usd": "427.20",
"openai_usd": "480.00"
},
{
"label": "Small tier, cached",
"claude_usd": "213.60",
"openai_usd": "48.00"
}
]No preço de tabela, Claude cobra 600.00, contra 652.80 da OpenAI. Os componentes de entrada são idênticos, porque as taxas de entrada são idênticas. Toda a diferença está na saída, e Claude vence por uma margem pequena demais para escolher um fornecedor com base nela.
Agora marque 800 desses 1,400 tokens de entrada como um prefixo estável: o prompt do sistema e os esquemas de ferramentas, que não mudam entre os turnos. Ambos os fornecedores cobram 10% da taxa básica de entrada por um acerto no cache. A cobrança do Claude cai para 427.20 e a da OpenAI para 480.00. O cache vale mais do que a escolha do fornecedor, e ambas as plataformas oferecem esse recurso.
É aqui que Claude perde. A maioria das respostas de suporte não precisa de um modelo workhorse. Mova o mesmo tráfego para a categoria small, e Claude cobra 213.60, enquanto a OpenAI cobra 48.00. Divida um pelo outro, e Claude custa cerca de quatro vezes e meia mais para o mesmo trabalho. Claude Haiku 4.5 cobra 1 por milhão de tokens de entrada, contra 0.2 do gpt-5.6-luna, e nenhum nível de cache elimina uma diferença de cinco vezes. Se sua carga de trabalho se ajustar a um modelo pequeno, a OpenAI será mais barata, e a margem será grande.
Cenário dois: um pipeline de documentos com contexto longo
25,000 contratos por mês. Cada solicitação contém a mesma instrução de 9,000 tokens e o mesmo schema JSON, depois 12,000 tokens de texto do contrato, e o modelo retorna cerca de 700 tokens de campos estruturados. A saída representa menos de 4% dos tokens deste trabalho, e esse único fato determina a comparação.
The data behind this chart
[
{
"label": "Chat feature",
"claude_usd": "427.20",
"openai_usd": "480.00"
},
{
"label": "Document pipeline",
"claude_usd": "820.00",
"openai_usd": "855.00"
},
{
"label": "Coding agent",
"claude_usd": "116.10",
"openai_usd": "124.20"
}
]Com o prefixo de 9,000 tokens armazenado em cache em ambos os lados, o Claude custa 820.00 e o OpenAI custa 855.00. Os custos de entrada são iguais até o centavo, porque as tarifas de entrada dos modelos principais são iguais em agosto de 2026. Toda a diferença está no custo de saída, definido como 5 vezes o custo de entrada no Claude e 6 vezes no OpenAI.
Este trabalho também pode usar processamento em lote. Ambos os fornecedores concedem 50% de desconto na entrada e na saída para trabalho assíncrono. Portanto, os dois totais caem pela metade, e a diferença mantém a mesma proporção. O lote oferece o maior desconto individual em qualquer uma das plataformas, e um pipeline noturno de documentos pode sempre usá-lo.
A desvantagem do Claude vem da mesma lógica de níveis de antes. A extração de campos com um schema fixo é exatamente o tipo de trabalho que um modelo pequeno executa bem, e a entrada representa 97% dos tokens neste caso. Descer um nível multiplica a tarifa de entrada do OpenAI por 0.1 e a tarifa de entrada do Claude por 0.5. Teste o modelo pequeno em 200 documentos antes de presumir que precisa do modelo maior, usando a mesma avaliação que você usaria para escolher o nível correto do Claude para um trabalho.
Cenário três: um agente de programação sempre ativo
Um desenvolvedor executa um agente em um VPS, com aproximadamente 900 turnos do modelo por mês. Cada turno inclui cerca de 60,000 tokens de entrada de contexto do repositório, dos quais 80% são acertos de cache, e produz cerca de 1,800 tokens de edições e explicações. Calcule o preço na categoria de fronteira, porque, em programação, uma diferença de capacidade tem custo real.
O Claude cobra 116.10, contra 124.20 da OpenAI. A taxa de entrada e a taxa de leitura do cache são iguais, e a taxa de saída menor do Claude resulta em uma vantagem de cerca de 7%.
Esses 7% estão dentro da margem de erro do tokenizer mencionada anteriormente, portanto trate este cenário como um empate nas taxas. O que não é um empate é o modelo de cobrança. Para um desenvolvedor nesse volume, uma assinatura por usuário geralmente custa menos do que chamadas de API cobradas por uso, e a comparação muda completamente quando você inclui uma assinatura. Faça essa análise em a comparação entre custo da API e da assinatura antes de colocar um agente em cobrança por uso. Se você usar cobrança por uso, descubra primeiro para onde os tokens vão, porque o uso de tokens de um agente de programação é dominado pelo contexto reenviado a cada turno, e não pelo código que ele escreve.
Os multiplicadores que determinam a cobrança
A tarifa principal é o menor item desta lista. Cada item abaixo altera uma cobrança real em um valor maior que a diferença entre os dois fornecedores no mesmo nível.
Entrada em cache. Os dois fornecedores cobram 10% da entrada base quando há um acerto de cache. A Anthropic também cobra para gravar o cache: 1.25 vezes a entrada base para uma entrada de cinco minutos e 2 vezes para uma entrada de uma hora. Um acerto posterior atualiza essa entrada pelo preço de leitura. Portanto, uma entrada de cinco minutos se paga após uma leitura. Uma carga de trabalho com intervalos longos entre as solicitações grava mais vezes do que lê. Nesse caso, o cache custa mais do que economiza. O tráfego constante aproveita bem o cache. O tráfego em rajadas, não.
Descontos por lote. Desconto de 50% na entrada e na saída em ambas as plataformas, somente para trabalho assíncrono. Se o trabalho puder esperar, isso reduz pela metade a cobrança em qualquer fornecedor e pode ser combinado com o cache.
Proporção de saída. O Claude cobra 5 vezes a tarifa de entrada pela saída. A OpenAI cobra 6 vezes. Quanto maior for a proporção de tokens escritos em vez de lidos, mais vantajoso será o Claude com a mesma tarifa de entrada. O inverso vale para trabalhos dominados pela entrada.
Novas tentativas. Uma nova tentativa cobra novamente toda a entrada e não retorna nada utilizável. Se 6% das suas chamadas falharem na validação do schema e forem repetidas, o componente de entrada será 6% maior do que o previsto no plano. Registre novas tentativas como uma linha de custo, não como uma linha de erro. As equipes geralmente descobrem esse multiplicador por último, e ele costuma ser maior do que a diferença entre os fornecedores que motivou uma semana de discussões.
Qual lado perde e em que ponto
Claude perde claramente na categoria pequena. gpt-5.6-luna cobra 0.2 por milhão de tokens de entrada, contra 1 do Claude Haiku 4.5. Na saída, os valores são 1.2 contra 5. A classificação em alto volume e a extração curta custam aproximadamente quatro vezes mais no Claude.
Claude perde na categoria principal a partir de 1 September 2026, quando a tarifa introdutória termina e o Sonnet 5 passa a custar 3 e 15, contra um gpt-5.6-terra sem alteração. Claude vence na categoria de fronteira em custo de saída, mas a margem pode ser anulada pelas suas próprias contagens de tokens. Nenhum dos lados vence em tarefas dominadas por entrada em August 2026, porque, a 2 por milhão em ambos os lados, os custos de entrada são iguais.
Como medir isso no seu próprio tráfego
Leia o objeto usage em cada resposta e armazene quatro números por solicitação: tokens de entrada, tokens de saída, tokens lidos do cache e tokens gravados no cache. Na Claude API, esses valores aparecem como input_tokens, output_tokens, cache_read_input_tokens e cache_creation_input_tokens. Some-os por dia, multiplique pelas tarifas atuais e compare o total com a fatura. Uma diferença entre os dois valores normalmente indica novas tentativas ou um caminho de código que você esqueceu que foi lançado.
Faça a comparação com uma semana de tráfego real, em vez de usar um prompt de amostra, e compare o custo por tarefa concluída, não o custo por token. Um modelo que responde na primeira tentativa, com o dobro da tarifa, é mais barato que um modelo que precisa de três tentativas, com metade da tarifa. O custo por token é uma tarifa. O custo por tarefa concluída é o valor da sua fatura.
Defina um limite máximo de gastos antes de deixar qualquer processo em execução. As duas plataformas oferecem limites de gastos em seus consoles, e um agente preso em um loop de novas tentativas pode consumir durante a noite o orçamento de um mês. Configure isso da mesma forma que faria para o controle de custos em um agente sempre ativo. Se estiver criando a primeira versão em um servidor que você possui, um primeiro aplicativo da Claude API em um VPS aborda o gerenciamento de chaves e o loop de solicitações sobre os quais este cálculo se baseia.
FAQ
A API do Claude é mais barata que a API do ChatGPT?
Não de forma consistente. Em agosto de 2026, as categorias frontier e workhorse cobram o mesmo por token de entrada nas duas plataformas, e o Claude cobra menos por token de saída. Por isso, o Claude custa alguns por cento menos em tarefas com predominância de saída. Na categoria pequena, o gpt-5.6-luna da OpenAI custa um quinto do Claude Haiku 4.5 por token de entrada. Portanto, a classificação de alto volume é muito mais barata na OpenAI. Calcule seu próprio valor com base na sua combinação de tokens, porque uma margem tão pequena é determinada pela sua carga de trabalho, não pela tabela de preços.
Por que as mesmas palavras custam uma quantidade diferente de tokens em cada API?
Porque cada modelo tem seu próprio tokenizer, e a contagem de tokens é uma propriedade do modelo. A Anthropic informa que o Claude 4.7 e os modelos posteriores produzem cerca de 30% mais tokens para o mesmo texto que o Claude Sonnet 4.6 e os modelos anteriores. Envie seu próprio texto ao endpoint de contagem de tokens de cada fornecedor, divida uma contagem pela outra e multiplique essa razão pela tarifa publicada antes de comparar. Uma diferença de 20% na quantidade de tokens supera a maioria das diferenças entre as tarifas publicadas.
O prompt caching pode aumentar o valor da cobrança?
Sim, na Anthropic. Uma gravação no cache custa 1.25 vezes a tarifa básica de entrada para uma entrada de cinco minutos e 2 vezes para uma entrada de uma hora, enquanto um acerto custa 0.1 vezes. Se o seu tráfego for suficientemente intermitente para que a maioria das entradas expire antes de ser lida, você pagará o adicional da gravação e não terá nenhuma leitura. Compare cache_creation_input_tokens com cache_read_input_tokens nos seus logs. Uma proporção próxima de 1 significa que o cache está aumentando seu custo. Nesse caso, prolongue a duração da entrada ou remova-a.
Devo executar um agente de programação na API ou em uma assinatura?
Para um desenvolvedor, em um volume normal, uma licença de assinatura geralmente custa menos que a cobrança por uso da API, porque um agente de programação reenvia um contexto grande a cada turno, e esse contexto é cobrado todas as vezes. Meça o uso por uma semana e depois compare o total da API com o preço da licença. A API é mais vantajosa quando o uso é irregular ou quando você precisa de acesso programático que uma licença não oferece.