SSD Nodes Learn Hosting plans →
Guides Matt ConnorPar Matt Connor · Mis à jour le 2026-08-13

Claude ou ChatGPT API : lequel coûte le moins cher ?

Comparez les tarifs Claude et ChatGPT API avec le calcul des tokens et trois cas chiffrés pour voir quand la facture Claude devient plus élevée.

La réponse courte

Il n’y a pas de vainqueur unique pour les tarifs des API Claude et ChatGPT, car les deux fournisseurs facturent différemment les tokens d’entrée et de sortie à chaque niveau. En août 2026, les deux niveaux supérieurs de Claude facturent chaque token d’entrée au même tarif que leurs équivalents OpenAI, mais moins cher pour les tokens de sortie. Claude est donc légèrement plus avantageux pour les tâches qui génèrent beaucoup de sorties. Au niveau inférieur, Claude coûte plusieurs fois plus cher pour la même tâche. Toute réponse qui ne précise pas le niveau et la répartition des tokens est une supposition.

Cette page commence donc par les calculs, puis présente trois charges de travail chiffrées avec leur répartition de tokens, avant d’examiner les multiplicateurs qui peuvent faire varier une facture réelle bien davantage que le tarif annoncé.

La seule formule dont vous avez besoin

Les deux API facturent le texte de la même manière. Vous payez les tokens que vous envoyez, ainsi qu’un tarif plus élevé pour les tokens que le modèle renvoie.

cost = (input tokens / 1,000,000) * input rate + (output tokens / 1,000,000) * output rate

Un token correspond à environ 4 caractères en anglais, soit près de 0.75 mot. Utilisez cette valeur uniquement pour une première estimation. Pour connaître le coût réel, utilisez les quantités renvoyées par chaque API dans l’objet usage de chaque réponse.

# Rates are US dollars per million tokens.
def cost(in_tok, out_tok, in_rate, out_rate):
    return in_tok / 1e6 * in_rate + out_tok / 1e6 * out_rate

# One support-chat turn: 1,400 tokens in, 220 tokens out, on a $2 / $10 model.
print(round(cost(1400, 220, 2.0, 10.0), 6))

Le script affiche 0.005, soit un demi-cent par échange. Multipliez cette valeur par le nombre d’échanges prévus sur un mois pour obtenir votre budget. Si l’unité d’un million de tokens dans ce dénominateur vous paraît abstraite, ce qu’un million de tokens permet réellement d’obtenir dans Claude vous donne une quantité de texte concrète. Retenez cette formule : chaque changement de tarif ultérieur se résumera à modifier une seule ligne, sans nouvelle analyse.

Les tarifs publiés, août 2026

Voici les prix catalogue publiés par les deux fournisseurs le 1 août 2026. Ce bloc est le seul endroit de l’article où un prix est indiqué. Vérifiez-le sur claude.com/pricing et sur la page tarifaire d’OpenAI avant de valider un budget.

ChartList prices in US dollars per million tokens, August 2026
The data behind this chart
[
  {
    "label": "Frontier",
    "claude_input": 5,
    "claude_output": 25,
    "openai_input": 5,
    "openai_output": 30
  },
  {
    "label": "Workhorse",
    "claude_input": 2,
    "claude_output": 10,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Workhorse from September",
    "claude_input": 3,
    "claude_output": 15,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Small",
    "claude_input": 1,
    "claude_output": 5,
    "openai_input": 0.2,
    "openai_output": 1.2
  }
]

Les associations correspondent à la position dans chaque gamme, et non à la notoriété. Dans la catégorie Frontier, Claude Opus 5 est comparé à gpt-5.6-sol. Dans la catégorie Workhorse, Claude Sonnet 5 est comparé à gpt-5.6-terra. Dans la catégorie Small, Claude Haiku 4.5 est comparé à gpt-5.6-luna. Les deux fournisseurs proposent aussi des modèles de gamme supérieure à ceux de ce bloc, et OpenAI conserve les anciennes générations aux tarifs d’origine. Chez Claude, il s’agit de Fable 5, facturé deux fois plus cher que la ligne Frontier pour les deux types de tokens, tout en conservant le même ratio de sortie de cinq fois le tarif d’entrée. Il est donc utile de lire ce que coûte Fable 5 et quand ce tarif se justifie avant de considérer Opus 5 comme le modèle le plus cher de votre facture. Comparer un modèle haut de gamme d’un côté à un modèle économique de l’autre ne produit aucun chiffre pertinent. C’est pourtant ainsi que la plupart des comparaisons publiées construisent leur titre.

Deux points de ce bloc doivent être explicités. Les tarifs 2 et 10 de Sonnet 5 sont des tarifs de lancement. Anthropic indique qu’ils prennent fin le 31 août 2026. Après cette date, Sonnet 5 est facturé 3 et 15. Ce seul changement fait passer la catégorie Workhorse d’un léger avantage pour Claude à un avantage net pour OpenAI. Il intervient pendant la période de validité de cet article.

Le second point est une tendance à retenir : Claude facture la sortie exactement 5 fois son propre tarif d’entrée dans chacune des lignes ci-dessus, tandis qu’OpenAI la facture 6 fois. C’est ce ratio, et non le tarif absolu, qui fait changer le gagnant selon la répartition de vos tokens.

Pourquoi un tarif par million de tokens ne permet pas de comparer les fournisseurs

Un tarif est un montant en dollars par token. Une facture correspond au tarif par token multiplié par le nombre de tokens. Or le nombre de tokens pour un texte dépend du modèle, pas du texte lui-même.

Anthropic le précise directement : les modèles Claude 4.7 et ultérieurs, notamment Claude Opus 5 et Claude Sonnet 5, utilisent un tokenizer plus récent qui produit environ 30% de tokens supplémentaires pour un même texte par rapport à Claude Sonnet 4.6 et aux versions antérieures. Le tarif n’a pas changé. La facture, elle, a changé.

Deux tarifs qui semblent identiques ne correspondent donc pas à deux factures identiques. Comptez les tokens des deux côtés avec votre propre texte avant de faire confiance à une comparaison, y compris celle-ci.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "messages": [{"role": "user", "content": "Summarise the attached contract."}]
  }'

Une réponse correcte est un petit objet JSON contenant input_tokens. Un 401 signifie que la variable contenant la clé est vide dans votre shell. Faites passer le même texte dans le tokenizer de l’autre fournisseur, divisez un nombre de tokens par l’autre, puis multipliez ce ratio par le tarif publié avant de comparer. Si le ratio favorise un fournisseur de plus d’environ 1.2, cet écart pèse davantage que toutes les différences de tarif du bloc précédent.

Scénario 1 : une fonctionnalité de chat

Un assistant de support intégré à une application web. 120,000 échanges par mois. Chaque échange envoie un prompt système, des schémas d’outils, deux extraits de la base d’aide récupérés et quelques messages précédents, soit environ 1,400 tokens en entrée. Le modèle répond avec environ 220 tokens. La fonctionnalité est interactive : la remise batch ne peut donc jamais s’appliquer. Exécutez-la sur le tier workhorse.

ChartChat feature, monthly cost in US dollars, 120,000 turns
The data behind this chart
[
  {
    "label": "List price",
    "claude_usd": "600.00",
    "openai_usd": "652.80"
  },
  {
    "label": "Cached prefix",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Small tier, cached",
    "claude_usd": "213.60",
    "openai_usd": "48.00"
  }
]

Au tarif catalogue, Claude facture 600.00, contre 652.80 pour OpenAI. Les coûts d’entrée sont identiques, car les tarifs d’entrée sont identiques. L’écart total vient de la sortie, et Claude l’emporte avec une marge trop faible pour choisir un fournisseur sur ce seul critère.

Marquez maintenant 800 de ces 1,400 tokens en entrée comme préfixe stable : le prompt système et les schémas d’outils, qui ne changent pas d’un échange à l’autre. Les deux fournisseurs facturent 10% de leur tarif d’entrée de base en cas de cache hit. La facture de Claude tombe à 427.20 et celle d’OpenAI à 480.00. Le caching a plus d’impact que le choix du fournisseur, et les deux plateformes le proposent.

C’est ici que Claude perd. La plupart des réponses de support ne nécessitent pas de modèle workhorse. Transférez le même trafic vers le small tier : Claude facture alors 213.60, contre 48.00 pour OpenAI. Le rapport entre les deux montre que Claude coûte environ quatre fois et demie plus cher pour le même travail. Claude Haiku 4.5 facture 1 par million de tokens en entrée, contre 0.2 pour gpt-5.6-luna. Aucun niveau de caching ne permet de combler un écart d’un facteur cinq. Si votre workload tient sur un petit modèle, OpenAI est moins cher et la différence est importante.

Scénario 2 : pipeline de traitement de documents avec long contexte

25,000 contrats par mois. Chaque requête contient les mêmes 9,000 tokens d’instructions et de schéma JSON, puis 12,000 tokens de texte contractuel. Le modèle renvoie environ 700 tokens de champs structurés. La sortie représente moins de 4 % des tokens de cette tâche. Ce seul fait détermine la comparaison.

ChartMonthly cost in US dollars, three workloads, cached and paired like-for-like
The data behind this chart
[
  {
    "label": "Chat feature",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Document pipeline",
    "claude_usd": "820.00",
    "openai_usd": "855.00"
  },
  {
    "label": "Coding agent",
    "claude_usd": "116.10",
    "openai_usd": "124.20"
  }
]

Avec le préfixe de 9,000 tokens mis en cache des deux côtés, Claude coûte 820.00 et OpenAI coûte 855.00. Les coûts d’entrée sont identiques au cent près, car les tarifs d’entrée principaux sont identiques en août 2026. Toute la différence vient de la sortie, facturée 5 fois le tarif d’entrée chez Claude et 6 fois chez OpenAI.

Cette tâche se prête également au batch. Les deux fournisseurs appliquent une remise de 50 % sur les entrées et les sorties pour le traitement asynchrone. Les deux totaux sont donc divisés par deux, et l’écart reste proportionnel. Le batch est la remise unitaire la plus importante sur les deux plateformes, et un pipeline documentaire nocturne peut toujours l’utiliser.

Claude est désavantagé par la même logique de gamme que précédemment. L’extraction de champs selon un schéma fixe est exactement le type de tâche qu’un petit modèle exécute bien, et les entrées représentent 97 % des tokens ici. Passer au niveau inférieur multiplie par 0.1 le tarif d’entrée d’OpenAI et par 0.5 celui de Claude. Testez le petit modèle sur 200 documents avant de supposer que vous avez besoin du modèle plus puissant, avec la même évaluation que celle utilisée pour choisir le bon niveau Claude pour une tâche.

Scénario trois : un agent de développement toujours actif

Un développeur exécute un agent sur un VPS, avec environ 900 tours de modèle par mois. Chaque tour contient environ 60,000 tokens d’entrée de contexte du dépôt, dont 80% correspondent à des lectures depuis le cache, et produit environ 1,800 tokens de modifications et d’explications. Évaluez-le avec les tarifs frontier, car c’est en développement que l’écart de capacité entraîne des coûts réels.

Claude facture 116.10, contre 124.20 pour OpenAI. Le tarif d’entrée et le tarif des lectures depuis le cache sont identiques, et le tarif de sortie inférieur de Claude lui donne un avantage d’environ 7%.

Ces 7% se situent dans la marge d’erreur liée au tokenizer évoquée précédemment. Considérez donc que les tarifs sont équivalents dans ce scénario. En revanche, le modèle de facturation n’est pas équivalent. Pour un développeur et ce volume d’utilisation, un abonnement par utilisateur coûte généralement moins cher que des appels API facturés à l’usage. La comparaison change donc complètement dès que vous en incluez un. Faites le calcul avec la comparaison entre le coût de l’API et celui d’un abonnement avant de placer un agent sur une facturation à l’usage. Si vous choisissez cette facturation, commencez par déterminer où vont les tokens, car l’utilisation des tokens par un agent de développement est surtout due au contexte renvoyé à chaque tour, et non au code qu’il écrit.

Les multiplicateurs qui déterminent la facture

Le tarif affiché est le plus petit poste de cette liste. Chacun des éléments ci-dessous modifie davantage la facture réelle que l’écart entre les deux fournisseurs au même niveau tarifaire.

Entrées mises en cache. Les deux fournisseurs facturent 10% des entrées de base lorsqu’une requête est servie depuis le cache. Anthropic facture également l’écriture dans le cache : 1.25 fois le tarif des entrées de base pour une entrée conservée cinq minutes, et 2 fois pour une entrée conservée une heure. Une lecture ultérieure actualise cette entrée au tarif de lecture. Une entrée conservée cinq minutes est donc amortie dès la première lecture. Une charge de travail avec de longs intervalles entre les requêtes écrit plus souvent qu’elle ne lit ; la mise en cache coûte alors plus qu’elle ne fait économiser. Un trafic régulier se met bien en cache. Un trafic en rafales, non.

Réductions pour le traitement par lots. 50% de réduction sur les entrées et les sorties chez les deux plateformes, uniquement pour les traitements asynchrones. Si le traitement peut attendre, la facture est divisée par deux chez l’un ou l’autre fournisseur, et cette réduction se cumule avec la mise en cache.

Part des sorties. Claude facture les sorties 5 fois le tarif de ses entrées. OpenAI les facture 6 fois. Plus vos tokens sont écrits plutôt que lus, plus Claude est avantageux à tarif d’entrée égal. L’inverse s’applique aux traitements dominés par les entrées.

Nouvelles tentatives. Une nouvelle tentative refacture l’intégralité des entrées et ne renvoie aucun résultat exploitable. Si 6% de vos appels échouent la validation du schéma et sont relancés, votre consommation d’entrées est supérieure de 6% à ce que prévoit votre estimation. Comptabilisez les nouvelles tentatives comme un poste de coût, et non comme une erreur. Les équipes découvrent souvent ce multiplicateur en dernier. Il est fréquemment plus important que l’écart entre les fournisseurs sur lequel elles ont passé une semaine à débattre.

Qui perd, et sur quel segment

Claude perd clairement sur le petit segment. gpt-5.6-luna facture 0.2 par million de tokens d’entrée, contre 1 pour Claude Haiku 4.5. La sortie est facturée 1.2, contre 5. La classification à haut volume et l’extraction courte coûtent environ quatre fois plus cher avec Claude.

Claude perd sur le segment polyvalent à partir du 1 September 2026, lorsque le tarif de lancement prend fin et que Sonnet 5 passe à 3 et 15, face à un gpt-5.6-terra inchangé. Claude gagne sur le segment frontier pour le tarif de sortie, avec un écart que vos propres volumes de tokens peuvent annuler. Aucun des deux ne gagne sur les traitements dominés par les entrées en August 2026, car, à 2 par million des deux côtés, les tarifs d’entrée sont identiques.

Comment mesurer cela sur votre propre trafic

Lisez l’objet usage dans chaque réponse et stockez quatre nombres par requête : les tokens d’entrée, les tokens de sortie, les tokens lus depuis le cache et les tokens écrits dans le cache. Dans l’API Claude, ces valeurs sont fournies dans input_tokens, output_tokens, cache_read_input_tokens et cache_creation_input_tokens. Faites la somme par jour, multipliez-la par les tarifs actuels, puis comparez le total à la facture. Un écart entre les deux provient généralement de nouvelles tentatives ou d’un chemin de code que vous avez oublié d’avoir déployé.

Effectuez la comparaison sur une semaine de trafic réel plutôt que sur un prompt d’exemple, et comparez le coût par tâche terminée plutôt que le coût par token. Un modèle qui répond en une seule tentative à un tarif deux fois plus élevé coûte moins cher qu’un modèle qui nécessite trois tentatives à moitié prix. Le coût par token est un tarif. Le coût par tâche terminée est le montant facturé.

Définissez un plafond de dépenses strict avant de laisser quoi que ce soit fonctionner sans surveillance. Les deux plateformes permettent de définir des limites de dépenses dans leur console, et un agent bloqué dans une boucle de nouvelles tentatives peut consommer une mensualité entière en une nuit. Configurez ce mécanisme comme vous le feriez pour le contrôle des coûts d’un agent toujours actif. Si vous développez la première version sur un serveur que vous administrez, une première application Claude API sur un VPS explique la gestion des clés et la boucle de requêtes sur lesquelles repose ce calcul.

FAQ

L’API Claude est-elle moins chère que l’API ChatGPT ?

Pas systématiquement. En août 2026, les niveaux frontier et workhorse facturent le même prix par token d’entrée des deux côtés, tandis que Claude facture moins par token de sortie. Claude revient donc quelques pourcents moins cher pour les tâches qui génèrent beaucoup de sorties. Dans le petit niveau, gpt-5.6-luna d’OpenAI coûte un cinquième du prix de Claude Haiku 4.5 par token d’entrée. La classification à gros volume est donc bien moins chère avec OpenAI. Calculez votre propre coût à partir de votre propre répartition de tokens, car un écart aussi faible dépend davantage de votre charge de travail que de la grille tarifaire.

Pourquoi les mêmes mots coûtent-ils un nombre différent de tokens sur chaque API ?

Parce que chaque modèle possède son propre tokenizer et que le nombre de tokens dépend du modèle. Anthropic indique que Claude 4.7 et les modèles ultérieurs produisent environ 30% de tokens en plus pour un même texte que Claude Sonnet 4.6 et les modèles antérieurs. Envoyez votre propre texte à l’endpoint de comptage des tokens de chaque fournisseur. Divisez un résultat par l’autre, puis appliquez ce ratio au tarif publié avant de comparer. Un écart de 20% sur le nombre de tokens dépasse la plupart des différences de tarifs publiées.

Le prompt caching peut-il parfois augmenter la facture ?

Oui, avec Anthropic. L’écriture dans le cache coûte 1.25 fois le tarif de base des entrées pour une entrée conservée cinq minutes et 2 fois ce tarif pour une entrée conservée une heure. Une lecture depuis le cache coûte 0.1 fois le tarif. Si votre trafic est suffisamment irrégulier pour que la plupart des entrées expirent avant d’être lues, vous payez le surcoût d’écriture sans bénéficier de lectures. Comparez cache_creation_input_tokens à cache_read_input_tokens dans vos journaux. Un ratio proche de 1 signifie que le cache vous coûte de l’argent. Augmentez la durée de conservation de l’entrée ou désactivez le cache.

Dois-je exécuter un agent de programmation via l’API ou avec un abonnement ?

Pour un développeur avec un volume courant, un abonnement coûte généralement moins cher qu’une facturation API à l’usage. Un agent de programmation renvoie un contexte volumineux à chaque tour, et ce contexte est facturé à chaque fois. Mesurez votre consommation pendant une semaine, puis comparez le total de l’API au prix de l’abonnement. L’API devient avantageuse lorsque l’utilisation est irrégulière ou lorsque vous avez besoin d’un accès programmatique qu’un abonnement ne fournit pas. Si le prix n’était pas la raison qui vous a conduit vers l’API, mais l’atteinte d’une limite d’utilisation, les solutions pour dépasser une limite d’utilisation de Claude comprennent plusieurs options moins coûteuses qu’un passage à la facturation à l’usage.

#claude#openai#api-pricing#tokens#cost-comparison