SSD Nodes Learn 🎉 VPS vanaf $4.99/mnd
Gidsen Matt ConnorDoor Matt Connor · Bijgewerkt 2026-08-13

Claude vs ChatGPT API: welke is goedkoper?

Er is geen universele winnaar. Ontdek hoe de token-prijsstelling per model verschilt en bekijk drie concrete rekenvoorbeelden om te zien wanneer Claude duurder uitvalt.

Het korte antwoord

Er is geen eenduidige winnaar in de prijsstelling van de Claude- en ChatGPT-API's, omdat beide leveranciers voor elke laag verschillende tarieven hanteren voor input en output. Sinds augustus 2026 rekenen de twee hoogste Claude-niveaus hetzelfde tarief per input-token als hun tegenhangers van OpenAI, maar minder per output-token; hierdoor is Claude iets voordeliger bij taken met een hoge output. Op het kleinste niveau is Claude echter enkele malen duurder voor hetzelfde werk. Elk antwoord dat geen specifiek niveau en een specifieke token-mix benoemt, is een gok.

Deze pagina presenteert daarom eerst de berekening, gevolgd door drie gecalculeerde workloads met hun respectievelijke token-mixen, en tot slot de vermenigvuldigingsfactoren die bepalen hoe een werkelijke factuur afwijkt van het basistarief.

De enige formule die u nodig heeft

Beide API's factureren tekst op dezelfde wijze. U betaalt voor de tokens die u verstuurt, en u betaalt een hoger tarief voor de tokens die het model terugschrijft.

cost = (input tokens / 1,000,000) * input rate + (output tokens / 1,000,000) * output rate

Een token staat gelijk aan ongeveer 4 Engelse tekens, oftewel circa 0,75 woord. Gebruik dit alleen als eerste schatting. Voor een definitieve factuur gebruikt u de aantallen die elke API teruggeeft in het usage-object van elk antwoord.

# Rates are US dollars per million tokens.
def cost(in_tok, out_tok, in_rate, out_rate):
    return in_tok / 1e6 * in_rate + out_tok / 1e6 * out_rate

# One support-chat turn: 1,400 tokens in, 220 tokens out, on a $2 / $10 model.
print(round(cost(1400, 220, 2.0, 10.0), 6))

Het script print 0.005, wat neerkomt op een halve cent per beurt. Vermenigvuldig dit met het aantal beurten dat u per maand verwacht en u heeft een budget. Als de eenheid van een miljoen tokens in die noemer abstract aanvoelt, geeft wat een miljoen tokens u daadwerkelijk oplevert in Claude een concreet beeld van de hoeveelheid tekst die dit vertegenwoordigt. Leer deze ene formule en elke prijswijziging na vandaag wordt een aanpassing van één regel in plaats van een nieuwe analyse.

De gepubliceerde tarieven, augustus 2026

Dit zijn de catalogusprijzen die beide leveranciers op 1 augustus 2026 hebben gepubliceerd. Dit blok is de enige plek in dit bericht waar een prijs wordt vermeld. Controleer deze tegenover claude.com/pricing en de prijspagina van OpenAI voordat u een budget vastlegt.

ChartList prices in US dollars per million tokens, August 2026
The data behind this chart
[
  {
    "label": "Frontier",
    "claude_input": 5,
    "claude_output": 25,
    "openai_input": 5,
    "openai_output": 30
  },
  {
    "label": "Workhorse",
    "claude_input": 2,
    "claude_output": 10,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Workhorse from September",
    "claude_input": 3,
    "claude_output": 15,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Small",
    "claude_input": 1,
    "claude_output": 5,
    "openai_input": 0.2,
    "openai_output": 1.2
  }
]

De vergelijkingen zijn gebaseerd op de positie in de respectievelijke productlijnen, niet op populariteit. Frontier is Claude Opus 5 tegenover gpt-5.6-sol. Workhorse is Claude Sonnet 5 tegenover gpt-5.6-terra. Small is Claude Haiku 4.5 tegenover gpt-5.6-luna. Beide leveranciers verkopen ook hogere tiers boven dit blok, en OpenAI houdt oudere generaties vermeld tegen hun oorspronkelijke tarieven. Aan de kant van Claude is die tier Fable 5, geprijsd op het dubbele van de frontier-rij voor beide onderdelen, terwijl de output-ratio van vijf keer behouden blijft. Daarom is wat Fable 5 kost en wanneer het dat tarief rechtvaardigt het lezen waard voordat u ervan uitgaat dat Opus 5 de hoogste kostenpost is. Het vergelijken van een vlaggenschip aan de ene kant met een budgetmodel aan de andere kant levert een getal op dat niets zegt; dit is hoe de meeste gepubliceerde vergelijkingen aan hun koptekst komen.

Twee zaken in dat blok moeten expliciet worden benoemd. De 2 en 10 van Sonnet 5 zijn introductietarieven. Anthropic documenteert dat deze eindigen op 31 augustus 2026, waarna Sonnet 5 3 en 15 in rekening brengt. Die ene wijziging verandert de workhorse-tier van een nipte overwinning voor Claude in een duidelijke overwinning voor OpenAI, en dit valt binnen de houdbaarheidsdatum van dit bericht.

Het tweede punt is een patroon dat het onthouden waard is: Claude prijst output op exact 5 keer het eigen inputtarief in elke rij hierboven, en OpenAI prijst output op 6 keer. Die verhouding, niet het absolute tarief, bepaalt welke partij voordeliger is op basis van uw token-mix.

Waarom een tarief per miljoen tokens niet vergelijkbaar is tussen leveranciers

Een tarief wordt uitgedrukt in dollars per token. Een factuur is het aantal dollars per token vermenigvuldigd met het aantal tokens, en het aantal tokens voor een tekst is een eigenschap van het model, niet van de tekst zelf.

Anthropic documenteert dit direct: Claude 4.7 en latere modellen, waaronder Claude Opus 5 en Claude Sonnet 5, gebruiken een nieuwere tokenizer die ongeveer 30% meer tokens genereert voor dezelfde tekst dan Claude Sonnet 4.6 en eerdere versies. Het tarief bleef gelijk. De factuur niet.

Twee tarieven die identiek lijken, resulteren dus niet in identieke facturen. Tel de tokens aan beide kanten met uw eigen tekst voordat u vertrouwt op enige vergelijking, inclusief deze.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "messages": [{"role": "user", "content": "Summarise the attached contract."}]
  }'

Een correcte respons is een klein JSON-object dat input_tokens bevat. Een 401 betekent dat de variabele voor de sleutel leeg is in uw shell. Voer dezelfde tekst door de tokenizer van de andere leverancier, deel het ene aantal door het andere en vermenigvuldig die verhouding met het gepubliceerde tarief voordat u vergelijkt. Als de verhouding in het voordeel van één leverancier meer dan ongeveer 1.2 bedraagt, weegt dit zwaarder dan elk tariefverschil in het bovenstaande blok.

Scenario één: een chatfunctie

Een ondersteuningsassistent binnen een webapplicatie. 120.000 interacties per maand. Elke interactie verstuurt een systeemprompt, tool-schema's, twee opgehaalde helpdeskfragmenten en enkele eerdere berichten, in totaal ongeveer 1.400 input-tokens, en het model antwoordt met ongeveer 220 tokens. Het proces is interactief, waardoor de batch-korting hier nooit van toepassing is. Voer dit uit op de workhorse-tier.

ChartChat feature, monthly cost in US dollars, 120,000 turns
The data behind this chart
[
  {
    "label": "List price",
    "claude_usd": "600.00",
    "openai_usd": "652.80"
  },
  {
    "label": "Cached prefix",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Small tier, cached",
    "claude_usd": "213.60",
    "openai_usd": "48.00"
  }
]

Tegen de catalogusprijs factureert Claude 600.00 tegenover 652.80 van OpenAI. De input-kosten zijn identiek, omdat de input-tarieven gelijk zijn. Het gehele prijsverschil zit in de output, en Claude wint dit met een marge die te klein is om op basis daarvan een leverancier te kiezen.

Markeer nu 800 van die 1.400 input-tokens als een stabiel voorvoegsel: de systeemprompt en de tool-schema's, die niet veranderen tussen interacties. Beide leveranciers rekenen 10% van hun basis-inputtarief voor een cache-hit. De factuur van Claude daalt naar 427.20 en die van OpenAI naar 480.00. Caching is waardevoller dan de keuze voor een leverancier, en beide platforms bieden dit aan.

Hier verliest Claude. De meeste ondersteuningsantwoorden vereisen geen workhorse-model. Verplaats hetzelfde verkeer naar de small-tier en Claude factureert 213.60 terwijl OpenAI 48.00 factureert. Deel de een door de ander en Claude kost ongeveer vierenhalf keer zoveel voor hetzelfde werk. Claude Haiku 4.5 rekent 1 per miljoen input-tokens tegenover gpt-5.6-luna op 0.2, en geen enkele hoeveelheid caching dicht een vijfvoudig gat. Als uw werklast geschikt is voor een klein model, is OpenAI goedkoper en is de marge aanzienlijk.

Scenario twee: een document-pipeline met lange context

25.000 contracten per maand. Elk verzoek bevat dezelfde instructie van 9.000 tokens en een JSON-schema, gevolgd door 12.000 tokens aan contracttekst, waarna het model ongeveer 700 tokens aan gestructureerde velden teruggeeft. De output beslaat minder dan 4% van de tokens in deze taak, en dat ene feit bepaalt de vergelijking.

ChartMonthly cost in US dollars, three workloads, cached and paired like-for-like
The data behind this chart
[
  {
    "label": "Chat feature",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Document pipeline",
    "claude_usd": "820.00",
    "openai_usd": "855.00"
  },
  {
    "label": "Coding agent",
    "claude_usd": "116.10",
    "openai_usd": "124.20"
  }
]

Met de prefix van 9.000 tokens aan beide kanten gecachet, factureert Claude 820.00 en factureert OpenAI 855.00. De inputkosten komen tot op de cent overeen, omdat de tarieven voor de standaard-input in augustus 2026 gelijk zijn. Het volledige verschil zit in de output, die bij Claude 5 keer en bij OpenAI 6 keer de prijs van de input bedraagt.

Deze taak is ook geschikt voor batching. Beide leveranciers geven 50% korting op input en output voor asynchroon werk, waardoor beide totalen halveren en de verhouding gelijk blijft. Batching is de grootste individuele korting op beide platforms, en een nachtelijke document-pipeline kan hier altijd gebruik van maken.

Waar Claude verliest, is door dezelfde logica met betrekking tot de niveaus als voorheen. Veldextractie op basis van een vast schema is precies het werk dat een klein model goed uitvoert, en de input beslaat hier 97% van de tokens. Door één niveau lager te gaan, wordt het inputtarief van OpenAI met 0,1 vermenigvuldigd en dat van Claude met 0,5. Test het kleine model op 200 documenten voordat u aanneemt dat u het grotere model nodig heeft, waarbij u dezelfde evaluatie gebruikt die u zou uitvoeren voor het kiezen van het juiste Claude-niveau voor een taak.

Scenario drie: een altijd actieve programmeer-agent

Eén ontwikkelaar draait een agent op een VPS, met ongeveer 900 model-turns per maand. Elke turn bevat ongeveer 60.000 input-tokens aan repository-context, waarvan 80% een cache-hit is, en produceert ongeveer 1.800 tokens aan wijzigingen en uitleg. Bereken de prijs op basis van het frontier-niveau, omdat bij programmeren een verschil in capaciteit direct geld kost.

Claude factureert 116.10 tegenover 124.20 van OpenAI. Bij hetzelfde input-tarief en dezelfde cache-read-rate wint Claude met ongeveer 7% dankzij het lagere output-tarief.

Die 7% valt binnen de foutmarge van de tokenizer die eerder werd genoemd, dus beschouw dit scenario als een gelijkspel wat betreft de tarieven. Wat geen gelijkspel is, is het facturatiemodel. Voor één ontwikkelaar bij dit volume kost een abonnementslicentie meestal minder dan API-aanroepen op basis van verbruik, en de hele vergelijking verandert zodra u een abonnement meerekent. Werk dit uit met de vergelijking tussen API- en abonnementskosten voordat u een agent op basis van verbruik factureert. Als u het verbruik wel meet, achterhaal dan eerst waar de tokens naartoe gaan, omdat het tokenverbruik van een programmeer-agent wordt gedomineerd door context die bij elke turn opnieuw wordt verzonden, in plaats van door de code die de agent schrijft.

De vermenigvuldigers die de factuur bepalen

Het basistarief is de kleinste post op deze lijst. Elk van de onderstaande factoren beïnvloedt een werkelijke factuur meer dan het verschil tussen de twee leveranciers in dezelfde categorie.

Gecachte input. Beide leveranciers rekenen 10% van de basis-input voor een cache-hit. Anthropic brengt ook kosten in rekening voor het schrijven naar de cache: 1,25 keer de basis-input voor een item van vijf minuten en 2 keer voor een item van een uur. Een latere hit ververst dat item tegen de leesprijs. Een item van vijf minuten verdient zichzelf dus terug na één keer lezen. Een werklast met lange pauzes tussen verzoeken schrijft vaker dan dat deze leest; in dat geval kost cachen meer dan het oplevert. Stabiel verkeer cacht goed. Verkeer met pieken doet dat niet.

Batch-kortingen. 50% korting op input en output bij beide platforms, uitsluitend voor asynchroon werk. Als de taak kan wachten, halveert dit de factuur bij beide leveranciers, en dit is cumulatief met caching.

Output-aandeel. Claude rekent 5 keer het inputtarief voor output. OpenAI rekent 6 keer. Hoe meer van uw tokens worden geschreven in plaats van gelezen, hoe gunstiger Claude oogt bij een gelijk inputtarief; voor werk dat gedomineerd wordt door input geldt het omgekeerde.

Opnieuw proberen (retries). Een retry betaalt de volledige input opnieuw en levert niets bruikbaars op. Als 6% van uw aanroepen faalt bij de schema-validatie en opnieuw wordt geprobeerd, is uw input-component 6% groter dan uw planning aangeeft. Registreer retries als een kostenpost, niet als een foutmelding. Teams ontdekken deze vermenigvuldiger als laatste, en deze is vaak groter dan het verschil tussen leveranciers waarover ze een week hebben gediscussieerd.

Welke partij verliest en waar

Claude verliest het kleine segment volledig. gpt-5.6-luna rekent 0.2 per miljoen input-tokens tegenover Claude Haiku 4.5 op 1, met output op 1.2 tegenover 5. Classificatie met een hoog volume en korte extractie kosten bij Claude ruwweg vier keer zoveel.

Claude verliest het werkpaard-segment vanaf 1 september 2026, wanneer het introductietarief afloopt en Sonnet 5 overgaat naar 3 en 15 tegenover een ongewijzigde gpt-5.6-terra. Claude wint het frontier-segment op output-tarief, met een marge die uw eigen token-aantallen teniet kunnen doen. Geen van beide partijen wint bij input-gedomineerd werk in augustus 2026, omdat bij 2 per miljoen aan beide kanten de input-kosten gelijk zijn.

Hoe u dit kunt meten bij uw eigen verkeer

Lees het usage-object bij elk antwoord en sla vier getallen per verzoek op: input tokens, output tokens, cache read tokens en cache write tokens. Bij de Claude API komen deze binnen als input_tokens, output_tokens, cache_read_input_tokens en cache_creation_input_tokens. Tel deze per dag bij elkaar op, vermenigvuldig ze met de huidige tarieven en vergelijk uw totaal met de factuur. Een verschil tussen beide is meestal het gevolg van retries of een codepad waarvan u vergeten was dat u het had uitgebracht.

Voer de vergelijking uit op basis van een week aan werkelijk verkeer in plaats van op een voorbeeldprompt, en vergelijk de kosten per voltooide taak in plaats van de kosten per token. Een model dat in één poging antwoordt tegen het dubbele tarief is goedkoper dan een model dat drie pogingen nodig heeft tegen de helft van de prijs. Kosten per token zijn een tarief. Kosten per voltooide taak zijn wat u daadwerkelijk betaalt.

Stel een harde uitgavenlimiet in voordat u iets laat draaien. Beide platforms bieden uitgavenlimieten in hun consoles, en een agent die vastzit in een retry-loop kan in één nacht het budget van een hele maand verbruiken. Richt dit in zoals u dat zou doen voor kostenbeheersing bij een altijd actieve agent. Als u de eerste versie bouwt op een server die u zelf beheert, behandelt een eerste Claude API-app op een VPS het beheer van keys en de request-loop waar deze berekeningen op gebaseerd zijn.

FAQ

Is de Claude API goedkoper dan de ChatGPT API?

Niet consistent. In augustus 2026 rekenen de frontier- en workhorse-tiers aan beide kanten hetzelfde tarief per input-token, en Claude rekent minder per output-token, waardoor Claude enkele procenten goedkoper is bij werkzaamheden met veel output. In de small-tier kost OpenAI's gpt-5.6-luna een vijfde van Claude Haiku 4.5 per input-token, waardoor classificatie op grote schaal veel goedkoper is bij OpenAI. Bereken uw eigen cijfer op basis van uw eigen token-mix, aangezien een dergelijke kleine marge meer wordt bepaald door uw workload dan door de prijslijst.

Waarom kosten dezelfde woorden een verschillend aantal tokens op elke API?

Omdat elk model zijn eigen tokenizer heeft en het aantal tokens een eigenschap van het model is. Anthropic documenteert dat Claude 4.7 en latere modellen ongeveer 30% meer tokens produceren voor dezelfde tekst dan Claude Sonnet 4.6 en eerdere versies. Stuur uw eigen tekst naar het token-tel-eindpunt van elke leverancier, deel het ene aantal door het andere en vermenigvuldig die verhouding met het gepubliceerde tarief voordat u vergelijkt. Een token-verschil van 20% weegt zwaarder dan de meeste gepubliceerde tariefverschillen.

Maakt prompt caching de rekening ooit hoger?

Ja, bij Anthropic. Een cache-write kost 1,25 keer het basis-inputtarief voor een invoer van vijf minuten en 2 keer voor een invoer van een uur, terwijl een hit 0,1 keer kost. Als uw verkeer zo grillig is dat de meeste invoeren verlopen voordat ze worden gelezen, betaalt u de write-premie en ontvangt u geen reads. Vergelijk cache_creation_input_tokens met cache_read_input_tokens in uw logs. Een verhouding nabij 1 betekent dat caching u geld kost; verleng de invoerduur of stop met het gebruik ervan.

Moet ik een coding agent draaien op de API of via een abonnement?

Voor één ontwikkelaar met een gemiddeld volume kost een abonnementsplaats meestal minder dan facturering via de API, omdat een coding agent bij elke beurt een grote context opnieuw verstuurt en die context telkens in rekening wordt gebracht. Meet het verbruik eerst een week lang en vergelijk het API-totaal vervolgens met de prijs van de abonnementsplaats. De API is voordeliger bij grillig gebruik, of wanneer u programmatische toegang nodig heeft die een abonnement niet biedt. Als u naar de API bent overgestapt vanwege het bereiken van een gebruikslimiet in plaats van vanwege de prijs, zijn er routes om een Claude-gebruikslimiet te omzeilen die minder kosten dan overstappen op facturering per gebruik.

#claude#openai#api-pricing#tokens#cost-comparison