SSD Nodes Learn
Gidsen Matt ConnorDoor Matt Connor · Bijgewerkt 2026-07-24

Claude API of abonnement: wat is goedkoper?

Bereken het break-even punt tussen de Claude API en een vast abonnement. Ontdek welke kosten per token de keuze tussen de API en een plan beïnvloeden.

Is the Claude API cheaper than a subscription?

De Claude API is goedkoper dan een abonnement bij een bepaald volume, en duurder daarboven. Voor een developer die de hele dag interactief codeert, is het vaste abonnement meestal voordeliger. Voor een programma dat zelfstandig calls maakt, is de API de enige optie, dus de kosten zijn daar niet doorslaggevend. De rest is rekenwerk dat u in tien minuten kunt uitvoeren.

Er is geen officieel break-even punt om op te zoeken. De abonnementen worden verkocht als gebruiksvakken in plaats van token-limieten, dus er is geen gepubliceerde waarde die aangeeft waar de twee lijnen elkaar kruisen. Wat volgt is de formule, gebaseerd op de huidige tarieven per token, plus de factoren in uw eigen gedrag die het antwoord veel verder doen verschuiven dan de abonnementsprijs. Elk break-even punt hieronder is mijn eigen berekening op basis van gepubliceerde tarieven en gestelde aannames, geen gedocumenteerd getal.

Als u nog moet beslissen welk plan u wilt kopen, geeft welk Claude plan past bij uw werkwijze antwoord op die vraag. Dit bericht gaat ervan uit dat u al weet welk plan u zou kopen, en wilt weten of u het überhaupt moet kopen.

Two billing models that are not the same shape

Een abonnement is capaciteit die u mogelijk niet gebruikt. U betaalt een vast bedrag en krijgt een limiet die volgens een schema wordt gereset. De Claude Code documentatie van Anthropic beschrijft de structuur voor Team en Enterprise seats: gebruik "trekt van een per-seat limiet die wordt gereset op een rollend venster van vijf uur en een wekelijks venster", gedeeld met Claude chat en Cowork. Een abonnee bereikt dezelfde limiet via het aantal berichten, wat de meldingen "You've hit your session limit" en "You've hit your weekly limit" oplevert. Capaciteit die u niet gebruikt, is geld dat u toch al heeft uitgegeven. Capaciteit die u overschrijdt, stopt uw werk totdat het venster wordt gereset; het wisselen van model met /model herstelt de toegang niet, omdat de vensters gedeeld worden over alle modellen.

De API is een meter die nooit stopt. Er is geen venster en geen muur. Elke request wordt geprijsd per token, en sommige zaken worden buiten tokens om geprijsd: web search "is beschikbaar op de Claude API voor $10 per 1.000 searches". Niets stopt bij een limiet. De factuur groeit simpelweg.

Plannormen per 23 juli 2026, geciteerd van de Claude pricing pagina: Pro is "$17 Per month with annual subscription discount ($200 billed up front). $20 if billed monthly", en het bevat Claude Code. Max wordt vermeld als "From $100 Per month". Team seats beginnen bij "$20 Per seat / month if billed annually". Enterprise is de interessante variant, omdat het beide modellen tegelijk gebruikt: "Seat price + usage at API rates $20/seat". De tarieven veranderen vaak en de limiet achter elk plan wordt nooit in tokens gepubliceerd; lees de pricing pagina op de dag van uw beslissing.

What you cannot get from the API

Een planlimiet, en de interface die daar omheen is gebouwd. Het /usage-credits commando van Claude Code beheert de credits voor abonnementen, en u voert dit uit "na het inloggen met uw claude.ai abonnement via /login; het commando is niet beschikbaar met API key authenticatie." Het /usage scherm verschilt ook per facturatiemodus: het Session blok "toont API token verbruik en is bedoeld voor API gebruikers", terwijl abonnees in plaats daarvan balken voor plangebruik en een overzicht van het verbruik zien.

Een langere prompt cache in Claude Code. Dit kost echt geld en is gemakkelijk over het hoofd te zien. De documentatie vermeldt: "De levensduur is een uur bij een abonnement en daalt naar vijf minuten zodra u gebruikmaakt van usage credits; op een API key of cloud provider is het standaard vijf minuten". Uw eerste bericht na een pauze die langer is dan de cache-levensduur maakt geen gebruik van de cache, waardoor uw volledige context opnieuw wordt verwerkt en wordt gefactureerd tegen de prijzen van een write-operatie. Met een abonnement kunt u een vergadering van vijftig minuten volgen en daarna weer verdergaan met een warme cache. Met een API key kost dezelfde pauze een volledige re-write van de session prefix.

What you cannot get from a subscription

Programmatische toegang. Een cron job of een webhook handler die Claude aanroept heeft een API key nodig; als dat uw workload is, is de vergelijking al klaar. Het bouwen van uw eerste Claude API app op een VPS behandelt de key-afhandeling en het eerste werkende script.

De Batch API korting. De pricing pagina vermeldt dit expliciet: "De Batch API maakt asynchrone verwerking van grote volumes requests mogelijk met 50% korting op zowel input als output tokens." Dat halveert de meter voor elk werk waar een mens niet op hoeft te wachten. Batch-tarieven per miljoen tokens zijn $2.50 in en $12.50 uit op Opus 4.8, $1 en $5 op Sonnet 5 bij introductieprijzen, en $0.50 en $2.50 op Haiku 4.5. De prijs is latentie: de meeste batches zijn binnen een uur klaar, een batch die niet binnen 24 uur is voltooid vervalt, en streaming kan niet worden gebatcht. Batch en prompt caching kunnen worden gecombineerd; omdat een batch langer dan vijf minuten kan draaien, kunt u de 1-uurs cache binnen een batch gebruiken.

Kosten toewijzen per project. Elke API response geeft een usage blok terug, zodat u de kosten van een enkele request kunt loggen en kunt toewijzen aan een project of klant. Een abonnement rapporteert één set balken voor de persoon die de seat bezit.

Eén ding moet duidelijk worden gesteld, omdat men in beide richtingen een verkeerde aanname kan doen: dit zijn gescheiden facturatie-omgevingen. De documentatie van Anthropic stuurt abonnementen naar de claude.ai support en Console-facturatie naar het API-platform; /usage-credits werkt niet onder een API key. Niets wat ik heb gecontroleerd geeft aan dat een abonnement API-credits bevat, dus reken op twee accounts en twee facturen.

The break-even formula

Bereken de prijs van één turn, en schaal dit vervolgens op.

turn cost = uncached_input_tokens x base_input_price
          + cache_write_tokens    x 1.25 x base_input_price
          + cache_read_tokens     x 0.10 x base_input_price
          + output_tokens         x output_price

monthly API cost = turn cost x turns_per_active_day x active_days_per_month

break even when: monthly API cost = flat plan fee

De multipliers zijn gepubliceerd, niet geschat. Een 5-minuten cache write kost "1.25x base input price", een 1-uur write kost "2x base input price", en een cache read kost "0.1x base input price". Thinking tokens worden gefactureerd als output tokens, dus ze horen bij output_tokens, zelfs op modellen die geen reasoning summary tonen.

Basistarieven per miljoen tokens (MTok), actueel op 23 juli 2026:

  • claude-fable-5: $10 input, $50 output. Cache read $1. 5-min cache write $12.50. 1M context.
  • claude-opus-4-8 en claude-opus-4-7: $5 input, $25 output. Cache read $0.50. 5-min cache write $6.25. 1M context.
  • claude-sonnet-5: $2 input, $10 output bij introductieprijzen tot 31 augustus 2026, daarna $3 en $15. Bij introductietarieven is cache read $0.20 en 5-min cache write $2.50. 1M context.
  • claude-haiku-4-5: $1 input, $5 output. Cache read $0.10. 5-min cache write $1.25. 200K context.

Er is geen toeslag voor een lange context: "A 900k-token request is billed at the same per-token rate as a 9k-token request."

A worked example, with the assumptions written down

Neem één gemiddelde Claude Code turn op Sonnet 5 met 60.000 tokens aan context: 55.000 uit de cache, 3.000 nieuw naar de cache geschreven, 2.000 tokens aan nieuwe uncached input, en 1.200 output tokens inclusief thinking.

  • Cache reads: 55,000 x $0.20/MTok = $0.0110
  • Cache writes: 3,000 x $2.50/MTok = $0.0075
  • Uncached input: 2,000 x $2.00/MTok = $0.0040
  • Output: 1,200 x $10.00/MTok = $0.0120

Dat is ongeveer $0.035 per turn. Bij 120 turns op een actieve dag is dat ongeveer $4.14 per dag. Bij 20 actieve dagen per maand is dat ongeveer $83 per maand.

Vergelijk dit met de vaste kosten hierboven; het zegt twee dingen tegelijk. Het is ongeveer vier keer de Pro-prijs, dus Pro is op papier goedkoper, mits de limiet 120 Sonnet turns per dag toelaat. Die voorwaarde is iets wat geen enkel gepubliceerd getal voor u kan bevestigen. Dezelfde $83 ligt onder de instapprijs van Max, dus hier is de meter voordeliger dan Max.

Verander nu één aanname tegelijk en kijk hoe de plannprijs niet langer het doorslaggevende getal is.

Three things move the break-even more than the plan price does

Prompt caching. Voer dezelfde 60.000-token turn uit zonder caching en de hele prompt wordt gefactureerd als nieuwe input: 60,000 x $2.00/MTok = $0.12, plus $0.012 aan output, dus $0.132 per turn. Dat is bijna vier keer de turn met cache, en het verandert de $83 per maand in ongeveer $317. Dit is het enige break-even punt dat Anthropic wel publiceert, omdat het niet afhankelijk is van uw workload: "A cache hit costs 10% of the standard input price, which means caching pays off after just one cache read for the 5-minute duration (1.25x write), or after two cache reads for the 1-hour duration (2x write)."

Twee foutmodi schakelen caching uit zonder waarschuwing. De eerste is een prefix die korter is dan de minimale cachebare lengte van het model: 512 tokens op Fable 5, 1.024 op Opus 4.8 en Sonnet 5, 2.048 op Opus 4.7, en 4.096 op Haiku 4.5. Een kortere prefix wordt niet gecached en er wordt geen foutmelding gegeven. De tweede is parallelle requests, omdat "a cache entry only becomes available after the first response begins." Tien identieke requests die tegelijk worden verzonden, betalen allemaal de volledige inputprijs. Het teken voor beide is dat cache_read_input_tokens op nul staat.

Modelkeuze. Bereken dezelfde turn op Opus 4.8, tegen $5 in en $25 uit, met cache reads van $0.50 en 5-min writes van $6.25 per MTok: reads $0.0275, writes $0.0188, uncached input $0.0100, output $0.0300. Dat is ongeveer $0.086 per turn, 2,5 keer de Sonnet turn, en ongeveer $207 per maand bij hetzelfde volume. Eén modelkeuze verplaatste hetzelfde werk van onder de instapprijs van Max naar meer dan het dubbele daarvan. Haiku 4.5 tegen $1 en $5 verplaatst het de andere kant op voor mechanisch werk zoals log triage.

Het inspanningsniveau hoort bij de modelkeuze, omdat thinking tokens tegen outputtarieven worden gefactureerd. Op Opus 4.8 is de API-standaard high, en het gedocumenteerde startpunt voor coderen en agentic werk is de duurdere xhigh. Verlaag dit met /effort in Claude Code of met output_config.effort op de API. Nog één ding verschuift oude schattingen: de nieuwere modellen gebruiken een nieuwere tokenizer die "ongeveer 30% meer tokens produceert voor dezelfde tekst", dus een telling op een ouder model onderschat de kosten van dezelfde tekst vandaag.

Sessionhygiëne. De API is stateless, dus elke turn stuurt de volledige conversatie opnieuw als gefactureerde input. Een lange sessie kost daarom meer per bericht dan een nieuwe sessie; dit is de oorzaak achter de meeste verrassingsfacturen en wordt gedetailleerd behandeld in wat daadwerkelijk tokens verbruikt in een Claude Code sessie. Voer /clear uit tussen ongerelateerde taken, omdat verouderde context bij elk volgend bericht opnieuw wordt verzonden en gefactureerd. Voer /compact uit binnen één lange taak, zodat de historie wordt samengevat in plaats van volledig wordt meegestuurd. Werk in aaneengesloten blokken, omdat de standaard cache "has a 5-minute lifetime" en "is refreshed for no additional cost each time the cached content is used". Een sessie die u elke tien minuten aanraakt, betaalt elke keer een re-write. Een losstaande Claude Code sessie die draait in tmux op een VPS verbruikt bijna niets terwijl deze in rust is, maar als de cache-levensduur wordt overschreden, gaat u alsnog de warme prefix kwijt.

Measure your own usage before you decide

Beslis niet op basis van mijn voorbeeld. Beslis op basis van een week van uzelf.

Voer in Claude Code een week lang /usage uit aan het einde van elke sessie (/cost is een alias voor hetzelfde scherm). Het rapporteert de tokenaantallen van de sessie en een kostenraming, met één kanttekening uit de documentatie: "The dollar figure is an estimate computed locally from token counts and may differ from your actual bill." Totals worden gereset wanneer u /clear uitvoert, dus lees eerst het scherm. Bij een abonnement is dat dollarbedrag niet uw factuur, maar de tokenaantallen erachter zijn wat deze formule nodig heeft. /context laat zien wat het venster vult.

Op een API-account is de usage pagina in de Claude Console het officiële overzicht. Om een prompt te prijzen voordat u deze verzendt, is client.messages.count_tokens() "free to use but subject to requests per minute rate limits based on your usage tier", en het is de enige telling die de tokenizer gebruikt waarover u daadwerkelijk wordt gefactureerd.

Lees na een call het usage blok en lees het correct:

u = response.usage
total_input = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokens

input_tokens telt alleen het resterende uncached deel, gedocumenteerd als de "tokens after the last cache breakpoint". Een turn die input_tokens: 4000 rapporteert is geen 4.000-token turn, en de drie velden bij elkaar opgeteld zijn de promptgrootte die deze formule nodig heeft.

Vergelijk vervolgens. Als uw gemeten maand duidelijk onder de plannprijs ligt, kies dan de meter. Als het duidelijk erboven ligt, kies dan het plan, mits de limiet een normale werkdag voor u kan dragen. Als het dicht bij de lijn ligt, kies dan het plan, want een plan kan u niet verrassen, terwijl een meter dat wel kan.

FAQ

Is the Claude API cheaper than Claude Pro or Max?

Het hangt af van het volume, en er is geen gepubliceerde break-even om op te zoeken, omdat abonnementen worden verkocht als gebruiksvakken in plaats van token-limieten. Bereken de prijs van één typische turn op basis van de gepubliceerde tarieven per token, vermenigvuldig dit met uw turns per actieve dag en actieve dagen per maand, en vergelijk dat getal met de plannprijs. In één uitgewerkt voorbeeld kwam een 60.000-token Sonnet 5 turn uit op ongeveer $0.035, oftewel ongeveer $83 per maand bij 120 turns per dag gedurende 20 dagen: boven de Pro-prijs, onder de instapprijs van Max.

How do I work out my Claude API cost per month?

Voer een week lang /usage uit in Claude Code om echte tokenaantallen te verzamelen, of lees de usage pagina in de Claude Console als u al een API-account heeft. Bereken vervolgens de prijs van één turn: uncached input tegen het basistarief, cache writes tegen 1.25 keer het basistarief, cache reads tegen 0.1 keer het basistarief, en output tegen het outputtarief, waarbij thinking tokens als output worden geteld. Vermenigvuldig dit met turns per actieve dag en actieve dagen per maand.

What changes a Claude API bill the most?

Prompt caching, meer dan wat dan ook. Een 60.000-token turn op Sonnet 5 kost ongeveer $0.035 wanneer de prefix uit de cache komt en ongeveer $0.132 wanneer dat niet het geval is. Modelkeuze komt daarna: dezelfde turn op Opus 4.8 kost ongeveer $0.086. Sessieduur komt op de derde plaats, omdat de API stateless is en elke turn de hele conversatie opnieuw als gefactureerde input verstuurt.

Does a Claude subscription include API access?

Beschouw ze als twee accounts met twee facturen. API-calls worden gefactureerd per token tegen een account dat u in de Console aanmaakt, en niets in de documentatie die ik heb gecontroleerd geeft aan dat een abonnement API-credits verleent. Het duidelijkste teken dat het gescheiden omgevingen zijn, is het /usage-credits commando van Claude Code, dat "isn't available with API key authentication". Veel developers hebben beide: een plan voor interactief coderen, een key voor de dingen die ze bouwen.