Hoeveel tokens bevat een Claude Pro abonnement?
Claude Pro hanteert geen vast aantal tokens. Uw gebruik wordt gemeten in berichten per tijdvenster. Lees hier hoe dit systeem werkt en wat uw limiet beïnvloedt.
Hoeveel tokens zijn inbegrepen bij Claude Pro?
Claude Pro bevat geen vast aantal tokens en per september 2026 publiceert Anthropic hierover geen cijfers. Een Claude-abonnement wordt gemeten in berichten binnen een voortschrijdend tijdvenster, niet in tokens die van een saldo worden afgetrokken. Hoe groot dat venster is, hangt af van het model dat u kiest, de lengte van uw conversatie en de hoeveelheid tekst die elke interactie bevat.
Dit is het antwoord dat zelden wordt gegeven, omdat mensen verwachten dat een abonnement werkt zoals een API key. Een API key verbruikt een saldo dat in tokens wordt geteld, waardoor u de factuur zelf kunt berekenen. Een abonnement verkoopt toegang tot een limiet die Anthropic vaststelt en aanpast; aangezien deze limiet in berichten wordt uitgedrukt, is er geen vast aantal tokens te noemen. Iedereen die u wel een getal geeft, verzint dit.
Stel daarom een andere vraag. Wat maakt mijn berichten duur? Daar is een concreet antwoord op, en daar kunt u vandaag nog actie op ondernemen.
Waarom een abonnement geen tokenaantal kan offreren
De API brengt elk verzoek in rekening op basis van tokens. Input-tokens omvatten alles wat u verstuurt, output-tokens omvatten alles wat het model terugschrijft, en voor beide gelden verschillende tarieven. Dit is de reden waarom input- en output-tokens verschillende bedragen kosten voordat u een schatting maakt.
De consumentenabonnementen hebben geen saldo om uit te geven. Anthropic hanteert een limiet voor het aantal berichten dat u mag versturen binnen een voortschrijdend venster dat opent bij uw eerste bericht en na een vast aantal uren sluit. De betaalde abonnementen kennen een tweede, ruimere limiet die over een week wordt gemeten. Een bericht heeft geen vaste grootte, waardoor hetzelfde aantal berichten voor twee verschillende personen een zeer uiteenlopende hoeveelheid werk betekent. De helppagina's van Anthropic beschrijven de limieten in geschatte berichten voor een kort gesprek, en waarschuwen vervolgens dat lange gesprekken en grote bijlagen het tegoed sneller verbruiken. Die waarschuwing is het volledige verhaal, en het mechanisme erachter wordt vrijwel nooit uitgelegd.
Waarom beurt 20 van een chat veel meer kost dan beurt 1
Het model onthoudt niets tussen verzoeken. Het is stateless, waardoor bij elke beurt het volledige gesprek opnieuw wordt verzonden: de system prompt, elk eerder bericht dat u schreef, elk eerder antwoord van Claude en elk bestand dat u heeft bijgevoegd. Uw nieuwe vraag is misschien twintig woorden lang. Het verzoek dat deze bevat, is echter het volledige transcript.
De kosten van een beurt stijgen daarom naarmate de chat langer wordt, en deze stijging verloopt lineair. De onderstaande rijen tonen die berekening op basis van een set aannames: een system prompt van ongeveer 1.000 tokens, uw berichten van elk ongeveer 1.000 tokens en antwoorden van elk ongeveer 1.200 tokens. Deze illustreren het mechanisme. Het is geen meting van uw account.
The data behind this chart
[
{
"label": "Turn 1",
"sent_this_turn": "2,000",
"cumulative_input": "2,000"
},
{
"label": "Turn 5",
"sent_this_turn": "10,800",
"cumulative_input": "32,000"
},
{
"label": "Turn 10",
"sent_this_turn": "21,800",
"cumulative_input": "119,000"
},
{
"label": "Turn 20",
"sent_this_turn": "43,800",
"cumulative_input": "458,000"
}
]Bij de eerste beurt verzendt u 2,000 input-tokens. Bij beurt 20 verzendt dezelfde korte vraag 43,800, meer dan twintig keer zoveel, voor dezelfde hoeveelheid typewerk van uw kant. Over het gehele gesprek heeft u 458,000 input-tokens verzonden, en het grootste deel daarvan is dezelfde tekst die telkens opnieuw wordt verstuurd.
Twintig afzonderlijke chats van één beurt zouden twintig keer de eerste rij hierboven hebben verzonden en niets anders. Dezelfde vragen, een fractie van de belasting. Bijlagen vergroten dit verschil, omdat een PDF die u bij beurt twee heeft bijgevoegd, bij beurt drie, bij beurt vier en bij elke daaropvolgende beurt opnieuw wordt verzonden, ongeacht of het gesprek er nog over gaat.
Dit is de reden waarom twee personen met hetzelfde abonnement een totaal ander verbruik rapporteren. De een houdt de hele week één thread open en bereikt de limiet op woensdag. De ander opent voor elke taak een nieuwe chat en bereikt zelden een limiet. Geen van beiden doet iets verkeerd. Hun tokenverbruik verschilt een grootteorde omdat hun gewoontes verschillen.
Op de API kunt u de herhaalkosten beperken met prompt caching, waarbij het ongewijzigde begin van een verzoek wordt opgeslagen, zodat latere aanroepen voor dat deel tegen een gereduceerd inputtarief worden gefactureerd. Bij een abonnement heeft u geen controle over caching, dus de gesprekslengte is de knop waar u daadwerkelijk aan kunt draaien. Hetzelfde mechanisme domineert programmeersessies, waarbij bestandsinhoud en tooldefinities bij elke beurt worden meegestuurd. Daarom doet de context van een programmeersessie klein houden meer voor uw limieten dan welke instelling dan ook, en is waar de tokens van een Claude Code-sessie echt naartoe gaan het lezen waard voordat u het abonnement de schuld geeft.
Wat elk abonnementsniveau biedt, in relatieve termen
Geen enkel niveau publiceert een absoluut quotum. Wat wordt gepubliceerd is relatief, en dit relatieve beeld is voldoende om een keuze te maken. Free bevindt zich onderaan, en de vrije capaciteit kan beperkt worden wanneer de vraag naar de dienst hoog is. Pro bevindt zich daarboven. Max wordt verkocht in twee formaten, beschreven als veelvouden van het Pro-gebruik, grofweg vijf keer en grofweg twintig keer zoveel. Team en Enterprise worden per gebruiker geprijsd en hanteren hun eigen limieten.
Beschouw deze vermenigvuldigers als een intentieverklaring in plaats van als een contract. Anthropic past de limieten aan en deze aanpassingen worden niet vooraf aangekondigd; dit is een extra reden waarom geen enkele eerlijke pagina u een exact aantal tokens kan geven. Voor het financiële aspect van dezelfde vergelijking behandelen wat Pro kost en waar de limieten liggen en het verschil tussen de twee Max-niveaus dit onderwerp, en wat het Free-abonnement daadwerkelijk toestaat beslaat de ondergrens.
De modelkeuze is een tweede vermenigvuldiger die bovenop het niveau komt. Dezelfde vraag kost meer van uw venster bij het grootste model dan bij het kleinste, omdat een zwaarder model per token duurder is om uit te voeren. Het verplaatsen van routinewerk van Opus naar Sonnet of Haiku levert vaak meer werktijd op dan een upgrade, dus het model afstemmen op de taak is het eerste wat u moet proberen wanneer u voortdurend tegen limieten aanloopt.
Hoe u uw eigen verbruik inzichtelijk maakt in plaats van te gokken
Uw eigen account is de enige betrouwbare bron en is met twee klikken bereikbaar. Open op claude.ai de instellingen (Settings) en vervolgens het verbruik (Usage). Hier ziet u wat u in het huidige venster heeft verbruikt en wanneer dit venster wordt gereset. Controleer dit één keer wanneer antwoorden worden geweigerd en één keer na een lange sessie; zo leert u uw eigen patroon sneller kennen dan via welke gepubliceerde cijfers dan ook.
In Claude Code voeren twee slash-commando's dezelfde taak uit vanaf de terminal. /usage rapporteert het verbruik van het abonnement en de reset-tijd. /context geeft een overzicht van wat het contextvenster op dit moment vult, waarbij onderscheid wordt gemaakt tussen de systeemprompt, tooldefinities, bestanden en de gespreksgeschiedenis. Wanneer /context laat zien dat een oud gesprek de overhand heeft, start /clear een nieuwe sessie en daalt de kosten per beurt weer richting de eerste rij van de bovenstaande tabel.
Bij de API is de telling exact en kunt u deze opvragen voordat u iets verstuurt:
curl https://api.anthropic.com/v1/messages/count_tokens \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-sonnet-5",
"messages": [{"role": "user", "content": "Summarise the attached report."}]
}'Een correct antwoord bevat één veld; dit is het getal dat voor de facturering wordt gebruikt:
{"input_tokens": 14}Elk voltooid verzoek rapporteert dezelfde administratie zodra het is afgerond:
{"usage": {"input_tokens": 21430, "output_tokens": 512}}Verstuur één korte vraag als een nieuw verzoek, verstuur vervolgens diezelfde vraag aan het einde van een lange thread en vergelijk de twee input_tokens-waarden. Het verschil is exact het effect dat uw abonnement meet, vastgelegd in een getal.
Wat te doen als de limiet halverwege een taak wordt bereikt
- Wacht op het venster. De applicatie toont de reset-tijd en het wachten duurt vaak korter dan het toepassen van een workaround. Dit is de juiste keuze wanneer er geen urgente deadlines zijn.
- Schakel over naar een lichter model. Een kleiner model is per beurt goedkoper in elk abonnement. Bij sommige abonnementen wordt er geput uit een aparte toewijzing, waardoor het werk doorgaat terwijl het zwaardere model rust.
- Start een nieuwe chat met alleen de informatie die nodig is voor de volgende stap. Plak de conclusie, niet het volledige transcript. De kosten per beurt dalen direct en de antwoorden verbeteren meestal, omdat het model niet langer duizenden tokens aan afgeronde discussie hoeft te verwerken.
- Verplaats de taak naar de API, waar tokens per verzoek worden geteld en per token worden gefactureerd. Er is geen venster om op te wachten en u kunt de prijs van elke aanroep zien voordat en nadat u deze uitvoert.
Welke optie geschikt is, hangt af van de vraag of uw probleem de tijd of de werklast is. Een eenmalige piek is een timingprobleem. Een muur waar u elke woensdag tegenaan loopt, is een werklastprobleem; hiervoor is de API of een groter abonnement geschikter dan een betere timing. de volledige checklist voor een limiet die halverwege een taak wordt bereikt begeleidt u stap voor stap bij het herstel, en hoe de rollende vensters openen en resetten legt uit waarom de klok zich op deze manier gedraagt. Als u overweegt de API te gaan gebruiken, bereken dan eerst de kosten: de API afgezet tegen een abonnement voor dezelfde werklast en wat een miljoen tokens daadwerkelijk kost bieden de berekeningen voordat u de overstap maakt.
FAQ
Hoeveel tokens zijn inbegrepen bij Claude Pro?
Anthropic publiceert geen tokenlimiet voor Pro, en per september 2026 is er geen specifiek getal te noemen. Pro wordt gemeten op basis van het aantal berichten binnen een voortschrijdend venster, met een ruimere limiet die over een week wordt berekend. Hoeveel berichten er in dit venster passen, hangt af van het model en de lengte van uw conversatie. Elke pagina die een specifiek maandelijks aantal tokens voor Pro noemt, speculeert slechts. Open Settings en vervolgens Usage op claude.ai om uw eigen verbruik en het tijdstip van de reset te bekijken.
Reset het starten van een nieuwe chat mijn verbruik?
Nee. Het verbruik wordt voor uw account over het gehele venster geteld, dus een nieuwe chat geeft niet terug wat u al heeft verbruikt. Wat het wel verandert, zijn de kosten per interactie vanaf dat punt. Een nieuwe chat bevat geen transcript dat opnieuw moet worden verzonden, waardoor deze aan het begin van de bovenstaande schaal start in plaats van verder op te lopen. Het openen van een nieuwe chat bij een onderwerpwijziging is de meest kostenefficiënte gewoonte voor elk abonnement.
Waarom heb ik vandaag sneller mijn limiet bereikt dan gisteren?
Dit komt meestal doordat het werk van vandaag in één lange thread plaatsvond. Bij elke interactie wordt de volledige conversatie plus eventuele bijgevoegde bestanden opnieuw verzonden, waardoor de kosten per bericht gestaag oplopen terwijl het aantal berichten voor u gelijk lijkt te blijven. De andere veelvoorkomende oorzaak is het model: zwaardere modellen verbruiken de limiet sneller per interactie, waardoor een middag op het grootste model eerder eindigt dan een ochtend op een kleiner model.
Moet ik overstappen naar de API voor nauwkeurige token-telling?
Stap over als u de exacte cijfers of voorspelbaarheid nodig heeft. De API telt input- en output-tokens bij elke aanroep, biedt een endpoint voor token-telling dat u kunt aanroepen vóór verzending, en kent geen wachttijdvenster. Er wordt per token gefactureerd, dus intensief gebruik kost meer dan een vast abonnement en licht gebruik kost aanzienlijk minder. Bereken uw werkelijke werklast ten opzichte van uw huidige abonnement voordat u overstapt, aangezien het antwoord afhangt van het aantal tokens dat u verstuurt.