SSD Nodes Learn Hosting plans →
Gidsen Matt ConnorDoor Matt Connor · Bijgewerkt 2026-08-28

Claude gebruikslimiet bereikt: wat moet u nu doen?

Wanneer u de melding voor Claude gebruikslimieten krijgt, helpt wisselen van model niet. Ontdek het verschil tussen abonnementsquota en de HTTP 429 API rate limit foutmelding.

Wat zijn de gebruikslimieten van Claude?

De gebruikslimieten van Claude zijn onderverdeeld in twee afzonderlijke systemen. De eerste stap is bepalen welk systeem uw toegang heeft beperkt. Een Claude-abonnement (Pro, Max, Team of Enterprise) biedt een doorlopend gebruiksquotum dat wordt gedeeld tussen modellen en met de Claude-chat. Bij overschrijding krijgt u een melding zoals You've hit your session limit · resets 3:45pm. De Claude API hanteert een andere maatstaf: de snelheid waarmee u verzoeken en tokens verstuurt, gemeten per minuut. Bij overschrijding ontvangt u een HTTP 429-fout van het type rate_limit_error, vergezeld van een retry-after-header die aangeeft hoeveel seconden u moet wachten.

De oplossingen voor beide situaties verschillen volledig. Een abonnementslimiet heeft betrekking op het totale verbruik binnen een bepaalde periode; u moet wachten tot de limiet wordt gereset of extra gebruik bijkopen. Een API-rate-limit heeft betrekking op uw huidige snelheid en wordt na enkele seconden opgeheven zodra u uw verzoekfrequentie verlaagt.

De toegestane quota per abonnement en de getallen voor rate-limit-tiers wijzigen regelmatig. Omdat onjuiste informatie schadelijker is dan geen informatie, worden deze hier niet vermeld. Raadpleeg uw eigen limieten met de onderstaande commando's.

Welke limiet heeft u bereikt? Lees het exacte bericht

Claude Code benoemt het systeem in de tekst die het weergeeft. Controleer welk systeem op u van toepassing is voordat u wijzigingen aanbrengt.

  • You've hit your session limit · resets 3:45pm is een abonnementslimiet. Het beschikbare quotum van uw abonnement voor dit tijdsbestek is verbruikt.
  • You've hit your weekly limit · resets Mon 12:00am is hetzelfde systeem voor het langere tijdsbestek.
  • You've hit your Opus limit · resets 3:45pm is een abonnementslimiet die alleen geldt voor Opus-verzoeken. Dit is het enige geval waarin het wisselen van model helpt.
  • API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com. is een API-rate limit. U heeft de limiet bereikt die is geconfigureerd voor uw API-sleutel, of voor uw Amazon Bedrock- of Google Cloud-project. Welke van deze van toepassing is, hangt af van hoe de client authenticeert, aangezien een Bedrock- of Vertex-client wordt gemeten op basis van het quotum van uw cloudproject in plaats van een Anthropic-organisatie.
  • API Error: Server is temporarily limiting requests (not your usage limit) is een tijdelijke vertraging (throttle) die losstaat van uw abonnementsquotum. Claude Code probeert het automatisch opnieuw met backoff voordat deze regel aan u wordt getoond.

Abonnementslimieten: sessie, wekelijks en het Opus-venster

Een abonnement bevat een doorlopend gebruiksquotum. Wanneer dit is verbruikt, blokkeert Claude Code verdere verzoeken tot het reset-tijdstip dat in het bericht wordt getoond. Twee eigenschappen van dit quotum zorgen voor de meeste verwarring.

  • Het wordt gedeeld met Claude chat. Werk dat u uitvoert op claude.ai verbruikt hetzelfde quotum als werk in de terminal; een drukke middag in de chat verkort dus uw programmeeravond. Elk platform waarop u met dat account inlogt, put uit dezelfde voorraad. Op Linux verbruiken de bèta-desktopapp en de Claude Code CLI dus samen één quotum, niet elk afzonderlijk.
  • Het wordt gedeeld over modellen heen. Sessie- en weeklimieten kennen geen budget per model, met de enige uitzondering van de Opus-limiet.

Bij Claude for Teams en Enterprise is de gedocumenteerde structuur een quotum per gebruiker dat wordt gereset op basis van een doorlopend venster van vijf uur en een wekelijks venster. Dit wordt gedeeld met Claude chat en Cowork, en de omvang wordt bepaald door het type licentie (Standard of Premium). Bij Pro en Max zijn de reset-tijd in het bericht en uw eigen /usage-balken de betrouwbare cijfers, niet een getal dat uit een blogpost is gekopieerd. Als u nog een keuze moet maken voor een licentietype, vergelijkt welk Claude-abonnement u nodig heeft wat elk abonnement precies beperkt.

Waarom wisselen van model met /model de toegang niet herstelt

Dit is de meest gemaakte fout, en de documentatie is hierover duidelijk: sessie- en weeklimieten worden gedeeld tussen alle modellen, dus het wisselen van model herstelt de toegang niet. Het kiezen van een kleiner model nadat uw sessietegoed is verbruikt, verandert alleen welk model antwoord zou geven. Het verandert niets aan de resterende limiet, omdat de limiet nooit per model werd bijgehouden; de wissel heeft dus niets om vrij te geven.

De uitzondering is de Opus-limiet, een plafond dat daadwerkelijk modelspecifiek is. Als het bericht You've hit your Opus limit luidt, dan is /model de juiste oplossing. Schakel over naar een ander model en werk verder, omdat alleen Opus-verzoeken werden geblokkeerd.

De limiet als een bug beschouwen is de tweede fout. Opnieuw installeren of opnieuw verifiëren verandert niets. Het tegoed wordt aangevuld wanneer het tijdsvenster wordt gereset, of wanneer u gebruikstegoeden aanschaft.

Wat te doen bij het bereiken van een abonnementslimiet

  1. Controleer de reset-tijd. Een sessievenster is kort. Een wekelijks venster is niet iets waar u achter uw bureau op wacht.
  2. Als het de Opus-limiet betreft, voer /model uit en kies een ander model.
  3. Voer /usage uit om uw abonnementslimieten, uw verbruik en de reset-tijd te bekijken. /cost is een alias voor hetzelfde scherm.
  4. Voer /usage-credits uit om door te werken nadat het plafond is bereikt. Bij Pro en Max opent dit uw factureringsinstellingen. Bij Team en Enterprise opent dit de gebruiksinstellingen van uw organisatie, of wordt er een verzoek naar uw beheerders gestuurd als u geen toegang heeft tot de facturering.
  5. Als u elke week tegen dezelfde muur aanloopt, is het abonnement niet passend voor uw werkwijze en is het de moeite waard om de manieren om een gebruikslimiet te omzeilen één keer te overwegen in plaats van bij elke reset.

/usage-credits vereist een claude.ai-abonnement waarvoor u bent ingelogd via /login. Het is niet beschikbaar bij authenticatie via een API-sleutel, omdat een API-sleutel geen abonnementsruimte heeft om uit te breiden.

Gebruikstegoeden hebben één bijwerking die belangrijk is om vooraf te weten. De levensduur van de prompt-cache is een uur bij een abonnement en daalt naar vijf minuten zodra u gebruikmaakt van tegoeden. Hierdoor starten meer beurten koud en stijgt het Claude Code tokenverbruik voor hetzelfde werk.

Berichten die lijken op gebruikslimieten maar dat niet zijn

Vier foutmeldingen in Claude Code worden gerapporteerd als gebruikslimieten, terwijl dit niet het geval is.

  • Een waarschuwing over context of auto-compact is geen gebruikslimiet. /context toont een regel zoals Context exceeds the 200k-token limit by 94k tokens — run /compact or /clear to continue. zodra het gesprek de contextwindow van het model overschrijdt. Oudere geschiedenis wordt samengevat om ruimte vrij te maken; uw abonnementslimiet blijft onaangetast.
  • Error during compaction: Conversation too long. Press esc twice to go up a few messages and try again. betekent dat /compact zelf is mislukt, omdat er onvoldoende vrije context over is om de samenvatting te genereren.
  • Credit balance is too low betekent dat uw Console-organisatie geen prepaid-tegoed meer heeft. Voeg tegoed toe via platform.claude.com/settings/billing, waar u ook automatisch opwaarderen kunt instellen.
  • API Error: Usage credits required for 1M context · run /usage-credits to turn them on, or /model to switch to standard context is een controle op rechten, geen uitgeput quotum. Kies de modelvariant zonder het [1m]-achtervoegsel, of stel CLAUDE_CODE_DISABLE_1M_CONTEXT=1 in.

Er is nog één melding afkomstig van de API. Een 413 request_too_large is een groottelimiet voor een enkel verzoek, geen rate limit.

API-rate-limits: wat de 429-foutmelding daadwerkelijk telt

De Messages API meet drie zaken, afzonderlijk voor elke modelklasse.

  • requests per minute (RPM)
  • input tokens per minute (ITPM)
  • output tokens per minute (OTPM)

Uw organisatie heeft ook een bestedingslimiet, wat iets anders is: een maximaal maandelijks bedrag voor API-gebruik. Zodra u de bestedingslimiet van uw tier bereikt, wordt het API-gebruik gepauzeerd tot de volgende maand, tenzij u een hogere limiet aanvraagt. Een retry-loop lost dit niet op.

Vier mechanismen bepalen wanneer de 429-foutmelding optreedt.

  • Limieten gelden per modelklasse. Ze zijn afzonderlijk van toepassing op elk model, waardoor u verschillende modellen tegelijkertijd tot hun respectievelijke limieten kunt gebruiken. Sommige families delen een bucket: de Opus-ratelimiet is een totaal voor Claude Opus 4.8, Opus 4.7, Opus 4.6 en Opus 4.5, terwijl Claude Sonnet 5 een eigen limiet heeft.
  • Capaciteit wordt continu aangevuld. De API gebruikt een token bucket-algoritme, waardoor de capaciteit continu wordt aangevuld in plaats van op een vast moment te resetten. Een limiet van 60 requests per minute kan worden afgedwongen als één request per seconde; 60 requests die tegelijkertijd worden verstuurd, zullen dus alsnog falen.
  • Alleen niet-gecachte input telt mee voor ITPM bij de meeste modellen. input_tokens en cache_creation_input_tokens tellen mee. cache_read_input_tokens telt bij de meeste Claude-modellen niet mee, met Claude Haiku 3.5 als gedocumenteerde uitzondering. Caching levert daarom zowel ruimte in de ratelimiet als een korting op. Aan de output-zijde telt een hoge max_tokens niet mee voor OTPM, omdat OTPM alleen de daadwerkelijk geproduceerde tokens telt.
  • Limieten gelden op organisatieniveau. Aan een workspace kan een lagere limiet worden toegewezen, en limieten op organisatieniveau zijn altijd van kracht, zelfs als de som van de workspace-limieten hoger uitvalt. Een limiet die u niet op workspace-niveau heeft overschreven, wordt geërfd van de organisatie en is dus niet onbeperkt.

Tiers genaamd Start, Build, Scale en Custom bepalen de daadwerkelijke getallen, die automatisch worden toegewezen op basis van uw gebruiksgeschiedenis en accountstatus. Nieuwe organisaties kunnen onder de standaard gepubliceerde limieten beginnen, waardoor een eerste 429-foutmelding eerder kan optreden dan een tabel doet vermoeden. Een scherpe stijging in het gebruik activeert versnellingslimieten, die een 429-foutmelding geven terwijl u zich nog binnen uw tier bevindt; verhoog het verkeer daarom geleidelijk. Elk gepubliceerd cijfer is een plafond: de gedocumenteerde limieten zijn het maximaal toegestane gebruik, geen gegarandeerde minima. Gebruik de "Request rate limit increase"-optie op de Limits-pagina in de Claude Console om een verhoging aan te vragen.

Een 429 lezen: retry-after, de headers en SDK-retries

Elke API-fout retourneert hetzelfde omhulsel: een genest error-object dat het type en het bericht bevat, plus een request_id op het hoogste niveau.

{
  "type": "error",
  "error": {
    "type": "rate_limit_error",
    "message": "<names the rate limit you exceeded>"
  },
  "request_id": "req_011CSHoEeqs5C35K2UUqR7Fy"
}

De headers bevatten de rest van de informatie.

  • retry-after is het aantal seconden dat u moet wachten voordat u het verzoek opnieuw kunt proberen. Eerdere pogingen zullen mislukken.
  • anthropic-ratelimit-requests-limit, anthropic-ratelimit-requests-remaining en anthropic-ratelimit-requests-reset beschrijven uw verzoekbudget.
  • anthropic-ratelimit-input-tokens-* en anthropic-ratelimit-output-tokens-* doen hetzelfde voor ITPM en OTPM, met dezelfde achtervoegsels voor limit, remaining en reset.
  • anthropic-ratelimit-tokens-* toont de waarden voor de meest restrictieve limiet die momenteel van kracht is.

Reset-headers zijn RFC 3339-tijdstempels. Headers voor resterende tokens worden afgerond op het dichtstbijzijnde duizendtal; beschouw deze dus als een indicatie. De fast mode heeft een eigen pool en eigen anthropic-fast-*-headers. Lees deze allemaal uit bij elk geslaagd verzoek:

curl -s -D - -o /dev/null https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{"model":"claude-sonnet-5","max_tokens":16,"messages":[{"role":"user","content":"hi"}]}' \
  | grep -i 'ratelimit\|retry-after\|request-id'

Elke respons bevat ook een unieke request-id-header, zoals req_018EeWyXxfu5pfWkrYcMdjWG. Deze verschijnt als request_id in foutmeldingen en als _request_id in responsen van de Python- en TypeScript-SDK. Vermeld deze code wanneer u contact opneemt met de ondersteuning.

Controleer of u daadwerkelijk een backoff-loop nodig heeft voordat u er een schrijft. De officiële SDK's voeren automatisch retries uit bij tijdelijke fouten, waaronder verbindingsfouten, rate limits en 5xx-serverfouten, met exponentiële backoff. Standaard gebeurt dit twee keer, waarbij de retry-after-header wordt gerespecteerd indien aanwezig. Elke client accepteert een maximum-retries-optie om dit gedrag aan te passen of uit te schakelen.

import anthropic

client = anthropic.Anthropic(max_retries=5)  # the SDK default is 2

try:
    msg = client.messages.create(
        model="claude-sonnet-5",
        max_tokens=1024,
        messages=[{"role": "user", "content": "hello"}],
    )
except anthropic.RateLimitError as err:
    headers = err.response.headers
    print("still limited after retries; wait", headers.get("retry-after"), "seconds")
    print("request id:", headers.get("request-id"))

529 overloaded_error is niet uw schuld

Een 429-foutmelding geeft aan dat u te veel verzoeken verstuurt. Een 529 overloaded_error-foutmelding geeft aan dat de API tijdelijk overbelast is; dit kan voorkomen wanneer de API een hoog verkeersvolume van alle gebruikers tegelijkertijd verwerkt. Dit wordt niet veroorzaakt door uw key of uw code. Probeer het opnieuw met exponential backoff, wat de SDK's al automatisch doen voor 5xx-antwoorden, en controleer status.claude.com als het probleem aanhoudt. Een 500 api_error-foutmelding is een interne fout die u op dezelfde manier opnieuw probeert; in beide gevallen is er geen sprake van een rate limit.

Lees uw eigen limieten in plaats van een tabel

Bij een abonnement is /usage het scherm dat ertoe doet. Het toont de balken van uw abonnementsgebruik en een overzicht van wat deze heeft verbruikt, en d of w schakelt tussen de afgelopen 24 uur en de afgelopen 7 dagen. Twee kanttekeningen. Het blok Sessie toont het gebruik van API-tokens en is bedoeld voor API-gebruikers; abonnees kunnen het dollarbedrag daarvan negeren. De cijfers zijn afkomstig van de lokale sessiegeschiedenis op die machine, waardoor gebruik vanaf een ander apparaat of vanaf claude.ai ontbreekt.

Aan de API-kant tekent de pagina Gebruik in de Claude Console twee grafieken: "Rate Limit - Input Tokens" en "Rate Limit - Output Tokens". De invoergrafiek zet het uurlijkse maximum aan niet-gecachte invoertokens per minuut af tegen uw huidige ITPM-limiet, met uw cache-rate ernaast, zodat u een limiet ziet naderen in plaats van dat u deze in productie bereikt.

Om uw geconfigureerde limieten programmatisch uit te lezen:

curl -s https://api.anthropic.com/v1/organizations/rate_limits \
  -H "x-api-key: $ANTHROPIC_ADMIN_KEY" \
  -H "anthropic-version: 2023-06-01"

Hiervoor is een Admin API-sleutel nodig, en GET /v1/organizations/workspaces/{workspace_id}/rate_limits doet hetzelfde per werkruimte. Beide zijn alleen-lezen: gebruik het tabblad Limieten in de Console om een limiet te wijzigen.

Minder verbruiken om limieten te voorkomen

Beide systemen meten onderliggend hetzelfde, dus deze methoden werken op beide.

  • Verbruik minder tokens per beurt. Continue sessies houden de cache warm en /clear tussen ongerelateerde taken kost niets. Tokengebruik van Claude Code behandelt deze methoden volledig.
  • Verlaag de inspanning. De niveaus zijn low, medium, high, xhigh en max. Het /effort-menu biedt ook ultracode, wat het verbruik verhoogt in plaats van verlaagt. Diepgaand redeneren voor een mechanische naamswijziging levert niets op.
  • Beperk gelijktijdigheid na een 429. Verlaag CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY en vermijd veel parallelle subagents. Voer ook /status uit: een verdwaalde ANTHROPIC_API_KEY routeert verzoeken via een low-tier key in plaats van via uw abonnement.
  • Verplaats niet-interactief werk naar de Message Batches API. Deze verwerkt grote volumes asynchroon met 50% korting op input- en output-tokens, onder eigen snelheidslimieten, zodat een nachtelijke taak niet concurreert met uw sessie.

Werk waarbij veel data in de context wordt geladen, ondervindt hier de meeste hinder van: als u aandelen en opties analyseert op basis van live marktdata, kost het ophalen van het specifieke segment dat nodig is voor een vraag slechts een fractie van het plakken van volledige tabellen met koersen en ketens. Werk met pieken dat door een programma in plaats van een persoon wordt aangestuurd, hoort vanaf het begin op een API key te draaien. De overstap verandert zowel de manier van betalen als de manier waarop u wordt gemeten, aangezien de Claude API geen gratis laag heeft buiten het kleine tegoed dat bij aanmelding wordt verleend. Uw eerste Claude API-app op een VPS behandelt sleutelbeheer en retries, en een langlopende agent overleeft een verbroken verbinding wanneer u Claude Code draaiende houdt op een VPS binnen tmux.

FAQ

Waarom lost het wisselen van modellen mijn Claude-gebruikslimiet niet op?

Omdat sessie- en weeklimieten worden gedeeld over alle modellen. De limiet is gekoppeld aan het abonnement, niet aan een specifiek model. Daarom verandert /model welk model antwoordt, maar niet hoeveel ruimte er nog over is. De enige uitzondering is You've hit your Opus limit, wat alleen geldt voor Opus-verzoeken. In dat geval is het wisselen van model de gedocumenteerde oplossing.

Wat betekent de 429 rate_limit_error en hoe lang moet ik wachten?

Dit betekent dat uw account een limiet heeft bereikt voor die modelklasse: verzoeken per minuut, invoertokens per minuut of uitvoertokens per minuut. Het antwoord bevat een retry-after-header met het aantal seconden dat u moet wachten; eerdere pogingen zullen falen. De officiële SDK's voeren automatisch retries uit bij rate limits en 5xx-fouten met exponential backoff (standaard twee keer), waarbij deze header wordt gerespecteerd. Een 429-fout die optreedt terwijl u nog binnen de limieten van uw tier valt, wijst op een versnellingslimiet door een plotselinge toename in activiteit.

Hoe zie ik mijn Claude-gebruikslimieten en wanneer deze worden gereset?

Voer in Claude Code /usage uit voor uw abonnementsbalken, resettijden en een overzicht van het gebruik; /cost is een alias, en d of w schakelt tussen de laatste 24 uur en de laatste 7 dagen. Deze cijfers zijn afkomstig uit de lokale sessiegeschiedenis en bevatten daarom geen gebruik van andere apparaten of van claude.ai. Voor de API toont de Console uw rate limits, en GET /v1/organizations/rate_limits geeft uw geconfigureerde limieten weer met een Admin API-key.

Kan ik doorwerken nadat ik mijn Claude-abonnementslimiet heb bereikt?

Soms. Voer /usage-credits uit om extra gebruik aan te schaffen boven de limiet bij Pro en Max, of om dit aan te vragen bij een beheerder bij Team en Enterprise; hiervoor is een claude.ai-login via /login vereist en dit is niet beschikbaar bij authenticatie via een API-key. Wacht anders tot de resettijd, wissel van model als het de Opus-limiet betrof, of verplaats het werk naar een API-key, waarbij het gebruik per minuut wordt gemeten in plaats van per venster.