SSD Nodes Learn Hosting plans →
Guides Matt ConnorPar Matt Connor · Mis à jour le 2026-09-22

Limite Claude atteinte : que faire maintenant ?

Le message indique une fenêtre de 5 heures ou hebdomadaire. Découvrez quand l’accès revient et quand changer de modèle, réduire le contexte, acheter des crédits ou utiliser l’API.

Quelle limite Claude avez-vous atteinte

Le message indiquant qu’une limite Claude est atteinte précise la fenêtre pendant laquelle vous devez attendre. Cette fenêtre détermine ce que vous pouvez faire ensuite. Les limites de session et hebdomadaires s’appliquent à tous les modèles en même temps. Changer de modèle ne rétablit donc pas votre accès. Une limite qui mentionne un seul modèle est l’exception : changez de modèle et continuez à travailler pendant que ce modèle reste bloqué.

Claude Code affiche la fenêtre et son heure de réinitialisation sur la même ligne :

You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pm

La fenêtre de session est une période glissante de cinq heures. Les fenêtres hebdomadaires sont réinitialisées chaque semaine à une heure fixe attribuée à votre compte. Le jour et l’heure restent donc identiques d’une semaine à l’autre. Un abonnement Pro inclut la fenêtre de session de cinq heures ainsi qu’une limite hebdomadaire applicable à tous les modèles. Un abonnement Max ajoute une deuxième limite hebdomadaire qui s’applique uniquement à une famille de modèles. Les plafonds eux-mêmes sont présentés dans le détail complet des limites d’utilisation de Claude. Cette page explique ce qui se passe ensuite.

C’est le point qui prête souvent à confusion. Chaque requête est comptabilisée simultanément dans la fenêtre de session et dans la fenêtre hebdomadaire. Une après-midi intensive peut donc épuiser le quota hebdomadaire alors que la fenêtre de cinq heures dispose encore de capacité. Consultez l’heure de réinitialisation avant de planifier la suite de votre journée. Une réinitialisation à 15:45 laisse le temps de faire une pause. Une réinitialisation lundi à minuit ne laisse pas la même marge.

Consultez le compteur avant de faire des suppositions

Sur claude.ai, ouvrez Settings, puis Usage. Les barres de progression indiquent la part utilisée de la fenêtre de session de cinq heures et de chaque fenêtre hebdomadaire. Vous voyez ainsi quelle fenêtre est épuisée, au lieu de devoir le deviner.

Dans Claude Code, exécutez /usage. La commande affiche les mêmes barres correspondant à votre forfait, ainsi qu’une ventilation de l’utilisation récente. Celle-ci indique la part attribuée aux skills, aux sous-agents, aux plugins et à chaque serveur MCP (model context protocol), en pourcentage de l’utilisation totale. Appuyez sur d pour afficher les dernières 24 heures et sur w pour afficher les 7 derniers jours. L’outil signale également tout motif représentant au moins 10% de l’utilisation récente. Les deux motifs les plus fréquents sont un contexte long et des échecs de cache.

Deux réserves s’appliquent. La ventilation est calculée à partir de l’historique des sessions enregistré sur cette machine. Le travail effectué sur un autre ordinateur portable ou sur claude.ai n’y figure donc pas, même s’il a utilisé la même allocation, car Claude Code et vos conversations claude.ai partagent une même fenêtre d’abonnement. Par ailleurs, le montant en dollars affiché dans le bloc Session, en haut, est calculé selon les tarifs catalogue standard de l’API (application programming interface). Il ne correspond donc pas à votre facture lorsque vous utilisez un abonnement.

Passer à un modèle plus petit aide-t-il ?

Uniquement lorsque le message nomme un modèle. Après You've hit your Opus limit, exécutez /model, sélectionnez Sonnet ou Haiku, et la session se poursuit avec tout son contexte. Après You've hit your session limit ou You've hit your weekly limit, /model ne change rien, car ces fenêtres sont partagées par tous les modèles.

Le changement est beaucoup plus utile avant d’atteindre la limite qu’après. Sonnet prend en charge la plupart des tâches de développement pour une fraction du tarif d’Opus. Laisser Opus comme modèle par défaut est donc l’une des deux habitudes à l’origine de la plupart des dépassements d’utilisation inattendus. L’autre est de conserver une session sans jamais la réinitialiser. Confiez les modifications mécaniques et le tri des journaux à Haiku, et gardez Opus pour la décision de conception qui vous bloque réellement. Choisir entre Opus, Sonnet et Haiku explique dans quels cas chacun justifie son prix.

Ne payez pas pour du contexte que vous n’utilisez plus

Claude Code envoie l’intégralité de votre conversation à chaque requête. Chaque fois que Claude utilise un outil, il envoie une nouvelle requête contenant les résultats de cet outil. Le prompt caching permet de relire l’historique au tarif du cache plutôt qu’au tarif normal des entrées. Cela réduit le coût, mais ne le rend pas nul. Ainsi, une question d’une seule ligne dans une session ouverte depuis le matin consomme quand même des crédits pour toute la conversation.

/context
/clear
/compact Focus on the failing tests and the files we changed

/clear ne coûte rien, car il supprime le contexte au lieu de le relire. /compact doit lire la conversation qu’il résume. La compaction d’un contexte très volumineux constitue donc elle-même une requête importante. Utilisez /clear lorsque vous passez à une tâche sans rapport. Utilisez /compact uniquement si vous êtes au milieu d’une tâche et devez conserver le fil de la conversation. Exécutez /rename avant de vider le contexte afin de pouvoir retrouver la session avec /resume.

La durée de vie du cache compte davantage que la plupart des utilisateurs ne le pensent. Avec un abonnement, le cache reste disponible pendant une heure. Sa durée tombe à cinq minutes lorsque vous utilisez des crédits de consommation. Cinq minutes est également la valeur par défaut avec une clé API. Votre premier message après une longue pause ne trouve plus le cache et le contexte entier est retraité au tarif normal des entrées. C’est pourquoi la consommation augmente souvent sans raison visible. Quand le prompt caching devient rentable présente les calculs.

Trois autres leviers se trouvent au même endroit. /mcp liste les serveurs configurés afin que vous puissiez désactiver ceux dont cette tâche n’a pas besoin. Un fichier CLAUDE.md volumineux est chargé au démarrage de la session, que la tâche en ait besoin ou non. Placez donc les instructions spécialisées dans des skills, qui ne sont chargées que lorsqu’elles sont invoquées. Enfin, l’extended thinking est facturé comme des tokens de sortie, qui constituent la moitié la plus coûteuse. Réduisez-le avec /effort, désactivez-le dans /config ou définissez MAX_THINKING_TOKENS=8000 sur un modèle disposant d’un budget de réflexion fixe.

Découpez la tâche pour qu’elle tienne dans une seule fenêtre

Avant une modification importante, appuyez sur Shift+Tab pour passer en mode planification. Claude explore le code source et propose une approche à valider. Une mauvaise direction détectée à ce stade coûte un plan, au lieu de deux heures de modifications et de reprise du travail.

Confiez les opérations verbeuses aux sous-agents. L’exécution d’une suite de tests ou la lecture d’un journal de 10,000 lignes dans un sous-agent conserve la sortie brute dans le contexte de ce sous-agent. Seul le résumé revient dans votre conversation principale.

Appuyez sur Escape dès que Claude prend une mauvaise direction. /rewind restaure la conversation et le code à un point de contrôle antérieur. Vous n’avez ainsi pas à perdre du temps à annuler un travail que vous ne vouliez pas.

Faut-il acheter des crédits d’utilisation ou utiliser l’API ?

Les crédits d’utilisation permettent à un compte Pro ou Max de continuer à fonctionner au-delà du quota de son forfait. Ils sont facturés aux tarifs standard de l’API. Activez-les dans Settings, puis Usage, sur claude.ai, après avoir associé un moyen de paiement. Vous pouvez aussi exécuter /usage-credits dans Claude Code. Cette commande ouvre vos paramètres de facturation dans le navigateur. Les crédits s’appliquent aux conversations Claude et à l’utilisation du terminal Claude Code, avec une limite quotidienne d’utilisation de $2000. La commande nécessite une connexion par abonnement. Elle n’est donc pas disponible si vous vous authentifiez avec une clé d’API. Les crédits ne sont pas proposés avec le forfait gratuit. La première étape consiste donc à souscrire Pro à $20 par mois. Ce que Pro ajoute et les limites que vous pouvez atteindre explique jusqu’où ce forfait peut vous mener. Si vous achetez des crédits la plupart des semaines, un quota plus élevé revient généralement moins cher. L’écart entre les forfaits Max à $100 et $200 correspond à un multiplicateur d’utilisation, et non à une différence de modèles ou de fonctionnalités.

L’autre possibilité consiste à utiliser une clé d’API standard depuis Claude Console. La facturation se fait au token, sans session ni fenêtre hebdomadaire. Un piège est possible : une variable ANTHROPIC_API_KEY présente dans votre environnement fait passer Claude Code par cette clé au lieu de votre abonnement, sans l’indiquer. Vous le découvrez sur la facture ou avec la commande suivante :

API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.

Cette erreur 429 correspond à la limite de débit de la clé, et non à celle de votre forfait. Exécutez /status et vérifiez que l’identifiant d’authentification actif est bien celui que vous vouliez utiliser.

Quel est le coût d’un après-midi sur l’API ?

L’exemple détaillé ci-dessous correspond à un après-midi de développement avec un agent : 200,000 tokens d’entrée non mis en cache, 1.8 million de lectures du cache et 150,000 tokens de sortie. Les prix sont les tarifs publics d’Anthropic en août 2026. Chaque tarif est exprimé par million de tokens. Si cette unité reste abstraite, ce que vaut réellement un million de tokens la convertit en quantité de texte lu et écrit que vous pouvez visualiser.

ChartOne afternoon of agent work priced at API list rates, August 2026
The data behind this chart
[
  {
    "label": "Opus 5",
    "input_usd_per_mtok": 5,
    "cache_read_usd_per_mtok": 0.5,
    "output_usd_per_mtok": 25,
    "afternoon_usd": 5.65
  },
  {
    "label": "Sonnet 5",
    "input_usd_per_mtok": 2,
    "cache_read_usd_per_mtok": 0.2,
    "output_usd_per_mtok": 10,
    "afternoon_usd": 2.26
  },
  {
    "label": "Haiku 4.5",
    "input_usd_per_mtok": 1,
    "cache_read_usd_per_mtok": 0.1,
    "output_usd_per_mtok": 5,
    "afternoon_usd": 1.13
  }
]

Le même après-midi coûte 5.65 $ avec Opus 5 et 1.13 $ avec Haiku 4.5. C’est la sortie qui fait varier le total : à 25 $ par million de tokens avec Opus 5, contre 5 $ avec Haiku 4.5, les 150,000 tokens écrits par Claude coûtent plus cher que les 2 millions de tokens lus. C’est pourquoi réduire le budget de réflexion permet d’économiser davantage que réduire le nombre de fichiers. Si vous cherchez quel fournisseur utiliser plutôt que quel modèle exécuter, trois tâches chiffrées sur les API Claude et ChatGPT montrent quelle facture est la plus avantageuse dans chaque cas.

Une date est à retenir. Sonnet 5 bénéficie d’un tarif de lancement de 2 $ et 10 $ par million de tokens d’entrée et de sortie jusqu’au 31 août 2026. Le tarif passe ensuite à 3 $ et 15 $ le 1er septembre 2026. Le coût du même après-midi passe alors de 2.26 $ à environ 3.39 $.

Calcul de chaque coût d’après-midi

Opus 5 : 200,000 tokens d’entrée non mis en cache à 5 $ par million, soit 1.00 $. 1.8 million de lectures du cache au dixième du tarif d’entrée, soit 0.90 $. 150,000 tokens de sortie à 25 $ par million, soit 3.75 $. Total : 5.65 $.

Sonnet 5 : 0.40 $ pour l’entrée non mise en cache, 0.36 $ pour les lectures du cache et 1.50 $ pour la sortie. Total : 2.26 $.

Haiku 4.5 : 0.20 $ pour l’entrée non mise en cache, 0.18 $ pour les lectures du cache et 0.75 $ pour la sortie. Total : 1.13 $.

Les 3 lignes utilisent les mêmes nombres de tokens. Les écarts correspondent donc uniquement aux prix. Dans la pratique, le coût d’un après-midi varie selon la quantité de contexte qui reste en cache.

Pour donner un ordre de grandeur, la documentation d’Anthropic indique que les dépenses moyennes liées à Claude Code dans les déploiements d’entreprise sont proches de 13 $ par développeur et par jour d’activité, et inférieures à 30 $ par jour d’activité pour 90 % des utilisateurs, en août 2026. La facturation au token n’est pas automatiquement moins chère qu’un abonnement. Elle est avantageuse lorsque votre charge est irrégulière, car les journées sans activité ne coûtent rien. Elle est moins avantageuse lorsque vous travaillez tous les jours. L’API comparée à un abonnement avec des chiffres réels présente le point d’équilibre.

Exécuter une tâche longue sur un VPS pendant la nuit

Certaines tâches ne nécessitent pas de surveillance : un refactoring important, une migration de tests ou une révision complète de la documentation. Elles ne nécessitent pas non plus votre fenêtre d’abonnement. Exécutez-les sur un VPS (virtual private server) avec une clé API : elles utilisent la facturation à l’usage par token, tandis que le quota de votre forfait reste disponible pour votre travail interactif du lendemain.

Installez Claude Code sur un serveur Ubuntu et vérifiez qu’il fonctionne :

curl -fsSL https://claude.ai/install.sh | bash
claude --version

claude --version doit afficher une chaîne de version telle que 2.1.211 (Claude Code). Un command not found à cette étape signifie que ~/.local/bin n’est pas encore présent dans votre PATH. Ouvrez donc un nouveau shell et réessayez. Il s’agit du même installateur que celui utilisé sur un poste Linux, où la CLI cohabite avec l’application desktop bêta et les plugins de l’éditeur.

Placez la clé dans un fichier plutôt que dans l’historique du shell. Créez ~/.claude-env dans un éditeur, avec une seule ligne, export ANTHROPIC_API_KEY=sk-ant-your-key-here, puis protégez le fichier et chargez-le :

chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10

La dernière ligne affiche les dix premiers caractères. Cela suffit pour confirmer que la variable est définie sans afficher la clé complète.

Démarrez maintenant la tâche dans tmux afin qu’elle survive à la fermeture de votre ordinateur portable :

tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
  --allowedTools "Read,Edit,Bash" \
  --append-system-prompt-file ./CLAUDE.md \
  --output-format json > ~/overnight.json

Détachez la session avec Ctrl-b puis d, et fermez la connexion. Rattachez-vous plus tard avec tmux attach -t overnight. Claude Code dans une session tmux sur un VPS détaille la gestion des sessions.

--bare est important ici. Il désactive la détection automatique des hooks, des skills, des plugins et de CLAUDE.md. Il ne lit jamais les identifiants OAuth. L’exécution utilise donc uniquement la clé API. C’est ce qui empêche la tâche d’utiliser votre abonnement. Les règles du projet ne sont alors plus disponibles. C’est pourquoi --append-system-prompt-file les transmet explicitement. Sans --bare, un ANTHROPIC_API_KEY défini déclenche une demande d’approbation unique à laquelle une exécution sans surveillance ne peut pas répondre.

Le matin, consultez le résultat et le coût dans le JSON :

jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.json

Claude Code renvoie le code 0 en cas de succès et un code différent de 0 en cas d’échec. Un script wrapper peut donc tester le code de retour et vous envoyer un e-mail en cas d’erreur. Définissez une limite de dépenses pour l’espace de travail dans la Claude Console avant de laisser la tâche s’exécuter. Un agent bloqué dans une boucle de retry à 3am peut réellement dépenser beaucoup d’argent. Réduisez CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY si vous souhaitez également ralentir son exécution. Contrôler le coût des agents laissés en exécution présente les limites à définir en priorité.

Attribuez à la tâche son propre utilisateur sans privilèges et sa propre branche git. Un agent qui modifie un dépôt sans surveillance fera parfois quelque chose que vous auriez arrêté. Une branche transforme ce problème en git checkout plutôt qu’en incident. Exécuter un agent de programmation en toute sécurité sur un VPS détaille l’isolation.

Pour les traitements entièrement non interactifs, comme la classification de milliers d’enregistrements, la Batch API traite les requêtes de manière asynchrone, avec une remise de 50% sur les tokens d’entrée et de sortie. C’est le mode au coût par token le plus faible publié par Anthropic, et une exécution pendant la nuit correspond exactement au délai qu’il implique.

Ce qui ne rétablit pas votre accès

Seul le temps vous rend votre quota, c’est pourquoi toute méthode censée réinitialiser une limite d’utilisation de Claude ne résiste pas à un examen attentif.

Démarrer une nouvelle conversation ne rétablit pas votre quota. L’utilisation est décomptée de votre compte, et non d’une conversation. En revanche, chaque message suivant coûte moins cher, car une nouvelle conversation ne contient aucun historique à relire. Cela reste donc utile. C’est une réduction des coûts, pas une réinitialisation.

Supprimer d’anciennes conversations ne rembourse rien. Ces tokens ont été consommés au moment de leur traitement.

Changer de modèle après avoir atteint une limite de session ou de messages hebdomadaire ne change rien, car ces fenêtres sont communes à tous les modèles. Seul un message qui nomme un modèle répond à /model.

Réessayer en boucle ne fait qu’occuper votre terminal. L’heure de réinitialisation affichée dans le message est la bonne réponse, et /usage affiche la même heure sans l’erreur.

La mise à niveau est la seule action qui augmente réellement le plafond. Si les limites restent inchangées après le paiement, cherchez pourquoi un nouveau forfait peut laisser les anciennes limites en place avant de conclure que le quota est défectueux.

FAQ

Au bout de combien de temps ma limite Claude est-elle réinitialisée ?

Le message vous l’indique. Les limites de session suivent une fenêtre glissante de cinq heures, et le message affiche une heure, par exemple resets 3:45pm. Les limites hebdomadaires sont réinitialisées à une heure fixe chaque semaine, définie pour votre compte, et le message affiche le jour, par exemple resets Mon 12:00am. Pour voir les deux barres et les deux heures de réinitialisation avant d’atteindre une limite, exécutez /usage dans Claude Code, ou ouvrez Settings, puis Usage, sur claude.ai.

Passer à Sonnet me permettra-t-il de reprendre le travail ?

Uniquement lorsque le message indique un modèle. Après You've hit your Opus limit, exécutez /model, sélectionnez un autre modèle, et la session reprend avec son contexte intact. Après You've hit your session limit ou You've hit your weekly limit, le choix du modèle ne change rien, car ces fenêtres comptabilisent tous les modèles ensemble. Passer à un modèle moins coûteux avant d’atteindre la limite permet réellement de prolonger la fenêtre.

Démarrer une nouvelle conversation réinitialise-t-il ma limite d’utilisation ?

Non. L’utilisation est comptabilisée pour votre compte. Une nouvelle conversation utilise donc la même réserve restante. Elle réduit toutefois le coût de chaque message suivant, car une nouvelle conversation ne contient aucun historique que Claude doit relire. /clear dans Claude Code fait la même chose et ne coûte rien, tandis que /compact doit lire la conversation qu’il résume. Compacter une très grande session constitue donc lui-même une requête coûteuse.

L’API coûte-t-elle moins cher que la mise à niveau de mon forfait ?

Cela dépend de la régularité de votre utilisation. L’après-midi de travail présenté sur cette page coûte $2.26 avec Sonnet 5 et $1.13 avec Haiku 4.5, aux tarifs catalogue d’août 2026. Un abonnement correspond à un forfait fixe pour une réserve plafonnée. Il est donc avantageux si vous travaillez presque tous les jours. La facturation au token est avantageuse lorsque votre charge varie fortement, car les journées sans utilisation ne vous coûtent rien.

Puis-je laisser une tâche s’exécuter en attendant la réinitialisation ?

Oui, si vous la sortez de votre abonnement. Exécutez-la sur un VPS avec ANTHROPIC_API_KEY défini dans l’environnement. Elle sera alors facturée au token au lieu de consommer la fenêtre de votre forfait, et les deux ne se feront donc jamais concurrence. claude --bare -p dans tmux survit à la fermeture de votre ordinateur portable, et --output-format json écrit un champ total_cost_usd que vous pouvez vérifier le matin avec jq.