Limite Claude atteinte : que faire maintenant ?
Claude affiche une limite atteinte ? Identifiez la fenêtre de cinq heures ou hebdomadaire, puis choisissez : autre modèle, contexte réduit, crédits ou API.
Quelle limite Claude avez-vous atteinte
Le message indiquant qu’une limite Claude est atteinte précise la fenêtre que vous devez attendre. Cette fenêtre détermine ce que vous pouvez faire ensuite. Les limites de session et hebdomadaires s’appliquent à tous les modèles en même temps. Changer de modèle ne rétablit donc pas votre accès. Une limite qui mentionne un seul modèle fait exception : changez de modèle et continuez à travailler pendant que ce modèle reste bloqué.
Claude Code affiche la fenêtre et son heure de réinitialisation sur la même ligne :
You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pmLa fenêtre de session dure cinq heures glissantes. Les fenêtres hebdomadaires sont réinitialisées à une heure fixe chaque semaine, définie pour votre compte. Le jour et l’heure restent donc identiques d’une semaine à l’autre. Un abonnement Pro comprend la fenêtre de session de cinq heures et une limite hebdomadaire applicable à tous les modèles. Un abonnement Max ajoute une deuxième limite hebdomadaire qui s’applique uniquement à une famille de modèles. Les plafonds eux-mêmes sont détaillés dans le détail complet des limites d’utilisation de Claude. Cette page commence là où l’autre s’arrête.
C’est ce point qui surprend souvent. Chaque requête est comptabilisée simultanément dans la fenêtre de session et dans la fenêtre hebdomadaire. Un après-midi d’utilisation intensive peut donc épuiser le quota hebdomadaire alors que la fenêtre de cinq heures dispose encore de capacité. Consultez l’heure de réinitialisation avant de planifier la suite de votre journée. Une réinitialisation à 15:45 correspond à une pause-café. Une réinitialisation le lundi à minuit ne permet pas la même souplesse.
Consultez le compteur avant de faire des suppositions
Sur claude.ai, ouvrez Settings, puis Usage. Les barres de progression indiquent la part utilisée de la fenêtre de session de cinq heures et de chaque fenêtre hebdomadaire. Vous voyez ainsi laquelle est épuisée au lieu de faire des suppositions.
Dans Claude Code, exécutez /usage. Cette commande affiche les mêmes barres correspondant à votre forfait, ainsi qu’une ventilation de l’utilisation récente. Celle-ci indique la part attribuée aux skills, aux subagents, aux plugins et à chaque serveur MCP (model context protocol), en pourcentage du total. Appuyez sur d pour afficher les dernières 24 heures et sur w pour les 7 derniers jours. La commande signale également tout élément représentant au moins 10% de l’utilisation récente. Les deux éléments les plus fréquents sont généralement le contexte long et les cache misses.
Deux précisions sont nécessaires. La ventilation est calculée à partir de l’historique des sessions enregistré sur cette machine. Le travail effectué sur un autre ordinateur portable ou sur claude.ai n’y figure donc pas. Par ailleurs, le montant en dollars affiché dans le bloc Session, en haut de l’écran, est calculé selon les tarifs catalogue standard appliqués aux utilisateurs de l’API (application programming interface). Il ne correspond donc pas à votre facture lorsque vous utilisez un abonnement.
Passer à un modèle plus petit aide-t-il ?
Seulement lorsque le message nomme un modèle. Après You've hit your Opus limit, exécutez /model, sélectionnez Sonnet ou Haiku, puis la session continue avec tout son contexte. Après You've hit your session limit ou You've hit your weekly limit, /model ne change rien, car ces fenêtres sont partagées entre tous les modèles.
Le changement est beaucoup plus utile avant d’atteindre la limite qu’après. Sonnet prend en charge la plupart des tâches de programmation à une fraction du tarif d’Opus. Laisser Opus comme modèle par défaut est donc l’une des deux habitudes à l’origine de la plupart des consommations inattendues. L’autre consiste à ne jamais vider une session. Confiez les modifications mécaniques et le tri des journaux à Haiku, et gardez Opus pour la décision de conception sur laquelle vous êtes réellement bloqué. Choisir entre Opus, Sonnet et Haiku explique dans quels cas chacun justifie son prix.
Arrêtez de payer pour un contexte que vous n’utilisez plus
Claude Code envoie l’intégralité de votre conversation à chaque requête. Chaque fois que Claude utilise un outil, il envoie une nouvelle requête contenant les résultats de cet outil. Le prompt caching permet de relire l’historique au tarif du cache plutôt qu’au tarif d’entrée complet. Cela réduit le coût, mais ne le rend pas nul. Ainsi, une question d’une ligne dans une session ouverte depuis le matin consomme quand même des crédits pour toute la conversation.
/context
/clear
/compact Focus on the failing tests and the files we changed/clear ne coûte rien, car il supprime le contexte au lieu de le lire. /compact doit lire la conversation qu’il résume. La compaction d’un contexte très volumineux constitue donc elle-même une requête importante. Utilisez /clear lorsque vous passez à une tâche sans rapport. Utilisez /compact uniquement lorsque vous êtes au milieu d’une tâche et que vous devez conserver le fil. Exécutez /rename avant de supprimer le contexte afin de pouvoir retrouver la session avec /resume.
La durée de vie du cache est plus importante que prévu. Avec un abonnement, le cache reste disponible pendant une heure. Elle passe à cinq minutes lorsque vous utilisez des crédits de consommation. Cinq minutes est également la valeur par défaut avec une API key. Votre premier message après une longue pause ne trouve pas le cache et traite de nouveau tout le contexte au tarif d’entrée complet. C’est pourquoi la consommation augmente souvent sans raison apparente. Quand le prompt caching devient rentable explique le calcul.
Trois autres leviers se trouvent au même endroit. /mcp liste les serveurs configurés afin que vous puissiez désactiver ceux dont cette tâche n’a pas besoin. Un fichier CLAUDE.md volumineux est chargé au démarrage de la session, que le travail en ait besoin ou non. Déplacez donc les instructions spécialisées dans des skills, qui ne sont chargées que lorsqu’elles sont invoquées. Enfin, l’extended thinking est facturé comme des output tokens, qui constituent la partie la plus coûteuse. Réduisez-le avec /effort, désactivez-le dans /config ou définissez MAX_THINKING_TOKENS=8000 sur un modèle doté d’un budget de réflexion fixe.
Découpez la tâche pour qu’elle tienne dans une seule fenêtre
Appuyez sur Maj+Tab pour passer en mode plan avant une modification importante. Claude explore la base de code et propose une approche à valider. Une mauvaise direction détectée à ce stade coûte un plan, au lieu de deux heures de modifications et du travail nécessaire pour les reprendre.
Déléguez les opérations verbeuses aux sous-agents. L’exécution d’une suite de tests ou la lecture d’un journal de 10,000 lignes dans un sous-agent conserve la sortie brute dans le contexte de ce sous-agent. Seul le résumé revient dans votre conversation principale.
Appuyez sur Échap dès que Claude part dans la mauvaise direction. /rewind restaure la conversation et le code à un point de contrôle antérieur. Vous ne payez ainsi pas pour annuler un travail que vous ne vouliez pas.
Faut-il acheter des crédits d’utilisation ou utiliser l’API ?
Les crédits d’utilisation permettent à un compte Pro ou Max de continuer à fonctionner au-delà de la limite du forfait. Ils sont facturés aux tarifs API standard. Activez-les dans Settings, puis Usage, sur claude.ai, après avoir associé un moyen de paiement. Vous pouvez aussi exécuter /usage-credits dans Claude Code. Cette commande ouvre vos paramètres de facturation dans le navigateur. Les crédits s’appliquent aux conversations Claude et à l’utilisation du terminal Claude Code, avec une limite d’utilisation quotidienne de $2000. La commande nécessite une connexion avec un abonnement. Elle n’est donc pas disponible si vous vous authentifiez avec une clé API.
L’autre option consiste à utiliser une simple clé API depuis Claude Console. La facturation se fait au token, sans session ni fenêtre hebdomadaire. Un piège est à connaître : si ANTHROPIC_API_KEY est défini par erreur dans votre environnement, Claude Code utilise cette clé au lieu de votre abonnement, sans vous l’indiquer. Vous ne le découvrirez qu’à la réception de la facture, ou avec la commande suivante :
API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.Cette erreur 429 correspond à la limite de débit de la clé, et non à celle de votre forfait. Exécutez /status et vérifiez que l’identifiant actif est bien celui que vous souhaitez utiliser.
Combien coûte un après-midi sur l’API ?
L’exemple détaillé ci-dessous correspond à un après-midi de développement avec un agent : 200,000 tokens d’entrée non mis en cache, 1.8 million de lectures depuis le cache et 150,000 tokens de sortie. Les prix sont les tarifs publics d’Anthropic en vigueur en août 2026. Chacun de ces tarifs est indiqué par million de tokens. Si cette unité reste abstraite, ce que représente réellement un million de tokens la convertit en quantité de texte lu et écrit que vous pouvez visualiser.
The data behind this chart
[
{
"label": "Opus 5",
"input_usd_per_mtok": 5,
"cache_read_usd_per_mtok": 0.5,
"output_usd_per_mtok": 25,
"afternoon_usd": 5.65
},
{
"label": "Sonnet 5",
"input_usd_per_mtok": 2,
"cache_read_usd_per_mtok": 0.2,
"output_usd_per_mtok": 10,
"afternoon_usd": 2.26
},
{
"label": "Haiku 4.5",
"input_usd_per_mtok": 1,
"cache_read_usd_per_mtok": 0.1,
"output_usd_per_mtok": 5,
"afternoon_usd": 1.13
}
]Le même après-midi coûte 5.65 $ avec Opus 5 et 1.13 $ avec Haiku 4.5. C’est la sortie qui fait varier le total : à 25 $ par million de tokens avec Opus 5, contre 5 $ avec Haiku 4.5, les 150,000 tokens écrits par Claude coûtent plus cher que les 2 millions de tokens lus. C’est pourquoi réduire le budget de réflexion permet d’économiser davantage que réduire le nombre de fichiers.
Notez une date. Sonnet 5 bénéficie d’un tarif de lancement de 2 $ et 10 $ par million de tokens d’entrée et de sortie jusqu’au 31 août 2026. Le tarif passe ensuite à 3 $ et 15 $ le 1 septembre 2026. Le coût du même après-midi passe alors de 2.26 $ à environ 3.39 $.
Calcul de chaque coût d’après-midi
Opus 5 : 200,000 tokens d’entrée non mis en cache à 5 $ par million coûtent 1.00 $. Les 1.8 million de lectures depuis le cache, facturées à un dixième du tarif d’entrée, coûtent 0.90 $. Les 150,000 tokens de sortie à 25 $ par million coûtent 3.75 $. Total : 5.65 $.
Sonnet 5 : 0.40 $ d’entrée non mise en cache, 0.36 $ de lectures depuis le cache et 1.50 $ de sortie. Total : 2.26 $.
Haiku 4.5 : 0.20 $ d’entrée non mise en cache, 0.18 $ de lectures depuis le cache et 0.75 $ de sortie. Total : 1.13 $.
Les 3 lignes utilisent les mêmes quantités de tokens. Les écarts correspondent donc uniquement aux prix. En pratique, le coût d’un après-midi varie selon la quantité de contexte qui reste en cache.
Pour donner un ordre de grandeur, la documentation d’Anthropic indique que les dépenses moyennes liées à Claude Code dans les déploiements d’entreprise sont proches de 13 $ par développeur et par jour actif, et inférieures à 30 $ par jour actif pour 90 % des utilisateurs, en août 2026. La facturation au token n’est pas automatiquement moins chère qu’un abonnement. Elle est avantageuse lorsque votre charge est irrégulière, car les journées sans activité ne coûtent rien. Elle est moins avantageuse lorsque vous travaillez tous les jours. Comparaison entre l’API et un abonnement avec des chiffres réels présente le seuil de rentabilité.
Exécuter une tâche longue sur un VPS pendant la nuit
Certaines tâches ne nécessitent pas de surveillance : une refactorisation importante, une migration de tests ou une révision complète de la documentation. Elles ne nécessitent pas non plus votre fenêtre d’abonnement. Exécutez-les sur un VPS (virtual private server) avec une clé d’API. Elles utiliseront la facturation à l’usage par token, tandis que le quota de votre forfait restera disponible pour le travail interactif du lendemain.
Installez Claude Code sur une machine Ubuntu et vérifiez qu’il s’exécute :
curl -fsSL https://claude.ai/install.sh | bash
claude --versionclaude --version doit afficher une chaîne de version telle que 2.1.211 (Claude Code). Un command not found à ce stade signifie que ~/.local/bin n’est pas encore présent dans votre PATH. Ouvrez donc un nouveau shell et réessayez.
Placez la clé dans un fichier plutôt que dans l’historique du shell. Créez ~/.claude-env dans un éditeur avec une seule ligne, export ANTHROPIC_API_KEY=sk-ant-your-key-here, puis restreignez ses permissions et chargez-la :
chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10La dernière ligne affiche les dix premiers caractères. Cela suffit pour confirmer que la variable est définie sans afficher la clé complète à l’écran.
Démarrez maintenant la tâche dans tmux afin qu’elle survive à la fermeture de votre ordinateur portable :
tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
--allowedTools "Read,Edit,Bash" \
--append-system-prompt-file ./CLAUDE.md \
--output-format json > ~/overnight.jsonDétachez-vous avec Ctrl-b puis d, et fermez la connexion. Rattachez-vous plus tard avec tmux attach -t overnight. Claude Code dans une session tmux sur un VPS décrit en détail la gestion de la session.
--bare est important ici. Il désactive la découverte automatique des hooks, des skills, des plugins et de CLAUDE.md. Il ne lit jamais les identifiants OAuth. L’exécution utilise donc uniquement la clé d’API. C’est ce qui maintient la tâche en dehors de votre abonnement. Cela signifie également que les règles du projet ne sont plus disponibles. C’est pourquoi --append-system-prompt-file les transmet volontairement. Sans --bare, un ANTHROPIC_API_KEY défini déclenche une demande d’approbation unique à laquelle une exécution unattended ne peut pas répondre.
Le matin, lisez le résultat et le coût dans le JSON :
jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.jsonClaude Code se termine avec le code 0 en cas de succès et avec un code différent de 0 en cas d’échec. Un script wrapper peut donc tester le code de retour et vous envoyer un e-mail en cas d’échec. Définissez une limite de dépenses pour le workspace dans la Claude Console avant de laisser la tâche s’exécuter. Un agent bloqué dans une boucle de retry à 3am peut réellement dépenser beaucoup d’argent. Réduisez CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY si vous voulez également le ralentir. Contrôler le coût des agents laissés en exécution présente les limites à définir en priorité.
Attribuez à la tâche son propre utilisateur non privilégié et sa propre branche git. Un agent qui modifie un repository unattended fera parfois quelque chose que vous auriez arrêté. Une branche transforme cela en git checkout plutôt qu’en incident. Exécuter un agent de code en toute sécurité sur un VPS décrit l’isolation à mettre en place.
Pour les traitements entièrement non interactifs, comme la classification de milliers d’enregistrements, la Batch API traite les requêtes de manière asynchrone avec une remise de 50% sur les tokens d’entrée et de sortie. C’est le mode au coût par token le plus faible publié par Anthropic. Une exécution pendant la nuit correspond exactement à la latence requise.
Ce qui ne rétablit pas votre accès
Démarrer une nouvelle conversation ne rétablit pas votre quota. L’utilisation est comptabilisée sur votre compte, et non sur une conversation. Cela réduit toutefois le coût de chaque message suivant, car une nouvelle conversation ne contient aucun historique à relire. Cela reste donc utile. C’est une réduction des coûts, pas une réinitialisation.
Supprimer d’anciennes conversations ne rembourse rien. Ces tokens ont été consommés lors de leur traitement.
Changer de modèle après avoir atteint une limite de session ou de messages hebdomadaire ne change rien, car ces limites sont partagées entre tous les modèles. Seul un message qui nomme un modèle répond à /model.
Relancer la commande en boucle ne fait qu’occuper votre terminal. L’heure de réinitialisation indiquée dans le message est la réponse réelle, et /usage affiche la même heure sans l’erreur.
FAQ
Dans combien de temps ma limite Claude sera-t-elle réinitialisée ?
Le message vous l’indique. Les limites de session suivent une fenêtre glissante de cinq heures, et le message affiche une heure, par exemple resets 3:45pm. Les limites hebdomadaires sont réinitialisées chaque semaine à une heure fixe attribuée à votre compte, et le message affiche le jour, par exemple resets Mon 12:00am. Pour afficher les deux barres et les deux heures de réinitialisation avant d’atteindre une limite, exécutez /usage dans Claude Code, ou ouvrez Settings, puis Usage sur claude.ai.
Passer à Sonnet me permettra-t-il de reprendre le travail ?
Uniquement lorsque le message indique un modèle. Après You've hit your Opus limit, exécutez /model, choisissez un autre modèle, puis la session continue avec son contexte intact. Après You've hit your session limit ou You've hit your weekly limit, le choix du modèle ne change rien, car ces fenêtres comptabilisent tous les modèles ensemble. Passer à un modèle moins coûteux avant d’atteindre la limite est ce qui prolonge réellement la fenêtre.
Démarrer une nouvelle conversation réinitialisera-t-il ma limite d’utilisation ?
Non. L’utilisation est comptabilisée sur votre compte. Une nouvelle conversation utilise donc la même allowance restante. Elle rend toutefois chaque message suivant moins coûteux, car une nouvelle conversation ne contient aucun historique que Claude doit relire. /clear dans Claude Code fait la même chose et ne coûte rien, tandis que /compact doit lire la conversation qu’il résume. Compacter une très grande session constitue donc lui-même une requête coûteuse.
L’API est-elle moins chère que la mise à niveau de mon forfait ?
Cela dépend de la régularité de votre utilisation. L’après-midi de travail détaillé sur cette page coûte $2.26 avec Sonnet 5 et $1.13 avec Haiku 4.5, aux tarifs catalogue d’août 2026. Un abonnement est un forfait fixe pour une allowance plafonnée. Il est donc avantageux si vous travaillez la plupart des jours. La facturation au token est plus intéressante lorsque votre charge est irrégulière, car les jours sans utilisation ne vous coûtent rien.
Puis-je laisser une tâche s’exécuter pendant que j’attends la réinitialisation ?
Oui, si vous la sortez de votre abonnement. Exécutez-la sur un VPS avec ANTHROPIC_API_KEY défini dans l’environnement. La facturation se fait alors au token au lieu d’utiliser la fenêtre de votre forfait, et les deux ne se concurrencent jamais. claude --bare -p dans tmux survit à la fermeture de votre ordinateur portable, et --output-format json écrit un champ total_cost_usd que vous pouvez vérifier le matin avec jq.