Claude பயன்பாட்டு வரம்புகளைத் தாண்டுவது எப்படி?
Claude சந்தா வரம்புகள் மற்றும் API 429 பிழைகளுக்கு இடையிலான வேறுபாடுகளை அறியுங்கள். மாடல்களை மாற்றினாலும் அணுகல் கிடைக்காது. வரம்புகளைத் தவிர்க்கும் முறைகள் இங்கே உள்ளன.
Claude-ன் பயன்பாட்டு வரம்புகள் என்ன?
Claude-ன் பயன்பாட்டு வரம்புகள் இரண்டு தனித்தனி அமைப்புகளாக உள்ளன. முதலில், எந்த அமைப்பால் நீங்கள் தடுக்கப்பட்டீர்கள் என்பதைக் கண்டறிய வேண்டும். ஒரு Claude சந்தா (Pro, Max, Team, அல்லது Enterprise) உங்களுக்கு ஒரு குறிப்பிட்ட பயன்பாட்டு அளவை வழங்குகிறது. இது அனைத்து மாடல்களுக்கும் மற்றும் Claude chat-க்கும் பொதுவானது. இந்த வரம்பை மீறும்போது You've hit your session limit · resets 3:45pm போன்ற ஒரு செய்தி மூலம் நீங்கள் தடுக்கப்படுவீர்கள். Claude API வேறொரு விஷயத்தை அளவிடுகிறது: நீங்கள் எவ்வளவு வேகத்தில் கோரிக்கைகளையும் (requests) டோக்கன்களையும் (tokens) அனுப்புகிறீர்கள் என்பது நிமிடத்திற்கு ஒருமுறை கணக்கிடப்படுகிறது. இது rate_limit_error வகை HTTP 429 பிழை மற்றும் எவ்வளவு வினாடிகள் காத்திருக்க வேண்டும் என்பதைக் குறிக்கும் retry-after தலைப்பு (header) மூலம் உங்களைத் தடுக்கும்.
இவற்றைச் சரிசெய்யும் முறைகள் முற்றிலும் மாறுபட்டவை. சந்தா வரம்பு என்பது ஒரு குறிப்பிட்ட கால இடைவெளியில் நீங்கள் எவ்வளவு பயன்படுத்தினீர்கள் என்பதைப் பொறுத்தது; எனவே, வரம்பு மீண்டும் தொடங்கும் வரை காத்திருக்க வேண்டும் அல்லது கூடுதல் பயன்பாட்டுத் திறனை வாங்க வேண்டும். API rate limit என்பது உங்கள் தற்போதைய வேகத்தைப் பொறுத்தது; நீங்கள் வேகத்தைக் குறைத்தவுடன் சில வினாடிகளில் இது சரியாகிவிடும்.
திட்டங்களுக்கான ஒதுக்கீடுகளும் rate-limit tier எண்களும் அடிக்கடி மாறக்கூடும். தவறான எண்களைக் குறிப்பிடுவது பயனுள்ளதாக இருக்காது என்பதால், அவை இங்கே வழங்கப்படவில்லை. கீழே கொடுக்கப்பட்டுள்ள கட்டளைகளைப் பயன்படுத்தி உங்கள் வரம்புகளை நீங்களே சரிபார்க்கவும்.
நீங்கள் எந்த வரம்பை அடைந்துள்ளீர்கள்? துல்லியமான செய்தியை வாசிக்கவும்
Claude Code தான் அச்சிடும் உரையில் அந்த அமைப்பின் பெயரை குறிப்பிடுகிறது. எதையும் மாற்றுவதற்கு முன், உங்களுடையது எது என்பதை உறுதிப்படுத்தவும்.
You've hit your session limit · resets 3:45pmஎன்பது சந்தா வரம்பு (subscription limit). இந்த கால இடைவெளிக்கான உங்கள் திட்டத்தின் ஒதுக்கீடு முடிந்துவிட்டது.You've hit your weekly limit · resets Mon 12:00amஎன்பது நீண்ட கால இடைவெளிக்கான அதே அமைப்பின் வரம்பாகும்.You've hit your Opus limit · resets 3:45pmஎன்பது Opus கோரிக்கைகளுக்கு மட்டுமே பொருந்தும் சந்தா வரம்பாகும். இந்த ஒரு சூழலில் மட்டும், மாடலை (model) மாற்றுவது உதவும்.API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.என்பது API விகித வரம்பாகும் (API rate limit). உங்கள் API key-க்காக அல்லது உங்கள் Amazon Bedrock அல்லது Google Cloud project-க்காக அமைக்கப்பட்ட வரம்பை நீங்கள் அடைந்துவிட்டீர்கள். கிளையண்ட் எவ்வாறு அங்கீகரிக்கிறது என்பதைப் பொறுத்து இது அமையும், ஏனெனில் Bedrock அல்லது Vertex கிளையண்ட், Anthropic நிறுவனத்தின் ஒதுக்கீட்டிற்குப் பதிலாக உங்கள் cloud project-ன் ஒதுக்கீட்டின் அடிப்படையில் கணக்கிடப்படுகிறது.API Error: Server is temporarily limiting requests (not your usage limit)என்பது உங்கள் திட்ட ஒதுக்கீட்டுடன் தொடர்பில்லாத, குறுகிய காலத் தடையாகும் (throttle). அந்த வரியைக் காட்டுவதற்கு முன்பே, Claude Code தானாகவே backoff முறையைப் பயன்படுத்தி மீண்டும் முயற்சிக்கிறது.
சந்தா வரம்புகள்: அமர்வு, வாராந்திர மற்றும் Opus கால அளவு
ஒரு சந்தாத் திட்டத்தில் சுழற்சி முறையில் பயன்பாட்டு வரம்பு (rolling usage allowance) உள்ளடங்கியுள்ளது. இந்த வரம்பு தீர்ந்துவிட்டால், செய்தியில் காட்டப்பட்டுள்ள மறுஅமைப்பு (reset) நேரம் வரை Claude Code அடுத்தடுத்த கோரிக்கைகளைத் தடுக்கும். இந்த வரம்பின் இரண்டு பண்புகள் பெரும்பாலும் குழப்பத்தை ஏற்படுத்துகின்றன.
- இது Claude chat-உடன் பகிரப்படுகிறது. claude.ai-ல் நீங்கள் செய்யும் வேலை, terminal-ல் செய்யும் அதே வரம்பிலிருந்தே கழிக்கப்படுகிறது. எனவே, chat-ல் அதிக நேரம் செலவிடுவது உங்கள் மாலை நேர coding பணிக்கான வரம்பைக் குறைக்கும். ஒரே கணக்கில் நீங்கள் உள்நுழையும் அனைத்து தளங்களும் ஒரே வரம்பையே பயன்படுத்துகின்றன. எனவே, Linux-ல் beta desktop app மற்றும் Claude Code CLI ஆகிய இரண்டும் தனித்தனியாக அல்லாமல், ஒரே வரம்பையே பகிர்ந்து கொள்கின்றன.
- இது அனைத்து மாதிரிகளுக்கும் (models) பொதுவானது. அமர்வு மற்றும் வாராந்திர வரம்புகளில் மாதிரி வாரியான ஒதுக்கீடு கிடையாது; Opus வரம்பு மட்டுமே இதற்கு விதிவிலக்கு.
Claude for Teams மற்றும் Enterprise திட்டங்களில், ஒவ்வொரு பயனருக்கும் (per-seat) ஒரு குறிப்பிட்ட வரம்பு வழங்கப்படுகிறது. இது ஐந்து மணிநேர சுழற்சி மற்றும் வாராந்திர சுழற்சி அடிப்படையில் மறுஅமைப்பு செய்யப்படுகிறது. இது Claude chat மற்றும் Cowork ஆகியவற்றுடன் பகிரப்படுகிறது, மேலும் பயனரின் அடுக்கு (Standard அல்லது Premium) அடிப்படையில் இதன் அளவு தீர்மானிக்கப்படுகிறது. Pro மற்றும் Max திட்டங்களில், செய்தியில் குறிப்பிடப்பட்டுள்ள மறுஅமைப்பு நேரம் மற்றும் உங்கள் சொந்த /usage பட்டிகளே நம்பகமானவை; வலைப்பதிவுகளில் உள்ள புள்ளிவிவரங்களை நம்ப வேண்டாம். நீங்கள் எந்தத் திட்டத்தைத் தேர்வு செய்வது என்று இன்னும் முடிவு செய்யவில்லை என்றால், உங்களுக்கு எந்த Claude திட்டம் தேவை என்பதைப் பார்த்து, ஒவ்வொரு திட்டத்திலும் உள்ள கட்டுப்பாடுகளை ஒப்பிட்டுப் பாருங்கள்.
/model மூலம் மாதிரியை மாற்றினாலும் ஏன் அணுகல் மீண்டும் கிடைப்பதில்லை
இதுவே மிகவும் பொதுவான தவறான நடவடிக்கையாகும், இதைப் பற்றி ஆவணங்கள் தெளிவாகக் கூறுகின்றன: session மற்றும் weekly வரம்புகள் அனைத்து மாதிரிகளுக்கும் பொதுவானவை, எனவே மாதிரிகளை மாற்றுவதால் அணுகல் மீண்டும் கிடைக்காது. உங்கள் session காலாவதியான பிறகு சிறிய மாதிரியைத் தேர்ந்தெடுப்பது, எந்த மாதிரி பதிலளிக்கும் என்பதை மட்டுமே மாற்றும். இது மீதமுள்ள ஒதுக்கீட்டை (allowance) மாற்றாது, ஏனெனில் ஒதுக்கீடு என்பது மாதிரி வாரியாகக் கணக்கிடப்படுவதில்லை, எனவே மாற்றத்தினால் எந்தப் பயனும் இல்லை.
Opus வரம்பு இதற்கு விதிவிலக்காகும், இது ஒரு குறிப்பிட்ட மாதிரிக்கு மட்டுமேயான வரம்பாகும். செய்தி You've hit your Opus limit என்று இருந்தால், /model என்பதே சரியான தீர்வாகும். மற்றொரு மாதிரிக்கு மாறி தொடர்ந்து பணியாற்றுங்கள், ஏனெனில் Opus கோரிக்கைகள் மட்டுமே தடுக்கப்பட்டிருந்தன.
இந்த வரம்பை ஒரு பிழையாக (bug) கருதுவது இரண்டாவது தவறான நடவடிக்கையாகும். மீண்டும் நிறுவுவதோ (reinstall) அல்லது மீண்டும் அங்கீகரிப்பதோ (re-authenticate) எதையும் மாற்றாது. ஒதுக்கீடு என்பது காலக்கெடு முடிவடையும் போது அல்லது நீங்கள் usage credits வாங்கும் போது மட்டுமே மீண்டும் கிடைக்கும்.
சந்தா வரம்பை (subscription limit) எட்டும்போது என்ன செய்ய வேண்டும்
- வரம்பு எப்போது மீட்டமைக்கப்படும் (reset time) என்பதைப் பார்க்கவும். ஒரு session window குறுகிய காலமே இருக்கும். வாராந்திர வரம்பு என்பது உங்கள் மேஜையில் அமர்ந்து காத்திருக்க வேண்டிய ஒன்றல்ல.
- இது Opus வரம்பு என்றால்,
/modelகட்டளையை இயக்கி மற்றொரு model-ஐத் தேர்ந்தெடுக்கவும். - உங்கள் plan வரம்புகள், பயன்பாட்டு அளவு மற்றும் அவை எப்போது மீட்டமைக்கப்படும் என்பதைப் பார்க்க
/usageகட்டளையை இயக்கவும்./costஎன்பது அதே திரையைக் காட்டும் ஒரு மாற்றுப் பெயராகும் (alias). - வரம்பைத் தாண்டி தொடர்ந்து பணியாற்ற
/usage-creditsகட்டளையை இயக்கவும். Pro மற்றும் Max திட்டங்களில் இது உங்கள் billing அமைப்புகளைத் திறக்கும். Team மற்றும் Enterprise திட்டங்களில் இது உங்கள் நிறுவனத்தின் பயன்பாட்டு அமைப்புகளைத் திறக்கும்; அல்லது உங்களுக்கு billing அணுகல் இல்லையெனில், உங்கள் நிர்வாகிகளுக்கு ஒரு கோரிக்கையை அனுப்பும். - ஒவ்வொரு வாரமும் ஒரே வரம்பை நீங்கள் எதிர்கொண்டால், உங்கள் பணிமுறைக்கு அந்தத் திட்டம் பொருத்தமானதல்ல என்று அர்த்தம். ஒவ்வொரு முறையும் மீட்டமைக்கப்படும்போது கவலைப்படுவதை விட, பயன்பாட்டு வரம்பிலிருந்து வெளியேறும் வழிகளை ஒருமுறை ஆராய்வது சிறந்தது.
/usage-credits வசதியைப் பயன்படுத்த, /login வழியாக உள்நுழைந்த ஒரு claude.ai சந்தா தேவை. API key அங்கீகாரத்தில் இது கிடைக்காது, ஏனெனில் API key-க்கு நீட்டிக்கக்கூடிய plan ஒதுக்கீடு எதுவும் இல்லை.
பயன்பாட்டு வரம்பு credits-ஐப் பயன்படுத்தும்போது கவனிக்க வேண்டிய ஒரு முக்கிய விஷயம் உள்ளது. சந்தாவில் இருக்கும்போது prompt cache-ன் ஆயுட்காலம் ஒரு மணிநேரம், ஆனால் credits-ஐப் பயன்படுத்தத் தொடங்கியவுடன் அது ஐந்து நிமிடங்களாகக் குறைந்துவிடும். இதனால் பல உரையாடல்கள் புதிதாகத் தொடங்க வேண்டியிருக்கும், மேலும் அதே பணிக்கு Claude Code token பயன்பாடு அதிகரிக்கும்.
பயன்பாட்டு வரம்புகள் போலத் தோன்றும் ஆனால் அவை அல்லாத செய்திகள்
Claude Code-ல் நான்கு பிழைகள் பயன்பாட்டு வரம்புகள் (usage limits) எனத் தவறாகப் புகாரளிக்கப்படுகின்றன, ஆனால் அவை உண்மையில் பயன்பாட்டு வரம்புகள் அல்ல.
- ஒரு context அல்லது auto-compact எச்சரிக்கை என்பது பயன்பாட்டு வரம்பு அல்ல. உரையாடல் மாதிரியின் (model) context window-ஐத் தாண்டி வளரும்போது,
/contextஆனதுContext exceeds the 200k-token limit by 94k tokens — run /compact or /clear to continue.போன்ற ஒரு வரியை அச்சிடும். இடவசதியை உருவாக்க பழைய வரலாறு சுருக்கப்படும், உங்கள் திட்டத்தின் ஒதுக்கீடு (plan allowance) பாதிக்கப்படாது. Error during compaction: Conversation too long. Press esc twice to go up a few messages and try again.என்பது/compactதோல்வியடைந்தது என்று பொருள், ஏனெனில் அது உருவாக்க வேண்டிய சுருக்கத்தை வைத்திருக்க போதுமான context இடம் இல்லை.Credit balance is too lowஎன்பது உங்கள் Console நிறுவனத்தின் முன்கூட்டியே செலுத்தப்பட்ட credits தீர்ந்துவிட்டன என்று பொருள். platform.claude.com/settings/billing தளத்தில் credits-ஐச் சேர்க்கவும், அங்கு auto-reload வசதியும் உள்ளது.API Error: Usage credits required for 1M context · run /usage-credits to turn them on, or /model to switch to standard contextஎன்பது ஒரு entitlement சரிபார்ப்பு, இது ஒதுக்கீடு தீர்ந்துவிட்டதைக் குறிக்காது.[1m]suffix இல்லாத model variant-ஐத் தேர்ந்தெடுக்கவும் அல்லதுCLAUDE_CODE_DISABLE_1M_CONTEXT=1-ஐ அமைக்கவும்.
API-லிருந்து இன்னொன்று வருகிறது. 413 request_too_large என்பது ஒரு கோரிக்கையின் (single request) அளவு வரம்பாகும், இது rate limit அல்ல.
API rate limits: 429 பிழை எதைக் கணக்கிடுகிறது
Messages API மூன்று விஷயங்களை, ஒவ்வொரு model class-க்கும் தனித்தனியாகக் கணக்கிடுகிறது.
- requests per minute (RPM)
- input tokens per minute (ITPM)
- output tokens per minute (OTPM)
உங்கள் நிறுவனத்திற்கு ஒரு spend limit-ம் உண்டு, இது வேறுபட்டது: API பயன்பாட்டிற்கான அதிகபட்ச மாதாந்திர செலவு இது. உங்கள் tier-ன் spend cap-ஐ அடைந்தவுடன், நீங்கள் அதிக வரம்பைக் கோரவில்லை எனில், அடுத்த மாதம் வரை API பயன்பாடு நிறுத்தப்படும். எந்தவொரு retry loop-ம் இதைச் சரிசெய்யாது.
429 பிழை எப்போது வரும் என்பதை நான்கு வழிமுறைகள் தீர்மானிக்கின்றன.
- வரம்புகள் model class வாரியானவை. இவை ஒவ்வொரு model-க்கும் தனித்தனியாகப் பொருந்தும், எனவே நீங்கள் வெவ்வேறு model-களை அவற்றின் வரம்பிற்கு உட்பட்டு ஒரே நேரத்தில் பயன்படுத்தலாம். சில குடும்பங்கள் ஒரே bucket-ஐப் பகிர்ந்து கொள்கின்றன: Claude Opus 4.8, Opus 4.7, Opus 4.6 மற்றும் Opus 4.5 ஆகியவற்றின் மொத்த பயன்பாடு Opus rate limit-க்குள் அடங்கும், அதே சமயம் Claude Sonnet 5-க்குத் தனி வரம்பு உண்டு.
- Capacity தொடர்ந்து நிரப்பப்படுகிறது. API ஒரு token bucket algorithm-ஐப் பயன்படுத்துகிறது, எனவே capacity ஒரு குறிப்பிட்ட நேரத்தில் reset ஆகாமல், தொடர்ந்து நிரப்பப்படுகிறது. 60 requests per minute என்ற வரம்பு, ஒரு வினாடிக்கு ஒரு request என அமல்படுத்தப்படலாம், எனவே ஒரே நேரத்தில் 60 requests அனுப்பினால் அவை தோல்வியடையும்.
- பெரும்பாலான model-களில் uncached input மட்டுமே ITPM-ல் கணக்கிடப்படும்.
input_tokensமற்றும்cache_creation_input_tokensகணக்கிடப்படும். பெரும்பாலான Claude model-களில்cache_read_input_tokensகணக்கிடப்படாது, Claude Haiku 3.5 இதற்கு விதிவிலக்காகும். எனவே, Caching என்பது தள்ளுபடியைத் தருவதுடன், rate-limit வரம்பையும் அதிகரிக்க உதவுகிறது. Output பக்கத்தில், அதிகப்படியானmax_tokensஎன்பது OTPM-ஐப் பாதிக்காது, ஏனெனில் OTPM என்பது உண்மையில் உருவாக்கப்பட்ட tokens-ஐ மட்டுமே கணக்கிடுகிறது. - வரம்புகள் organization அளவில் அமலில் இருக்கும். ஒரு workspace-க்குக் குறைந்த வரம்பு வழங்கப்படலாம், மேலும் workspace வரம்புகளின் கூடுதல், organization-ன் மொத்த வரம்பை விட அதிகமாக இருந்தாலும், organization-ன் வரம்புகளே பொருந்தும். நீங்கள் workspace-ல் மாற்றாத வரம்பு, organization-லிருந்து பெறப்படும், அது வரம்பற்றதாக இருக்காது.
Start, Build, Scale மற்றும் Custom எனப் பெயரிடப்பட்ட tiers, உங்கள் பயன்பாட்டு வரலாறு மற்றும் கணக்கின் நிலையைப் பொறுத்து தானாகவே ஒதுக்கப்படும் உண்மையான எண்களை நிர்ணயிக்கின்றன. புதிய நிறுவனங்கள் வெளியிடப்பட்ட தரநிலையை விடக் குறைந்த வரம்பில் தொடங்கலாம், எனவே அட்டவணையில் உள்ளதை விட முன்னதாகவே முதல் 429 பிழை வரலாம். பயன்பாட்டில் திடீர் அதிகரிப்பு ஏற்பட்டால் acceleration limits தூண்டப்படும், இது உங்கள் tier வரம்பிற்குள் இருந்தாலும் 429 பிழையைத் தரும், எனவே traffic-ஐ படிப்படியாக அதிகரிக்கவும். வெளியிடப்பட்ட ஒவ்வொரு எண்ணிக்கையும் ஒரு உச்சவரம்பு மட்டுமே: ஆவணப்படுத்தப்பட்ட வரம்புகள் அனுமதிக்கப்பட்ட அதிகபட்ச பயன்பாடே தவிர, குறைந்தபட்ச உத்தரவாதம் அல்ல. கூடுதல் வரம்பைக் கோர, Claude Console-ல் உள்ள Limits பக்கத்தில் இருக்கும் "Request rate limit increase" வசதியைப் பயன்படுத்தவும்.
429 பிழையை வாசித்தல்: retry-after, headers மற்றும் SDK retries
ஒவ்வொரு API பிழையும் ஒரே மாதிரியான envelope-ஐத் திருப்பி அனுப்பும்: இது பிழையின் வகை மற்றும் செய்தியைக் கொண்ட ஒரு nested error object மற்றும் மேல்மட்டத்தில் ஒரு request_id ஆகியவற்றைக் கொண்டிருக்கும்.
{
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "<names the rate limit you exceeded>"
},
"request_id": "req_011CSHoEeqs5C35K2UUqR7Fy"
}மீதமுள்ள தகவல்கள் headers-ல் இருக்கும்.
retry-afterஎன்பது நீங்கள் மீண்டும் கோரிக்கையை அனுப்பும் வரை காத்திருக்க வேண்டிய வினாடிகளின் எண்ணிக்கை ஆகும். இதற்கு முன்னதாக அனுப்பப்படும் கோரிக்கைகள் தோல்வியடையும்.anthropic-ratelimit-requests-limit,anthropic-ratelimit-requests-remainingமற்றும்anthropic-ratelimit-requests-resetஆகியவை உங்கள் கோரிக்கை வரவுசெலவுத் திட்டத்தை (request budget) விவரிக்கின்றன.anthropic-ratelimit-input-tokens-*மற்றும்anthropic-ratelimit-output-tokens-*ஆகியவை ITPM மற்றும் OTPM ஆகியவற்றிற்கு அதே limit, remaining மற்றும் reset suffixes-உடன் செயல்படுகின்றன.anthropic-ratelimit-tokens-*தற்போது நடைமுறையில் உள்ள மிகக் கடுமையான வரம்பிற்கான மதிப்புகளைக் காட்டுகிறது.
Reset headers என்பவை RFC 3339 timestamps ஆகும். Remaining token headers ஆயிரத்திற்கு அருகாமையில் முழுமையாக்கப்படுகின்றன, எனவே அவற்றை ஒரு gauge-ஆகக் கருதவும். Fast mode-க்கு எனத் தனி pool மற்றும் அதன் சொந்த anthropic-fast-* headers உள்ளன. வெற்றிகரமான எந்தவொரு அழைப்பிலிருந்தும் இவற்றை வாசிக்கவும்:
curl -s -D - -o /dev/null https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-5","max_tokens":16,"messages":[{"role":"user","content":"hi"}]}' \
| grep -i 'ratelimit\|retry-after\|request-id'ஒவ்வொரு பதிலிலும் ஒரு தனித்துவமான request-id header இருக்கும், உதாரணமாக req_018EeWyXxfu5pfWkrYcMdjWG. இது பிழை உடல்களில் request_id என்றும், Python மற்றும் TypeScript SDK பதில்களில் _request_id என்றும் தோன்றும். நீங்கள் ஆதரவு குழுவைத் தொடர்பு கொள்ளும்போது இதைக் குறிப்பிடவும்.
ஒரு backoff loop-ஐ எழுதுவதற்கு முன்பு, அது உங்களுக்குத் தேவையா என்பதைச் சரிபார்க்கவும். அதிகாரப்பூர்வ SDK-கள், connection errors, rate limits மற்றும் 5xx server errors உள்ளிட்ட தற்காலிகத் தோல்விகளை தானாகவே மீண்டும் முயற்சிக்கும் (retry). இவை exponential backoff முறையைப் பயன்படுத்தி, முன்னிருப்பாக இரண்டு முறை முயற்சிக்கும், மேலும் retry-after header இருக்கும்போது அதை மதிக்கும். ஒவ்வொரு client-ம் இந்தச் செயல்பாட்டை மாற்ற அல்லது முடக்க maximum-retries விருப்பத்தை ஏற்கும்.
import anthropic
client = anthropic.Anthropic(max_retries=5) # the SDK default is 2
try:
msg = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "hello"}],
)
except anthropic.RateLimitError as err:
headers = err.response.headers
print("still limited after retries; wait", headers.get("retry-after"), "seconds")
print("request id:", headers.get("request-id"))529 overloaded_error உங்கள் தவறு அல்ல
429 என்பது நீங்கள் மிக வேகமாகச் செயல்பட்டதைக் குறிக்கிறது. 529 overloaded_error என்பது API தற்காலிகமாக அதிக சுமையுடன் இருப்பதைக் குறிக்கிறது; அனைத்து பயனர்களிடமிருந்தும் வரும் அதிகப்படியான traffic காரணமாக இது ஏற்படலாம். உங்கள் key அல்லது code-ல் எந்தப் பிழையும் இல்லை. Exponential backoff முறையைப் பயன்படுத்தி மீண்டும் முயற்சிக்கவும் (SDK-கள் 5xx பதில்களுக்கு இதை ஏற்கனவே செய்கின்றன). சிக்கல் நீடித்தால் status.claude.com பக்கத்தைச் சரிபார்க்கவும். 500 api_error என்பது ஒரு internal error ஆகும்; இதற்கும் அதே முறையில் மீண்டும் முயற்சிக்கவும். இவை இரண்டுமே rate limit தொடர்பானவை அல்ல.
அட்டவணையைப் பார்ப்பதற்குப் பதிலாக உங்கள் சொந்த வரம்புகளைப் படித்தல்
ஒரு சந்தாவில், /usage என்பது முக்கியமான திரையாகும். இது உங்கள் திட்டப் பயன்பாட்டுப் பட்டைகளையும் (usage bars) எவை அவற்றை நுகர்ந்தன என்பதற்கான விவரங்களையும் காட்டுகிறது, மேலும் d அல்லது w கடந்த 24 மணிநேரம் மற்றும் கடந்த 7 நாட்களுக்கு இடையே மாற உதவுகிறது. இரண்டு எச்சரிக்கைகள் உள்ளன. Session தொகுதி API token பயன்பாட்டைக் காட்டுகிறது மற்றும் இது API பயனர்களுக்கானது, எனவே சந்தாதாரர்கள் அதன் டாலர் மதிப்பைப் புறக்கணிக்கலாம். இந்த எண்கள் அந்த இயந்திரத்தில் உள்ள உள்ளூர் session வரலாற்றிலிருந்து வருகின்றன, எனவே மற்றொரு சாதனத்திலிருந்து அல்லது claude.ai-லிருந்து வரும் பயன்பாடு இதில் விடுபடும்.
API பக்கத்தில், Claude Console-ல் உள்ள Usage பக்கம் "Rate Limit - Input Tokens" மற்றும் "Rate Limit - Output Tokens" ஆகிய இரண்டு வரைபடங்களை வரைகிறது. உள்ளீட்டு வரைபடம், உங்கள் தற்போதைய ITPM வரம்பிற்கு எதிராக, ஒரு நிமிடத்திற்கு கேச் செய்யப்படாத உள்ளீட்டு tokens-ன் அதிகபட்ச மணிநேர அளவை அதன் கேச் விகிதத்துடன் காட்டுகிறது, எனவே நீங்கள் production-ல் வரம்பை அடைவதற்கு முன்பே அதை நெருங்குவதைக் கண்காணிக்கலாம்.
உங்கள் கட்டமைக்கப்பட்ட வரம்புகளை நிரல் ரீதியாகப் படிக்க:
curl -s https://api.anthropic.com/v1/organizations/rate_limits \
-H "x-api-key: $ANTHROPIC_ADMIN_KEY" \
-H "anthropic-version: 2023-06-01"இதற்கு ஒரு Admin API key தேவைப்படுகிறது, மேலும் GET /v1/organizations/workspaces/{workspace_id}/rate_limits ஒவ்வொரு workspace-க்கும் இதையே செய்கிறது. இவை இரண்டும் read-only ஆகும்: ஒரு வரம்பை மாற்ற, Console-ல் உள்ள Limits தாவலைப் பயன்படுத்தவும்.
less-ஐப் பயன்படுத்தி, வரம்புகளைக் குறைத்தல்
இரண்டு அமைப்புகளும் அடிப்படையான ஒரே விஷயத்தையே அளவிடுகின்றன, எனவே இந்த உத்திகள் இரண்டிற்கும் பொருந்தும்.
- ஒரு முறைக்குக் குறைவான tokens-ஐச் செலவிடுங்கள். தொடர்ச்சியான செயல்பாடுகள் cache-ஐச் சூடாக வைத்திருக்கும், மேலும் தொடர்பில்லாத பணிகளுக்கு இடையே
/clearபயன்படுத்துவது எந்தச் செலவையும் ஏற்படுத்தாது. Claude Code token பயன்பாடு அந்த உத்திகளை முழுமையாக விளக்குகிறது. - முயற்சியைக் குறைக்கவும். நிலைகள்
low,medium,high,xhighமற்றும்maxஆகும்./effortமெனுultracode-ஐயும் வழங்குகிறது, இது செலவைக் குறைப்பதற்குப் பதிலாக அதிகரிக்கிறது. ஒரு இயந்திரத்தனமான பெயர் மாற்றத்திற்கு ஆழ்ந்த சிந்தனை (deep reasoning) தேவையில்லை. - 429 பிழைக்குப் பிறகு concurrency-ஐக் குறைக்கவும்.
CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY-ஐக் குறைத்து, பல parallel subagents-ஐத் தவிர்க்கவும்./status-ஐயும் இயக்கவும்: கவனக்குறைவாக ஒருANTHROPIC_API_KEYஇருந்தால், அது உங்கள் சந்தாவிற்குப் பதிலாக low-tier key வழியாக கோரிக்கைகளை அனுப்பும். - Message Batches API-க்கு interactive அல்லாத பணிகளை மாற்றவும். இது அதிக அளவிலான தரவுகளை asynchronous முறையில் 50% தள்ளுபடியில் (input மற்றும் output tokens) கையாள்கிறது. இது தனித்தனி rate limits-ஐக் கொண்டிருப்பதால், இரவு நேரப் பணிகள் உங்கள் தற்போதைய session-உடன் போட்டியிடாது.
தரவுகளை context-ல் அதிகமாகச் சேர்க்கும் பணிகள் இதைப் பெரிதும் பாதிக்கின்றன: நீங்கள் நேரடிச் சந்தை தரவுகளுடன் பங்குகள் மற்றும் விருப்பங்களை ஆய்வு செய்கிறீர்கள் என்றால், ஒவ்வொரு கேள்விக்கும் தேவையான சிறிய பகுதியை மட்டும் எடுப்பது, முழு அட்டவணைகளையும் நகலெடுப்பதை விடக் குறைந்த செலவே ஆகும். மனிதர்களுக்குப் பதிலாக நிரல்களால் இயக்கப்படும் பணிகள் ஆரம்பத்திலிருந்தே API key-ல் இருக்க வேண்டும். அங்கு மாறுவது உங்கள் கட்டண முறையை மாற்றுவதுடன், அளவீட்டு முறையையும் மாற்றும், ஏனெனில் Claude API-ல் இலவச அடுக்கு இல்லை, பதிவு செய்யும் போது வழங்கப்படும் சிறிய credit மட்டுமே உண்டு. VPS-ல் உங்கள் முதல் Claude API செயலி key கையாளுதல் மற்றும் retries பற்றி விளக்குகிறது, மேலும் tmux-க்குள் Claude Code-ஐ இயக்குவதன் மூலம், இணைப்பு துண்டிக்கப்பட்டாலும் நீண்ட கால agent இயக்கம் பாதிக்கப்படாது.
FAQ
மாடல்களை மாற்றுவது ஏன் எனது Claude பயன்பாட்டு வரம்பைச் சரிசெய்வதில்லை?
ஏனெனில், அமர்வு (session) மற்றும் வாராந்திர வரம்புகள் அனைத்து மாடல்களுக்கும் பொதுவானவை. பயன்பாட்டு ஒதுக்கீடு என்பது உங்கள் திட்டத்திற்கு (plan) உரியது, ஒரு குறிப்பிட்ட மாடலுக்கு உரியது அல்ல. எனவே, /model எந்த மாடல் பதிலளிக்கும் என்பதை மட்டுமே மாற்றும், மீதமுள்ள ஒதுக்கீட்டை மாற்றாது. இதற்கு You've hit your Opus limit மட்டுமே விதிவிலக்கு, இது Opus கோரிக்கைகளுக்கு மட்டுமே பொருந்தும். அந்தச் சூழலில், மாடலை மாற்றுவது ஆவணப்படுத்தப்பட்ட தீர்வாகும்.
429 rate_limit_error என்பதன் பொருள் என்ன, நான் எவ்வளவு நேரம் காத்திருக்க வேண்டும்?
உங்கள் கணக்கு அந்த மாடல் வகைக்கான விகித வரம்பை (rate limit) எட்டிவிட்டது என்று பொருள்: இது நிமிடத்திற்கான கோரிக்கைகள், நிமிடத்திற்கான உள்ளீட்டு டோக்கன்கள் அல்லது நிமிடத்திற்கான வெளியீட்டு டோக்கன்கள் ஆகியவற்றில் ஒன்றாக இருக்கலாம். இந்த பதிலுடன் வரும் retry-after தலைப்பு (header), நீங்கள் எத்தனை வினாடிகள் காத்திருக்க வேண்டும் என்பதைக் குறிக்கும். அதற்கு முன்னதாக மீண்டும் முயற்சிப்பது தோல்வியடையும். அதிகாரப்பூர்வ SDK-கள் ஏற்கனவே விகித வரம்புகள் மற்றும் 5xx பிழைகளை exponential backoff முறையில் கையாளுகின்றன. இயல்பாக இருமுறை முயற்சிக்கும் இவை, அந்தத் தலைப்பில் உள்ள கால அளவை மதிக்கின்றன. உங்கள் திட்ட வரம்பிற்குள் இருக்கும்போதே 429 பிழை ஏற்பட்டால், அது திடீரென அதிகரித்த பயன்பாட்டினால் ஏற்பட்ட வேகக் கட்டுப்பாட்டைக் குறிக்கிறது.
எனது Claude பயன்பாட்டு வரம்புகளையும் அவை எப்போது மீட்டமைக்கப்படும் என்பதையும் எப்படிப் பார்ப்பது?
Claude Code-ல், உங்கள் திட்டத்தின் நிலைப் பட்டைகள், மீட்டமைப்பு நேரங்கள் மற்றும் பயன்பாட்டு விவரங்களைப் பார்க்க /usage கட்டளையை இயக்கவும்; /cost என்பது இதற்கான மாற்றுப் பெயர் (alias). d அல்லது w கட்டளைகள் கடந்த 24 மணிநேரம் மற்றும் கடந்த 7 நாட்களுக்கான தரவுகளுக்கு இடையே மாற உதவும். இந்தத் தரவுகள் உள்ளூர் அமர்வு வரலாற்றிலிருந்து வருவதால், பிற சாதனங்கள் மற்றும் claude.ai மூலம் செய்யப்படும் பயன்பாடுகள் இதில் கணக்கில் வராது. API-ஐப் பொறுத்தவரை, Console உங்கள் விகித வரம்புகளை வரைபடமாகக் காட்டும், மேலும் Admin API key மூலம் GET /v1/organizations/rate_limits கட்டளையைப் பயன்படுத்தி உங்கள் கட்டமைக்கப்பட்ட வரம்புகளைப் பெறலாம்.
எனது Claude திட்ட வரம்பை எட்டிய பிறகும் நான் தொடர்ந்து வேலை செய்ய முடியுமா?
சில நேரங்களில் முடியும். Pro மற்றும் Max திட்டங்களில் வரம்பிற்கு மேல் பயன்பாட்டை வாங்க, அல்லது Team மற்றும் Enterprise திட்டங்களில் நிர்வாகியிடம் கோர /usage-credits கட்டளையை இயக்கவும். இதற்கு /login வழியாக claude.ai உள்நுழைவு தேவை, API key அங்கீகாரத்தில் இது கிடைக்காது. இல்லையெனில், மீட்டமைப்பு நேரம் வரை காத்திருக்கவும், Opus வரம்பாக இருந்தால் மாடலை மாற்றவும், அல்லது உங்கள் பணியை API key-க்கு மாற்றவும். API key பயன்பாடு குறிப்பிட்ட கால இடைவெளிக்கு பதிலாக நிமிடத்திற்கு நிமிடம் கணக்கிடப்படுகிறது.