Claude API சந்தாவை விட மலிவானதா?
தற்போதைய token விகிதங்களில் break-even எண்கணிதம் இதோ. அதிகாரப்பூர்வ எண் இல்லை; திட்டக் கட்டணத்தை விட உங்கள் பயன்பாடே பதிலைத் தீர்மானிக்கிறது.
Claude API சந்தாவை விட மலிவானதா?
குறிப்பிட்ட பயன்பாட்டளவுக்குக் கீழ் Claude API சந்தாவை விட மலிவானது. அதற்கு மேல் செலவானது. நாள் முழுவதும் ஊடாடும் முறையில் குறியீடு எழுதும் ஒரு டெவலப்பருக்கு, தட்டையான திட்டம் பொதுவாக வெல்கிறது. தனது அழைப்புகளைத் தானே மேற்கொள்ளும் ஒரு நிரலுக்கு, API மட்டுமே ஒரே விருப்பம். எனவே செலவு இதைத் தீர்மானிப்பதில்லை. மீதமுள்ளது பத்து நிமிடங்களில் நீங்கள் செய்யக்கூடிய எண்கணிதம்.
பார்ப்பதற்கு அதிகாரப்பூர்வ சமப்பங்கு-எண் (break-even number) எதுவும் இல்லை. சந்தா பக்கம் token ஒதுக்கீட்டை விட பயன்பாட்டுச் சாளரங்களாக விற்கப்படுகிறது. எனவே எந்தப் பதிப்பிக்கப்பட்ட எண்ணும் இரண்டு கோடுகள் எங்கே வெட்டுகின்றன என்பதை உங்களுக்குச் சொல்லாது. இதைத் தொடர்ந்து வருவது தற்போதைய ஒரு token விகிதங்களில் விலை நிர்ணயிக்கப்பட்ட சூத்திரம், அத்துடன் திட்டக் கட்டணத்தை விட உங்கள் பதிலை மேலும் தொலைவுக்கு நகர்த்தும் உங்கள் சொந்த நடத்தையின் பகுதிகள். கீழே உள்ள ஒவ்வொரு சமப்பங்கு-எண்ணும் பதிப்பிக்கப்பட்ட விகிதங்கள் மற்றும் கூறப்பட்ட கருதுகோள்களிலிருந்து எனது சொந்த எண்கணிதம், ஆவணப்படுத்தப்பட்ட எண் அல்ல.
எந்தத் திட்டத்தை வாங்குவது என்று இன்னும் தீர்மானித்து கொண்டிருந்தால், உங்கள் வேலை செய்யும் முறைக்கு ஏற்ற Claude திட்டம் எது அதற்கு விடையளிக்கிறது. இந்தப் பதிவின் கருதுகோள், நீங்கள் எந்தத் திட்டத்தை வாங்குவீர்கள் என்று தெரிந்துகொண்டு, அதை வாங்க வேண்டுமா வேண்டாமா என்பதை அறிய விரும்புகிறீர்கள் என்பதாகும்.
ஒரே வடிவம் இல்லாத இரண்டு பில்லிங் மாதிரிகள்
சந்தா என்பது நீங்கள் பயன்படுத்தாமலும் இருக்கக்கூடிய ஒரு திறன். நீங்கள் ஒரு நிலையான கட்டணம் செலுத்துகிறீர்கள். ஒரு கால அட்டவணையின்படி மீட்டமைக்கப்படும் ஒதுக்கீட்டைப் பெறுகிறீர்கள். Anthropic-இன் Claude Code ஆவணப்படுத்தல் Team மற்றும் Enterprise seat-களுக்கான வடிவத்தைக் கூறுகிறது: பயன்பாடு "ஒரு உருளும் ஐந்து மணிநேரச் சாளரம் மற்றும் வாராந்திரச் சாளரத்தில் மீட்டமைக்கப்படும் ஒரு ஒரு seat ஒதுக்கீட்டிலிருந்து எடுக்கப்படுகிறது", இது Claude chat மற்றும் Cowork உடன் பகிரப்படுகிறது. ஒரு சந்தாதாரர் அதே வடிவத்தை அவர்கள் எதிர்கொள்ளும் செய்திகள் வழியாகச் சந்திக்கிறார், அவை "நீங்கள் உங்கள் அமர்வு வரம்பை அடைந்துவிட்டீர்கள்" மற்றும் "நீங்கள் உங்கள் வாராந்திர வரம்பை அடைந்துவிட்டீர்கள்" எனப் படிக்கின்றன. நீங்கள் பயன்படுத்தாத திறன் என்பது நீங்கள் எப்படியோ செலவழித்த பணம். நீங்கள் தாண்டும் திறன் சாளரம் மீட்டமைக்கப்படும் வரை உங்கள் வேலையை நிறுத்துகிறது, மேலும் /model உடன் மாதிரியை மாற்றுவது அணுகலை மீட்டெடுப்பதில்லை, ஏனெனில் சாளரங்கள் மாதிரிகள் முழுவதும் பகிரப்படுகின்றன.
API என்பது ஒருபோதும் நிற்காத ஒரு மீட்டர். சாளரமோ சுவரோ இல்லை. ஒவ்வொரு கோரிக்கையும் ஒரு token க்கு விலை நிர்ணயிக்கப்படுகிறது, மேலும் சில விஷயங்கள் token-களுக்கு வெளியே விலை நிர்ணயிக்கப்படுகின்றன: வலைத் தேடல் "Claude API-இல் 1,000 தேடல்களுக்கு $10 என்ற விலையில் கிடைக்கிறது". எதுவும் ஒரு வரம்பில் நிற்பதில்லை. இன்வாய்ஸ் வெறுமனே வளர்கிறது.
23 July 2026 நிலவரப்படி திட்டக் கட்டணங்கள், Claude விலை நிர்ணயப் பக்கத்திலிருந்து மேற்கோள் காட்டப்பட்டுள்ளது: Pro ஆனது "ஆண்டு சந்தாத் தள்ளுபடியுடன் மாதத்திற்கு $17 (முன்பணமாக $200 பில் செய்யப்படுகிறது). மாதாமாதம் பில் செய்தால் $20", மேலும் இதில் Claude Code அடங்கும். Max "மாதத்திற்கு $100 இலிருந்து" எனப் பட்டியலிடப்பட்டுள்ளது. Team seat-கள் "ஆண்டுதோறும் பில் செய்தால் ஒரு seat / மாதத்திற்கு $20" இல் தொடங்குகின்றன. Enterprise சுவாரஸ்யமானது, ஏனெனில் இது இரண்டு மாதிரிகளையும் ஒரே நேரத்தில் இயக்குகிறது: "Seat விலை + API விகிதங்களில் பயன்பாடு $20/seat". கட்டணங்கள் அடிக்கடி மாறுகின்றன, மேலும் ஒவ்வொன்றிற்கும் பின்னால் உள்ள ஒதுக்கீடு token-களில் ஒருபோதும் வெளியிடப்படுவதில்லை, எனவே நீங்கள் முடிவு செய்யும் நாளன்று விலை நிர்ணயப் பக்கத்தைப் படியுங்கள்.
API-இலிருந்து நீங்கள் பெற முடியாதது
ஒரு திட்ட ஒதுக்கீடு, மற்றும் அதைச் சுற்றி கட்டப்பட்ட இடைமுகம். Claude Code-இன் /usage-credits கட்டளை சந்தா பயன்பாட்டு credit-களை நிர்வகிக்கிறது, மேலும் நீங்கள் "/login மூலம் உங்கள் claude.ai சந்தாவுடன் உள்நுழைந்த பிறகு இதை இயக்குகிறீர்கள்; இந்தக் கட்டளை API key அங்கீகரிப்புடன் கிடைக்கவில்லை." /usage திரையும் பில்லிங் முறைமையைப் பொறுத்து வேறுபடுகிறது: அதன் அமர்வுத் தொகுதி "API token பயன்பாட்டைக் காட்டுகிறது மற்றும் API பயனர்களுக்காக வடிவமைக்கப்பட்டுள்ளது", அதே சமயம் சந்தாதாரர்கள் திட்டப் பயன்பாட்டுப் பட்டைகள் மற்றும் பயன்பாட்டு உடைப்பைப் பார்க்கிறார்கள்.
Claude Code-இல் நீண்ட prompt cache. இது உண்மையான பணத்தைச் செலவிடுகிறது மற்றும் தவற எளிதானது. ஆவணப்படுத்தல் கூறுகிறது "ஆயுட்காலம் சந்தாவில் ஒரு மணிநேரம், நீங்கள் பயன்பாட்டு credit-களைப் பயன்படுத்தும்போது அது ஐந்து நிமிடங்களாகக் குறைகிறது; API key அல்லது cloud provider-இல், இது இயல்பாகவே ஐந்து நிமிடங்கள்". cache ஆயுட்காலத்தை விட நீண்ட இடைவெளிக்குப் பிறகு உங்கள் முதல் செய்தி cache-ஐத் தவறவிடுகிறது, எனவே உங்கள் முழு context-உம் மறுசெயலாக்கப்பட்டு write விலைகளில் பில் செய்யப்படுகிறது. சந்தாவில் நீங்கள் ஐம்பது நிமிட கூட்டத்திற்குச் சென்று வெப்பமாகத் திரும்பலாம். API key-இல் அதே இடைவெளி அமர்வு prefix-இன் முழு மறு-write செலவினை ஏற்படுத்துகிறது.
சந்தாவிலிருந்து நீங்கள் பெற முடியாதது
நிரல்முறை அணுகல். Claude-ஐ அழைக்கும் ஒரு cron job அல்லது webhook handler-க்கு API key தேவை, எனவே அதுதான் உங்கள் பணிச்சுமையென்றால் ஒப்பீடு முடிந்தது. VPS-இல் உங்கள் முதல் Claude API செயலியை உருவாக்குதல் key கையாளுதல் மற்றும் முதல் வேலை செய்யும் ஸ்கிரிப்டை உள்ளடக்கியது.
Batch API தள்ளுபடி. விலை நிர்ணயப் பக்கம் இதைத் தெளிவாகக் கூறுகிறது: "Batch API உள்ளீடு மற்றும் வெளியீடு token-கள் இரண்டிலும் 50% தள்ளுபடியுடன் அதிக அளவு கோரிக்கைகளின் ஒத்திசைவற்ற செயலாக்கத்தை அனுமதிக்கிறது." ஒரு மனிதர் காத்திருக்காத எந்த வேலைக்கும் இது மீட்டரை பாதியாக்குகிறது. ஒரு மில்லியன் token-களுக்கான Batch விகிதங்கள் Opus 4.8-இல் உள்ளீட்டிற்கு $2.50 மற்றும் வெளியீட்டிற்கு $12.50, அறிமுக விலையில் Sonnet 5-இல் $1 மற்றும் $5, மற்றும் Haiku 4.5-இல் $0.50 மற்றும் $2.50. இதற்குப் பரிமாறியது latency: பெரும்பாலான batch-கள் ஒரு மணிநேரத்திற்குள் முடிகின்றன, 24 மணிநேரத்திற்குள் முடியாத ஒரு batch காலாவதியாகிறது, மேலும் streaming-ஐ batch செய்ய முடியாது. Batch மற்றும் prompt caching ஒன்றாகச் சேர்கின்றன, மேலும் ஒரு batch ஐந்து நிமிடங்களை விட அதிக நேரம் இயங்கக்கூடு என்பதால், அதற்குள் 1-மணிநேர cache-ஐப் பயன்படுத்துங்கள்.
ஒரு திட்டத்திற்கான செலவுப் பொறுப்பு. ஒவ்வொரு API பதிலும் ஒரு usage தொகுதியை வழங்குகிறது, எனவே நீங்கள் ஒரு கோரிக்கையின் செலவைப் பதிவு செய்து அதை ஒரு திட்டம் அல்லது வாடிக்கையாளருக்கு உரியதாக்கலாம். ஒரு சந்தா seat வைத்திருப்பவருக்கு ஒரே ஒரு தொகுதி பட்டைகளை மட்டுமே தெரிவிக்கிறது.
ஒரு விஷயத்தை கவனமாகக் கூறுங்கள், ஏனெனில் இது இரண்டு திசைகளிலும் எளிதாக ஊகிக்கப்படுகிறது: இவை தனித்தனி பில்லிங் மேற்பரப்புகள். Anthropic-இன் ஆவணப்படுத்தல் சந்தா பில்லிங்கை claude.ai support-க்கும் Console பில்லிங்கை API தளத்திற்கும் திருப்புகிறது, மேலும் /usage-credits ஒரு API key-இன் கீழ் வேலை செய்யாது. நான் சரிபார்த்த எதுவும் ஒரு சந்தா API credit-ஐ உள்ளடக்கியது எனக் கூறவில்லை, எனவே இரண்டு கணக்குகள் மற்றும் இரண்டு பில்களைத் திட்டமிடுங்கள்.
சமப்பங்கு-சூத்திரம்
ஒரு முறையை விலை நிர்ணயித்து, பின்னர் அதை அளவிடுங்கள்.
turn cost = uncached_input_tokens x base_input_price
+ cache_write_tokens x 1.25 x base_input_price
+ cache_read_tokens x 0.10 x base_input_price
+ output_tokens x output_price
monthly API cost = turn cost x turns_per_active_day x active_days_per_month
break even when: monthly API cost = flat plan feeபெருக்கிகள் மதிப்பிடப்பட்டவை அல்ல, வெளியிடப்பட்டவை. ஒரு 5-நிமிட cache write "அடிப்படை உள்ளீட்டு விலையின் 1.25x" செலவிடுகிறது, ஒரு 1-மணிநேர write "அடிப்படை உள்ளீட்டு விலையின் 2x" செலவிடுகிறது, மேலும் ஒரு cache read "அடிப்படை உள்ளீட்டு விலையின் 0.1x" செலவிடுகிறது. Thinking token-கள் வெளியீட்டு token-களாக பில் செய்யப்படுகின்றன, எனவே அவை output_tokens-இல் சேர்க்கப்பட வேண்டும், ஒரு பகுத்தறிதல் சுருக்கத்தைக் காட்டாத மாதிரிகளில் கூட.
ஒரு மில்லியன் token-களுக்கான (MTok) அடிப்படை விகிதங்கள், 23 July 2026 நிலவரப்படி தற்போதையது:
claude-fable-5: உள்ளீடு $10, வெளியீடு $50. Cache read $1. 5-நிமிட cache write $12.50. 1M context.claude-opus-4-8மற்றும்claude-opus-4-7: உள்ளீடு $5, வெளியீடு $25. Cache read $0.50. 5-நிமிட cache write $6.25. 1M context.claude-sonnet-5: 31 August 2026 வரை அறிமுக விலையில் உள்ளீடு $2, வெளியீடு $10, பின்னர் $3 மற்றும் $15. அறிமுக விகிதங்களில், cache read $0.20 மற்றும் 5-நிமிட cache write $2.50. 1M context.claude-haiku-4-5: உள்ளீடு $1, வெளியீடு $5. Cache read $0.10. 5-நிமிட cache write $1.25. 200K context.
நீண்ட context-க்கு எந்தக் கூடுதல் கட்டணமும் இல்லை: "ஒரு 900k-token கோரிக்கை 9k-token கோரிக்கையைப் போலவே ஒரு token விகிதத்தில் பில் செய்யப்படுகிறது."
ஒரு வேலை செய்யும் உதாரணம், கருதுகோள்கள் எழுதப்பட்டவை
60,000 token context-ஐத் தாங்கி வரும் Sonnet 5-இல் ஒரு நடு-அமர்வு Claude Code முறையை எடுத்துக்கொள்ளுங்கள்: 55,000 cache-இலிருந்து வழங்கப்பட்டது, 3,000 புதிதாக cache-க்கு எழுதப்பட்டது, 2,000 token புதிய cache செய்யப்படாத உள்ளீடு, மற்றும் thinking உட்பட 1,200 வெளியீட்டு token-கள்.
- Cache read-கள்: 55,000 x $0.20/MTok = $0.0110
- Cache write-கள்: 3,000 x $2.50/MTok = $0.0075
- Cache செய்யப்படாத உள்ளீடு: 2,000 x $2.00/MTok = $0.0040
- வெளியீடு: 1,200 x $10.00/MTok = $0.0120
இது ஒரு முறைக்கு சுமார் $0.035. ஒரு செயலில் உள்ள நாளில் 120 முறை எனில், தோராயமாக ஒரு நாளைக்கு $4.14. ஒரு மாதத்திற்கு 20 செயலில் உள்ள நாட்கள் எனில், தோராயமாக ஒரு மாதத்திற்கு $83.
இதை மேலே உள்ள தட்டையான கட்டணங்களுடன் ஒப்பிடுங்கள், அது ஒரே நேரத்தில் இரண்டையும் கூறுகிறது. இது Pro கட்டணத்தை விட சுமார் நான்கு மடங்கு, எனவே அதன் ஒதுக்கீடு ஒரு நாளைக்கு 120 Sonnet முறைகளைத் தாங்குவது என்ற நிபந்தனையுடன், Pro காகிதத்தில் மலிவானது. அந்த நிபந்தனையை எந்தப் பதிப்பிக்கப்பட்ட எண்ணும் உங்களுக்காகத் தீர்க்காது. அதே $83 உள்ளீட்டு Max கட்டணத்திற்குக் கீழே உள்ளது, எனவே இங்கே மீட்டர் Max-ஐ வெல்கிறது.
இப்போது ஒரு நேரத்தில் ஒரு கருதுகோளை மாற்றுங்கள், மேலும் திட்டக் கட்டணம் தீர்மானிக்கும் எண்ணாக நிற்பதை நிறுத்துவதைப் பாருங்கள்.
திட்ட விலையை விட சமப்பங்கு-எண்ணை மூன்று விஷயங்கள் அதிகமாக நகர்த்துகின்றன
Prompt caching. அதே 60,000-token முறையை caching இல்லாமல் இயக்குங்கள், முழு prompt-ம் புதிய உள்ளீடாக பில் செய்யப்படுகிறது: 60,000 x $2.00/MTok = $0.12, வெளியீட்டில் $0.012, எனவே ஒரு முறைக்கு $0.132. இது cache செய்யப்பட்ட முறையை விட சுமார் நான்கு மடங்கு, மேலும் இது $83 மாதத்தை சுமார் $317 ஆக மாற்றுகிறது. இது Anthropic வெளியிடும் ஒரே சமப்பங்கு-எண், ஏனெனில் இது உங்கள் பணிச்சுமையைச் சார்ந்திருக்காது: "ஒரு cache hit தரப்படுத்தப்பட்ட உள்ளீட்டு விலையின் 10% செலவிடுகிறது, அதாவது 5-நிமிட காலத்திற்கு (1.25x write) ஒரு cache read-க்குப் பிறகு, அல்லது 1-மணிநேர காலத்திற்கு (2x write) இரண்டு cache read-களுக்குப் பிறகு caching லாபகரமானதாகிறது."
இரண்டு தோல்வி முறைகள் உங்களுக்குத் தெரியாமல் caching-ஐ அணைக்கின்றன. முதலாவது மாதிரியின் குறைந்தபட்ச cache செய்யக்கூடிய நீளத்தை விட குறைவான ஒரு prefix: Fable 5-இல் 512 token-கள், Opus 4.8 மற்றும் Sonnet 5-இல் 1,024, Opus 4.7-இல் 2,048, மற்றும் Haiku 4.5-இல் 4,096. குறைவான ஒரு prefix cache செய்யப்படாது, மேலும் எந்தப் பிழையும் எழுப்பப்படாது. இரண்டாவது இணை கோரிக்கைகள், ஏனெனில் "ஒரு cache உள்ளீடு முதல் பதில் தொடங்கிய பிறகு மட்டுமே கிடைக்கிறது." ஒரே நேரத்தில் அனுப்பப்பட்ட பத்து ஒரே மாதிரியான கோரிக்கைகளும் முழு உள்ளீட்டு விலையைச் செலுத்துகின்றன. இரண்டிற்குமான அறிகுறி cache_read_input_tokens பூஜ்யத்தில் இருப்பது.
மாதிரி தேர்வு. அதே முறையை Opus 4.8-இல் விலை நிர்ணயியுங்கள், உள்ளீடு $5 மற்றும் வெளியீடு $25, cache read-கள் $0.50 மற்றும் 5-நிமிட write-கள் ஒரு MTok-க்கு $6.25: read-கள் $0.0275, write-கள் $0.0188, cache செய்யப்படாத உள்ளீடு $0.0100, வெளியீடு $0.0300. இது ஒரு முறைக்கு சுமார் $0.086, Sonnet முறையை விட 2.5 மடங்கு, மேலும் அதே அளவில் ஒரு மாதத்திற்கு சுமார் $207. ஒரு மாதிரி தேர்வு அதே வேலையை உள்ளீட்டு Max கட்டணத்திற்குக் கீழே இருந்து அதன் இருமடங்கிற்கும் மேலாக நகர்த்தியது. $1 மற்றும் $5 கொண்ட Haiku 4.5 பதிவு பகுப்பாய்வு போன்ற இயந்திர வேலைக்கு இதை மறுபுறம் நகர்த்துகிறது.
முயற்சி நிலை மாதிரி தேர்வுடன் சேர்கிறது, ஏனெனில் thinking token-கள் வெளியீட்டு விகிதங்களில் பில் செய்யப்படுகின்றன. Opus 4.8-இல் API இயல்புநிலை high, மேலும் குறியீடு மற்றும் agentic வேலைக்கான ஆவணப்படுத்தப்பட்ட தொடக்கப் புள்ளி கூடுதல் செலவான xhigh. Claude Code-இல் /effort உடன் அல்லது API-இல் output_config.effort உடன் இதைக் குறைக்கவும். பழைய மதிப்பீடுகளை மாற்றும் இன்னொரு விஷயம்: புதிய மாதிரிகள் ஒரு புதிய tokenizer-ஐப் பயன்படுத்துகின்றன அது "அதே உரைக்கு சுமார் 30% அதிக token-களை உருவாக்குகிறது", எனவே பழைய மாதிரியில் அளவிடப்பட்ட எண்ணிக்கை இன்று அதே உரையைக் குறைவாகக் காட்டுகிறது.
அமர்வு தூய்மை. API stateless ஆகும், எனவே ஒவ்வொரு முறையும் முழு உரையாடலையும் பில் செய்யப்பட்ட உள்ளீடாக மீண்டும் அனுப்புகிறது. எனவே ஒரு நீண்ட அமர்வு ஒரு புதிய அமர்வை விட ஒரு செய்திக்கு அதிக செலவாகும், இதுதான் பெரும்பாலான ஆச்சரியமான இன்வாய்ஸ்களுக்குப் பின்னால் உள்ள வியக்கம், மேலும் இது ஒரு Claude Code அமர்வில் உண்மையில் token-களை எது நுகர்கிறது இல் விரிவாக விளக்கப்பட்டுள்ளது. தொடர்பில்லாத பணிகளுக்கு இடையே /clear ஐ இயக்குங்கள், ஏனெனில் பழைய context ஒவ்வொரு பிற்கால செய்தியிலும் மீண்டும் அனுப்பப்பட்டு மீண்டும் பில் செய்யப்படுகிறது. ஒரு நீண்ட பணிக்குள் /compact ஐ இயக்குங்கள், எனவே வரலாறு முழுவதுமாகக் கொண்டு செல்வதற்குப் பதிலாக சுருக்கப்படுகிறது. தொடர்ச்சியான உழைப்பில் வேலை செய்யுங்கள், ஏனெனில் இயல்புநிலை cache "5-நிமிட ஆயுட்காலத்தைக் கொண்டுள்ளது" மற்றும் "cache செய்யப்பட்ட உள்ளடக்கம் ஒவ்வொரு முறை பயன்படுத்தப்படும்போதும் கூடுதல் செலவின்றி புதுப்பிக்கப்படுகிறது". நீங்கள் பத்து நிமிடங்களுக்கு ஒருமுறை தொடும் ஒரு அமர்வு ஒவ்வொரு முறையும் ஒரு மறு-write கட்டணம் செலுத்துகிறது. ஒரு பிரிக்கப்பட்ட VPS-இல் tmux-இல் இயங்கும் Claude Code அமர்வு அது செயலற்றிருக்கும்போது கிட்டத்தட்ட எதையும் செலவிடுவதில்லை, ஆனால் cache ஆயுட்காலத்தை தாண்டி செயலற்றிருப்பது இன்னும் வெப்பமான prefix-ஐ இழக்கிறது.
முடிவெடுப்பதற்கு முன் உங்கள் சொந்த பயன்பாட்டை அளவிடுங்கள்
எனது உதாரணத்திலிருந்து முடிவெடுக்க வேண்டாம். உங்கள் ஒரு வாரத்திலிருந்து முடிவெடுக்கவும்.
Claude Code-இல், ஒரு வாரம் ஒவ்வொரு அமர்வின் முடிவிலும் /usage ஐ இயக்குங்கள் (/cost அதே திரைக்கான ஒரு alias). இது அமர்வின் token எண்ணிக்கைகள் மற்றும் செலவு மதிப்பீட்டைப் புகாரளிக்கிறது, ஆவணப்படுத்தலிலிருந்து ஒரு எச்சரிக்கையுடன்: "டாலர் எண் என்பது token எண்ணிக்கைகளிலிருந்து உள்ளூர் கணினியில் கணக்கிடப்பட்ட ஒரு மதிப்பீடு மற்றும் உங்கள் உண்மையான பில்லிலிருந்து வேறுபடலாம்." நீங்கள் /clear ஐ இயக்கும்போது மொத்தங்கள் மீட்டமைக்கப்படுகின்றன, எனவே முதலில் திரையைப் படியுங்கள். ஒரு சந்தாவில் அந்த டாலர் எண் உங்கள் பில் அல்ல, ஆனால் அதற்குப் பின்னால் உள்ள token எண்ணிக்கைகளே இந்தச் சூத்திரத்திற்குத் தேவையானவை. /context சாளரத்தை நிரப்புவது என்ன என்பதைக் காட்டுகிறது.
ஒரு API கணக்கில், Claude Console-இல் உள்ள பயன்பாட்டுப் பக்கமே அதிகாரப்பூர்வ பதிவு. நீங்கள் அனுப்புவதற்கு முன் ஒரு prompt-ஐ விலை நிர்ணயிக்க, client.messages.count_tokens() "பயன்படுத்த இலவசம், ஆனால் உங்கள் பயன்பாட்டு அடுக்கை அடிப்படையாகக் கொண்டு நிமிடத்திற்கான கோரிக்கை விகித வரம்புகளுக்கு உட்பட்டது", மேலும் இதுதான் நீங்கள் உண்மையில் பில் செய்யப்படும் tokenizer-ஐப் பயன்படுத்தும் ஒரே எண்ணிக்கை.
ஒரு அழைப்பிற்குப் பிறகு, பயன்பாட்டுத் தொகுதியைப் படியுங்கள், மேலும் அதைச் சரியாகப் படியுங்கள்:
u = response.usage
total_input = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokensinput_tokens cache செய்யப்படாத மீதியை மட்டுமே எண்ணுகிறது, "கடைசி cache breakpoint-க்குப் பிறகான token-கள்" என ஆவணப்படுத்தப்பட்டுள்ளது. ஒரு முறை input_tokens: 4000 எனப் புகாரளிப்பது ஒரு 4,000-token முறை அல்ல, மேலும் மூன்று புலங்களையும் ஒன்றாகச் சேர்ப்பதுதான் இந்தச் சூத்திரம் விரும்பும் prompt அளவு.
பின்னர் ஒப்பிடுங்கள். உங்கள் அளவிடப்பட்ட மாதம் திட்டக் கட்டணத்திற்கு தெளிவாகக் கீழே இருந்தால், மீட்டரை எடுத்துக்கொள்ளுங்கள். இது தெளிவாக மேலே இருந்தால், திட்டத்தை எடுத்துக்கொள்ளுங்கள், அதன் ஒதுக்கீடு உங்களுக்கான ஒரு இயல்பான வேலை நாளைத் தாங்குவதாக இருந்தால். இது கோட்டிற்கு அருகில் இருந்தால், திட்டத்தை எடுத்துக்கொள்ளுங்கள், ஏனெனில் ஒரு திட்டம் உங்களை ஆச்சரியப்படுத்த முடியாது, ஆனால் ஒரு மீட்டர் முடியும்.
FAQ
Claude API ஆனது Claude Pro அல்லது Max-ஐ விட மலிவானதா?
இது அளவைப் பொறுத்தது, மேலும் பார்க்க எந்தப் பதிப்பிக்கப்பட்ட சமப்பங்கு-எண்ணும் இல்லை, ஏனெனில் சந்தாக்கள் token ஒதுக்கீடுகளை விட பயன்பாட்டுச் சாளரங்களாக விற்கப்படுகின்றன. பதிப்பிக்கப்பட்ட ஒரு token விகிதங்களிலிருந்து ஒரு வழக்கமான முறையை விலை நிர்ணயியுங்கள், உங்கள் ஒரு செயலில் உள்ள நாளைக்கான முறைகள் மற்றும் ஒரு மாதத்திற்கான செயலில் உள்ள நாட்களால் பெருக்கவும், பின்னர் அந்த எண்ணை திட்டக் கட்டணத்துடன் ஒப்பிடவும். ஒரு வேலை செய்யும் உதாரணத்தில், ஒரு 60,000-token Sonnet 5 முறை சுமார் $0.035 ஆக வந்தது, அல்லது 20 நாட்களில் ஒரு நாளைக்கு 120 முறை எனில் தோராயமாக ஒரு மாதத்திற்கு $83: Pro கட்டணத்திற்கு மேலே, உள்ளீட்டு Max கட்டணத்திற்குக் கீழே.
ஒரு மாதத்திற்கான எனது Claude API செலவை நான் எப்படிக் கணக்கிடுவது?
உண்மையான token எண்ணிக்கைகளைச் சேகரிக்க ஒரு வாரம் Claude Code-இல் /usage ஐ இயக்கவும், அல்லது நீங்கள் ஏற்கனவே ஒரு API கணக்கை வைத்திருந்தால் Claude Console-இல் உள்ள பயன்பாட்டுப் பக்கத்தைப் படிக்கவும். பின்னர் ஒரு முறையை விலை நிர்ணயியுங்கள்: அடிப்படை விகிதத்தில் cache செய்யப்படாத உள்ளீடு, அடிப்படை உள்ளீட்டின் 1.25 மடங்கில் cache write-கள், அடிப்படை உள்ளீட்டின் 0.1 மடங்கில் cache read-கள், மற்றும் வெளியீட்டு விகிதத்தில் வெளியீடு, thinking token-களை வெளியீடாகக் கணக்கிடவும். ஒரு செயலில் உள்ள நாளைக்கான முறைகள் மற்றும் ஒரு மாதத்திற்கான செயலில் உள்ள நாட்களால் பெருக்கவும்.
ஒரு Claude API பில்லை எது மிக அதிகமாக மாற்றுகிறது?
Prompt caching, வேறெதை விடவும். Sonnet 5-இல் ஒரு 60,000-token முறை prefix cache-இலிருந்து வழங்கப்படும்போது சுமார் $0.035 மற்றும் இல்லையெனில் சுமார் $0.132 செலவாகும். மாதிரி தேர்வு அடுத்ததாக வருகிறது: Opus 4.8-இல் அதே முறை சுமார் $0.086 செலவாகும். அமர்வு நீளம் மூன்றாவதாக வருகிறது, ஏனெனில் API stateless ஆகும் மற்றும் ஒவ்வொரு முறையும் முழு உரையாடலையும் பில் செய்யப்பட்ட உள்ளீடாக மீண்டும் அனுப்புகிறது.
ஒரு Claude சந்தா API அணுகலை உள்ளடக்கியதா?
அவற்றை இரண்டு பில்களுடன் இரண்டு கணக்குகளாகக் கருதுங்கள். API அழைப்புகள் Console-இல் நீங்கள் உருவாக்கும் ஒரு கணக்கிற்கு எதிராக ஒரு token க்கு பில் செய்யப்படுகின்றன, மேலும் நான் சரிபார்த்த ஆவணப்படுத்தலில் எதுவும் ஒரு சந்தா API credit-ஐ வழங்குகிறது எனக் கூறவில்லை. அவை தனித்தனி மேற்பரப்புகள் என்பதற்கான தெளிவான அறிகுறி Claude Code-இன் /usage-credits கட்டளை, அது "API key அங்கீகரிப்புடன் கிடைக்கவில்லை". பல டெவலப்பர்கள் இரண்டையும் வைத்திருக்கிறார்கள்: ஊடாடும் குறியீட்டிற்காக ஒரு திட்டம், அவர்கள் உருவாக்கும் விஷயங்களுக்காக ஒரு key.