SSD Nodes Learn Hosting plans →
கல்வி வழிகாட்டிகள் Matt Connorஆல் Matt Connor · புதுப்பிக்கப்பட்டது 2026-08-26

Claude API சந்தா முறையை விட மலிவானதா? கணக்கீடு இதோ

Claude API பயன்பாட்டிற்கான கட்டண முறைகளை ஒப்பிடுகிறோம். மாத சந்தா மற்றும் டோக்கன் அடிப்படையிலான API செலவுகளில் எது உங்களுக்கு லாபகரமானது என்பதைக் கண்டறிய உதவும் எளிய கணித விளக்கம்.

Claude API சந்தாவை விட மலிவானதா?

குறிப்பிட்ட பயன்பாட்டு அளவிற்கு கீழே Claude API சந்தாவை விட மலிவானது, ஆனால் அந்த அளவைத் தாண்டும்போது அது அதிக செலவை ஏற்படுத்தும். நாள் முழுவதும் ஊடாடும் முறையில் (interactively) குறியீட்டு முறை (coding) செய்யும் ஒரு டெவலப்பருக்கு, நிலையான கட்டணத் திட்டம் (flat plan) பொதுவாகச் சிறந்தது. தானாகவே அழைப்புகளை (calls) மேற்கொள்ளும் ஒரு நிரலுக்கு, API மட்டுமே ஒரே வழி என்பதால், செலவு இங்கு முடிவெடுக்கும் காரணியாக இருக்காது. மீதமுள்ளவை பத்து நிமிடங்களில் கணக்கிடக்கூடிய எளிய கணிதமே.

இதற்கென அதிகாரப்பூர்வமான சமநிலை புள்ளி (break-even number) எதுவும் இல்லை. சந்தா முறை என்பது டோக்கன் ஒதுக்கீட்டிற்குப் பதிலாக பயன்பாட்டு கால அளவுகளாக (usage windows) விற்கப்படுகிறது, எனவே எந்தவொரு வெளியிடப்பட்ட புள்ளிவிவரமும் இரண்டு கட்டணங்களும் எங்கு இணைகின்றன என்பதைத் துல்லியமாகக் கூற முடியாது. தற்போதைய டோக்கன் கட்டணங்களின் அடிப்படையில் கணக்கிடப்பட்ட சூத்திரம் மற்றும் உங்கள் பயன்பாட்டு முறைகள் கீழே கொடுக்கப்பட்டுள்ளன. கீழே உள்ள ஒவ்வொரு சமநிலை புள்ளிவிவரமும் வெளியிடப்பட்ட கட்டணங்கள் மற்றும் அனுமானங்களின் அடிப்படையில் நான் செய்த கணக்கீடே தவிர, இது ஒரு ஆவணப்படுத்தப்பட்ட எண் அல்ல.

நீங்கள் எந்தத் திட்டத்தை வாங்க வேண்டும் என்று இன்னும் முடிவெடுக்கவில்லை என்றால், உங்கள் பணிக்கு எந்த Claude திட்டம் பொருத்தமானது என்ற கட்டுரை அதற்குப் பதிலளிக்கும். இந்தக் கட்டுரை, நீங்கள் எந்தத் திட்டத்தை வாங்கப் போகிறீர்கள் என்பது உங்களுக்குத் தெரியும் என்றும், அதை வாங்குவதா வேண்டாமா என்பதை மட்டுமே அறிய விரும்புகிறீர்கள் என்றும் கருதுகிறது.

வெவ்வேறு வடிவங்களைக் கொண்ட இரண்டு கட்டண மாதிரிகள்

சந்தா (Subscription) என்பது நீங்கள் பயன்படுத்தாதிருக்கக்கூடிய ஒரு திறன் (capacity). நீங்கள் ஒரு நிலையான கட்டணத்தைச் செலுத்துகிறீர்கள், குறிப்பிட்ட கால இடைவெளியில் புதுப்பிக்கப்படும் ஒரு ஒதுக்கீட்டைப் (allowance) பெறுகிறீர்கள். Anthropic-ன் Claude Code ஆவணங்கள் Team மற்றும் Enterprise இருக்கைகளுக்கான (seats) வடிவத்தைக் குறிப்பிடுகின்றன: பயன்பாடு என்பது "ஐந்து மணிநேர சுழற்சி மற்றும் வாராந்திர கால இடைவெளியில் புதுப்பிக்கப்படும் ஒரு நபர் சார்ந்த ஒதுக்கீட்டிலிருந்து கழிக்கப்படுகிறது", இது Claude chat மற்றும் Cowork ஆகியவற்றுடன் பகிரப்படுகிறது. ஒரு சந்தாதாரர் அதே வடிவத்தை அவர்கள் சந்திக்கும் செய்திகள் மூலம் எதிர்கொள்கிறார், அவை "You've hit your session limit" மற்றும் "You've hit your weekly limit" என்று காட்டுகின்றன. நீங்கள் பயன்படுத்தாத திறன் என்பது நீங்கள் ஏற்கனவே செலவழித்த பணமாகும். நீங்கள் மீறும் திறன், அந்த கால இடைவெளி முடியும் வரை உங்கள் பணியை நிறுத்திவிடும், மேலும் /model மூலம் மாதிரியை மாற்றினாலும் அணுகல் மீண்டும் கிடைக்காது, ஏனெனில் அந்த கால இடைவெளிகள் அனைத்து மாதிரிகளுக்கும் பொதுவானவை. நீங்கள் இப்போது அந்தச் செய்திகளில் ஒன்றைப் பார்த்துக் கொண்டிருந்தால், எந்த கால இடைவெளிக்காகக் காத்திருக்கிறீர்கள் என்பதைக் கண்டறிவது இந்த கணக்கீடுகளுக்கு முன்னதாகவே செய்யப்பட வேண்டும், ஏனெனில் ஐந்து மணிநேர மற்றும் வாராந்திர தடைகள் வெவ்வேறு பதில்களைக் கோருகின்றன.

API என்பது ஒருபோதும் நிற்காத ஒரு மீட்டர். இதில் கால இடைவெளியோ அல்லது தடைகளோ இல்லை. ஒவ்வொரு கோரிக்கையும் (request) டோக்கன் அடிப்படையில் விலை நிர்ணயிக்கப்படுகிறது, மேலும் சில விஷயங்கள் டோக்கன்களுக்கு வெளியே விலை நிர்ணயிக்கப்படுகின்றன: இணையத் தேடல் "Claude API-ல் 1,000 தேடல்களுக்கு $10 என்ற விலையில் கிடைக்கிறது". எந்தவொரு வரம்பிலும் எதுவும் நின்றுவிடாது. விலைப்பட்டியல் (invoice) தொடர்ந்து அதிகரித்துக்கொண்டே இருக்கும். இதற்கு கீழே இலவச அடுக்கு (free tier) எதுவும் இல்லை, இருப்பினும் பதிவு செய்ததற்கான கடன் மற்றும் கட்டணமில்லா பகுதிகள் இந்த கணக்கீடுகள் முக்கியத்துவம் பெறுவதற்கு முன்பே ஒரு முதல் பரிசோதனையைச் செய்ய உதவும்.

23 July 2026 நிலவரப்படி திட்டக் கட்டணங்கள், Claude விலை நிர்ணயப் பக்கத்திலிருந்து மேற்கோள் காட்டப்பட்டுள்ளன: Pro என்பது "ஆண்டு சந்தா தள்ளுபடியுடன் மாதம் $17 (முன்கூட்டியே $200 வசூலிக்கப்படும்). மாதந்தோறும் கட்டணம் செலுத்தினால் $20", இதில் Claude Code அடங்கும். Max என்பது "மாதம் $100-லிருந்து" என்று பட்டியலிடப்பட்டுள்ளது. Team இருக்கைகள் "ஆண்டுதோறும் கட்டணம் செலுத்தினால் ஒரு இருக்கைக்கு மாதம் $20" என்ற விலையில் தொடங்குகின்றன. Enterprise என்பது சுவாரஸ்யமானது, ஏனெனில் இது இரண்டு மாதிரிகளையும் ஒரே நேரத்தில் இயக்குகிறது: "இருக்கை விலை + API கட்டணத்தில் பயன்பாடு $20/இருக்கை". நீங்கள் இந்த கலப்பு மாதிரியை ஒப்பிட்டுப் பார்க்கிறீர்கள் என்றால், Enterprise இருக்கைக் கட்டணம் உண்மையில் எதை உள்ளடக்கியது என்பது இருக்கைக்கான குறைந்தபட்ச கட்டணங்கள் மற்றும் பேச்சுவார்த்தை மூலம் பெறப்பட்ட மேற்கோளில் மட்டுமே வரும் பகுதிகளை விளக்குகிறது. நீங்கள் Claude முழுவதையும் விட, குறிப்பாக கோடிங் கருவியின் விலையை மட்டும் கணக்கிடுகிறீர்கள் என்றால், ஒவ்வொரு திட்டத்திலும் Claude Code-ன் விலை அந்த கட்டணங்களை ஒரு மாத மதிப்பீட்டுடன் ஒப்பிடுகிறது. இந்த ஒப்பீட்டின் நிலையான பக்கம் இன்னும் Claude-ல் முடிவாகவில்லை என்றால், ChatGPT-ன் Go, Plus மற்றும் Pro ஆகியவற்றுடன் இந்த அடுக்குகளின் விலை ஒப்பீடு அந்த முடிவின் மறுபாதியாகும். கட்டணங்கள் அடிக்கடி மாறுகின்றன, மேலும் ஒவ்வொன்றின் பின்னால் உள்ள ஒதுக்கீடு டோக்கன்களில் வெளியிடப்படுவதில்லை, எனவே நீங்கள் முடிவெடுக்கும் நாளில் விலை நிர்ணயப் பக்கத்தைப் படிக்கவும்.

API மூலம் பெற முடியாதவை

திட்ட ஒதுக்கீடு (Plan allowance) மற்றும் அதைச் சுற்றியுள்ள இடைமுகம். Claude Code-ன் /usage-credits கட்டளை சந்தா பயன்பாட்டு வரவுகளை (subscription usage credits) நிர்வகிக்கிறது. நீங்கள் "/login வழியாக உங்கள் claude.ai சந்தாவில் உள்நுழைந்த பிறகு" இதை இயக்க வேண்டும்; API key அங்கீகாரத்தில் இந்தக் கட்டளை கிடைக்காது. /usage திரையும் பில்லிங் முறையைப் பொறுத்து மாறுபடும்: அதன் Session பகுதி "API token பயன்பாட்டைக் காட்டுகிறது மற்றும் இது API பயனர்களுக்காக உருவாக்கப்பட்டது", ஆனால் சந்தாதாரர்கள் திட்டப் பயன்பாட்டுப் பட்டைகளையும் (usage bars) பயன்பாட்டு விவரங்களையும் காண்பார்கள்.

Claude Code-ல் நீண்ட prompt cache. இது உண்மையான பணச் செலவை உள்ளடக்கியது மற்றும் கவனிக்கத் தவறுவது எளிது. ஆவணங்களின்படி, "சந்தாவில் இதன் ஆயுட்காலம் ஒரு மணிநேரம், ஆனால் பயன்பாட்டு வரவுகளைப் பயன்படுத்தத் தொடங்கினால் அது ஐந்து நிமிடங்களாகக் குறையும்; API key அல்லது cloud provider-ல், இது இயல்பாகவே ஐந்து நிமிடங்கள்". cache ஆயுட்காலத்தை விட நீண்ட இடைவெளிக்குப் பிறகு நீங்கள் அனுப்பும் முதல் செய்தி cache-ஐத் தவறவிடும், எனவே உங்கள் முழு சூழலும் (context) மீண்டும் செயலாக்கப்பட்டு, எழுதும் விலையின் (write prices) அடிப்படையில் கட்டணம் வசூலிக்கப்படும். சந்தாவில் இருந்தால், நீங்கள் ஐம்பது நிமிடக் கூட்டம் முடித்துத் திரும்பும்போது cache இன்னும் செயல்பாட்டில் இருக்கும். API key-ல் அதே இடைவெளி, session prefix-ஐ முழுமையாக மீண்டும் எழுத வேண்டிய செலவை ஏற்படுத்தும்.

சந்தா மூலம் பெற முடியாதவை

Programmatic access. Claude-ஐ அழைக்கும் ஒரு cron job அல்லது webhook handler-க்கு API key தேவை. எனவே, உங்கள் பணிமுறை இதுவாக இருந்தால், ஒப்பீடு இத்துடன் முடிவடைகிறது. VPS-ல் உங்கள் முதல் Claude API செயலியை உருவாக்குதல் என்ற பகுதி, key கையாளுதல் மற்றும் முதல் செயல்பாட்டு script-ஐ விளக்குகிறது.

Batch API தள்ளுபடி. விலை நிர்ணயப் பக்கம் இதைத் தெளிவாகக் குறிப்பிடுகிறது: "Batch API மூலம் அதிக அளவிலான கோரிக்கைகளை asynchronous முறையில் செயலாக்க முடியும், இதற்கு input மற்றும் output tokens இரண்டிலும் 50% தள்ளுபடி உண்டு." மனிதர்கள் காத்திருக்கத் தேவையில்லாத எந்தவொரு பணிக்கும் இது கட்டணத்தை பாதியாகக் குறைக்கும். Opus 4.8-ல் ஒரு மில்லியன் tokens-க்கான Batch கட்டணம் input-க்கு $2.50 மற்றும் output-க்கு $12.50 ஆகும். Sonnet 5-ன் அறிமுக விலையில் இது $1 மற்றும் $5, Haiku 4.5-ல் $0.50 மற்றும் $2.50 ஆகும். இதில் உள்ள சமரசம் latency ஆகும்: பெரும்பாலான batches ஒரு மணி நேரத்திற்குள் முடிந்துவிடும், 24 மணி நேரத்திற்குள் முடியாத batch காலாவதியாகிவிடும், மேலும் streaming-ஐ batch செய்ய முடியாது. Batch மற்றும் prompt caching ஆகியவற்றை இணைத்துப் பயன்படுத்தலாம். ஒரு batch ஐந்து நிமிடங்களுக்கு மேல் இயங்கக்கூடியது என்பதால், அதற்குள் 1-மணிநேர cache-ஐப் பயன்படுத்தவும்.

Per-project செலவு ஒதுக்கீடு. ஒவ்வொரு API response-உம் ஒரு usage தொகுதியைத் தருகிறது. எனவே, ஒரு கோரிக்கையின் செலவை நீங்கள் log செய்து, அதை ஒரு குறிப்பிட்ட project அல்லது வாடிக்கையாளருடன் இணைக்க முடியும். சந்தா முறை, அந்த இருக்கையை வைத்திருப்பவருக்கான ஒட்டுமொத்த பயன்பாட்டு வரைபடத்தை மட்டுமே காட்டுகிறது.

ஒரு விஷயத்தை கவனமாகத் தெரிந்துகொள்ளுங்கள், ஏனெனில் இதில் குழப்பம் ஏற்பட வாய்ப்புள்ளது: இவை இரண்டும் தனித்தனி கட்டண முறைகள். Anthropic-ன் ஆவணங்கள் சந்தா கட்டணத்தை claude.ai ஆதரவுக்கும், Console கட்டணத்தை API தளத்திற்கும் பிரிக்கின்றன. மேலும், /usage-credits என்பது API key மூலம் இயங்காது. சந்தாவில் API credit உள்ளடங்கியிருக்கும் என்று எங்கும் குறிப்பிடப்படவில்லை, எனவே இரண்டு தனித்தனி கணக்குகளையும் இரண்டு தனித்தனி கட்டணங்களையும் திட்டமிடுங்கள்.

Break-even சூத்திரம்

ஒரு முறை விலையை கணக்கிட்டு, அதற்கேற்ப அளவிடவும்.

turn cost = uncached_input_tokens x base_input_price
          + cache_write_tokens    x 1.25 x base_input_price
          + cache_read_tokens     x 0.10 x base_input_price
          + output_tokens         x output_price

monthly API cost = turn cost x turns_per_active_day x active_days_per_month

break even when: monthly API cost = flat plan fee

பெருக்கிகள் (multipliers) மதிப்பிடப்பட்டவை அல்ல, அவை அதிகாரப்பூர்வமாக வெளியிடப்பட்டவை. 5-நிமிட cache write-க்கு "அடிப்படை உள்ளீட்டு விலையில் 1.25 மடங்கு", 1-மணிநேர write-க்கு "அடிப்படை உள்ளீட்டு விலையில் 2 மடங்கு" மற்றும் cache read-க்கு "அடிப்படை உள்ளீட்டு விலையில் 0.1 மடங்கு" கட்டணம் வசூலிக்கப்படுகிறது. Thinking tokens-கள் output tokens-களாகவே கணக்கிடப்படுகின்றன, எனவே reasoning summary-ஐக் காட்டாத மாதிரிகளில் கூட அவை output_tokens-ல் அடங்கும்.

ஒரு மில்லியன் tokens-க்கான (MTok) அடிப்படை கட்டணங்கள், 23 ஜூலை 2026 நிலவரப்படி:

  • claude-fable-5: $10 உள்ளீடு, $50 வெளியீடு. Cache read $1. 5-நிமிட cache write $12.50. 1M context.
  • claude-opus-4-8 மற்றும் claude-opus-4-7: $5 உள்ளீடு, $25 வெளியீடு. Cache read $0.50. 5-நிமிட cache write $6.25. 1M context.
  • claude-sonnet-5: 31 ஆகஸ்ட் 2026 வரை அறிமுக விலையாக $2 உள்ளீடு, $10 வெளியீடு, அதன் பிறகு $3 மற்றும் $15. அறிமுக விலையில், cache read $0.20 மற்றும் 5-நிமிட cache write $2.50. 1M context.
  • claude-haiku-4-5: $1 உள்ளீடு, $5 வெளியீடு. Cache read $0.10. 5-நிமிட cache write $1.25. 200K context.

நீண்ட context-க்கு கூடுதல் கட்டணம் ஏதுமில்லை: "900k-token கோரிக்கையானது 9k-token கோரிக்கைக்கு வசூலிக்கப்படும் அதே token விகிதத்திலேயே கணக்கிடப்படுகிறது."

செயல்முறை உதாரணம், அனுமானங்களுடன்

Sonnet 5-ல் 60,000 tokens சூழல் (context) கொண்ட ஒரு Claude Code அமர்வை எடுத்துக்கொள்வோம்: 55,000 tokens cache-லிருந்து பெறப்பட்டது, 3,000 tokens புதிதாக cache-ல் எழுதப்பட்டது, 2,000 tokens புதிய uncached உள்ளீடு, மற்றும் 1,200 tokens வெளியீடு (சிந்தனை உள்ளடக்கியது).

  • Cache reads: 55,000 x $0.20/MTok = $0.0110
  • Cache writes: 3,000 x $2.50/MTok = $0.0075
  • Uncached input: 2,000 x $2.00/MTok = $0.0040
  • Output: 1,200 x $10.00/MTok = $0.0120

இது ஒரு முறைக்கு (turn) சுமார் $0.035 ஆகும். ஒரு சுறுசுறுப்பான நாளில் 120 முறைகள் பயன்படுத்தினால், தோராயமாக ஒரு நாளைக்கு $4.14. மாதத்திற்கு 20 சுறுசுறுப்பான நாட்கள் எனில், தோராயமாக மாதத்திற்கு $83.

இதை மேலே உள்ள நிலையான கட்டணங்களுடன் ஒப்பிடும்போது, இரண்டு விஷயங்கள் தெளிவாகின்றன. இது Pro கட்டணத்தை விட நான்கு மடங்கு அதிகம், எனவே Pro-வின் ஒதுக்கீடு ஒரு நாளைக்கு 120 Sonnet முறைகளை உள்ளடக்கும் பட்சத்தில், காகித அளவில் Pro மலிவானது. அந்த நிபந்தனை என்ன என்பதை எந்த அதிகாரப்பூர்வ எண்ணாலும் உறுதிப்படுத்த முடியாது. இதற்கான விடைக்கு மிக நெருக்கமான வழி Pro எதை உள்ளடக்கியது மற்றும் அதன் வரம்புகள் எங்கே முடிகின்றன என்பதை உற்று நோக்குவது ஆகும். மலிவான கட்டணமே சிறந்தது என்று கருதுவதற்கு முன் இதைப் படிப்பது அவசியம். அதே $83 என்பது ஆரம்பநிலை Max கட்டணத்தை விடக் குறைவு, எனவே இங்கே பயன்பாட்டு அடிப்படையிலான கட்டணம் (meter) Max-ஐ விடச் சிறந்தது. அந்த கடைசி வாக்கியத்தில் 'ஆரம்பநிலை' (entry) என்ற சொல் முக்கியமானது, ஏனெனில் Max இரண்டு விலைகளில் விற்கப்படுகிறது, மேலும் நீங்கள் உண்மையில் எந்த Max நிலையை வாங்குவீர்கள் என்பது நீங்கள் ஒப்பிடும் அளவுகோலை மாதத்திற்கு $100 வரை மாற்றும்.

இப்போது ஒவ்வொரு அனுமானத்தையும் ஒவ்வொன்றாக மாற்றிப் பாருங்கள், திட்டக் கட்டணம் மட்டுமே முடிவெடுக்கும் காரணியாக இருக்காது என்பதை உணர்வீர்கள்.

திட்ட விலையை விட break-even புள்ளியை மாற்றும் மூன்று காரணிகள்

Prompt caching. 60,000-token கொண்ட ஒரு உரையாடலை caching இல்லாமல் இயக்கினால், முழு prompt-ம் புதிய input-ஆகக் கணக்கிடப்படும்: 60,000 x $2.00/MTok = $0.12, அதனுடன் $0.012 output கட்டணம் சேர்ந்து, ஒரு முறைக்கு $0.132 செலவாகும். இது cached முறையில் நடக்கும் செலவை விட நான்கு மடங்கு அதிகம்; இதனால் மாதத்திற்கு $83 ஆக இருக்க வேண்டிய செலவு சுமார் $317 ஆக உயரும். Anthropic நிறுவனம் வெளியிடும் ஒரே break-even கணக்கீடு இதுதான், ஏனெனில் இது உங்கள் workload-ஐச் சார்ந்தது அல்ல: "ஒரு cache hit என்பது சாதாரண input விலையில் 10% மட்டுமே. அதாவது, 5-நிமிட காலாவதிக்கு (1.25x write) ஒருமுறை cache-ஐப் படித்தாலே லாபம் கிடைத்துவிடும்; 1-மணிநேர காலாவதிக்கு (2x write) இரண்டு முறை படித்தால் லாபம் கிடைக்கும்."

இரண்டு வகையான தோல்விகள் உங்களுக்குத் தெரியாமலேயே caching-ஐ முடக்கிவிடும். முதலாவது, model-ன் குறைந்தபட்ச cacheable அளவை விடக் குறைவான prefix: Fable 5-க்கு 512 tokens, Opus 4.8 மற்றும் Sonnet 5-க்கு 1,024 tokens, Opus 4.7-க்கு 2,048 tokens, மற்றும் Haiku 4.5-க்கு 4,096 tokens. prefix குறைவாக இருந்தால் cache ஆகாது, ஆனால் எந்த error-ம் காட்டப்படாது. இரண்டாவது, ஒரே நேரத்தில் அனுப்பப்படும் parallel requests, ஏனெனில் "முதல் response தொடங்கிய பிறகுதான் cache entry கிடைக்கும்." ஒரே நேரத்தில் அனுப்பப்படும் பத்து ஒரே மாதிரியான requests-க்கும் முழு input கட்டணம் வசூலிக்கப்படும். இவை இரண்டையும் கண்டறிய cache_read_input_tokens பூஜ்ஜியத்தில் உள்ளதா என்று பார்க்கவும்.

Model தேர்வு. Opus 4.8-ல் அதே உரையாடலை இயக்கினால், input $5 மற்றும் output $25, cache reads $0.50, 5-நிமிட writes $6.25/MTok என கணக்கிடப்படும்: reads $0.0275, writes $0.0188, uncached input $0.0100, output $0.0300. இது ஒரு முறைக்கு $0.086 செலவாகும், இது Sonnet-ஐ விட 2.5 மடங்கு அதிகம், அதே அளவில் பயன்படுத்தினால் மாதத்திற்கு சுமார் $207 செலவாகும். ஒரே ஒரு model மாற்றத்தால், செலவு வரம்பிற்குள் இருந்த வேலை, வரம்பை விட இரண்டு மடங்கு அதிகமாக உயர்ந்துவிட்டது. log triage போன்ற இயந்திரத்தனமான வேலைகளுக்கு $1 மற்றும் $5 விலையுள்ள Haiku 4.5-ஐப் பயன்படுத்தினால் செலவு குறையும். Fable 5-ல் input $10 மற்றும் output $50 என விலை அதிகம் என்பதால், எந்த வேலைகளுக்கு Fable 5-ன் கட்டணம் நியாயமானது என்பதைப் படித்துவிட்டு, அதை default model-ஆகத் தேர்வு செய்யவும்.

Effort level என்பது model தேர்வுடன் தொடர்புடையது, ஏனெனில் thinking tokens output விலையிலேயே கணக்கிடப்படும். Opus 4.8-ல் API default high ஆக உள்ளது, coding மற்றும் agentic வேலைகளுக்கு பரிந்துரைக்கப்படும் தொடக்க நிலை xhigh ஆகும். Claude Code-ல் /effort மூலமாகவோ அல்லது API-ல் output_config.effort மூலமாகவோ இதை மாற்றலாம். பழைய மதிப்பீடுகளை மாற்றும் மற்றொரு விஷயம்: புதிய models புதிய tokenizer-ஐப் பயன்படுத்துகின்றன, இது "ஒரே உரைக்கு சுமார் 30% கூடுதல் tokens-ஐ உருவாக்குகிறது", எனவே பழைய model-ல் கணக்கிடப்பட்ட அளவு இன்றைய உரையை விடக் குறைவாகவே இருக்கும்.

Session hygiene. API-க்கு state கிடையாது, எனவே ஒவ்வொரு முறையும் முழு உரையாடலும் input-ஆக மீண்டும் அனுப்பப்பட்டு கட்டணம் வசூலிக்கப்படும். இதனால் நீண்ட session-களில் ஒவ்வொரு message-க்கும் செலவு அதிகமாகும். இதுவே எதிர்பாராத கட்டண உயர்வுக்கு முக்கிய காரணம். இது Claude Code session-ல் tokens எதனால் செலவாகிறது என்பதில் விரிவாக விளக்கப்பட்டுள்ளது. தொடர்பில்லாத வேலைகளுக்கு இடையே /clear-ஐ இயக்கவும், ஏனெனில் பழைய context ஒவ்வொரு முறையும் மீண்டும் அனுப்பப்பட்டு கட்டணம் வசூலிக்கப்படும். ஒரு நீண்ட வேலையின் போது /compact-ஐ இயக்கவும், இதனால் வரலாறு முழுமையாக அனுப்பப்படாமல் சுருக்கப்படும். தொடர்ச்சியாக வேலை செய்யவும், ஏனெனில் default cache "5-நிமிட காலாவதி கொண்டது" மற்றும் "cached content பயன்படுத்தப்படும் ஒவ்வொரு முறையும் கூடுதல் கட்டணமின்றி புதுப்பிக்கப்படும்". நீங்கள் பத்து நிமிடத்திற்கு ஒருமுறை session-ஐத் தொட்டால், ஒவ்வொரு முறையும் re-write கட்டணம் வசூலிக்கப்படும். VPS-ல் tmux-ல் இயங்கும் Claude Code session சும்மா இருக்கும்போது எதையும் செலவு செய்யாது, ஆனால் cache காலாவதியான பிறகு warm prefix இழக்கப்படும்.

முடிவெடுக்கும் முன் உங்கள் பயன்பாட்டை அளவிடுங்கள்

எனது உதாரணத்தை வைத்து முடிவெடுக்க வேண்டாம். உங்கள் ஒரு வார கால பயன்பாட்டை வைத்து முடிவெடுங்கள்.

Claude Code-ல், ஒரு வாரத்திற்கு ஒவ்வொரு அமர்வின் முடிவிலும் /usage கட்டளையை இயக்கவும் (/cost என்பது அதே திரையைக் காட்டும் மாற்றுப் பெயர்). இது அந்த அமர்வின் token எண்ணிக்கையையும், தோராயமான கட்டண மதிப்பீட்டையும் வழங்கும். ஆவணத்தில் உள்ள ஒரு எச்சரிக்கையை கவனத்தில் கொள்ளவும்: "இந்த டாலர் மதிப்பு token எண்ணிக்கையிலிருந்து உள்ளூர் கணக்கீடு மூலம் பெறப்பட்டது, இது உங்கள் உண்மையான கட்டணத்திலிருந்து மாறுபடலாம்." நீங்கள் /clear கட்டளையை இயக்கும்போது மொத்த எண்ணிக்கை மீட்டமைக்கப்படும், எனவே முதலில் திரையில் உள்ளதைப் படித்துக்கொள்ளவும். சந்தா முறையில் இந்த டாலர் மதிப்பு உங்கள் கட்டணம் அல்ல, ஆனால் இந்த சூத்திரத்திற்குத் தேவையான token எண்ணிக்கை அதில்தான் உள்ளது. /context கட்டளை window-வில் என்னென்ன தரவுகள் உள்ளன என்பதைக் காட்டும்.

API கணக்கில், Claude Console-ல் உள்ள usage பக்கம் மட்டுமே அதிகாரப்பூர்வமான பதிவாகும். ஒரு prompt-ஐ அனுப்பும் முன் அதன் விலையை அறிய, client.messages.count_tokens() கட்டளையைப் பயன்படுத்தலாம். இது "பயன்படுத்த இலவசம், ஆனால் உங்கள் பயன்பாட்டு நிலையைப் பொறுத்து நிமிடத்திற்கு இத்தனை கோரிக்கைகள் (requests per minute) என்ற வரம்பிற்கு உட்பட்டது". நீங்கள் உண்மையில் கட்டணம் செலுத்த வேண்டிய tokenizer-ஐப் பயன்படுத்தும் ஒரே கணக்கீடு இதுதான்.

ஒரு அழைப்பிற்குப் பிறகு, usage தொகுதியைப் படித்து, அதைச் சரியாகப் புரிந்துகொள்ளவும்:

u = response.usage
total_input = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokens

input_tokens என்பது cache செய்யப்படாத மீதமுள்ள பகுதிகளை மட்டுமே கணக்கிடுகிறது. இது "கடைசி cache breakpoint-க்கு பிறகுள்ள tokens" என்று ஆவணப்படுத்தப்பட்டுள்ளது. input_tokens: 4000 என்று காட்டும் ஒரு turn என்பது 4,000-token கொண்ட turn அல்ல. இந்த மூன்று புலங்களையும் (fields) கூட்டினால் கிடைப்பதே இந்த சூத்திரத்திற்குத் தேவையான prompt அளவு ஆகும்.

பிறகு ஒப்பிடுங்கள். நீங்கள் அளந்த மாதாந்திர பயன்பாடு plan கட்டணத்தைவிட தெளிவாகக் குறைவாக இருந்தால், meter முறையைத் தேர்ந்தெடுக்கவும். அது தெளிவாக அதிகமாக இருந்தால், plan-ன் allowance உங்கள் வழக்கமான வேலை நாளுக்குத் தேவையான பயன்பாட்டை உள்ளடக்கும் வரை, plan-ஐத் தேர்ந்தெடுக்கவும். இரண்டிற்கும் இடையிலான வரம்புக்கு அருகில் இருந்தால், plan-ஐத் தேர்ந்தெடுக்கவும்; plan உங்களுக்கு எதிர்பாராத கட்டணத்தை உருவாக்காது, meter உருவாக்கக்கூடும். பயன்பாடு Pro கட்டணத்திற்கும் மிகவும் குறைவாக இருந்தால், இரண்டில் எதையும் வாங்குவதற்கு முன் உங்கள் பணிமுறைக்கு paid plan, free tier-ஐவிடச் சிறந்ததா என்பதைத் தீர்மானிக்கவும்; ஏனெனில் இத்தகைய குறைந்த பயன்பாடு free limit-ஐ போதுமான அளவு அடையாமல் இருக்கலாம், அதனால் எந்தக் கட்டணத்தையும் செலுத்துவது நியாயமற்றதாக இருக்கலாம். இதுவும் மாற்ற முடியாத முடிவு அல்ல; இன்னும் சில வாரங்களின் உண்மையான பயன்பாடு உங்கள் மதிப்பீட்டுக்கு முரணாக இருந்தால், tier-ஐ cancel செய்வது அல்லது குறைப்பது ஏற்கனவே நீங்கள் செலுத்திய மாதத்தைப் பாதிக்காது. நீங்கள் எந்தத் தேர்வை எடுத்தாலும், இந்தக் கணக்கு எந்த billing model மலிவானது என்பதை மட்டுமே தீர்மானிக்கும். மீட்கப்படும் வேலை நேரத்தின் மூலம் அந்தச் செலவு தன்னைத்தானே ஈடுசெய்கிறதா என்பதை உங்கள் சொந்த hourly rate-ஐ அடிப்படையாகக் கொண்டு தனியாகக் கணக்கிட வேண்டும்.

FAQ

Claude API, Claude Pro அல்லது Max-ஐ விட மலிவானதா?

இது பயன்பாட்டு அளவைப் பொறுத்தது. சந்தாக்கள் (subscriptions) குறிப்பிட்ட token வரம்பிற்குப் பதிலாக, பயன்பாட்டு கால அளவுகளாக விற்கப்படுவதால், இதற்கென பொதுவான லாப-நட்ட கணக்கீடு ஏதுமில்லை. வெளியிடப்பட்ட per-token கட்டணங்களின் அடிப்படையில் ஒரு சராசரி உரையாடலுக்கான (turn) விலையைக் கணக்கிடுங்கள். அதை ஒரு மாதத்தில் நீங்கள் பயன்படுத்தும் மொத்த உரையாடல்களின் எண்ணிக்கையுடன் பெருக்கி, சந்தா கட்டணத்துடன் ஒப்பிட்டுப் பாருங்கள். உதாரணமாக, 60,000-token கொண்ட ஒரு Sonnet 5 உரையாடல் சுமார் $0.035 செலவாகும். மாதத்திற்கு 20 நாட்கள், ஒரு நாளைக்கு 120 உரையாடல்கள் என கணக்கிட்டால், இது சுமார் $83 ஆகும். இது Pro கட்டணத்தை விட அதிகம், ஆனால் Max-ன் ஆரம்ப கட்டணத்தை விடக் குறைவு.

எனது மாதந்திர Claude API செலவை எவ்வாறு கணக்கிடுவது?

உண்மையான token எண்ணிக்கையைச் சேகரிக்க ஒரு வாரத்திற்கு Claude Code-ல் /usage-ஐ இயக்கவும். அல்லது உங்களிடம் ஏற்கனவே API கணக்கு இருந்தால், Claude Console-ல் உள்ள usage பக்கத்தைப் பார்க்கவும். பின் ஒரு உரையாடலுக்கான விலையைக் கணக்கிடுங்கள்: cache செய்யப்படாத input-க்கு அடிப்படை கட்டணம், cache write-க்கு அடிப்படை input கட்டணத்தைப் போல 1.25 மடங்கு, cache read-க்கு 0.1 மடங்கு, மற்றும் output-க்கு output கட்டணம். இதில் thinking tokens-ஐயும் output-ஆகவே கருத வேண்டும். இதை ஒரு மாதத்தில் நீங்கள் பயன்படுத்தும் மொத்த உரையாடல்களுடன் பெருக்கவும்.

Claude API கட்டணத்தில் அதிக மாற்றத்தை ஏற்படுத்துவது எது?

Prompt caching தான் மிக முக்கியமான காரணி. Sonnet 5-ல் 60,000-token கொண்ட ஒரு உரையாடல், prefix cache-லிருந்து பெறப்பட்டால் சுமார் $0.035 செலவாகும்; cache-லிருந்து பெறப்படாவிட்டால் சுமார் $0.132 செலவாகும். அடுத்ததாக model தேர்வு முக்கியமானது: Opus 4.8-ல் அதே உரையாடலுக்கு சுமார் $0.086 செலவாகும். மூன்றாவது காரணி session-ன் நீளம்; ஏனெனில் API stateless என்பதால், ஒவ்வொரு முறையும் முழு உரையாடலும் input-ஆக அனுப்பப்பட்டு அதற்கான கட்டணம் வசூலிக்கப்படும்.

Claude சந்தாவில் API அணுகல் உள்ளதா?

இவை இரண்டையும் தனித்தனி கணக்குகளாகவும், தனித்தனி கட்டணங்களாகவும் கருதுங்கள். API அழைப்புகளுக்கு Console-ல் நீங்கள் உருவாக்கும் கணக்கின் மூலம் token அடிப்படையில் கட்டணம் வசூலிக்கப்படும். நான் சரிபார்த்த ஆவணங்களின்படி, சந்தா மூலம் API credit வழங்கப்படுவதாக எந்தத் தகவலும் இல்லை. இவை இரண்டும் தனித்தனி சேவைகள் என்பதற்குச் சிறந்த சான்று Claude Code-ன் /usage-credits கட்டளை ஆகும்; இது "API key authentication-ல் கிடைக்காது". பல developers இரண்டையும் பயன்படுத்துகின்றனர்: interactive coding-க்கு ஒரு சந்தா, தாங்கள் உருவாக்கும் மென்பொருள்களுக்கு ஒரு API key.