SSD Nodes Learn 🎉 VPS $4.99/மாதம் முதல்
கல்வி வழிகாட்டிகள் Matt Connorஆல் Matt Connor · புதுப்பிக்கப்பட்டது 2026-08-07

Claude Fable 5 விலை மற்றும் பயன்பாட்டு விவரங்கள்

Claude Fable 5 விலை ஒரு மில்லியன் input tokens-க்கு $10 மற்றும் output tokens-க்கு $50 ஆகும். உங்கள் பணிகளுக்கு இந்த கட்டண விகிதங்கள் எவ்வாறு பொருந்தும் என்பதை அறியுங்கள்.

Claude Fable 5-ன் விலை என்ன?

Claude API-ல் Claude Fable 5-ன் விலை ஒரு மில்லியன் input tokens-க்கு $10 மற்றும் ஒரு மில்லியன் output tokens-க்கு $50 ஆகும். இவை 3 August 2026 அன்று pricing பக்கத்திலிருந்து பெறப்பட்ட Anthropic நிறுவனத்தின் அதிகாரப்பூர்வ விலைப் பட்டியல் ஆகும். இதன் API model ID claude-fable-5 ஆகும். இது 9 June 2026 அன்று Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud மற்றும் Microsoft Foundry ஆகியவற்றில் பொதுப் பயன்பாட்டிற்காக வெளியிடப்பட்டது.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

இதை ஒரு ஏணி வரிசை போலக் கருதவும். Fable 5-ன் விலை Claude Opus 5-ஐ விட இரண்டு மடங்கும், தற்போதைய Claude Sonnet 5-ன் விலையை விட ஐந்து மடங்கும், Claude Haiku 4.5-ஐ விட பத்து மடங்கும் ஆகும். கட்டணத்தின் இரு பக்கங்களிலும் இந்த விகிதம் சமமாகவே உள்ளது, ஏனெனில் அந்தப் பட்டியலில் உள்ள ஒவ்வொரு மாதிரியும் (model) அதன் input விலையை விட ஐந்து மடங்கு அதிக விலையை output-க்கு நிர்ணயித்துள்ளது. எனவே, ஒரு பணிக்குத் தேவையான input மற்றும் output token அளவுகள் தெரிந்தால், பெருக்கல் மூலம் ஒரு விலையை மற்றொன்றாக மாற்றிக்கொள்ளலாம்.

ஒரு குறிப்பிட்ட தேதி இந்த கணக்கீட்டை மாற்றுகிறது. Sonnet 5, 31 August 2026 வரை ஒரு மில்லியன் tokens-க்கு $2 (input) மற்றும் $10 (output) என்ற அறிமுக விலையில் கிடைக்கிறது. 1 September 2026 முதல் இதன் விலை $3 மற்றும் $15 என நிர்ணயிக்கப்பட்டுள்ளது. Fable 5-ன் விலையில் மாற்றம் இல்லை, எனவே அந்தத் தேதியிலிருந்து இவ்விரண்டிற்கும் இடையிலான விலை வித்தியாசம் ஐந்து மடங்கிலிருந்து மூன்று மடங்கிற்கும் சற்று அதிகமாகக் குறையும். நீங்கள் இலையுதிர்காலத்திற்கான (autumn) வரவு செலவுத் திட்டத்தைத் தயாரிப்பவர் என்றால், பிந்தைய Sonnet விலைகளையே பயன்படுத்தவும்.

தள்ளுபடிகள் மற்றும் கட்டணத்தை அதிகரிக்கும் ஒரு பெருக்கி

Prompt caching என்பது செலவைக் குறைப்பதற்கான மிக முக்கியமான வழியாகும். ஒரு cache read-ன் விலை அடிப்படை உள்ளீட்டு விலையில் பத்தில் ஒரு பங்கு மட்டுமே; Fable 5-ல் இது மில்லியன் tokens-க்கு $1 ஆகும். Cache-ல் எழுதுவதற்கான செலவு சாதாரண உள்ளீட்டு token-ஐ விட அதிகம்: ஐந்து நிமிட cache-க்கு அடிப்படை விலையை விட 1.25 மடங்கும், ஒரு மணிநேர cache-க்கு 2 மடங்கும் ஆகும். ஐந்து நிமிட cache ஒருமுறை வாசித்தாலே அதன் செலவை ஈடுசெய்துவிடும், ஒரு மணிநேர cache இரண்டு முறை வாசித்தாலே லாபகரமானதாகிவிடும். prompt caching எப்போது லாபகரமாக இருக்கும் என்பதைக் கணக்கிடுவது குறித்த புரிதலே, அதை எல்லா இடங்களிலும் செயல்படுத்துவதற்கு முன்பாக அவசியமானதாகும்.

Batch API உள்ளீடு மற்றும் வெளியீடு ஆகிய இரண்டிற்கும் 50% தள்ளுபடி வழங்குகிறது. எனவே, batched Fable 5 பணிகளுக்கு மில்லியன் tokens-க்கு $5 மற்றும் $25 மட்டுமே செலவாகும். Batch கோரிக்கைகள் asynchronous முறையில் செயல்படுவதால், உடனடி பதில் தேவைப்படாத பணிகளுக்கு மட்டுமே இது பொருந்தும். இந்த இரண்டு தள்ளுபடிகளும் ஒன்றிணைந்து செயல்படுவதால், cached மற்றும் batched பணிகளுக்குச் செலவு கணிசமாகக் குறையும்.

1M token context window வசதி Claude 4.6 மற்றும் அதற்குப் பிந்தைய மாடல்களில் சாதாரண கட்டணத்திலேயே கிடைக்கிறது. நீண்ட context-க்கு கூடுதல் கட்டணம் ஏதுமில்லை; எனவே 900k token கோரிக்கைக்கும் 9k token கோரிக்கைக்கும் ஒரே token கட்டணமே வசூலிக்கப்படும்.

கட்டணத்தை அதிகரிக்கும் காரணி data residency ஆகும். Inference-ஐ ஐக்கிய அமெரிக்காவிற்குள் வைத்திருக்க inference_geo: "us"-ஐ அமைக்கும்போது, cache reads மற்றும் cache writes உட்பட அனைத்து token வகைகளுக்கும் 1.1 மடங்கு பெருக்கி (multiplier) பொருந்தும். ஒப்பந்தத்தின்படி கட்டாயம் தேவைப்படாவிட்டால், default global routing-ஐ மாற்ற வேண்டாம்.

இந்த மாடலுக்கு மட்டும் ஒரு பிரத்யேக கட்டண விதி உள்ளது. Fable 5-ல் உள்ள safety classifiers ஒரு கோரிக்கையை நிராகரிக்கக்கூடும். அவ்வாறு நிகழும்போது, Messages API பிழைக்கு பதிலாக stop_reason: "refusal"-ஐ வெற்றிகரமான HTTP 200 response-ஆக வழங்கும். எந்த வெளியீடும் உருவாக்கப்படுவதற்கு முன்பே கோரிக்கை நிராகரிக்கப்பட்டால், அதற்கு நீங்கள் கட்டணம் செலுத்த வேண்டியதில்லை. அதே prompt-ஐ வேறொரு Claude மாடலில் மீண்டும் முயற்சித்தால், fallback credit மூலம் prompt cache செலவு திரும்பப் பெறப்படும். எனவே, ஒரே cache-ஐ மீண்டும் சூடுபடுத்த (warm) நீங்கள் கட்டணம் செலுத்த வேண்டியதில்லை.

எந்தெந்த திட்டங்களில் Claude Fable 5 உள்ளடங்கியுள்ளது?

3 ஆகஸ்ட் 2026 நிலவரப்படி, Anthropic-ன் Claude Fable பக்கத்தின்படி, இந்த model Pro, Max, Team மற்றும் Enterprise பயனர்களுக்குக் கிடைக்கிறது. இலவசத் திட்டம் (free plan) இதில் குறிப்பிடப்படவில்லை. டெவலப்பர்களுக்கு, இது Claude API மற்றும் மேலே பட்டியலிடப்பட்டுள்ள cloud marketplaces மூலமாகப் பொதுவாகக் கிடைக்கிறது.

ஒரு திட்டத்தில் கிடைப்பது என்பது, வரம்பின்றி பயன்படுத்தலாம் என்று அர்த்தமல்ல. Anthropic-ன் pricing பக்கத்தில் உள்ள திட்ட ஒப்பீட்டு அட்டவணை, Fable பயன்பாட்டை சில பயனர்களுக்கு வாராந்திர பயன்பாட்டு வரம்புகளின் பங்கும், மற்றவர்களுக்கு usage credits-ம் கட்டுப்படுத்துகிறது. இந்த நடைமுறை ஜூலை 2026-ல் பலமுறை மாற்றப்பட்டது. Fable 5-ஐ மீண்டும் வெளியிடுவது குறித்த Anthropic-ன் அறிக்கையில், 7 ஜூலை 2026 வரை Pro, Max, Team மற்றும் குறிப்பிட்ட Enterprise திட்டங்களில் வாராந்திர பயன்பாட்டு வரம்பில் 50% வரை இந்த model உள்ளடங்கும் என்றும், அந்தத் தேதிக்குப் பிறகு usage credits மூலம் பயன்படுத்தலாம் என்றும் தெரிவிக்கப்பட்டிருந்தது. ஜூலை மாதத்தின் பிற்பகுதியில் வந்த செய்திகள், இந்த வரம்புகள் மேலும் நீட்டிக்கப்பட்டதையும், பயனர் வகைகளுக்கு இடையே பிரிவுகள் இருப்பதையும் விவரித்தன.

எனவே, இந்தத் தளம் ஒவ்வொரு திட்டத்திற்குமான வரம்பைக் குறிப்பிடாது. அந்த மாதம் வெளியிடப்பட்ட எந்தவொரு எண்ணிக்கையும் இரண்டு வாரங்களுக்கு மேல் நீடிக்கவில்லை; பழைய தகவலைக் குறிப்பிடுவது தகவலே இல்லாததை விட மோசமானது. நீங்கள் முடிவெடுக்கும் நாளில், திட்ட ஒப்பீட்டு அட்டவணையில் Fable என்று பெயரிடப்பட்ட வரிசையைத் திறந்து பார்க்கவும். செய்தி கட்டுரைகளில் உள்ள எந்தவொரு எண்ணையும் காலாவதியானதாகக் கருதவும்.

API rate மட்டுமே நிலையானது. எந்தவொரு பாதையிலும், உள்ளடங்கிய பயன்பாட்டு வரம்பு முடிந்த பிறகு, Fable 5-ன் கூடுதல் பயன்பாட்டிற்கு மேலே உள்ள அட்டவணையில் உள்ள விலையின்படி கட்டணம் வசூலிக்கப்படும். எனவே, எந்தவொரு சூழலிலும் விலைப்பட்டியலை அடிப்படையாகக் கொண்டே திட்டமிட வேண்டும். இதுவே நீங்கள் API billing மற்றும் subscription-ஐ ஒப்பிடும்போது மற்ற Claude model-களுக்கும் அடையும் அதே முடிவாகும். நீங்கள் இன்னும் ஒரு திட்டத்தைத் தேர்ந்தெடுக்கவில்லை என்றால், உங்கள் பயன்பாட்டிற்கு எந்த Claude திட்டம் பொருந்தும் என்பதிலிருந்து தொடங்கவும்.

விலை விகிதத்தை விட உங்கள் கட்டணம் ஏன் அதிகமாக உள்ளது

Fable 5-ன் விலை, நேரடி விலை ஒப்பீட்டை விட அதிகமாக இருப்பதற்கு இரண்டு ஆவணப்படுத்தப்பட்ட காரணங்கள் உள்ளன.

முதலாவது tokenizer. Fable 5, Claude Opus 4.7-உடன் அறிமுகப்படுத்தப்பட்ட tokenizer-ஐப் பயன்படுத்துகிறது. Opus 4.7-க்கு முன் வெளியான மாடல்களுடன் ஒப்பிடும்போது, அதே உரை சுமார் 30% கூடுதல் tokens-ஐ உருவாக்குகிறது; இந்த அதிகரிப்பு உள்ளடக்கத்தைப் பொறுத்து மாறுபடும். Haiku 4.5 அந்த tokenizer-க்கு முந்தையது என்பதால், ஒரே உரையை இரண்டு மாடல்களுக்கும் அளிக்கும்போது, விலைப்பட்டியலில் உள்ள பத்து மடங்கு வித்தியாசம் பதிமூன்று மடங்காக மாறுகிறது. Sonnet 5 புதிய tokenizer-ஐப் பயன்படுத்துவதால், Fable மற்றும் Sonnet இடையேயான token ஒப்பீடு சரியாக இருக்கும். ஆனால் Fable மற்றும் Haiku இடையேயான ஒப்பீடு அவ்வாறு இருக்காது.

இரண்டாவது, thinking. Fable 5-ல் adaptive thinking எப்போதும் செயல்பாட்டில் இருக்கும், மேலும் thinking: {"type": "disabled"} ஆதரிக்கப்படாது. Thinking tokens, output tokens-ஆக முழு output விலையில் கணக்கிடப்படும். இந்த மாடலில் raw chain of thought ஒருபோதும் வழங்கப்படாது, மேலும் thinking.display இயல்பாகவே "omitted" என அமைக்கப்பட்டுள்ளது. இதன் பொருள், சிறிய அளவிலான பதில் கூட அதிக எண்ணிக்கையிலான billed output tokens-ஐக் கொண்டிருக்கலாம். Anthropic-ன் ஆவணங்கள் இதைத் தெளிவாகக் குறிப்பிடுகின்றன: billed output token எண்ணிக்கை, பதிலில் தெரியும் token எண்ணிக்கையுடன் ஒத்துப்போகாது.

ஊகிப்பதற்குப் பதிலாக, விவரங்களைப் பார்க்கவும். usage.output_tokens_details.thinking_tokens என்ற புலம், reasoning-க்காக எத்தனை billed output tokens செலவிடப்பட்டன என்பதைத் தெரிவிக்கும்:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

Anthropic-ன் thinking ஆவணத்திலிருந்து எடுக்கப்பட்ட அந்த உதாரணத்தில், மொத்தம் 348 billed output tokens-ல் 312 tokens யாரும் பார்க்காத reasoning-க்காகச் செலவிடப்பட்டுள்ளன. நீங்கள் stream செய்யும்போது, இந்த விவரம் இறுதி message_delta நிகழ்வில் மட்டுமே கிடைக்கும். எனவே, கடைசி text chunk-உடன் வாசிப்பதை நிறுத்தும் client, இதை ஒருபோதும் பதிவு செய்யாது.

இதற்கான கட்டுப்பாடு effort ஆகும், இது output_config.effort-ல் அமைக்கப்பட்டுள்ளது. இதில் low, medium, high (இயல்புநிலை), xhigh மற்றும் max ஆகிய நிலைகள் உள்ளன.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

இந்த மாடலுக்கான Anthropic-ன் வழிகாட்டுதல் என்னவென்றால், high-ல் தொடங்கி, அதிக திறன் தேவைப்படும் பணிகளுக்கு மட்டும் xhigh-க்குச் செல்லவும். வழக்கமான பணிகளுக்கு medium அல்லது low நிலைக்குக் குறைக்கவும். ஏனெனில், Fable 5-ல் குறைந்த effort-ல் கிடைக்கும் முடிவுகள், முந்தைய மாடல்களின் xhigh-ஐ விடச் சிறப்பாக இருக்கும். இதில் இரண்டு சிக்கல்கள் உள்ளன. கோரிக்கைகளுக்கு இடையே effort-ஐ மாற்றுவது உங்கள் prompt cache-ஐச் செல்லாததாக்கும், ஏனெனில் தீர்மானிக்கப்பட்ட effort மதிப்பு prompt-ல் சேர்க்கப்படுகிறது. எனவே, ஒரு பணிக்கு ஒரு நிலையைத் தேர்வு செய்து அதையே பராமரிக்கவும். மேலும், max_tokens என்பது thinking மற்றும் response text இரண்டையும் உள்ளடக்கிய மொத்த output-க்கான கடினமான வரம்பு (hard cap) ஆகும். எனவே, thinking இல்லாத பதிலுக்காக அமைக்கப்பட்ட வரம்பு, பதிலைத் துண்டித்துவிடும். stop_reason: "max_tokens" என்ற பிழை தெரிந்தால், நீங்கள் வரம்பை அதிகரிக்க வேண்டும் அல்லது effort-ஐக் குறைக்க வேண்டும்.

ஒவ்வொரு token-க்கும் கட்டணம் அல்ல, முடிக்கப்பட்ட பணிக்கு கட்டணம்

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

3 வரிசைகளில் உள்ளவை கணக்கீடுகள், இவை செயல்திறன் அளவீடுகள் (benchmarks) அல்ல. கட்டண விகிதங்கள் பொதுவெளியில் உள்ளன. token அளவுகள் உங்கள் சொந்த பயன்பாட்டுத் தரவுகளின் அடிப்படையில் நீங்கள் மாற்ற வேண்டிய அனுமானங்கள் மட்டுமே. நடுத்தர வரிசையில் உள்ளதைப் போன்ற ஒரு coding session-க்கு Fable 5-ல் $5.00 செலவாகிறது, அதே சமயம் Sonnet 5-ல் $1.00 செலவாகிறது. நீண்ட காலப் பணிகளுக்கு Fable 5-ல் $40.00 மற்றும் Sonnet 5-ல் $8.00 செலவாகிறது. கடைசி வரிசையில் உள்ள Haiku நெடுவரிசை வெறும் கணக்கீடு மட்டுமே: Haiku 4.5-ல் 200k token context window மட்டுமே உள்ளதால், அந்தப் பணியை அதனால் கையாள முடியாது.

முடிவெடுப்பதற்கு 'ஒவ்வொரு token-க்கும் கட்டணம்' என்பது தவறான அளவீடு. முடிக்கப்பட்ட பணிக்கு ஆகும் செலவு என்பது, ஒரு முயற்சிக்கு ஆகும் செலவை, மேற்கொள்ளப்பட்ட முயற்சிகளின் எண்ணிக்கையால் பெருக்குவதாகும். தற்போதைய கட்டண விகிதங்களின்படி, ஒரு Fable 5 முயற்சிக்கு ஆகும் செலவு ஐந்து Sonnet 5 முயற்சிகளுக்குச் சமம். எனவே, வெறும் retry எண்ணிக்கையை மட்டும் வைத்துக்கொண்டு upgrade செய்வதை நியாயப்படுத்த முடியாது. Sonnet ஐந்து முறை முயற்சிக்கும்போது நான்கு முறைக்கும் மேல் தோல்வியடைந்தால் மட்டுமே, மலிவான மாடல் token செலவில் பின்தங்கும்.

token கட்டணப் பட்டியலில் விடுபட்ட விஷயங்களே upgrade செய்வதற்கான உண்மையான காரணங்கள். அட்டவணையில் உள்ள இரண்டு நீண்ட காலப் பணிகளுக்கும் இடையிலான செலவு வித்தியாசம், பெரும்பாலான சந்தைகளில் ஒரு மணிநேரப் பொறியாளர் ஊதியத்தை விடக் குறைவு. விலையுயர்ந்த மாடல் ஒரு மணிநேர ஆய்வு நேரத்தைச் சேமித்தாலோ அல்லது தவறான migration-ஐத் தவிர்த்து, அதைச் சரிசெய்யும் வேலையைக் குறைத்தாலோ, அது அந்தச் செலவை ஈடுசெய்துவிடும்; ஆனால் இந்தச் சேமிப்பு கட்டணப் பட்டியலில் தெரியாது. ஏற்றுக்கொள்ளப்பட்ட முடிவுகளுக்கு ஆகும் செலவை அடிப்படையாகக் கொண்டு ஒப்பீடு செய்யுங்கள், அத்துடன் உங்கள் சொந்த நேரத்தையும் மொத்தச் செலவில் கணக்கிடுங்கள். ஒரு மில்லியன் tokens உண்மையில் எதைக் குறிக்கிறது என்பதை அறிந்துகொள்வது இந்த மதிப்பீட்டை மிகவும் துல்லியமாக்கும்.

Claude Fable 5 அதன் விலைக்கு ஏற்றதாக இருக்கும் மூன்று பணிகள்

தவறான முடிவுகள் அதிக செலவை ஏற்படுத்தும் நீண்ட கால ஏஜென்ட் செயல்பாடுகள். Fable 5 பல மணிநேரங்கள் நீடிக்கும் பணிகளுக்காக உருவாக்கப்பட்டது: 1M token context window, ஒரு கோரிக்கைக்கு 128k output tokens வரை, மற்றும் xhigh effort level ஆகியவை முப்பது நிமிடங்களுக்கு மேல் இயங்கும் பணிகளுக்காக வடிவமைக்கப்பட்டுள்ளன. 40-வது நிலையில் ஒரு ஏஜென்ட் எடுக்கும் தவறான முடிவை 300-வது நிலை வரை யாரும் கவனிக்கவில்லை என்றால், அதைச் சரிசெய்யும் செலவை விட, இந்த மாடலின் செயல்பாட்டுத் திறன் சிறந்தது.

பெரிய codebase-ல் ஒருமுறை மட்டும் செய்யப்படும் migration அல்லது audit. ஒருமுறை மட்டுமே செய்யப்படும் பணிகளுக்குச் செலவை ஈடுசெய்யும் வாய்ப்பு இல்லை, எனவே token-க்கான கூடுதல் கட்டணம் ஒரே invoice-ல் சேரும், மேலும் முழுப் பணியும் ஒரே context window-க்குள் அடங்கிவிடும். இது asynchronously இயங்கக்கூடியது என்றால், Batch API மூலம் இதன் செலவை $25 (ஒரு மில்லியன் output tokens-க்கு) என பாதியாகக் குறைக்கலாம்.

குறைந்த விலை மாடல்கள் ஏற்கனவே இரண்டு முறை தோல்வியடைந்த பணிகள். இரண்டு தோல்வியுற்ற முயற்சிகள் மற்றும் அதைச் சரிசெய்ய நீங்கள் செலவிடும் நேரம், மேலே உள்ள அட்டவணையில் உள்ள அளவுகளில் ஒரு Fable முயற்சியின் விலையை விட அதிகம். சிக்கலான பணிகளுக்கு உயர்நிலை மாடலுக்கு மாறுவது செலவு குறைந்த வழியாகும், இதற்காகவே model ladder பயன்படுத்தப்படுகிறது. நீங்கள் இன்னும் எந்த tier-ஐத் தேர்வு செய்வது என்று குழப்பத்தில் இருந்தால், Claude model tier-களுக்கு இடையிலான திறன் ஒப்பீடு இந்தப் பக்கத்தில் உள்ளதை விட வேறுபட்ட கேள்விக்கு விடையளிக்கும்.

Sonnet 5 அல்லது Haiku 4.5 சிறந்த தேர்வாக இருக்கும் மூன்று பணிகள்

அதிக அளவிலான வகைப்படுத்துதல் மற்றும் தரவு பிரித்தெடுத்தல் (High volume classification and extraction). இப்பணிகள் throughput மற்றும் unit cost ஆகியவற்றின் அடிப்படையில் மதிப்பிடப்படுகின்றன. இவற்றின் தரத் தேவை குறைவு என்பதால், மலிவான மாடல்களே போதுமானதாக இருக்கும். Haiku 4.5 துல்லியமாகச் செய்யும் ஒரு பணிக்கு, Fable 5-ஐப் பயன்படுத்துவது பத்து மடங்கு அதிக செலவை ஏற்படுத்தும், ஆனால் கூடுதல் பலன் ஏதும் கிடைக்காது.

Latency-யே முதன்மையானதாக இருக்கும் ஊடாடும் பணிகள் (Interactive work). Anthropic-ன் மாடல் அட்டவணையின்படி, Fable 5-ன் latency அதிகம். மேலும், இதில் 'thinking' செயல்முறையை நிறுத்த முடியாது. ஒரு chat box அல்லது editor completion-ல், பயனர்கள் தரத்தை கவனிப்பதற்கு முன்பே காத்திருப்பு நேரத்தை உணர்வார்கள் என்பதால், அதிக திறன் கொண்ட மாடல் இங்கு மந்தமாகவே செயல்படும்.

ஜனவரி 2026-க்கு பிந்தைய நிகழ்வுகளைச் சார்ந்த பணிகள். Fable 5-ன் நம்பகமான knowledge cutoff ஜனவரி 2026 ஆகும். Opus 5-ன் cutoff மே 2026 ஆகும். அதிக விலை கொண்ட மாடலே பழைய தகவல்களைக் கொண்டிருப்பதால், சமீபத்திய நிகழ்வுகள் குறித்த கேள்விகளுக்கு, நீங்கள் search அல்லது fetch கருவிகளை வழங்காதவரை, பழைய தகவல்களுக்காக இரு மடங்கு கட்டணம் செலுத்த வேண்டியிருக்கும்.

செலவைத் தாண்டி ஒரு முக்கிய கட்டுப்பாடு உள்ளது. Fable 5, 'Covered Model' என வகைப்படுத்தப்பட்டுள்ளதால், இதில் 30 நாட்கள் தரவு சேமிப்பு (data retention) கொள்கை உள்ளது; இதை zero data retention முறையில் பயன்படுத்த முடியாது. உங்கள் ஒப்பந்தத்தின்படி zero retention கட்டாயமென்றால், எவ்வளவு விலை கொடுத்தாலும் Fable 5-ஐப் பயன்படுத்த முடியாது, எந்த தள்ளுபடியும் இதை மாற்றாது.

fable-method களஞ்சியங்கள் எதைக் காட்டுகின்றன, எதைக் காட்டவில்லை

Fable 5 அணுகுமுறைகளை, குறைந்த செலவிலான ஒரு model பின்பற்றக்கூடிய திறன்களாக எவ்வாறு மாற்றலாம் என்பதை விளக்கும் களஞ்சியங்களை (repositories) பயிற்சியாளர்கள் வெளியிட்டுள்ளனர். fable-method repo ஒரு சிந்தனைத் திறன் (thinking skill), ஒரு ஒருங்கிணைப்புச் சுழற்சி

பட்ஜெட்டை உறுதிப்படுத்தும் முன் உங்கள் சொந்த எண்களைச் சரிபார்க்கவும்

  • ஒவ்வொரு பதிலிலும் usage-ஐப் படித்து, output_tokens_details.thinking_tokens-ஐத் தெரியும் வெளியீட்டிலிருந்து தனித்தனியாகப் பதிவு செய்யவும். நீங்கள் பார்க்காத காரணங்களே மற்றவர்களை ஆச்சரியப்படுத்தும் கூடுதல் செலவுப் பொருட்களாகும்.
  • இயல்புநிலை அமைப்பை ஏற்றுக்கொள்வதற்குப் பதிலாக effort-ஐத் தெளிவாக அமைக்கவும், மேலும் prompt caching-ஐச் சார்ந்திருக்கும் எந்தவொரு உரையாடலிலும் அதை மாறாமல் வைத்திருக்கவும்.
  • உங்கள் நிலையான முன்னொட்டை (stable prefix) முதலில் ஒரு cache breakpoint-க்கு பின்னால் வைக்கவும். அடிப்படை உள்ளீட்டு விலையில் பத்தில் ஒரு பங்கு விலையில் cache-ஐ வாசிப்பது, பெரும்பாலான model downgrades-ஐ விட அதிக சேமிப்பைத் தரும்.
  • உடனடி பதில் தேவையில்லாத எதையும் Batch API-க்கு மாற்றவும்.
  • மாற்றுகளை நேர்மையாக மதிப்பிடவும். Claude மற்றும் ChatGPT API விலையை ஒப்பிடுதல் உங்கள் பணிச்சுமையில் ஒரு நீண்ட கால உறுதிப்பாட்டிற்கு முன் ஒரு மதியம் செலவழித்துச் சரிபார்ப்பது பயனுள்ளது.

பணிச்சுமை உங்கள் சொந்த server-ல் இயங்கும் ஒரு agent என்றால், model தேர்வுக்கு அப்பாற்பட்ட கட்டுப்பாடுகளே மிக முக்கியமானவை. VPS-ல் agent செலவுகளைக் கட்டுக்குள் வைத்திருத்தல் என்பது ஒரு runaway session-ஐத் தடுக்கும் loop வரம்புகள் மற்றும் செலவுக் கட்டுப்பாடுகளைப் பற்றி விளக்குகிறது, மேலும் Claude Code உண்மையில் எங்கே tokens-ஐச் செலவிடுகிறது என்பது உங்கள் பயன்பாட்டு dashboard-ல் நீங்கள் காணும் எண்களைப் பற்றி விளக்குகிறது.

FAQ

ஒரு மில்லியன் tokens-க்கு Claude Fable 5-ன் விலை என்ன?

Claude API-ல் ஒரு மில்லியன் input tokens-க்கு $10 மற்றும் ஒரு மில்லியன் output tokens-க்கு $50 என Claude Fable 5 விலை நிர்ணயிக்கப்பட்டுள்ளது. இது 3 ஆகஸ்ட் 2026 அன்று Anthropic-ன் விலை நிர்ணயப் பக்கத்தில் சரிபார்க்கப்பட்டது. Cache read-க்கு ஒரு மில்லியன் tokens-க்கு $1 வசூலிக்கப்படுகிறது, இது அடிப்படை input விலையில் பத்தில் ஒரு பங்கு ஆகும். Batch API-ல் asynchronous பணிகளுக்கு 50% தள்ளுபடி வழங்கப்படுகிறது, இதனால் ஒரு மில்லியன் tokens-க்கு $5 மற்றும் $25 என விலை அமைகிறது. inference_geo parameter-ஐப் பயன்படுத்தி inference-ஐ அமெரிக்காவிற்குள் வைத்திருப்பது, ஒவ்வொரு வகைக்கும் 1.1 மடங்கு கூடுதல் கட்டணத்தை சேர்க்கும்.

Claude Pro சந்தாவில் Claude Fable 5 உள்ளதா?

Anthropic-ன் Claude Fable பக்கம், இந்த model Pro, Max, Team மற்றும் Enterprise பயனர்களுக்குக் கிடைக்கும் என்று குறிப்பிடுகிறது; இலவசத் திட்டத்தைப் பற்றி இதில் குறிப்பிடப்படவில்லை. இதில் கிடைக்கும் அணுகல் வரம்பற்றது அல்ல. சில பயனர்களுக்கு வாராந்திர பயன்பாட்டு வரம்பின் ஒரு பகுதியாக Fable கிடைக்கிறது, மற்றவர்களுக்கு usage credits மூலம் கிடைக்கிறது. இந்த நடைமுறை ஜூலை 2026-ல் பலமுறை மாற்றப்பட்டது. ஏதேனும் ஒரு கட்டுரையில் உள்ள தகவலை நம்புவதை விட, நீங்கள் முடிவெடுக்கும் நாளில் Anthropic-ன் விலை நிர்ணயப் பக்கத்தில் உள்ள திட்ட ஒப்பீட்டு அட்டவணையில் Fable வரிசையைப் பார்க்கவும். அனுமதிக்கப்பட்ட பயன்பாட்டு வரம்பு முடிந்த பிறகு, கூடுதல் பயன்பாட்டிற்கு API விலையின்படி கட்டணம் வசூலிக்கப்படும்.

எனது Claude Fable 5 கட்டணம், நான் பார்த்த output-ஐ விட ஏன் அதிகமாக உள்ளது?

Claude Fable 5-ல் Adaptive thinking எப்போதும் இயங்கிக் கொண்டிருக்கும். Thinking tokens-க்கு output tokens-க்கான கட்டணமே வசூலிக்கப்படும், மேலும் அந்த raw chain of thought பயனருக்குத் தெரியாது. thinking.display அதன் இயல்புநிலையான omitted-ல் இருக்கும்போது, நீங்கள் thinking field-ஐக் காண முடியாது, ஆனால் அதற்குப் பின்னால் உள்ள ஒவ்வொரு reasoning token-க்கும் கட்டணம் செலுத்துவீர்கள். இந்த இரண்டையும் பிரித்தறிய பதிலில் உள்ள usage.output_tokens_details.thinking_tokens-ஐப் பார்க்கவும். streaming செய்யும்போது, இது இறுதி message_delta நிகழ்வில் மட்டுமே வரும். பணியின் தேவைக்கு ஏற்ப reasoning மற்றும் பதிலின் விகிதம் அதிகமாக இருந்தால், effort அளவைக் குறைக்கவும்.

நான் Claude Fable 5-ஐப் பயன்படுத்த வேண்டுமா அல்லது Claude Opus 5-ஐப் பயன்படுத்த வேண்டுமா?

Claude Opus 5-ன் விலை token-க்கு பாதியாக உள்ளது. மேலும், இதன் knowledge cutoff மே 2026 ஆகும், Fable 5-க்கு இது ஜனவரி 2026 ஆகும். முதலில் Opus 5-ல் தொடங்கி, அதில் ஒரு பணி தோல்வியடைந்தாலோ அல்லது தவறான பதிலால் ஏற்படும் இழப்பு விலை வித்தியாசத்தை விட அதிகமாக இருந்தாலோ Fable 5-க்கு மாறவும். நீண்ட கால agent பணிகளுக்கு Fable 5 சரியான தேர்வாகும், அங்கு ஒரு தவறான கிளை பல மணிநேர வேலைகளை வீணாக்கலாம். மேலும், ஒவ்வொரு முறையும் கட்டணம் செலுத்துவதற்குப் பதிலாக, ஒருமுறை மட்டும் அதிக கட்டணம் செலுத்தி முடிக்கும் பணிகளுக்கும் இதுவே சிறந்தது.

#claude#fable#model-selection#pricing#tokens