Claude Fable 5 ధర ఎంత? ఎప్పుడు వాడాలి
Claude Fable 5 ధర inputకి మిలియన్ tokensకు $10, outputకి $50. Anthropic ప్రచురించిన రేట్లు, Sonnet 5 introductory pricing ముగిసే తేదీ, సరైన ఉపయోగాలను చూడండి.
Claude Fable 5 ధర ఎంత?
Claude APIలో Claude Fable 5 ధర $10 ప్రతి మిలియన్ input tokens కు, $50 ప్రతి మిలియన్ output tokens కు ఉంటుంది. ఇవి Anthropic ప్రచురించిన జాబితా ధరలు. 3 August 2026న pricing page నుంచి వీటిని తీసుకున్నారు. API model ID claude-fable-5. ఇది 9 June 2026న Claude API, Amazon Bedrock, AWSలోని Claude Platform, Google Cloud మరియు Microsoft Foundryలో సాధారణ వినియోగానికి అందుబాటులోకి వచ్చింది.
The data behind this chart
[
{
"label": "Claude Fable 5",
"input": "10",
"output": "50",
"cache_read": "1",
"batch_input": "5",
"batch_output": "25"
},
{
"label": "Claude Opus 5",
"input": "5",
"output": "25",
"cache_read": "0.50",
"batch_input": "2.50",
"batch_output": "12.50"
},
{
"label": "Claude Sonnet 5 (intro rate)",
"input": "2",
"output": "10",
"cache_read": "0.20",
"batch_input": "1",
"batch_output": "5"
},
{
"label": "Claude Sonnet 5 (from 1 Sep)",
"input": "3",
"output": "15",
"cache_read": "0.30",
"batch_input": "1.50",
"batch_output": "7.50"
},
{
"label": "Claude Haiku 4.5",
"input": "1",
"output": "5",
"cache_read": "0.10",
"batch_input": "0.50",
"batch_output": "2.50"
}
]దీనిని ఒక స్థాయి క్రమంగా పరిగణించండి. Fable 5 ధర Claude Opus 5 కంటే రెండింతలు, ప్రస్తుత Claude Sonnet 5 ధర కంటే ఐదింతలు, Claude Haiku 4.5 కంటే పదింతలు. ఆ పట్టికలోని ప్రతి model తన input rate కు ఖచ్చితంగా ఐదు రెట్లు output rate ను నిర్ణయిస్తుంది. అందువల్ల రెండు వైపులా ఈ నిష్పత్తి ఒకే విధంగా ఉంటుంది. ఒక పనికి అవసరమైన input మరియు output tokens విభజన మీకు తెలిస్తే, గుణించడం ద్వారా ఒక ధరను మరొక model ధరగా మార్చవచ్చు.
ఒక తేదీ ఈ లెక్కను మారుస్తుంది. 31 August 2026 వరకు Sonnet 5 introductory pricing కింద ప్రతి మిలియన్ tokens కు $2 మరియు $10 ధరలతో అందుబాటులో ఉంటుంది. 1 September 2026 నుంచి దాని జాబితా ధరలు $3 మరియు $15 అవుతాయి. Fable 5 ధరలో మార్పు ఉండదు. అందువల్ల ఆ రోజున ఈ రెండింటి మధ్య ధర వ్యత్యాసం ఐదింతల నుంచి కొద్దిగా మూడింతలకంటే ఎక్కువకు తగ్గుతుంది. శరదృతువు కోసం బడ్జెట్ రూపొందిస్తుంటే, తరువాతి Sonnet ధరలను ఉపయోగించండి.
రాయితీలు, అలాగే బిల్లును పెంచే ఏకైక గుణకం
Prompt caching అత్యంత ప్రభావవంతమైన నియంత్రణ. Cache read ధర base input ధరలో పదో వంతు మాత్రమే. Fable 5లో ఇది ప్రతి మిలియన్ tokensకు $1. Cacheలో రాయడానికి సాధారణ input token కంటే ఎక్కువ ఖర్చవుతుంది: ఐదు నిమిషాల cacheకు base ధరకు 1.25 రెట్లు, ఒక గంట cacheకు base ధరకు 2 రెట్లు. ఐదు నిమిషాల cache ఒక్క read తర్వాతే తన ఖర్చును తిరిగి చెల్లిస్తుంది. ఒక గంట cache రెండు reads తర్వాత తన ఖర్చును తిరిగి చెల్లిస్తుంది. అందుకే దీన్ని ప్రతిచోటా ప్రారంభించే ముందు prompt caching ఎక్కడ లాభదాయకంగా మారుతుందో లెక్కించడం అవసరం.
Batch API input మరియు output రెండింటిపైనా 50% తగ్గింపును ఇస్తుంది. అందువల్ల batched Fable 5 పనికి ప్రతి మిలియన్ tokensకు $5 మరియు $25 ఖర్చవుతుంది. Batch requests asynchronousగా ఉంటాయి. కాబట్టి వెంటనే సమాధానం అవసరం లేని పనికే ఇది ఉపయోగపడుతుంది. ఈ రెండు రాయితీలు కలిపి వర్తిస్తాయి. అందువల్ల cached, batched job రెండు పరిమాణాల్లోనూ తక్కువ ఖర్చుతో ఉంటుంది.
Claude 4.6 మరియు తరువాతి modelsలో 1M token context window standard ratesలోనే చేర్చబడింది. దీర్ఘ contextకు అదనపు surcharge లేదు. అందువల్ల 900k token requestకు, 9k requestకు ఉన్నట్లే ప్రతి tokenకు అదే rate వర్తిస్తుంది.
బిల్లును పెంచే గుణకం data residency. Inferenceను United Statesలోనే నిర్వహించడానికి inference_geo: "us" సెట్ చేస్తే, cache reads మరియు cache writesతో సహా ప్రతి token categoryపై 1.1 రెట్లు multiplier వర్తిస్తుంది. Contractలో తప్పనిసరిగా కోరితే తప్ప default global routingనే కొనసాగించండి.
ఈ modelకు ప్రత్యేకమైన ఒక billing rule ఉంది. Fable 5 requestsను తిరస్కరించగల safety classifiersను ships చేస్తుంది. అలా జరిగినప్పుడు Messages API errorకు బదులుగా stop_reason: "refusal" ను విజయవంతమైన HTTP 200 responseగా తిరిగి ఇస్తుంది. Output రూపొందకముందే request తిరస్కరించబడితే దానికి బిల్లు ఉండదు. అదే promptను మరో Claude modelపై retry చేస్తే, switch కోసం జరిగిన prompt cache ఖర్చును fallback credit తిరిగి చెల్లిస్తుంది. అందువల్ల అదే cacheను రెండుసార్లు warm చేయడానికి మీరు చెల్లించాల్సిన అవసరం ఉండదు.
ఏ ప్లాన్లలో Claude Fable 5 ఉంటుంది?
3 August 2026 నాటికి, Anthropic యొక్క Claude Fable పేజీ ప్రకారం ఈ model Pro, Max, Team మరియు Enterprise users కు అందుబాటులో ఉంది. Free plan పేరు అందులో లేదు. ఆ జాబితాలో Pro అత్యల్ప ధర కలిగిన seat. అందువల్ల Pro ధర ఎంత, దాని usage limits ఎక్కడ మీ usage ను ఆపుతాయి అనేది Fable కోసం ఏ subscription మార్గానికైనా కనిష్ఠ ఖర్చును నిర్ణయిస్తుంది. Developers కోసం ఇది సాధారణంగా Claude API లో, అలాగే పైన పేర్కొన్న cloud marketplaces ద్వారా అందుబాటులో ఉంది. ఆ మార్గంలో free tier లేదు. కాబట్టి meter ప్రారంభమయ్యే ముందు మీకు లభించేది signup సమయంలో Anthropic ఇచ్చే చిన్న credit మాత్రమే.
ఒక plan లో అందుబాటులో ఉండటం అంటే పరిమితి లేకుండా included అని కాదు. Anthropic pricing page లోని plan comparison table కొన్ని seats లో Fable ను weekly usage limits లోని ఒక భాగం వెనుక, మరికొన్నింటిలో usage credits వెనుక పరిమితం చేస్తుంది. ఈ ఏర్పాటు July 2026 లో ఒకటి కంటే ఎక్కువసార్లు మారింది. Fable 5 ను redeploy చేయడంపై Anthropic స్వయంగా ఇచ్చిన ప్రకటనలో, Pro, Max, Team మరియు select Enterprise plans కు 7 July 2026 వరకు weekly usage limits లో గరిష్ఠంగా 50% వరకు model usage, ఆ తేదీ తర్వాత usage credits ఉంటాయని పేర్కొంది. July మిగిలిన కాలంలో వచ్చిన reports మరిన్ని extensions మరియు seat types మధ్య విభజనను వివరించాయి.
అందువల్ల ఈ పేజీలో ప్రతి plan కు limit ను ఇవ్వడం లేదు. ఆ నెలలో ప్రచురించిన ఏ figure కూడా రెండు వారాలు స్థిరంగా లేదు. ఇక్కడ పాత number ఉంచడం కంటే number ఇవ్వకపోవడమే మంచిది. మీరు నిర్ణయించే రోజున plan comparison table లో Fable అని ఉన్న row ను తెరిచి చూడండి. ఏ news article లోని number అయినా outdated అని భావించండి. Fable access కోసం ఒక seat తీసుకున్న తర్వాత allowance table ఆధారంగా మీరు ఊహించిన దానికంటే తక్కువగా ఉంటే, తదుపరి renewal కు ముందు plan ను మళ్లీ దిగువ స్థాయికి మార్చడం వలన ఇప్పటికే చెల్లించిన month పై ప్రభావం ఉండదు.
స్థిరంగా ఉన్నది API rate. ఏ మార్గంలోనైనా included allowance పూర్తయిన తర్వాత, తదుపరి Fable 5 usage కు పైన ఉన్న chart లోని prices ప్రకారం bill వస్తుంది. Enterprise ఈ నిర్మాణాన్ని స్పష్టంగా చూపిస్తుంది. ఎందుకంటే Enterprise seat fee access ను కొనుగోలు చేసినప్పటికీ, tokens మాత్రం దాని పైన API rates ప్రకారం meter అవుతాయి. అందువల్ల రెండు సందర్భాల్లోనూ plan చేయడానికి price list లోని number నే ఆధారంగా తీసుకోవాలి. ఇతర Claude model కోసం API billing ను subscription తో పోల్చినప్పుడు కూడా ఇదే నిర్ణయానికి వస్తారు. మీరు ఇంకా tier ఎంచుకోకపోతే, మీ usage కు సరిపోయే Claude plan ఏది అనే దానితో ప్రారంభించండి. ఆ seat Fable కు మాత్రమే access మార్గం కాకుండా మీ రోజువారీ assistant గా కూడా ఉపయోగపడితే, commit చేయడానికి ముందు Claude plans ధరలను ChatGPT ధరలతో ఎలా పోల్చాలో పరిశీలించడం మంచిది.
ధరల నిష్పత్తి సూచించిన దానికంటే మీ బిల్లు ఎందుకు ఎక్కువగా ఉంటుంది
సూటిగా ధరలను పోల్చినప్పుడు కనిపించే దానికంటే Fable 5 ఖరీదైనదిగా మారడానికి రెండు పత్రబద్ధమైన కారణాలు ఉన్నాయి.
మొదటిది tokenizer. Fable 5, Claude Opus 4.7 తో పరిచయం చేసిన tokenizer ను ఉపయోగిస్తుంది. Opus 4.7 కంటే ముందు విడుదలైన models తో పోలిస్తే, అదే text సుమారు 30% ఎక్కువ tokens ను ఉత్పత్తి చేస్తుంది. ఖచ్చితమైన పెరుగుదల content పై ఆధారపడి ఉంటుంది. Haiku 4.5 ఆ tokenizer కు ముందు విడుదలైంది. అందువల్ల రెండు models కు ఒకే text block ను ఇస్తే, price list లోని పది రెట్ల తేడా వాస్తవానికి సుమారు పదమూడు రెట్లకు చేరుతుంది. Sonnet 5 కొత్త tokenizer ను ఉపయోగిస్తుంది. కాబట్టి Fable ను Sonnet తో పోల్చడం ప్రతి token కు న్యాయమైన పోలిక. Fable ను Haiku తో పోల్చడం అలా కాదు.
రెండవది thinking. Fable 5 లో Adaptive thinking ఎల్లప్పుడూ ఆన్లో ఉంటుంది, మరియు thinking: {"type": "disabled"} support చేయబడదు. Thinking tokens ను output tokens గా, పూర్తి output rate వద్ద bill చేస్తారు. ఈ model లో raw chain of thought ఎప్పుడూ తిరిగి ఇవ్వబడదు. thinking.display కు డిఫాల్ట్ విలువ "omitted". అందువల్ల చిన్నగా కనిపించే సమాధానానికి కూడా పెద్ద billed output count ఉండవచ్చు. Anthropic documentation దీనిని స్పష్టంగా చెబుతుంది: billed output token count, response లో కనిపించే token count తో సరిపోలదు.
ఊహించకుండా breakdown ను చూడండి. Reasoning కోసం ఎన్ని billed output tokens ఉపయోగించబడ్డాయో usage.output_tokens_details.thinking_tokens field చూపిస్తుంది:
{
"usage": {
"input_tokens": 25,
"output_tokens": 348,
"output_tokens_details": {
"thinking_tokens": 312
}
}
}Anthropic thinking documentation నుంచి తీసుకున్న ఆ ఉదాహరణలో, 348 billed output tokens లో 312 tokens ఎవరూ చూడని reasoning కోసం ఉపయోగించబడ్డాయి. మీరు stream చేసినప్పుడు, ఈ breakdown చివరి message_delta event లో మాత్రమే వస్తుంది. అందువల్ల చివరి text chunk వద్ద reading ఆపే client దీన్ని ఎప్పటికీ record చేయదు.
దీనిని నియంత్రించేది effort. ఇది output_config.effort వద్ద set చేయబడుతుంది. అందుబాటులో ఉన్న levels low, medium, high (డిఫాల్ట్), xhigh మరియు max.
{
"model": "claude-fable-5",
"max_tokens": 32000,
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "..." }]
}ఈ model కోసం Anthropic సూచన ఏమిటంటే, high తో ప్రారంభించి, అత్యధిక capability అవసరమయ్యే పనులకు మాత్రమే xhigh కు పెంచాలి. సాధారణ పనులకు medium లేదా low కు తగ్గించాలి. కారణం, Fable 5 లో తక్కువ effort తరచుగా పాత models లోని xhigh కంటే మెరుగైన ఫలితాన్ని ఇస్తుంది. దీనితో రెండు సమస్యలు వస్తాయి. Requests మధ్య effort మార్చితే మీ prompt cache చెల్లదు, ఎందుకంటే resolved effort value prompt లోకి చేర్చబడుతుంది. కాబట్టి ప్రతి workload కు ఒక level ఎంచుకుని, దానినే స్థిరంగా ఉంచండి. అలాగే max_tokens అనేది మొత్తం output కు hard cap. ఇందులో thinking మరియు response text రెండూ ఉంటాయి. అందువల్ల thinking లేని సమాధానానికి సరిపోయే cap తో thinking ఉపయోగిస్తే output truncate అవుతుంది. stop_reason: "max_tokens" కనిపిస్తే, cap ను పెంచాలి లేదా effort ను తగ్గించాలి.
పూర్తయిన పనికి అయ్యే ఖర్చు, tokenకు అయ్యే ఖర్చు కాదు
The data behind this chart
[
{
"label": "Short answer (5k in, 1k out)",
"fable_5": "0.10",
"opus_5": "0.05",
"sonnet_5": "0.02",
"haiku_4_5": "0.01"
},
{
"label": "Coding session (300k in, 40k out)",
"fable_5": "5.00",
"opus_5": "2.50",
"sonnet_5": "1.00",
"haiku_4_5": "0.50"
},
{
"label": "Long agent run (2M in, 400k out)",
"fable_5": "40.00",
"opus_5": "20.00",
"sonnet_5": "8.00",
"haiku_4_5": "4.00"
}
]ఆ 3 వరుసలు benchmark కాదు; అవి arithmetic మాత్రమే. రేట్లు ఇప్పటికే ప్రచురించబడ్డాయి. Token పరిమాణాలు అంచనాలు మాత్రమే. వాటి స్థానంలో మీ స్వంత usage data నుంచి గణాంకాలను ఉపయోగించాలి. మధ్య వరుసకు సమానమైన coding session, Fable 5లో $5.00, Sonnet 5లో $1.00 ఖర్చవుతుంది. దీర్ఘమైన runకు Fable 5లో $40.00, Sonnet 5లో $8.00 ఖర్చవుతుంది. చివరి వరుసలోని Haiku column arithmetic కోసం మాత్రమే ఉంది. Haiku 4.5లో 200k token context window ఉంది. అందువల్ల ఆ పని మొత్తాన్ని అది అసలు పట్టుకోలేదు.
నిర్ణయం తీసుకోవడానికి cost per token సరైన ప్రమాణం కాదు. పూర్తయిన ప్రతి పనికి అయ్యే ఖర్చు అంటే, ప్రతి ప్రయత్నానికి అయ్యే ఖర్చును ప్రయత్నాల సంఖ్యతో గుణించిన మొత్తం. ప్రస్తుత రేట్లలో ఒక Fable 5 ప్రయత్నానికి అయ్యే ఖర్చు, ఐదు Sonnet 5 ప్రయత్నాల ఖర్చుతో సమానం. అందువల్ల retry count ఒక్కటే upgrade చేయడానికి దాదాపు ఎప్పుడూ సరిపోదు. Token ఖర్చు పరంగా చవకైన మార్గం నష్టదాయకం కావాలంటే, Sonnet ఐదు ప్రయత్నాల్లో నాలుగు కంటే ఎక్కువ సార్లు విఫలమవ్వాలి.
దాన్ని సమర్థించేది token billలో కనిపించని మిగతా అంశాలన్నీ. Chartలోని రెండు దీర్ఘమైన runs మధ్య ఖర్చు తేడా, చాలా మార్కెట్లలో ఒక engineer గంటకు అయ్యే ఖర్చు కంటే తక్కువ. ఖరీదైన model review సమయాన్ని ఒక గంట తగ్గించినా, తరువాత సరిచేయాల్సిన ఒక తప్పు migrationను నివారించినా, saving billలో కనిపించకపోయినా అది ఇప్పటికే తన ఖర్చును తిరిగి చెల్లించినట్టే. పోలికను ఆమోదించబడిన ప్రతి ఫలితానికి అయ్యే డబ్బు ఆధారంగా చేయాలి. మొత్తం లెక్కలో మీ సమయాన్ని కూడా చేర్చాలి. ఒక million tokensతో వాస్తవంగా ఏమి పొందవచ్చో తెలుసుకోవడం ఆ అంచనాను మరింత స్పష్టంగా చేస్తుంది.
Claude Fable 5 ధరను సమర్థించే మూడు పనులు
తప్పు దారి ఖరీదైన దీర్ఘకాలిక agent runs. Fable 5 గంటల్లో కొలిచే పనుల కోసం రూపొందించబడింది: 1M token context window, ప్రతి request కు గరిష్ఠంగా 128k output tokens, అలాగే లక్షల్లో ఉండే token budgets తో ముప్పై నిమిషాలకు మించి నడిచే పనుల కోసం రూపొందించిన xhigh effort level ఇందులో ఉన్నాయి. 40వ దశలో agent తప్పు branch ఎంచుకుని, అది 300వ దశ వరకు ఎవరికీ కనిపించకపోయిన తర్వాత చేయాల్సిన cleanup ను పరిగణనలోకి తీసుకుని run ఖర్చును అంచనా వేయండి.
పెద్ద codebase అంతటా ఒకసారి మాత్రమే నిర్వహించే migration లేదా audit. ఒకసారి మాత్రమే చేసే పనికి పరిమాణం ద్వారా ఖర్చును తగ్గించే అవకాశం ఉండదు. అందువల్ల ప్రతి token కు ఉన్న అదనపు ఖర్చు ఒకే invoice పై పడుతుంది. మొత్తం పని ఒకే context window లో సరిపోవచ్చు. ఇది asynchronous గా నడపగలిగితే, Batch API ప్రతి మిలియన్ output tokens కు ఖర్చును సగానికి తగ్గించి $25 చేస్తుంది.
తక్కువ ధర గల model ఇప్పటికే రెండుసార్లు విఫలమైన task. ఆ రెండు విఫల ప్రయత్నాల ఖర్చు, వాటిని debug చేయడానికి పట్టే మీ సమయం కలిపితే, పై chart లోని volumes వద్ద ఒక Fable ప్రయత్నం కంటే ఎక్కువ అవుతుంది. కాబట్టి escalation తక్కువ ఖర్చుతో కూడిన మార్గం. Model ladder ఉద్దేశం కూడా అదే. సాధారణంగా tiers మధ్య ఇంకా ఎంపిక చేస్తుంటే, Claude model tiers మధ్య capability comparison ఈ పేజీ సమాధానం ఇచ్చే ప్రశ్నకు భిన్నమైన ప్రశ్నకు సమాధానం ఇస్తుంది.
Sonnet 5 లేదా Haiku 4.5 సరైన ఎంపిక అయ్యే మూడు పనులు
అధిక పరిమాణ classification మరియు extraction. ఈ పనులను throughput మరియు ప్రతి యూనిట్ ఖర్చు ఆధారంగా అంచనా వేస్తారు. వీటి నాణ్యత పరిమితి తక్కువగా ఉండటంతో చవకైన model ఆ స్థాయిని చేరుతుంది. Haiku 4.5 సరిగ్గా పూర్తి చేసే పనికి పది రెట్లు ధర చెల్లించినా, Fable 5 ద్వారా కొలవగల అదనపు ప్రయోజనం ఉండదు.
latency నే ఉత్పత్తిగా భావించే interactive పని. Anthropic యొక్క model table ప్రకారం Fable 5 యొక్క తులనాత్మక latency ఎక్కువగా ఉంటుంది. Thinking ను నిలిపివేయలేరు. మరింత సామర్థ్యం ఉన్న model లో chat box లేదా editor completion అనుభవం అధ్వాన్నంగా అనిపిస్తుంది, ఎందుకంటే వినియోగదారులు నాణ్యతను గుర్తించేలోపే వేచి ఉండే సమయాన్ని గమనిస్తారు.
January 2026 తర్వాతి సంఘటనలపై ఆధారపడే ఏ పని అయినా. Fable 5 యొక్క విశ్వసనీయ knowledge cutoff January 2026. Opus 5 యొక్కది May 2026. ఖరీదైన model లో ప్రస్తుత సమాచారం తక్కువగా ఉంటుంది. అందువల్ల తాజా సమాచారం కోరే ప్రశ్నల్లో search లేదా fetch tools అందించకపోతే, పాత knowledge కోసం రెట్టింపు చెల్లించాల్సి వస్తుంది.
ఒక పరిమితి ఖర్చుతో పూర్తిగా సంబంధం లేకుండా ఉంటుంది. Fable 5లో 30 day data retention ఉంటుంది. ఇది zero data retention కింద అందుబాటులో ఉండదు, ఎందుకంటే దీనిని Covered Modelగా వర్గీకరించారు. మీ agreement ప్రకారం zero retention అవసరమైతే, ఏ ధరకు అయినా Fable 5ను ఉపయోగించలేరు. ఎలాంటి discount దీనిని మార్చదు.
fable-method repos చూపించేది, చూపించనిది
Fable 5 విధానాలు ఎలా పనిచేస్తాయో సంక్షిప్తంగా వివరిస్తూ, తక్కువ ఖర్చున్న model అనుసరించగల skills గా practitionerలు repos ప్రచురించారు. fable-method repoలో ఒక thinking skill, orchestration loop, అలాగే agent ఇచ్చిన స్వంత report ను చదవకుండా, పేర్కొన్న ప్రతి check ను మళ్లీ అమలు చేసే adversarial verifier వివరించబడ్డాయి. దాని READMEలో ఇది స్పష్టంగా ఉంది: "ఇది community distillation, Anthropic artifact కాదు."
దాన్ని అంతకన్నా ఎక్కువగా పరిగణించవద్దు. ప్రజలు model ను ఎలా నడిపిస్తున్నారో దీనిలో ఆధారాలు ఉన్నాయి. కానీ model ఎలా పనిచేస్తుందో తెలిపే documentation ఇది కాదు. ఇందులోని ఏ అంశాన్నీ Anthropic validate చేయలేదు. దాదాపు ఒకేలా ఉన్న, కానీ భిన్నమైన wording కలిగిన అనేక forks కూడా ఉన్నాయి. ఇది spec కంటే folklore నుంచి వచ్చినదిగా ఉండటానికి ఇదే సరిపడే సూచన.
ఖర్చుపై నిర్ణయం తీసుకునేటప్పుడు ఉపయోగకరమైన signal ఏమిటంటే, ప్రజలు copy చేయదగినవిగా భావించిన భాగాలు procedural గా ఉండటం. Task ను classify చేయండి. అది పూర్తయిందని నిరూపించే check ను స్పష్టంగా పేర్కొనండి. నిర్ణయం తీసుకునే ముందు evidence సేకరించండి. తరువాత summary చదవడం ద్వారా కాకుండా, observation ద్వారా verify చేయండి. తక్కువ ఖర్చున్న model కు స్పష్టమైన checklist మరియు verification step ఇస్తే, పనితీరు తేడాలోని కొంత భాగాన్ని తగ్గించవచ్చు. అందువల్ల ఖరీదైన model ను standardize చేయడానికి ముందు, మీ స్వంత evaluation set పై ఈ experiment ను అమలు చేయండి. ఫలితం మీ tasks పై ఆధారపడి ఉంటుంది. అందుకే ఇతరుల సంఖ్య మీకు పెద్దగా ఉపయోగపడదు.
కట్టుబడికి ముందు మీ స్వంత సంఖ్యలను తనిఖీ చేయండి
- ప్రతి response లో
usageను చదవండి. కనిపించే output కు వేరుగాoutput_tokens_details.thinking_tokensను log చేయండి. మీరు చూడని reasoning ఖర్చులో ఊహించని అంశంగా మారుతుంది. - default ను అంగీకరించకుండా
effortను స్పష్టంగా సెట్ చేయండి. Prompt caching పై ఆధారపడే ఏ conversation లోనైనా దాన్ని స్థిరంగా ఉంచండి. - ముందుగా మీ స్థిరమైన prefix ను cache breakpoint వెనుక ఉంచండి. Base input price లో పదో వంతు ధరకు లభించే cache read, చాలా model downgrades కంటే ఎక్కువ ఆదా చేస్తుంది.
- తక్షణ సమాధానం అవసరం లేని పనులను Batch API కి తరలించండి.
- ప్రత్యామ్నాయానికి నిజాయితీగా ధరను లెక్కించండి. మీ స్వంత workload పై Claude మరియు ChatGPT API ధరలను పోల్చడం దీర్ఘకాలిక కట్టుబాటుకు ముందు ఒక మధ్యాహ్నం వెచ్చించదగిన పని.
Workload మీ స్వంత server పై నడిచే agent అయితే, అత్యంత ముఖ్యమైన నియంత్రణలు model ఎంపికకు వెలుపల ఉంటాయి. VPS పై agent ఖర్చులను నియంత్రణలో ఉంచడం runaway session ను ఆపే loop limits మరియు spend caps గురించి వివరిస్తుంది. Claude Code వాస్తవంగా ఎక్కడ tokens ఖర్చు చేస్తుంది మీ usage dashboard లో కనిపించే సంఖ్యలను వివరిస్తుంది.
FAQ
Claude Fable 5 ప్రతి మిలియన్ tokens కు ఎంత ఖర్చవుతుంది?
3 August 2026న Anthropic pricing pageలో పరిశీలించిన ప్రకారం, Claude APIలో Claude Fable 5 ధర ప్రతి మిలియన్ input tokensకు $10, ప్రతి మిలియన్ output tokensకు $50. Cache read ధర ప్రతి మిలియన్ tokensకు $1. ఇది ప్రాథమిక input రేటులో పదో వంతు. Batch API రెండు రకాలపైనా 50% తగ్గింపు ఇస్తుంది. దీంతో asynchronous పనికి ప్రతి మిలియన్ tokensకు $5 మరియు $25 చెల్లించాలి. inference_geo parameterతో inferenceను United Statesలోనే ఉంచితే ప్రతి categoryకి 1.1 times multiplier జతచేయబడుతుంది.
Claude Fable 5, Claude Pro subscriptionలో చేర్చబడిందా?
Anthropic యొక్క Claude Fable పేజీలో ఈ model Pro, Max, Team మరియు Enterprise usersకు అందుబాటులో ఉన్నట్లు ఉంది. Free plan గురించి అందులో పేర్కొనలేదు. చేర్చిన access అపరిమితం కాదు. కొన్ని seatsలో Fable weekly usage limitsలోని భాగంగా అందుతుంది. మరికొన్ని seatsలో usage credits ద్వారా అందుతుంది. ఈ విధానం July 2026లో ఒకటి కంటే ఎక్కువసార్లు మారింది. మీరు నిర్ణయం తీసుకునే రోజున Anthropic pricing pageలోని plan comparison tableలో Fable అని ఉన్న rowను చదవండి. ఏదైనా articleలోని పాత సంఖ్యపై ఆధారపడవద్దు. చేర్చిన allowance పూర్తయిన తర్వాతి usageకు API rate ప్రకారం బిల్లు వస్తుంది.
కనిపించే outputతో పోలిస్తే నా Claude Fable 5 బిల్లు ఎందుకు ఎక్కువగా ఉంది?
Claude Fable 5లో Adaptive thinking ఎల్లప్పుడూ onలో ఉంటుంది. Thinking tokensను output tokensగా bill చేస్తారు. Raw chain of thought ఎప్పటికీ తిరిగి ఇవ్వబడదు. thinking.display default విలువ omittedగా ఉన్నప్పుడు, మీరు ఖాళీ thinking fieldను చూస్తారు. అయితే దాని వెనుక జరిగిన ప్రతి reasoning tokenకు చెల్లించాలి. Responseలోని usage.output_tokens_details.thinking_tokensను చదివి ఈ విభజనను చూడండి. Streamingలో ఇది చివరి message_delta eventలో మాత్రమే వస్తుందని గమనించండి. Reasoning మరియు answer మధ్య నిష్పత్తి taskకు అవసరమైనదానికంటే ఎక్కువగా ఉంటే effort levelను తగ్గించండి.
Claude Fable 5 లేదా Claude Opus 5లో దేనిని ఉపయోగించాలి?
Claude Opus 5 ప్రతి tokenకు సగం ఖర్చవుతుంది. దీనికి మరింత తాజా reliable knowledge cutoff కూడా ఉంది: Fable 5కు January 2026 కాగా, Opus 5కు May 2026. ముందుగా Opus 5లో ప్రారంభించండి. అక్కడ task విఫలమైతే, లేదా తప్పు సమాధానం వల్ల కలిగే నష్టం ధరలోని తేడాకంటే ఎక్కువైతే Fable 5కు మారండి. ఒక తప్పు branchను సరిచేయడానికి గంటల cleanup అవసరమయ్యే long horizon agent పనులకు Claude Fable 5 సరైన ఎంపిక. అలాగే premiumను ప్రతి requestపై శాశ్వతంగా కాకుండా ఒకే invoiceపై భరించగల one off jobsకు కూడా ఇది అనుకూలం.