Claude Fable 5 ధర ఎంత మరియు ఎప్పుడు వాడాలి?
Claude Fable 5 ధర మిలియన్ ఇన్పుట్ టోకెన్లకు $10 మరియు అవుట్పుట్ టోకెన్లకు $50. ఈ ధరలు మీ ప్రాజెక్ట్ బడ్జెట్పై ఎలాంటి ప్రభావం చూపుతాయో మరియు ఏ పనులకు ఇది సరైనదో ఇక్కడ చూడండి.
Claude Fable 5 ధర ఎంత?
Claude APIలో Claude Fable 5 ధర మిలియన్ ఇన్పుట్ టోకెన్లకు $10 మరియు మిలియన్ అవుట్పుట్ టోకెన్లకు $50. ఇవి 3 ఆగస్టు 2026న ధరల పేజీ నుండి సేకరించిన Anthropic వారి అధికారిక ధరలు. దీని API మోడల్ ID claude-fable-5. ఇది 9 జూన్ 2026న Claude API, Amazon Bedrock, AWS లోని Claude Platform, Google Cloud మరియు Microsoft Foundry లలో అందుబాటులోకి వచ్చింది.
The data behind this chart
[
{
"label": "Claude Fable 5",
"input": "10",
"output": "50",
"cache_read": "1",
"batch_input": "5",
"batch_output": "25"
},
{
"label": "Claude Opus 5",
"input": "5",
"output": "25",
"cache_read": "0.50",
"batch_input": "2.50",
"batch_output": "12.50"
},
{
"label": "Claude Sonnet 5 (intro rate)",
"input": "2",
"output": "10",
"cache_read": "0.20",
"batch_input": "1",
"batch_output": "5"
},
{
"label": "Claude Sonnet 5 (from 1 Sep)",
"input": "3",
"output": "15",
"cache_read": "0.30",
"batch_input": "1.50",
"batch_output": "7.50"
},
{
"label": "Claude Haiku 4.5",
"input": "1",
"output": "5",
"cache_read": "0.10",
"batch_input": "0.50",
"batch_output": "2.50"
}
]దీనిని ఒక క్రమానుగత పట్టికగా చూడవచ్చు. Fable 5 ధర Claude Opus 5 కంటే రెండు రెట్లు, ప్రస్తుత Claude Sonnet 5 రేటు కంటే ఐదు రెట్లు మరియు Claude Haiku 4.5 కంటే పది రెట్లు ఎక్కువగా ఉంటుంది. బిల్లులోని రెండు వైపులా ఈ నిష్పత్తి సమానంగా ఉంటుంది, ఎందుకంటే ఆ పట్టికలోని ప్రతి మోడల్ తన సొంత ఇన్పుట్ రేటు కంటే ఐదు రెట్లు ఎక్కువ ధరను అవుట్పుట్ కోసం నిర్ణయిస్తుంది. కాబట్టి, ఒక పనికి ఎంత ఇన్పుట్ మరియు అవుట్పుట్ టోకెన్లు అవసరమో తెలిస్తే, ఒక ధరను గుణకారం ద్వారా మరొక ధరలోకి మార్చుకోవచ్చు.
ఒక తేదీ ఈ లెక్కలను మారుస్తుంది. Sonnet 5 ధర 31 ఆగస్టు 2026 వరకు మిలియన్ టోకెన్లకు $2 మరియు $10 గా పరిచయ ధర (introductory pricing) వద్ద ఉంది. 1 సెప్టెంబర్ 2026 నుండి దీని ధర $3 మరియు $15 గా ఉంటుంది. Fable 5 ధరలో ఎలాంటి మార్పు లేదు, కాబట్టి ఆ రోజు నుండి ఈ రెండింటి మధ్య వ్యత్యాసం ఐదు రెట్ల నుండి మూడు రెట్లకు పైగా తగ్గుతుంది. మీరు శరదృతువు (autumn) కోసం బడ్జెట్ను సిద్ధం చేస్తున్నట్లయితే, Sonnet యొక్క తర్వాతి ధరలను పరిగణనలోకి తీసుకోండి.
డిస్కౌంట్లు మరియు వ్యతిరేక దిశలో పనిచేసే ఒక మల్టిప్లైయర్
Prompt caching అనేది అత్యంత ప్రభావవంతమైన మార్గం. Cache read ధర బేస్ ఇన్పుట్ ధరలో పదో వంతు మాత్రమే ఉంటుంది, ఇది Fable 5 పై మిలియన్ టోకెన్లకు $1. Cache లోకి రాయడం (writing) సాధారణ ఇన్పుట్ టోకెన్ కంటే ఎక్కువ ఖర్చు అవుతుంది: ఐదు నిమిషాల cache కోసం బేస్ ధర కంటే 1.25 రెట్లు, ఒక గంట cache కోసం బేస్ ధర కంటే 2 రెట్లు ఉంటుంది. ఐదు నిమిషాల cache ఒక్కసారి చదివితేనే దాని ఖర్చును భర్తీ చేస్తుంది, ఒక గంట cache రెండుసార్లు చదివితే భర్తీ చేస్తుంది. మీరు ప్రతిచోటా prompt caching ను ప్రారంభించే ముందు prompt caching ఎప్పుడు లాభదాయకంగా మారుతుందో లెక్కించడం అనేదే ఈ గణితం యొక్క ముఖ్య ఉద్దేశ్యం.
Batch API ఇన్పుట్ మరియు అవుట్పుట్ రెండింటిపై 50% తగ్గింపును అందిస్తుంది, కాబట్టి batched Fable 5 పనికి మిలియన్ టోకెన్లకు $5 మరియు $25 ఖర్చవుతుంది. Batch అభ్యర్థనలు అసమకాలికంగా (asynchronous) ఉంటాయి, కాబట్టి తక్షణమే సమాధానం అవసరం లేని పనులకు మాత్రమే ఇది ఉపయోగపడుతుంది. ఈ రెండు డిస్కౌంట్లు కలిపి పనిచేస్తాయి, దీనివల్ల cached మరియు batched జాబ్ రెండు విధాలుగా చౌకగా మారుతుంది.
1M టోకెన్ కాంటెక్స్ట్ విండో Claude 4.6 మరియు తర్వాతి మోడళ్లలో ప్రామాణిక ధరలకే లభిస్తుంది. దీనికి అదనపు long context ఛార్జీలు లేవు, కాబట్టి 900k టోకెన్ల అభ్యర్థనకు కూడా 9k టోకెన్ల అభ్యర్థనకు వర్తించే అదే టోకెన్ ధర వర్తిస్తుంది.
బిల్లును పెంచే మల్టిప్లైయర్ డేటా రెసిడెన్సీ (data residency). ఇన్ఫరెన్స్ను యునైటెడ్ స్టేట్స్ లోపలే ఉంచడానికి inference_geo: "us" ను సెట్ చేస్తే, cache reads మరియు cache writes తో సహా ప్రతి టోకెన్ కేటగిరీకి 1.1 రెట్లు మల్టిప్లైయర్ వర్తిస్తుంది. కాంట్రాక్ట్ ద్వారా తప్పనిసరి కాకపోతే, డిఫాల్ట్ గ్లోబల్ రూటింగ్నే ఉంచండి.
ఒక బిల్లింగ్ నియమం ఈ మోడల్కు ప్రత్యేకమైనది. Fable 5 లో భద్రతా క్లాసిఫైయర్లు ఉంటాయి, ఇవి అభ్యర్థనను తిరస్కరించవచ్చు. అలా జరిగినప్పుడు, Messages API లోపం (error) బదులుగా stop_reason: "refusal" ను విజయవంతమైన HTTP 200 రెస్పాన్స్గా తిరిగి ఇస్తుంది, మరియు ఎటువంటి అవుట్పుట్ జనరేట్ కాకముందే తిరస్కరించబడిన అభ్యర్థనకు మీకు బిల్లు పడదు. మీరు అదే ప్రాంప్ట్ను మరొక Claude మోడల్పై మళ్ళీ ప్రయత్నిస్తే, ఫాల్బ్యాక్ క్రెడిట్ ద్వారా స్విచ్ చేసిన ప్రాంప్ట్ కాష్ ఖర్చు తిరిగి వస్తుంది, కాబట్టి ఒకే కాష్ను రెండుసార్లు సిద్ధం చేయడానికి మీరు చెల్లించాల్సిన అవసరం లేదు.
ఏ ప్లాన్లలో Claude Fable 5 అందుబాటులో ఉంది?
3 ఆగస్టు 2026 నాటికి, Anthropic యొక్క Claude Fable పేజీ ప్రకారం ఈ మోడల్ Pro, Max, Team మరియు Enterprise వినియోగదారులకు అందుబాటులో ఉంది. ఉచిత ప్లాన్ (free plan) పేరు ఇక్కడ పేర్కొనబడలేదు. ఆ జాబితాలో Pro అత్యంత తక్కువ ధర కలిగినది, కాబట్టి Pro ధర ఎంత మరియు దాని వినియోగ పరిమితులు ఎక్కడ ముగుస్తాయి అనేది Fable కోసం మీరు ఎంచుకునే సబ్స్క్రిప్షన్ మార్గానికి కనీస ధరను నిర్ణయిస్తుంది. కేవలం Fable యాక్సెస్ కోసమే మీరు అప్గ్రేడ్ అవ్వాలనుకుంటే, ముందుగా మీ సొంత వినియోగానికి Pro ప్లాన్ విలువైనదేనా అనేది ఆలోచించండి, ఎందుకంటే తక్కువ Fable పరిమితి కోసం మాత్రమే సబ్స్క్రిప్షన్ తీసుకోవడం సరైన నిర్ణయం కాకపోవచ్చు. డెవలపర్ల కోసం ఇది Claude API లో మరియు పైన పేర్కొన్న క్లౌడ్ మార్కెట్ప్లేస్ల ద్వారా సాధారణంగా అందుబాటులో ఉంది. ఆ మార్గంలో ఉచిత శ్రేణి (free tier) లేదు, కాబట్టి సైన్-అప్ సమయంలో Anthropic ఇచ్చే చిన్న క్రెడిట్ మాత్రమే మీకు లభిస్తుంది, ఆ తర్వాత బిల్లింగ్ ప్రారంభమవుతుంది.
ఒక planలో అందుబాటులో ఉండటం, ఎలాంటి పరిమితి లేకుండా చేర్చబడటం ఒకటే కాదు. అలాగే subscription వినియోగాన్ని API మాదిరిగా meter చేయదు. ఎందుకంటే Pro seatకు ప్రచురిత token quota ఏదీ లేదు. దాని బదులుగా rolling windowలో messages ఆధారంగా usageను లెక్కిస్తుంది. అందువల్ల planలోని ఏ అంశాన్నీ పై per million గణాంకాల్లోకి నేరుగా మార్చలేం.
Anthropic pricing pageలోని plan comparison table ప్రకారం, కొన్ని seatsలో Fableను weekly usage limitsలోని నిర్దిష్ట భాగం ఆధారంగా అందిస్తుంది. ఇతర seatsలో usage credits ఆధారంగా అందిస్తుంది. ఈ విధానం July 2026లో ఒకటి కంటే ఎక్కువసార్లు మారింది.
Fable 5ను మళ్లీ అందుబాటులోకి తీసుకురావడంపై Anthropic స్వయంగా విడుదల చేసిన ప్రకటన ప్రకారం, Pro, Max, Team మరియు select Enterprise plansలో 7 July 2026 వరకు weekly usage limitsలో గరిష్ఠంగా 50% వరకు ఈ modelను ఉపయోగించవచ్చు. ఆ తేదీ తర్వాత usage credits వర్తిస్తాయి. July మిగిలిన కాలానికి సంబంధించిన reportsలో మరిన్ని extensions, అలాగే seat types మధ్య విభజన ఉన్నట్లు పేర్కొన్నారు.
కాబట్టి ఈ పేజీలో ప్లాన్ వారీగా పరిమితులను ముద్రించడం లేదు. ఆ నెలలో ప్రచురించబడిన ఏ సంఖ్య కూడా రెండు వారాల కంటే ఎక్కువ కాలం నిలవలేదు, కాబట్టి పాత సంఖ్యను ఇక్కడ ఇవ్వడం కంటే ఏమీ ఇవ్వకపోవడమే మేలు. మీరు నిర్ణయం తీసుకునే రోజున ప్లాన్ పోలిక పట్టికలో Fable అని ఉన్న అడ్డు వరుసను (row) చూడండి, వార్తా కథనాల్లోని సంఖ్యలను పాతవిగా పరిగణించండి. Fable యాక్సెస్ కోసం మీరు సీటు తీసుకున్న తర్వాత, పట్టికలో చూపిన దానికంటే తక్కువ పరిమితి ఉంటే, తదుపరి రెన్యూవల్కు ముందే ప్లాన్ తగ్గించుకోవడం ద్వారా మీరు ఇప్పటికే చెల్లించిన నెల వరకు సేవలను పొందవచ్చు.
API రేటు మాత్రం స్థిరంగా ఉంటుంది. ఏ మార్గంలోనైనా, కేటాయించిన పరిమితి ముగిసిన తర్వాత, అదనపు Fable 5 వినియోగం పైన ఉన్న చార్టులోని ధరల ప్రకారం బిల్ చేయబడుతుంది. Enterprise ప్లాన్లో ఈ నిర్మాణం స్పష్టంగా ఉంటుంది, ఎందుకంటే Enterprise సీటు ఫీజు యాక్సెస్ కోసం చెల్లిస్తే, టోకెన్లు API రేట్ల ప్రకారం అదనంగా బిల్ చేయబడతాయి. దీనివల్ల ధరల జాబితానే మీరు ప్లాన్ చేసుకోవడానికి ప్రామాణికం అవుతుంది, ఇతర Claude మోడళ్ల కోసం API బిల్లింగ్ను సబ్స్క్రిప్షన్తో పోల్చినప్పుడు కూడా ఇదే ముగింపుకు వస్తారు. మీరు ఇంకా ఏ శ్రేణిని ఎంచుకోకపోతే, మీ వినియోగానికి ఏ Claude ప్లాన్ సరిపోతుందో చూడండి. ఆ సీటు కేవలం Fable కోసం మాత్రమే కాకుండా మీ రోజువారీ అసిస్టెంట్గా కూడా ఉపయోగపడాలంటే, మీరు ఒక ప్లాన్ను ఖరారు చేసుకునే ముందు Claude ప్లాన్ల ధరలను ChatGPT తో పోల్చి చూడటం మంచిది.
ధరల నిష్పత్తి సూచించిన దానికంటే మీ బిల్లు ఎందుకు ఎక్కువగా వస్తుందో తెలుసుకోండి
Fable 5 ధర నేరుగా పోల్చినప్పుడు కనిపించే దానికంటే ఎక్కువగా ఉండటానికి రెండు డాక్యుమెంట్ చేయబడిన కారణాలు ఉన్నాయి.
మొదటిది టోకెనైజర్. Fable 5, Claude Opus 4.7 తో పరిచయం చేసిన టోకెనైజర్ను ఉపయోగిస్తుంది. Opus 4.7 కి ముందు విడుదలైన మోడళ్లతో పోలిస్తే, అదే టెక్స్ట్ సుమారు 30% ఎక్కువ టోకెన్లను ఉత్పత్తి చేస్తుంది, మరియు ఈ పెరుగుదల కచ్చితంగా కంటెంట్పై ఆధారపడి ఉంటుంది. Haiku 4.5 ఆ టోకెనైజర్కు ముందు వచ్చినది, కాబట్టి మీరు రెండు మోడళ్లకు ఒకే టెక్స్ట్ బ్లాక్ను ఇచ్చినప్పుడు ధరల జాబితాలో ఉన్న పది రెట్ల వ్యత్యాసం కాస్తా పదమూడు రెట్లు అవుతుంది. Sonnet 5 కొత్త టోకెనైజర్ను ఉపయోగిస్తుంది, కాబట్టి Fable మరియు Sonnet మధ్య టోకెన్ వారీగా పోలిక సరైనదే, కానీ Fable మరియు Haiku మధ్య పోలిక సరైనది కాదు.
రెండవది థింకింగ్ (thinking). Fable 5 లో అడాప్టివ్ థింకింగ్ ఎల్లప్పుడూ ఆన్లో ఉంటుంది మరియు thinking: {"type": "disabled"} సపోర్ట్ చేయబడదు. థింకింగ్ టోకెన్లు అవుట్పుట్ టోకెన్లుగానే బిల్ చేయబడతాయి, పూర్తి అవుట్పుట్ రేటుతోనే ఛార్జ్ చేయబడతాయి. ఈ మోడల్లో ప్రాసెస్ చేయబడిన థింకింగ్ చైన్ ఎప్పటికీ తిరిగి రాదు, మరియు thinking.display డిఫాల్ట్గా "omitted" కి సెట్ చేయబడి ఉంటుంది. దీని అర్థం, మీకు కనిపించే చిన్న సమాధానం వెనుక పెద్ద మొత్తంలో బిల్ చేయబడిన అవుట్పుట్ కౌంట్ ఉండవచ్చు. Anthropic డాక్యుమెంటేషన్ దీనిని స్పష్టంగా పేర్కొంది: బిల్ చేయబడిన అవుట్పుట్ టోకెన్ కౌంట్, రెస్పాన్స్లో కనిపించే టోకెన్ కౌంట్తో సరిపోలదు.
ఊహించడం కంటే బ్రేక్డౌన్ను చదవండి. usage.output_tokens_details.thinking_tokens ఫీల్డ్ రీజనింగ్ కోసం ఎన్ని బిల్ చేయబడిన అవుట్పుట్ టోకెన్లు ఖర్చయ్యాయో తెలియజేస్తుంది:
{
"usage": {
"input_tokens": 25,
"output_tokens": 348,
"output_tokens_details": {
"thinking_tokens": 312
}
}
}Anthropic థింకింగ్ డాక్యుమెంటేషన్ నుండి తీసుకున్న ఆ ఉదాహరణలో, బిల్ చేయబడిన 348 అవుట్పుట్ టోకెన్లలో 312 టోకెన్లు ఎవరికీ కనిపించని రీజనింగ్ కోసం ఖర్చయ్యాయి. మీరు స్ట్రీమింగ్ చేస్తున్నప్పుడు, ఈ బ్రేక్డౌన్ చివరి message_delta ఈవెంట్లో మాత్రమే అందుతుంది, కాబట్టి చివరి టెక్స్ట్ చంక్ వద్ద రీడింగ్ ఆపేసే క్లయింట్ దీనిని ఎప్పటికీ రికార్డ్ చేయదు.
దీని నియంత్రణ effort ద్వారా జరుగుతుంది, ఇది output_config.effort వద్ద సెట్ చేయబడుతుంది. ఇందులో low, medium, high (డిఫాల్ట్), xhigh మరియు max స్థాయిలు ఉంటాయి.
{
"model": "claude-fable-5",
"max_tokens": 32000,
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "..." }]
}ఈ మోడల్ కోసం Anthropic ఇచ్చే సూచన ఏమిటంటే, high తో ప్రారంభించి, అత్యంత క్లిష్టమైన పనులకు మాత్రమే xhigh కి పెంచండి, మరియు సాధారణ పనుల కోసం medium లేదా low కి తగ్గించండి. ఎందుకంటే Fable 5 లో తక్కువ ఎఫర్ట్ పెట్టినా, అది పాత మోడళ్లలోని xhigh కంటే మెరుగైన ఫలితాలను ఇస్తుంది. దీనితో రెండు ఇబ్బందులు ఉన్నాయి. అభ్యర్థనల మధ్య ఎఫర్ట్ను మార్చడం వల్ల మీ ప్రాంప్ట్ క్యాష్ చెల్లదు, ఎందుకంటే నిర్ణయించబడిన ఎఫర్ట్ విలువ ప్రాంప్ట్లో రెండర్ చేయబడుతుంది. కాబట్టి ప్రతి వర్క్లోడ్కు ఒక స్థాయిని ఎంచుకుని దానినే స్థిరంగా ఉంచండి. అలాగే max_tokens అనేది మొత్తం అవుట్పుట్, థింకింగ్ మరియు రెస్పాన్స్ టెక్స్ట్ కలిపి ఒక హార్డ్ క్యాప్. కాబట్టి థింకింగ్ లేని సమాధానం కోసం సెట్ చేసిన క్యాప్, థింకింగ్ ఉన్నప్పుడు సమాధానాన్ని మధ్యలోనే కత్తిరిస్తుంది (truncate). stop_reason: "max_tokens" కనిపిస్తే, మీరు క్యాప్ను పెంచాలి లేదా ఎఫర్ట్ను తగ్గించాలి.
టోకెన్ ధర కాకుండా, పూర్తి చేసిన పనికి అయ్యే ఖర్చు
The data behind this chart
[
{
"label": "Short answer (5k in, 1k out)",
"fable_5": "0.10",
"opus_5": "0.05",
"sonnet_5": "0.02",
"haiku_4_5": "0.01"
},
{
"label": "Coding session (300k in, 40k out)",
"fable_5": "5.00",
"opus_5": "2.50",
"sonnet_5": "1.00",
"haiku_4_5": "0.50"
},
{
"label": "Long agent run (2M in, 400k out)",
"fable_5": "40.00",
"opus_5": "20.00",
"sonnet_5": "8.00",
"haiku_4_5": "4.00"
}
]3 అడ్డు వరుసలు కేవలం అంకగణిత లెక్కలే, ఇవి బెంచ్మార్క్ కాదు. ధరలు ప్రచురించబడ్డాయి. టోకెన్ పరిమాణాలు కేవలం ఊహలు మాత్రమే, వీటిని మీ సొంత వినియోగ డేటాతో భర్తీ చేసుకోవాలి. మధ్య వరుసలో ఉన్నట్లుగా ఉండే ఒక కోడింగ్ సెషన్, Fable 5 పై $5.00 ఖర్చవుతుంది, అదే Sonnet 5 పై $1.00 ఖర్చవుతుంది. సుదీర్ఘమైన పనికి Fable 5 పై $40.00 ఖర్చవుతుండగా, Sonnet 5 పై $8.00 ఖర్చవుతుంది. చివరి వరుసలోని Haiku కాలమ్ కేవలం అంకగణితం మాత్రమే: Haiku 4.5 కు 200k టోకెన్ల కాంటెక్స్ట్ విండో మాత్రమే ఉంది, కాబట్టి అది ఆ పనిని అసలు నిర్వహించలేదు.
నిర్ణయం తీసుకోవడానికి టోకెన్ ధర సరైన కొలమానం కాదు. పూర్తి చేసిన పనికి అయ్యే ఖర్చు అంటే, ఒక ప్రయత్నానికి అయ్యే ఖర్చును మొత్తం ప్రయత్నాల సంఖ్యతో గుణించడం. నేటి ధరల ప్రకారం, ఒక Fable 5 ప్రయత్నం ఖర్చు ఐదు Sonnet 5 ప్రయత్నాలతో సమానం, కాబట్టి కేవలం రీట్రై (retry) సంఖ్యను బట్టి అప్గ్రేడ్ చేయడం సమర్థనీయం కాదు. Sonnet ఐదు ప్రయత్నాలలో నాలుగు కంటే ఎక్కువసార్లు విఫలమైతేనే, తక్కువ ధర గల మోడల్ టోకెన్ల పరంగా నష్టపోతుంది.
టోకెన్ బిల్లులో కనిపించని అంశాలే అసలైన సమర్థనను చూపుతాయి. చార్టులోని రెండు సుదీర్ఘ పనుల మధ్య వ్యత్యాసం, చాలా మార్కెట్లలో ఒక గంట ఇంజనీర్ సమయం కంటే తక్కువ. ఖరీదైన మోడల్ ఒక గంట రివ్యూ సమయాన్ని ఆదా చేసినా, లేదా మీరు మళ్ళీ సరిచేయాల్సిన ఒక తప్పుడు మైగ్రేషన్ను నివారించినా, అది బిల్లులో కనిపించని ఆదా ద్వారా తన ఖర్చును ఇప్పటికే భర్తీ చేసుకున్నట్లే. ఆమోదించబడిన ఫలితంపై అయ్యే ఖర్చును లెక్కించండి, మరియు ఆ మొత్తం లెక్కలో మీ సొంత సమయాన్ని కూడా చేర్చండి. మిలియన్ టోకెన్లు వాస్తవానికి దేనికి ఉపయోగపడతాయో తెలుసుకోవడం ద్వారా ఈ అంచనా మరింత స్పష్టంగా ఉంటుంది.
Claude Fable 5 తన ధరను సమర్థించుకునే మూడు రకాల పనులు
తప్పుడు నిర్ణయం తీసుకుంటే నష్టం ఎక్కువగా ఉండే సుదీర్ఘమైన ఏజెంట్ రన్లు. Fable 5 గంటల తరబడి జరిగే పనుల కోసం రూపొందించబడింది: 1M టోకెన్ కాంటెక్స్ట్ విండో, ప్రతి అభ్యర్థనకు 128k అవుట్పుట్ టోకెన్లు, మరియు xhigh ఎఫర్ట్ లెవల్, ఇవి మిలియన్ల కొద్దీ టోకెన్ల బడ్జెట్తో ముప్పై నిమిషాలకు పైగా జరిగే పనుల కోసం ఉద్దేశించబడ్డాయి. 40వ దశకంలో ఏజెంట్ తప్పుడు మార్గంలో వెళ్తే, అది 300వ దశకం వరకు ఎవరికీ తెలియదు; అటువంటి తప్పులను సరిదిద్దే ఖర్చుతో పోలిస్తే ఈ మోడల్ రన్ ఖర్చు చాలా తక్కువ.
పెద్ద కోడ్బేస్పై ఒకేసారి చేసే మైగ్రేషన్ లేదా ఆడిట్. ఒకేసారి చేసే పనులకు ఖర్చును విభజించే అవకాశం ఉండదు, కాబట్టి ప్రతి టోకెన్కు అయ్యే అదనపు ఖర్చు ఒకే ఇన్వాయిస్పై పడుతుంది, మరియు మొత్తం పని ఒకే కాంటెక్స్ట్ విండోలో సరిపోవచ్చు. ఒకవేళ ఇది అసింక్రోనస్గా రన్ అయితే, Batch API ద్వారా దీని ధర మిలియన్ అవుట్పుట్ టోకెన్లకు $25 కి తగ్గుతుంది.
తక్కువ ధర కలిగిన మోడల్ ఇప్పటికే రెండుసార్లు విఫలమైన పని. పైన పేర్కొన్న చార్ట్లోని పరిమాణాల వద్ద, రెండుసార్లు విఫలమైన ప్రయత్నాలు మరియు మీరు వాటిని డీబగ్ చేయడానికి వెచ్చించే సమయం, ఒక Fable ప్రయత్నం కంటే ఎక్కువ ఖర్చుతో కూడుకున్నవి. సమస్యను ఉన్నత స్థాయి మోడల్కు పంపడం (Escalating) తక్కువ ఖర్చుతో కూడుకున్న పని, మోడల్ లాడర్ (model ladder) ఉద్దేశ్యం కూడా ఇదే. మీరు సాధారణంగా వివిధ మోడల్ స్థాయిల మధ్య ఎంపిక చేసుకుంటున్నట్లయితే, Claude మోడల్ స్థాయిల మధ్య సామర్థ్యాల పోలిక ఈ పేజీలో ఉన్న దానికంటే భిన్నమైన ప్రశ్నకు సమాధానాన్ని ఇస్తుంది.
Sonnet 5 లేదా Haiku 4.5 సరైన ఎంపిక అయ్యే మూడు సందర్భాలు
అధిక పరిమాణంలో వర్గీకరణ మరియు సమాచార సంగ్రహణ (High volume classification and extraction). ఈ పనులకు throughput మరియు యూనిట్ ధర ప్రామాణికాలు. వీటిలో నాణ్యతకు ఉండే పరిమితి తక్కువగా ఉంటుంది, కాబట్టి తక్కువ ధర గల మోడల్ కూడా ఆ స్థాయిని చేరుకోగలదు. Haiku 4.5 ఖచ్చితంగా పూర్తి చేయగల పనికి, Fable 5 ని ఉపయోగించి పది రెట్లు ఎక్కువ ధర చెల్లించినా అదనంగా లభించే ప్రయోజనం ఏమీ ఉండదు.
Latency ప్రధానంగా ఉండే ఇంటరాక్టివ్ పనులు. Anthropic మోడల్ టేబుల్ ప్రకారం Fable 5 యొక్క latency ఎక్కువగా ఉంటుంది, మరియు ఇందులో 'thinking' ప్రక్రియను ఆపివేయడం సాధ్యం కాదు. చాట్ బాక్స్ లేదా ఎడిటర్ కంప్లీషన్ వంటి వాటిలో, వినియోగదారులు నాణ్యత కంటే వేచి ఉండే సమయాన్నే ఎక్కువగా గమనిస్తారు కాబట్టి, ఎక్కువ సామర్థ్యం గల మోడల్ వాడటం వల్ల అనుభవం మెరుగుపడదు.
జనవరి 2026 తర్వాత జరిగిన సంఘటనలపై ఆధారపడే పనులు. Fable 5 యొక్క నమ్మదగిన నాలెడ్జ్ కటాఫ్ జనవరి 2026. Opus 5 ది మే 2026. ఖరీదైన మోడల్ పాత సమాచారాన్ని కలిగి ఉంది, కాబట్టి మీరు search లేదా fetch టూల్స్ అందించకపోతే, తాజా సమాచారం కోసం మీరు పాత జ్ఞానానికి రెట్టింపు ధర చెల్లించాల్సి వస్తుంది.
ఖర్చుతో సంబంధం లేని ఒక ముఖ్యమైన పరిమితి కూడా ఉంది. Fable 5 కి 30 రోజుల డేటా రిటెన్షన్ ఉంటుంది మరియు ఇది 'Covered Model' గా పరిగణించబడుతుంది కాబట్టి, 'zero data retention' సదుపాయం దీనికి అందుబాటులో లేదు. మీ ఒప్పందం ప్రకారం zero retention తప్పనిసరి అయితే, ఎంత ధర చెల్లించినా లేదా ఎంత డిస్కౌంట్ ఉన్నా Fable 5 ని ఉపయోగించడం సాధ్యం కాదు.
fable-method రిపోజిటరీలు ఏమి చూపుతాయి, ఏమి చూపవు
Fable 5 విధానాలు ఎలా పనిచేస్తాయో, తక్కువ ఖర్చుతో కూడిన మోడల్ అనుసరించగలిగే నైపుణ్యాలుగా మార్చి, నిపుణులు కొన్ని రిపోజిటరీలను ప్రచురించారు. fable-method repo ఒక ఆలోచనా నైపుణ్యాన్ని, ఒక ఆర్కెస్ట్రేషన్ లూప్ను, మరియు ఏజెంట్ నివేదికను చదవడానికి బదులుగా ప్రతి క్లెయిమ్ చేసిన చెక్ను మళ్లీ రన్ చేసే ఒక అడ్వర్సరీ వెరిఫైయర్ను వివరిస్తుంది. దీని README నేరుగా ఇలా చెబుతోంది: "ఇది కమ్యూనిటీ ద్వారా రూపొందించబడిన సారాంశం, Anthropic అందించినది కాదు."
దీనిని అలాగే పరిగణించండి. ఇది ప్రజలు మోడల్ను ఎలా నడిపిస్తున్నారో తెలిపే సాక్ష్యం మాత్రమే, మోడల్ ఎలా పనిచేస్తుందో వివరించే డాక్యుమెంటేషన్ కాదు. ఇందులో ఉన్న ఏదీ Anthropic ద్వారా ధృవీకరించబడలేదు. అంతేకాకుండా, వేర్వేరు పదజాలంతో దాదాపు ఒకేలా ఉండే అనేక ఫోర్కులు (forks) ఉన్నాయి; ఒక స్పెసిఫికేషన్ కంటే జానపద కథనం (folklore) నుండి మీరు ఆశించేది ఇదే.
ఖర్చు నిర్ణయం తీసుకోవడానికి పరిగణించవలసిన ముఖ్యమైన విషయం ఏమిటంటే, ప్రజలు కాపీ చేయడానికి విలువైనవిగా భావించిన భాగాలు విధానపరమైనవి (procedural). పనిని వర్గీకరించండి, అది పూర్తయిందని నిరూపించే చెక్కు పేరు పెట్టండి, నిర్ణయం తీసుకునే ముందు సాక్ష్యాలను సేకరించండి, ఆపై సారాంశాన్ని చదవడం ద్వారా కాకుండా పరిశీలన ద్వారా ధృవీకరించండి. స్పష్టమైన చెక్లిస్ట్ మరియు వెరిఫికేషన్ స్టెప్ అందించినప్పుడు తక్కువ ఖర్చుతో కూడిన మోడల్ కూడా కొంతవరకు అంతరాన్ని తగ్గిస్తుంది. కాబట్టి, ఖరీదైన మోడల్ను ప్రామాణికం చేసుకునే ముందు మీ స్వంత మూల్యాంకన సెట్పై ఆ ప్రయోగాన్ని నిర్వహించండి. ఫలితం మీ పనులపై ఆధారపడి ఉంటుంది, అందుకే ఇతరుల గణాంకాలు మీకు పెద్దగా ఉపయోగపడవు.
బడ్జెట్ను ఖరారు చేసే ముందు మీ స్వంత సంఖ్యలను తనిఖీ చేసుకోండి
- ప్రతి ప్రతిస్పందనపై
usageను చదవండి మరియు కనిపించే అవుట్పుట్ నుండిoutput_tokens_details.thinking_tokensను విడిగా లాగ్ చేయండి. మీరు చూడని రీజనింగ్ (reasoning) అనేది ప్రజలను ఆశ్చర్యపరిచే ఖర్చు అంశం. - డిఫాల్ట్ విలువను అంగీకరించే బదులు
effortను స్పష్టంగా సెట్ చేయండి మరియు ప్రాంప్ట్ క్యాషింగ్పై ఆధారపడే ఏదైనా సంభాషణలో దానిని స్థిరంగా ఉంచండి. - మీ స్థిరమైన ప్రిఫిక్స్ను ముందుగా క్యాష్ బ్రేక్పాయింట్ వెనుక ఉంచండి. బేస్ ఇన్పుట్ ధరలో పదో వంతు వద్ద క్యాష్ రీడ్ చేయడం అనేది చాలా మోడల్ డౌన్గ్రేడ్ల కంటే ఎక్కువ ఆదా చేస్తుంది.
- తక్షణ సమాధానం అవసరం లేని దేనినైనా Batch API కి తరలించండి.
- ప్రత్యామ్నాయ ధరను నిజాయితీగా అంచనా వేయండి. మీ స్వంత వర్క్లోడ్పై Claude మరియు ChatGPT API ధరల పోలిక చేయడం అనేది సుదీర్ఘ నిబద్ధతకు ముందు ఒక మధ్యాహ్నం సమయం కేటాయించదగిన పని.
వర్క్లోడ్ మీ స్వంత సర్వర్లో నడుస్తున్న ఏజెంట్ అయితే, మోడల్ ఎంపిక కంటే ముఖ్యమైన నియంత్రణలు బయట ఉంటాయి. VPSలో ఏజెంట్ ఖర్చులను నియంత్రణలో ఉంచడం అనేది రన్అవే సెషన్ను ఆపే లూప్ పరిమితులు మరియు ఖర్చు పరిమితుల గురించి వివరిస్తుంది, మరియు Claude Code వాస్తవానికి టోకెన్లను ఎక్కడ ఖర్చు చేస్తుంది అనేది మీ వినియోగ డాష్బోర్డ్లో మీరు చూసే సంఖ్యలను వివరిస్తుంది.
FAQ
Claude Fable 5 మిలియన్ టోకెన్లకు ఎంత ఖర్చవుతుంది?
Claude APIలో Claude Fable 5 ధర మిలియన్ ఇన్పుట్ టోకెన్లకు $10 మరియు మిలియన్ అవుట్పుట్ టోకెన్లకు $50 గా ఉంది, ఇది 3 ఆగస్టు 2026న Anthropic ధరల పేజీలో ధృవీకరించబడింది. Cache read ధర మిలియన్ టోకెన్లకు $1, ఇది ప్రాథమిక ఇన్పుట్ ధరలో పదో వంతు. Batch API ఇరువైపులా 50% తగ్గింపును అందిస్తుంది, దీనివల్ల అసమకాలిక (asynchronous) పనులకు మిలియన్ టోకెన్లకు $5 మరియు $25 ఖర్చవుతుంది. inference_geo పారామీటర్తో inference ను యునైటెడ్ స్టేట్స్ లోపలే ఉంచడం వల్ల ప్రతి కేటగిరీకి 1.1 రెట్లు అదనపు ధర పడుతుంది.
Claude Fable 5, Claude Pro సబ్స్క్రిప్షన్లో అందుబాటులో ఉందా?
Anthropic యొక్క Claude Fable పేజీ ఈ మోడల్ Pro, Max, Team మరియు Enterprise వినియోగదారులకు అందుబాటులో ఉందని పేర్కొంది, ఉచిత ప్లాన్ గురించి ఎక్కడా చెప్పలేదు. ఇందులో లభించే యాక్సెస్ అపరిమితం కాదు. కొన్ని ఖాతాలకు Fable వారపు వినియోగ పరిమితుల్లో భాగంగా లభిస్తుంది, మరికొన్నింటికి వినియోగ క్రెడిట్ల ద్వారా లభిస్తుంది; జూలై 2026లో ఈ విధానం ఒకటి కంటే ఎక్కువసార్లు మారింది. ఏదైనా వ్యాసంలోని గణాంకాలను నమ్మే బదులు, మీరు నిర్ణయం తీసుకునే రోజున Anthropic ధరల పేజీలోని ప్లాన్ పోలిక పట్టికలో Fable అని ఉన్న అడ్డు వరుసను చూడండి. కేటాయించిన పరిమితి ముగిసిన తర్వాత, తదుపరి వినియోగానికి API ధర ప్రకారం బిల్లు పడుతుంది.
నా Claude Fable 5 బిల్లు, కనిపిస్తున్న అవుట్పుట్ కంటే ఎందుకు ఎక్కువగా ఉంది?
Claude Fable 5 కోసం Adaptive thinking ఎల్లప్పుడూ ఆన్లో ఉంటుంది, thinking టోకెన్లు అవుట్పుట్ టోకెన్లుగానే బిల్లు చేయబడతాయి మరియు ఆ raw chain of thought ఎప్పటికీ వినియోగదారుకు తిరిగి రాదు. thinking.display దాని డిఫాల్ట్ విలువ omitted వద్ద ఉన్నప్పుడు, మీరు ఖాళీ thinking ఫీల్డ్ను చూస్తారు కానీ దాని వెనుక ఉన్న ప్రతి reasoning టోకెన్కు చెల్లిస్తారు. విభజనను చూడటానికి ప్రతిస్పందనలో usage.output_tokens_details.thinking_tokens ను చదవండి, మరియు streaming చేస్తున్నప్పుడు ఇది కేవలం చివరి message_delta ఈవెంట్లో మాత్రమే వస్తుందని గమనించండి. ఒకవేళ reasoning మరియు సమాధానం మధ్య నిష్పత్తి అవసరానికి మించి ఎక్కువగా ఉంటే effort స్థాయిని తగ్గించండి.
నేను Claude Fable 5 వాడాలా లేక Claude Opus 5 వాడాలా?
Claude Opus 5 ధర టోకెన్కు సగం మాత్రమే ఉంటుంది మరియు దీనికి Fable 5 (జనవరి 2026) తో పోలిస్తే మరింత ఇటీవలి నమ్మదగిన నాలెడ్జ్ కటాఫ్ (మే 2026) ఉంది. Opus 5 తో ప్రారంభించండి, అక్కడ ఏదైనా పని విఫలమైనప్పుడు లేదా తప్పుడు సమాధానం వల్ల ధర వ్యత్యాసం కంటే ఎక్కువ నష్టం వాటిల్లినప్పుడు Fable 5 కి మారండి. ఒక తప్పుడు నిర్ణయం గంటల కొద్దీ పనిని వృథా చేసే సుదీర్ఘ ఏజెంట్ పనులకు, మరియు ప్రతి అభ్యర్థనపై కాకుండా ఒకేసారి బిల్లు పడే పనులకు Fable 5 సరైన ఎంపిక.