SSD Nodes Learn Hosting plans →
మార్గదర్శకాలు Matt Connorద్వారా Matt Connor · అప్‌డేట్ చేయబడింది 2026-08-27

ఏ Claude మోడల్ ఎంచుకోవాలి? ధరల పూర్తి వివరాలు

Claude Opus 4.8, Sonnet 5, Haiku 4.5 మోడల్స్ మధ్య తేడాలు ఏమిటి? 2026 జూలై నాటి API ధరలు, 1,00,000 పనుల ఖర్చు విశ్లేషణ మరియు మీ బిల్లును తగ్గించే ముఖ్యమైన సెట్టింగ్స్ ఇక్కడ చూడండి.

నేను ఏ Claude మోడల్‌ను ఉపయోగించాలి?

మీరు ఏ Claude మోడల్‌ను ఉపయోగించాలనే ప్రశ్నకు క్లుప్త సమాధానం: Claude Opus 4.8 తో ప్రారంభించండి, ఒక నిర్దిష్ట కారణం ఉంటే తప్ప దాని నుండి మారకండి. Anthropic మార్గదర్శకం కూడా ఇదే. "ఏ మోడల్ ఉపయోగించాలో మీకు తెలియకపోతే, సంక్లిష్టమైన ఏజెంటిక్ కోడింగ్ మరియు ఎంటర్‌ప్రైజ్ పనుల కోసం Claude Opus 4.8 తో ప్రారంభించండి." పని బాగా నిర్వచించబడి, మీరు దానిని రోజుకు అనేకసార్లు చేస్తున్నప్పుడు Claude Sonnet 5 కి మారండి. సరైన సమాధానం ఎలా ఉంటుందో మీకు ఇప్పటికే తెలిసిన యాంత్రికమైన, అధిక-వాల్యూమ్ పనుల కోసం Claude Haiku 4.5 కి మారండి. సుదీర్ఘకాలం నడిచే ఏజెంట్ల కోసం Claude Fable 5 వీటి అన్నింటికంటే పైన ఉంటుంది.

ఈ ఎంపికకు ధర ఉంటుంది. 23 July 2026 నాటికి Claude API (application programming interface) రేట్లు మిలియన్ టోకెన్లకు (MTok అని పిలుస్తారు) ఈ క్రింది విధంగా ఉన్నాయి:

  • Claude Fable 5 (claude-fable-5): $10 / MTok in, $50 / MTok out. 1M context.
  • Claude Opus 4.8 (claude-opus-4-8): $5 in, $25 out. 1M context.
  • Claude Opus 4.7 (claude-opus-4-7): $5 in, $25 out. 1M context.
  • Claude Sonnet 5 (claude-sonnet-5): 31 August 2026 వరకు పరిచయ ధరగా $2 in, $10 out. 1 September 2026 నుండి ప్రామాణిక ధర $3 in, $15 out వర్తిస్తుంది. 1M context.
  • Claude Haiku 4.5 (claude-haiku-4-5): $1 in, $5 out. 200K context.

ఆ ఐడెంటిఫైయర్‌లు పైన రాసినట్లుగా పూర్తిస్థాయిలో ఉంటాయి. వాటికి అదనంగా ఏమీ చేర్చబడదు.

1M-token మోడళ్లపై పరిమాణానికి అదనపు ఛార్జీ ఉండదు: "900k-token అభ్యర్థనకు, 9k-token అభ్యర్థనకు ఉన్న అదే ప్రతి-token రేటు వర్తిస్తుంది." ఈ రేట్లు APIకి మాత్రమే పరిమితం కావు. ఎందుకంటే Claude Enterprise seat ధరకు అదనంగా API రేట్ల ప్రకారం వినియోగాన్ని లెక్కిస్తుంది. కాబట్టి seat plan ఉపయోగించే బృందానికి కూడా క్రింద ఉన్న లెక్కలన్నీ ఇదే విధంగా వర్తిస్తాయి. Flat-rate subscription మీటర్‌ను మారుస్తుంది, కానీ ఈ నిర్ణయాన్ని మార్చదు. ఎందుకంటే రెండు Claude Max tiers లోనూ ఒకే మోడళ్లు ఉంటాయి; వాటి మధ్య తేడా మీకు లభించే వినియోగ పరిమాణంలో మాత్రమే ఉంటుంది. అదే శ్రేణిలో మరింత దిగువన, Claude Pro యొక్క నెలకు $20 ధర ప్రతి-token రేటుకు బదులుగా usage allowance ను అందిస్తుంది. అందువల్ల అక్కడ మిమ్మల్ని ఆపేది bill కాదు; limit reset కోసం వేచి ఉండాల్సి వస్తుంది. ప్రస్తుతం మీరు ఆ స్థాయిలో ఉంటే, మీరు ఏ window కోసం వేచి చూస్తున్నారో నిర్ణయించడం క్రింద ఉన్న లెక్కలకన్నా ముందుగా చేయాలి. ఎందుకంటే దానికి పరిష్కారం తక్కువ-పరిమాణ మోడల్, చిన్న context లేదా APIకి మారడం; తక్కువ రేటు కాదు. మీరు ఇంకా చెల్లించడం ప్రారంభించకపోతే, మొదటగా Pro కోసం $20 చెల్లించడం విలువైనదేనా అన్నది పై రేట్లపై కాకుండా, free limit మిమ్మల్ని ఎంత తరచుగా ఆపుతుందనే దానిపై ఆధారపడి ఉంటుంది.

ప్రతి మోడల్ దేనికోసం ఉద్దేశించబడింది

Anthropic ప్రతి మోడల్‌ను ఒక్కో వాక్యంలో వివరిస్తుంది, లీడర్‌బోర్డ్‌ల కంటే ఈ వివరణలే మెరుగైన మార్గదర్శకాలుగా పనిచేస్తాయి.

  • Claude Fable 5: "సుదీర్ఘకాలం నడిచే ఏజెంట్ల కోసం తదుపరి తరం మేధస్సు." ఈ నాలుగింటిలో ఇది అత్యంత నెమ్మదైనదిగా పరిగణించబడుతుంది.
  • Claude Opus 4.8: "సంక్లిష్టమైన ఏజెంటిక్ కోడింగ్ మరియు ఎంటర్‌ప్రైజ్ పనుల కోసం." దీని latency మధ్యస్థంగా ఉంటుంది.
  • Claude Sonnet 5: "వేగం మరియు మేధస్సుల ఉత్తమ కలయిక." ఇది వేగవంతమైనది.
  • Claude Haiku 4.5: "సరిహద్దు స్థాయి మేధస్సుతో కూడిన అత్యంత వేగవంతమైన మోడల్."

ఈ నాలుగింటిలో Fable 5 మాత్రమే ఈ పోలికలో ఎటువంటి వర్క్‌లోడ్ ధరను కలిగి లేదు, మరియు Opus 4.8 ధర కంటే ఐదు రెట్లు ఎక్కువ ధర ఉన్నందున, $10 ఇన్ మరియు $50 అవుట్ ఇచ్చే పనులు ఏవి అనే ప్రశ్నకు ప్రత్యేక సమాధానం అవసరం.

Haiku 4.5 ధర కంటే ముందే పనికి సరిపోతుందో లేదో నిర్ణయించే పరిమితులను కలిగి ఉంది. దీని context window 1M కు బదులుగా 200K tokens మాత్రమే, కాబట్టి పెద్ద repository లేదా సుదీర్ఘమైన ఏజెంట్ ట్రాన్స్‌క్రిప్ట్ ఇందులో సరిపోవు. synchronous Messages API పై దీని గరిష్ట అవుట్‌పుట్ 64K tokens, మిగిలిన వాటికి ఇది 128K గా ఉంది. దీని నమ్మదగిన knowledge cutoff ఫిబ్రవరి 2025, మిగిలిన మూడు మోడల్స్ జనవరి 2026 వరకు సమాచారాన్ని కలిగి ఉన్నాయి.

నిజమైన పనిభారంపై ఈ ఎంపిక వల్ల నాకు అయ్యే ఖర్చు ఎంత?

ఈ శ్రేణిలోని ప్రతి మోడల్ ఇన్‌పుట్ రేటు కంటే అవుట్‌పుట్ రేటును ఐదు రెట్లు ఎక్కువగా నిర్ణయిస్తుంది. Opus 4.8 ఇన్‌పుట్ $5 మరియు అవుట్‌పుట్ $25. Haiku 4.5 ఇన్‌పుట్ $1 మరియు అవుట్‌పుట్ $5. ఈ నిష్పత్తి మొత్తం శ్రేణిలో స్థిరంగా ఉంటుంది, కాబట్టి ఎక్కువ అవుట్‌పుట్‌ను ఉత్పత్తి చేసే పనుల విషయంలో మీరు ఎంచుకునే మోడల్ చాలా కీలకం.

ఏజెంటిక్ (Agentic) పనులు అటువంటి రకానికి చెందినవి, ఎందుకంటే థింకింగ్ టోకెన్లు అవుట్‌పుట్ టోకెన్లుగా బిల్ చేయబడతాయి మరియు టెక్స్ట్ మీకు చేరకపోయినా కూడా అవి max_tokens లో లెక్కించబడతాయి. Fable 5, Opus 4.8, Opus 4.7 మరియు Sonnet 5 లలో రీజనింగ్ సమ్మరీ డిఫాల్ట్‌గా మినహాయించబడుతుంది, కాబట్టి thinking ఫీల్డ్ ఖాళీగా వస్తుంది. బిల్లింగ్‌లో ఎటువంటి మార్పు ఉండదు: "ఏది ఏమైనప్పటికీ, మల్టీ-టర్న్ సంభాషణలలో ఈ బ్లాక్ ఒకే విధంగా బిల్ చేయబడుతుంది మరియు అదే విధంగా తిరిగి పంపబడుతుంది." Claude టోకెన్ బిల్లును ఏవి నింపుతాయి అనే అంశం ఆ మీటరింగ్ విధానాన్ని పూర్తిగా వివరిస్తుంది.

మీరు పోల్చుతున్న మోడళ్ల మధ్య థింకింగ్ రన్ అవుతుందా లేదా అనేది మారుతూ ఉంటుంది, దీనిని గమనించకపోతే ఖర్చు పరీక్ష విఫలమవుతుంది. Sonnet 5 మరియు Fable 5 లలో థింకింగ్ ఇప్పటికే ఆన్‌లో ఉంటుంది మరియు దానికి ఎటువంటి కాన్ఫిగరేషన్ అవసరం లేదు. Opus 4.8 మరియు Opus 4.7 లలో మీరు రిక్వెస్ట్‌లో thinking: {type: "adaptive"} సెట్ చేసే వరకు అది ఆఫ్‌లో ఉంటుంది. సంఖ్యలను విశ్లేషించే ముందు రెండు వైపులా కాన్ఫిగరేషన్‌ను సరిపోల్చండి.

అత్యంత చౌకైన మోడల్ ఎందుకు అత్యంత ఖరీదైనదిగా మారవచ్చు

ఒక స్వయం-సమగ్రమైన కోడింగ్ పనిని తీసుకోండి. ఈ అభ్యర్థన 60,000 tokens సందర్భాన్ని కలిగి ఉంది, మరియు ఆలోచనతో కలిపి మోడల్ 8,000 tokens అవుట్‌పుట్‌ను ఇస్తుంది. Caching లేదు, కాబట్టి గణన స్పష్టంగా కనిపిస్తుంది.

Opus 4.8 పై: $5 ధర వద్ద 0.06 MTok ఇన్‌పుట్ $0.30 అవుతుంది, మరియు $25 ధర వద్ద 0.008 MTok అవుట్‌పుట్ $0.20 అవుతుంది. ఈ ప్రయత్నానికి $0.50 ఖర్చవుతుంది. Haiku 4.5 పై అదే ప్రయత్నానికి $0.06 మరియు $0.04, అంటే మొత్తం $0.10 ఖర్చవుతుంది.

Haiku ప్రతి ప్రయత్నానికి ఐదు రెట్లు చౌకగా ఉంటుంది, ఇది విఫలమైన ప్రయత్నం ఏమి చేస్తుందో గమనించే వరకు చాలా ఆదాగా అనిపిస్తుంది. మీరు తప్పు సమాధానాన్ని చదువుతారు, దీనికి మీ సమయం ఖర్చవుతుంది. మీరు దానిని మళ్ళీ ప్రయత్నంలో సందర్భం (context) గా పంపుతారు, కాబట్టి ప్రతి ప్రయత్నం మునుపటి కంటే పెద్దదిగా మారుతుంది. మూడవ ప్రయత్నం కూడా విఫలమైతే, మీరు ఎలాగూ Opus కు మారుతారు: Haiku కోసం $0.30 మరియు Opus కోసం $0.50 కలిపి $0.80 అవుతుంది, ఇది Opus ను ఒకసారి ఉపయోగించడం కంటే 60% ఎక్కువ.

కాబట్టి, నిర్ణయాత్మక ప్రశ్న ఏమిటంటే మీరు సమాధానాన్ని ఎంత చౌకగా తనిఖీ చేయగలరు అనేది. తప్పు సమాధానం ఒక సెకనులో స్పష్టంగా తెలిసినప్పుడు, చిన్న మోడల్ లాభదాయకం. తప్పును గుర్తించడానికి diff ను జాగ్రత్తగా చదవాల్సి వచ్చినప్పుడు, చిన్న మోడల్ మీకు ఇన్వాయిస్‌లో కనిపించని సమయాన్ని ఖర్చు చేస్తుంది.

చిన్న మోడల్ ఎక్కడ స్పష్టంగా విజయం సాధిస్తుంది

ఈ సందర్భాలలో Haiku 4.5 సరైన ఎంపిక:

  • మెకానికల్ సబ్-ఏజెంట్ పనులు. ఫైళ్లను రీనేమ్ చేసే లేదా సెర్చ్ అవుట్‌పుట్‌ను సేకరించే సబ్-ఏజెంట్‌కు ఫ్రాంటియర్ రీజనింగ్ అవసరం లేదు. మీరు Claude తో AI ఏజెంట్‌ను నిర్మించి దానికి సహాయకాలను అందించినప్పుడు ఇది సాధారణ పద్ధతి.
  • లాగ్ ట్రయాజ్ (Log triage). ఒక లైన్ అనవసరమైనదా లేక మనిషి దృష్టికి అవసరమైనదా అని నిర్ణయించడం అనేది స్పష్టమైన ఫెయిల్యూర్ మోడ్ కలిగిన ఒక చిన్న నిర్ణయం.
  • నిర్ణీత లేబుల్ సెట్‌తో వర్గీకరణ. అవుట్‌పుట్ చిన్నదిగా ఉంటుంది మరియు నమూనాపై ఖచ్చితత్వాన్ని కొలవవచ్చు.
  • అధిక వాల్యూమ్ ప్రొడక్షన్ కాల్స్. రోజుకు 100,000 రన్‌ల వద్ద, ప్రతి టోకెన్ వ్యత్యాసం కేవలం రౌండింగ్ ఎర్రర్‌గా మిగిలిపోదు. n8n లో అనుసంధానించబడిన AI వర్క్‌ఫ్లోల సాధారణ రూపం ఇదే.
  • వినియోగదారుకు ప్రతిస్పందన వేగం ముఖ్యమైన ఏదైనా పని. Haiku 4.5 లైనప్‌లో అత్యంత వేగవంతమైన మోడల్‌గా రేట్ చేయబడింది.

Haiku కు సంబంధించి ఒక పరిమితి ఉంది. దీని కనీస క్యాచబుల్ ప్రాంప్ట్ 4,096 టోకెన్లు, అదే Opus 4.8 మరియు Sonnet 5 లలో ఇది 1,024 టోకెన్లు. ఈ కనిష్ట పరిమితి కంటే తక్కువ ఉంటే "ఈ సంఖ్య కంటే తక్కువ టోకెన్లను కాష్ చేయడానికి చేసే ఏ అభ్యర్థనలైనా కాషింగ్ లేకుండానే ప్రాసెస్ చేయబడతాయి మరియు ఎటువంటి ఎర్రర్ తిరిగి రాదు". Sonnet 5 లో కాష్ అయ్యే 1,500-టోకెన్ల ఇన్‌స్ట్రక్షన్ బ్లాక్, Haiku 4.5 లో సైలెంట్‌గా కాష్ అవ్వదు. దీనికి సంకేతం cache_creation_input_tokens మరియు cache_read_input_tokens రెండూ సున్నా వద్ద ఉండటం, దీని గురించి ఎల్లప్పుడూ ఆన్‌లో ఉండే ఏజెంట్ ఖర్చులను తగ్గించుకోవడం అనే విభాగంలో కాష్‌ను కోల్పోయే ఇతర మార్గాలతో పాటు వివరించబడింది.

సమాధానాన్ని మార్చే అంశాలు

వీటిలో ప్రతి ఒక్కటి మోడల్ పేరు కంటే బిల్లుపై ఎక్కువ ప్రభావాన్ని చూపుతాయి.

Effort. మోడల్ సమాధానం ఇచ్చే ముందు ఎంత పని చేయాలో output_config.effort నియంత్రిస్తుంది. దీని స్థాయిలు low, medium, high, xhigh మరియు max, ఇందులో high డిఫాల్ట్: "effort ను high కి సెట్ చేయడం అనేది effort పారామీటర్‌ను పూర్తిగా వదిలేయడంతో సమానమైన ప్రవర్తనను ఇస్తుంది." ఇది అభ్యర్థన యొక్క టాప్ లెవల్‌లో కాకుండా output_config లోపల ఉంటుంది:

response = client.messages.create(
    model="claude-sonnet-5",
    max_tokens=4096,
    output_config={"effort": "medium"},
    messages=messages,
)

Effort ప్రతి రెస్పాన్స్ టోకెన్‌పై ప్రభావం చూపుతుంది: "ఇది టూల్ కాల్‌లతో సహా అన్ని టోకెన్ ఖర్చులను ప్రభావితం చేయగలదు. ఉదాహరణకు, తక్కువ effort అంటే Claude తక్కువ టూల్ కాల్‌లను చేస్తుంది." ఇది ఏజెంటిక్ లూప్‌పై ప్రభావం చూపుతుంది. ఇది టోకెన్ క్యాప్ కాదు: "Effort అనేది ప్రవర్తనా సంకేతం, కఠినమైన టోకెన్ బడ్జెట్ కాదు." Anthropic ప్రతి స్థాయికి ఎటువంటి ఖర్చు మల్టిప్లైయర్‌ను ప్రచురించదు మరియు మీ స్వంత వినియోగ సందర్భాన్ని పరీక్షించమని సూచిస్తుంది, కాబట్టి high వద్ద Sonnet 5 రన్ మరియు low వద్ద Opus 4.8 రన్ మధ్య పోలికను మీరు ఈరోజే పరీక్షించవచ్చు. effort కు మద్దతు ఇచ్చే మోడళ్ల జాబితాలో Haiku 4.5 లేదు.

Prompt caching. ఒక కాష్ రీడ్ బేస్ ఇన్‌పుట్ రేటులో 0.1x ఖర్చు అవుతుంది, మరియు మోడల్ ఎంపికను నిర్ణయించే సంఖ్య వివిధ స్థాయిలలో ఇది ఎలా పనిచేస్తుందనే దానిపై ఆధారపడి ఉంటుంది. Opus 4.8 పై కాష్ హిట్ $0.50 / MTok ఖర్చవుతుంది, మరియు Haiku 4.5 పై అన్‌కాష్డ్ ఇన్‌పుట్ $1 / MTok ఖర్చవుతుంది, కాబట్టి బాగా కాష్ చేయబడిన Opus ప్రిఫిక్స్, కోల్డ్ Haiku ప్రాంప్ట్ కంటే ఇన్‌పుట్ టోకెన్‌కు చౌకగా ఉంటుంది. పెద్ద స్థిరమైన ప్రిఫిక్స్‌ను పదేపదే పంపే ఏ వర్క్‌లోడ్‌లోనైనా సెషన్ హైజీన్, మోడల్ ఎంపిక కంటే మెరుగైన ఫలితాలను ఇస్తుంది.

Batches. సమాధానం కోసం వేచి ఉండాల్సిన అవసరం లేకపోతే, Message Batches API అదే మోడళ్లను "ఇన్‌పుట్ మరియు అవుట్‌పుట్ టోకెన్‌లపై 50% తగ్గింపుతో" రన్ చేస్తుంది. ఇది క్రింద ఉన్న పోలికలోని ప్రతి అడ్డు వరుసను సగానికి తగ్గిస్తుంది, మరియు ఇది అన్ని స్థాయిలలో పనిచేస్తుంది: 1 సెప్టెంబర్ 2026 నుండి ప్రామాణిక ధర వద్ద ఒక బ్యాచ్డ్ Opus 4.8 జాబ్, సింక్రోనస్ Sonnet 5 జాబ్ కంటే తక్కువ ఖర్చు అవుతుంది, తద్వారా అదే ధరకు సామర్థ్యం కోసం లాటెన్సీని సర్దుబాటు చేసుకోవచ్చు.

ఒక పనికి అయ్యే ఖర్చుల పోలిక

పని భారం: 100,000 సపోర్ట్ ఈమెయిల్స్‌ను వర్గీకరించడం. ఒక్కో కాల్‌కు 2,000 ఇన్‌పుట్ టోకెన్లు మరియు 300 అవుట్‌పుట్ టోకెన్లు. అంటే మొత్తం 200 MTok ఇన్‌పుట్ మరియు 30 MTok అవుట్‌పుట్.

  • Haiku 4.5: 200 x $1 = $200 ఇన్‌పుట్, 30 x $5 = $150 అవుట్‌పుట్. మొత్తం $350.
  • Sonnet 5, ప్రారంభ ధర: 200 x $2 = $400 ఇన్‌పుట్, 30 x $10 = $300 అవుట్‌పుట్. మొత్తం $700.
  • Sonnet 5, 1 సెప్టెంబర్ 2026 నుండి: 200 x $3 = $600 ఇన్‌పుట్, 30 x $15 = $450 అవుట్‌పుట్. మొత్తం $1,050.
  • Opus 4.8: 200 x $5 = $1,000 ఇన్‌పుట్, 30 x $25 = $750 అవుట్‌పుట్. మొత్తం $1,750.

భవిష్యత్తు ధరలతో లెక్కించడానికి నాలుగు సంఖ్యలను మార్చండి. కింద పేర్కొన్న సర్దుబాట్లు మోడల్ పేరు కంటే ఎక్కువ ప్రభావాన్ని చూపుతాయి:

  • Batching ప్రతి లైన్ ఖర్చును సగానికి తగ్గిస్తుంది: $175, $350, $525 మరియు $875. రాత్రిపూట జరిగే వర్గీకరణ ప్రక్రియ కోసం వేచి ఉండాల్సిన అవసరం లేదు కాబట్టి, దీన్ని వదిలివేయడానికి కారణం లేదు.
  • ఉమ్మడి ప్రిఫిక్స్‌ను కాష్ చేయడం (Caching). ప్రతిసారీ 2,000 ఇన్‌పుట్ టోకెన్లలో 1,200 టోకెన్లు ఒకే రకమైన ఇన్‌స్ట్రక్షన్ బ్లాక్ అనుకుందాం. Sonnet 5 ప్రారంభ ధర వద్ద, ఇవి $2 / MTok కు బదులుగా $0.20 / MTok (cache hits) ఖర్చవుతాయి. కాబట్టి 120 MTok కు $240 కి బదులుగా $24 ఖర్చవుతుంది. దీనికి $2 చొప్పున 80 MTok కొత్త ఇన్‌పుట్ ($160) మరియు $300 అవుట్‌పుట్ కలిపితే, Sonnet 5 ఖర్చు $700 కు బదులుగా $484 దగ్గర ఉంటుంది. Haiku 4.5 లో ఈ పద్ధతి పనిచేయదు, ఎందుకంటే 1,200 టోకెన్లు దాని 4,096-టోకెన్ కనీస పరిమితి కంటే తక్కువ.
  • రీట్రైలు (Retries). Haiku ఇచ్చిన సమాధానాలను 8% ఈమెయిల్స్‌లో తిరస్కరించి, వాటిని Opus 4.8 పై మళ్ళీ రన్ చేస్తున్నారని అనుకుందాం. $350 కి 0.08 x $1,750 = $140 కలిపితే, మొత్తం $490 అవుతుంది. నా అంచనాను కాకుండా, మీ స్వంత తిరస్కరణ రేటును లెక్కించండి.
  • టూల్ డెఫినిషన్లు, ఒకవేళ పనిలో వాటిని ఉపయోగిస్తే. Opus 4.8 లో tool_choice ను auto గా సెట్ చేసినప్పుడు సిస్టమ్ ప్రాంప్ట్ 290 టోకెన్లు, Sonnet 5 లో 354 టోకెన్లు మరియు Haiku 4.5 లో 496 టోకెన్లు ఉంటాయి. తక్కువ ధర కలిగిన మోడల్ ఎక్కువ స్థిరమైన ఓవర్‌హెడ్‌ను కలిగి ఉంటుంది.

$490 ఖర్చయ్యే ఎస్కలేషన్ పాత్‌తో కూడిన Haiku మరియు $484 ఖర్చయ్యే కాష్ చేసిన Sonnet 5 దాదాపు ఒకే ధరలో ఉన్నాయి. వీటిలో ఒకటి మాత్రమే పనిని ఒకేసారి పూర్తి చేస్తుంది. మోడల్ ఎంపిక మాత్రమే పూర్తి పరిష్కారం కాదు.

సెషన్ మధ్యలో మోడల్స్‌ను మార్చడం వల్ల డబ్బు ఆదా అవుతుందా?

స్టిక్కర్ ధరలు సూచించిన దానికంటే తక్కువ సందర్భాల్లోనే ఇది ఆదా అవుతుంది, ఎందుకంటే ఆదా అనేది ప్రతి టోకెన్‌కు లెక్కించబడుతుంది, కానీ మీరు రిస్క్ చేసేది మొత్తం cached prefix ను.

Cache ను ఏది చెల్లుబాటు కాకుండా చేస్తుందో Anthropic డాక్యుమెంట్ చేసింది. Prefixes అనేవి tools, ఆపై system, ఆపై messages క్రమంలో నిర్మించబడతాయి, మరియు "ప్రతి స్థాయిలో మార్పులు ఆ స్థాయిని మరియు తదుపరి అన్ని స్థాయిలను చెల్లుబాటు కాకుండా చేస్తాయి." రెండు అభ్యర్థన సెట్టింగ్‌లు కూడా ఆ జాబితాలో ఉన్నాయి: "Thinking configuration మరియు resolved effort స్థాయి ప్రాంప్ట్‌లోనే రెండర్ చేయబడతాయి, కాబట్టి వాటిలో దేనిని మార్చినా కొత్త cache prefix ప్రారంభమవుతుంది." Effort విషయంలో డాక్యుమెంట్స్ ఇంకా ఇలా చెబుతున్నాయి: "cache hits పై ఆధారపడే సంభాషణలో కాకుండా, పనిభారాన్ని బట్టి effort ను మార్చండి."

ఆ డాక్యుమెంట్ చేసిన జాబితాలో మోడల్ లేదు, కాబట్టి ఏ విధంగానూ ఊహించవద్దు. స్విచ్ చేసిన తర్వాత మొదటి అభ్యర్థనపై cache_read_input_tokens ను చదవండి మరియు ఆ సంఖ్యనే సమాధానాన్ని చెప్పనివ్వండి. 150,000-token Opus 4.8 prefix పై cache read సుమారు $0.08 ఖర్చవుతుంది మరియు కొత్త write సుమారు $0.94 ఖర్చవుతుంది, ఇది మీరు ఆశిస్తున్న ప్రతి-టోకెన్ వ్యత్యాసం కంటే ఎక్కువ.

కాబట్టి వీటిని పనుల మధ్య మార్చండి, ఒక పని లోపల కాదు. Claude Code లో దీని అర్థం, cache ఇప్పటికే తొలగించబడుతున్నప్పుడు మొదట /clear, ఆపై /model లేదా /effort అని అర్థం. ఇవి రెండూ CLI లో టైప్ చేయబడతాయి, కాబట్టి మీరు Linux లో పని చేస్తుంటే, Anthropic Linux కోసం స్థానికంగా అందించేది స్థిరమైన CLI ని ఇంకా బీటాలో ఉన్న డెస్క్‌టాప్ యాప్‌తో జత చేస్తుంది కాబట్టి, టెర్మినల్ వెర్షన్‌ను ఇన్‌స్టాల్ చేసుకోవడం మంచిది. ఆ మార్పు బిల్లులో కనిపిస్తుందా లేదా అనేది మీరు ఆ సెషన్ కోసం ఎలా చెల్లిస్తున్నారనే దానిపై ఆధారపడి ఉంటుంది, ఎందుకంటే Claude Code నెలవారీ ప్లాన్ లేదా ప్రతి-టోకెన్ API క్రెడిట్‌లపై నడుస్తుంది మరియు రెండో పద్ధతిలో మాత్రమే మోడల్ మార్పుకు డాలర్లలో ధర నిర్ణయించబడుతుంది.

మీ స్వంత వర్క్‌లోడ్‌పై సమాధానాన్ని ఎలా పరీక్షించాలి

వేరొక మోడల్ నుండి తీసుకున్న గణనతో ప్రాంప్ట్ పరిమాణాన్ని నిర్ణయించవద్దు. టోకెన్-కౌంటింగ్ ఎండ్‌పాయింట్ ఉచితంగా అందుబాటులో ఉంటుంది మరియు మీరు పేర్కొన్న మోడల్ యొక్క టోకెనైజర్‌తోనే లెక్కిస్తుంది, కాబట్టి మీరు దేనిని ఉపయోగించాలనుకుంటున్నారో దాని పేరునే పేర్కొనండి. ఆ ఎండ్‌పాయింట్ ప్లాట్‌ఫారమ్‌లో ఎప్పుడూ బిల్లు పడని అతికొద్ది భాగాలలో ఒకటి, కాబట్టి మీరు పోలిక కోసం నిజమైన క్రెడిట్‌ను ఖర్చు చేసే ముందు చెల్లించకుండా మీరు ఇంకా ఏమి రన్ చేయవచ్చు అనేది తనిఖీ చేయడం మంచిది. Opus 4.7 మరియు ఆ తర్వాతి వెర్షన్లు, Fable 5 మరియు Sonnet 5 కొత్త టోకెనైజర్‌ను ఉపయోగిస్తాయి, ఇది "అదే టెక్స్ట్ కోసం సుమారు 30% ఎక్కువ టోకెన్లను ఉత్పత్తి చేస్తుంది". కాబట్టి పాత మోడల్‌పై లెక్కించిన బడ్జెట్, కొత్త మోడల్‌పై టోకెన్ రేటు మారకపోయినా తక్కువగా కనిపిస్తుంది.

ఆ తర్వాత వచ్చిన ఫలితాన్ని చదవండి. input_tokens అనేది కేవలం కాష్ చేయని మిగిలిన భాగం మాత్రమే, కాబట్టి అసలైన ప్రాంప్ట్ పరిమాణం ఆ ఫీల్డ్ ప్లస్ cache_creation_input_tokens ప్లస్ cache_read_input_tokens అవుతుంది. VPSలో మొదటి Claude API యాప్ అనేది ఆ కొలతను రన్ చేయడానికి అత్యంత సరళమైన మరియు నిజాయితీ గల మార్గం, మరియు మీ వినియోగానికి ఏ Claude ప్లాన్ సరిపోతుంది అనేది మీరు టోకెన్ల వారీగా చెల్లించాలా వద్దా అనే దానిపై తీసుకునే ప్రత్యేక నిర్ణయం. ఒకవేళ ఇది సబ్‌స్క్రిప్షన్ తీసుకోవాలా వద్దా అనే దానికంటే, ఏ సబ్‌స్క్రిప్షన్ తీసుకోవాలి అనే ప్రశ్నగా మారితే, ChatGPT ధరలతో పోల్చిన Claude యొక్క ప్లాన్లు అదే కోడింగ్ పనికి ఇతర ప్రొవైడర్ల వద్ద ఎంత ఖర్చవుతుందో వివరిస్తుంది. ఒకవేళ ఈ కొలత మీ పనిని శాశ్వతంగా APIకి పంపినట్లయితే, సబ్‌స్క్రిప్షన్‌ను తక్కువ స్థాయికి మార్చడం లేదా పూర్తిగా రద్దు చేయడం ద్వారా కూడా మీరు ఇప్పటికే చెల్లించిన కాలపరిమితి మీకు అందుబాటులో ఉంటుంది, కాబట్టి గణాంకాలు తెలిసిన తర్వాత నిర్ణయం తీసుకోవడంలో ఎటువంటి నష్టం లేదు.

FAQ

కోడింగ్ కోసం ఏ Claude మోడల్ ఉత్తమమైనది?

సంక్లిష్టమైన ఏజెంటిక్ కోడింగ్ కోసం Claude Opus 4.8 ప్రామాణిక ప్రారంభ బిందువు. జూలై 2026 నాటికి, దీని ధర మిలియన్ ఇన్‌పుట్ టోకెన్లకు $5 మరియు మిలియన్ అవుట్‌పుట్ టోకెన్లకు $25. Claude Sonnet 5 వేగం మరియు తెలివితేటల కలయికగా ఉత్తమమైనదిగా పరిగణించబడుతుంది. 31 ఆగస్టు 2026 వరకు దీని ధర $2 / $10, ఇది Opus ధరలో సగం కంటే తక్కువ. ఒకే పనిని రెండింటిపై రన్ చేసి, thinking కాన్ఫిగరేషన్‌ను స్థిరంగా ఉంచి, response.usage నుండి మొత్తం టోకెన్ ఖర్చును పోల్చి చూడండి.

Claude Haiku 4.5, Sonnet 5 స్థానంలో వాడటానికి తగినంత చౌకగా ఉంటుందా?

టోకెన్ ధర పరంగా చూస్తే, ఇది చాలా చౌక: Sonnet 5 ప్రారంభ ధర $2 / $10 తో పోలిస్తే, Haiku 4.5 ధర $1 / $5. సెప్టెంబర్ 1, 2026 నుండి Sonnet 5 ధర $3 / $15 అవుతుంది. అయితే, పరిమితులు నిర్ణయాత్మక పాత్ర పోషిస్తాయి. Haiku 4.5 లో 1M కు బదులుగా 200K టోకెన్ల కాంటెక్స్ట్ విండో, synchronous Messages API పై 64K గరిష్ట అవుట్‌పుట్, ఫిబ్రవరి 2025 నాటి నాలెడ్జ్ కటాఫ్, output_config.effort సపోర్ట్ లేకపోవడం మరియు 4,096-టోకెన్ల కనీస కాషబుల్ ప్రాంప్ట్ పరిమితి ఉన్నాయి. చిన్న సిస్టమ్ ప్రాంప్ట్‌లపై ఇది కాషింగ్‌ను నిలిపివేస్తుంది.

సెషన్ మధ్యలో తక్కువ ధర గల Claude మోడల్‌కు మారడం వల్ల డబ్బు ఆదా అవుతుందా?

చూడటానికి అలా అనిపించినా, ఆచరణలో తక్కువ ఆదా అవుతుంది. tools, system లేదా messages ప్రిఫిక్స్‌లలో మార్పులు, thinking కాన్ఫిగరేషన్‌లో మార్పులు మరియు output_config.effort లో మార్పులు కాష్‌ను ఇన్వాలిడేట్ చేస్తాయని Anthropic పేర్కొంది. మోడల్ మారినప్పుడు ఇప్పటికే ఉన్న కాష్‌కు ఏమవుతుందో డాక్యుమెంట్ చేయలేదు, కాబట్టి దానిని తెలియని అంశంగా పరిగణించి, ఆ తర్వాత వచ్చే మొదటి అభ్యర్థనపై cache_read_input_tokens ను పరిశీలించండి. దీని ప్రభావం తెలుసుకోవడం ముఖ్యం: 150,000-టోకెన్ల Opus 4.8 ప్రిఫిక్స్‌పై కాష్ రీడ్ ధర సుమారు $0.08, కొత్త రైట్ ధర సుమారు $0.94. ఇది టోకెన్ వారీగా ఆదా అయ్యే మొత్తాన్ని మించిపోతుంది. కాష్ తొలగించబడే సమయాల్లో, అంటే Claude Code లో /clear తర్వాత మాత్రమే పనుల మధ్య మోడల్ మార్చండి.

output_config.effort నా బిల్లుపై ఎలాంటి ప్రభావం చూపుతుంది?

ఇది టెక్స్ట్, టూల్ కాల్స్ మరియు థింకింగ్ కోసం మోడల్ ఎన్ని టోకెన్లను ఖర్చు చేస్తుందో మారుస్తుంది. తక్కువ effort సెట్ చేస్తే టూల్ కాల్స్ తగ్గుతాయి. ఏజెంటిక్ లూప్‌లలో ప్రతి టూల్ ఫలితం తదుపరి టర్న్‌లలో మళ్ళీ పంపబడుతుంది కాబట్టి, ఇది ఖర్చుపై ప్రభావం చూపుతుంది. అందుబాటులో ఉన్న స్థాయిలు low, medium, high, xhigh మరియు max, వీటిలో high డిఫాల్ట్‌గా ఉంటుంది. Anthropic ప్రతి స్థాయికి ఖర్చు మల్టిప్లైయర్‌ను ప్రకటించలేదు; effort ను టోకెన్ బడ్జెట్‌గా కాకుండా ప్రవర్తనా సంకేతంగా పరిగణించమని సూచించింది, కాబట్టి మీ పనిపై దీనిని పరీక్షించి చూడండి.

Claude Batches API ఎంత ఆదా చేస్తుంది?

అసింక్రోనస్ డెలివరీకి బదులుగా ఇన్‌పుట్ మరియు అవుట్‌పుట్ టోకెన్లపై 50% ఆదా అవుతుంది. జూలై 2026 నాటికి, Opus 4.8 ధర $2.50 in / $12.50 out, Sonnet 5 ధర $1 / $5 (ప్రారంభ ధర), మరియు Haiku 4.5 ధర $0.50 / $2.50. గమనించదగ్గ విషయం ఏమిటంటే: సెప్టెంబర్ 1, 2026 నుండి ప్రామాణిక రేటు ప్రకారం, ఒక బ్యాచ్డ్ Opus 4.8 జాబ్ ధర, సింక్రోనస్ Sonnet 5 జాబ్ ధర కంటే తక్కువ. కాబట్టి, బ్యాచింగ్ ద్వారా అదే ధరకు మరింత శక్తివంతమైన మోడల్‌ను పొందవచ్చు.