Modeli ipi ya Claude inafaa kwa matumizi yako?
Chagua kati ya Claude Opus 4.8, Sonnet 5, na Haiku 4.5 kwa kulinganisha bei za Julai 2026. Pata uchambuzi wa gharama kwa kazi 100,000 na mipangilio inayoongeza bili yako.
Ni modeli ipi ya Claude ninayopaswa kutumia?
Jibu fupi kuhusu ni modeli ipi ya Claude unayopaswa kutumia: anza na Claude Opus 4.8, na uihame tu ikiwa una sababu maalum ya kufanya hivyo. Mwongozo wa Anthropic ni uleule. "Ikiwa huna uhakika ni modeli ipi ya kutumia, anza na Claude Opus 4.8 kwa ajili ya kazi ngumu za uandishi wa code (agentic coding) na kazi za kibiashara." Shuka hadi Claude Sonnet 5 wakati kazi imefafanuliwa vyema na unaiendesha mara nyingi kwa siku. Shuka tena hadi Claude Haiku 4.5 kwa ajili ya kazi za kawaida zenye ujazo mkubwa ambapo tayari unajua jibu sahihi linaonekanaje. Claude Fable 5 iko juu ya zote, kwa ajili ya mawakala (agents) wanaoendesha kazi kwa muda mrefu.
Uchaguzi huu una gharama zake. Hizi ndizo bei kwenye Claude API (application programming interface) kuanzia tarehe 23 Julai 2026, kwa kila milioni moja ya tokens, ambazo nyaraka huziandika kama MTok.
- Claude Fable 5 (
claude-fable-5): $10 / MTok ya kuingiza, $50 / MTok ya kutoa. 1M context. - Claude Opus 4.8 (
claude-opus-4-8): $5 ya kuingiza, $25 ya kutoa. 1M context. - Claude Opus 4.7 (
claude-opus-4-7): $5 ya kuingiza, $25 ya kutoa. 1M context. - Claude Sonnet 5 (
claude-sonnet-5): $2 ya kuingiza, $10 ya kutoa kwa bei ya utangulizi hadi tarehe 31 Agosti 2026. Bei ya kawaida ya $3 ya kuingiza, $15 ya kutoa itaanza kutumika tarehe 1 Septemba 2026. 1M context. - Claude Haiku 4.5 (
claude-haiku-4-5): $1 ya kuingiza, $5 ya kutoa. 200K context.
Vitambulisho hivyo vimekamilika kama vilivyoandikwa. Hakuna kitu kinachoongezwa kwenye vitambulisho hivyo.
Ukubwa wa ombi wenyewe hauongezi gharama kwenye modeli zinazoshughulikia tokeni 1M: “Ombi la tokeni 900k hutozwa kwa kiwango kilekile cha kila tokeni kama ombi la tokeni 9k.” Viwango hivyo vinatumika pia nje ya API, kwa sababu Claude Enterprise hupima matumizi kwa viwango vya API pamoja na bei ya kiti; kwa hiyo, hesabu yote hapa chini ni ileile kwa timu iliyo kwenye mpango wa viti. Usajili wa bei bapa hubadilisha kipimo cha matumizi, lakini si uamuzi huu, kwa sababu ngazi zote mbili za Claude Max zina modeli zilezile na zinatofautiana tu kwa kiasi cha matumizi unachopata. Chini zaidi kwenye ngazi hiyo, Claude Pro ya $20 kwa mwezi hununua kiwango cha matumizi badala ya kiwango cha malipo kwa kila tokeni, kwa hiyo kinachokuzuia ni kuwekwa upya kwa kikomo, si bili. Ikiwa huo ndio mpango unaotumia sasa, kubaini ni dirisha gani la matumizi unalosubiri kunapaswa kutangulia hesabu yoyote iliyo hapa chini, kwa sababu suluhisho ni kutumia modeli ndogo, muktadha mdogo au kuhamia API, badala ya kutafuta kiwango cha bei nafuu. Na ikiwa bado hujaanza kulipia, kuamua kama Pro inastahili $20 kwanza kunategemea mara ngapi kikomo cha bure kinakuzuia, si viwango vyovyote vilivyoelezwa hapo juu.
Kila modeli inafanya kazi gani hasa
Anthropic inaelezea safu hii kwa mstari mmoja kwa kila modeli, na mistari hiyo inaongoza vizuri zaidi kuliko ubao wowote wa viongozi.
- Claude Fable 5: "Akili ya kizazi kijacho kwa ajili ya mawakala wanaoendesha kwa muda mrefu." Imekadiriwa kuwa ya polepole zaidi kati ya hizo nne kwa upande wa latency.
- Claude Opus 4.8: "Kwa ajili ya uandishi wa code tata wa mawakala na kazi za kibiashara." Latency ya wastani.
- Claude Sonnet 5: "Mchanganyiko bora wa kasi na akili." Ina kasi.
- Claude Haiku 4.5: "Modeli ya haraka zaidi yenye akili inayokaribia kiwango cha juu kabisa."
Fable 5 ndiyo pekee kati ya hizo nne ambayo kulinganisha huku hakupangi bei kwa mzigo wa kazi, na kwa kiwango cha mara mbili ya Opus 4.8, swali la kazi zipi hulipa $10 kwa kuingiza na $50 kwa kutoa linastahili jibu lake lenyewe.
Haiku 4.5 pia ina vikwazo vinavyoamua kufaa kwa kazi kabla ya bei. Dirisha lake la muktadha (context window) ni token 200K badala ya 1M, kwa hivyo hazina kubwa ya code au nakala ndefu ya wakala haitatoshea. Pato lake la juu kwenye Messages API ya synchronous ni token 64K dhidi ya 128K kwa nyingine, na tarehe yake ya mwisho ya maarifa ya kuaminika ni Februari 2025, wakati zile nyingine tatu ziko Januari 2026.
Je, chaguo hili linanigharimu kiasi gani katika mzigo halisi wa kazi?
Kila modeli katika mfululizo huu hutoza gharama ya matokeo (output) kwa kiwango cha mara tano ya gharama ya ingizo (input). Opus 4.8 inagharimu $5 kwa ingizo na $25 kwa matokeo. Haiku 4.5 inagharimu $1 kwa ingizo na $5 kwa matokeo. Uwiano huu unabaki vilevile katika safu nzima, kwa hivyo modeli unayochagua ni muhimu zaidi katika kazi zinazozalisha matokeo mengi.
Kazi za wakala (agentic work) ni aina hiyo ya kazi, kwa sababu tokeni za kufikiri (thinking tokens) hutozwa kama tokeni za matokeo na huhesabiwa kuelekea max_tokens hata wakati maandishi hayakufikii. Kwenye Fable 5, Opus 4.8, Opus 4.7 na Sonnet 5 muhtasari wa hoja huondolewa kwa chaguo-msingi, kwa hivyo sehemu ya thinking hurudi ikiwa tupu. Utozaji haubadiliki: "Kwa vyovyote vile, kizuizi hicho hutozwa kwa njia ileile na kurudishwa vilevile katika mazungumzo ya hatua nyingi." Ni nini hasa kinachojaza bili ya tokeni ya Claude huchambua mita hiyo kikamilifu.
Kama kufikiri (thinking) kunafanya kazi au la hutofautiana kati ya modeli unazolinganisha, jambo ambalo litaharibu jaribio la gharama ikiwa utalipuuza. Kwenye Sonnet 5 na Fable 5 kufikiri tayari kumewashwa na hakuhitaji usanidi wowote. Kwenye Opus 4.8 na Opus 4.7 kumezimwa hadi utakapoweka thinking: {type: "adaptive"} katika ombi lako. Linganisha usanidi katika pande zote mbili kabla ya kuhitimisha chochote kutokana na namba hizo.
Kwa nini mtindo wa bei nafuu unaweza kuwa ghali zaidi
Chukua kazi moja ya uandishi wa msimbo inayojitegemea. Ombi lina 60,000 tokens za muktadha, na mtindo unazalisha 8,000 tokens za matokeo ikijumuisha mchakato wa kufikiri. Hakuna caching, kwa hivyo hesabu inabaki wazi.
Kwenye Opus 4.8: 0.06 MTok ya input kwa $5 ni $0.30, na 0.008 MTok ya output kwa $25 ni $0.20. Jaribio hili linagharimu $0.50. Kwenye Haiku 4.5 jaribio lilelile ni $0.06 pamoja na $0.04, hivyo $0.10.
Haiku ni nafuu mara tano kwa kila jaribio, jambo linaloonekana kama nafasi kubwa ya akiba hadi pale unapofuatilia kile ambacho jaribio lililofeli hufanya. Unasoma jibu lisilo sahihi, ambalo linagharimu muda wako. Unalituma tena kama muktadha kwenye jaribio la pili, kwa hivyo kila jaribio linakuwa kubwa kuliko la awali. Na jaribio la tatu likikosea bado, unahamishia kazi kwenye mtindo mkubwa: $0.30 ya Haiku pamoja na $0.50 ya Opus ni $0.80, au 60% zaidi ya kuendesha Opus mara moja.
Kwa hivyo swali la msingi ni jinsi unavyoweza kukagua jibu kwa gharama nafuu. Wakati jibu lisilo sahihi liko wazi ndani ya sekunde moja, mtindo mdogo ni dili. Wakati kugundua kosa kunamaanisha kusoma diff kwa makini, mtindo mdogo unakugharimu muda ambao hauonekani kwenye ankara.
Wakati mtindo mdogo unaposhinda moja kwa moja
Haiku 4.5 ndilo jibu sahihi katika hali hizi:
- Kazi za wakala mdogo (subagent). Wakala mdogo anayebadilisha majina ya faili au kukusanya matokeo ya utafutaji hahitaji uwezo wa kufikiri wa kiwango cha juu. Hiyo ndiyo kanuni ya kawaida pindi unapojenga wakala wa AI kwa kutumia Claude na kumpa wasaidizi.
- Uchambuzi wa log (log triage). Kuamua kama mstari fulani ni kelele au unastahili kuzingatiwa na binadamu ni uamuzi finyu wenye njia dhahiri ya kufeli.
- Uainishaji dhidi ya seti ya lebo zisizobadilika. Matokeo ni mafupi na usahihi unaweza kupimika kwenye sampuli.
- Wito wa uzalishaji wa kiwango cha juu. Kwa uzinduzi 100,000 kwa siku, tofauti ya gharama kwa kila token huacha kuwa kosa la kukadiria. Hiyo ndiyo sura ya kawaida ya mtiririko wa kazi wa AI uliounganishwa kwenye n8n.
- Chochote ambapo kasi ya majibu ni muhimu kwa mtumiaji. Haiku 4.5 imekadiriwa kuwa mtindo wa kasi zaidi katika mfululizo huu.
Kikomo kimoja kinahusu Haiku mahususi. Prompt yake ndogo zaidi inayoweza kuhifadhiwa kwenye cache ni token 4,096, ikilinganishwa na 1,024 kwenye Opus 4.8 na Sonnet 5, na chini ya kiwango hicho cha chini "maombi yoyote ya kuhifadhi kwenye cache token chache kuliko idadi hii yatashughulikiwa bila kuhifadhiwa, na hakuna kosa linalorejeshwa". Kizuizi cha maelekezo cha token 1,500 kinachohifadhiwa kwenye Sonnet 5 hakitahifadhiwa kimya kimya kwenye Haiku 4.5. Ishara ya hii ni cache_creation_input_tokens na cache_read_input_tokens zote zikiwa kwenye sifuri, jambo ambalo kudhibiti gharama za wakala anayefanya kazi kila wakati linashughulikia pamoja na njia nyingine za kupoteza cache.
Vigezo vinavyobadilisha jibu
Kila kimoja kati ya hivi husukuma muswada mbali zaidi kuliko jina la modeli linavyofanya.
Juhudi (Effort). output_config.effort hudhibiti kiasi cha kazi ambacho modeli hufanya kabla ya kutoa jibu. Viwango vyake ni low, medium, high, xhigh na max, huku high ikiwa ndiyo chaguo-msingi: "Kuweka effort kuwa high kunazalisha tabia inayofanana kabisa na kuacha kigezo cha effort kabisa." Kigezo hiki huwekwa ndani ya output_config badala ya kukaa kwenye ngazi ya juu ya ombi:
response = client.messages.create(
model="claude-sonnet-5",
max_tokens=4096,
output_config={"effort": "medium"},
messages=messages,
)Juhudi huathiri kila token katika majibu: "Inaweza kuathiri matumizi yote ya token ikiwemo miito ya zana (tool calls). Kwa mfano, juhudi ndogo itamaanisha Claude hufanya miito michache ya zana." Hii hujikusanya katika mzunguko wa wakala (agentic loop). Hii si kikomo cha token: "Juhudi ni ishara ya kitabia, si bajeti kali ya token." Anthropic haichapishi kiongeza gharama kwa kila ngazi na inakushauri ujaribu kesi yako ya matumizi, kwa hivyo uendeshaji wa Sonnet 5 katika high dhidi ya uendeshaji wa Opus 4.8 katika low ni ulinganisho halisi unaoweza kuufanya mchana huu. Haiku 4.5 haipo kwenye orodha ya modeli zinazounga mkono juhudi.
Prompt caching. Usomaji wa cache hugharimu 0.1x ya kiwango cha msingi cha input, na namba inayoamua chaguo la modeli ni kile ambacho hicho hufanya katika ngazi mbalimbali. Cache hit kwenye Opus 4.8 hugharimu $0.50 / MTok, na input isiyo na cache kwenye Haiku 4.5 hugharimu $1 / MTok, kwa hivyo prefix ya Opus iliyohifadhiwa vizuri kwenye cache ni nafuu kwa kila token ya input kuliko prompt ya Haiku isiyo na cache. Usafi wa session (session hygiene) ni bora kuliko chaguo la modeli katika mzigo wowote wa kazi unaotuma tena prefix kubwa na thabiti.
Batches. Ikiwa hakuna kinachosubiri jibu, Message Batches API huendesha modeli zilezile kwa "punguzo la 50% kwenye token za input na output". Hii hupunguza kwa nusu kila mstari wa ulinganisho hapa chini, na inafanya kazi katika ngazi zote: kazi ya Opus 4.8 iliyopangwa kwa batch hugharimu kidogo kuliko kazi ya Sonnet 5 ya wakati mmoja (synchronous) kwa bei ya kawaida kuanzia 1 Septemba 2026, ikibadilisha latency kwa uwezo kwa gharama ileile.
Ulinganisho wa gharama za kazi
Mzigo wa kazi: kuainisha barua pepe 100,000 za usaidizi, kila moja ikiwa na simu moja, tokeni 2,000 za kuingiza na tokeni 300 za kutoa kwa kila simu. Hii ni jumla ya 200 MTok za kuingiza na 30 MTok za kutoa.
- Haiku 4.5: 200 x $1 = $200 kwa kuingiza, 30 x $5 = $150 kwa kutoa. Jumla $350.
- Sonnet 5, bei ya utangulizi: 200 x $2 = $400 kwa kuingiza, 30 x $10 = $300 kwa kutoa. Jumla $700.
- Sonnet 5, kuanzia 1 Septemba 2026: 200 x $3 = $600 kwa kuingiza, 30 x $15 = $450 kwa kutoa. Jumla $1,050.
- Opus 4.8: 200 x $5 = $1,000 kwa kuingiza, 30 x $25 = $750 kwa kutoa. Jumla $1,750.
Badilisha namba nne ili kukokotoa upya kwa bei za kesho. Marekebisho hapa chini yanabadilisha matokeo zaidi kuliko jina la modeli lilivyofanya:
- Batching inapunguza kila mstari kwa nusu: $175, $350, $525 na $875. Hakuna kinachosubiri kazi ya uainishaji ya usiku, kwa hivyo hakuna sababu ya kuiruka.
- Caching ya prefix inayoshirikiwa. Tuseme tokeni 1,200 kati ya 2,000 za kuingiza ni kizuizi kilekile cha maelekezo kila wakati. Kwenye Sonnet 5 kwa bei ya utangulizi, hizi hugharimu $0.20 / MTok kama cache hits badala ya $2 / MTok, kwa hivyo 120 MTok hugharimu $24 badala ya $240. Ongeza 80 MTok za pembejeo mpya kwa $2, ambayo ni $160, pamoja na $300 ya matokeo, na Sonnet 5 inafika karibu $484 badala ya $700. Mbinu hiyo hiyo haifanyi kazi kwenye Haiku 4.5, kwa sababu tokeni 1,200 ziko chini ya kiwango cha chini cha tokeni 4,096.
- Retries. Tuseme unakataa jibu la Haiku kwenye 8% ya barua pepe na kuendesha zile tena kwenye Opus 4.8. Ongeza 0.08 x $1,750 = $140 kwenye $350, na kupata $490. Pima kiwango chako cha kukataa badala ya kutumia changu.
- Ufafanuzi wa zana, ikiwa kazi inazitumia. System prompt wanayozalisha ni tokeni 290 kwenye Opus 4.8 ikiwa
tool_choiceimewekwa kuwaauto, 354 kwenye Sonnet 5 na 496 kwenye Haiku 4.5. Modeli ya bei nafuu zaidi hubeba gharama kubwa zaidi ya kudumu.
Haiku yenye njia ya kusogeza juu (escalation path) kwa $490 na Sonnet 5 iliyohifadhiwa kwenye cache kwa $484 hugharimu sawa, na mojawapo inafanya kazi hiyo kwa hatua moja. Modeli haikuwa swali zima kamwe.
Je, kubadili modeli katikati ya kikao huokoa gharama?
Mara chache kuliko bei za awali zinavyoashiria, kwa sababu akiba hiyo ni kwa kila token na unachokiweka hatarini ni prefix nzima iliyohifadhiwa kwenye cache.
Anthropic inaelezea kinachofuta cache. Prefix hujengwa kwa mpangilio wa tools, kisha system, kisha messages, na "Mabadiliko katika kila ngazi hufuta ngazi hiyo na ngazi zote zinazofuata." Mipangilio miwili ya ombi iko kwenye orodha hiyo pia: "Usanidi wa thinking na ngazi iliyotatuliwa ya effort huwekwa kwenye prompt yenyewe, kwa hivyo kubadili yoyote kati ya hayo huanzisha prefix mpya ya cache." Kuhusu effort, nyaraka hizo zinaenda mbali zaidi: "badilisha effort kulingana na mzigo wa kazi badala ya ndani ya mazungumzo yanayotegemea cache hits".
Modeli haipo kwenye orodha hiyo iliyoandikwa, kwa hivyo usikisie kwa njia yoyote ile. Soma cache_read_input_tokens kwenye ombi la kwanza baada ya kubadili na acha namba ikupe jibu. Kwenye prefix ya Opus 4.8 ya token 150,000, usomaji wa cache unagharimu takriban $0.08 na uandishi mpya unagharimu takriban $0.94, ambayo ni zaidi ya mizunguko kadhaa ya tofauti ya bei kwa kila token uliyokuwa ukiifuatilia.
Kwa hivyo badilisha mambo haya kati ya kazi, si ndani ya kazi moja. Katika Claude Code hiyo inamaanisha /clear kwanza, wakati cache inapotupwa hata hivyo, kisha /model au /effort. Yote hayo huandikwa kwenye CLI, kwa hivyo ikiwa unafanya kazi kwenye Linux usakinishaji unaofaa kuwa nao ni ule wa terminal, kwa sababu kile ambacho Anthropic inatoa kiasili kwa Linux huoanisha CLI iliyotulia na programu ya desktop ambayo bado iko kwenye beta. Ikiwa mabadiliko hayo yataonekana kwenye bili kabisa inategemea jinsi unavyolipa kwa kikao hicho, kwa sababu Claude Code huendeshwa kwa mpango wa kila mwezi au kwa mikopo ya API ya kila token na ni ile ya pili pekee inayopangia bei mabadiliko ya modeli kwa dola.
Jinsi ya kupima jibu kwenye workload yako mwenyewe
Usikadirie ukubwa wa prompt kwa kutumia idadi iliyopatikana kutoka kwa model nyingine. Endpoint ya kuhesabu token ni bure kutumika na huhesabu kwa kutumia tokenizer ya model yoyote utakayoitaja, kwa hivyo taja ile unayopanga kuitumia. Endpoint hiyo ni moja ya sehemu chache za jukwaa ambazo hazitozi malipo kamwe, na nini kingine unachoweza kuendesha bila kulipia inafaa kuangaliwa kabla ya kutumia mkopo halisi kwenye ulinganisho. Opus 4.7 na matoleo mapya zaidi, Fable 5 na Sonnet 5 hutumia tokenizer mpya zaidi ambayo "hutoa takriban 30% ya token zaidi kwa maandishi yaleyale", kwa hivyo bajeti iliyopimwa kwenye model ya zamani huonekana kuwa ndogo kwenye model mpya kwa kiwango kilekile cha malipo kwa kila token.
Kisha soma kile kilichorejeshwa. input_tokens ni salio lisilohifadhiwa kwenye cache pekee, kwa hivyo ukubwa halisi wa prompt ni uwanja huo pamoja na cache_creation_input_tokens pamoja na cache_read_input_tokens. App ya kwanza ya Claude API kwenye VPS ndiyo sehemu ndogo zaidi ya kweli ya kufanyia kipimo hicho, na mpango upi wa Claude unaofaa matumizi yako ni uamuzi tofauti kuhusu kama utalipia kwa kila token hata kidogo. Ikiwa hilo litageuka kuwa swali la ni usajili upi wa kuwa nao badala ya kama uwe na usajili, viwango vya bei vya Claude kando ya vile vya ChatGPT hufafanua gharama za kazi ileile ya uandishi wa code kwenye nafasi za mtoa huduma mwingine. Ikiwa kipimo hicho kitapeleka kazi yako kwenye API kwa kudumu, kushusha usajili kwenye ngazi ya chini au kuusitisha kabisa bado kukuachia kipindi ambacho tayari umekilipia, kwa hivyo hakuna adhabu yoyote kwa kuamua baada ya namba kuwa tayari.
FAQ
Ni modeli ipi ya Claude inayofaa zaidi kwa uandishi wa code?
Claude Opus 4.8 ndiyo sehemu ya kuanzia iliyothibitishwa kwa uandishi wa code wa kiwakala (agentic coding) wenye utata, kwa gharama ya $5 kwa kila token milioni 1 za input na $25 kwa kila token milioni 1 za output kufikia Julai 2026. Claude Sonnet 5 imewekwa kama mchanganyiko bora wa kasi na akili, na kwa bei ya $2 / $10 hadi tarehe 31 Agosti 2026, inagharimu chini ya nusu ya bei hiyo. Tekeleza kazi ileile kwenye modeli zote mbili, weka usanidi wa kufikiri (thinking configuration) ukiwa sawa, kisha ulinganishe matumizi ya jumla ya token kutoka response.usage.
Je, Claude Haiku 4.5 ni nafuu kutosha kuchukua nafasi ya Sonnet 5?
Kwa kila token, ndiyo: $1 / $5 dhidi ya $2 / $10 kwa Sonnet 5 kwenye bei ya utangulizi, au $3 / $15 kuanzia tarehe 1 Septemba 2026. Vikwazo ndivyo vinavyoamua. Haiku 4.5 ina context window ya token 200K badala ya 1M, kiwango cha juu cha output cha 64K kwenye Messages API ya synchronous, tarehe ya mwisho ya maarifa ya kuaminika ya Februari 2025, haina usaidizi wa output_config.effort, na prompt ya chini kabisa ya token 4,096 inayoweza kuhifadhiwa kwenye cache ambayo huzima cache kimya kimya kwenye system prompts fupi.
Je, kubadili kwenda kwenye modeli ya Claude ya bei nafuu katikati ya kikao huokoa pesa?
Si mara nyingi kama inavyoonekana. Anthropic inaelezea vitu vinavyobatilisha cache (cache invalidators) kama mabadiliko kwenye prefix ya tools, system au messages, mabadiliko kwenye usanidi wa kufikiri, na mabadiliko kwenye output_config.effort. Kile ambacho kubadili modeli hufanya kwenye cache iliyopo hakijaelezewa, kwa hivyo ichukulie kama haijulikani na usome cache_read_input_tokens kwenye ombi la kwanza baada ya hapo. Ni muhimu kujua dau: kwenye prefix ya token 150,000 ya Opus 4.8, usomaji wa cache unagharimu takriban $0.08 na uandishi mpya unagharimu takriban $0.94, jambo ambalo huzidi akiba ya kila token kwa mizunguko kadhaa. Badili kati ya kazi, baada ya /clear katika Claude Code, wakati cache inapotupwa bila kujali.
Je, output_config.effort hufanya nini kwenye bili yangu?
Inabadilisha idadi ya token ambazo modeli hutumia kwenye maandishi, miito ya zana (tool calls) na kufikiri. Effort ya chini hufanya miito michache ya zana, jambo ambalo huongezeka kwenye mizunguko ya kiwakala kwa sababu kila matokeo ya zana hutumwa tena kwenye mizunguko inayofuata. Viwango ni low, medium, high, xhigh na max, huku high ikiwa ndiyo chaguo-msingi. Anthropic haichapishi kiongeza gharama kwa kila ngazi, ikiiita effort kama ishara ya kitabia badala ya bajeti ya token, kwa hivyo ipime kwenye kazi yako mwenyewe.
Claude Batches API huokoa kiasi gani?
50% kwenye token za input na output, kwa kubadilishana na utoaji wa asynchronous. Kufikia Julai 2026, hiyo inafanya Opus 4.8 kuwa $2.50 kwa input / $12.50 kwa output, Sonnet 5 kuwa $1 / $5 kwa bei ya utangulizi, na Haiku 4.5 kuwa $0.50 / $2.50. Ulinganisho unaostahili kuzingatiwa unavuka viwango: kazi ya Opus 4.8 iliyopangwa kwa batch inagharimu chini ya kazi ya synchronous ya Sonnet 5 kwa kiwango cha kawaida kuanzia tarehe 1 Septemba 2026, kwa hivyo batching hununua modeli yenye nguvu zaidi kwa pesa ileile.