SSD Nodes Learn Hosting plans →
Mwongozo Matt ConnorNa Matt Connor · Imeboreshwa 2026-08-31

Jinsi ya kuzuia Claude Code kuwa polepole na ghali

Kila turn hutuma context yote tena, hivyo session ndefu huwa polepole na ghali. Tumia /context, kata gharama ya kudumu, kisha clear na compact kwa makusudi.

Jinsi ya kuzuia session ndefu ya Claude Code isiwe polepole na ghali

Session ndefu ya Claude Code huwa polepole na ghali kwa sababu kila turn hutuma tena context yote, na context hiyo huendelea kukua. Suluhisho ni kufuata usafi wa session kwa mpangilio maalumu. Tumia /context kuona ni nini kinachojaza window, punguza vitu unavyolipia katika kila request, kisha tumia /clear kati ya tasks zisizohusiana na /compact ukiweka instruction ndani ya task moja ndefu. Fanya kazi kwa vipindi vinavyoendelea, kwa sababu prompt cache ikiwa cold, kusoma kwa gharama ndogo hubadilika kuwa kuandika upya kila kitu ulichosema.

Sababu ya meter kuendelea kuhesabu imeelezwa katika token meter iliyo nyuma ya agent session.

Soma /context kabla ya kubadilisha chochote

Usibashiri kinachojaza window. Claude Code itakuambia.

/context [all] huonyesha matumizi ya context ya sasa kama grid yenye rangi, pamoja na mapendekezo ya optimization kwa tools zinazotumia context nyingi na memory bloat; all hupanua uchanganuzi wa kila kipengee katika fullscreen mode. Soma matokeo kama ndoo tano.

  • System prompt. Maelekezo ya harness ya Claude Code yenyewe. Hayawezi kubadilishwa katika session.
  • Tool definitions. Schema ya kila tool ambayo agent inaweza kuita, ikiwemo kila MCP (Model Context Protocol) server iliyounganishwa.
  • Memory files. CLAUDE.md na auto memory, zilizopakiwa wakati wa kuanza session.
  • Files and tool results. Kila file iliyosomwa na kila kitu ambacho commands zako zilichapisha.
  • Message history. Turns zako na majibu yake.

Vitu vitatu vya kwanza ni gharama isiyobadilika, inayolipwa katika kila request kwa muda wote wa session. Vitu viwili vya mwisho huongezeka. Punguza gharama isiyobadilika mara moja mwanzoni; dhibiti sehemu inayoongezeka kila wakati.

Strings mbili zinakuonyesha kuwa window imejaa:

Context exceeds the 200k-token limit by 94k tokens — run /compact or /clear to continue.
Context is 94k tokens past the 200k-token compaction window — run /compact to reduce usage.

Ya kwanza ni hard limit, na request hukataliwa; error inayolingana ya API (application programming interface) husomeka Prompt is too long. Ya pili ni compaction window, ambayo inaweza kuwa chini ya real context window ya model yenye token 1 million. Requests bado hufaulu baada ya kuifikia, kwa hiyo hiyo ni warning, si kukataliwa.

Kwenye paid plan, /usage huongeza nusu nyingine kwa kuashiria mienendo kama long context au cache misses na kuhusisha matumizi ya hivi karibuni na skills, subagents na MCP servers binafsi. Ikiwa inakuambia kuwa allowance tayari imetumika, ni limit window gani unayoingojea huamua kama kupunguza context kutakusaidia sasa au unahitaji njia nyingine ya kurudi kufanya kazi.

CLAUDE.md ni gharama ya kudumu ya context, kwa hiyo iwe fupi

CLAUDE.md yako hupakiwa wakati wa kuanza kwa session na hubaki humo. Ikiwa ina utaratibu wa kina wa deployment, tokens hizo huwa kwenye context unaporekebisha typo kwenye test file. Mwongozo wa Anthropic unapendekeza kujumuisha mambo muhimu pekee na kuweka file chini ya mistari 200.

Hamisha taratibu kwenye skills. Skill hupakiwa tu inapoitwa, kwa hiyo workflow unayoendesha mara mbili kwa wiki haitumii chochote katika siku nyingine. Skills zina bajeti yao baada ya compaction: bodies huingizwa tena, zikiwa na kikomo cha tokens 5,000 kwa skill na 25,000 kwa jumla; za zamani huondolewa kwanza. Truncation huhifadhi mwanzo wa file, kwa hiyo weka maagizo muhimu zaidi karibu na juu ya SKILL.md.

Kile kinachobaki baada ya compaction huamua mahali ambapo agizo linapaswa kuwekwa.

  • System prompt na mtindo wa output hubaki bila kubadilika, kwa sababu si sehemu ya message history.
  • Project-root CLAUDE.md, rules zisizo na scope, na auto memory huingizwa tena kutoka disk.
  • Rule yenye frontmatter ya paths: hupotea hadi file inayolingana isomwe tena.
  • CLAUDE.md iliyowekwa ndani ya subdirectory hupotea hadi file iliyo ndani ya subdirectory hiyo isomwe tena.
  • Hooks haziathiriwi, kwa sababu hook huendeshwa kama code na haiingii kwenye context.

Kwa hiyo, rule unayoitegemea inapaswa kuwekwa kwenye project-root CLAUDE.md: Claude Code huondoa tool outputs za zamani kwanza, kisha hufanya summary, kwa hiyo maagizo kutoka mwanzoni mwa conversation yanaweza kupotea. Hariri memory kwa kutumia /memory. Claude Code huhifadhi copy iliyopakia wakati wa kuanza kwa session, kwa hiyo trim ya katikati ya session huhifadhi prompt cache na haitumiki hadi /clear, /compact inayofuata au restart. Kupotea kwa context ni sababu moja tu ya rule kuacha kufuatwa, kwa hiyo rule ikiwa bado iko wazi kwenye window lakini inapuuzwa, chunguza sababu nyingine kabla ya kuandika upya.

/clear kati ya kazi, /compact ndani ya kazi moja

Hizi mbili zinaonekana kubadilishana, lakini gharama zake zinatofautiana sana.

/clear [name] huanzisha mazungumzo mapya bila muktadha. Haitumi ombi lolote, kwa hiyo haina gharama. Pitisha jina ili kuweka lebo kwenye mazungumzo yaliyotangulia katika kiteuzi cha /resume; /reset na /new ni majina mengine ya amri hiyo. Itumie mara tu unapohamia kwenye kazi isiyohusiana, kwa sababu vinginevyo kazi ya zamani ingetumwa tena, na kutozwa tena, katika kila ujumbe wa kazi mpya.

/compact [instructions] huachilia nafasi ya muktadha huku ikiendelea na mazungumzo yale yale: hufupisha historia hadi hapo na kuibadilisha. Itumie ndani ya kazi moja ndefu ambayo bado inahitaji mwendelezo.

Daima mpe /compact maagizo. /compact bila maagizo hufanya muhtasari kwa kutumia prompt chaguomsingi ambayo haijui ni sehemu gani ya kazi bado unayohitaji. Ukiipa maagizo, huhifadhi:

/compact focus on the auth bug fix
/compact keep only the plan and the diff

Ikiwa unatumia compact kwa sababu ile ile kila mara, weka agizo la kudumu katika CLAUDE.md ya mradi wako chini ya kichwa cha # Compact instructions. Katika session mpya, /compact huchapisha Not enough messages to compact., ambayo humaanisha tu kuwa bado hakuna historia.

Gharama mbili huchanganywa hapa. Ombi la kufanya muhtasari hushiriki prefix yako, kwa hiyo husoma cache iliyopo badala ya kuchakata historia tena, na muda wake mwingi hutumika kutengeneza muhtasari. Kufanya compact kwa muktadha mkubwa bado ni ombi kubwa, kwa sababu mazungumzo yanayofanyiwa muhtasari ndiyo input. Turn inayofuata baada ya compact si sehemu inayochukua muda mwingi: hujenga tena cache kwa prompt fupi zaidi.

Kuna commands mbili za bei nafuu zaidi. /rewind [description] hurudisha nyuma code na mazungumzo hadi checkpoint; kwa path unayotaka kuacha kabisa, ni bora kuliko kufanya compact, kwa sababu hurudisha nyuma hadi prefix ambayo tayari iko kwenye cache. /recap huongeza muhtasari kama command output badala ya kubadilisha historia, kwa hiyo prefix iliyo kwenye cache hubaki vilevile.

Compaction ya kiotomatiki inapoendelea kujirudia, huchapisha hivi:

Autocompact is thrashing: the context refilled to the limit...

Compaction imekamilika, lakini file au tool output ilijaza tena window mara kadhaa mfululizo, kwa hiyo Claude Code iliacha kujaribu tena. Rejesha hali kwa kusoma file kubwa kwa vipande vya line, kuendesha /compact kwa focus inayoondoa output kubwa, kuhamishia kazi hiyo kwa subagent, au kutumia /clear ikiwa mazungumzo ya awali yamekwisha.

Seva za MCP ni gharama ya kudumu

Kila seva ya MCP unayounganisha huongeza gharama kwenye kila ombi katika kipindi chote cha session. Unalipia gharama hiyo hata kama huitumii.

Claude Code hupunguza athari hii. Kwa chaguo-msingi, ufafanuzi wa zana za MCP huahirishwa, kwa hiyo majina ya zana pekee ndiyo huingia kwenye context hadi Claude itumie zana mahususi. Endesha /context ili kuona gharama halisi ya seva zako, na /mcp disable <name> ili kuondoa seva ambayo hutaitumia leo. Ikiwa unaendesha seva zako za MCP kwenye VPS, hesabu hiyo hiyo huweka kikomo cha idadi ya zana ambazo seva moja inapaswa kutoa.

Fanya hivi mwanzoni mwa session. Ufafanuzi unapobaki umeahirishwa, kuunganisha au kukata seva huongeza tu maudhui kwenye mazungumzo, na cache huendelea kuwepo. Badala yake, ufafanuzi unapopakiwa kwenye prefix kwa sababu tool search imezimwa au seva haijaahirishwa, mabadiliko hayo hayo husababisha ombi linalofuata kusoma kila kitu upya.

Chuja output ndefu ya tool kabla haijaingia kwenye context

Matokeo ya tool ni input, na input hutumwa tena katika kila turn inayofuata. Test run inayotoa tokens 20,000 za output si gharama ya mara moja: utailipia tena katika kila turn hadi iondoke kwenye window.

Chuja kwenye chanzo. Hook inayopunguza test run na kubakiza failures pekee kabla Claude hajayaona hubadilisha output hiyo ndefu kuwa tokens mia chache, katika turn hii na kila itakapotumwa tena:

npm test 2>&1 | grep -E "FAIL|Error:" | head -40

Hooks zenyewe haziingii kwenye context, kwa sababu zinaendeshwa kama code. Fanya hivi kwa tool yoyote ambayo output yake inazidi urefu wa screen. Mantiki hiyo hiyo inatumika kwa file lenye mistari 3,000: omba range ya mistari unayohitaji, kwa sababu file lote hubaki kwenye window mara tu linapowasili.

Dhibiti faili ambazo agent husoma, na kabidhi kazi zenye kelele

Prompt inayotaja faili na dalili husoma faili hilo. Ombi la jumla la kupanga mradi husoma chochote ambacho agent anaona kinafaa, na kila usomaji huo hubaki kwenye context window.

Kabidhi kazi zenye maelezo mengi kwa subagent. Uendeshaji wa test na uchakataji wa log hutumia context halisi; subagent huweka output hiyo kwenye window yake na kurudisha muhtasari pekee. Hasara yake ni kwamba subagent huunda cache yake bila kupata cache hit kwenye mwito wa kwanza, na hutumia muda wa cache wa dakika tano hata ukiwa na subscription. Ukabidhi wa kazi hulinda kwa uhakika context yako kuu. Hupunguza jumla ya tokens kila wakati.

Saa hii ya cache: fanya kazi kwa vipindi

Prompt caching ndiyo hufanya kutuma tena kuwe na gharama nafuu: 0.1x ya kiwango cha msingi cha input kusoma prefix, ikilinganishwa na 1.25x ya kuiandika, au 2x kuiandika kwa lifetime ya saa moja. Kila matumizi huongeza muda wa entry bila gharama ya ziada, kwa hiyo saa huanza kuhesabiwa kutoka matumizi ya mwisho. Multipliers hizo zinaonyesha muundo wa bili, lakini si ukubwa wake. Ziunganishe na gharama halisi ya tokens milioni moja ili kubadilisha context window kamili kuwa kiasi cha dola.

Lifetime utakayopata inategemea jinsi unavyothibitisha utambulisho, na hapo ndipo kauli ya jumla kwamba "cache yako huisha baada ya dakika tano" inapokosea.

  • Kwenye usajili wa Claude, Claude Code huomba kiotomatiki lifetime ya saa moja.
  • Ukivuka kikomo cha plan yako na kuanza kutumia usage credits, matumizi hayo hutozwa, kwa hiyo lifetime hurudi kuwa dakika tano.
  • Kwenye API key au cloud provider, hubaki kuwa dakika tano. ENABLE_PROMPT_CACHING_1H=1 huomba lifetime ya saa moja, na FORCE_PROMPT_CACHING_5M=1 huilazimisha irudi kuwa dakika tano.

Ushauri wa mpangilio wa kazi ni uleule katika hali zote mbili: fanya kazi katika vipindi vinavyoendelea, kwa sababu pengo la kutofanya kazi linalozidi lifetime husababisha zamu yako inayofuata iandike tena prefix yote iliyokusanywa. Claude Code session iliyotenganishwa katika tmux haina gharama ikiwa haifanyi kazi, na cache iliyo tayari ndiyo gharama unayoacha baada ya muda huo wa kutofanya kazi.

Baadhi ya vitendo hutupa cache hata ukiwa bado unafanya kazi: kubadili models, kubadili effort level, kuwasha fast mode, kuunganisha au kutenganisha MCP server, kuwezesha au kuzima plugin, kukataa tool nzima, kufanya compacting, na kuboresha Claude Code. /model ndiyo mshangao wa kawaida, kwa sababu kila model ina cache yake. Kwa hiyo, request inayofuata husoma historia yote bila cache hits, ingawa maudhui ni yaleyale. Usomaji huo tena hutozwa kwa viwango vya destination model, kwa hiyo kubadili kwenda Fable katikati ya session hutoza historia yote uliyokusanya kwa published input rate ya Fable 5.

Kuhariri files, kuhariri CLAUDE.md, kuita skills na commands, kuendesha /recap, kurudi nyuma, na kuanzisha subagent hakutupi cache. Cache hiyo inahusishwa na machine moja na directory moja, kwa hiyo sessions mbili zilizo katika directories tofauti hazitumii cache ya kila mmoja. Uhusiano huo hufuata CLI badala ya account yako, kwa hiyo hakuna chochote kati ya hivyo kinachohamishwa kwenda Claude desktop app, ambayo kwenye Linux ni beta install tofauti inayotumika pamoja na CLI.

Ili kuona kama caching inafanya kazi, soma current_usage. cache_creation_input_tokens iliandikwa kwa kiwango cha cache write; cache_read_input_tokens ilitolewa kwa takriban sehemu ya kumi ya kiwango cha kawaida cha input. Uwiano mkubwa wa usomaji dhidi ya uundaji ni ishara nzuri. Ikiwa uundaji unabaki juu zamu baada ya zamu, kuna kitu katika prefix yako kinachoendelea kubadilika.

Je, context window kubwa zaidi hutatua hili?

Kwa kiasi. Baadhi ya models za sasa zinaunga mkono context window ya token milioni 1, na compaction hufanya kazi kwa njia ileile kwenye kikomo hicho kikubwa. Gharama haibadiliki, kwa sababu prompt yote bado hutumwa tena na kutozwa kwenye kila turn. Context window kubwa huamua wakati unapolazimika kuchukua hatua; usafi wa context huamua gharama. Ikiwa bill ndiyo tatizo badala ya kikomo, ni mpango gani wa Claude unaolingana na namna unavyofanya kazi huamua ikiwa unatumia dola au allowance ya mpango.

Uhariri na ufupishaji wa muktadha katika API ni vitu tofauti

Ikiwa unaunda agent yako mwenyewe kwenye Messages API, hakuna slash commands, kwa hiyo unatekeleza hili mwenyewe. Panga kazi hiyo tangu mwanzo, kwa sababu API haina free tier zaidi ya credit ndogo ya usajili, hivyo kila turn ya historia ambayo haijapunguzwa hutozwa kikamilifu. Provider unayemchagua huamua hesabu hiyo kabla ya trimming yoyote kufanyika. Kwa hiyo, ikiwa chaguo bado halijaamuliwa, hesabu gharama ya workload hiyo hiyo kwenye API zote mbili badala ya kulinganisha viwango vinavyotangazwa vya kila token. Kuna vipengele viwili vya upande wa server vinavyofanya kazi hiyo. Si kipengele kimoja.

Context editing huondoa kwa kuchagua maudhui mahususi kwenye historia ya mazungumzo inapokua, kisha hubadilisha kila matokeo yaliyoondolewa kwa maandishi ya placeholder ili Claude ajue kuwa kitu kimeondolewa. Hiki ni beta: tuma anthropic-beta: context-management-2025-06-27 na usanidi strategies chini ya context_management.edits. clear_tool_uses_20250919 huondoa tool results, na clear_thinking_20251015 hudhibiti thinking blocks. trigger yake huwa 100,000 input tokens kwa chaguo-msingi, keep huwa matumizi 3 ya mwisho ya tools, na clear_tool_inputs huwa false, kwa hiyo inputs hubaki na results pekee ndizo huondolewa.

Compaction hutengeneza muhtasari na kubadilisha historia yote ya mazungumzo kwa muhtasari huo. Hiki pia ni beta: tuma anthropic-beta: compact-2026-01-12 na utumie edit type compact_20260112. Trigger huwa {"type": "input_tokens", "value": 150000} kwa chaguo-msingi, na thamani lazima iwe angalau 50,000.

Compaction ina sheria moja ya handoff ambayo huvuruga agents bila kuonekana. Jibu huanza na content block ya compaction iliyo na muhtasari, ikifuatiwa na text block ya kawaida. Lazima urudishe block hiyo kwenye requests zinazofuata. API kisha huondoa kila content block iliyotangulia. Kwa vitendo, ongeza response.content nzima, si text pekee.

Nyaraka za Anthropic zinataja server-side compaction kuwa strategy kuu ya kudhibiti muktadha katika mazungumzo yanayoendelea kwa muda mrefu, na context editing kuwa chaguo la kudhibiti kwa undani zaidi kitakachoondolewa. Kwanza thibitisha model support. Opus, Sonnet na Fable models za sasa zinaunga mkono compaction; claude-haiku-4-5 haiungi mkono, na ukurasa wa compaction una orodha ya sasa. Beta yoyote kati ya hizi haiendeshi /compact ya Claude Code, ambayo nyaraka zake zinaeleza kuwa ni ombi la mara moja la kutengeneza muhtasari linalotumwa na client.

FAQ

Kwa nini kipindi changu cha Claude Code huwa polepole na ghali zaidi kadiri kinavyoendelea?

Kwa sababu mazungumzo yote hutumwa tena katika kila zamu. Kwa hiyo, swali la mstari mmoja katika kipindi ambacho kimekuwa wazi siku nzima hubeba maudhui yote ya siku hiyo. Prompt caching hudumisha gharama hiyo ikiwa akiba bado iko hai, kwa kiwango cha 0.1x cha bei ya msingi ya ingizo wakati wa kusoma. Zamu inapokosa akiba, kiambishi awali hicho huandikwa tena kwa kiwango cha 1.25x. Endesha /context ili kuona kinachojaza window, kisha soma Claude Code hukutoza kwa ajili ya nini ili kuelewa utaratibu huo.

Kuna tofauti gani kati ya /clear na /compact katika Claude Code?

/clear huanzisha mazungumzo mapya bila context. Haitumi request yoyote, kwa hiyo haina gharama. Hilo ndilo chaguo sahihi kati ya task zisizohusiana. /compact huhifadhi mazungumzo yale yale na kubadilisha historia kuwa muhtasari. Hilo ndilo chaguo sahihi ndani ya task moja ndefu. Ipe focus, kama ilivyo katika /compact keep only the plan and the diff, kwa sababu maagizo hayo huamua kitakachobaki.

Ninaonaje kinachotumia context window yangu ya Claude Code?

Endesha /context, au /context all ili kupata mgawanyo kamili wa kila kipengele. Huonyesha system prompt, tool definitions, MCP servers, memory files na history kama grid yenye rangi. Pia hutoa mapendekezo kuhusu tools zinazotumia context nyingi na memory bloat. Kwenye paid plan, /usage pia huonyesha matumizi ya hivi karibuni kwa kila skill, subagent na MCP server.

Je, nitumie context window ya token milioni 1 badala ya kufanya compaction?

Window kubwa huchelewesha tatizo badala ya kulitatua. Models kadhaa za sasa hutumia context window ya token milioni 1, zikiwemo Opus 4.8 na Sonnet 5, na compaction hufanya kazi kwa njia ile ile humo. Kila zamu bado hutuma prompt yote tena na bado hutozwa kwa ajili yake. Kwa hiyo, mazungumzo yenye token 400,000 huwa ghali bila kujali kama yanatoshea.

Kuna tofauti gani kati ya context editing na compaction katika Claude API?

Context editing hufuta maudhui ya zamani kwa kuchagua, hasa tool results. Huacha placeholder text mahali pa kila kipengele kilichofutwa ili Claude ajue kwamba kiliondolewa. Compaction hutengeneza muhtasari na kubadilisha history yote kwa muhtasari huo. Documentation ya Anthropic inaita compaction mkakati mkuu wa mazungumzo yanayodumu muda mrefu, na inaweka context editing kama chaguo la udhibiti wa kina. Vyote ni beta na vina headers zao. Pia vyote ni tofauti na /compact ya Claude Code.