SSD Nodes Learn 🎉 VPS dari $5.50/bln
Panduan Matt ConnorOleh Matt Connor · Dikemas kini 2026-08-14

Adakah ciri memori Claude dikenakan bayaran tambahan?

Ciri memori Claude tidak mempunyai harga khusus. Kos dikira berdasarkan token input yang dimainkan semula. Gunakan prompt caching untuk menjimatkan bil penggunaan anda.

Adakah ciri memori Claude mengenakan bayaran tambahan?

Ciri memori Claude tidak mempunyai harga tersendiri. Kadar yang diterbitkan oleh Anthropic adalah berdasarkan setiap juta token input dan setiap juta token output, dengan kadar tambahan untuk prompt caching, dan tiada satu pun daripadanya dipanggil sebagai token memori. Menyimpan memori itu sendiri tidak menelan sebarang kos pada Claude API (application programming interface), kerana alat memori adalah berasaskan klien dan fail tersebut berada pada storan milik anda.

Memori tetap akan mempengaruhi bil anda, kerana fakta yang diingati hanya mengubah jawapan apabila ia berada di dalam permintaan yang dibaca oleh Claude. Mengingati bermaksud menghantar semula. Teks tersebut sampai sebagai token input dan dicaj mengikut kadar input biasa model tersebut. Dua nombor menentukan jumlahnya: berapa banyak token teks yang diingati yang anda mainkan semula pada setiap giliran, dan sama ada teks yang dimainkan semula itu boleh disajikan daripada prompt cache.

Dalam langganan Pro atau Max, anda tidak dibilkan mengikut token sama sekali, jadi memori menggunakan kuota penggunaan anda dan bukannya wang anda. Mekanisme di bawah adalah sama. Hanya unitnya yang berubah. Kuota tersebut adalah terhad, jadi adalah wajar untuk mengetahui kos Claude Pro dan tahap had yang menyekat anda sebelum anda memutuskan berapa banyak memori yang perlu dibawa oleh setiap giliran. Claude Enterprise pula berbeza, kerana ia mengukur setiap token pada kadar API sebagai tambahan kepada harga kerusi, jadi blok memori yang terlalu besar akan kembali menjadi wang dan bukannya kuota. Jika memotong memori membawa penggunaan anda kembali ke bawah siling pelan yang lebih kecil dengan selesa, beralih daripada Max kepada Pro adalah langkah susulan yang berbaloi, dan perubahan tersebut akan berkuat kuasa pada penghujung tempoh yang telah anda bayar. Jika perbandingan yang anda timbangkan sebenarnya merentasi penyedia dan bukannya merentasi peringkat Anthropic sendiri, pelan Claude yang diletakkan bersebelahan dengan ChatGPT pada harga semasa adalah tempat untuk bermula.

Apakah maksud "memory" pada setiap platform Claude

Tiga produk berasingan berkongsi istilah yang sama, dan kekeliruan sering timbul kerana mencampuradukkan ketiga-tiganya.

Alat memory pada Claude API. Anda menambah satu entri ke dalam tatasusunan tools dan melaksanakan operasi fail dalam kod anda sendiri.

{"type": "memory_20250818", "name": "memory"}

Sehingga Ogos 2026, alat ini tersedia secara umum pada Messages API tanpa pengepala beta, pada model Claude 4 dan versi terkemudian. Ia bersifat sisi klien: Claude meminta operasi seperti view /memories, pengendali anda menjalankannya terhadap storan yang anda kawal, dan anda mengembalikan hasilnya dalam blok tool_result. Anthropic tidak menyimpan fail tersebut, jadi tiada caj storan yang dikenakan. Sebaliknya, anda membayar untuk perjalanan pergi balik (round trip) tersebut. Definisi alat dihantar dalam setiap permintaan, dan kandungan fail yang dikembalikan kekal dalam perbualan bermula dari titik tersebut.

Anthropic menerbitkan bahagian tetap bagi overhead tersebut. Pada Claude Opus 5 dengan pilihan alat auto, prompt sistem penggunaan alat adalah sebanyak 286 token, seperti yang didokumenkan pada Ogos 2026. Jumlah ini dibayar sekali bagi setiap permintaan apabila sebarang alat hadir, sama ada memory atau sebaliknya.

Claude Code. Dua mekanisme dimuatkan pada permulaan setiap sesi. Fail CLAUDE.md menyimpan arahan yang anda tulis. Auto memory menyimpan nota yang ditulis oleh Claude untuk dirinya sendiri, di bawah ~/.claude/projects/<project>/memory/. Hanya 200 baris pertama atau 25KB daripada MEMORY.md yang dimuatkan, mengikut had mana yang dicapai dahulu, dan fail topik di sebelahnya dibaca atas permintaan dan bukannya semasa permulaan. Segala yang dimuatkan semasa permulaan menjadi sebahagian daripada awalan (prefix) yang dibawa oleh setiap permintaan seterusnya dalam sesi tersebut. Bagaimana Claude Code memanggil semula memory antara sesi merangkumi urutan pemuatan fail demi fail.

Claude di web. Pada claude.ai, memory ialah set entri yang ditulis dan dikemas kini oleh Claude semasa anda bersembang, dengan ruang memory berasingan bagi setiap projek. Settings > Memory menyenaraikan perkara yang disimpan, dan togol di situ menawarkan Pause memory atau Reset memory. Platform ini dibilkan melalui langganan, jadi penggunaan memory di sini akan menggunakan had penggunaan anda.

Mengapa teks yang diingati dibilkan sebagai token input

Messages API adalah tanpa status (stateless). Ia tidak menyimpan apa-apa antara panggilan, jadi klien anda menghantar keseluruhan perbualan pada setiap giliran dan model membaca semuanya semula. Memori bukanlah pengecualian kepada peraturan itu. Ia hanyalah satu lagi blok teks dalam permintaan yang sama.

Pembahagian ini boleh dilihat dalam objek usage pada mana-mana respons.

"usage": {
  "input_tokens": 412,
  "cache_creation_input_tokens": 0,
  "cache_read_input_tokens": 18240,
  "output_tokens": 236
}

input_tokens hanya mengira token yang tidak dibaca daripada cache dan tidak digunakan untuk menciptanya, yang secara praktikalnya bermaksud token selepas titik henti cache terakhir. Jumlah input untuk permintaan tersebut ialah cache_read_input_tokens ditambah cache_creation_input_tokens ditambah input_tokens. Fail memori yang dibuka oleh Claude tiga giliran yang lalu berada di dalam jumlah tersebut pada setiap giliran sejak itu. Ia diletakkan di bawah cache_read_input_tokens selagi awalan cache dikekalkan, dan di bawah input_tokens apabila ia tidak dikekalkan. Teks yang sama, harga yang sangat berbeza. Token input dan output membawa harga yang berbeza, dan memori hanya akan sentiasa berada di bahagian input.

Tempat untuk melihat angka ini dalam penggunaan anda sendiri

Jangan ambil angka daripada catatan blog, termasuk catatan ini. Ukur blok memori anda sendiri. Pengiraan token adalah percuma dan mempunyai had kadar tersendiri, jadi pengukuran ini tidak menelan sebarang kos.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "content-type: application/json" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-opus-5",
    "system": "You are a scientist",
    "messages": [{"role": "user", "content": "Hello, Claude"}]
  }'

Respons yang diberikan ialah satu angka, seperti { "input_tokens": 14 }. Jalankan sekali dengan teks memori anda ditampal ke dalam medan system dan sekali lagi tanpa teks tersebut; perbezaannya ialah kos memori yang dikenakan kepada anda pada setiap giliran. Dua peringatan perlu diambil kira. Kiraan ini hanyalah anggaran, dan token tambahan yang ditambah oleh Anthropic untuk pengoptimuman sistemnya sendiri tidak dibilkan kepada anda. Selain itu, buat kiraan berdasarkan model yang akan anda jalankan, kerana Claude 4.7 dan versi terkemudian menggunakan tokenizer baharu yang menghasilkan kira-kira 30 peratus lebih banyak token untuk teks yang sama.

Di dalam Claude Code, soalan yang sama dijawab tanpa sebarang curl sama sekali.

  • /context menunjukkan perkara yang dimuatkan sekarang, termasuk fail memori, supaya anda boleh melihat bahagiannya dalam tetingkap sebelum anda menaip apa-apa.
  • /memory menyenaraikan fail CLAUDE.md anda dan membuka folder memori automatik.
  • /usage mencetak jumlah sesi, termasuk bacaan cache dan penulisan cache.
  • Baris status boleh memaparkan penggunaan tetingkap konteks secara berterusan, supaya pertumbuhan dapat dilihat semasa ia berlaku.

Blok sesi /usage kelihatan seperti ini:

Total cost:            $0.55
Total duration (API):  6m 20s
Total duration (wall): 6h 33m 10s
Total code changes:    0 lines added, 0 lines removed
Usage by model:
   claude-sonnet-4-6:  1.2k input, 5.3k output, 940.0k cache read, 50.0k cache write ($0.55)

Baca baris terakhir dengan teliti. Angka bacaan cache 940.0k ialah perbualan, memori dan segala-galanya, yang dihantar semula pada setiap giliran pada kadar cache. Angka input 1.2k hanyalah bahagian yang baharu. Claude Code mengira jumlah dolar tersebut secara setempat daripada harga senarai, jadi ia mengabaikan sebarang diskaun yang anda miliki dan mungkin berbeza daripada invois anda. Halaman Usage dalam Claude Console ialah angka yang muktamad.

Kemudian, jalankan perbandingan secara terus. Tanya soalan pembukaan yang sama dalam dua sesi baharu, satu sesi biasa dan satu lagi dengan memori automatik dimatikan.

CLAUDE_CODE_DISABLE_AUTO_MEMORY=1 claude

Jalankan /context dalam setiap sesi dan bandingkan entri fail memori. Jurang tersebut ialah kos memori terkumpul anda pada permulaan setiap sesi, sebelum sebarang kerja dilakukan. Perincian penuh tentang ke mana perginya penggunaan token Claude Code wajar dibaca bersama dua angka tersebut.

Berapakah kos memainkan semula memori bagi setiap juta token?

Prompt caching adalah sebab mengapa blok memori yang sama boleh menelan kos sepuluh kali ganda lebih tinggi pada satu giliran berbanding giliran yang lain. Anthropic menerbitkan kadar cache sebagai gandaan harga input asas setiap model, jadi hubungan ini kekal walaupun harga dalam dolar berubah.

ChartAnthropic's published prompt caching rates, as a multiple of base input price
The data behind this chart
[
  {
    "label": "Base input",
    "price_multiple": 1
  },
  {
    "label": "5 minute cache write",
    "price_multiple": 1.25
  },
  {
    "label": "1 hour cache write",
    "price_multiple": 2
  },
  {
    "label": "Cache read",
    "price_multiple": 0.1
  }
]

Bacaan cache menelan kos 0.1 kali ganda harga input asas. Menulis entri dengan jangka hayat 5 minit menelan kos 1.25 kali ganda harga asas, dan jangka hayat 1 jam menelan kos 2 kali ganda harga asas. Anthropic menyatakan titik pulang modal dengan jelas: caching berbaloi selepas satu bacaan cache pada tempoh 5 minit, atau selepas dua bacaan cache pada tempoh 1 jam. Titik pulang modal untuk prompt caching ialah pengiraan yang perlu dijalankan sebelum anda menentukan di mana memori harus diletakkan.

Gandaan tersebut menukarkan kiraan main semula kepada aritmetik. Blok seterusnya adalah aritmetik daripada gandaan yang diterbitkan di atas, bukan ukuran bagi sebarang beban kerja sebenar. Ia meletakkan harga pada blok memori dalam tiga cara sepanjang sesi 100 giliran, yang dinyatakan sebagai bilangan token setara yang dicaj pada kadar input asas biasa.

ChartA memory block over 100 turns, expressed as base-rate input tokens
The data behind this chart
[
  {
    "label": "4,000 tokens, never cached",
    "base_rate_equivalent_tokens": "400,000"
  },
  {
    "label": "4,000 tokens, 1 write and 99 reads",
    "base_rate_equivalent_tokens": "44,600"
  },
  {
    "label": "1,000 tokens, 1 write and 99 reads",
    "base_rate_equivalent_tokens": "11,150"
  }
]

Blok memori 4,000 token yang terlepas cache pada kesemua 100 giliran dibilkan seperti 400,000 token kadar asas. Blok yang sama di sebalik satu penulisan cache 5 minit dan 99 bacaan cache dibilkan seperti 44,600. Kecilkan ia kepada suku daripada saiz asalnya dan kekalkan caching, ia akan dibilkan seperti 11,150. Ciri tersebut tidak berubah merentas 3 baris tersebut. Hanya kelakuan main semula yang berubah. Itu masih lagi kiraan token dan bukannya wang, dan menukarkan kiraan token kepada angka pada bil bulanan anda adalah satu pendaraban dengan kadar per-juta model anda. Kadar tersebut ditetapkan oleh model yang anda jalankan, jadi jika ejen akan menggunakan Claude Fable 5, mulakan daripada kadar per-juta yang diterbitkan dan kesesuaian kerjanya.

Baris kedua mengandaikan setiap daripada 99 permintaan seterusnya tiba semasa entri cache masih aktif. Andaian itu adalah punca kebanyakan bil sebenar menjadi tidak tepat.

Mengapakah soalan yang sama menjadi lebih mahal selepas rehat?

Entri cache mempunyai tempoh hayat, dan jam bermula pada permintaan yang menulis atau membacanya. Tempoh lalai ialah 5 minit. Pilihan 1 jam mengenakan kos 2x ganda untuk penulisan seperti yang ditunjukkan di atas. Dalam Claude Code, tempoh hayat ialah satu jam bagi langganan, dan ia berkurangan kepada lima minit sebaik sahaja anda menggunakan kredit penggunaan; pada API key atau penyedia awan, tempoh lalai ialah lima minit. Menetapkan ENABLE_PROMPT_CACHING_1H=1 mengekalkan tempoh hayat satu jam semasa menggunakan kredit penggunaan.

Oleh itu, soalan satu baris yang ditaip ke dalam sesi yang anda biarkan terbuka semasa makan tengah hari menjadi mahal kerana entri cache telah tamat tempoh semasa anda tiada. Keseluruhan awalan (prefix), termasuk memori, diproses semula pada kadar input asas dan ditulis ke dalam cache sekali lagi. Tempoh masa rehat tersebut menentukan harga itu.

Anda boleh mengesahkannya sendiri daripada sekadar mempercayainya. Pada pelan Pro, Max, Team atau Enterprise, pecahan /usage akan menandakan sebarang kelakuan yang menyumbang kepada 10 peratus atau lebih penggunaan terkini, dan kedua-dua konteks panjang serta cache misses akan muncul di situ mengikut nama. Pada API, perhatikan cache_creation_input_tokens melonjak kembali ke saiz penuh awalan anda pada permintaan pertama selepas tempoh senyap.

Perkara yang membatalkan cache secara senyap

Awalan yang dicache disusun mengikut urutan: alatan, kemudian sistem, dan seterusnya mesej. Perubahan pada satu peringkat akan membatalkan peringkat tersebut dan semua peringkat selepasnya. Menyunting definisi alatan akan membuang keseluruhan cache. Menyunting prompt sistem akan membuang cache sistem dan mesej.

Ini merupakan perangkap bagi sesiapa yang menyimpan memori dalam prompt sistem dan menulisnya semula apabila ejen belajar. Setiap penulisan semula akan membuang salinan cache bagi semua perkara di belakangnya, menyebabkan permintaan seterusnya perlu melakukan penulisan penuh sekali lagi. Pastikan bahan yang stabil berada di hadapan dan kekalkan kestabilannya, manakala bahan yang tidak stabil diletakkan di bahagian akhir senarai mesej supaya pembatalannya tidak menelan kos yang tinggi.

Terdapat kegagalan kedua yang lebih senyap. Setiap model mempunyai awalan minimum yang boleh dicache: 512 token pada Claude Opus 5, 1,024 pada Claude Sonnet 5, 4,096 pada Claude Haiku 4.5, seperti yang diterbitkan pada Ogos 2026. Dokumentasi Anthropic menyatakan dengan jelas tentang perkara yang berlaku di bawah had tersebut: "Sebarang permintaan untuk mencache kurang daripada jumlah token ini akan diproses tanpa caching, dan tiada ralat dikembalikan." Oleh itu, fail memori kecil yang ditandakan dengan cache_control tidak akan berfungsi sama sekali secara senyap. Gejala yang boleh anda lihat ialah cache_creation_input_tokens kekal pada 0 walaupun prompt anda jelas mengandungi breakpoint.

Singkirkan memori yang tidak lagi memberikan nilai

Setiap baris memori menggunakan token pada setiap pusingan yang membawanya, jadi persoalan bagi setiap baris adalah sama ada ia telah mengubah jawapan baru-baru ini. Claude Code menjadikan had ini konkrit. Sasarkan untuk memastikan CLAUDE.md berada di bawah 200 baris, kerana fail yang lebih panjang menggunakan lebih banyak konteks dan mengurangkan kebolehpercayaan Claude dalam mematuhinya. MEMORY.md dihadkan kepada 200 baris pertama atau 25KB semasa waktu pemuatan, dan apa-apa yang melebihi had tersebut akan digugurkan pada permulaan sesi seterusnya, jadi indeks yang terlalu besar hanya membazirkan token dan tidak memberikan manfaat.

Dua tabiat dapat memastikan saiznya kekal kecil. Alihkan perincian keluar daripada indeks dan masukkan ke dalam fail topik, yang dibaca oleh Claude atas permintaan dan bukannya semasa permulaan. Alihkan arahan aliran kerja keluar daripada CLAUDE.md dan masukkan ke dalam kemahiran (skills), yang dimuatkan hanya apabila dipanggil. Bagi fail memori yang sudah bermula dengan frontmatter, Claude Code merekodkan masa penulisan dalam medan modified sebagai cap masa ISO 8601, dalam versi 2.1.214 atau lebih baharu, dan cap masa tersebut merupakan cara terpantas untuk mengesan fakta yang telah lapuk. Menyingkirkan memori ejen yang lapuk membincangkan proses semakan dengan lebih mendalam.

Apabila pengambilan data lebih baik daripada memuatkan segala-galanya ke dalam konteks

Alat memori wujud untuk menyokong pengambilan data tepat pada masanya (just-in-time). Daripada memuatkan segala-galanya di awal, ejen merekodkan apa yang dipelajari dan membaca semula fail hanya apabila tugasan memerlukannya. Ini mengubah pengiraan, kerana bacaan fail menelan kos tokennya sekali sahaja dan kemudian kekal di dalam awalan (prefix) yang dicache, manakala blok yang dimuatkan secara kekal menelan kos pada setiap pusingan.

Satu peraturan mudah terhasil daripada dua carta di atas. Teks yang digunakan dalam hampir setiap pusingan perlu diletakkan dalam awalan cache yang stabil. Teks yang digunakan sekali dalam dua puluh pusingan perlu diletakkan di sebalik panggilan view. Titik pulang modal berubah mengikut bilangan ulangan anda, bukan berdasarkan caj daripada Anthropic.

Pada API, anda juga boleh membiarkan platform memotong perbualan. Penyuntingan konteks akan mengosongkan hasil alat lama sebaik sahaja perbualan melepasi ambang yang anda tetapkan.

{
  "edits": [
    {
      "type": "clear_tool_uses_20250919",
      "trigger": {"type": "input_tokens", "value": 30000},
      "keep": {"type": "tool_uses", "value": 3},
      "clear_at_least": {"type": "input_tokens", "value": 5000}
    }
  ]
}

Nilai lalai ialah pencetus 100,000 token input dan 3 penggunaan alat yang dikekalkan. Baca interaksi dengan caching sebelum anda mendayakannya: mengosongkan kandungan akan membatalkan awalan cache pada titik pengosongan tersebut, jadi anda akan membayar kos penulisan cache pada permintaan seterusnya. Itulah tujuan clear_at_least. Ia menangguhkan pengosongan sehingga penjimatan cukup besar untuk mewajarkan penulisan tersebut. Respons melaporkan dengan tepat apa yang berlaku di bawah context_management, dengan cleared_tool_uses dan cleared_input_tokens, supaya pertukaran tersebut boleh diukur dan bukannya sekadar teori. Mengurus tetingkap konteks dalam Claude Code menggunakan idea yang sama untuk sesi pengekodan.

Perkara yang mempunyai item baris sendiri

Memori tidak mempunyai caj tersendiri, tetapi beberapa ciri memang mempunyai caj, dan adalah berbaloi untuk mengetahui yang mana satu. Ini adalah kadar API Claude yang diterbitkan setakat Ogos 2026. Beberapa operasi tidak mengenakan sebarang bayaran langsung, tetapi tiada pelan percuma pada API Claude, hanya kredit kecil semasa pendaftaran, jadi segala yang disenaraikan di bawah adalah perbelanjaan sebenar bermula daripada permintaan pertama anda.

  • Carian web: $10 bagi setiap 1,000 carian, ditambah dengan kos token biasa bagi semua kandungan yang dimasukkan oleh carian ke dalam konteks.
  • Pelaksanaan kod: 1,550 jam percuma bagi setiap organisasi setiap bulan, kemudian $0.05 sejam bagi setiap kontena. Ia adalah percuma apabila digunakan bersama carian web atau pengambilan web.
  • Ejen Terurus Claude: masa jalan sesi pada $0.08 bagi setiap jam sesi, sebagai tambahan kepada caj token biasa.
  • Pengambilan web: tiada caj tambahan, hanya kos token bagi kandungan yang diambil.

Memori tidak muncul pada mana-mana baris tersebut. Ia muncul dalam kiraan token input anda, yang merupakan tempat tepat untuk anda mengukurnya, dan tempat tepat di mana pemangkasan (pruning) dan caching boleh menguranginya. Jika anda sedang merancang belanjawan untuk ejen yang berjalan tanpa pengawasan pada pelayan peribadi maya (VPS), kawalan kos untuk ejen AI pada VPS adalah perkara seterusnya yang perlu disediakan, kerana ejen dengan fail memori yang semakin berkembang tanpa pemangkasan akan menjadi lebih mahal setiap minggu tanpa sebarang laporan mengenainya.

FAQ

Adakah terdapat caj berasingan untuk ciri memori Claude?

Tidak. Senarai harga Anthropic mempunyai kadar bagi setiap juta token input, setiap juta token output dan gandaan caching prompt, tanpa baris caj untuk memori. Pada API Claude, alat memori berfungsi di bahagian klien, jadi fail tersebut disimpan pada storan yang anda sudah bayar. Apa yang ditambah oleh memori ialah token input, yang dibilkan pada kadar input biasa model bagi setiap pusingan yang membawanya.

Adakah mematikan memori menjadikan Claude lebih murah?

Ia mengurangkan jumlah token bagi setiap permintaan, yang merendahkan kos setiap permintaan. Sama ada ia menjimatkan wang secara keseluruhan bergantung pada apa yang berlaku seterusnya. Jika Claude perlu membaca semula tiga fail dan bertanya kepada anda dua soalan untuk membina semula apa yang sudah disimpan oleh memori, token tersebut menelan kos yang lebih tinggi daripada memori itu sendiri. Ukur kos tersebut daripada membuat andaian: jalankan /context dalam sesi dengan memori automatik dihidupkan dan dalam sesi yang dimulakan dengan CLAUDE_CODE_DISABLE_AUTO_MEMORY=1, kemudian bandingkan jumlah token yang digunakan untuk tugasan yang sama.

Mengapa penggunaan saya meningkat sedangkan saya tidak mengubah apa-apa?

Punca paling biasa ialah cache miss selepas tempoh jeda. Entri cache bertahan selama 5 minit secara lalai, atau satu jam pada tetapan lanjutan, jadi permintaan pertama selepas rehat akan memproses semula keseluruhan awalan anda pada kadar input asas dan menulisnya semula. Punca kedua yang biasa ialah penyuntingan awalan: menukar definisi alat akan membatalkan keseluruhan cache, dan menukar system prompt akan membatalkan cache sistem dan mesej. Pada pelan langganan, pecahan /usage akan menamakan tingkah laku tersebut apabila ia menyumbang 10 peratus atau lebih daripada penggunaan terkini.

Patutkah memori diletakkan dalam system prompt atau di sebalik panggilan alat?

Letakkannya dalam system prompt apabila hampir setiap pusingan menggunakannya, kerana ia kemudiannya akan berada dalam awalan yang dicache dan menelan kos pada kadar bacaan cache. Letakkannya di sebalik panggilan view apabila hanya sesetengah tugasan memerlukannya, kerana fail yang dibaca sekali sahaja akan menelan kos tokennya sekali sahaja, bukannya pada setiap pusingan. Angka penentu ialah bilangan ulangan anda, dan objek usage memberikan angka tersebut secara terus kepada anda.

Adakah ciri memori dikira terhadap had penggunaan langganan?

Ya, secara tidak langsung, kerana had langganan digunakan oleh token yang dibawa oleh setiap permintaan. Dokumentasi bantuan Anthropic menyatakan bahawa perbualan yang lebih panjang yang mencetuskan pengurusan konteks automatik akan menggunakan lebih banyak had penggunaan anda. Memori menjadikan setiap permintaan sedikit lebih panjang, dan sesi yang panjang akan memainkan semula panjang tersebut pada setiap pusingan. Bagaimana had penggunaan Claude sebenarnya berfungsi merangkumi perkara yang ditetapkan semula dan bila ia berlaku.