هل تكلفك ذاكرة Claude رسوماً إضافية؟
لا تنشر Anthropic سعراً مستقلاً لذاكرة Claude: النص المُتذكَّر يُعاد كـ tokens إدخال، وتحدد فاتورتك كمية النص المعاد وإمكان تخزينه مؤقتاً.
هل تتطلب ميزات الذاكرة في Claude تكلفة إضافية؟
لا تفرض ميزات الذاكرة في Claude رسوماً مستقلة. تنشر Anthropic أسعارها لكل مليون token من الإدخال ولكل مليون token من الإخراج، مع أسعار إضافية للتخزين المؤقت للمطالبات، ولا يُسمّى أيٌّ منها token للذاكرة. لا يكلّف تخزين الذاكرة نفسه شيئاً عند استخدام Claude API (واجهة برمجة التطبيقات)، لأن أداة الذاكرة تعمل من جهة العميل، ويُحفظ الملف في مساحة تخزين تملكها.
مع ذلك، تؤثر الذاكرة في فاتورتك، لأن المعلومة المحفوظة لا تغيّر الإجابة إلا عندما تكون ضمن الطلب الذي يقرأه Claude. تذكّر المعلومة يعني إعادة إرسالها. يصل ذلك النص بوصفه tokens إدخال، وتُحتسب تكلفته وفق سعر الإدخال العادي للنموذج. ويحدد عاملان مقدار التكلفة: عدد tokens في النص المحفوظ الذي تعيد إرساله في كل دور، وما إذا كان يمكن تقديم هذا النص المعاد إرساله من ذاكرة التخزين المؤقت للمطالبة.
في اشتراك Pro أو Max، لا تُحاسب على أساس عدد tokens، لذا تستهلك الذاكرة من حصة الاستخدام بدلاً من أموالك. الآلية أدناه متطابقة. الذي يتغير هو وحدة القياس فقط. هذه الحصة محدودة، لذلك من المفيد معرفة تكلفة Claude Pro والنقطة التي تبدأ عندها حدوده بمنعك قبل أن تقرر مقدار الذاكرة التي ينبغي أن يحملها كل دور. أما Claude Enterprise فيعمل بطريقة مختلفة، إذ يحتسب كل token وفق أسعار API فوق سعر المقعد، ولذلك تتحول كتلة الذاكرة الكبيرة إلى تكلفة مالية بدلاً من استهلاك الحصة. إذا أدى تقليص الذاكرة إلى إعادة استخدامك بشكل مريح إلى ما دون سقف خطة أصغر، فإن الانتقال من Max إلى Pro هو الخطوة التالية المناسبة، ويُطبَّق التغيير في نهاية الفترة التي دفعت قيمتها مسبقاً. وإذا كانت المقارنة التي تدرسها فعلياً بين مزودين مختلفين، لا بين مستويات Anthropic نفسها، فابدأ من مقارنة خطط Claude بخطط ChatGPT وفق الأسعار الحالية.
ما المقصود بـ«الذاكرة» في كل واجهة من واجهات Claude
تستخدم ثلاثة منتجات منفصلة الكلمة نفسها، والخلط بينها هو السبب الأكبر في إرباك هذا السؤال.
أداة الذاكرة في Claude API. تضيف إدخالاً واحداً إلى مصفوفة tools، وتنفّذ عمليات الملفات في التعليمات البرمجية الخاصة بك.
{"type": "memory_20250818", "name": "memory"}اعتباراً من August 2026، أصبحت هذه الأداة متاحة عموماً في Messages API من دون ترويسة تجريبية، وعلى نماذج Claude 4 والإصدارات الأحدث. تعمل الأداة من جهة العميل: يطلب Claude عملية مثل view /memories، ويشغّل المعالج الخاص بك العملية على وحدة تخزين تتحكم بها، ثم تعيد النتيجة داخل كتلة tool_result. لا تحتفظ Anthropic بالملف، لذلك لا توجد رسوم تخزين تنقلها إلى المستخدم. أنت تدفع مقابل جولة التبادل بدلاً من ذلك. يُرسل تعريف الأداة مع كل طلب، ويبقى محتوى الملف الذي يعود ضمن المحادثة بدءاً من تلك النقطة.
تنشر Anthropic الجزء الثابت من هذه التكلفة الإضافية. في Claude Opus 5، عند استخدام اختيار أداة بقيمة auto، تتكون مطالبة نظام استخدام الأداة من 286 رمزاً، وفقاً لما هو موثّق في August 2026. تُحتسب هذه التكلفة مرة واحدة لكل طلب عند وجود أي أداة، سواء كانت أداة ذاكرة أم غيرها.
Claude Code. تُحمّل آليتان عند بدء كل جلسة. تحتوي ملفات CLAUDE.md على التعليمات التي تكتبها. وتحتوي الذاكرة التلقائية على ملاحظات يكتبها Claude لنفسه ضمن ~/.claude/projects/<project>/memory/. لا يُحمّل من MEMORY.md سوى أول 200 سطر أو 25KB، أيهما يحدث أولاً، بينما تُقرأ ملفات الموضوع الموجودة بجانبه عند الطلب بدلاً من قراءتها عند بدء التشغيل. يصبح كل ما يُحمّل عند بدء التشغيل جزءاً من البادئة التي يحملها كل طلب لاحق في تلك الجلسة. يشرح كيفية استرجاع Claude Code للذاكرة بين الجلسات ترتيب التحميل ملفاً تلو الآخر.
Claude على الويب. في claude.ai، تتكون الذاكرة من إدخالات يكتبها Claude ويحدّثها أثناء الدردشة، مع مساحة ذاكرة منفصلة لكل مشروع. يعرض Settings > Memory العناصر المخزنة، ويوفّر المفتاح هناك خياري Pause memory أو Reset memory. تُحتسب تكلفة هذه الواجهة ضمن الاشتراك، لذلك تستهلك الذاكرة هنا حدود الاستخدام.
لماذا يُحتسب النص المتذكَّر ضمن رموز الإدخال
واجهة Messages API عديمة الحالة. فهي لا تحتفظ بأي شيء بين الاستدعاءات، لذلك يرسل العميل المحادثة كاملة في كل دور، ويعيد النموذج قراءتها بالكامل. ولا تُستثنى الذاكرة من هذه القاعدة. فهي كتلة نصية إضافية ضمن الطلب نفسه.
يظهر هذا التقسيم في الكائن usage ضمن أي استجابة.
"usage": {
"input_tokens": 412,
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 18240,
"output_tokens": 236
}يحصي input_tokens الرموز التي لم تُقرأ من ذاكرة التخزين المؤقت ولم تُستخدم لإنشائها فقط، ما يعني عملياً الرموز الواقعة بعد آخر نقطة توقف للتخزين المؤقت. إجمالي الإدخال للطلب هو cache_read_input_tokens زائد cache_creation_input_tokens زائد input_tokens. يقع ملف ذاكرة فتحه Claude قبل 3 أدوار ضمن هذا الإجمالي في كل دور لاحق. ويُحتسب ضمن cache_read_input_tokens ما دام الجزء السابق المخزّن مؤقتاً صالحاً، وضمن input_tokens عندما لا يكون صالحاً. النص نفسه، لكن بسعرين مختلفين تماماً. تختلف أسعار رموز الإدخال والإخراج، ولا تُحتسب الذاكرة إلا ضمن جانب الإدخال.
أين ترى هذه الأرقام في استخدامك الفعلي
لا تعتمد على رقم وارد في تدوينة، بما في ذلك هذه التدوينة. قِس كتلة الذاكرة لديك بنفسك. عدّ الرموز مجاني وله حد معدل مستقل، لذلك لا تكلّفك عملية القياس شيئاً.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-5",
"system": "You are a scientist",
"messages": [{"role": "user", "content": "Hello, Claude"}]
}'تكون الاستجابة رقماً واحداً، مثل { "input_tokens": 14 }. شغّل الأمر مرة بعد لصق نص الذاكرة في الحقل system، ومرة أخرى من دونه. الفرق بين النتيجتين هو تكلفة تلك الذاكرة في كل دورة. انتبه إلى أمرين. العدد تقديري، والرموز الإضافية التي تضيفها Anthropic لتحسينات النظام الخاصة بها لا تُحتسب عليك. استخدم أيضاً النموذج الذي ستشغّله فعلياً، لأن Claude 4.7 والإصدارات الأحدث تستخدم محللاً رمزياً أحدث ينتج رموزاً أكثر بنحو 30 percent للنص نفسه.
داخل Claude Code، تحصل على الإجابة نفسها من دون استخدام curl.
- يعرض
/contextما تم تحميله الآن، بما في ذلك ملفات الذاكرة، حتى ترى حصتها من نافذة السياق قبل أن تكتب أي شيء. - يسرد
/memoryملفات CLAUDE.md ويفتح مجلد الذاكرة التلقائية. - يطبع
/usageإجماليات الجلسة، بما في ذلك قراءات ذاكرة التخزين المؤقت وكتاباتها. - يمكن لسطر الحالة عرض استخدام نافذة السياق باستمرار، لذلك يظهر نموه أثناء حدوثه.
تبدو كتلة جلسة /usage كما يلي:
Total cost: $0.55
Total duration (API): 6m 20s
Total duration (wall): 6h 33m 10s
Total code changes: 0 lines added, 0 lines removed
Usage by model:
claude-sonnet-4-6: 1.2k input, 5.3k output, 940.0k cache read, 50.0k cache write ($0.55)اقرأ السطر الأخير بعناية. يمثل رقم قراءة ذاكرة التخزين المؤقت 940.0k المحادثة والذاكرة وكل ما سبق إرساله مرة أخرى في كل دورة بسعر ذاكرة التخزين المؤقت. أما رقم الإدخال 1.2k فيمثل الجزء الجديد فقط. يحسب Claude Code مبلغ الدولار محلياً من أسعار القائمة، لذلك لا يراعي أي خصم لديك وقد يختلف عن فاتورتك. تُعد صفحة Usage في Claude Console الرقم المعتمد.
ثم أجرِ المقارنة مباشرة. اطرح السؤال الافتتاحي نفسه في جلستين جديدتين، إحداهما عادية والأخرى مع إيقاف تشغيل الذاكرة التلقائية.
CLAUDE_CODE_DISABLE_AUTO_MEMORY=1 claudeشغّل /context في كل جلسة، ثم قارن إدخال ملفات الذاكرة. يوضح الفرق تكلفة الذاكرة المتراكمة لديك في بداية كل جلسة، قبل تنفيذ أي عمل. يستحق تفصيل كامل لمواضع استهلاك Claude Code للرموز القراءة إلى جانب هذين الرقمين.
ما تكلفة إعادة تشغيل الذاكرة لكل مليون رمز؟
التخزين المؤقت للمطالبات هو سبب إمكانية أن تكلّف كتلة الذاكرة نفسها عشرة أضعاف تكلفتها في دور مقارنة بدور آخر. تنشر Anthropic أسعار التخزين المؤقت كمضاعفات لسعر الإدخال الأساسي لكل نموذج، لذلك تظل العلاقة نفسها حتى عندما تتغير الأسعار بالدولار.
The data behind this chart
[
{
"label": "Base input",
"price_multiple": 1
},
{
"label": "5 minute cache write",
"price_multiple": 1.25
},
{
"label": "1 hour cache write",
"price_multiple": 2
},
{
"label": "Cache read",
"price_multiple": 0.1
}
]تبلغ تكلفة قراءة من ذاكرة التخزين المؤقت 0.1 ضعف سعر الإدخال الأساسي. وتبلغ تكلفة كتابة إدخال بعمر 5 دقائق 1.25 ضعف السعر الأساسي، بينما تبلغ تكلفة الإدخال بعمر ساعة واحدة 2 ضعف السعر الأساسي. توضّح Anthropic نقطة التعادل مباشرة: يصبح التخزين المؤقت مجدياً بعد قراءة واحدة من ذاكرة التخزين المؤقت عند مدة 5 دقائق، أو بعد قراءتين عند مدة ساعة واحدة. نقطة التعادل في التخزين المؤقت للمطالبات هي الحساب الذي يجب إجراؤه قبل أن تقرر موضع الذاكرة.
تحوّل هذه المضاعفات عدد مرات إعادة التشغيل إلى حساب مباشر. الكتلة التالية هي حساب مبني على المضاعفات المنشورة أعلاه، وليست قياساً لحمل عمل فعلي. وهي تسعّر كتلة ذاكرة بثلاث طرق خلال جلسة من 100 دور، معبّراً عنها بعدد الرموز المكافئ الذي يُحاسب عليه وفق سعر الإدخال الأساسي العادي.
The data behind this chart
[
{
"label": "4,000 tokens, never cached",
"base_rate_equivalent_tokens": "400,000"
},
{
"label": "4,000 tokens, 1 write and 99 reads",
"base_rate_equivalent_tokens": "44,600"
},
{
"label": "1,000 tokens, 1 write and 99 reads",
"base_rate_equivalent_tokens": "11,150"
}
]إذا كانت كتلة الذاكرة المؤلفة من 4,000 رمز لا تصيب ذاكرة التخزين المؤقت في أي من الأدوار الـ100، فستُحاسب كما لو كانت 400,000 رمزاً بالسعر الأساسي. أما الكتلة نفسها خلف عملية كتابة واحدة إلى ذاكرة تخزين مؤقت مدتها 5 دقائق و99 قراءة من ذاكرة التخزين المؤقت، فستُحاسب كما لو كانت 44,600. وإذا قلّصت حجمها إلى ربع حجمها وأبقيت التخزين المؤقت، فستُحاسب كما لو كانت 11,150. لم تتغير الميزة عبر هذه الصفوف الـ3. الذي تغيّر هو سلوك إعادة التشغيل فقط. تظل هذه أعداد رموز وليست مبالغ مالية، وتحويل عدد الرموز إلى مبلغ في فاتورتك الشهرية يتطلب عملية ضرب واحدة في سعر نموذجك لكل مليون رمز. يحدّد النموذج الذي تشغّله هذا السعر، لذلك إذا كان الوكيل سيعمل على Claude Fable 5، فابدأ من أسعاره المنشورة لكل مليون رمز والمهام التي يناسبها.
يفترض الصف الثاني وصول كل طلب من الطلبات الـ99 اللاحقة بينما يظل إدخال التخزين المؤقت صالحاً. هذا الافتراض هو السبب في معظم الأخطاء في الفواتير الفعلية.
لماذا تكلّف الإجابة عن السؤال نفسه أكثر بعد انقطاع؟
لكل إدخال في ذاكرة التخزين المؤقت مدة صلاحية، وتبدأ هذه المدة عند الطلب الذي يكتب الإدخال أو يقرأه. المدة الافتراضية هي 5 دقائق. يكلّف خيار الساعة الواحدة ضعف تكلفة الكتابة الموضحة أعلاه. في Claude Code، تبلغ مدة الصلاحية ساعة واحدة عند استخدام اشتراك، وتنخفض إلى 5 دقائق عندما تُخصم التكلفة من أرصدة الاستخدام؛ أما عند استخدام مفتاح API أو موفر سحابي، فالمدة الافتراضية هي 5 دقائق. يحافظ ضبط ENABLE_PROMPT_CACHING_1H=1 على مدة الصلاحية البالغة ساعة واحدة عند استخدام أرصدة الاستخدام.
لذلك، تكون كتابة سؤال من سطر واحد في جلسة تركتها مفتوحة أثناء استراحة الغداء مكلفة، لأن إدخال ذاكرة التخزين المؤقت انتهت صلاحيته أثناء غيابك. تتم معالجة البادئة بأكملها، بما في ذلك الذاكرة، مرة أخرى بسعر الإدخال الأساسي، ثم تُكتب مجدداً في ذاكرة التخزين المؤقت. مدة التوقف هي التي حدّدت هذه التكلفة.
يمكنك التحقق من ذلك بدلاً من الاكتفاء بتصديقه. في خطط Pro أو Max أو Team أو Enterprise، يحدد تفصيل /usage أي سلوك مسؤول عن 10 بالمئة أو أكثر من الاستخدام الأخير، ويظهر كل من السياق الطويل وعمليات فقدان ذاكرة التخزين المؤقت بالاسم. في API، راقب cache_creation_input_tokens لترى أنه يرتفع مجدداً إلى الحجم الكامل للبادئة في أول طلب بعد فترة من الخمول.
ما الذي يُبطل ذاكرة التخزين المؤقت بصمت
تكون البادئة المخزنة مؤقتاً مرتبة بهذا التسلسل: الأدوات، ثم النظام، ثم الرسائل. يؤدي التغيير في مستوى ما إلى إبطال ذاكرة التخزين المؤقت لذلك المستوى وكل ما يليه. يؤدي تعديل تعريف أداة إلى التخلص من ذاكرة التخزين المؤقت بأكملها. ويؤدي تعديل موجه النظام إلى التخلص من ذاكرة النظام والرسائل.
هذه هي المشكلة التي تواجه كل من يحتفظ بالذاكرة في موجه النظام ثم يعيد كتابتها مع تعلّم الوكيل. كل إعادة كتابة تتخلص من النسخة المخزنة مؤقتاً لكل ما يليها، لذلك يدفع الطلب التالي تكلفة كتابة كاملة من جديد. أبقِ المحتوى الثابت في المقدمة وحافظ على ثباته، وضع المحتوى المتغير في موضع متأخر من قائمة الرسائل، حيث يكون إبطاله أقل تكلفة.
هناك إخفاق آخر أكثر هدوءاً. لكل نموذج حد أدنى للبادئة القابلة للتخزين المؤقت: 512 رمزاً في Claude Opus 5، و1,024 في Claude Sonnet 5، و4,096 في Claude Haiku 4.5، وفقاً لما نُشر في August 2026. توضح وثائق Anthropic ما يحدث عند عدم بلوغ هذا الحد: "تُعالج أي طلبات لتخزين عدد من الرموز أقل من هذا العدد دون تخزين مؤقت، ولا يُرجع أي خطأ." لذلك لا يفعل ملف ذاكرة صغير يحمل العلامة cache_control أي شيء على الإطلاق، من دون إظهار ذلك. والعَرَض الذي يمكنك رؤيته هو بقاء cache_creation_input_tokens عند 0، رغم أن موجهك يحتوي بوضوح على نقطة توقف.
اختصر الذاكرة التي لم تعد تستحق الاحتفاظ بها
تستهلك كل سطر من الذاكرة رموزاً في كل دور يتضمنه، لذلك يكون السؤال عن كل سطر هو ما إذا كان قد غيّر إجابة مؤخراً. يوضح Claude Code الحدود بشكل عملي. احرص على إبقاء ملف CLAUDE.md أقل من 200 سطر، لأن الملفات الأطول تستهلك مزيداً من السياق وتقلل مدى التزام Claude بها بشكل موثوق. يقتصر تحميل MEMORY.md على أول 200 سطر أو 25KB، وأي محتوى يتجاوز هذا الحد يُحذف عند بدء الجلسة التالية. لذلك يستهلك الفهرس الكبير رموزاً دون أن يضيف معرفة.
تحافظ عادتان على صغر حجمه. انقل التفاصيل من الفهرس إلى ملفات الموضوعات، إذ يقرأها Claude عند الطلب بدلاً من قراءتها عند بدء التشغيل. وانقل تعليمات سير العمل من CLAUDE.md إلى المهارات، التي لا تُحمّل إلا عند استدعائها. بالنسبة إلى ملفات الذاكرة التي تبدأ مسبقاً بـfrontmatter، يسجّل Claude Code وقت الكتابة في حقل modified كطابع زمني بتنسيق ISO 8601، وذلك في الإصدار 2.1.214 أو الإصدارات الأحدث. ويساعد هذا الطابع الزمني على اكتشاف المعلومة التي أصبحت قديمة بأسرع طريقة. يتناول اختصار ذاكرة الوكيل القديمة عملية المراجعة بمزيد من التفصيل.
عندما يتفوّق الاسترجاع على تحميل كل شيء في السياق
توجد أداة الذاكرة لدعم الاسترجاع في الوقت المناسب. بدلاً من تحميل كل شيء مسبقاً، يسجّل الوكيل ما يتعلمه ويقرأ الملف مجدداً فقط عندما تحتاج المهمة إليه. يغيّر ذلك طريقة حساب التكلفة، لأن قراءة الملف تستهلك عدد رموزه مرة واحدة، ثم يبقى الملف ضمن البادئة المخزّنة مؤقتاً، بينما تستهلك كتلة محمّلة دائماً تكلفتها في كل دور.
تنتج عن المخططين أعلاه قاعدة بسيطة. ينتمي النص الذي تستخدمه معظم الأدوار إلى البادئة المستقرة المخزّنة مؤقتاً. أما النص الذي يُستخدم مرة واحدة كل 20 دوراً، فينبغي وضعه خلف استدعاء view. تتغير نقطة التعادل وفق عدد مرات إعادة التشغيل، وليس وفق أي رسوم تفرضها Anthropic.
في API، يمكنك أيضاً السماح للمنصة بتقليص المحادثة. يمسح تحرير السياق نتائج الأدوات القديمة عندما تتجاوز المحادثة حداً تحدده.
{
"edits": [
{
"type": "clear_tool_uses_20250919",
"trigger": {"type": "input_tokens", "value": 30000},
"keep": {"type": "tool_uses", "value": 3},
"clear_at_least": {"type": "input_tokens", "value": 5000}
}
]
}الإعدادات الافتراضية هي حد تشغيل يبلغ 100,000 رمز إدخال، مع الاحتفاظ باستخدامات 3 أدوات. اقرأ آلية التفاعل مع التخزين المؤقت قبل تفعيلها: يؤدي مسح المحتوى إلى إبطال البادئة المخزّنة مؤقتاً عند موضع المسح، لذلك تدفع تكلفة كتابة ذاكرة التخزين المؤقت في الطلب التالي. هذا هو الغرض من clear_at_least. فهو يؤجل المسح حتى يصبح التوفير كبيراً بما يكفي لتبرير عملية الكتابة. يعرض الرد ما حدث بالضبط ضمن context_management، مع cleared_tool_uses وcleared_input_tokens، لذلك تصبح المقايضة قابلة للقياس بدلاً من أن تكون نظرية. يطبّق إدارة نافذة السياق في Claude Code الفكرة نفسها على جلسة برمجية.
ما الذي يُحتسب له بند مستقل
لا تُفرض رسوماً مستقلة على الذاكرة، لكن بعض الميزات تُحتسب لها رسوم فعلية، ومن المفيد معرفة هذه الميزات. هذه هي أسعار Claude API المنشورة اعتباراً من August 2026. لا تكلّف بعض العمليات شيئاً على الإطلاق، لكن لا توجد فئة مجانية في Claude API، بل يوجد رصيد صغير عند التسجيل فقط. لذلك تمثل جميع التكاليف أدناه إنفاقاً فعلياً منذ أول طلب ترسله.
- البحث على الويب: $10 لكل 1,000 عملية بحث، إضافةً إلى تكلفة الرموز المعتادة لكل ما يضيفه البحث إلى السياق.
- تنفيذ التعليمات البرمجية: 1,550 ساعة مجانية لكل مؤسسة شهرياً، ثم $0.05 لكل ساعة ولكل حاوية. ويكون مجانياً عند استخدامه مع البحث على الويب أو جلب المحتوى من الويب.
- Claude Managed Agents: مدة تشغيل الجلسة بسعر $0.08 لكل ساعة جلسة، إضافةً إلى رسوم الرموز المعتادة.
- جلب المحتوى من الويب: لا توجد رسوم إضافية، وتُحتسب فقط تكلفة رموز المحتوى الذي جرى جلبه.
لا تظهر الذاكرة في أي من هذه البنود. بل تظهر ضمن عدد رموز الإدخال، وهو الموضع الذي يمكنك فيه قياسها بدقة، وكذلك الموضع الذي يمكن فيه لتقليص المحتوى والتخزين المؤقت خفض التكلفة. إذا كنت تضع ميزانية لوكيل يعمل دون مراقبة على خادم خاص افتراضي (VPS)، فإن ضوابط تكلفة وكيل الذكاء الاصطناعي على VPS هي الخطوة التالية التي ينبغي تنفيذها، لأن الوكيل الذي يتضخم ملف ذاكرته من دون تقليص سيصبح أكثر تكلفة كل أسبوع من دون أن يرصد أحد ذلك.
FAQ
هل توجد رسوم منفصلة لميزات ذاكرة Claude؟
لا. تتضمن قائمة أسعار Anthropic أسعاراً لكل مليون من رموز الإدخال، ولكل مليون من رموز الإخراج، ولمضاعفات التخزين المؤقت للمطالبات، ولا تتضمن بنداً خاصاً بالذاكرة. في Claude API، تعمل أداة الذاكرة من جهة العميل، لذلك تُخزَّن الملفات على مساحة تخزين تدفع مقابلها مسبقاً. ما تضيفه الذاكرة هو رموز الإدخال، وتُحتسب بالسعر المعتاد لإدخال النموذج في كل طلب يحملها.
هل يؤدي إيقاف الذاكرة إلى جعل Claude أقل تكلفة؟
يؤدي ذلك إلى خفض عدد الرموز في كل طلب، وبالتالي خفض تكلفة كل طلب. لكن مقدار التوفير الإجمالي يعتمد على ما يحدث لاحقاً. إذا اضطر Claude إلى إعادة قراءة ثلاثة ملفات وطرح سؤالين عليك لإعادة بناء ما كانت الذاكرة تحتفظ به، فقد تتجاوز تكلفة هذه الرموز تكلفة الذاكرة. قِس ذلك بدلاً من التخمين: شغّل /context في جلسة تكون فيها الذاكرة التلقائية مفعّلة، وفي جلسة بدأت باستخدام CLAUDE_CODE_DISABLE_AUTO_MEMORY=1، ثم قارن إجمالي الرموز المستهلكة لتنفيذ المهمة نفسها.
لماذا ارتفع استهلاكي رغم أنني لم أغيّر شيئاً؟
السبب الأكثر شيوعاً هو فقدان التخزين المؤقت بعد فترة توقف. تعيش إدخالات التخزين المؤقت 5 دقائق افتراضياً، أو ساعة واحدة عند استخدام الإعداد الممتد. لذلك يعيد أول طلب بعد التوقف معالجة البادئة كاملة بسعر الإدخال الأساسي، ثم يكتبها مرة أخرى. السبب الشائع الثاني هو تعديل البادئة: يؤدي تغيير تعريف أداة إلى إبطال التخزين المؤقت بالكامل، بينما يؤدي تغيير مطالبة النظام إلى إبطال تخزين النظام والرسائل مؤقتاً. في خطة الاشتراك، يوضّح تفصيل /usage هذا السلوك عندما يشكّل 10 بالمئة أو أكثر من الاستخدام الأخير.
هل ينبغي أن تكون الذاكرة في مطالبة النظام أم خلف استدعاء أداة؟
ضعها في مطالبة النظام عندما تستخدمها معظم الطلبات، لأنها تبقى حينها ضمن البادئة المخزنة مؤقتاً وتُحتسب بسعر قراءة التخزين المؤقت. وضعها خلف استدعاء view عندما تحتاج إليها بعض المهام فقط، لأن قراءة ملف مرة واحدة تجعل تكلفة رموزه تُحتسب مرة واحدة بدلاً من احتسابها في كل طلب. الرقم الحاسم هو عدد مرات إعادة التشغيل، ويمنحك الكائن usage هذا الرقم مباشرة.
هل تُحتسب ميزات الذاكرة ضمن حدود استخدام الاشتراك؟
نعم، بصورة غير مباشرة، لأن حدود الاشتراك تُستهلك وفق الرموز التي يحملها كل طلب. توضّح وثائق مساعدة Anthropic أن المحادثات الأطول التي تؤدي إلى تشغيل إدارة السياق التلقائية تستهلك جزءاً أكبر من حد الاستخدام. تجعل الذاكرة كل طلب أطول قليلاً، وتعيد الجلسة الطويلة هذه الزيادة في كل طلب. يوضّح كيف تعمل حدود استخدام Claude فعلياً ما الذي يُعاد ضبطه ومتى.