SSD Nodes Learn Hosting plans →
الأدلة Matt Connorبقلم Matt Connor · آخر تحديث في 2026-08-23

ما هي رموز Claude؟ تكلفة جلسة Claude Code

الرمز في Claude يساوي نحو 3.5 أحرف. تعرّف لماذا تُحتسب 80,000 رمز في دور واحد من Claude Code، ولماذا تجعل 5 دقائق خمول الدور التالي أغلى 5 مرات.

ما المقصود بالرموز في Claude؟

الرمز هو وحدة النص التي يقرأها Claude ويكتبها: جزء من كلمة، ويعادل تقريباً 3.5 أحرف إنجليزية. يأتي هذا التقدير من مسرد Anthropic نفسه. وعند احتساب المسافات وعلامات الترقيم، يتجاوز العدد رمزاً واحداً لكل كلمة بفارق واضح. لذلك يتجاوز نص من ألف كلمة 1,300 رمز بسهولة. يستهلك الكود عدداً أكبر لكل سطر. فالأقواس وعوامل التشغيل والشرطات السفلية والمسافات البادئة تُقسِّم النص إلى رموز أكثر لكل حرف مقارنةً بالإنجليزية. وعادةً ما يستهلك ملف مصدر من بضع مئات من الأسطر عدة آلاف من الرموز. أما ملف من 2,000 سطر يقرر الوكيل قراءته، فيستهلك عدداً من الرموز من خمس خانات قبل كتابة أي سطر جديد من الكود.

هناك أمران في أدوات تقسيم النص إلى رموز يسببان الالتباس. أولاً، تختلف هذه الأدوات حسب النموذج. اعتباراً من July 2026، تستخدم Opus 4.7 والإصدارات الأحدث، وSonnet 5، وFable 5 أداة تقسيم أحدث تنتج رموزاً أكثر بنحو 30% للنص نفسه مقارنةً بنماذج Claude الأقدم. تختلف الزيادة الدقيقة حسب المحتوى. ويؤثر ذلك في أي تقدير تضعه بالرموز، رغم أن أسعار الرمز الواحد لم ترتفع نتيجة لذلك. ثانياً، إنّ tiktoken، وهي المكتبة التي يلجأ إليها كل منشور في المدونات، هي أداة تقسيم النص الخاصة بـOpenAI، وتُقلّل العدد الفعلي لدى Claude بنحو 15–20% في النصوص العادية، وبنسبة أكبر في الكود. العدد الوحيد الموثوق هو العدد الذي يعيده endpoint count_tokens، كما هو موضح أدناه.

ما الذي يحدد تكلفة جلسة البرمجة لديك؟

تُختزل كل فاتورة من Claude، سواء كانت فاتورة API أو حداً للاشتراك، في مقياس واحد: الرموز المميزة الداخلة والرموز المميزة الخارجة. تعرض صفحة الأسعار الأمر كما لو كان بسيطاً: عدد محدد من الدولارات لكل مليون رمز مميز من رموز الإدخال، وعدد آخر لكل مليون رمز مميز من رموز الإخراج. لكن الصفحة لا توضّح أن جانب الإدخال في جلسة برمجة تعتمد على الوكلاء يعمل بمعدل أعلى بكثير مما تتوقع، لأن المحادثة كاملة تُرسَل من جديد في كل دور. لقد بعت بنية تحتية تُحاسَب وفق الاستخدام لمدة خمسة عشر عاماً، والرموز المميزة هي أول مقياس أراه لا يستطيع معظم العملاء فعلاً تحديد ما الذي يحرّكه. يوضح هذا الدليل كيفية قراءة المقياس: ما الذي يُحتسب إدخالاً وإخراجاً في جلسة تعتمد على الوكلاء، ولماذا تكون حلقة إعادة الإرسال مكلفة إلى هذا الحد، وكيف تغيّر آلية تخزين المطالبات مؤقتاً الحسابات، وأي العوامل تؤثر فعلياً في الرقم.

ما يُحتسب كله هو المدخلات: ما الذي يقيسه العداد فعلياً

يفترض الناس أنهم يدفعون مقابل الشيفرة التي يكتبها Claude. لكن هذا هو البند الأصغر في الجلسة الوكيلة. تشمل رموز الإدخال، ذات التكلفة الأقل لكن الحجم الأكبر بكثير، ما يلي:

  • موجّه النظام. تعليمات Claude Code الخاصة بالتشغيل، إضافة إلى ملفات CLAUDE.md والذاكرة لديك، التي تُحمّل عند بدء الجلسة وتبقى موجودة في كل طلب لاحق.
  • تعريفات الأدوات. مخطط كل أداة يمكن للوكيل استدعاؤها. يضيف كل خادم MCP تتصل به إلى هذه التكلفة الثابتة، مع أن Claude Code يؤجل الآن تعريفات أدوات MCP الكاملة افتراضياً؛ لذلك لا تبقى في السياق إلا أسماء الأدوات إلى أن تُستخدم إحدى الأدوات للمرة الأولى. يخفف ذلك التكلفة، لكنه لا يلغيها.
  • كل ملف يقرأه الوكيل. يؤدي Read لملف مصدر إلى وضع الملف كاملاً في السياق، ويبقى فيه.
  • كل نتيجة أداة. عمليات الاختبار، ومخرجات grep، ومخرجات الطرفية الكثيرة، وسجلات البناء، كلها تعود بوصفها رموز إدخال. إذا طبعت مجموعة اختبارات فاشلة 8,000 سطر، فقد احتُسبت عليك تكلفة كتاب صغير.
  • المحادثة كاملة حتى تلك اللحظة، وتُرسل مجدداً في كل دور. تستحق هذه النقطة قسماً مستقلاً.

إعادة الإرسال التي لا يضعها أحد في الحسبان

واجهة Claude API عديمة الحالة. لا تتذكر جلستك بين الطلبات، ولا يتذكرها أي مكوّن آخر. لذلك، في الدور 2، يرسل العميل الدور 1 مع استجابة النموذج ورسالتك الجديدة. وفي الدور 50، يعيد إرسال الأدوار من 1 إلى 49، وكل ملف تمت قراءته، وكل نتيجة أداة، وكل فرق، بالإضافة إلى الدور 50. يعيد النموذج قراءة النص الكامل للمحادثة في كل مرة، وتُحتسب كل واحدة من رموز الإدخال التي يعيد قراءتها ضمن التكلفة.

النتيجة هي أن تكلفة الدور الواحد تزداد تقريباً خطياً مع طول الجلسة، بينما تزداد التكلفة الإجمالية للجلسة تقريباً تربيعياً. قد تكلف رسالة نصف سنت في الدور 3 عشرين ضعف ذلك في الدور 60، رغم أن السؤال نفسه يتكون من سطر واحد، لأنها تحمل معها محتوى ستين دوراً. هذه هي الحقيقة الأساسية التي تفسّر معظم تذاكر «لماذا كانت فاتورتي مرتفعة إلى هذا الحد؟». وليست هذه سمة خاصة بـClaude؛ فأي منتج LLM يبدو ذا حالة هو في الواقع واجهة API عديمة الحالة تعمل في خلفيتها حلقة لإعادة الإرسال.

المخرجات: ما تراه، إضافة إلى التفكير الذي لا تراه

تُعدّ رموز المخرجات أغلى من رموز الإدخال بخمسة أضعاف ضمن المجموعة الحالية (بسعر $5/$25 في Opus 4.8، وسعر القائمة $3/$15 في Sonnet 5، و$1/$5 في Haiku 4.5، اعتباراً من July 2026). وتشمل المخرجات النص والتعليمات البرمجية التي ينشئها Claude، إضافة إلى رموز التفكير: الاستدلال الداخلي الذي ينفذه النموذج قبل الإجابة. هناك حقيقتان مهمتان. يُحتسب التفكير وفق أسعار المخرجات ويُخصم من max_tokens. وقد تعني استجابة API التي تتوقف مع stop_reason: "max_tokens" وإجابة مبتورة غالباً أن التفكير استهلك الميزانية قبل اكتمال الإجابة. وفي النماذج الحالية، قد لا يُعرض ملخص الاستدلال إطلاقاً؛ إذ لا تعرضه Opus 4.8 وSonnet 5 وFable 5 افتراضياً، مع أن التفكير حدث فعلاً وما زال يُحتسب. عدم ظهوره لا يعني أنه مجاني.

يُفعّل Claude Code التفكير الموسّع افتراضياً لأنه يحسّن العمل متعدد الخطوات بشكل قابل للقياس، وقد تصل الميزانية الافتراضية إلى عشرات الآلاف من الرموز لكل طلب. في المهام الأبسط، يمكنك خفضه: خفّض مستوى الجهد باستخدام /effort أو في /model، أو اضبط إعدادات التفكير في /config. هذا تحكم حقيقي في التكلفة، وليس اعتقاداً بلا أساس.

التخزين المؤقت للمطالبات يعيد صياغة الحسابات

التخزين المؤقت للمطالبة هو السبب في أن حلقة إعادة الإرسال لا تؤدي إلى إفلاس الجميع. يمكن لواجهة API تخزين بادئة ثابتة من المطالبة، ومطالبة النظام، وتعريفات الأدوات، وسجل المحادثة مؤقتاً، ثم تقديمها في الطلب التالي بجزء من السعر. اعتباراً من July 2026، تكون المعاملات كما يلي: تكلفة كتابة ذاكرة التخزين المؤقت تعادل 1.25× من سعر الإدخال الأساسي (2× في الإصدار ذي مدة الساعة الواحدة)، بينما تكلفة قراءة ذاكرة التخزين المؤقت تعادل 0.1×. الكتابات أعلى تكلفة؛ أما القراءات فتحصل على خصم قدره 90%. تكفي قراءة واحدة لتعويض علاوة الكتابة ذات مدة 5 دقائق وأكثر.

يدير Claude Code التخزين المؤقت نيابةً عنك، وفي الجلسة السليمة تُقدَّم جميع عمليات إعادة الإرسال الضخمة تقريباً من ذاكرة التخزين المؤقت. لكن مدة بقاء ذاكرة التخزين المؤقت الافتراضية هي خمس دقائق منذ آخر استخدام. إذا ابتعدت لتناول قهوة واستغرق ذلك وقتاً أطول، ثم عدت وأرسلت رسالة، فستكون ذاكرة التخزين المؤقت قد انتهت صلاحيتها، وستُعاد كتابة البادئة المتراكمة بالكامل بتكلفة 1.25× بدلاً من قراءتها بتكلفة 0.1×. في جلسة تضم 150K رمزاً، تكلف هذه الجولة الباردة الواحدة أكثر من اثنتي عشرة جولة دافئة. هذه هي النتيجة غير البديهية التي يجب استيعابها: قد يكلف نمط التوقف ثم الاستئناف أكثر من العمل المتواصل، لأن كل فترة خمول تتجاوز TTL تحوّل جولتك التالية من قراءة منخفضة التكلفة إلى إعادة كتابة مرتفعة التكلفة. اعمل على دفعات؛ لا تغذِّ جلسة ضخمة برسالة واحدة كل عشر دقائق.

إذا كنت تستدعي API من تطبيقك الخاص على VPS، فلن تحصل على أي من ذلك مجاناً. ومن أكثر الأخطاء الشائعة التي تتسبب بها بنفسك إدراج طابع زمني أو معرّف طلب داخل مطالبة النظام، ما يغيّر بايتات البادئة في كل طلب ويعطّل التخزين المؤقت بصمت. المؤشر هو بقاء usage.cache_read_input_tokens عند الصفر في الاستدعاءات المتطابقة ظاهرياً.

الصيغة مع مثال عملي

تجاهل من يذكر تكلفة ثابتة من نوع «الجلسة تكلف $X». تختلف الجلسات بمقدار يصل إلى رتبتين عشريتين. الصيغة التي يمكن الاعتماد عليها هي:

turn cost = (uncached input      x base input price)
          + (cache writes        x 1.25 x base input price)
          + (cache reads         x 0.10 x base input price)
          + (output incl. thinking x output price)

session cost = sum over all turns

مثال عملي على Claude Opus 4.8، الذي يبلغ سعره اعتباراً من July 2026 مقدار $5 لكل مليون token من الإدخال و$25 لكل مليون token من الإخراج. في دورة متوسطة من الجلسة تحمل 80,000 token من السياق المتراكم: تتم قراءة 75,000 من الذاكرة المؤقتة، وتُكتب 3,000 حديثة، ويكون 2,000 من الإدخال الجديد غير المخزّن مؤقتاً، ويبلغ الإخراج 1,500 token بما في ذلك التفكير.

  • قراءات الذاكرة المؤقتة: 75,000 × $0.50/M = $0.0375
  • عمليات كتابة الذاكرة المؤقتة: 3,000 × $6.25/M = $0.019
  • الإدخال غير المخزّن مؤقتاً: 2,000 × $5/M = $0.010
  • الإخراج: 1,500 × $25/M = $0.0375

تبلغ التكلفة نحو $0.10 للدورة؛ وتكلف خمسون دورة مماثلة نحو $5. أما الدورة نفسها بعد انتهاء صلاحية الذاكرة المؤقتة، فتتطلب إعادة كتابة 80,000 token كاملة بسعر $6.25/M، أي $0.50 قبل احتساب الإخراج، وتكلف نحو خمسة أضعاف تكلفة الدورة كاملة مع ذاكرة مؤقتة فعّالة، رغم تنفيذ العمل نفسه. يختصر هذا الفارق قصة التخزين المؤقت بأكملها في رقم واحد. وهذه الأسطر الأربعة نفسها هي الطريقة الوحيدة الصادقة لمقارنة المورّدين، لأن الأسعار المعلنة تتجاهل قراءات الذاكرة المؤقتة والتفكير بالكامل، كما أن تشغيلها على ثلاث مهام حقيقية يوضح موضع ارتفاع فاتورة Claude أو انخفاضها عن فاتورة OpenAI.

إذا كنت تريد تكوين فكرة عن وحدة الفوترة نفسها بدلاً من دورة واحدة، فتعرض حسابات مليون token من حيث الصفحات والملفات والدولارات العمليات الحسابية نفسها على مستوى أعلى. وللمعايرة لا للتنبؤ: تشير الأرقام المنشورة من Anthropic بشأن عمليات نشر Claude Code للمؤسسات، اعتباراً من July 2026، إلى متوسط يبلغ نحو $13 لكل مطوّر في اليوم النشط، و$150–250 شهرياً، مع بقاء 90% من المستخدمين تحت $30 يومياً. تختلف التكلفة الفعلية بحسب اختيار النموذج، وانضباط إدارة الجلسات، وحجم قاعدة الشيفرة، ولهذا تحديداً تهمّ عوامل التحكم الواردة أدناه.

معرفة استخدامك

في Claude Code، الأمر هو /usage (ولا يزال /cost يعمل لأنه اسم مستعار). تعرض كتلة Session في الأعلى إحصاءات الرموز وتقديراً محلياً للتكلفة المحسوبة للجلسة الحالية. وفي خطط الاشتراك، تعرض الشاشة نفسها أشرطة حدود خطتك وتفصيلاً ينسب الاستخدام الأخير إلى المهارات والوكلاء الفرعيين والإضافات وخوادم MCP الفردية. للحصول على بيانات الفوترة المعتمدة لحسابات API، تُعد صفحة الاستخدام في Claude Console مصدر الحقيقة، أما الرقم الذي تعرضه CLI فهو تقديري. يعرض الأمر /context شبكة ملوّنة توضّح ما يشغل نافذة السياق، مثل موجه النظام والأدوات وتعريفات MCP والملفات والسجل. وهذه أسرع طريقة لاكتشاف CLAUDE.md متضخم أو خادم MCP كثير الرسائل. مرّر all لتوسيع التفصيل الكامل لكل عنصر.

من خلال API، يوضح لك كل رد ما حدث بالضبط:

response = client.messages.create(model="claude-sonnet-5", max_tokens=2048,
                                  messages=messages)
u = response.usage
total_prompt = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokens
print(f"uncached={u.input_tokens} written={u.cache_creation_input_tokens} "
      f"read={u.cache_read_input_tokens} output={u.output_tokens}")

لاحظ أن input_tokens يمثل فقط الباقي غير المخزّن مؤقتاً. أما الحجم الفعلي للموجه فهو مجموع حقول الإدخال الثلاثة. إذا استمر وكيل في العمل لمدة ساعة وظهر له input_tokens: 4000، فهذا لا يعني أن تكلفته منخفضة؛ فقد جرى تقديم الرموز الـ200,000 الأخرى من ذاكرة التخزين المؤقت. لتقدير التكلفة قبل الإرسال، استخدم نقطة نهاية عدّ الرموز. استدعاؤها مجاني، ولها حد معدل مستقل، وتستخدم أداة تقسيم الرموز الخاصة بالنموذج الذي تحدده. تعامل مع النتيجة على أنها تقدير قريب، لأن الفوترة تعتمد على الطلب الفعلي:

count = client.messages.count_tokens(model="claude-sonnet-5",
                                     messages=[{"role": "user", "content": big_file}])
print(count.input_tokens)

لا تستخدم tiktoken مطلقاً، للسبب الموضح أعلاه.

خطط الاشتراك مقابل الدفع حسب الاستخدام

آلية العمل في هذا الدليل متطابقة في كل الحالات؛ والاختلاف الوحيد هو طريقة الفوترة. عند استخدام مفتاح API، تحاسبك Anthropic وفق نظام الدفع حسب الاستخدام، لكل token وبالأسعار المنشورة، ولذلك فإن كل رقم ورد أعلاه يمثل تكلفة مالية فعلية. يبدأ احتساب التكلفة في وقت أبكر مما يتوقعه معظم المستخدمين، لأنه لا توجد طبقة مجانية يمكن الاعتماد عليها، بل رصيد صغير عند التسجيل وعدد محدود من نقاط النهاية التي لا تُحتسب تكلفتها. وهذا هو ما يحصل عليه حساب API الجديد فعلياً قبل إضافة بطاقة دفع.

في اشتراك Claude (Pro وMax وTeam وEnterprise)، يُحتسب استخدام Claude Code من الحصة المضمنة في خطتك بدلاً من ذلك. واعتباراً من July 2026، تشمل هذه الحصة نافذة جلسة متحركة مدتها خمس ساعات، إضافة إلى نافذة أسبوعية، وتكون مشتركة بين النماذج وبين محادثات claude.ai. أما الرقم بالدولار /usage فهو إرشادي وليس فاتورة. عند استنفاد إحدى النوافذ، ستظهر لك الرسالة "لقد بلغت الحد الأقصى لجلسة الاستخدام" أو "لقد بلغت الحد الأقصى للاستخدام الأسبوعي" مع وقت إعادة الضبط. ولن تؤدي محاولة تبديل النموذج باستخدام /model إلى استعادة الوصول، لأن النوافذ مشتركة بين النماذج. ترتبط هذه النوافذ بالحساب، لا بالعميل الذي تستخدمه حالياً. ومن المفيد معرفة ذلك إذا كنت لا تزال تحدد ما الذي يعمل أصلاً على Linux وأي خطة تغطي كل واجهة. تحدد النافذة التي استنفدتها فعلياً مدة الانتظار وما يستحق فعله أثناء ذلك، لذلك من المفيد معرفة خياراتك عند بلوغ حد الاستخدام أثناء تنفيذ مهمة. ويمكن للخطط اختيارياً تفعيل أرصدة الاستخدام، التي تُدار باستخدام /usage-credits، لشراء استخدام يتجاوز الحد الأقصى. لن أدرج حصص الخطط عمداً، لأنها أكثر الأرقام تقلباً في هذا الموضوع بأكمله؛ راجع بدلاً من ذلك claude.com/pricing وأشرطة /usage الخاصة بحسابك. تظل آلية احتساب الـtoken مهمة حتى مع الاشتراك، فالجلسة غير الفعالة تستهلك نافذتك بالطريقة نفسها التي كانت ستستهلك بها دولارات. وبالنسبة إلى جانب الاشتراكات، راجع خطة Claude المناسبة لاستخدامك.

الضوابط التي تحقق أثراً فعلياً

  • حدّد نطاق ما يقرأه الوكيل. يقرأ الطلب «أصلح خطأ التحقق في auth.py» ملفاً واحداً، بينما يقرأ الطلب «حسّن قاعدة التعليمات البرمجية هذه» أربعين ملفاً. اجعل CLAUDE.md موجزاً، لأنه يُحمّل في كل جلسة. اقتصر فيه على الأساسيات، وانقل التعليمات الخاصة بسير العمل إلى skills تُحمّل عند الطلب.
  • كن واضحاً وموجزاً. عند /clear بين المهام غير المرتبطة، يُعاد إرسال السياق القديم وتُحتسب تكلفته في كل رسالة لاحقة. وفي المهمة الطويلة الواحدة، يلخّص /compact Focus on the failing tests and the diff السجل تدريجياً ويحافظ على بقائك بعيداً عن المنحنى التربيعي.
  • اختر حجم النموذج المناسب. يتولى Sonnet معظم مهام البرمجة بسعر $2/$10 لكل مليون token وفق التسعير التمهيدي في July 2026، وبالسعر الأساسي $3/$15، مقارنةً بـOpus بسعر $5/$25. أما Haiku، بسعر $1/$5، فهو مناسب للمهام الميكانيكية التي ينفذها الوكيل الفرعي، مثل فرز السجلات. ويقع Fable 5 في الطرف الآخر بسعر $10/$50، أي ضعف سعر Opus على جانبي مقياس التسعير. لذلك من المفيد معرفة المهام التي تبرر هذا السعر فعلاً قبل تركه محدداً للمهام الروتينية. يبدّل /model النموذج أثناء الجلسة.
  • رشّح المخرجات المطوّلة مسبقاً. يحوّل hook يختزل تشغيل الاختبارات إلى حالات الفشل قبل أن يراها Claude نتيجة أداة بحجم 20,000 token إلى 300 token. ويحدث ذلك في كل إعادة إرسال لاحقة لذلك الدور.
  • جمّع ما لا يحتاج إلى تفاعل مباشر. في مسارات API الخاصة بك، مثل التصنيف والمراجعة المجمّعة والمهام الليلية، تشغّل Batches API النماذج نفسها بخصم 50% مقابل تسليم غير متزامن.
  • راعِ مدة صلاحية cache. اعمل في فترات متواصلة. لا تكلّف جلسة Claude Code منفصلة داخل tmux على VPS شيئاً أثناء خمولها؛ لا تُستهلك token إلا عند تشغيل دور. لكن cache الدافئة هي ما تفقده أثناء الخمول، ولذلك يدفع الدور التالي تكلفة إعادة الكتابة.

FAQ

كم عدد الرموز التي تستخدمها جلسة برمجة في Claude Code؟

لا يوجد عدد ثابت. غالباً ما تتضمن الجولة الواحدة في منتصف الجلسة عشرات الآلاف من رموز الإدخال بعد تراكم الملفات والسجل، وقد تصل الجلسة العملية إلى ملايين الرموز، مع تقديم معظمها من ذاكرة التخزين المؤقت بسعر يعادل عُشر السعر الأساسي. وللمعايرة، يبلغ متوسط أرقام الاستخدام المؤسسي التي نشرتها Anthropic حتى July 2026 نحو $13 لكل مطوّر في اليوم النشط، ويستخدم 90% من المستخدمين أقل من $30. شغّل /usage في جلستك؛ فمراقبته لمدة خمس دقائق أدق من أي متوسط منشور.

هل تكلّف رموز التفكير مالاً حتى عندما لا أستطيع رؤيتها؟

نعم. تُحاسَب رموز التفكير بوصفها رموز إخراج، وبالسعر الأعلى، وتُحتسب ضمن max_tokens. وتفرض النماذج الحالية رسوماً عليها حتى عندما تخفي الواجهة ملخص الاستدلال من العرض. إذا توقّف الرد عند stop_reason: "max_tokens" قبل اكتمال الإجابة الظاهرة، فمن المرجّح أن التفكير استهلك الميزانية. في Claude Code، خفّض مستوى الجهد باستخدام /effort للمهام التي لا تحتاج إلى استدلال عميق.

لماذا تصبح جلسة Claude Code الطويلة أغلى لكل رسالة؟

لأن API عديمة الحالة: فهي تعيد إرسال المحادثة كاملة في كل جولة، بما في ذلك كل ملف تمت قراءته، وكل نتيجة أداة، وكل تبادل سابق، بوصفها إدخالاً خاضعاً للفوترة. لذلك تحمل الجولة 50 الجولات من 1 إلى 49. تقدم ذاكرة التخزين المؤقت للمطالبات البادئة المتكررة بسعر يعادل نحو عُشر سعر الإدخال الأساسي، لكن البادئة نفسها تستمر في النمو. كما أن أي فترة خمول تتجاوز مدة صلاحية ذاكرة التخزين المؤقت تحول الجولة التالية إلى إعادة كتابة كاملة بالسعر الكامل. يقلّص /compact السجل؛ ويعيد /clear ضبطه.

كيف أتحقق من استخدام Claude للرموز والتكلفة؟

في Claude Code، يعرض /usage إحصاءات رموز الجلسة، وتقديراً محلياً للتكلفة، وأشرطة حدود الخطة في الاشتراكات، و/cost اسم مستعار له. ويعرض /context العناصر التي تملأ نافذة السياق. للحصول على بيانات فوترة API المعتمدة، استخدم صفحة الاستخدام في Claude Console. وفي التعليمات البرمجية الخاصة بك، اقرأ response.usage. ويعطي جمع input_tokens وcache_creation_input_tokens وcache_read_input_tokens الحجم الفعلي للمطالبة، وقدّر الاستخدام مسبقاً باستخدام نقطة النهاية count_tokens، وليس باستخدام tiktoken مطلقاً.