أي نموذج Claude تختار؟ دليل التكلفة والأسعار
قارن أسعار Claude Opus 4.8 وSonnet 5 وHaiku 4.5 في يوليو 2026، مع تكلفة 100,000 مهمة وتأثير إعدادات الإدخال والإخراج على فاتورتك.
أي نموذج Claude ينبغي أن أستخدم؟
الإجابة المختصرة عن النموذج الذي ينبغي أن تستخدمه من Claude هي: ابدأ بـClaude Opus 4.8، ولا تنتقل عنه إلا لسبب واضح يمكنك تحديده. إرشادات Anthropic هي نفسها: «إذا لم تكن متأكداً من النموذج الذي ينبغي استخدامه، فابدأ بـClaude Opus 4.8 للبرمجة الوكيلة المعقدة والعمل المؤسسي». انتقل إلى Claude Sonnet 5 عندما تكون المهمة محددة جيداً وتنفذها مرات كثيرة يومياً. ثم انتقل إلى Claude Haiku 4.5 للأعمال الميكانيكية ذات الحجم الكبير، عندما تعرف مسبقاً شكل الإجابة الصحيحة. يأتي Claude Fable 5 فوق هذه النماذج كلها، وهو مخصص للوكلاء الذين يعملون لفترات طويلة.
يرتبط الاختيار بتكلفة. هذه هي أسعار Claude API (واجهة برمجة التطبيقات) في 23 July 2026، لكل مليون token، وهي الوحدة التي تسميها الوثائق MTok.
- Claude Fable 5 (
claude-fable-5): $10 / MTok للإدخال، و$50 / MTok للإخراج. سياق بسعة 1M. - Claude Opus 4.8 (
claude-opus-4-8): $5 للإدخال، و$25 للإخراج. سياق بسعة 1M. - Claude Opus 4.7 (
claude-opus-4-7): $5 للإدخال، و$25 للإخراج. سياق بسعة 1M. - Claude Sonnet 5 (
claude-sonnet-5): $2 للإدخال، و$10 للإخراج وفق السعر التمهيدي حتى 31 August 2026. ويبدأ السعر القياسي البالغ $3 للإدخال و$15 للإخراج في 1 September 2026. سياق بسعة 1M. - Claude Haiku 4.5 (
claude-haiku-4-5): $1 للإدخال، و$5 للإخراج. سياق بسعة 200K.
هذه المعرّفات كاملة كما هي مكتوبة. لا تُضاف إليها أي لاحقة.
لا تفرض النماذج التي تدعم 1M token رسوماً إضافية بسبب الحجم نفسه: «تُحتسب تكلفة طلب من 900k token وفق سعر token نفسه المطبّق على طلب من 9k token». وتمتد هذه الأسعار أيضاً إلى ما هو أبعد من API، لأن Claude Enterprise يحسب الاستخدام وفق أسعار API إضافةً إلى سعر المقعد، ولذلك فإن كل ما يلي هو الحساب نفسه لفريق يستخدم خطة مقاعد. يغيّر الاشتراك بسعر ثابت طريقة احتساب الاستخدام، لكنه لا يغيّر هذا القرار، لأن طبقتي Claude Max توفران النماذج نفسها وتختلفان فقط في مقدار الاستخدام المتاح. وعلى مستوى أدنى من السلم نفسه، تمنحك خطة Claude Pro التي تكلف $20 شهرياً حصة استخدام بدلاً من سعر لكل token، ولذلك فإن ما يوقفك هناك هو إعادة ضبط الحد، لا فاتورة. إذا كنت تستخدم هذه الخطة الآن، فـتحديد نافذة الاستخدام التي تنتظر إعادة ضبطها يسبق أي حساب مما يلي، لأن الحل هو استخدام نموذج أصغر، أو سياق أصغر، أو الانتقال إلى API، وليس البحث عن سعر أقل. وإذا لم تبدأ بالدفع بعد، فإن تحديد ما إذا كانت خطة Pro تستحق $20 من الأساس يعتمد على مدى تكرار إيقاف الحد المجاني لك، لا على أي من الأسعار المذكورة أعلاه.
ما الغرض الفعلي من كل نموذج
تصف Anthropic المجموعة بجملة واحدة لكل نموذج، وتساعد هذه الجمل على الاختيار أكثر من أي جدول تصنيف.
- Claude Fable 5: «ذكاء الجيل التالي للوكلاء ذوي التشغيل الطويل». وهو الأبطأ بين النماذج الأربعة من حيث زمن الاستجابة.
- Claude Opus 4.8: «للبرمجة المعتمدة على الوكلاء والعمل المؤسسي المعقد». زمن استجابة متوسط.
- Claude Sonnet 5: «أفضل مزيج من السرعة والذكاء». سريع.
- Claude Haiku 4.5: «أسرع نموذج بذكاء قريب من مستوى النماذج الرائدة».
Fable 5 هو النموذج الوحيد من النماذج الأربعة الذي لا يضع هذا الاختبار سعراً له ضمن أي عبء عمل. وبما أن سعره يعادل ضعف سعر Opus 4.8، فإن السؤال عن المهام التي تبرر دفع $10 والحصول على $50 يستحق إجابة مستقلة.
يفرض Haiku 4.5 أيضاً حدوداً تحدد ملاءمته للمهمة قبل النظر في السعر. يبلغ حجم نافذة السياق لديه 200K من الرموز بدلاً من 1M، لذلك لن يتسع لمستودع كبير أو لسجل طويل لجلسة وكيل. كما يبلغ الحد الأقصى للإخراج في Messages API المتزامنة 64K من الرموز، مقابل 128K للنماذج الأخرى. أما تاريخ القطع الموثوق لمعرفته فهو February 2025، في حين يعود تاريخ النماذج الثلاثة الأخرى إلى January 2026.
ما تكلفة هذا الاختيار في عبء عمل حقيقي؟
يحتسب كل نموذج في المجموعة تكلفة المخرجات بمعدل يساوي 5 أضعاف معدل المدخلات. تبلغ تكلفة Opus 4.8 مبلغ $5 للمدخلات و$25 للمخرجات. وتبلغ تكلفة Haiku 4.5 مبلغ $1 للمدخلات و$5 للمخرجات. تنطبق هذه النسبة على كامل المجموعة، لذلك يؤثر النموذج الذي تختاره بدرجة أكبر في الأعمال التي تنتج مخرجات كثيرة.
يندرج العمل الوكيلي ضمن هذا النوع من الأعمال، لأن رموز التفكير تُحتسب بوصفها رموز مخرجات وتُضاف إلى max_tokens حتى عندما لا يصل النص إليك. في Fable 5 وOpus 4.8 وOpus 4.7 وSonnet 5، يُحذف ملخص الاستدلال افتراضياً، لذلك يعود الحقل thinking فارغاً. ولا تتغير الفوترة: «في كلتا الحالتين، تُحتسب تكلفة الكتلة بالطريقة نفسها وتُعاد بالطريقة نفسها في المحادثات متعددة الأدوار». يشرح ما الذي يملأ فاتورة رموز Claude فعلياً آلية احتساب هذا العداد بالتفصيل.
يختلف ما إذا كان التفكير يعمل أصلاً بين النماذج التي تقارنها. وقد يؤدي تجاهل ذلك إلى إفساد اختبار التكلفة. التفكير مفعّل مسبقاً في Sonnet 5 وFable 5 ولا يحتاج إلى إعداد. أما في Opus 4.8 وOpus 4.7، فهو معطّل إلى أن تضبط thinking: {type: "adaptive"} في الطلب. طابق الإعدادات في كلا الجانبين قبل استخلاص أي استنتاج من الأرقام.
لماذا قد يكون النموذج الأرخص هو الأكثر تكلفة
خذ مهمة برمجية واحدة مكتفية ذاتياً. يحتوي الطلب على 60,000 رمز من السياق، وينتج النموذج 8,000 رمز من المخرجات، بما في ذلك التفكير. لا يوجد تخزين مؤقت، لذلك تظل الحسابات واضحة.
في Opus 4.8: تبلغ تكلفة 0.06 MTok من الإدخال بسعر $5 مبلغ $0.30، وتبلغ تكلفة 0.008 MTok من المخرجات بسعر $25 مبلغ $0.20. تبلغ تكلفة المحاولة $0.50. في Haiku 4.5، تبلغ تكلفة المحاولة نفسها $0.06 بالإضافة إلى $0.04، أي $0.10.
يكون Haiku أرخص بخمس مرات لكل محاولة. يبدو ذلك هامشاً كبيراً، إلى أن تتابع ما يحدث عند فشل المحاولة. تقرأ الإجابة الخاطئة، وهذا يستهلك وقتك. تعيد إرسالها ضمن السياق في المحاولة التالية، لذلك تصبح كل محاولة أكبر من سابقتها. وعندما تفشل المحاولة الثالثة أيضاً، تصعّد المهمة رغم ذلك: تبلغ تكلفة Haiku البالغة $0.30 مع Opus البالغة $0.50 مبلغ $0.80، أي أكثر بنسبة 60% من تشغيل Opus مرة واحدة.
لذلك، فإن السؤال الحاسم هو مدى انخفاض تكلفة التحقق من الإجابة. عندما تكون الإجابة الخاطئة واضحة خلال ثانية واحدة، يكون النموذج الصغير صفقة جيدة. أما عندما يتطلب اكتشاف الخطأ قراءة diff بعناية، فإن النموذج الصغير يستهلك وقتاً لا يظهر في الفاتورة. إن تحديد قيمة لهذا الوقت هو الحساب نفسه المستخدم في حساب ما إذا كانت خطة Claude Code تحقق عائداً، وعندما تدخل أجرك بالساعة في الحساب، غالباً ما يتوقف النموذج الأرخص عن الظهور كخيار رخيص.
متى يتفوق نموذج أصغر بوضوح
يكون Haiku 4.5 الخيار الصحيح في الحالات التالية:
- المهام الميكانيكية للوكلاء الفرعيين. لا يحتاج الوكيل الفرعي الذي يعيد تسمية الملفات أو يجمع مخرجات البحث إلى استدلال متقدم. هذا هو النمط المعتاد بعد إنشاء وكيل ذكاء اصطناعي باستخدام Claude وتزويده بأدوات مساعدة.
- فرز السجلات. تحديد ما إذا كان السطر ضجيجاً أو يستحق انتباه الإنسان هو حكم محدود، وله نمط فشل واضح.
- التصنيف وفق مجموعة ثابتة من التسميات. يكون الناتج قصيراً، ويمكن قياس الدقة على عينة.
- الاستدعاءات الإنتاجية عالية الحجم. عند تنفيذ 100,000 مرة يومياً، يتوقف الفرق في التكلفة لكل رمز عن كونه هامشياً. وهذا هو الشكل المعتاد لـسير عمل الذكاء الاصطناعي المربوط بـn8n.
- أي حالة تكون فيها سرعة الاستجابة مهمة للمستخدم. يُصنَّف Haiku 4.5 على أنه أسرع نموذج في المجموعة.
هناك قيد يخص Haiku تحديداً. الحد الأدنى للمطالبة القابلة للتخزين المؤقت لديه هو 4,096 رمزاً، مقابل 1,024 في Opus 4.8 وSonnet 5. وأقل من هذا الحد الأدنى، «ستُعالج أي طلبات لتخزين عدد أقل من هذا العدد مؤقتاً دون استخدام التخزين المؤقت، ولن يُعاد أي خطأ». فكتلة تعليمات من 1,500 رمزاً تُخزَّن مؤقتاً في Sonnet 5 لا تُخزَّن مؤقتاً بصمت في Haiku 4.5. وتظهر العلامة عندما تكون cache_creation_input_tokens وcache_read_input_tokens كلتاهما صفراً. ويتناول خفض تكاليف الوكيل الذي يعمل باستمرار هذه الحالة إلى جانب الطرق الأخرى التي قد تؤدي إلى فقدان التخزين المؤقت.
العوامل التي تغيّر النتيجة
كل عامل من هذه العوامل يؤثر في التكلفة أكثر من اسم النموذج.
الجهد. يتحكم output_config.effort في مقدار العمل الذي ينفذه النموذج قبل أن يجيب. المستويات هي low وmedium وhigh وxhigh وmax، ويُعد high المستوى الافتراضي: «يؤدي ضبط effort على high إلى السلوك نفسه تماماً كما يحدث عند حذف المعلمة effort بالكامل». ويأتي هذا الإعداد داخل output_config، وليس في المستوى الأعلى من الطلب:
response = client.messages.create(
model="claude-sonnet-5",
max_tokens=4096,
output_config={"effort": "medium"},
messages=messages,
)يؤثر الجهد في كل token ضمن الاستجابة: «يمكن أن يؤثر في إجمالي استهلاك tokens، بما في ذلك استدعاءات الأدوات. فمثلاً، يعني خفض الجهد أن Claude سيجري استدعاءات أدوات أقل». ويتراكم هذا الأثر ضمن حلقة الوكيل. لا يمثل الجهد حداً أقصى لعدد tokens: «الجهد إشارة سلوكية، وليس ميزانية صارمة لـtokens». لا تنشر Anthropic معاملاً للتكلفة لكل مستوى، وتطلب منك اختبار حالة الاستخدام الخاصة بك. لذلك يمكنك إجراء مقارنة فعلية هذا بعد الظهر بين تشغيل Sonnet 5 عند high وتشغيل Opus 4.8 عند low. ولا يظهر Haiku 4.5 ضمن قائمة النماذج التي تدعم الجهد.
التخزين المؤقت للمطالبات. تكلف قراءة البيانات من التخزين المؤقت 0.1x من السعر الأساسي للإدخال. والعامل الذي يحدد اختيار النموذج هو أثر ذلك عبر المستويات. تكلف إصابة التخزين المؤقت في Opus 4.8 مبلغ $0.50 / MTok، بينما تكلف بيانات الإدخال غير المخزنة مؤقتاً في Haiku 4.5 مبلغ $1 / MTok. لذلك تكون بادئة Opus المخزنة مؤقتاً جيداً أرخص لكل input token من مطالبة Haiku غير المخزنة مؤقتاً. وتحقق نظافة الجلسة وفراً أكبر من تغيير النموذج في أي حمل عمل يعيد إرسال بادئة كبيرة ومستقرة.
المعالجة الدفعية. إذا لم يكن هناك ما ينتظر الإجابة، تشغّل Message Batches API النماذج نفسها «بخصم قدره 50% من tokens للإدخال والإخراج معاً». ويؤدي ذلك إلى خفض كل صف في المقارنة التالية إلى النصف. كما يعمل عبر المستويات: تكلف مهمة Opus 4.8 دفعية أقل من مهمة Sonnet 5 متزامنة بالسعر القياسي اعتباراً من 1 September 2026، مع استبدال جزء من زمن الاستجابة بقدرة أعلى مقابل المبلغ نفسه.
مقارنة عملية للتكلفة
المهمة: تصنيف 100,000 رسالة بريد إلكتروني للدعم، باستدعاء واحد لكل رسالة، و2,000 رمز إدخال و300 رمز إخراج لكل استدعاء. هذا يعادل 200 MTok من الإدخال و30 MTok من الإخراج.
- Haiku 4.5: 200 x $1 = $200 للإدخال، و30 x $5 = $150 للإخراج. الإجمالي $350.
- Sonnet 5، بالسعر التمهيدي: 200 x $2 = $400 للإدخال، و30 x $10 = $300 للإخراج. الإجمالي $700.
- Sonnet 5، ابتداءً من 1 September 2026: 200 x $3 = $600 للإدخال، و30 x $15 = $450 للإخراج. الإجمالي $1,050.
- Opus 4.8: 200 x $5 = $1,000 للإدخال، و30 x $25 = $750 للإخراج. الإجمالي $1,750.
استبدل أربعة أرقام لإعادة الحساب باستخدام أسعار الغد. التعديلات التالية تغيّر النتيجة بدرجة أكبر من اسم النموذج:
- المعالجة الدفعية تخفّض تكلفة كل سطر إلى النصف: $175 و$350 و$525 و$875. لا شيء ينتظر تنفيذ مهمة التصنيف الليلية، لذلك لا يوجد سبب لتجاوزها.
- تخزين البادئة المشتركة مؤقتاً. لنفترض أن 1,200 من رموز الإدخال البالغ عددها 2,000 هي كتلة التعليمات نفسها في كل مرة. في Sonnet 5 بالسعر التمهيدي، تكلف هذه الرموز $0.20 / MTok عند إصابتها في الذاكرة المؤقتة بدلاً من $2 / MTok، لذلك تبلغ تكلفة 120 MTok $24 بدلاً من $240. أضف 80 MTok من الإدخال الجديد بسعر $2، أي $160، إضافة إلى $300 للإخراج، فتبلغ تكلفة Sonnet 5 نحو $484 بدلاً من $700. لا تحقق الطريقة نفسها أي توفير في Haiku 4.5، لأن 1,200 رمز أقل من الحد الأدنى البالغ 4,096 رمزاً.
- إعادة المحاولة. لنفترض أنك ترفض إجابة Haiku في 8% من رسائل البريد الإلكتروني، ثم تعيد تشغيلها على Opus 4.8. أضف 0.08 x $1,750 = $140 إلى $350، ليصبح الإجمالي $490. قِس معدل الرفض لديك بدلاً من استخدام معدلي.
- تعريفات الأدوات، إذا كانت المهمة تستخدمها. تكون مطالبة النظام التي تنشئها بطول 290 رمزاً في Opus 4.8 عند ضبط
tool_choiceعلىauto، و354 رمزاً في Sonnet 5، و496 رمزاً في Haiku 4.5. يتحمل النموذج الأرخص أكبر تكلفة ثابتة.
تبلغ تكلفة Haiku مع مسار تصعيد قدره $490 وتكلفة Sonnet 5 مع التخزين المؤقت $484 القيمة نفسها تقريباً، ويُنجز أحدهما المهمة في تمريرة واحدة. لم يكن النموذج هو المسألة كاملةً قط.
هل يؤدّي تبديل النماذج أثناء الجلسة إلى خفض التكلفة؟
يحدث ذلك بمعدل أقل مما توحي به الأسعار المعلنة، لأن التوفير يُحتسب لكل token، بينما ما تعرّضه للخطر هو بادئة مخزّنة مؤقتاً بالكامل.
توضّح Anthropic ما الذي يُبطل صلاحية ذاكرة التخزين المؤقت. تُبنى البوادئ بالترتيب tools، ثم system، ثم messages، وتنص الوثائق على أن «التغييرات في كل مستوى تُبطل ذلك المستوى وجميع المستويات اللاحقة». كما توجد إعدادات طلبان ضمن هذه القائمة: «يُدرج إعداد التفكير ومستوى effort المحسوم في prompt نفسه، لذلك يؤدي تغيير أي منهما إلى بدء بادئة جديدة في ذاكرة التخزين المؤقت». وتضيف الوثائق بشأن effort توصية أوضح: «غيّر effort بين أحمال العمل، لا داخل محادثة تعتمد على إصابات ذاكرة التخزين المؤقت».
لا يظهر النموذج ضمن تلك القائمة الموثقة، لذلك لا تفترض أياً من الاحتمالين. اقرأ cache_read_input_tokens في أول طلب بعد التبديل، ودَع الرقم يجيب. في بادئة من 150,000 token لنموذج Opus 4.8، تكلّف قراءة ذاكرة التخزين المؤقت نحو $0.08، بينما تكلّف الكتابة الجديدة نحو $0.94. وهذا يتجاوز تكلفة عدة جولات من الفارق لكل token الذي كنت تسعى إلى توفيره.
لذلك غيّر هذه الأشياء بين المهام، لا داخل المهمة نفسها. في Claude Code، يعني ذلك استخدام /clear أولاً، عندما تكون ذاكرة التخزين المؤقت ستُهمل على أي حال، ثم استخدام /model أو /effort. تُكتب هاتان القيمتان في CLI، لذلك إذا كنت تعمل على Linux فالتثبيت المفيد هو إصدار الطرفية، لأن ما تطلقه Anthropic أصلاً لنظام Linux يجمع بين CLI مستقر وتطبيق سطح مكتب لا يزال في الإصدار التجريبي. ويعتمد ظهور التبديل في الفاتورة على طريقة دفعك مقابل تلك الجلسة، لأن Claude Code يعمل إما ضمن خطة شهرية ثابتة أو باستخدام أرصدة API محسوبة لكل token، والخيار الثاني فقط يفرض سعراً بالدولار عند تغيير النموذج. أما في الخطة الثابتة، فسعر استخدام نموذج أثقل يتمثل في نافذة الاستخدام لا في الفاتورة، وClaude Code مشمول بدءاً من Pro ويستخدم النافذة نفسها التي تستخدمها تطبيقات الدردشة، لذلك فإن ساعة من استخدام Opus في الطرفية هي ساعة لا تستخدمها في المتصفح.
كيفية اختبار الإجابة على عبء العمل الخاص بك
لا تقدّر حجم prompt باستخدام عدد مأخوذ من نموذج مختلف. نقطة نهاية حساب عدد الرموز متاحة مجاناً، وتستخدم tokenizer الخاص بالنموذج الذي تحدده، لذلك حدّد النموذج الذي تخطط لاستدعائه. نقطة النهاية هذه واحدة من الأجزاء القليلة في المنصة التي لا تُحتسب عليها أي رسوم، ويستحق ما يمكنك تشغيله أيضاً دون دفع التحقق منه قبل إنفاق رصيد فعلي على المقارنة. تستخدم Opus 4.7 والإصدارات الأحدث، وFable 5 وSonnet 5، tokenizer أحدث «ينتج رموزاً أكثر بنسبة 30% تقريباً للنص نفسه»، لذلك تكون الميزانية المقاسة على نموذج أقدم أقل من اللازم عند استخدامها مع نموذج أحدث وبالسعر نفسه لكل رمز.
ثم اقرأ النتيجة. input_tokens هو الباقي غير المخزّن مؤقتاً فقط، لذلك فإن الحجم الحقيقي لـprompt يساوي قيمة هذا الحقل مضافاً إليها cache_creation_input_tokens وcache_read_input_tokens. يُعد أول تطبيق Claude API على VPS أصغر مكان عملي وصادق لإجراء هذا القياس، بينما يتناول خطة Claude المناسبة لاستخدامك القرار المنفصل المتعلق بما إذا كنت ستدفع مقابل كل رمز أصلاً. إذا اتضح أن المسألة تتعلق بتحديد الاشتراك الذي ستحتفظ به بدلاً من تحديد ما إذا كنت ستحتفظ باشتراك، فإن فئات Claude المسعّرة إلى جانب فئات ChatGPT توضّح تكلفة عمل البرمجة نفسه على مقاعد الموفر الآخر. وإذا أدى القياس إلى نقل عملك إلى API بشكل دائم، فإن خفض الاشتراك إلى فئة أدنى أو إلغاؤه بالكامل يترك لك الفترة التي دفعت قيمتها بالفعل، لذلك لا توجد غرامة على اتخاذ القرار بعد ظهور الأرقام. أجرِ القياس نفسه لفريق بدلاً من شخص واحد، وسيتغير الإجمالي مرة أخرى، لأن مقعد Team أو Enterprise يجب أن تكون تكلفته أفضل مما كان ذلك الشخص سينفقه لكل رمز حتى يصبح شراؤه مجدياً.
FAQ
ما أفضل نموذج Claude للبرمجة؟
يُعد Claude Opus 4.8 نقطة البداية الموثقة للبرمجة المعقدة القائمة على الوكلاء، بسعر $5 لكل مليون رمز إدخال و$25 لكل مليون رمز إخراج، اعتباراً من July 2026. ويُقدَّم Claude Sonnet 5 على أنه أفضل مزيج من السرعة والذكاء. وبسعر $2 / $10 حتى 31 August 2026، تكون تكلفته أقل من نصف تكلفة Opus 4.8. شغّل المهمة نفسها على النموذجين، وثبّت إعداد التفكير، ثم قارن إجمالي الإنفاق على الرموز من response.usage.
هل Claude Haiku 4.5 رخيص بما يكفي ليحل محل Sonnet 5؟
نعم، بسهولة من حيث سعر الرمز: $1 / $5 مقابل $2 / $10 لـSonnet 5 في التسعير التمهيدي، أو $3 / $15 بدءاً من 1 September 2026. لكن الحدود هي العامل الحاسم. يحتوي Haiku 4.5 على نافذة سياق بسعة 200K رمز بدلاً من 1M، وحد أقصى للإخراج يبلغ 64K في Messages API المتزامن، وقطع معرفة موثوقاً يعود إلى February 2025، ولا يدعم output_config.effort، كما يتطلب prompt قابلاً للتخزين المؤقت بحد أدنى يبلغ 4,096 رمزاً، ما يؤدي بصمت إلى تعطيل التخزين المؤقت في مطالبات النظام القصيرة.
هل يؤدي التبديل إلى نموذج Claude أرخص في منتصف الجلسة إلى توفير المال؟
ليس بالقدر الذي يبدو عليه الأمر. توثّق Anthropic أن مبطلات التخزين المؤقت تشمل تغييرات في البادئة tools أو system أو messages، وتغييرات في إعداد التفكير، وتغييرات في output_config.effort. ولا توثّق الشركة تأثير تبديل النموذج في ذاكرة التخزين المؤقت الحالية، لذلك اعتبر النتيجة غير معروفة واقرأ cache_read_input_tokens في أول طلب بعد التبديل. من المهم معرفة التكلفة: في بادئة من Opus 4.8 بسعة 150,000 رمز، تكلف قراءة ذاكرة التخزين المؤقت نحو $0.08، بينما تكلف الكتابة الجديدة نحو $0.94. وهذا يفوق الوفر الناتج عن عدة أدوار من انخفاض سعر الرمز. بدّل بين المهام، أو بعد /clear في Claude Code، عندما تكون ذاكرة التخزين المؤقت ستُتخلَّص منها على أي حال.
ما تأثير output_config.effort في فاتورتي؟
يغيّر عدد الرموز التي ينفقها النموذج على النص واستدعاءات الأدوات والتفكير. يؤدي مستوى الجهد الأقل إلى عدد أقل من استدعاءات الأدوات. ويتراكم هذا الأثر في حلقات الوكلاء، لأن نتيجة كل أداة تُعاد في الأدوار اللاحقة. المستويات هي low وmedium وhigh وxhigh وmax، مع كون high هو الإعداد الافتراضي. لا تنشر Anthropic مضاعف تكلفة لكل مستوى. وتصف الجهد بأنه إشارة سلوكية لا ميزانية للرموز، لذلك قِس تأثيره على مهمتك الخاصة.
كم يوفّر Claude Batches API؟
يوفّر 50% من رموز الإدخال والإخراج، مقابل التسليم غير المتزامن. اعتباراً من July 2026، يصبح سعر Opus 4.8 هو $2.50 للإدخال / $12.50 للإخراج، وسعر Sonnet 5 هو $1 / $5 في التسعير التمهيدي، وسعر Haiku 4.5 هو $0.50 / $2.50. المقارنة المهمة هنا بين المستويات: تكلف مهمة Opus 4.8 المجمّعة أقل من مهمة Sonnet 5 المتزامنة بالسعر القياسي بدءاً من 1 September 2026. لذلك يتيح التجميع استخدام نموذج أقوى بالتكلفة نفسها.