أي نموذج Claude أستخدم؟ دليل الأسعار والتكاليف
مقارنة أسعار Opus 4.8 وSonnet 5 وHaiku 4.5 لواجهة API في يوليو 2026. مثال عملي لحساب تكلفة 100,000 مهمة والإعدادات الأكثر تأثيراً على الفاتورة.
أي نموذج من Claude يجب أن تستخدمه؟
الإجابة المختصرة عن أي نموذج من Claude يجب أن تستخدمه: ابدأ بـ Claude Opus 4.8، ولا تبتعد عنه إلا لسبب يمكنك تسميته. توجيهات Anthropic هي نفسها. "إذا كنت غير متأكد من النموذج الذي ستستخدمه، فابدأ بـ Claude Opus 4.8 لأعمال البرمجة الوكيلة المعقدة وأعمال المؤسسات." انتقل إلى Claude Sonnet 5 عندما تكون المهمة محددة جيداً وتقوم بتشغيلها عدة مرات في اليوم. انتقل مرة أخرى إلى Claude Haiku 4.5 للأعمال الميكانيكية ذات الحجم الكبير حيث تعرف مسبقاً كيف تبدو الإجابة الصحيحة. يقع Claude Fable 5 فوقها جميعاً، للوكلاء طويلي الأمد.
لهذا الاختيار ثمن مرتبط به. هذه هي الأسعار على واجهة برمجة تطبيقات Claude كما في 23 يوليو 2026، لكل مليون رمز، والتي تكتبها المستندات كـ MTok.
- Claude Fable 5 (
claude-fable-5): 10 دولارات / MTok للإدخال، 50 دولاراً / MTok للإخراج. سياق 1M. - Claude Opus 4.8 (
claude-opus-4-8): 5 دولارات للإدخال، 25 دولاراً للإخراج. سياق 1M. - Claude Opus 4.7 (
claude-opus-4-7): 5 دولارات للإدخال، 25 دولاراً للإخراج. سياق 1M. - Claude Sonnet 5 (
claude-sonnet-5): دولاران للإدخال، 10 دولارات للإخراج بسعر تمهيدي حتى 31 أغسطس 2026. السعر القياسي 3 دولارات للإدخال، 15 دولاراً للإخراج يسري في 1 سبتمبر 2026. سياق 1M. - Claude Haiku 4.5 (
claude-haiku-4-5): دولار واحد للإدخال، 5 دولارات للإخراج. سياق 200K.
هذه المعرفات مكتملة كما هي مكتوبة. لا يُلحق بها شيء.
الحجم بحد ذاته لا يحمل أي رسوم إضافية على نماذج 1M-رمز: "طلب 900k-رمز يُفوتر بنفس سعر الرمز الواحد كطلب 9k-رمز."
الغرض الفعلي لكل نموذج
تصف أنثروبيك المجموعة بسطر واحد لكل نموذج، وهذه السطور ترشدك أفضل من أي لوحة تصنيف.
- كلود فيبل 5: "ذكاء الجيل التالي للوكلاء طويلي الأمد." يُصنف الأبطأ بين الأربعة من حيث زمن الاستجابة.
- كلود أوبس 4.8: "لأعمال البرمجة الوكيلية المعقدة وأعمال المؤسسات." زمن استجابة متوسط.
- كلود سونيت 5: "أفضل مزيج من السرعة والذكاء." سريع.
- كلود هايكو 4.5: "أسرع نموذج بذكاء قريب من الطراز الأول."
يحمل هايكو 4.5 أيضاً قيوداً تحدد ملاءمة المهمة قبل أن يحددها السعر. نافذة السياق فيه 200 ألف رمز بدلاً من مليون، لذا لن يتسع مستودع كبير أو نص محادثة وكيل طويل. أقصى إخراج له على واجهة الرسائل المتزامنة هو 64 ألف رمز مقابل 128 ألفاً للنماذج الأخرى، وحد المعرفة الموثوق لديه هو فبراير 2025، بينما تجلس النماذج الثلاثة الأخرى عند يناير 2026.
ما الذي تكلفني إياه هذه المقارنة على حمل عمل حقيقي؟
كل نموذج في المجموعة يُسعّر المخرجات بخمسة أضعاف سعر المدخلات. سعر Opus 4.8 هو 5 دولارات للمدخلات و25 دولاراً للمخرجات. سعر Haiku 4.5 هو دولار واحد للمدخلات و5 دولارات للمخرجات. تثبت هذه النسبة على امتداد المجموعة بأكملها، لذا فإن النموذج الذي تختاره يكون أكثر أهمية في الأعمال التي تولّد مخرجات كثيرة.
الأعمال الوكيلية هي من هذا النوع من الأعمال، لأن رموز التفكير تُفوتر كرموز مخرجات وتُحتسب ضمن max_tokens حتى عندما لا يصلك النص. في Fable 5 وOpus 4.8 وOpus 4.7 وSonnet 5، يُحذف ملخص الاستدلال افتراضياً، لذا يعود حقل thinking فارغاً. الفوترة لا تتغير: "في كلتا الحالتين، تُفوتر الكتلة بنفس الطريقة وتُمرر بنفس الطريقة في المحادثات متعددة الأدوار." ما الذي يملأ فاتورة رموز Claude فعلياً يحلل هذا العداد بالكامل.
يختلف تشغيل التفكير من عدمه بين النماذج التي تقارنها، مما سيفسد اختبار التكلفة إذا أغفلته. في Sonnet 5 وFable 5، يكون التفكير قيد التشغيل مسبقاً ولا يحتاج إلى إعداد. في Opus 4.8 وOpus 4.7، يكون متوقفاً حتى تضبط thinking: {type: "adaptive"} في الطلب. طابق الإعداد في كلا الجانبين قبل أن تستنتج أي شيء من الأرقام.
لماذا قد يكون أرخص نموذج هو الأغلى
خذ مهمة برمجة واحدة قائمة بذاتها. يحمل الطلب 60,000 رمز من السياق، وينتج النموذج 8,000 رمز من المخرجات بما في ذلك التفكير. لا يوجد تخزين مؤقت، لذا تبقى العملية الحسابية واضحة.
على Opus 4.8: 0.06 مليون رمز من المدخلات بسعر $5 تساوي $0.30، و 0.008 مليون رمز من المخرجات بسعر $25 تساوي $0.20. تكلف المحاولة $0.50. على Haiku 4.5 نفس المحاولة تكلف $0.06 زائد $0.04، أي $0.10.
Haiku أرخص بخمس مرات لكل محاولة، مما يبدو كهامش كبير حتى تتابع ما تفعله المحاولة الفاشلة. تقرأ الإجابة الخاطئة، مما يكلفك وقتك. تعيد إرسالها كسياق في إعادة المحاولة، لذا كل محاولة تصبح أكبر من السابقة. وعندما تفشل المحاولة الثالثة أيضاً، تلجأ للنموذج الأكبر على أي حال: $0.30 لـ Haiku زائد $0.50 لـ Opus يساوي $0.80، أو 60% أكثر من تشغيل Opus مرة واحدة.
لذا فالسؤال الحاسم هو مدى رخص التحقق من الإجابة. عندما يكون الخطأ واضحاً في ثانية واحدة، يكون النموذج الصغير صفقة رابحة. عندما يتطلب اكتشاف الخطأ قراءة الفروقات بدقة، يكلفك النموذج الصغير وقتاً لا يظهر أبداً في الفاتورة.
حيث يفوز نموذج أصغر بشكل قاطع
Haiku 4.5 هو الإجابة الصحيحة في هذه الحالات:
- عمل الوكيل الفرعي الميكانيكي. الوكيل الفرعي الذي يعيد تسمية الملفات أو يجمع مخرجات البحث لا يحتاج إلى استدلال متقدم. هذا هو النمط القياسي بمجرد أن تبني وكيل ذكاء اصطناعي باستخدام Claude وتعطيه مساعدين.
- فرز السجلات. تحديد ما إذا كان السطر مجرد ضوضاء أم يستحق انتباه الإنسان هو حكم ضيق مع وضع فشل واضح.
- التصنيف مقابل مجموعة تسميات ثابتة. المخرجات قصيرة والدقة قابلة للقياس على عينة.
- الاستدعاءات الإنتاجية عالية الحجم. عند 100,000 تشغيل في اليوم، يتوقف الفارق لكل رمز عن كونه خطأ تقريب. هذا هو الشكل المعتاد لـ سير عمل الذكاء الاصطناعي الموصول بـ n8n.
- أي شيء تكون فيه سرعة الاستجابة مهمة للمستخدم. تم تصنيف Haiku 4.5 كأسرع نموذج في المجموعة.
هناك حد واحد ينتمي إلى Haiku تحديداً. الحد الأدنى للموجه القابل للتخزين المؤقت هو 4,096 رمزاً، مقابل 1,024 في Opus 4.8 و Sonnet 5، وتحت هذا الحد الأدنى "أي طلبات لتخزين أقل من هذا العدد من الرموز ستتم معالجتها بدون تخزين مؤقت، ولن يتم إرجاع أي خطأ". كتلة تعليمات بحجم 1,500 رمز يتم تخزينها مؤقتاً على Sonnet 5 لا يتم تخزينها مؤقتاً بصمت على Haiku 4.5. العلامة هي أن cache_creation_input_tokens و cache_read_input_tokens كلاهما عند الصفر، وهو ما إبقاء تكاليف الوكيل الدائم التشغيل منخفضة يغطيه إلى جانب الطرق الأخرى لفقدان التخزين المؤقت.
الروافع التي تغير الإجابة
كل واحدة من هذه تنقل فاتورة أبعد مما يفعله اسم النموذج.
الجهد. يتحكم output_config.effort في مقدار العمل الذي يقوم به النموذج قبل أن يجيب. المستويات هي low و medium و high و xhigh و max، و high هو الافتراضي: "ضبط effort على high ينتج بالضبط نفس سلوك حذف معامل effort بالكامل." إنه يتداخل داخل output_config بدلاً من أن يكون في المستوى الأعلى للطلب:
response = client.messages.create(
model="claude-sonnet-5",
max_tokens=4096,
output_config={"effort": "medium"},
messages=messages,
)يؤثر الجهد على كل رمز في الاستجابة: "يمكن أن يؤثر على كل إنفاق الرموز بما في ذلك استدعاءات الأدوات. على سبيل المثال، الجهد الأقل يعني أن كلود يقوم باستدعاءات أدوات أقل." هذا يتراكم على حلقة وكيل. إنه ليس حداً أقصى للرموز: "الجهد هو إشارة سلوكية، وليس ميزانية رموز صارمة." لا تنشر أنثروبيك مضاعف تكلفة لكل مستوى وتطلب منك اختبار حالة الاستخدام الخاصة بك، لذا فإن تشغيل Sonnet 5 عند high مقابل تشغيل Opus 4.8 عند low هو مقارنة حقيقية يمكنك إجراؤها بعد ظهر اليوم. Haiku 4.5 غائب عن قائمة النماذج التي تدعم الجهد.
التخزين المؤقت للموجهات. تكلفة قراءة ذاكرة التخزين المؤقت 0.1 ضعف سعر الإدخال الأساسي، والرقم الذي يقرر اختيار النموذج هو ما يفعله ذلك عبر المستويات. إصابة ذاكرة التخزين المؤقت على Opus 4.8 تكلف $0.50 / مليون رمز، والإدخال غير المخزن مؤقتاً على Haiku 4.5 يكلف $1 / مليون رمز، لذا فإن بادئة Opus المخزنة مؤقتاً بشكل جيد أرخص لكل رمز إدخال من موجه Haiku بارد. نظافة الجلسة تتفوق على اختيار النموذج في أي عبء عمل يعيد إرسال بادئة كبيرة ومستقرة.
الدفعات. إذا لم يكن هناك شيء ينتظر الإجابة، فإن Message Batches API تشغل نفس النماذج مع "خصم 50% على كل من رموز الإدخال والإخراج". إنها تخفض كل صف من المقارنة أدناه إلى النصف، وتعمل عبر المستويات: وظيفة Opus 4.8 المجمعة تكلف أقل من وظيفة Sonnet 5 المتزامنة بالسعر القياسي اعتباراً من 1 سبتمبر 2026، بمقايضة زمن الانتظار بالقدرة مقابل المال.
مقارنة تكلفة فعلية لعمل واحد
المهمة: تصنيف 100,000 بريد دعم، استدعاء واحد لكل بريد، 2,000 رمز إدخال و300 رمز إخراج لكل استدعاء. هذا يساوي 200 مليون رمز إدخال و30 مليون رمز إخراج.
- Haiku 4.5: 200 × $1 = $200 إدخال، 30 × $5 = $150 إخراج. المجموع $350.
- Sonnet 5، السعر التمهيدي: 200 × $2 = $400 إدخال، 30 × $10 = $300 إخراج. المجموع $700.
- Sonnet 5، من 1 سبتمبر 2026: 200 × $3 = $600 إدخال، 30 × $15 = $450 إخراج. المجموع $1,050.
- Opus 4.8: 200 × $5 = $1,000 إدخال، 30 × $25 = $750 إخراج. المجموع $1,750.
غيّر أربعة أرقام لتعيد الحساب بأسعار الغد. التعديلات أدناه تحرك النتيجة أبعد مما فعل اسم النموذج:
- التجميع يخفض كل سطر للنصف: $175، $350، $525 و$875. لا شيء ينتظر في مهمة تصنيف ليلية، فلا سبب لتخطي التجميع.
- تخزين البادئة المشتركة مؤقتاً. لنقل إن 1,200 من رموز الإدخال البالغة 2,000 هي نفس كتلة التعليمات في كل مرة. في Sonnet 5 بالسعر التمهيدي، تكلفتها $0.20 / مليون رمز كإصابة مخبأة بدلاً من $2 / مليون رمز، لذا 120 مليون رمز تكلف $24 بدلاً من $240. أضف 80 مليون رمز إدخال جديد بسعر $2، أي $160، زائد $300 إخراج، فيهبط Sonnet 5 إلى حوالي $484 بدلاً من $700. الحيلة نفسها لا تفعل شيئاً في Haiku 4.5، لأن 1,200 رمز أقل من حده الأدنى البالغ 4,096 رمزاً.
- إعادة المحاولة. افترض أنك ترفض إجابة Haiku في 8% من الرسائل وتعيد تشغيلها على Opus 4.8. أضف 0.08 × $1,750 = $140 إلى $350، فيصبح الناتج $490. قس معدل الرفض الخاص بك بدلاً من استعارة معدلي.
- تعريفات الأدوات، إن كانت المهمة تستخدمها. موجه النظام الذي تولده هو 290 رمزاً في Opus 4.8 مع ضبط
tool_choiceعلىauto، و354 في Sonnet 5 و496 في Haiku 4.5. النموذج الأرخص يحمل العبء الثابت الأكبر.
Haiku مع مسار تصعيد عند $490 وSonnet 5 المخبأ عند $484 يتساويان في التكلفة، وأحدهما ينجز المهمة بتمريرة واحدة. النموذج لم يكن السؤال كله قط.
هل توفير المال عند تبديل النماذج أثناء الجلسة؟
يحدث ذلك بمعدل أقل مما توحي به الأسعار المعلنة، لأن التوفير يكون لكل رمز، وما تعرضه للخطر هو بادئة مخزنة مؤقتاً بالكامل.
توثق tools ما يبطل التخزين المؤقت. تُبنى البادئات بالترتيب tools، ثم system، ثم messages، و"التغييرات في كل مستوى تبطل ذلك المستوى وجميع المستويات اللاحقة." يوجد إعدادان للطلب في تلك القائمة أيضاً: "يتم إدراج إعدادات التفكير ومستوى effort المُحدد في الموجه نفسه، لذا فإن تغيير أي منهما يبدأ بادئة تخزين مؤقت جديدة." وبخصوص الجهد، تذهب الوثائق إلى أبعد من ذلك: "غيّر الجهد عبر المهام بدلاً من تغييره داخل محادثة تعتمد على نجاح التخزين المؤقت".
النموذج ليس ضمن تلك القائمة الموثقة، لذا لا تفترض الأمر في أي من الاتجاهين. اقرأ cache_read_input_tokens في أول طلب بعد التبديل ودع الرقم يُجيبك. بالنسبة لبادئة tools بحجم 150,000 رمز، تبلغ تكلفة قراءة التخزين المؤقت حوالي 0.08 دولار، بينما تبلغ تكلفة الكتابة الجديدة حوالي 0.94 دولار، وهو مبلغ يتجاوز فارق التكلفة لكل رمز الذي كنت تسعى إليه عبر عدة دورات.
لذا قم بتغيير هذه الأمور بين المهام، وليس داخل المهمة الواحدة. في tools، هذا يعني /clear أولاً، عندما يتم التخلص من التخزين المؤقت على أي حال، ثم /model أو /effort.
كيفية اختبار الإجابة على عبء العمل الخاص بك
لا تُحدد حجم المُدخل بعدّ مأخوذ من نموذج مختلف. نقطة نهاية عد الرموز مجانية الاستخدام وتَعُد باستخدام مُجزئ الرموز الخاص بأي نموذج تُسميه، لذا سَمِّ النموذج الذي تخطط لاستدعائه. يستخدم Opus 4.7 والإصدارات الأحدث، وFable 5 وSonnet 5 مُجزئ رموز أحدث "يُنتج رموزاً أكثر بنسبة 30% تقريباً لنفس النص"، لذا فإن الميزانية المُقاسة على نموذج أقدم تبدو منخفضة على نموذج أحدث بمعدل سعر ثابت لكل رمز.
ثم اقرأ ما عاد. input_tokens هو فقط الباقي غير المُخزَّن مؤقتاً، لذا فإن حجم المُدخل الحقيقي هو ذلك الحقل زائد cache_creation_input_tokens زائد cache_read_input_tokens. تطبيق Claude API أول على خادم افتراضي خاص هو أصغر مكان صادق لتشغيل هذا القياس، وأي خطة من Claude تناسب استخدامك هو القرار المنفصل حول ما إذا كنت ستدفع لكل رمز على الإطلاق.
FAQ
ما نموذج Claude الأنسب للبرمجة؟
يُعد Claude Opus 4.8 نقطة الانطلاق الموثقة لمهام البرمجة الوكيلة المعقدة، بتكلفة 5 دولارات لكل مليون رمز إدخال و25 دولاراً لكل مليون رمز إخراج اعتباراً من يوليو 2026. يُوصف Claude Sonnet 5 بأنه أفضل مزيج من السرعة والذكاء، وبتكلفة 2 / 10 دولارات حتى 31 أغسطس 2026، فهو أقل من نصف التكلفة. نفّذ المهمة نفسها على كليهما، وثبّت إعدادات التفكير، وقارن إجمالي إنفاق الرموز من response.usage.
هل Claude Haiku 4.5 رخيص بما يكفي ليحل محل Sonnet 5؟
لكل رمز، بسهولة: 1 / 5 دولارات مقابل 2 / 10 دولارات لـ Sonnet 5 بالتسعير التمهيدي، أو 3 / 15 دولاراً من 1 سبتمبر 2026. الحدود هي الفيصل. يمتلك Haiku 4.5 نافذة سياق بسعة 200 ألف رمز بدلاً من مليون، وحد أقصى للإخراج يبلغ 64 ألف رمز على واجهة برمجة التطبيقات المتزامنة Messages API، وقطع معرفة موثوق في فبراير 2025، ولا يدعم output_config.effort، وحد أدنى للمطالبة القابلة للتخزين المؤقت يبلغ 4,096 رمزاً مما يعطل التخزين المؤقت بصمت على مطالبات النظام القصيرة.
هل التبديل إلى نموذج Claude أرخص في منتصف الجلسة يوفر المال؟
أقل مما يبدو. توثق Anthropic مُبطِلات ذاكرة التخزين المؤقت كتغييرات في بادئة tools أو system أو messages، وتغييرات في إعدادات التفكير، وتغييرات في output_config.effort. ما يفعله تبديل النموذج بذاكرة التخزين المؤقت الحالية غير موثق، لذا تعامل معه كمجهول واقرأ cache_read_input_tokens في الطلب الأول بعده. الرهان يستحق المعرفة: على بادئة بـ 150,000 رمز لـ Opus 4.8، تكلف قراءة ذاكرة التخزين المؤقت حوالي 0.08 دولار والكتابة الجديدة حوالي 0.94 دولار، وهو ما يفوق عدة دورات من التوفير لكل رمز. انتقل بين المهام، بعد /clear في Claude Code، عندما يتم التخلص من ذاكرة التخزين المؤقت بغض النظر.
ما تأثير output_config.effort على فاتورتي؟
يغير عدد الرموز التي ينفقها النموذج عبر النص واستدعاءات الأدوات والتفكير. الجهد الأقل يؤدي إلى استدعاءات أدوات أقل، مما يتضاعف في الحلقات الوكيلة لأن كل نتيجة أداة يُعاد إرسالها في الدورات اللاحقة. المستويات هي low وmedium وhigh وxhigh وmax، مع high كإعداد افتراضي. لا تنشر Anthropic مضاعف تكلفة لكل مستوى، وتصف الجهد بأنه إشارة سلوكية وليس ميزانية رموز، لذا قسه على مهمتك الخاصة.
ما مقدار التوفير الذي توفره واجهة Claude Batches API؟
50% على رموز الإدخال والإخراج معاً، مقابل التسليم غير المتزامن. اعتباراً من يوليو 2026، هذا يجعل Opus 4.8 بسعر 2.50 دولار للإدخال / 12.50 دولار للإخراج، وSonnet 5 بسعر 1 / 5 دولارات بالتسعير التمهيدي، وHaiku 4.5 بسعر 0.50 / 2.50 دولار. المقارنة الجديرة بالملاحظة تمتد عبر المستويات: مهمة Opus 4.8 المجمعة تكلف أقل من مهمة Sonnet 5 المتزامنة بالسعر القياسي من 1 سبتمبر 2026، لذا فإن التجميع يمنحك نموذجاً أقوى بنفس المال.