كم تكلفة مليون رمز في Claude؟
تعرّف إلى تكلفة مليون رمز في Claude، ولماذا يختلف السعر بين الإدخال والإخراج، مع معادلة تحوّل عدد الرموز إلى تقدير واضح لفاتورتك الشهرية.
ما تكلفة 1M من الرموز المميّزة في Claude؟
يعني 1M من الرموز المميّزة مليونَ رمز مميّز، وهو المقياس الذي تُحدَّد به أسعار كل واجهة Claude API (واجهة برمجة التطبيقات). لا توجد تكلفة واحدة له، لأن رموز الإدخال والإخراج تُحاسَب بمعدلات مختلفة، ولكل نموذج معدلاه الخاصان. اعتبارًا من August 2026، تبلغ تكلفة مليون رمز إدخال مميّز $1 في Claude Haiku 4.5، و$2 في Claude Sonnet 5، و$5 في Claude Opus 5.
الإخراج هو الجزء الأعلى تكلفة. في كل نموذج حالي، يبلغ معدل الإخراج خمسة أضعاف معدل الإدخال، لذلك يحدد توزيع الرموز بينهما فاتورتك بدرجة أكبر من الرقم المعلن. يختلف سلوك تطبيق يرسل مستندات طويلة ويعيد إجابات قصيرة كثيرًا عن تطبيق يكتب إجابات طويلة انطلاقًا من مطالبة قصيرة.
تتناول هذه الصفحة اقتصاديات الوحدة: تكلفة الرمز المميّز وكيفية تقدير الفاتورة قبل إنشاء التطبيق. لمعرفة أين تذهب الرموز المميّزة فعليًا أثناء العمل، اقرأ أين تذهب الرموز المميّزة داخل جلسة Claude Code.
كيف يبدو 1M من الرموز
الرمز هو جزء من النص يقرأه النموذج أو يكتبه. التقدير التقريبي من Anthropic هو رمز واحد لكل 4 أحرف، أو نحو 0.75 كلمة باللغة الإنجليزية. لذلك يعادل مليون رمز نحو 750,000 كلمة، أو قرابة 4 MB من النص العادي.
تعطي التقديرات المنشورة للمدخلات الشائعة تصورًا أفضل عن الحجم.
The data behind this chart
[
{
"label": "Average web page (10 kB)",
"tokens": "2,500"
},
{
"label": "Documentation page (100 kB)",
"tokens": "25,000"
},
{
"label": "Research paper PDF (500 kB)",
"tokens": "125,000"
}
]بهذه المعدلات، يعادل 1M من الرموز نحو 400 صفحة ويب متوسطة تُقرأ مرة واحدة، أو 8 أوراق بحثية بهذا الحجم. وهذا يعادل تمريرة واحدة على قاعدة شيفرة متوسطة الحجم، أو شهرًا من استخدام الدردشة الخفيف لشخص واحد.
اعتبر كل ذلك تقديرًا. تحتوي الشيفرة وJSON والنصوص باللغات غير الإنجليزية على عدد أقل من الكلمات لكل رمز، لذلك تمثل نسبة 0.75 الطرف المتفائل. وهناك عامل آخر يؤثر في العدد: يستخدم Claude Opus 4.7 والإصدارات الأحدث، بما في ذلك Opus 5 وSonnet 5، محلل رموز أحدثًا ينتج رموزًا أكثر بنحو 30 بالمئة للنص نفسه مقارنةً بـ Sonnet 4.6 والإصدارات الأقدم. ويستخدم Claude Haiku 4.5 محلل الرموز الأقدم. لذلك يقلل العدد الذي قسته على Haiku 4.5 من العدد الفعلي على Sonnet 5 عند استخدام المدخل نفسه، ما يعني أن المقارنة المباشرة للسعر لكل مليون بين هذين الجيلين ليست عادلة. احسب عدد الرموز للمطالبة نفسها على كلا النموذجين قبل اتخاذ القرار.
تكلفة Claude لكل مليون رمز مميز
The data behind this chart
[
{
"label": "Haiku 4.5",
"input_usd": 1,
"output_usd": 5
},
{
"label": "Sonnet 5 (to 31 Aug 2026)",
"input_usd": 2,
"output_usd": 10
},
{
"label": "Sonnet 5 (from 1 Sep 2026)",
"input_usd": 3,
"output_usd": 15
},
{
"label": "Opus 5",
"input_usd": 5,
"output_usd": 25
}
]يخضع Claude Sonnet 5 لسعر تمهيدي قدره $2 للإدخال و$10 للإخراج حتى 31 August 2026. اعتبارًا من 1 September 2026، يُطبَّق السعر القياسي: $3 للإدخال و$15 للإخراج. أما Claude Opus 5 فسعره $5 و$25.
قد تتغير الأسعار. اعتبر كل قيمة في هذه الصفحة مثالًا حسابيًا مؤرخًا في August 2026، وتحقق من الأرقام الحالية في صفحة الأسعار الرسمية قبل اعتماد الميزانية.
طول السياق لا يغير السعر. في Claude 4.6 والإصدارات الأحدث، تُحتسب نافذة السياق الكاملة البالغة 1M رمز مميز وفق السعر القياسي. لذلك، تكون تكلفة الطلب الذي يحتوي على 900,000 رمز مميز لكل رمز مميز مساوية لتكلفة طلب يحتوي على 9,000 رمز مميز. تزيد تكلفة المطالبة الطويلة لأنها تحتوي على عدد أكبر من الرموز المميزة، ولا يُطبَّق سعر منفصل للسياق الطويل.
الحساب الذي يظل صحيحًا بعد تغيير السعر
كل فاتورة تتكوّن من عمليتي ضرب وعملية جمع واحدة.
cost = (input_tokens / 1,000,000) * input_rate
+ (output_tokens / 1,000,000) * output_rateمكتوبة بصيغة تعليمات برمجية يمكنك تشغيلها:
INPUT_RATE = 2.00 # USD per million input tokens, Sonnet 5, August 2026
OUTPUT_RATE = 10.00 # USD per million output tokens
def cost(input_tokens, output_tokens):
return (input_tokens * INPUT_RATE + output_tokens * OUTPUT_RATE) / 1_000_000
print(f"{cost(4300, 400):.4f}")يطبع ذلك 0.0126. تبلغ تكلفة طلب يرسل 4,300 من رموز الإدخال ويتلقى 400 من رموز الإخراج نحو 1.3 سنت على Sonnet 5. احتفظ بالسعرين في موضع واحد في التعليمات البرمجية. عند تغيّر السعر، عدّل سطرين، وستتغير معه كل التقديرات في نظامك.
تقدير تطبيقي لتطبيق حقيقي
لنفترض وجود مساعد للدعم. يبلغ حجم موجّه النظام ووثائق المنتج 4,000 رمز، ويُرسلان مع كل طلب، لأن Messages API عديم الحالة ولا يتذكر النموذج أي شيء بين الاستدعاءات. يضيف سؤال المستخدم نحو 300 رمز. ويبلغ طول الإجابة نحو 400 رمز. بذلك يستهلك كل طلب 4,300 رمز إدخال و400 رمز إخراج.
يتيح لك مليون رمز إدخال تنفيذ نحو 232 طلبًا من هذا النوع. عند 1,000 طلب يوميًا، يستهلك التطبيق 4.3 مليون رمز إدخال يوميًا، ولذلك فإن «1M tokens» لا يغطي سوى أقل من ست ساعات من حركة الشبكة.
The data behind this chart
[
{
"label": "Opus 5, list rates",
"cost_per_1k_usd": "31.50"
},
{
"label": "Sonnet 5, list rates",
"cost_per_1k_usd": "12.60"
},
{
"label": "Sonnet 5, Batch API",
"cost_per_1k_usd": "6.30"
},
{
"label": "Haiku 4.5, list rates",
"cost_per_1k_usd": "6.30"
},
{
"label": "Sonnet 5, warm prompt cache",
"cost_per_1k_usd": "5.40"
}
]في Claude Opus 5، تكلّف حركة الشبكة هذه 31.50 دولارًا لكل 1,000 طلب. وفي Sonnet 5 تبلغ التكلفة 12.60 دولارًا. ويؤدي الانتقال إلى Claude Haiku 4.5 إلى خفضها إلى 6.30 دولارًا، بينما يخفض مخزن المطالبات المؤقت الدافئ في Sonnet 5 التكلفة أكثر، لتصل إلى 5.40 دولارًا.
اضرب التكلفة في 30 لتحسب تكلفة شهر من حركة الشبكة هذه. تبلغ تكلفة Sonnet 5 وفق الأسعار المعلنة نحو 378 دولارًا شهريًا. أما التطبيق نفسه مع مخزن مؤقت دافئ فتبلغ تكلفته نحو 162 دولارًا. يؤثر اختيارك للنموذج وقرارك بشأن التخزين المؤقت كل منهما في التكلفة أكثر من أي سعر يمكنك التفاوض عليه عند هذا الحجم. ويُعد اختيار النموذج الذي ستشغله مسألة مستقلة. يفوز النموذج الأرخص الذي يجتاز تقييماتك: يوضح الاختيار بين Opus وSonnet وHaiku كيفية اختبار ذلك بطريقة صحيحة.
تخزين المطالبات مؤقتًا يخفض تكلفة الجزء المتكرر
بادئة مكوّنة من 4,000 رمز تكون متطابقة في كل طلب، وتدفع تكلفتها الكاملة كمدخلات في كل مرة. يخزّن تخزين المطالبة مؤقتًا البادئة بعد معالجتها، ويفرض معدلًا مخفضًا عند إعادة استخدامها.
تكلفة قراءة ذاكرة التخزين المؤقت تساوي 0.1 من معدل الإدخال الأساسي. وتكلفة كتابة ذاكرة التخزين المؤقت تساوي 1.25 من المعدل الأساسي لمدة صلاحية قدرها 5 دقائق، أو 2 من المعدل الأساسي لمدة صلاحية قدرها 1 ساعة. لذلك تغطي ذاكرة التخزين المؤقت لمدة 5 دقائق تكلفتها بعد قراءة واحدة، لأن الكتابة تكلف 0.25 إضافية، بينما توفر كل قراءة 0.9. وتحتاج ذاكرة التخزين المؤقت لمدة 1 ساعة إلى قراءتين لتحقيق نقطة التعادل.
أبسط طريقة لتفعيلها هي استخدام حقل واحد في المستوى الأعلى:
curl https://api.anthropic.com/v1/messages \
-H "content-type: application/json" \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-5",
"max_tokens": 1024,
"cache_control": {"type": "ephemeral"},
"system": "You are a helpful assistant.",
"messages": [
{"role": "user", "content": "What are the key themes in Pride and Prejudice?"}
]
}'بعد ذلك، اقرأ الكتلة usage التي تعود في الاستجابة:
{
"usage": {
"cache_creation_input_tokens": 5120,
"cache_read_input_tokens": 1800,
"input_tokens": 50,
"output_tokens": 503
}
}تُحاسب عدادات الإدخال الثلاثة هذه وفق 3 معدلات مختلفة، ويكون مجموعها حجم الإدخال الفعلي: total_input_tokens = cache_read_input_tokens + cache_creation_input_tokens + input_tokens. سيكون تقدير التكلفة الذي يقرأ input_tokens فقط غير دقيق بدرجة كبيرة بعد تفعيل التخزين المؤقت.
هناك شيئان يمنعان ذاكرة التخزين المؤقت من تغطية تكلفتها، ويفشل كلاهما دون إظهار خطأ.
يجب أن تكون البادئة متطابقة على مستوى البايتات. يبحث التخزين المؤقت عن تطابق في البادئة، لذلك يؤدي وضع طابع زمني أو اسم المستخدم في بداية مطالبة النظام إلى تغييرها في كل طلب. عندئذ تدفع 1.25 من معدل الإدخال الأساسي في كل مرة، ولا تحصل على أي قراءة. يتمثل العرض في بقاء cache_creation_input_tokens مرتفعًا، بينما يظل cache_read_input_tokens يساوي 0. ضع cache_control في آخر كتلة يكون محتواها متطابقًا بين الطلبات، وضع كل ما يتغير بعدها. يؤدي تغيير تعريفات tools إلى إبطال ذاكرة التخزين المؤقت بأكملها أسفلها، لأن الإبطال ينتقل وفق ترتيب الأدوات، ثم النظام، ثم الرسائل.
يجب أن تكون البادئة طويلة بما يكفي. الحد الأدنى للطول القابل للتخزين المؤقت هو 512 رمزًا في Opus 5، و1,024 في Sonnet 5، و4,096 في Haiku 4.5. لا تُخزّن المطالبة الأقصر مؤقتًا، ولا تُعاد أي رسالة خطأ. تُخزّن البادئة المكوّنة من 4,000 رمز في المثال السابق مؤقتًا في Sonnet 5، ولا تُخزّن في Haiku 4.5، لأن 4,000 أقل من الحد الأدنى لذلك النموذج. عندما تكون قراءتا العدادين 0، فهذا يعني أنه لم يُخزّن أي شيء مؤقتًا.
المعالجة الدفعية تخفض التكلفة إلى النصف
تعالج Batch API الطلبات بشكل غير متزامن بخصم قدره 50 percent على المدخلات والمخرجات. في المثال أعلاه، يخفض ذلك التكلفة من $12.60 لكل 1,000 طلب إلى $6.30. يتراكم هذا الخصم مع التخزين المؤقت للمطالبات، ولذلك تُعد مهمة Batch المخزنة مؤقتًا الطريقة الأقل تكلفة لتنفيذ الأعمال المجمعة.
ما تتخلى عنه هو زمن الاستجابة، ولذلك لا تناسب Batch أي مهمة ينتظر الشخص نتيجتها. وتناسب التصنيف الذي يُنفذ طوال الليل واستكمال معالجة المستندات.
لماذا تتزايد تكلفة الدردشة داخل محادثة واحدة
لأن API لا يحتفظ بالحالة، يعيد عميلك إرسال المحادثة بأكملها في كل دورة. لذلك يزداد استخدام الرموز داخل دردشة واحدة تربيعيًا مع طولها، وليس خطيًا.
افترض أن متوسط كل دورة هو 500 رمز. ترسل الدورة 1 عدد 500 من رموز الإدخال. وترسل الدورة 2 عدد 1,000. وترسل الدورة 20 عدد 10,000. وباستخدام الصيغة n(n+1)/2، تكون محادثة من 20 دورة قد أرسلت نحو 105,000 من رموز الإدخال، بينما لا يتجاوز نص المحادثة نفسه 10,000 رمز.
لهذا السبب تكون تكلفة ميزة الدردشة أعلى مما يوحي به نص المحادثة، ولهذا يؤتي تخزين البادئة الثابتة مؤقتًا أو تلخيص الدورات الأقدم ثماره في سلاسل المحادثات الطويلة. ويتبع الوكيل الذي يكرر استدعاءات الأدوات النمط نفسه، بل يكون الوضع أسوأ: إذ تبقى كل نتيجة أداة في السجل، ويُعاد إرسالها في كل دورة لاحقة. وتكتسب وضع حد إنفاق صارم على وكيل تشغّله بنفسك أهمية أكبر هنا، لأن هذا النمو يحدث تلقائيًا ولا يراقبه أحد.
احسب الرموز قبل أن تخمّن
توقّف عن اشتقاق عدد الرموز من عدد الكلمات. تحسبها واجهة API نيابةً عنك، من دون تكلفة، وبحدّ معدل منفصل عن إنشاء الرسائل.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-5",
"system": "You are a scientist",
"messages": [{
"role": "user",
"content": "Hello, Claude"
}]
}'تحتوي الاستجابة على حقل واحد:
{ "input_tokens": 14 }أرسل إليها مطالبة النظام الفعلية وتعريفات الأدوات، مع رسالة مستخدم تمثيلية، ثم أدخل العدد في دالة التكلفة أعلاه. تستخدم نقطة النهاية النص نفسه المستخدم في طلب الرسالة، لذلك تُحتسب الصور وملفات PDF بشكل صحيح أيضًا. هناك نقطتان مهمتان. العدد تقديري وقد يختلف قليلًا عن الرقم المفوتر. كما يُقاس باستخدام مُرمّز النموذج الذي تمرّره، لذلك مرّر النموذج الذي ستشغّله فعليًا.
لا يمكن حساب رموز الإخراج مسبقًا، لأنها لا تكون موجودة بعد. حدّد سقفها باستخدام max_tokens، ثم قِس التوزيع الفعلي من usage.output_tokens على حركة الشبكة الحية.
ما الذي يُضاف أيضًا إلى الفاتورة
تشكل الرموز معظم الفاتورة. وهناك بعض البنود التي ليست رموزًا، وقد تفاجئ المستخدمين.
- تصبح تعريفات الأدوات رموز إدخال في كل طلب. وتضيف مطالبة النظام الخاصة باستخدام الأدوات وحدها من 286 إلى 406 رموز في Opus 5، قبل إضافة المخططات الخاصة بك. ويمكن لعشرة أوصاف مطولة للأدوات أن تضاعف مطالبة صغيرة.
- تُحتسب عمليات البحث على الويب بسعر $10 لكل 1,000 عملية بحث، بالإضافة إلى الرموز التي تستهلكها النتائج عند إدخالها في السياق.
- لا تفرض عملية جلب الويب رسمًا مستقلًا، لكن الصفحة التي يتم جلبها تصبح رموز إدخال. وتحتوي صفحة توثيق بحجم 100 kB تقريبًا على 25,000 من هذه الرموز.
- يؤدي طلب الاستدلال المقتصر على الولايات المتحدة باستخدام
inference_geoفي Claude 4.6 والإصدارات الأحدث إلى تطبيق معامل 1.1 على كل فئة من فئات الرموز، بما في ذلك عمليات قراءة ذاكرة التخزين المؤقت وكتابتها.
يعتمد تحديد ما إذا كانت API هي الخيار المناسب للشراء أصلًا على حجم استخدامك. فعند انخفاض الاستخدام عن مستوى معين، تتفوق خطة شهرية ثابتة بوضوح، ويجري مقارنة API باشتراك Claude باستخدام أرقام فعلية.
FAQ
ما تكلفة 1M من الرموز في Claude؟
يعتمد ذلك على النموذج، وعلى ما إذا كانت الرموز رموز إدخال أم إخراج. اعتبارًا من أغسطس 2026، تبلغ تكلفة مليون رمز إدخال $1 في Claude Haiku 4.5، و$2 في Claude Sonnet 5 ضمن التسعير التمهيدي، و$5 في Claude Opus 5. تبلغ تكلفة الإخراج خمسة أضعاف معدل الإدخال في كل نموذج من هذه النماذج. ينتقل Sonnet 5 إلى $3 للإدخال و$15 للإخراج في 1 سبتمبر 2026. تتغير الأسعار، لذلك تحقّق منها في صفحة التسعير الرسمية قبل اعتماد رقم في الميزانية.
هل 1M من الرموز يساوي 1M من الكلمات؟
لا. يتكوّن الرمز الواحد تقريبًا من 4 محارف باللغة الإنجليزية، أو نحو 0.75 كلمة، ولذلك يساوي مليون رمز نحو 750,000 كلمة. هذه النسبة إرشادية فقط. تستخدم التعليمات البرمجية وJSON واللغات غير الإنجليزية عددًا أكبر من الرموز لكل كلمة. يستخدم Claude Opus 4.7 والإصدارات الأحدث أيضًا أداة تقسيم إلى رموز أحدث، فتنتج نحو 30 بالمائة من الرموز الإضافية للنص نفسه مقارنةً بـ Claude Sonnet 4.6 والإصدارات الأقدم، لذلك لا يمكن نقل الأعداد مباشرةً بين أجيال النماذج. أجرِ القياس باستخدام نقطة النهاية المجانية /v1/messages/count_tokens، مع تمرير النموذج الذي تخطط لتشغيله.
هل تؤدي تخزينة المطالبات دائمًا إلى خفض التكلفة؟
لا. تكلف كتابة ذاكرة تخزين مؤقت لمدة 5 دقائق 1.25 ضعف معدل الإدخال الأساسي، لذلك تكون تكلفة السابقة التي تُكتب ولا تُقرأ مطلقًا أكبر بنسبة 25 بالمائة من تكلفة إرسالها عاديًا. وتغطي تكلفتها بدءًا من القراءة الأولى. وتفشل بطريقتين، وكلتاهما صامتة. إذا تغيرت السابقة المخزنة بين الطلبات، فلن تتطابق عملية البحث مطلقًا، لأن المطابقة تكون لسابقة مطابقة تمامًا. وإذا كانت السابقة أقصر من الحد الأدنى للطول القابل للتخزين مؤقتًا في النموذج، وهو 1,024 رمزًا في Sonnet 5 و4,096 في Haiku 4.5، فلن يتم تخزين أي شيء مؤقتًا ولن يُرجع أي خطأ. عندما تعرض cache_creation_input_tokens وcache_read_input_tokens القيمة 0 معًا، لا تؤدي ذاكرة التخزين المؤقت أي عمل.
لماذا نمت فاتورتي أسرع من عدد رسائلي؟
لأن المحادثة بأكملها تُرسل مجددًا في كل دور. لا تحتفظ Messages API بأي حالة، لذلك يحمل الدور 20 من المحادثة جميع الأدوار الـ19 السابقة مجددًا كإدخال. عندما يبلغ متوسط الأدوار 500 رمز، ترسل محادثة من 20 دورًا نحو 105,000 رمز إدخال، بينما لا يتجاوز طول سجل المحادثة 10,000 رمز. تعمل حلقات الوكلاء بالطريقة نفسها، لأن نتيجة كل أداة تبقى في السجل. خزّن السابقة الثابتة مؤقتًا، أو لخّص الأدوار الأقدم واحذفها من الطلب.