SSD Nodes Learn Hosting plans →
الأدلة Matt Connorبقلم Matt Connor · آخر تحديث في 2026-08-23

كم تكلفة مليون رمز في Claude؟

تعرّف إلى تكلفة مليون رمز في Claude API، ولماذا يختلف السعر بين الإدخال والإخراج والنماذج، مع طريقة تحويل عدد الرموز إلى فاتورة شهرية دقيقة.

ما تكلفة 1M من الرموز في Claude؟

يعني 1M مليون رمز، وهو الوحدة التي تُسعَّر بها كل أسعار Claude API (واجهة برمجة التطبيقات). لا توجد تكلفة واحدة ثابتة له، لأن رموز الإدخال والإخراج تُحاسَب بمعدلات مختلفة، ولكل نموذج معدلاه الخاصان. اعتباراً من August 2026، تبلغ تكلفة مليون رمز إدخال $1 في Claude Haiku 4.5، و$2 في Claude Sonnet 5، و$5 في Claude Opus 5.

الإخراج هو الجزء الأعلى تكلفة. في كل نموذج حالي، يبلغ معدل الإخراج خمسة أضعاف معدل الإدخال، ولذلك يحدد التوزيع بينهما فاتورتك بدرجة أكبر من الرقم المعلن. يختلف سلوك تطبيق يرسل مستندات طويلة ويعيد إجابات قصيرة كثيراً عن تطبيق يكتب إجابات طويلة انطلاقاً من مطالبة قصيرة.

تتناول هذه الصفحة اقتصاديات الوحدة: تكلفة الرمز، وكيفية تقدير الفاتورة قبل إنشاء التطبيق. لمعرفة أين تذهب الرموز فعلياً أثناء عملك، اقرأ أين تذهب الرموز داخل جلسة Claude Code.

ما الذي تبدو عليه 1M من الرموز

الرمز هو جزء من النص يقرأه النموذج أو يكتبه. التقدير التقريبي لدى Anthropic هو رمز واحد لكل 4 محارف، أو نحو 0.75 كلمة من الإنجليزية. لذلك تعادل مليون من الرموز نحو 750,000 كلمة، أو قرابة 4 MB من النص العادي.

تعطي التقديرات المنشورة للمدخلات الشائعة تصوراً أفضل عن هذا الحجم.

ChartApproximate input token counts for common content, published estimates
The data behind this chart
[
  {
    "label": "Average web page (10 kB)",
    "tokens": "2,500"
  },
  {
    "label": "Documentation page (100 kB)",
    "tokens": "25,000"
  },
  {
    "label": "Research paper PDF (500 kB)",
    "tokens": "125,000"
  }
]

وفق هذه المعدلات، تعادل 1M من الرموز قراءة نحو 400 صفحة ويب متوسطة مرة واحدة، أو ثماني أوراق بحثية بهذا الحجم. كما تعادل مروراً واحداً على قاعدة شيفرة متوسطة الحجم، أو شهراً من الاستخدام الخفيف للدردشة لشخص واحد.

اعتبر كل ذلك تقديراً. تحتوي الشيفرة وJSON والنصوص المكتوبة بلغات غير الإنجليزية على كلمات أقل لكل رمز، لذلك تمثل نسبة 0.75 الحد المتفائل. وهناك عامل آخر يغيّر العدد: يستخدم Claude Opus 4.7 والإصدارات الأحدث، بما في ذلك Opus 5 وSonnet 5، tokenizer أحدثاً ينتج رموزاً أكثر بنحو 30 بالمئة للنص نفسه مقارنةً بـSonnet 4.6 والإصدارات الأقدم. ويستخدم Claude Haiku 4.5 tokenizer الأقدم. لذلك يقلل العدد الذي قسته على Haiku 4.5 من العدد الفعلي على Sonnet 5 عند استخدام الإدخال نفسه، ما يعني أن المقارنة المباشرة للسعر لكل مليون بين هذين الحدين ليست عادلة. احسب عدد الرموز للمطالبة نفسها على كلا النموذجين قبل أن تقرر.

ما الذي تتقاضاه Claude لكل مليون رمز

ChartClaude API list price in USD per million tokens, August 2026
The data behind this chart
[
  {
    "label": "Haiku 4.5",
    "input_usd": 1,
    "output_usd": 5
  },
  {
    "label": "Sonnet 5 (to 31 Aug 2026)",
    "input_usd": 2,
    "output_usd": 10
  },
  {
    "label": "Sonnet 5 (from 1 Sep 2026)",
    "input_usd": 3,
    "output_usd": 15
  },
  {
    "label": "Opus 5",
    "input_usd": 5,
    "output_usd": 25
  }
]

تستخدم Claude Sonnet 5 سعراً تمهيدياً قدره $2 للإدخال و$10 للإخراج حتى 31 August 2026. واعتباراً من 1 September 2026، يُطبَّق السعر القياسي: $3 للإدخال و$15 للإخراج. أما Claude Opus 5 فسعره $5 للإدخال و$25 للإخراج. ويوجد نموذج يتجاوز هذه الأسعار بكثير: إذ يبلغ سعر Claude Fable 5 مقدار $10 للإدخال و$50 للإخراج، ولذلك فإن جدوى دفع هذه الأسعار تعتمد على المهام التي توجّه النموذج إليها فعلياً.

تتغير الأسعار. اعتبر كل رقم في هذه الصفحة مثالاً تطبيقياً مؤرخاً في August 2026، وتحقق من الأرقام الحالية في صفحة الأسعار الرسمية قبل اعتماد الميزانية.

توضح هذه الأسعار تكلفة Claude، لكنها لا توضح ما إذا كان الخيار الأرخص لأحمال العمل لديك. وتبيّن ثلاث مهام حُسبت تكلفتها على Claude وChatGPT أي واجهة API تتفوق في كل حالة.

طول السياق لا يغيّر السعر. في Claude 4.6 والإصدارات الأحدث، تُحتسب نافذة السياق الكاملة التي تبلغ 1M رمز وفق الأسعار القياسية، لذلك تكلّف طلبات 900,000 رمز المقدار نفسه لكل رمز مثل طلبات 9,000 رمز. وتكون المطالبة الطويلة أعلى تكلفة لأنها تحتوي على عدد أكبر من الرموز، ولا يُطبَّق سعر منفصل للسياق الطويل.

الحساب الذي يظل صحيحاً بعد تغيّر السعر

كل فاتورة تتكوّن من عمليتي ضرب وعملية جمع واحدة.

cost = (input_tokens  / 1,000,000) * input_rate
     + (output_tokens / 1,000,000) * output_rate

يمكنك كتابتها كتعليمة برمجية قابلة للتنفيذ:

INPUT_RATE = 2.00    # USD per million input tokens, Sonnet 5, August 2026
OUTPUT_RATE = 10.00  # USD per million output tokens

def cost(input_tokens, output_tokens):
    return (input_tokens * INPUT_RATE + output_tokens * OUTPUT_RATE) / 1_000_000

print(f"{cost(4300, 400):.4f}")

تطبع هذه التعليمة 0.0126. يكلّف الطلب الذي يرسل 4,300 رمز إدخال ويحصل على 400 رمز إخراج نحو 1.3 سنت على Sonnet 5. احتفظ بالمعدلين في موضع واحد داخل الشفرة. عند تغيّر السعر، تعدّل سطرين فقط، وتتحدّث معه كل التقديرات في نظامك.

تقدير عملي لتطبيق حقيقي

لنفترض مساعد دعم. يتكون موجّه النظام ووثائق المنتج لديه من 4,000 رمز، ويُرسلان مع كل طلب، لأن Messages API عديم الحالة ولا يتذكر النموذج أي شيء بين الاستدعاءات. يضيف سؤال المستخدم نحو 300 رمز. وتبلغ الإجابة نحو 400 رمز. بذلك يستهلك كل طلب 4,300 رمز إدخال و400 رمز إخراج.

يتيح لك مليون رمز إدخال إجراء نحو 232 طلباً من هذا النوع. عند 1,000 طلب يومياً، يستهلك التطبيق 4.3 مليون رمز إدخال يومياً، ولذلك فإن «1M tokens» لا يغطي سوى أقل من ست ساعات من حركة الطلبات.

ChartEstimated cost per 1,000 requests at 4,300 input and 400 output tokens
The data behind this chart
[
  {
    "label": "Opus 5, list rates",
    "cost_per_1k_usd": "31.50"
  },
  {
    "label": "Sonnet 5, list rates",
    "cost_per_1k_usd": "12.60"
  },
  {
    "label": "Sonnet 5, Batch API",
    "cost_per_1k_usd": "6.30"
  },
  {
    "label": "Haiku 4.5, list rates",
    "cost_per_1k_usd": "6.30"
  },
  {
    "label": "Sonnet 5, warm prompt cache",
    "cost_per_1k_usd": "5.40"
  }
]

في Claude Opus 5، تبلغ تكلفة حركة الطلبات هذه $31.50 لكل 1,000 طلب. وفي Sonnet 5 تبلغ $12.60. ويؤدي الانتقال إلى Claude Haiku 4.5 إلى خفضها إلى $6.30، بينما يخفضها prompt cache دافئ في Sonnet 5 أكثر، لتصل إلى $5.40.

اضرب التكلفة في 30 لتحصل على تكلفة شهر من حركة الطلبات هذه. تبلغ تكلفة Sonnet 5 وفق الأسعار المعلنة نحو $378 شهرياً. أما التطبيق نفسه مع cache دافئ فتبلغ تكلفته نحو $162. اختيار النموذج وقرارك بشأن التخزين المؤقت يساوي كل منهما أكثر من أي سعر يمكنك التفاوض عليه عند هذا الحجم. تحديد النموذج الذي ستستخدمه سؤال مستقل، ويفوز النموذج الأقل تكلفة الذي يجتاز تقييماتك: يشرح اختيار بين Opus وSonnet وHaiku كيفية اختبار ذلك بطريقة صحيحة.

التخزين المؤقت للمطالبات يقلل تكلفة الجزء المتكرر

بادئة بطول 4,000 رمز هي نفسها في كل طلب، وتدفع تكلفتها الكاملة ضمن سعر الإدخال في كل مرة. يخزّن التخزين المؤقت للمطالبة البادئة بعد معالجتها، ويطبّق سعراً مخفّضاً عند إعادة استخدامها.

تبلغ تكلفة قراءة ذاكرة التخزين المؤقت 0.1 من سعر الإدخال الأساسي. أما كتابة الذاكرة المؤقتة فتكلّف 1.25 من السعر الأساسي طوال مدة الصلاحية البالغة 5 دقائق، أو 2 من السعر الأساسي طوال مدة الصلاحية البالغة 1 ساعة. لذلك تغطي ذاكرة التخزين المؤقت لمدة 5 دقائق تكلفتها بعد قراءة واحدة، لأن الكتابة تكلّف 0.25 إضافية، بينما توفّر كل قراءة 0.9. وتحتاج ذاكرة التخزين المؤقت لمدة 1 ساعة إلى قراءتين لتحقيق نقطة التعادل.

أبسط طريقة لتفعيلها هي إضافة حقل واحد في المستوى الأعلى:

curl https://api.anthropic.com/v1/messages \
  -H "content-type: application/json" \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-opus-5",
    "max_tokens": 1024,
    "cache_control": {"type": "ephemeral"},
    "system": "You are a helpful assistant.",
    "messages": [
      {"role": "user", "content": "What are the key themes in Pride and Prejudice?"}
    ]
  }'

ثم اقرأ كتلة usage التي تعود في الاستجابة:

{
  "usage": {
    "cache_creation_input_tokens": 5120,
    "cache_read_input_tokens": 1800,
    "input_tokens": 50,
    "output_tokens": 503
  }
}

تُحاسَب عدادات الإدخال الثلاثة هذه وفق 3 أسعار مختلفة، ويشكّل مجموعها حجم الإدخال الفعلي لديك: total_input_tokens = cache_read_input_tokens + cache_creation_input_tokens + input_tokens. سيكون تقدير التكلفة الذي يقرأ input_tokens فقط خاطئاً بدرجة كبيرة بعد تفعيل التخزين المؤقت.

هناك أمران يمنعان التخزين المؤقت من تغطية تكلفته، ويفشلان كلاهما بصمت.

يجب أن تكون البادئة متطابقة على مستوى البايتات. يبحث التخزين المؤقت عن تطابق للبادئة، لذلك يؤدي وجود طابع زمني أو اسم المستخدم في بداية مطالبة النظام إلى تغييرها في كل طلب. عندها تدفع 1.25 من سعر الإدخال الأساسي في كل مرة، ولا تجري أي قراءة من الذاكرة المؤقتة. وتتمثل العلامة على ذلك في بقاء cache_creation_input_tokens مرتفعاً، بينما يبقى cache_read_input_tokens عند 0. ضع cache_control في آخر كتلة يظل محتواها متطابقاً بين الطلبات، وضع كل ما يتغير بعدها. يؤدي تغيير تعريفات tools إلى إبطال ذاكرة التخزين المؤقت بأكملها أسفلها، لأن الإبطال ينتقل وفق ترتيب الأدوات، ثم النظام، ثم الرسائل.

يجب أن تكون البادئة طويلة بما يكفي. الحد الأدنى للطول القابل للتخزين المؤقت هو 512 رمزاً في Opus 5، و1,024 في Sonnet 5، و4,096 في Haiku 4.5. لا تُخزَّن المطالبة الأقصر مؤقتاً، ولا تُعاد أي رسالة خطأ. تُخزَّن البادئة البالغ طولها 4,000 رمز في المثال السابق مؤقتاً في Sonnet 5، ولا تُخزَّن في Haiku 4.5، لأن 4,000 أقل من الحد الأدنى لذلك النموذج. عندما تكون قراءتا العدادين عند 0، فهذا يعني أنه لم تُخزَّن أي بيانات مؤقتاً.

المعالجة الدفعية تخفض التكلفة إلى النصف

تعالج Batch API الطلبات بشكل غير متزامن، مع خصم بنسبة 50 percent على كل من الإدخال والإخراج. في المثال أعلاه، يحوّل ذلك التكلفة من $12.60 لكل 1,000 طلب إلى $6.30. يتراكم هذا الخصم مع التخزين المؤقت للمطالبات، لذلك تُعد المهمة الدفعية المخزنة مؤقتاً أرخص طريقة لتنفيذ الأعمال المجمعة.

ما تتنازل عنه هو زمن الاستجابة، ولذلك لا تناسب المعالجة الدفعية أي مهمة ينتظر الشخص نتيجتها. وهي مناسبة للتصنيف الليلي واستكمال معالجة المستندات.

لماذا ترتفع تكلفة الدردشة داخل محادثة واحدة

لأن API لا يحتفظ بالحالة، يعيد عميلك إرسال المحادثة كاملة مع كل دور. لذلك يزداد استخدام الرموز داخل الدردشة وفق مربع طولها، وليس بشكل خطي.

لنفترض أن متوسط كل دور هو 500 رمز. يرسل الدور 1 عدد 500 من رموز الإدخال. ويرسل الدور 2 عدد 1,000. أما الدور 20 فيرسل 10,000. وباستخدام الصيغة n(n+1)/2، تكون محادثة من 20 دوراً قد أرسلت نحو 105,000 من رموز الإدخال، في حين أن نص المحادثة نفسه لا يتجاوز 10,000 رمز.

لهذا تكون تكلفة ميزة الدردشة أعلى مما يوحي به نص المحادثة، ولهذا يفيد تخزين البادئة الثابتة مؤقتاً أو تلخيص الأدوار الأقدم في السلاسل الطويلة. ويتبع الوكيل الذي يكرر استدعاءات الأدوات النمط نفسه، لكن بصورة أسوأ: تظل نتيجة كل أداة في السجل، ويُعاد إرسالها مع كل دور لاحق. ويكتسب وضع حد صارم للإنفاق على وكيل تشغّله بنفسك أهمية أكبر هنا، لأن هذا النمو يحدث تلقائياً ولا يراقبه أحد.

احسب عدد الرموز قبل أن تخمّن

توقّف عن اشتقاق عدد الرموز من عدد الكلمات. تحسبها واجهة API نيابةً عنك مجاناً، ضمن حد معدل منفصل عن إنشاء الرسائل.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "content-type: application/json" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-opus-5",
    "system": "You are a scientist",
    "messages": [{
      "role": "user",
      "content": "Hello, Claude"
    }]
  }'

تحتوي الاستجابة على حقل واحد:

{ "input_tokens": 14 }

أرسل إليها مطالبة النظام الفعلية وتعريفات الأدوات، مع رسالة مستخدم تمثيلية، ثم ضع الرقم في دالة التكلفة أعلاه. تستخدم نقطة النهاية نص الطلب نفسه المستخدم في طلب الرسالة، لذلك تُحتسب الصور وملفات PDF بشكل صحيح أيضاً. هناك نقطتان مهمتان. العدد تقديري وقد يختلف قليلاً عن الرقم المفوتر. كما يُقاس باستخدام محلّل الرموز الخاص بالنموذج الذي تمرّره، لذلك مرّر النموذج الذي ستشغّله فعلياً.

لا يمكن حساب رموز المخرجات مسبقاً، لأنها غير موجودة بعد. حدّد سقفها باستخدام max_tokens، ثم قِس التوزيع الفعلي من usage.output_tokens على حركة البيانات الحية.

ما الذي يُضاف إلى الفاتورة

تشكل الـtokens معظم الفاتورة. لكن هناك بعض البنود التي لا تُحتسب كـtokens، وقد تفاجئك.

  • تتحول تعريفات الأدوات إلى input tokens في كل طلب. وتضيف system prompt الخاصة بنظام استخدام الأدوات وحدها من 286 إلى 406 tokens في Opus 5، قبل احتساب schemas الخاصة بك. وقد تؤدي عشرة أوصاف مطوّلة للأدوات إلى مضاعفة prompt صغيرة.
  • تُحتسب Web search بسعر $10 لكل 1,000 عملية بحث، إضافة إلى tokens التي تستهلكها النتائج عند إدراجها في السياق.
  • لا تفرض Web fetch رسوماً مستقلة، لكن الصفحة التي تجلبها تتحول إلى input tokens. وتحتوي صفحة توثيق بحجم 100 kB على نحو 25,000 منها.
  • يؤدي طلب تنفيذ inference في الولايات المتحدة فقط باستخدام inference_geo على Claude 4.6 والإصدارات الأحدث إلى تطبيق معامل 1.1 على كل فئة من فئات الـtokens، بما في ذلك cache reads وcache writes.

يعتمد تحديد ما إذا كانت API هي الخيار المناسب للشراء أصلاً على حجم استخدامك. عادةً ما يؤدي بلوغ حد الاستخدام في إحدى الخطط إلى طرح هذا السؤال، وتتراوح الخيارات المتاحة بعد بلوغ الحد بين انتظار انتهاء الفترة ونقل ذلك العمل إلى استدعاءات API محسوبة حسب الاستخدام. وتكون الخطة الشهرية ذات السعر الثابت أفضل بوضوح تحت مستوى معين من الاستخدام، بينما تجري مقارنة API باشتراك Claude هذه المقارنة باستخدام أرقام فعلية.

FAQ

كم تبلغ تكلفة 1M من الرموز المميزة في Claude؟

يعتمد ذلك على النموذج، وعلى ما إذا كانت الرموز المميزة للإدخال أو للإخراج. اعتباراً من August 2026، تبلغ تكلفة مليون رمز مميز للإدخال $1 على Claude Haiku 4.5، و$2 على Claude Sonnet 5 وفق التسعير التمهيدي، و$5 على Claude Opus 5. تبلغ تكلفة الإخراج خمسة أضعاف سعر الإدخال في كل نموذج من هذه النماذج. ينتقل Sonnet 5 في 1 September 2026 إلى $3 للإدخال و$15 للإخراج. تتغير الأسعار، لذلك تحقّق منها في صفحة التسعير الرسمية قبل اعتماد رقم في الميزانية.

هل تعادل 1M من الرموز المميزة 1M من الكلمات؟

لا. يتكوّن الرمز المميز الواحد تقريباً من 4 أحرف باللغة الإنجليزية، أو نحو 0.75 كلمة، لذلك يعادل مليون رمز مميز نحو 750,000 كلمة. هذه النسبة تقديرية فقط. يستهلك كل من Code وJSON واللغات غير الإنجليزية رموزاً مميزة أكثر لكل كلمة. يستخدم Claude Opus 4.7 والإصدارات الأحدث أيضاً أداة تقسيم إلى رموز مميزة أحدث، وتنتج نحو 30 بالمئة من الرموز المميزة الإضافية للنص نفسه مقارنةً بـ Claude Sonnet 4.6 والإصدارات الأقدم، لذلك لا يمكن نقل الأعداد مباشرةً بين أجيال النماذج. قِس باستخدام نقطة النهاية المجانية /v1/messages/count_tokens، مع تمرير النموذج الذي تخطط لتشغيله.

هل يوفر تخزين المطالبات مؤقتاً المال دائماً؟

لا. تكلّف كتابة ذاكرة التخزين المؤقت لمدة 5 دقائق 1.25 ضعف سعر الإدخال الأساسي، لذلك تكون تكلفة السابقة التي تُكتب ولا تُقرأ أبداً أعلى بنسبة 25 بالمئة من إرسالها دون تخزين مؤقت. ويبدأ التخزين المؤقت في تحقيق جدواه من أول قراءة. ويفشل ذلك بطريقتين، وكلتاهما تحدثان بصمت. إذا تغيّرت السابقة المخزنة مؤقتاً بين الطلبات، فلن تتطابق عملية البحث أبداً، لأن المطابقة تكون للسابقة نفسها تماماً. وإذا كانت السابقة أقصر من الحد الأدنى الذي يمكن للنموذج تخزينه مؤقتاً، وهو 1,024 رمزاً مميزاً على Sonnet 5 و4,096 على Haiku 4.5، فلن يُخزَّن شيء مؤقتاً ولن يُعاد أي خطأ. عندما تكون قيمتا cache_creation_input_tokens وcache_read_input_tokens كلتاهما 0، فلا ينفّذ التخزين المؤقت أي شيء.

لماذا نمت فاتورتي أسرع من عدد رسائلي؟

لأن المحادثة كاملة تُرسل من جديد في كل دور. لا تحتفظ Messages API بالحالة، لذلك يرسل الدور 20 من المحادثة جميع الأدوار السابقة وعددها 19 مرة أخرى كإدخال. عندما يبلغ متوسط كل دور 500 رمز مميز، ترسل محادثة من 20 دوراً نحو 105,000 رمز مميز للإدخال، رغم أن نص المحادثة لا يتجاوز 10,000 رمز مميز. تعمل حلقات الوكلاء بالطريقة نفسها، لأن نتيجة كل أداة تبقى في السجل. خزّن السابقة الثابتة مؤقتاً، أو لخّص الأدوار الأقدم واحذفها من الطلب.