SSD Nodes Learn 8GB RAM — $66/سنة
الأدلة Matt Connorبقلم Matt Connor · آخر تحديث في 2026-08-01

كيف تتعلم وكلاء الذكاء الاصطناعي من الصفر؟

اتبع مسارًا من ست مراحل لتعلّم وكلاء الذكاء الاصطناعي: المفاهيم، حلقة تكتبها بنفسك، الأدوات، الذاكرة، تصميم الحلقة، والأمان، مع مشروع عملي في كل مرحلة.

المسار عبر ست مراحل

لتعلّم وكلاء الذكاء الاصطناعي من الصفر، ادرس ست مراحل بالترتيب: المفاهيم، وحلقتك الأولى، والأدوات، والذاكرة، وتصميم الحلقة، والأمان. في كل مرحلة تبني شيئًا واحدًا بيديك. تجاوز المراحل هو السبب الأكثر شيوعًا لتعثر المتعلمين، لأن إطار العمل يخفي بالضبط الجزء الذي تحتاج إلى رؤيته.

وكيل الذكاء الاصطناعي هو حلقة حول نموذج لغوي يُسمح له باستدعاء الأدوات. هذه الجملة تلخص الموضوع كله. وكل ما يأتي بعدها هو تفاصيل حول ما يدخل في الحلقة، وما يمكن للأدوات الوصول إليه، وكيف توقف الحلقة عندما تسوء الأمور. إذا استطعت شرح الحلقة لشخص آخر، فقد تعلمت الموضوع. أما إذا كنت لا تستطيع سوى تسمية أطر العمل، فلم تتعلمه بعد.

تفترض الخطة أدناه أنك تتعلم من خلال البناء. اقرأ مرحلة، وابنِ الشيء الصغير، وتعمد تعطيله، ثم انتقل إلى المرحلة التالية. المرحلة التي قرأتها فقط هي مرحلة لم تنفذها.

ما تحتاج إليه فعليًا قبل المرحلة 1

قائمة المتطلبات الأساسية الفعلية قصيرة، وأقصر مما توحي به معظم صفحات الدورات.

  • يمكنك قراءة Python أو TypeScript وكتابتهما بمستوى يسمح بإنشاء script من خمسين سطرًا.
  • تتعامل مع Linux shell بثقة: تثبّت حزمة، وتحرّر ملفًا، وتقرأ سجلًا.
  • لديك API key لنموذج مستضاف، أو جهاز يمكنه تشغيل نموذج محلي.

هذه هي القائمة كاملة. لا تحتاج إلى نظرية تعلّم الآلة، ولا تحتاج إلى أن تكون قد درّبت نموذجًا. لا يتضمن عمل الوكلاء التدرجات أو بيانات التدريب. لا تصبح بطاقة الرسومات مهمة إلا إذا قررت تشغيل النموذج بنفسك، وهذه مهارة منفصلة يمكنك اكتسابها لاحقًا من استضافة Ollama على VPS لتشغيل LLM ذاتيًا.

ما يستهين به الناس هو جانب shell. تفشل الوكلاء بسبب الأذونات، والمسارات، ومتغيرات البيئة، والعمليات التي تتوقف بصمت. إذا كان تتبع المكدس المتعلق بـ PATH أو وضع ملف يجعلك تغلق الطرفية، فاقضِ عطلة نهاية أسبوع في تعلّم أساسيات Linux أولًا. سيوفر عليك ذلك شهرًا من العمل لاحقًا.

المرحلة 1: ما هو الوكيل وما ليس هو

ابدأ باستدعاء API واحد ومن دون حلقة تكرار. أرسل مطالبة، واطبع الرد، وانظر إلى أعداد الرموز المميزة في الاستجابة. أصبحت الآن تفهم وحدة التكلفة ووحدة زمن الاستجابة.

بعد ذلك تعلّم استخدام الأدوات، وهي الفكرة الجديدة الوحيدة فعليًا في هذا المجال بأكمله. صِف دالة للنموذج باستخدام اسم ووصف ومخطط JSON (ترميز كائنات JavaScript) لمدخلاتها. لا ينفّذ النموذج أي شيء. بل يرد بطلب منظم: استدعِ run_command بهذه الوسائط. يشغّل برنامجك الدالة، ويرسل الناتج مرة أخرى في رسالة، ثم يطلب من النموذج الرد مجددًا. النموذج مخطِّط يقرأ النص ويكتب النص. أما برنامجك فهو الذي ينفّذ الإجراءات.

تنتهي روبوتات الدردشة بعد رد واحد. يكرر الوكيل هذا التبادل إلى أن يتوقف النموذج عن طلب الأدوات. هذا التكرار هو الفرق بالكامل، ولذلك تختلف أنماط الفشل أيضًا. قد يقدم روبوت الدردشة إجابة خاطئة مرة واحدة. أما الوكيل فقد يتصرف استنادًا إلى إجابة خاطئة عدة مرات قبل أن يلاحظ أحد ذلك.

المرحلة 2: اكتب الحلقة بنفسك مرة واحدة

لا تبدأ بإطار عمل. اكتب نحو ثلاثين سطرًا من Python حتى يكون هيكل البرنامج من تصميمك.

sudo apt update && sudo apt install -y python3-venv
python3 -m venv ~/agent
source ~/agent/bin/activate
pip install anthropic
export ANTHROPIC_API_KEY=your-key-here
import subprocess
import anthropic

client = anthropic.Anthropic()

tools = [{
    "name": "run_command",
    "description": "Run a read only shell command and return its output.",
    "input_schema": {
        "type": "object",
        "properties": {"command": {"type": "string"}},
        "required": ["command"],
    },
}]

messages = [{"role": "user", "content": "How much disk space is free here?"}]

while True:
    response = client.messages.create(
        model="claude-opus-5",
        max_tokens=4096,
        tools=tools,
        messages=messages,
    )
    if response.stop_reason != "tool_use":
        break
    messages.append({"role": "assistant", "content": response.content})
    results = []
    for block in response.content:
        if block.type == "tool_use":
            done = subprocess.run(
                block.input["command"], shell=True,
                capture_output=True, text=True, timeout=10,
            )
            results.append({
                "type": "tool_result",
                "tool_use_id": block.id,
                "content": done.stdout or done.stderr,
            })
    messages.append({"role": "user", "content": results})

print(next(b.text for b in response.content if b.type == "text"))

شغّل البرنامج باستخدام python3 agent.py. يطبع التشغيل السليم فقرة واحدة تذكر أنظمة الملفات لديك ومساحتها الحرة، لأن النموذج طلب df -h، وشغّل الكود هذا الأمر، ثم حوّل المرور الثاني ذلك الجدول إلى جملة. إذا لم يطبع شيئًا، فقد انتهت الحلقة قبل وصول كتلة نصية. أضف print(response.stop_reason) داخل الحلقة، وراقب تغيّر القيم.

اكسر البرنامج عمدًا الآن. احذف السطر tool_use_id واقرأ الخطأ، لأن نتيجة الأداة التي لا تحتوي على معرّف مطابق ترفضها API، وهذا أكثر أخطاء المبتدئين شيوعًا. اطرح سؤالًا يحتاج إلى أمرين، وراقب الحلقة وهي تعمل مرتين. اطرح سؤالًا مستحيلًا، وراقبها إما وهي تستسلم أو تستمر إلى ما لا نهاية.

تحذير واحد بشأن هذا المثال. فهو يمرر مخرجات النموذج مباشرة إلى shell باستخدام shell=True. وهذا مقبول على جهاز تجريبي يمكنك إعادة بنائه، لكنه غير صحيح في أي مكان آخر. تعالج المرحلة 6 ذلك. تشرح بناء وكيل ذكاء اصطناعي خاص بك على VPS المفاهيم الموجودة أسفل الحلقة بمزيد من التفصيل.

المرحلة 3: الأدوات التي لم تكن متاحة للوكيل مسبقًا

تعمل أداة run_command، لكن الوكيل الحقيقي يحتاج إلى أدوات تتصل بخدمات خارج النظام: نظام للتذاكر، وقاعدة بيانات، ومستودع. لا يمكن توسيع النطاق بكتابة غلاف مخصص لكل خدمة ولكل وكيل.

يُعد بروتوكول سياق النموذج (MCP) الحل الذي استقر عليه القطاع. يوفّر خادم MCP مجموعة من الأدوات عبر وسيلة نقل قياسية، ويمكن لأي وكيل يدعم MCP استخدامها من دون تعليمات برمجية مخصصة للربط. خادم نظام الملفات المرجعي عبارة عن أمر واحد:

npx -y @modelcontextprotocol/server-filesystem /home/you/projects

يتطلب ذلك تثبيت Node، وتكون وسيطة الدليل هي المسار الوحيد الذي سيتعامل معه الخادم. هذا هو نموذج الأمان في أبسط صورة: يحدد الخادم النطاق، وليس النموذج. وجّه عميلًا إليه، وسيحصل وكيلك على إمكانات قراءة الملفات وكتابتها من دون أن تكتبها بنفسك. يوضّح تشغيل خوادم MCP على VPS لوكلاء برمجة الذكاء الاصطناعي كيفية تشغيل هذه الخوادم بطريقة صحيحة، ضمن حساب خدمة، مع شرح خيارات النقل.

الدرس من هذه المرحلة هو أن تصميم الأدوات هو العمل الحقيقي. الوصف الغامض يجعل النموذج يخمّن. والأداة التي تُرجع أربعين ألف محرف تفسد نافذة السياق. والأداة القادرة على حذف العناصر ستحذفها في النهاية.

المرحلة 4: الذاكرة، وهي في معظمها مجرد ملفات

يلجأ المبتدئون إلى قاعدة بيانات متجهية في هذه المرحلة. لا تفعل ذلك، على الأقل ليس بعد.

لا يملك الوكيل ذاكرة بين الاستدعاءات. تعيد إرسال المحادثة بأكملها في كل مرة، ولذلك تكلف الجلسة الطويلة أكثر في كل دور من الجلسة القصيرة. لذلك تنقسم الذاكرة إلى مشكلتين. الأولى هي ما يتسع له إطار السياق الآن. تدير ذلك من خلال التلخيص، وحذف مخرجات الأدوات القديمة، وتخزين البادئة الثابتة من المطالبة مؤقتًا، بحيث تدفع جزءًا من تكلفتها فقط. والثانية هي ما يبقى بعد إعادة التشغيل، وهذا هو التخزين.

بالنسبة إلى المشكلة الثانية، يتفوق ملف markdown عادي يستطيع الوكيل قراءته وكتابته على قاعدة بيانات متجهية في كل مشروع أول تقريبًا. امنحه ملفًا واحدًا، وحدد له التنسيق، واطلب منه قراءة ذلك الملف قبل البدء وتحديثه عندما يتعلم شيئًا. ستحصل على معظم الفائدة، ويمكنك فتح الملف ومعرفة ما يعتقده وكيلك. استخدم التضمينات والاسترجاع عندما تتوقف الملاحظات عن الاتساع داخل إطار السياق، وليس قبل ذلك.

المرحلة 5: الحلقة هي المنتج

بحلول هذه المرحلة، يمكنك إنشاء وكيل يعمل أثناء مراقبتك له. تتمثل المرحلة 5 في جعله يعمل عندما لا تراقبه.

تحدد أربعة أسئلة ما إذا كان من الآمن ترك وكيل يعمل دون إشراف. ما الذي يشغّله، حتى لا يعمل دون سبب. ما الحد الذي يعمل ضمنه، حتى يظل أثر الخطأ محدودًا. كيف تتحقق من النتيجة، لأن الوكيل الذي يصحح واجبه بنفسه ينجح دائمًا. ما الميزانية التي توقفه، سواء بعدد الرموز أو بمدة زمنية فعلية. إن تصميم هذه العناصر الأربعة عن قصد هو المنهج الموضح في هندسة الحلقة وما يشمله هذا التعريف.

التمرين: خذ وكيلك في المرحلة 2، وأسند إليه مهمة تتطلب أربع أو خمس خطوات، ثم أضف حدًا صارمًا لعدد التكرارات. بعد ذلك أزل الحد وراقب ما تفعله حلقة غير محدودة بفاتورة الرموز لديك. نفّذ ذلك مرة واحدة باستخدام ميزانية صغيرة، حتى لا تفعله بالخطأ باستخدام ميزانية كبيرة.

المرحلة 6: السلامة والأسرار والتكلفة

هذه المرحلة إلزامية، وهي الأخيرة فقط لأنك لن تدرك حجم الخطر قبل أن تبني شيئًا يعمل.

شغّل الوكيل باستخدام مستخدم غير مميّز مخصص له، وليس باستخدام root أو حسابك الخاص، حتى يقتصر نطاق الضرر على دليل بدلًا من الجهاز بالكامل. أبقِ بيانات الاعتماد خارج نطاق وصول النموذج، لأن أي شيء موجود في نافذة السياق يمكن إعادته ضمن استدعاء أداة، والحل هو استخدام رموز مميزة قصيرة العمر ومحددة النطاق خلف أداة مساعدة، كما هو موضح في إبعاد الأسرار عن وكلاء الذكاء الاصطناعي. ضع حدًا أقصى صارمًا للإنفاق، لأن الحلقة غير المراقبة تفرض تكلفة على كل تكرار دون أن يراقبها أحد، وتجد الحدود وآلية التجميع التي تحافظ على معقولية التكلفة في التحكم في تكلفة وكيل الذكاء الاصطناعي على VPS يعمل دائمًا.

تستحق التكلفة رقمًا محددًا. اعتبارًا من July 2026، تفرض Claude Opus 5 رسومًا قدرها $5 لكل مليون رمز مميز للإدخال و$25 لكل مليون رمز مميز للإخراج، ويمكن لوكيل كثير الرسائل يعيد إرسال محادثة متزايدة الحجم أن يمرر بضع مئات الآلاف من الرموز المميزة خلال مهمة واحدة. ويؤثر التخزين المؤقت للمطالبات، إلى جانب استخدام نموذج أصغر للخطوات الروتينية، في هذه الحسابات بدرجة أكبر بكثير من أي تعديل على المطالبة.

يندرج حقن المطالبات هنا أيضًا. إذا كان وكيلك يقرأ صفحة ويب أو متعقبًا للمشكلات أو صندوق وارد، فإن كاتب ذلك النص يكتب أيضًا تعليمات إلى وكيلك. الدفاع ليس مطالبة نظام أكثر ذكاءً. بل هو الحد الفاصل، لأن الوكيل الذي لا يستطيع حذف مستودع لا يمكن إقناعه بحذفه.

أي خريطة ينبغي أن تتبع؟

اختر منهجًا واحدًا وأكمله بدلًا من تجربة ستة مناهج. يُعد مستودع Microsoft ai-agents-for-beginners المجاني الأكثر اكتمالًا. وهو دورة من ثمانية عشر درسًا تجاوزت 70,000 نجمة حتى July 2026، ويتوافق بوضوح مع المراحل المذكورة أعلاه. تفيد قوائم مستودعات الوكلاء الرائجة في معرفة المشاريع الموجودة، لكنها أقل فائدة بكثير بوصفها منهجًا دراسيًا، لأن القائمة المرتبة حسب عدد النجوم تكون مرتبة حسب الشعبية لا حسب ترتيب التعليم.

عندما تريد مشروعًا حقيقيًا للتدرب عليه، يكون وكيل البرمجة أفضل هدف أول. فالملاحظات تصل فورًا، والأدوات واضحة، والتراجع عن الأخطاء سهل. يشرح تشغيل وكيل ذكاء اصطناعي للبرمجة على VPS العملية كاملة من البداية إلى النهاية. وإذا كنت تفضل دراسة أنظمة عاملة بدلًا من بنائها من الصفر، فتوضح المقارنة في أفضل وكلاء الذكاء الاصطناعي المستضافين ذاتيًا كيف تعالج عدة مشاريع الحلقة نفسها بطرق مختلفة.

ما المدة التي يستغرقها هذا؟

بالنسبة إلى من يبرمج بالفعل، يستغرق المرحلتان 1 و2 مساءً واحدًا. وتستغرق المرحلة 3 عطلة نهاية أسبوع، يُخصَّص معظمها لوصف الأدوات لا للبروتوكول. وتستغرق المرحلتان 4 و5 بضعة أسابيع من الاستخدام الفعلي، لأنك لا تعرف ما ينساه وكيلك إلا بمراقبته وهو ينسى. أما المرحلة 6 فلا تنتهي تمامًا، لأن كل قدرة جديدة تمنحها له تعيد فتحها.

يتيح شهران من الأمسيات المنتظمة لمعظم الأشخاص الوصول إلى وكيل عملي، محدود النطاق، ومفيد. أما من يستغرقون عامًا فعادةً ما يكونون ممن واصلوا القراءة بدلًا من البناء.

FAQ

هل أحتاج إلى معرفة التعلم الآلي لبناء وكيل ذكاء اصطناعي؟

لا. يتطلب بناء وكيل استدعاء نموذج عبر API وربط طلبات أدواته بدوال حقيقية، وهذا يُعد برمجة تطبيقات عادية. لن تتعامل مع التدريب أو التدرجات أو مجموعات البيانات. تعتمد قابلية وكيلك للعمل على تصميم مخططات الأدوات، ومعالجة الأخطاء، وأذونات Linux. تصبح نظرية التعلم الآلي مهمة فقط إذا انتقلت إلى الضبط الدقيق لنموذج، وهذا عمل مختلف وله متطلبات مختلفة.

هل أبدأ باستخدام إطار عمل مثل LangChain أو CrewAI؟

اكتب حلقة خام واحدة أولًا، ثم استخدم إطار عمل. يستبدل إطار العمل الأسطر الثلاثين في المرحلة 2 بكائن إعدادات. يكون ذلك ملائمًا بعد أن تعرف ما الذي استُبدل، لكنه يسبب الالتباس قبل ذلك. عندما يتصرف وكيلك بشكل غير صحيح، يجب أن تفهم قائمة الرسائل ونتائج الأدوات مباشرة. ويصبح ذلك أصعب بكثير إذا لم ترَ هذه العناصر من قبل. بعد كتابة حلقة واحدة بنفسك، يوفر لك إطار العمل الوقت بدلًا من إخفاء الآلية.

ما تكلفة تعلم وكلاء الذكاء الاصطناعي؟

أقل مما يتوقع معظم الناس، إذا وضعت حدًا للتكلفة. يكفيك مفتاح API مستضاف وVPS صغير لإكمال المراحل الست كلها. لا يكمن الخطر الحقيقي في السعر بالساعة، بل في حلقة غير محدودة تُصدر فواتير عن كل تكرار أثناء نومك. ضع حدًا صارمًا للإنفاق في حساب API الخاص بك منذ اليوم الأول، وأضف حدًا للتكرارات إلى كل حلقة تكتبها، واستخدم نموذجًا أقل تكلفة للخطوات الروتينية. يؤدي تشغيل النموذج محليًا إلى إلغاء تكلفة الرموز، لكنه يستبدلها بمتطلبات عتادية.

ما الفرق بين وكيل ذكاء اصطناعي وروبوت محادثة؟

يجيب روبوت المحادثة مرة واحدة. يكرر الوكيل دورة متتابعة: يطلب النموذج استخدام أداة، ويشغّلها كودك، وتعود النتيجة، ثم يقرر النموذج ما يجب فعله بعد ذلك. يتيح هذا التكرار للوكيل إكمال مهمة تتضمن عدة خطوات، وهو أيضًا سبب حاجة الوكلاء إلى حدود لا يحتاج إليها روبوتات المحادثة. تكون الإجابة الخاطئة من روبوت المحادثة فقرة سيئة. أما الإجابة الخاطئة من الوكيل فتكون فقرة سيئة، إضافة إلى أي إجراء اتخذه بناءً عليها.