SSD Nodes Learn 8GB RAM — $66/سنة
الأدلة Matt Connorبقلم Matt Connor · آخر تحديث في 2026-08-01

هل يمكنك استضافة Claude ذاتيًا؟ الإجابة الصادقة

لا تنشر Anthropic أوزان Claude، لذلك لا يمكنك تشغيله على خادمك. تعرّف إلى البدائل القابلة للاستضافة ذاتيًا: نماذج مفتوحة، بوابة API، وClaude Code.

هل يمكنك استضافة Claude ذاتيًا؟ لا، وإليك السبب

لا يمكنك استضافة Claude ذاتيًا. لا تنشر Anthropic أوزان النموذج، لذلك لا يوجد ملف لتنزيله، ولا حاوية لتشغيله، ولا ترخيص يتيح لك تقديمه من أجهزتك الخاصة. يذهب كل طلب إلى Claude إلى واجهة API الخاصة بـ Anthropic أو إلى شريك مستضاف مثل Amazon Bedrock أو Google Vertex AI أو Microsoft Foundry. تشغيله على جهاز تملكه ليس مشكلة إعداد. فالمكوّن ببساطة غير موجود خارج Anthropic.

هذه هي الإجابة المختصرة. أما الإجابة الأطول، فهي أن معظم من يطرحون هذا السؤال لا يريدون الأوزان فعليًا. إنهم يريدون واحدًا من ثلاثة أشياء يمكن تحقيقها جميعًا على خادم تتحكم فيه: نموذجًا قادرًا يعمل محليًا، أو بوابة تحتفظ بمفاتيح API الخاصة بهم وتضع حدًا لإنفاقهم، أو وكيلًا للبرمجة يعمل على جهازهم الخاص بدلًا من حاسوبهم المحمول. يغطي هذا الدليل الخيارات الثلاثة، مع الأوامر.

ما المقصود عادةً بـ "Claude مستضاف ذاتيًا"

تنقسم عمليات البحث عن "Claude مستضاف ذاتيًا" إلى عدة احتياجات مختلفة، ولكل منها إجابة مختلفة.

يريد بعض الأشخاص الخصوصية. ولا يريدون أن تغادر المطالبات شبكتهم. لا يحل هذه المشكلة سوى نموذج محلي مفتوح الأوزان، لأن أي طلب إلى Claude هو بحكم التعريف طلب إلى Anthropic.

يريد بعض الأشخاص التحكم في التكاليف. ويخشون أن يستهلك وكيل غير مضبوط أرصدة كثيرة. تحل البوابة هذه المشكلة، وهي تعمل مع Claude، لذلك تحافظ على جودة النموذج.

يريد بعض الأشخاص الاستقلال عن الحاسوب المحمول. ويريدون وكيلًا يواصل العمل أثناء إغلاق الغطاء. يحل VPS هذه المشكلة، ويعمل Claude Code عليه بسلاسة.

يريد بعض الأشخاص عبارة "OpenRouter مستضاف ذاتيًا". وهذه بوابة أيضًا، والإجابة المعتادة هي LiteLLM.

حدد الفئة التي تنتمي إليها، لأن البنية المناسبة تختلف في كل حالة.

استضافة نموذج مفتوح على خادمك باستخدام Ollama

إذا كان الشرط هو ألا يغادر أي موجّه خادمك، فشغّل نموذجًا مفتوح الأوزان. عائلات النماذج القابلة للاستخدام فعليًا على خادم مستأجر اليوم هي Llama وQwen وMistral وGemma وDeepSeek. تنشر جميعها الأوزان التي يمكنك تنزيلها وتشغيلها.

Ollama هو أسرع مدخل إلى ذلك. يتكون برنامج التثبيت من سطر واحد، ويُعدّ خدمة systemd على Ubuntu.

curl -fsSL https://ollama.com/install.sh | sh
systemctl status ollama

يجب أن يطبع systemctl status ollama القيمة active (running). بعد ذلك، نزّل نموذجًا وتحدث إليه.

ollama pull qwen3:8b
ollama run qwen3:8b "Summarise what a reverse proxy does in two sentences."

ينزّل أول pull عدة غيغابايت، لذلك يجب أن يتسع النموذج في ذاكرة RAM أو ذاكرة GPU قبل أن يتمكن من الإجابة عن أي شيء. القاعدة التقريبية للنماذج المكمّمة هي أن النموذج الذي يحتوي على 8 مليارات معلَمة يحتاج إلى نحو 6 GB من الذاكرة الحرة، والنموذج الذي يحتوي على 14 مليار معلَمة يحتاج إلى نحو 10 GB، أما النموذج الذي يحتوي على 70 مليار معلَمة فيحتاج إلى ذاكرة أكبر مما توفره معظم خطط VPS العامة. إذا كانت ذاكرة الخادم غير كافية، تنهي النواة العملية، وتظهر لك Error: llama runner process has terminated، مع سطر يفيد بنفاد الذاكرة في dmesg. تحقّق من free -h قبل إلقاء اللوم على النموذج.

يوفر Ollama أيضًا واجهة HTTP API على 127.0.0.1:11434، وهذا ما يجعله مفيدًا للبرامج الأخرى، وليس مجرد أداة دردشة.

curl http://127.0.0.1:11434/api/generate -d '{"model":"qwen3:8b","prompt":"ping","stream":false}'

اترك هذا المنفذ مرتبطًا بـ localhost. يمثّل منفذ Ollama المفتوح على عنوان IP عام وحدة GPU مجانية لأي شخص يعثر عليه. يشرح الدليل الخاص بتشغيل Ollama على VPS الإعداد الكامل، بما في ذلك وحدة systemd واكتشاف GPU ووضع reverse proxy أمام الخدمة. إذا كنت تخدم أكثر من مستخدم واحد في الوقت نفسه، فاقرأ أولًا مقارنة Ollama وvLLM، لأن تصميم Ollama ذي التدفق الواحد يصبح عنق الزجاجة قبل وقت طويل من وصول العتاد إلى حدوده.

كن صريحًا بشأن الفارق. يكون النموذج المفتوح الجيد على VPS متوسط الموارد مفيدًا فعلًا للتلخيص والتصنيف وإعداد المسودات والاستخراج البسيط. لكنه لا يقترب من نموذج مستضاف رائد في الاستدلال الطويل متعدد الخطوات، أو العمل على قواعد الشيفرة الكبيرة، أو استخدام الأدوات بطريقة وكيلية، ولا يمكن لأي قدر من ضبط الموجّهات أن يسد هذا الفارق. اختر النموذج المحلي للمهام التي يجيدها، وادفع مقابل النموذج المستضاف عندما تكون الصعوبة حقيقية.

شغّل بوابتك الخاصة باستخدام LiteLLM

هذه هي «OpenRouter المستضاف ذاتيًا» التي يبحث عنها المستخدمون. تقع البوابة بين تطبيقاتك وكل مزوّد نماذج. تستخدم تطبيقاتك مفتاحًا واحدًا موجّهًا إلى خادمك. وتبقى مفاتيح المزوّد الحقيقية على ذلك الخادم فقط. يمكنك تحديد الإنفاق لكل مفتاح، وتوجيه التطبيقات المختلفة إلى نماذج مختلفة، وتسجيل كل طلب في مكان واحد.

يُعد LiteLLM الخيار الشائع لأنه يوفّر واجهة API متوافقة مع OpenAI، ويعمل كوكيل لـ Anthropic وOllama ومعظم المزوّدين الآخرين من خلال نقطة نهاية واحدة. شغّله في Docker باستخدام ملف إعدادات.

model_list:
  - model_name: claude
    litellm_params:
      model: anthropic/claude-sonnet-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local
    litellm_params:
      model: ollama/qwen3:8b
      api_base: http://127.0.0.1:11434

احفظ ذلك باسم litellm_config.yaml ثم ابدأ الوكيل. وهو يستمع على المنفذ 4000.

docker run -v $(pwd)/litellm_config.yaml:/app/config.yaml \
  -e ANTHROPIC_API_KEY=$ANTHROPIC_API_KEY \
  -e LITELLM_MASTER_KEY=sk-1234 \
  -p 4000:4000 docker.litellm.ai/berriai/litellm:latest \
  --config /app/config.yaml

يمثل LITELLM_MASTER_KEY بيانات اعتماد المسؤول، لذا تعامل معه مثل كلمة مرور root، ولا تستخدم القيمة التوضيحية في بيئة الإنتاج. استدعِ الوكيل بالطريقة نفسها التي تستدعي بها API مستضافة.

curl http://localhost:4000/v1/chat/completions \
  -H 'Authorization: Bearer sk-1234' \
  -H 'Content-Type: application/json' \
  -d '{"model": "claude","messages": [{"role": "user","content": "Say hello in five words."}]}'

تكون الاستجابة السليمة بصيغة JSON عادية وتحتوي على مصفوفة choices. وتعني 401 أن ترويسة Authorization لا تطابق مفتاحك الرئيسي. ويعني ظهور اسم النموذج في 400 أن model في طلبك لا يطابق أي model_name في ملف الإعدادات.

السبب في بناء ذلك بدلًا من استدعاء Anthropic مباشرة هو تحديد الإنفاق. أنشئ مفتاحًا افتراضيًا منفصلًا لكل تطبيق، مع ميزانيته الخاصة.

curl 'http://0.0.0.0:4000/key/generate' \
--header 'Authorization: Bearer sk-1234' \
--header 'Content-Type: application/json' \
--data-raw '{"models": ["claude"], "max_budget": 100}'

يمكن لهذا المفتاح إنفاق مئة دولار والوصول إلى نموذج واحد، ولا شيء آخر. عندما يتصرف وكيل بطريقة غير صحيحة في الساعة الثالثة صباحًا، يقتصر نطاق الضرر على مفتاح واحد بدلًا من حسابك بالكامل. هذا النمط، إلى جانب المراقبة المرتبطة به، هو موضوع الحفاظ على تكاليف الوكلاء تحت السيطرة على VPS. وإذا كنت لا تزال تقرر ما إذا كنت ستدفع مقابل كل رمز مميز أصلًا، فإن مقارنة تكلفة API بالاشتراك تشرح الحسابات اللازمة.

لاحظ ما لا تفعله البوابة. فهي لا تجعل Claude محليًا، ولا تخفي مطالباتك عن Anthropic. تظل الطلبات تغادر خادمك إلى المزوّد. وما تحصل عليه هو التحكم في المفاتيح والإنفاق والتوجيه والسجلات.

تشغيل Claude Code على خادم VPS خاص بك

الأمنية الثالثة هي الأسهل تحقيقًا. Claude Code هو عميل. يعمل حيثما تثبّت Node.js، ويتصل بواجهة API عبر HTTPS. تشغيله على خادم تملكه يعني أن الوكيل يواصل العمل بعد إيقاف تشغيل حاسوبك المحمول. ويعني أيضًا أن نطاق تأثير الوكيل يقتصر على جهاز يمكنك إعادة بنائه بدلًا من جهازك الرئيسي.

npm install -g @anthropic-ai/claude-code
claude --version

شغّله داخل tmux حتى لا يؤدي انقطاع اتصال SSH إلى إيقاف مهمة طويلة. يوضّح تشغيل Claude Code على خادم VPS باستخدام tmux هذا الإعداد، بما في ذلك إدارة الجلسات. خصّص للوكيل مستخدمًا غير مميّز. واقرأ قواعد الأمان لتشغيل Claude Code على خادم قبل منحه صلاحية الكتابة إلى أي شيء مهم بالنسبة إليك.

هذا استضافة ذاتية للوكيل، وليس للنموذج. من المهم توضيح ذلك، لأن الناس يخلطون بين الأمرين. أنت تملك العملية، ونظام الملفات، وخروج الشبكة، والسجلات. أما Anthropic فما زالت تملك الاستدلال.

ما الذي تكلّفك إياه كل نسخة فعليًا

تتغير الأسعار، لذا تعامل مع هذه الأرقام باعتبارها تصورًا عامًا لا عرضًا سعريًا. اعتبارًا من July 2026، يبلغ سعر Claude Sonnet 5 مقدار $3 لكل مليون رمز إدخال و$15 لكل مليون رمز إخراج، بينما يبلغ سعر Claude Opus 5 مقدار $5 و$25. لا يفرض النموذج المحلي تكلفة لكل رمز، بل يفرض تكلفة الخادم الشهرية، سواء استخدمته أم لا.

نقطة التعادل أقل مما يتوقعه الناس. تكلف VPS بذاكرة كافية لتشغيل نموذج مفتوح مفيد أموالًا حقيقية كل شهر، ويبقى خاملاً معظم الوقت. إذا كان استخدامك متقطعًا، تكون واجهة API المستضافة أرخص عادةً. وإذا كان استخدامك مستمرًا، أو إذا كانت بياناتك لا يمكن أن تغادر شبكتك، يتفوق النموذج المحلي في كلا الأمرين.

الإجابة العملية المختلطة هي ما تستقر عليه معظم الفرق. شغّل نموذجًا مفتوحًا محليًا للمهام الكثيرة ومنخفضة الصعوبة. وجّه الطلبات الصعبة إلى نموذج متقدم مستضاف. ضع بوابة أمام كليهما حتى لا تحتاج التطبيقات إلى معرفة أيهما مستخدم، وحتى تتمكن من تغيير الحد الفاصل بينهما دون تعديل شفرة التطبيق. هذه البنية هي التطبيق العملي لفكرة "Claude مستضاف ذاتيًا"، وبخلاف التطبيق الحرفي للفكرة، فهي موجودة. وإذا أردت تشغيل حزمة الوكيل بالكامل بنفسك أيضًا، فتغطي المراجعة الشاملة لوكلاء الذكاء الاصطناعي المستضافين ذاتيًا ما هو متاح.

FAQ

هل يمكنني تنزيل أوزان نموذج Claude وتشغيله محليًا؟

لا. لم تُصدر Anthropic أوزانًا لأي نموذج من نماذج Claude، ولا توجد رخصة تسمح بالاستضافة الذاتية. أي شيء يُعلن عنه عبر الإنترنت بوصفه "نموذج Claude" قابلًا للتنزيل هو إما نموذج مختلف يحمل اسمًا مضللًا، أو غلاف يستدعي API. إذا كان يتطلب مفتاح API، فهو ليس محليًا.

ما النموذج المفتوح الأقرب إلى Claude؟

لا يوجد تطابق تام، وتتغير النماذج الرائدة كل بضعة أشهر. تستحق عائلات الأوزان المفتوحة Llama وQwen وMistral وGemma وDeepSeek الاختبار. في التلخيص والتصنيف وتعديلات التعليمات البرمجية البسيطة، يكون النموذج المفتوح الجيد الذي يضم 8 إلى 14 مليار معلمة مفيدًا فعلًا. أما في الاستدلال متعدد الخطوات على النصوص الطويلة واستخدام الأدوات القائم على الوكلاء، فلا تزال الفجوة كبيرة مقارنةً بنموذج رائد مستضاف. اختبر النماذج باستخدام مطالباتك الخاصة بدلًا من الاعتماد على لوحة ترتيب.

هل يُعد LiteLLM نسخة مستضافة ذاتيًا من OpenRouter؟

نعم، من الناحية الوظيفية في جانب التوجيه وإدارة المفاتيح. يعمل LiteLLM على خادمك، ويقدم نقطة نهاية واحدة متوافقة مع OpenAI، ويمرر الطلبات إلى Anthropic وOllama ومعظم موفري الخدمات الآخرين. تحصل على حدود إنفاق لكل مفتاح، وتوجيه للنماذج، ومكان واحد لقراءة السجلات. لكنه لا يوفر الاستدلال المحلي: فلا تزال الطلبات الموجهة إلى Claude تنتقل إلى Anthropic.

هل يؤدي تشغيل Claude Code على خادمي الخاص إلى إبقاء التعليمات البرمجية الخاصة بي سرية؟

لا. يرسل Claude Code محتويات الملفات التي يقرأها إلى Anthropic API، أيًا كان المكان الذي تعمل فيه العملية. ما يوفره VPS هو عزل الوكيل، وليس خصوصية المحتوى. خصص له مستخدمًا مخصصًا غير متمتع بامتيازات root، وأبعده عن بيانات الاعتماد والمستودعات غير المرتبطة، وتعامل مع كل ما يمكنه قراءته على أنه محتوى يغادر الخادم.