SSD Nodes Learn Hosting plans →
मार्गदर्शक Matt Connorद्वारे Matt Connor · अपडेटेड 2026-08-26

2026 मधील सर्वोत्तम self-hosted AI agents कोणते?

OpenClaw, Hermes, Dify, OpenHands आणि Agent Zero यांची तुलना करा: प्रत्येकाचा सर्वोत्तम उपयोग, server गरजा आणि स्वतःच्या VPS वर सुरक्षितपणे चालवण्याची पद्धत जाणून घ्या.

2026 मधील सर्वोत्तम self-hosted AI agents थोडक्यात

2026 मधील सर्वोत्तम self-hosted AI agents मध्ये chat apps मधून वापरता येणाऱ्या personal assistant साठी OpenClaw, शक्य तितक्या लहान server वर त्याच कामासाठी Hermes Agent, language models वर आधारित applications तयार करणाऱ्या team साठी Dify, autonomous coding साठी OpenHands आणि agents स्वतःचे sub-agents सुरू करतात अशा general purpose framework साठी Agent Zero यांचा समावेश होतो. हे पाचही open source आहेत आणि हे पाचही तुमच्या नियंत्रणातील VPS वर चालतात. या आढाव्यात प्रत्येक tool कशासाठी आहे, त्याची रचना कशी आहे, server कडून त्याला कोणत्या आवश्यकता आहेत आणि प्रत्येक design मुळे तुमच्यावर किती security काम येते यांची तुलना केली आहे. त्यामुळे काहीही install करण्यापूर्वी योग्य tool निवडता येईल.

आम्ही यापैकी प्रत्येक tool प्रत्यक्ष servers वर चालवतो. खालील प्रत्येक section मध्ये त्या tool साठीच्या संपूर्ण setup आणि hardening guide ची link दिली आहे.

स्वतः होस्ट केलेला AI agent म्हणजे काय

AI agent म्हणजे language model भोवती तयार केलेला loop. Model परिस्थिती वाचतो, एक कृती निवडतो, तुमचा server ती कृती अंमलात आणतो आणि त्याचा परिणाम loop च्या पुढील फेरीसाठी input म्हणून वापरला जातो. या कृतींसाठी tools वापरली जातात: shell command चालवणे, file वाचणे किंवा लिहिणे, browser नियंत्रित करणे आणि API call करणे. संपूर्ण कार्यपद्धती समजून घ्यायची असल्यास, VPS वर स्वतःचा AI agent तयार करणे या मार्गदर्शकात loop, tools आणि memory सुरुवातीपासून समजावली आहेत. Web search ही सामान्यतः जोडली जाणारी सुविधा आहे. तुम्ही स्वतःचा SearXNG instance आधीच चालवत असल्यास, तो तुमच्या agent च्या search backend शी जोडू शकता. त्यामुळे तुमच्या queries खाजगी राहतात; परंतु agent आता कोणालाही लिहिता येणारी pages वाचू शकतो.

Self-hosted याचा अर्थ agent runtime, त्याची memory, tools आणि secrets दुसऱ्या platform वर न राहता तुमच्या स्वतःच्या server वर असतात. Language model स्वतः मात्र सामान्यतः hosted API द्वारे वापरला जातो, कारण सर्वात सक्षम models लहान server च्या memory मध्ये बसत नाहीत. त्याच VPS वर Ollama वापरून model उपलब्ध केल्यास तुम्ही पूर्णपणे local setup करू शकता. त्यासाठी सक्षम model चालवण्याइतकी RAM आवश्यक असते.

Agent self-host करण्याचे कारण म्हणजे नियंत्रण: तुमचा conversation history, files, API keys आणि agent चालवणारी प्रत्येक command तुमच्या मालकीच्या machine वरच राहते. सावधगिरी बाळगण्याचे कारणही हेच आहे. तुमच्या server वर commands चालवणारा agent तुम्ही त्याच्यावर घातलेल्या मर्यादांइतकाच सुरक्षित असतो. म्हणूनच खालील तुलना security posture ला दुय्यम मुद्दा न मानता स्वतंत्र आणि महत्त्वाचा निकष मानते.

एका ओळीत मांडलेले पाच agents

ChartFive self-hosted AI agents compared
The data behind this chart
[
  {
    "tool": "OpenClaw",
    "primary_use": "Personal assistant with full server access",
    "interface": "Chat apps (Telegram, WhatsApp, Slack, Discord)",
    "isolation_model": "One gateway process, on loopback by default",
    "ram_floor": "Small VPS; more if it drives a browser",
    "security_posture": "Safe network default; operator must harden the rest",
    "maturity": "380,000+ stars mid-2026; March 2026 CVE history"
  },
  {
    "tool": "Hermes Agent",
    "primary_use": "Lightweight personal assistant with memory",
    "interface": "Chat apps (Telegram, Discord)",
    "isolation_model": "Single process, runs fine under systemd",
    "ram_floor": "A $5 VPS is enough",
    "security_posture": "Connects outward only; no inbound port needed",
    "maturity": "New (February 2026), from Nous Research"
  },
  {
    "tool": "Dify",
    "primary_use": "LLM app platform for teams",
    "interface": "Web UI and API",
    "isolation_model": "Docker Compose stack of about six containers",
    "ram_floor": "2 GB free; 4 GB is comfortable",
    "security_posture": "Ships on plain HTTP port 80; needs TLS and a proxy in front",
    "maturity": "Established, fast release pace"
  },
  {
    "tool": "OpenHands",
    "primary_use": "Autonomous coding agent",
    "interface": "Web UI on port 3000",
    "isolation_model": "Per-task sandbox containers via the host Docker socket",
    "ram_floor": "4 GB",
    "security_posture": "Docker socket is root equivalent; run it on a disposable VPS",
    "maturity": "Established (formerly OpenDevin)"
  },
  {
    "tool": "Agent Zero",
    "primary_use": "General purpose multi-agent framework",
    "interface": "Web UI on port 50001",
    "isolation_model": "Subordinate agents in separate containers",
    "ram_floor": "2 GB to start",
    "security_posture": "Default run exposes the UI on every interface; bind it to loopback",
    "maturity": "Active, Docker-first"
  }
]

या तक्त्यातील दोन नमुने सुरक्षा कामाचा बहुतांश भाग ठरवतात. वैयक्तिक agents, OpenClaw आणि Hermes, chat apps द्वारे तुमच्यापर्यंत पोहोचतात. त्यामुळे ते बाहेरच्या दिशेने कनेक्शन करतात आणि inbound port ची मुळीच गरज नसते. वेब-केंद्रित साधने, Dify, OpenHands आणि Agent Zero, प्रत्येकी HTTP वर interface उपलब्ध करून देतात. या सर्व प्रकरणांत install केल्यानंतर सर्वप्रथम default network posture दुरुस्त करणे आवश्यक असते.

OpenClaw: सर्वाधिक सक्षम वैयक्तिक agent

OpenClaw हा तुम्ही स्वतःच्या server वर चालवणारा वैयक्तिक AI agent आहे. त्याच्याशी Telegram, WhatsApp, Slack किंवा Discord वरून संवाद साधता येतो. तो shell commands चालवू शकतो, browser नियंत्रित करू शकतो आणि तुमच्या files वाचू तसेच लिहू शकतो. त्यामुळे या यादीतील तो सर्वाधिक सक्षम tool आहे आणि तुमच्या machine मध्ये सर्वाधिक प्रवेश असलेला tool देखील आहे. तो MIT license अंतर्गत उपलब्ध आहे. 2026 च्या मध्यापर्यंत त्याला GitHub वर 380,000 पेक्षा जास्त stars मिळाले होते. त्यामुळे तो या platform वरील सर्वाधिक stars असलेल्या projects पैकी एक आहे. परिणामी, त्याच्याभोवतीचे ecosystem आणि community येथील इतर कोणत्याही agent पेक्षा खूप मोठे आहेत.

तुमचा निर्णय घेताना दोन तथ्ये लक्षात घ्या. पहिले, network बाजूची सुरुवात सुरक्षित असते. सर्वकाही नियंत्रित करणारी एकमेव process, म्हणजे gateway, default नुसार loopback address वर listen करते. त्यामुळे तुम्ही स्वतः expose करेपर्यंत ती internet वरून reachable नसते. दुसरे, या project चा वास्तविक security history आहे. March 2026 मध्ये चार दिवसांच्या आत नऊ security issues उघड करण्यात आले. त्यामध्ये critical privilege escalation flaw, CVE-2026-32922, याचा समावेश होता. या flaw ला 10 पैकी 9.9 rating देण्यात आली होती. OpenClaw चे security model hardening ची जबाबदारी तुमच्यावर, म्हणजे operator वर, ठेवते. यापैकी कोणतेही तथ्य OpenClaw टाळण्याचे कारण नाही. ते काळजीपूर्वक installation करण्याचे कारण आहे. हेच VPS वर OpenClaw सुरक्षितपणे चालवणे या मार्गदर्शिकेत step by step स्पष्ट केले आहे.

Hermes Agent: सर्वांत हलका वैयक्तिक agent

Hermes Agent हे Nous Research कडून आलेले साधन आहे. ते February 2026 मध्ये release झाले. त्यामुळे येथील साधनांमध्ये ते सर्वांत नवीन आहे. हा वैयक्तिक agent तुमच्या प्रकल्पांची persistent memory ठेवतो, काम करताना स्वतःच्या पुन्हा वापरता येणाऱ्या skills लिहितो आणि Telegram व Discord सारख्या chat apps द्वारे तुमच्यापर्यंत पोहोचतो. तो model agnostic आहे. त्यामुळे तुम्हाला पसंत असलेल्या कोणत्याही language model कडे त्याला निर्देशित करता येते.

त्याचे मुख्य वैशिष्ट्य म्हणजे त्याला फार कमी संसाधने लागतात. Hermes एका command ने install होते आणि $5 VPS वरही सहज चालते. याचे कारण असे की agent हा runtime असतो, model नाही. जड computation तुम्ही जोडलेल्या API कडे होते. Hermes तुमच्या model आणि chat apps शी बाहेरून संपर्क साधून काम करते. त्यामुळे त्याला inbound port ची गरज नसते आणि त्याची network surface जवळजवळ शून्य राहते. OpenClaw च्या तुलनेत याची खरी मर्यादा म्हणजे maturity. Hermes ला काहीच महिने झाले आहेत, तर OpenClaw चे integrations आणि community खूप मोठे आहेत. curl install script चालवण्यापूर्वी ते download करून वाचावे का, यासह संपूर्ण setup VPS वर Hermes Agent self-host करणे येथे दिले आहे.

टीम्ससाठीचे platform: Dify

Dify हे वेगळ्या प्रकारचे साधन आहे. एका व्यक्तीसाठी एक agent काम करण्याऐवजी, language models वर आधारित applications तयार करण्यासाठी हे self-host करता येणारे platform आहे: chat apps, agents आणि retrieval pipelines डिझाइन करण्यासाठी web interface, तुमच्या स्वतःच्या code मधून त्यांना call करण्यासाठी API आणि prompts, datasets तसेच model keys व्यवस्थापित करण्यासाठी एकच ठिकाण. एक लहान team हे उभारते, त्यामुळे scripts मध्ये API keys विखुरण्याऐवजी प्रत्येकजण एका shared private base वर काम करतो. तुमच्या team ची गरज shared apps तयार करण्यापेक्षा प्रत्येक व्यक्तीला स्वतःचा sandboxed agent देण्याशी अधिक संबंधित असल्यास, OneCLI प्रत्येक व्यक्तीसाठी एक agent हा दृष्टिकोन स्वीकारते, आणि model keys एका gateway मध्येच ठेवते.

या व्याप्तीमुळे अधिक moving parts येतात. Dify सुमारे अर्धा डझन containers असलेल्या Docker Compose stack स्वरूपात release केले जाते. त्यात Postgres database, Redis cache आणि vector database यांचा समावेश असतो. त्यामुळे किमान 2 GB free RAM आणि शक्यतो 4 GB RAM उपलब्ध ठेवा. Security चे कामही वेगळे आहे: Dify मधील bundled web server प्रत्येक interface वर plain HTTP port 80 वर listen करतो आणि install page वर पोहोचणारा पहिला visitor admin account claim करतो. ते loopback वर bind करा, त्याच्या पुढे TLS reverse proxy ठेवा आणि admin account त्वरित तयार करा. VPS वर Dify self-host करणे install प्रक्रिया आणि हे सर्व fixes स्पष्ट करते.

OpenHands: स्वायत्त coding agent

OpenHands, ज्याला पूर्वी OpenDevin म्हटले जात असे, हा स्वायत्त software engineering agent आहे. तुम्ही त्याला साध्या भाषेत task देता. तो कामाचे नियोजन करतो, code लिहितो, commands चालवतो, output वाचतो आणि task पूर्ण होईपर्यंत पुन्हा पुन्हा सुधारणा करतो. तो Docker वापरतो, port 3000 वर web UI उपलब्ध करून देतो, अनेक model backends ला support करतो आणि त्याला किमान 4 GB RAM आवश्यक असते.

तुमच्या संपूर्ण setup साठी एक design decision महत्त्वाचा आहे. प्रत्येक task fresh sandbox container मध्ये चालवण्यासाठी त्याचा controller host Docker socket mount करतो. त्या socket शी संवाद साधू शकणारी कोणतीही गोष्ट संपूर्ण host filesystem mount करणारा container सुरू करू शकते. त्यामुळे socket access म्हणजे प्रत्यक्षात त्या machine वरील root access होय. म्हणून OpenHands ला त्याच्या host पासून पूर्णपणे sandbox करता येत नाही. यासाठी योग्य mitigation म्हणजे स्वतंत्र placement. ज्यामध्ये इतर महत्त्वाचा data नसलेला, स्वतंत्र आणि सहज पुन्हा तयार करता येणारा VPS वापरा. सुरुवात करण्यापूर्वी त्या मशीनचा snapshot घ्या. Agent ने लिहिलेला code अनेक आठवडे चालवलेल्या server वर विश्वास ठेवण्याऐवजी snapshot मधून मशीन पुन्हा तयार करा. Setup, त्याच्या UI साठीचा SSH tunnel आणि यामागील कारणमीमांसा VPS वर OpenHands self-host करणे येथे दिली आहे.

Agent Zero: सर्वसाधारण उपयोगासाठी framework

Agent Zero हे Docker-first agent framework आहे. मुख्य agent subordinate agents सुरू करू शकतो. प्रत्येक subordinate agent स्वतंत्र isolated container मध्ये चालतो. प्रत्येक agent code execute करू शकतो, browser नियंत्रित करू शकतो आणि shell commands चालवू शकतो. हे सर्व web UI मधून नियंत्रित करता येते. हे फक्त सहा डॉलर इतक्या किमतीच्या VPS वरील hardware वरही चालते. त्यामुळे कमी budget मध्ये multi-agent setup वापरून पाहण्याचा हा सर्वात सोपा मार्ग आहे.

ते सुरक्षित ठेवण्यासाठी दोन सावधगिरी आवश्यक आहेत. बहुतेक guides मधील standard docker run web UI port 50001 वर प्रत्येक network interface वर publish करते. त्यामुळे commands चालवणाऱ्या system चे control panel container सुरू होताच संपूर्ण internet वरून reachable होते. त्याऐवजी ते loopback वर publish करा आणि SSH tunnel द्वारे access करा. तसेच container isolation चा अर्थ योग्य प्रकारे समजा. subordinate agents एकमेकांपासून walled off असतात. यामुळे agents सुरक्षित राहतात; तुमचा server सुरक्षित होत नाही. Host-side कामाची जबाबदारी तुमचीच राहते. VPS वर Agent Zero self-host करणे यामध्ये ही प्रक्रिया दिली आहे. त्यात बहुतेक tutorials मध्ये वगळलेला loopback bind देखील समाविष्ट आहे.

तुमच्यासाठी योग्य self-hosted AI agent कोणता

  • तुम्हाला chat apps मध्ये सक्षम personal assistant हवा आहे आणि प्रत्यक्ष hardening work करण्याची तयारी आहे: OpenClaw.
  • तुम्हाला कमीतकमी आणि स्वस्त server वर, जवळजवळ कोणतेही attack surface नसलेला personal agent हवा आहे: Hermes Agent.
  • तुमच्या टीमला LLM apps साठी एक shared, private base हवा आहे आणि non-developers वापरू शकतील असा UI हवा आहे: Dify.
  • तुम्ही अनुपस्थित असताना code लिहिला जावा असे तुम्हाला वाटते आणि त्यासाठी disposable server देऊ शकता: OpenHands.
  • इतर agents कडे काम सोपवणाऱ्या agents सोबत प्रयोग करायचा आहे: Agent Zero.

एक परिस्थिती या यादीबाहेरची आहे. तुम्हाला autonomous agent ऐवजी terminal मधून session नुसार नियंत्रित करता येणारा interactive coding agent हवा असल्यास, त्या प्रकारासाठी स्वतंत्र tools आणि स्वतंत्र guide आहेत: सर्वाधिक stars असलेल्या open option साठी VPS वर OpenCode चालवणे पहा; व्यापक पर्यायांसाठी VPS वर coding AI agent चालवणे पहा. दुसरी परिस्थिती capability पेक्षा uptime वर अवलंबून असते: agent तुम्ही अनुपस्थित असतानाही काम करत राहावा हा उद्देश असल्यास, always-on agent म्हणून KiroCrew चालवणे reboot नंतर memory आणि scheduled jobs टिकवून ठेवणारा pinned-container आणि systemd pattern दाखवते. बहुतेक agent installations हा महत्त्वाचा भाग अनिश्चिततेवर सोडतात.

सर्व पाचही साधनांसाठी सुरक्षा प्रक्रिया समान आहे

तुम्ही कोणताही agent निवडला तरी hardening ची पद्धत बदलत नाही, कारण जोखीम बदलत नाही. ही सर्व साधने तुमच्या सर्व्हरवर commands किंवा code चालवतात. त्यामुळे एखाद्या चुकीमुळे कोणत्या संसाधनांपर्यंत पोहोचता येईल, यावर सर्व्हरने मर्यादा घालणे आवश्यक आहे.

चार सवयी सर्वाधिक परिणामकारक ठरतात. agent dedicated unprivileged user म्हणून चालवा; root म्हणून कधीही चालवू नका. त्यामुळे झालेल्या नुकसानीची कमाल मर्यादा त्या user च्या permissions इतकीच राहते, जसे unprivileged user म्हणून services चालवणे येथे स्पष्ट केले आहे. प्रत्येक control surface private ठेवा. Web UI आणि gateway साठी loopback binding वापरा. त्यांना बाहेरून वापरण्याची गरज असल्यास SSH tunnel किंवा VPN वापरा, कारण पोहोचता न येणाऱ्या port वर कोणीही हल्ला करू शकत नाही. सर्व्हरसमोर default-deny firewall ठेवा आणि IPv4 सोबत IPv6 देखील तपासा. फक्त IPv4 समाविष्ट असलेल्या rule set मुळे तीच service IPv6 वर पूर्णपणे उघडी राहू शकते. self-hosting करणाऱ्या अनेक वापरकर्त्यांना अडचणीत आणणारी हीच IPv6 firewall gap आहे. तसेच secrets अशा files मध्ये ठेवा ज्या फक्त agent चा user वाचू शकतो (mode 600). ती secrets command lines वर paste करण्याऐवजी service मार्फत load करा. एका file वर इतर सर्व गोष्टींची सुरक्षा अवलंबून असेल, तेथे हाच नियम लागू होतो. Vaultwarden ची खरी सुरक्षा encrypted vault पेक्षा त्याच्या admin token आणि backup file वर अधिक अवलंबून असते, कारण त्या दोन्ही गोष्टी vault चे संरक्षण करतात.

या संपूर्ण पद्धतीचे worked example, ज्यामध्ये NoNewPrivileges, ProtectSystem=strict, PrivateTmp आणि ProtectHome असलेले hardened systemd unit समाविष्ट आहे, हे OpenClaw hardening guide आहे. हीच पद्धत या पृष्ठावरील कोणत्याही agent साठी वापरता येते. आणखी एक सवय सर्व पाचही साधनांसाठी महत्त्वाची आहे: updates विचारपूर्वक करा. March 2026 मधील OpenClaw disclosures मुळे agent मधील critical flaw किती वेगाने urgent ठरू शकतो हे स्पष्ट झाले. agent आधीपासूनच commands चालवत असल्यामुळे त्यातील privilege escalation bug हा सामान्य web app मधील त्याच प्रकारच्या bug पेक्षा खूपच गंभीर असतो.

FAQ

2026 मध्ये सर्वोत्तम self-hosted AI agent कोणता आहे?

हे कामावर अवलंबून आहे. 2026 च्या मध्यापर्यंत GitHub वर 380,000 पेक्षा जास्त stars असलेला OpenClaw हा सर्वाधिक सक्षम आणि लोकप्रिय personal agent आहे. त्याच भूमिकेसाठी Hermes Agent हा सर्वात हलका पर्याय आहे. LLM applications तयार करणाऱ्या टीमसाठी Dify हे सर्वोत्तम platform आहे. OpenHands हा सर्वात सक्षम autonomous coding agent आहे. Agent Zero हा सर्वाधिक लवचिक multi-agent framework आहे. प्रथम use case नुसार निवड करा. त्यानंतर तुम्ही किती hardening work करण्यास तयार आहात, त्यानुसार निर्णय घ्या.

स्वस्त VPS वर self-hosted AI agent चालवता येतो का?

होय, यांपैकी बहुतेक agents साठी ते शक्य आहे. Hermes Agent $5 VPS वर चालतो. Agent Zero सुमारे 2 GB RAM पासून सुरू होतो. Dify ला 2 ते 4 GB मोकळी RAM हवी असते. OpenHands ला किमान 4 GB हवी असते. Language model सहसा hosted API वर चालत असल्यामुळे agents स्वतः हलके असतात. तुम्ही model देखील self-host करत असाल, तर server चे आकारमान model नुसार ठरवा. ही आवश्यकता agent पेक्षा बरीच मोठी असते.

self-hosted AI agent चालवण्यासाठी GPU आवश्यक आहे का?

नाही. Agent हा runtime असतो. त्यात loop, tools आणि memory असतात. हे सर्व CPU-only VPS वर चालणारे सामान्य code असते. तुम्हाला language model स्वतःच्या hardware वर चालवायचा असेल, hosted API वापरायचा नसेल, तरच GPU महत्त्वाचा ठरतो. अशा वेळी model memory मध्ये बसेल याची खात्री असावी. Model download करण्यापूर्वी machine चे आकारमान model नुसार ठरवा.

self-hosted AI agents चालवणे सुरक्षित आहे का?

तुम्ही त्यांच्यावर घातलेल्या मर्यादांइतकेच ते सुरक्षित असतात. येथे प्रत्येक agent commands किंवा code चालवतो. त्यामुळे exposed control surface, root install आणि API keys लीक होणे हे धोके आहेत. सर्व पाच agents साठी उपाय समान आहेत: unprivileged user, SSH किंवा VPN द्वारे पोहोचता येणारे loopback-only interfaces, IPv4 आणि IPv6 दोन्हींसाठी default-deny firewall, secrets साठी file permissions आणि prompt updates. अशा पद्धतीने install केलेला agent चालवणे योग्य आहे. सार्वजनिक port वर थेट exposed केलेला agent सुरक्षित नाही.