Hermes Agent को $5 VPS पर कैसे होस्ट करें
Hermes Agent के लिए GPU की आवश्यकता नहीं है क्योंकि मॉडल कहीं और चलता है। इसे सुरक्षित रूप से चलाने के लिए ProtectSystem=strict का उपयोग करें और UFW में IPv6 को कॉन्फ़िगर करें।
Hermes Agent क्या है
Hermes Agent, Nous Research द्वारा फरवरी 2026 में जारी किया गया एक self-hosted AI agent है। आप इसे अपने सर्वर पर चलाते हैं, और यह आपके प्रोजेक्ट्स की persistent memory रखता है, काम करते समय अपने खुद के reusable skills लिखता है, और Telegram तथा Discord जैसे chat apps के माध्यम से आप तक पहुँचता है। यह model-agnostic है, इसलिए आप इसे अपनी पसंद के किसी भी language model के साथ जोड़ सकते हैं, और यह इतना हल्का है कि इसे $5 VPS पर, Docker में, या SSH के माध्यम से चलाया जा सकता है। यह विभाजन, जहाँ model कहीं और चलता है और loop, tools तथा memory आपके सिस्टम पर चलते हैं, वही चीज़ Hermes को an agent harness बनाती है, न कि केवल एक model, और यही कारण है कि एक छोटा सर्वर इसके लिए पर्याप्त है।
किसी भी agent की तरह, इसका मूल्य आपकी ओर से कार्य करने में है, और यही कारण है कि आप इसे सावधानी से सेटअप करते हैं। एक agent जो याद रखता है, सीखता है, और tasks चलाता है, वह एक standing process है जिसकी आपके सर्वर तक वास्तविक पहुँच होती है। यह गाइड इसे सुरक्षित तरीके से इंस्टॉल करती है, और यहाँ दी गई hardening वही है जो आप running OpenClaw safely के लिए लागू करेंगे।
एक-कमांड इंस्टॉलेशन, और इसे पहले पढ़ना क्यों जरूरी है
Hermes को एक ही कमांड से इंस्टॉल किया जा सकता है:
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bashयह सुविधाजनक है, और यह एक ऐसा तरीका है जिसका सम्मान किया जाना चाहिए। इंटरनेट से सीधे स्क्रिप्ट को पाइप करके शेल में चलाने का मतलब है कि वह स्क्रिप्ट जो कुछ भी करती है, उसे उसी यूजर के रूप में चलाया जा रहा है जिसने उसे रन किया है। इसे किसी वास्तविक सर्वर पर चलाने से पहले, इसे डाउनलोड करें, पढ़ें, और root के बजाय एक समर्पित यूजर के रूप में चलाएं:
curl -fsSL https://hermes-agent.nousresearch.com/install.sh -o hermes-install.sh
less hermes-install.shयह विशेष रूप से Hermes पर अविश्वास करने के बारे में नहीं है। यह वह आदत है जो किसी भी curl | bash इंस्टॉलेशन को आपके सेटअप की सबसे कमजोर कड़ी बनने से रोकती है।
इसे एक unprivileged user को दें
Hermes को root के बजाय उसके अपने system account के रूप में चलाएं, ताकि कोई bug या गलत instruction मशीन के बाकी हिस्सों तक न पहुँच सके। बिना login shell वाला एक user बनाएँ:
sudo useradd --system --home /opt/hermes --shell /usr/sbin/nologin hermesHermes को /opt/hermes के अंतर्गत install करें और उस account को उसका owner बनाएँ। official installer उसे चलाने वाले user के लिए install करता है, इसलिए आपके द्वारा download की गई script को hermes user के रूप में चलाएँ, उदाहरण के लिए sudo -u hermes bash hermes-install.sh, और files आपके home directory के बजाय उसके home directory में चली जाएँगी। इसका कारण वही है जो unprivileged user के रूप में services चलाने में बताया गया है: जिस account के रूप में agent चलता है, वह उस नुकसान की सीमा तय करता है जो वह पहुँचा सकता है। OS account पूरी तस्वीर का केवल आधा हिस्सा है, क्योंकि agent की अपनी settings यह तय करती हैं कि वह बिना पूछे कितना काम करता है, जो कि Claude Code के permission modes के पीछे का सवाल है जब agent उस box पर चल रहा हो जिसके सामने आप नहीं बैठे हैं। यदि box को अंततः केवल आपकी सेवा करने के बजाय और भी काम करने हों, तो OneCLI हर व्यक्ति को अपना sandboxed agent देकर उस एक-account-प्रति-agent के विचार को पूरी टीम तक ले जाता है, जबकि model keys एक ही gateway में रहती हैं जिसे किसी को भी copy करने की आवश्यकता नहीं होती।
सर्वर को फायरवॉल से सुरक्षित करें और इसके secrets को अलग रखें
Hermes अपना काम किसी मॉडल और आपके द्वारा कनेक्ट किए गए चैट ऐप्स तक पहुँच बनाकर करता है, इसलिए इसे इंटरनेट से आने वाले inbound connections को स्वीकार करने की आवश्यकता नहीं है। सर्वर के सामने एक default-deny फायरवॉल लगाएँ:
sudo ufw default deny incoming
sudo ufw allow 22/tcp
sudo ufw enableयहाँ IPv6 firewall gap पर ध्यान दें, क्योंकि केवल IPv4 को कवर करने वाला rule set किसी service को IPv6 पर exposed छोड़ सकता है। यदि agent को आपके home network पर मौजूद किसी ऐसी चीज़ तक पहुँचना आवश्यक है, जैसे NAS या local database, तो उस network को subnet router के साथ अपने tailnet पर advertise करना open inbound port के बजाय outbound connection के माध्यम से वहाँ पहुँचाता है। Model API key और सभी chat tokens ऐसी file में रखें जिसे केवल hermes user पढ़ सके (mode 600), और उसे service में load करें। उसे command line पर paste न करें, क्योंकि वह आपकी shell history में दर्ज हो जाएगा। ऐसी secrets file self-hosted password manager के पीछे मौजूद admin token जितना ही छोटा, लेकिन high-value target होती है। Vaultwarden hardening pass में दिया गया तर्क यहाँ भी लागू होता है: उस एक file को सुरक्षित रखें जो बाकी सब कुछ unlock करती है, और उसके backups को भी उतनी ही सावधानी से सुरक्षित रखें। File permissions मशीन पर मौजूद अन्य users को रोकती हैं, लेकिन underlying provider को नहीं। इसलिए यदि आपके agent के पास मौजूद keys इतनी sensitive हैं कि यह risk assessment बदल जाता है, तो encrypted memory और attestation यह तय करते हैं कि आपकी hosting company उन्हें RAM से पढ़ सकती है या नहीं।
Hermes को एक hardened systemd service के रूप में चलाएं
एक systemd unit आपके लॉग आउट करने और रीबूट के बाद भी Hermes को चालू रखती है, क्रैश होने पर इसे रीस्टार्ट करती है, और आपको kernel-level sandboxing जोड़ने की सुविधा देती है जो इसकी पहुंच को सीमित करती है। NoNewPrivileges, ProtectSystem=strict, PrivateTmp, और ProtectHome को चालू करें ताकि कोई भी समझौता (compromise) सीमित रहे।
यहाँ एक hardened unit जेनरेट करें, फिर इसे /etc/systemd/system/hermes.service पर कॉपी करें। यह unit hermes gateway को शुरू करती है, जो एक long-running process है और आपके chat apps को कनेक्ट करती है; service को enable करने से पहले अपने वर्ज़न पर उस कमांड और बाइनरी के पाथ की पुष्टि करने के लिए इंस्टॉल करने के बाद hermes --help चलाएं:
ये directives, और daemon-reload तथा enable --now चरण, systemd service के रूप में प्रोग्राम चलाना में कवर किए गए हैं:
sudo systemctl daemon-reload
sudo systemctl enable --now hermesकिसी अन्य एजेंट पर इसी पैटर्न के एक उदाहरण के लिए, systemd के अंतर्गत dsh headless चलाना में Restart नियमों और उन journalctl कमांड्स पर अधिक विस्तार से चर्चा की गई है, जिनकी आवश्यकता आपको तब होगी जब पहली बार रात में service बंद हो जाएगी। इससे भी बेहतर, यह जानने के लिए सुबह तक प्रतीक्षा न करें: एक OnFailure= unit जो alert को आपके अपने ntfy सर्वर पर भेजती है, Hermes के रीस्टार्ट होना बंद करते ही आपके फोन पर एक नोटिफिकेशन भेज देती है।
यदि आप native install के बजाय systemd से container को supervise कराना चाहते हैं, तो KiroCrew को pinned container के रूप में जीवित रखना वही रीबूट-सक्षम परिणाम देता है और साथ ही image वर्ज़न को भी स्थिर रखता है।
सर्वर को सुरक्षित बनाना
फ्रंट डोर को सुरक्षित करके प्रक्रिया पूरी करें। SSH को केवल key-based authentication पर ले जाएं और root login को अक्षम करें, जैसा कि SSH hardening on a VPS में बताया गया है, ताकि जिस account का उपयोग आप सर्वर मैनेज करने के लिए करते हैं, उसका अनुमान न लगाया जा सके। एक ऐसा agent जो persistent memory रखता है, उसे सुरक्षित रखना आवश्यक है, और सबसे सस्ता सुरक्षा उपाय यह सुनिश्चित करना है कि कोई भी उस सर्वर में login न कर सके जिस पर वह स्थित है।
एक बार जब सर्वर सुरक्षित हो जाए, तो अगली क्षमता जो अधिकांश लोग जोड़ते हैं वह है web search, और agent को अपने स्वयं के SearXNG instance की ओर निर्देशित करना उन queries को आपके अपने बॉक्स पर रखता है, हालांकि इसकी कीमत यह है कि आप इसे ऐसे pages फीड करते हैं जिन्हें किसी ने जाँचा नहीं है। Hermes आमतौर पर बॉक्स पर एकमात्र agent नहीं होता है, और यदि आप Claude Code को भी वहाँ चलाते हैं, तो दो sessions हर handoff को आपके माध्यम से रूट करने के बजाय सीधे एक-दूसरे को काम सौंप सकते हैं। यदि अगला agent जिसे आप जोड़ते हैं वह आपके chat apps के बजाय आपके code को पढ़ता है, तो उसी बॉक्स पर open-kritt के security scans चलाना एक ही ढांचे में फिट बैठता है: एक pinned release, उसका अपना account, और एक web UI जिसे आप open port के बजाय SSH tunnel के माध्यम से एक्सेस करते हैं।
यदि आप एक packaged agent चलाने के बजाय इसकी कार्यप्रणाली को समझना चाहते हैं, तो VPS पर अपना स्वयं का AI agent बनाना इसे चरण-दर-चरण स्पष्ट करता है। यदि उस गाइड में उपयोग की गई शब्दावली अभी भी आपके लिए नई है, तो AI agents सीखने के लिए एक क्रमिक मार्ग loop, tools, memory और safety को उसी क्रम में लेता है जिस क्रम में वे एक-दूसरे पर आधारित होते हैं, ताकि Hermes आपके लिए जो निर्णय लेता है, वे आपको जादू न लगें।
FAQ
क्या मैं Hermes Agent को सस्ते VPS पर चला सकता हूँ?
हाँ। Hermes को एक छोटे सर्वर पर चलने के लिए डिज़ाइन किया गया है, और $5 का VPS एक व्यक्तिगत, हमेशा चालू रहने वाले एजेंट के लिए पर्याप्त है। यह भारी ट्रैफ़िक सर्व करने के बजाय एक language model और आपके chat apps से संपर्क करता है, इसलिए यह संसाधनों पर हल्का है। इसे अपना स्वयं का user, एक firewall, और एक systemd service दें, और एक छोटा VPS इसे आसानी से संभाल लेगा। यदि आपके पास घर पर पहले से ही एक मशीन है, तो उसके हार्डवेयर और बिजली की लागत की तुलना उस मासिक शुल्क से करें, क्योंकि a home Proxmox box and a rented VPS अलग-अलग मोर्चों पर बेहतर होते हैं।
क्या one-line install script को चलाना सुरक्षित है?
curl | bash install सुविधाजनक है, लेकिन सुरक्षित आदत यह है कि script को download करें और चलाने से पहले उसे पढ़ें, और इसे root के बजाय एक dedicated user के रूप में चलाएँ। इस तरह, किसी भी project का piped installer उस सीमित account से अधिक कुछ नहीं कर सकता जिसकी अनुमति उसे दी गई है। यहाँ कुछ भी Hermes के लिए विशिष्ट नहीं है; इस तरह के हर install के लिए यह एक अच्छी प्रक्रिया है।
मैं root के बिना Hermes कैसे चलाऊँ?
बिना login shell वाला एक dedicated system user बनाएँ, Hermes को ऐसी directory के अंतर्गत install करें जिसका वह user मालिक हो, जैसे कि /opt/hermes, और service को उस account के रूप में चलाएँ। यदि एजेंट कभी breach होता है, तो नुकसान केवल उस तक सीमित रहता है जहाँ तक वह एक account पहुँच सकता है।
लॉग आउट करने के बाद मैं Hermes को चालू कैसे रखूँ?
इसे एक systemd service के रूप में चलाएँ। एक unit file boot होने पर Hermes को start करती है, crash होने पर उसे restart करती है, और आपके SSH session के समाप्त होने के बाद भी उसे चालू रखती है, जबकि systemd के sandboxing विकल्प यह सीमित करते हैं कि process क्या access कर सकती है। ऊपर दिए गए tool के साथ एक hardened unit बनाएँ और इसे systemctl enable --now hermes के साथ enable करें।
क्या Hermes Agent को GPU की आवश्यकता है?
नहीं। Hermes एक agent runtime है, न कि language model, इसलिए यह एक छोटे CPU-only VPS पर ठीक से चलता है। भारी computation वहाँ होती है जहाँ model चलता है, जो आमतौर पर एक hosted API होती है जिससे आप connect करते हैं। यदि आप model को उसी box पर self-host करना चाहते हैं, तो मशीन का आकार Hermes के बजाय model के अनुसार चुनें। CPU-only model hosting के लिए, the Ollama guide में दिए गए आंकड़े लागू होते हैं।