הרצת סוכן קידוד (Aider או Goose) על גבי שרת VPS
למדו כיצד להריץ סוכני AI כמו Aider או Goose על שרת VPS מרוחק. המדריך כולל הגדרת סביבת tmux, חיבור למודל Ollama מקומי, אופטימיזציה של משאבים ושיטות עבודה בטוחות.
מדוע להריץ סוכן קידוד על גבי VPS
סוכן קידוד הוא כלי שקורא את בסיס הקוד שלך, מבצע בו שינויים ומריץ פקודות לבדיקתם, והכול מתוך הטרמינל. להרצת סוכן על גבי VPS יש שלושה יתרונות על פני המחשב הנייד שלך: הוא ממשיך לעבוד גם לאחר שתתנתק, הוא ממוקם בסמיכות לקוד ולכלי הבנייה שלך, והוא יכול לתקשר עם מודל שאתה מארח בעצמך. הפעל אותו בתוך session של tmux ותוכל לסגור את המחשב הנייד ולהמשיך את העבודה מאוחר יותר, באותה שיטה המתוארת ב-הרצת Claude Code על גבי VPS עם tmux.
כדאי להכיר שני סוכנים מבוססי טרמינל. Aider הוא האופציה המותאמת לטרמינל והמבוססת על git: הוא מבצע commit אוטומטי לכל שינוי עם הודעה הגיונית, כך שההיסטוריה שלך נשארת נקייה וכל עריכה ניתנת לשחזור. זהו אחד מסוכני הקידוד הוותיקים ביותר לטרמינל, אם כי קצב ה-releases שלו הואט. Goose, מבית Block, הוא רחב יותר: סוכן ברישיון Apache-2.0 עם אקו-סיסטם גדול של הרחבות ותמיכה בספקים רבים, כולל מודלים מקומיים של Ollama, וכעת הוא מפותח תחת ה-Agentic AI Foundation (AAIF) של ה-Linux Foundation. Aider מתאים לזרימת עבודה ממושמעת וממוקדת-git; Goose מתאים לעוזר כללי יותר עם סט רחב של תוספים.
דרישות קדם
עליך להצטייד בשרת VPS הכולל git, tmux וגרסה עדכנית של Python עבור Aider, או במתקין Goose עבור Goose. כמו כן, נדרש מודל: מפתח API של ספק חיצוני כגון Anthropic או OpenAI, או מודל מקומי המוגש באמצעות Ollama על גבי אותו שרת VPS. שימוש במודל מקומי שומר את הקוד שלך בשרת הפרטי ואינו כרוך בעלות לכל טוקן, אך דורש זיכרון RAM מספיק להרצת מודל בעל יכולות מתאימות.
התקנה והרצה של Aider
התקינו את Aider בסביבה מבודדת באמצעות pipx, המגיע מתוך apt כיוון ש-Ubuntu 24.04 חוסמת הרצת pip install רגילה מחוץ לסביבה וירטואלית (לפי PEP 668). לאחר מכן, הריצו את Aider בתוך הפרויקט שלכם בתוך session של tmux, כדי שהתהליך ימשיך לפעול גם במקרה של ניתוק:
sudo apt install pipx
pipx ensurepath
pipx install aider-chat
tmux new -s aider
cd ~/my-project
aiderהערת גרסה: התקנה זו עובדת כמתואר ב-Ubuntu 24.04. ב-Ubuntu 26.04 היא נכשלת כרגע, כיוון שהתלויות המקובעות של Aider כוללות גרסת numpy ישנה שאינה נבנית מול Python 3.14 של 26.04. הפתרון הוא לספק ל-Aider גרסת Python 3.12 משלו:
pipx install --python 3.12 --fetch-missing-python aider-chatהפקודה pipx מורידה מפרש עצמאי עבור Aider בלבד, וההתקנה מסתיימת. זהו סימפטום לקצב העדכונים האיטי של Aider; אם הדבר מפריע לכם, Goose הוא בחירה מתוחזקת יותר.
ברגע שהתוכנה רצה, התנתקו מה-session בעזרת Ctrl-b ואז d, והסוכן ימשיך לעבוד גם כשהמחשב הנייד סגור; התחברו מחדש מאוחר יותר בעזרת tmux attach -t aider כדי לקרוא את השינויים שביצע. שום דבר לא מונע מכם להשאיר חלון tmux שני פתוח עבור סוכן נוסף, ואם שניהם הם Claude Code, שני ה-sessions יכולים להעביר עבודה ביניהם במקום שתעבירו אותה ידנית. Aider קורא את ה-repository שלכם, מציע עריכות, מחיל אותן ומבצע commit לכל אחת, והוא יכול לטעון קבצים נוספים להקשר כאשר שינוי משתרע על פני כמה מהם. מכיוון שכל שינוי הוא commit, ביטול פעולות הסוכן הוא פשוט git revert, וזו רשת הביטחון שהופכת את השימוש בו לנוח. Goose מותקן באמצעות סקריפט השורה האחת המתועד שלו ורץ באופן דומה מה-terminal, כשהוא מנהל משימות דרך התוספים שלו:
curl -fsSL https://github.com/aaif-goose/goose/releases/download/stable/download_cli.sh | bashמודל מאוחסן (Hosted) או מודל באירוח עצמי (Self-hosted)
מודל מאוחסן מספק את האיכות הטובה ביותר ואינו דורש חומרה מקומית, אך הוא כרוך בעלות לכל token והקוד שלכם נשלח לספק. עלויות לפי token מצטברות מהר יותר ממה שרוב האנשים צופים, כיוון שהסוכן (agent) שולח מחדש את כל השיחה בכל שלב. הניתוח של Claude Code לגבי מהו באמת ההיקף הכספי של טוקנים בסשן ארוך של סוכן תקף גם כאן, שכן Aider ו-Goose מחייבים באותה צורה. מודל באירוח עצמי באמצעות Ollama שומר את כל המידע בשרת שלכם והוא חינמי להרצה לאחר רכישת החומרה, אך מודל תכנות ברמה מספקת דורש זיכרון משמעותי. זהו האיזון שיש לשקול: איכות ונוחות מול פרטיות ועלות.
אם בחרתם באירוח עצמי, השאלה המעשית היא איזה מודל מתאים לשרת שלכם. עקבו אחר ה-context window תוך כדי עבודה, כיוון ש-Ollama מגדיר כברירת מחדל חלון קטן וקוטע בשקט כל תוכן ארוך יותר; עבור סוכן תכנות, המשמעות היא שהקבצים שזה עתה קרא נמחקים מה-prompt: הגדלת ה-num_ctx ב-הוראות אלו פותרת זאת, וה-KV cache הגדול יותר הנדרש לכך הוא חלק מהזיכרון שעליכם להקצות. בדקו את הגודל לפני שאתם מורידים מודל של שמונה גיגה-בייט למכונה שאינה יכולה להכיל אותו:
בטיחות: עריכת קבצים והרצת פקודות
סוכן קידוד אינו פסיבי. הוא משכתב קבצים ויכול להריץ פקודות build ו־test, לכן יש להתייחס אליו באותה רמת זהירות שבה מתייחסים לכל תהליך בעל הרשאות לשינוי המערכת. שלושה הרגלים מכסים את רוב הסיכונים. עבדו בתוך מאגר git, כך שכל שינוי מתועד וניתן לשחזור; Aider עושה זאת עבורכם באופן אוטומטי. הריצו את הסוכן כמשתמש רגיל ללא הרשאות מיוחדות, לעולם לא כ-root, בהתאם לעקרון משתמשים בעלי הרשאות מינימליות, כדי שפקודה שגויה לא תוכל להשפיע על כל המערכת. שמרו על השרת עצמו מאובטח, שכן VPS המיועד לקידוד הוא עדיין שרת חשוף לאינטרנט: השתמשו ב-SSH מבוסס מפתח בלבד, ב-firewall עם מדיניות default-deny, ושאר אמצעי האבטחה. המדריך OpenClaw hardening guide נוקט בגישה דומה עבור סוכן אוטונומי יותר, והעקרונות תקפים לכל המקרים.
כדי לשלב סוכן קידוד בתהליך העבודה שלכם, המדריך building an AI agent with Claude מראה כיצד מודל אחד מפעיל את הכלים שלכם; running Google's Gemini CLI on a VPS הוא אפשרות נוספת לטרמינל, ו-self-hosting OpenHands הוא המסלול האוטונומי הכבד יותר. לפרויקט הקוד הפתוח הפופולרי ביותר בתחום זה יש כעת מדריך משלו: running OpenCode on a VPS מגדיר אותו תוך שימוש ב-tmux ובדפוס העבודה של משתמש ללא הרשאות root.
FAQ
האם ניתן להריץ סוכן קידוד עם מודל מקומי במקום API בתשלום?
כן. גם Aider וגם Goose עובדים עם מודלים מקומיים המוגשים על ידי Ollama, כך שניתן להריץ סוכן קידוד באירוח עצמי מלא ללא עלות לפי טוקן וללא יציאת קוד מהשרת שלך. המגבלה היא זיכרון: מודל בעל יכולת מספקת לכתיבת קוד שימושי דורש כמות נכבדה של RAM או VRAM, לכן יש להתאים את המכונה למודל לפני שמתחייבים.
Aider או Goose, במה כדאי להשתמש?
בחרו ב-Aider אם זרימת העבודה שלכם ממוקדת ב-terminal וב-git ואתם מחפשים את האפשרות הבוגרת ביותר עם התקורה הנמוכה ביותר; הוא מבצע auto-commit לכל שינוי כך שההיסטוריה שלכם נשארת הפיכה. בחרו ב-Goose אם אתם מעוניינים בעוזר רחב יותר עם מערכת אקולוגית גדולה של תוספים ותמיכה בספקים רבים. שניהם מופעלים מה-terminal ושניהם עובדים עם Ollama, כך ששניהם מתאימים ל-VPS.
כמה זיכרון דרוש עבור מודל קידוד באירוח עצמי?
זה תלוי בגודל המודל ובמידת ה-quantization שלו. מודל קטן שעבר quantization יכול לרוץ על כמה גיגה-בייט, בעוד מודל חזק יותר דורש הרבה יותר, וחלונות הקשר (context windows) ארוכים מוסיפים לדרישות. השתמשו בכלי הערכת הגודל שלעיל כדי להעריך את הזיכרון שמודל נתון ואורך הקשר דורשים לפני ההורדה.
האם זה בטוח לתת לסוכן AI לערוך את הקוד שלי ולהריץ פקודות?
זה ניתן לניהול עם הרגלים נכונים. שמרו את העבודה שלכם ב-git repository כך שכל עריכה תהיה commit הפיך, הריצו את הסוכן כמשתמש ללא הרשאות (unprivileged user) ולא כ-root, ואבטחו את ה-VPS כפי שהייתם מאבטחים כל שרת ציבורי. עברו על השינויים שהוא מבצע במקום לסמוך עליהם בעיניים עצומות, ובמיוחד על כל פקודה שהוא מבקש להריץ מול המערכת שלכם.