SSD Nodes Learn
Посібники Matt ConnorВід Matt Connor · Оновлено 2026-07-24

Як створити AI агента на Claude та VPS

Використовуйте Claude Messages API та MCP для розробки автономного агента. Навчіться поєднувати інтелект моделі з інструментами на власному VPS сервері.

Що означає створення агента за допомогою Claude

Створення агента за допомогою Claude означає використання Claude як ядра для міркувань, тоді як цикл, інструменти та дані знаходяться на вашому власному сервері. Claude вирішує, що робити; ваш VPS виконує дії. Ви надсилаєте Claude завдання та поточний стан, Claude відповідає або відповіддю, або запитом на використання одного з ваших інструментів; ваш код виконує інструмент і надсилає результат назад, і цикл триває, доки завдання не буде виконано. Інтелект — це сервіс, який ви викликаєте через інтернет. Все інше належить вам.

Такий розподіл є перевагою. Ви отримуєте міркування рівня frontier-моделей без необхідності запускати модель, і ви повністю контролюєте, до чого може отримати доступ агент, оскільки інструменти запускаються на обладнанні, яке належить вам. Якщо ви вже створили свою першу програму для Claude, посібник з першого Claude app на VPS містить основи, на яких базується цей матеріал.

Claude — це мозок: Messages API

Кожен виклик Claude проходить через одну точку доступу — Messages API. Ви надсилаєте історію розмови та список інструментів, які може використовувати агент; Claude повертає свій наступний повідомлення. Це повідомлення є або фінальною відповіддю, або запитом на виклик інструменту. Для шляху самостійної розробки не існує окремого "agent API": використання інструментів є функцією цього єдиного ендпоінту, а цикл навколо нього ви запускаєте самостійно.

Claude не зберігає стан між викликами (stateless), що означає, що він нічого не пам'ятає самостійно. Кожен запит містить усю історію розмови. Ваш код зберігає історію та надсилає її на кожному кроці, через що кожен крок у довгій сесії коштує більше токенів, ніж попередній. Це не стільки обмеження, скільки архітектурне рішення: оскільки стан зберігається на вашому сервері, ви точно вирішуєте, що бачить Claude, і ніщо з завдання не зберігається там, де ви не маєте контролю.

Використання інструментів — це цикл агента

Цикл агента з Claude просто описати. Ви надсилаєте запит, що включає ваші інструменти. Claude зчитує завдання і, якщо йому потрібно діяти, відповідає запитом на використання інструменту, вказуючи назву інструменту та його вхідні дані. Ваш код виконує цей інструмент, а потім надсилає результат назад Claude у наступному запиті. Claude зчитує результат і або просить інший інструмент, або пише фінальну відповідь. Коли він перестає запитувати інструменти, завдання виконано.

Ви можете написати цей цикл вручну за кілька рядків, і багато хто так і робить, оскільки його легко зрозуміти та контролювати. Офіційні SDK також надають tool runner, який керує циклом за вас: ви надаєте функції інструментів, а SDK бере на себе обмін запитами до Claude, запуск ваших інструментів та передачу результатів назад, доки Claude не закінчить роботу. У будь-якому випадку структура однакова. Runner просто позбавляє вас необхідності писати цикл самостійно.

Три способи розробки та які підходять для VPS

Існує три способи створення агента Claude, і вони відрізняються обсягом механізмів, які ви запускаєте.

Перший — це ваш власний код, що викликає Claude API з вашими інструментами. Ви пишете цикл або використовуєте tool runner з SDK, і хостите все це на своєму VPS. Це поширений вибір, оскільки він дає повний контроль над інструментами, даними та безпекою, і працює як звичайна програма на вашому сервері. Більша частина цього посібника базується на цьому шляху.

Другий — Claude Agent SDK. Це Claude Code, агент для програмування, упакований як бібліотека для розробки. Він містить повний цикл агента та вбудовані інструменти для читання та запису файлів, виконання команд shell та пошуку, тому вам не потрібно збирати їх з нуля. Він також запускається на вашому власному сервері, що робить його чудовим варіантом для VPS, якщо вам потрібен функціональний агент для роботи з файлами та shell без необхідності створювати систему керування самостійно. Агенту, який читає файли та запускає команди shell, потрібна ізоляція перед автономною роботою, і безпечний запуск Claude Code на сервері описує систему дозволів, пісочницю та варіанти ізоляції.

Третій — Managed Agents, де Anthropic запускає цикл і хостить пісочницю, в якій виконуються інструменти агента. Це варіант з мінімальним втручанням: вам потрібно набагато менше операційних дій, але робоче середовище агента знаходиться на інфраструктурі Anthropic, а не на вашому VPS. Вибирайте цей варіант, якщо хочете мінімізувати операційне навантаження і вам не потрібно, щоб інструменти запускалися на вашій машині. Для двох інших варіантів ваш сервер є домом для агента, про що йдеться у решті цього посібника.

Підключення інструментів через MCP

Який би шлях ви не обрали, вам захочеться підключити агента до реальних систем, і Model Context Protocol — це зручний спосіб зробити це. MCP — це відкритий стандарт для надання інструментів та даних агенту. Замість того, щоб вручну писати інтеграцію для кожного сервісу, ви спрямовуєте Claude на MCP server, який вже представляє ці можливості як інструменти. Ви можете запускати MCP servers як невеликі сервіси на тому ж VPS, кожен з яких має лише необхідний доступ, про що я розповідаю у запуск MCP servers на VPS.

Вибір моделі

Claude представлена кількома моделями, і вибір однієї з них — це компроміс між можливостями, швидкістю та вартістю. На момент написання основні варіанти — це Claude Opus 4.8 (claude-opus-4-8), надійний стандарт для складних міркувань та тривалих запусків агента; Claude Sonnet 5 (claude-sonnet-5), збалансований варіант, який є дешевшим і швидшим, заливаясь близьким до Opus у багатьох завданнях; та Claude Haiku 4.5 (claude-haiku-4-5), найшвидша та найдешевша модель для простих, багатооб'ємних кроків. Вище них стоїть Claude Fable 5 (claude-fable-5), найпотужніша модель для найскладніших завдань. Використовуйте точний ідентифікатор моделі у своєму коді без додавання дати.

Практична схема — змішувати їх. Дозвольте дешевшій моделі обробляти рутинні виклики інструментів, а сильнішій — приймати складні рішення. Оскільки модель у вашому запиті — це лише рядок, перемикання є зміною в один рядок, тому почніть з надійного стандарту і знижуйте рівень там, де швидкість або вартість важливіші за останню краплю якості.

Запуск як захищеного сервісу на вашому VPS

Агент корисний лише тоді, коли він працює безперервно, і безпечний лише тоді, коли він ізольований. На VPS обидва ці аспекти забезпечуються запуском агента як захищеного системного сервісу, а не як програми, яку ви запустили вручну в терміналі. Як сервіс він запускається під час завантаження, перезапускається у разі збою та веде логи в journal. У захищеному режимі він працює від імені непривілейованого користувача з доступом лише до необхідного, тому помилка або некоректна інструкція матиме обмеження.

Найважливіше правило — тримати ваш Claude API key на стороні сервера. Ключ оплачує та авторизує кожен виклик, тому він має бути у файлі, доступному лише користувачу агента, завантаженому в сервіс як змінна середовища, і ніколи не розміщуватися в коді, у репозиторії або будь-де, де його може досягти браузер. Згенеруйте повний, захищений юніт сервісу для вашого агента тут:

ToolRun your agent as a hardened service

Потім налаштуйте сам сервер. Налаштуйте SSH тільки за ключами та обмежте доступ для облікового запису, з якого ви адмініструєте, як описано в SSH hardening на VPS. Якщо ви хочете керувати агентом через інтерактивну сесію під час розробки, запуск Claude Code на VPS з tmux буде хорошим доповненням. А якщо ви хочете зрозуміти концепції, що стоять за всім цим, не прив'язуючись до однієї моделі, допоміжний посібник з створення власного AI агента на VPS викладає основи.

Якщо вам потрібен термінальний помічник для кодування, запуск coding AI агента на VPS охоплює Aider та Goose.

FAQ

Яку модель Claude мені слід використовувати для створення агента?

Почніть з Claude Opus 4.8 (claude-opus-4-8), надійного стандарту, і коригуйте далі. Claude Sonnet 5 (claude-sonnet-5) дешевша та швидша для більшості завдань, Claude Haiku 4.5 (claude-haiku-4-5) найкраща для простих багатооб'ємних кроків, а Claude Fable 5 (claude-fable-5) є найпотужнішою для найскладніших завдань. Поширена схема — використовувати дешевшу модель для рутинних кроків і сильнішу для складних рішень, оскільки перемикання — це зміна в один рядок.

Я запускаю всього агента на своєму VPS чи це робить Anthropic?

Це залежить від підходу. Якщо ви пишете власний цикл для Claude API або використовуєте Claude Agent SDK, агент повністю працює на вашому VPS, і лише виклики моделей йдуть до Anthropic. Якщо ви використовуєте Managed Agents, Anthropic запускає цикл і хостить пісочницю, де виконуються інструменти, тому менша частина працює на вашому сервері. Для агента, що працює на вашій машині, використовуйте один із перших двох варіантів.

Яка різниця між Claude API та Claude Agent SDK?

Claude API — це сирий ендпоінт Messages: ви надсилаєте розмову та інструменти, а потім пишете цикл агента навколо нього або використовуєте tool runner з SDK. Claude Agent SDK — це бібліотека вищого рівня, Claude Code, упакована для розробки, яка містить повний цикл та вбудовані інструменти для файлів, shell та пошуку. Використовуйте API, коли хочете визначити все самостійно, і Agent SDK, коли вам потрібен функціональний агент без необхідності збирати систему керування.

Як мені безпечно зберігати мій Claude API key на сервері?

Зберігайте його на стороні сервера, а не у своєму коді. Зберігайте його у файлі, доступному лише для облікового запису, під яким працює агент, завантажуйте його в сервіс як змінну середовища і ніколи не комітьте його в репозиторій і не відкривайте для браузера. Оскільки кожен запит до Claude йде з вашого сервера, ключу ніколи не потрібно потрапляти на пристрій користувача, що робить агента, запущеного на сервері, простішим у захисті, ніж агента, вбудованого в клієнтський додаток.

Чи потрібно мені хостити модель самостійно для створення агента за допомогою Claude?

Ні. У випадку з Claude модель є хостованим сервісом, який ви викликаєте через API, тому вам не потрібно нічого запускати на GPU. Ваш VPS запускає цикл агента, інструменти та дані, а міркування відбуваються на стороні Anthropic. Це дозволяє скромному серверу запускати функціонального агента. Якщо ж ви хочете використовувати повністю локальну модель, це шлях самостійного хостингу, описаний у допоміжному посібнику зі створення власного AI агента.