SSD Nodes Learn Hosting plans →
Panduan Matt ConnorOleh Matt Connor · Dikemas kini 2026-08-29

Cara Bina Ejen AI Menggunakan Claude di VPS

Ketahui cara membina ejen AI dengan Claude sebagai otak dan VPS sebagai badan. Panduan ini menerangkan penggunaan Messages API, fungsi alatan dan MCP untuk automasi.

Apakah maksud membina ejen dengan Claude

Membina ejen dengan Claude bermaksud menggunakan Claude sebagai teras penaakulan, manakala gelung, alatan dan data berada pada pelayan anda sendiri. Claude menentukan tindakan yang perlu diambil; VPS anda melaksanakannya. Anda menghantar tugasan dan status semasa kepada Claude, Claude membalas sama ada dengan jawapan atau permintaan untuk menggunakan salah satu alatan anda, kod anda menjalankan alatan tersebut dan menghantar semula hasilnya, dan gelung ini diteruskan sehingga kerja selesai. Kepintaran tersebut merupakan perkhidmatan yang anda panggil melalui internet. Segala perkara di sekelilingnya adalah milik anda.

Pembahagian ini merupakan tarikannya. Anda mendapat penaakulan tahap hadapan tanpa perlu mengendalikan model, dan anda mengekalkan kawalan penuh terhadap perkara yang boleh dicapai oleh ejen tersebut, kerana alatan itu berjalan pada perkakasan milik anda. Jika anda telah membina program Claude yang pertama, panduan aplikasi Claude pertama pada VPS merangkumi asas yang dibina oleh panduan ini.

Claude ialah otak: Messages API

Setiap panggilan kepada Claude melalui satu endpoint, iaitu Messages API. Anda menghantar perbualan setakat ini dan senarai alatan yang boleh digunakan oleh ejen; Claude akan menghantar semula mesej seterusnya. Mesej tersebut sama ada jawapan akhir atau permintaan untuk memanggil alatan. Bagi laluan bina-sendiri, tiada "agent API" yang berasingan: penggunaan alatan merupakan ciri bagi endpoint tunggal ini, dan gelung di sekelilingnya perlu dikendalikan oleh anda.

Claude tidak mempunyai status (stateless) antara panggilan, yang bermaksud ia tidak mengingati apa-apa dengan sendirinya. Setiap permintaan membawa keseluruhan perbualan. Kod anda menyimpan sejarah dan menghantarnya pada setiap giliran, yang merupakan sebab setiap giliran dalam sesi yang panjang menelan lebih banyak token berbanding sebelumnya. Ini bukanlah satu batasan tetapi lebih kepada pilihan reka bentuk: kerana status berada pada pelayan anda, anda menentukan dengan tepat apa yang dilihat oleh Claude, dan tiada apa-apa tentang tugasan tersebut disimpan di mana-mana tempat yang tidak dikawal oleh anda. Ini bermakna prompt akan terus berkembang, dan walaupun context window Claude mampu menampungnya dengan selesa, model tempatan dalam gelung yang sama tidak akan mampu, itulah sebabnya Ollama perlu meningkatkan num_ctx sebelum ia berhenti memotong prompt yang panjang.

Penggunaan alat ialah gelung ejen

Gelung ejen dengan Claude mudah untuk dihuraikan. Anda menghantar permintaan yang merangkumi alat anda. Claude membaca tugasan tersebut dan, jika ia perlu bertindak, ia membalas dengan permintaan penggunaan alat yang menamakan alat serta mengisi inputnya. Kod anda menjalankan alat tersebut, kemudian menghantar hasilnya kembali kepada Claude dalam permintaan seterusnya. Claude membaca hasil tersebut dan sama ada meminta alat lain atau menulis balasan akhirnya. Apabila ia berhenti meminta alat, tugasan tersebut selesai.

Anda boleh menulis gelung itu secara manual dalam beberapa baris, dan ramai orang melakukannya, kerana ia mudah dilihat dan mudah dikawal. SDK rasmi juga menyediakan pelari alat yang memacu gelung tersebut untuk anda: anda membekalkan fungsi alat, dan SDK mengendalikan proses ulang-alik memanggil Claude, menjalankan alat anda, serta menyalurkan hasil kembali sehingga Claude selesai. Walau apa pun caranya, bentuknya tetap sama. Pelari tersebut hanya menjimatkan masa anda daripada menulis gelung itu sendiri. Jika gelung tersebut masih terasa abstrak, penawarnya adalah dengan menulis gelung yang minimum sebelum anda menggunakan pelari, yang merupakan langkah di mana segala-galanya bergantung dalam laluan berperingkat untuk mempelajari ejen AI dari asas ini.

Tiga cara untuk membina, dan yang mana sesuai untuk VPS

Terdapat tiga cara untuk membina ejen Claude, dan ia berbeza dari segi jumlah jentera yang anda kendalikan.

Cara pertama ialah kod anda sendiri yang memanggil Claude API dengan alatan anda sendiri. Anda menulis gelung (loop), atau menggunakan tool runner SDK, dan anda mengehoskan keseluruhan perkara tersebut pada VPS anda. Ini merupakan pilihan biasa, kerana ia memberikan anda kawalan penuh ke atas alatan, data, dan keselamatan, serta ia berjalan sebagai program biasa pada pelayan anda. Kebanyakan panduan ini mengandaikan laluan ini.

Cara kedua ialah Claude Agent SDK. Ini adalah Claude Code, ejen pengekodan, yang dibungkus sebagai pustaka yang boleh anda bina. Ia membekalkan gelung ejen yang lengkap dan alatan terbina dalam untuk membaca dan menulis fail, menjalankan arahan shell, dan mencari, jadi anda tidak perlu memasang semua itu dari awal. Ia juga berjalan pada pelayan anda sendiri, yang menjadikannya sangat sesuai untuk VPS apabila anda mahukan ejen fail-dan-shell yang berkebolehan tanpa perlu membina rangka kerja sendiri. Ejen yang membaca fail dan menjalankan arahan shell memerlukan pengurungan sebelum ia berfungsi tanpa pengawasan, dan menjalankan Claude Code dengan selamat pada pelayan merangkumi sistem kebenaran, sandbox, dan pilihan pengasingan.

Cara ketiga ialah Managed Agents, di mana Anthropic menjalankan gelung dan mengehoskan sandbox tempat alatan ejen dilaksanakan. Ini adalah pilihan tanpa sentuh: terdapat jauh lebih sedikit perkara untuk anda kendalikan, tetapi ruang kerja ejen berada pada infrastruktur Anthropic dan bukannya VPS anda. Gunakan pilihan ini apabila anda mahukan kerja operasi yang paling minimum dan tidak memerlukan alatan tersebut berjalan pada mesin anda sendiri. Bagi dua cara yang lain, pelayan anda adalah tempat asal ejen tersebut, yang merupakan fokus bagi bahagian seterusnya dalam panduan ini.

Menyambungkan alatan dengan MCP

Tidak kira laluan yang anda pilih, anda pasti mahu menyambungkan ejen kepada sistem sebenar, dan Model Context Protocol ialah cara yang kemas untuk melakukannya. MCP ialah standard terbuka untuk mendedahkan alatan dan data kepada ejen. Daripada mengekod integrasi secara manual untuk setiap servis, anda hanya perlu menghalakan Claude kepada pelayan MCP yang sudah pun membentangkan keupayaan tersebut sebagai alatan. Anda boleh menjalankan pelayan MCP sebagai servis kecil pada VPS yang sama, setiap satunya dengan akses yang diperlukan sahaja, perkara yang saya huraikan dalam menjalankan pelayan MCP pada VPS.

Memilih model

Claude hadir dalam beberapa model, dan pemilihan model adalah pertukaran antara keupayaan, kelajuan, dan kos. Setakat penulisan ini, pilihan utama ialah Claude Opus 4.8 (claude-opus-4-8), pilihan lalai yang berkemampuan untuk penaakulan sukar dan tugasan ejen yang panjang; Claude Sonnet 5 (claude-sonnet-5), pilihan seimbang yang lebih murah dan pantas namun masih setanding dengan Opus dalam banyak tugasan; dan Claude Haiku 4.5 (claude-haiku-4-5), yang paling pantas dan murah, untuk langkah mudah yang berisipadu tinggi. Di atas kesemuanya terdapat Claude Fable 5 (claude-fable-5), model yang paling berkemampuan, untuk kerja yang paling mencabar. Gunakan pengecam model yang tepat dalam kod anda, tanpa menambah tarikh padanya.

Corak praktikalnya adalah dengan menggabungkan model-model tersebut. Biarkan model yang lebih murah mengendalikan panggilan alat rutin dan model yang lebih kuat mengendalikan keputusan yang sukar. Oleh kerana model hanyalah satu rentetan dalam permintaan anda, penukaran boleh dilakukan dengan satu baris kod sahaja, jadi mulakan dengan model lalai yang berkemampuan dan laraskan ke bawah jika kelajuan atau kos lebih penting daripada kualiti maksimum.

Jalankan ia sebagai servis yang diperkukuh pada VPS anda

Sesuatu ejen hanya berguna jika ia terus berjalan, dan ia hanya selamat jika ia terkawal. Pada VPS, kedua-dua perkara ini dicapai dengan menjalankan ejen sebagai servis sistem yang diperkukuh, bukannya program yang dimulakan secara manual dalam terminal. Sebagai servis, ia bermula semasa but, bermula semula jika ia terhenti, dan merekodkan log ke dalam journal. Apabila diperkukuh, ia berjalan sebagai pengguna tanpa keistimewaan dengan hanya akses yang diperlukan, jadi pepijat atau arahan yang salah mempunyai had. Unit servis hanya boleh mengehadkan perkara yang boleh disentuh oleh proses tersebut, jadi selebihnya terletak di dalam harness ejen itu sendiri, iaitu tugas yang dilakukan oleh plugin DeepSeek Harness yang berbaloi untuk dipasang pada stack yang berbeza: had perbelanjaan, peraturan kebenaran setiap alat, dan pengimbasan suntikan prompt.

Peraturan paling penting ialah menyimpan kunci API Claude anda di bahagian pelayan. Kunci tersebut membayar dan membenarkan setiap panggilan, jadi ia perlu berada dalam fail yang hanya boleh dibaca oleh pengguna ejen, dimuatkan ke dalam servis sebagai pemboleh ubah persekitaran, dan tidak boleh diletakkan dalam kod, dalam repositori, atau di mana-mana tempat yang boleh dicapai oleh pelayar. Jana unit servis yang lengkap dan diperkukuh untuk ejen anda di sini:

ToolRun your agent as a hardened service

Kemudian, selesaikan konfigurasi pelayan itu sendiri. Tetapkan SSH kepada kunci sahaja dan kunci akaun yang anda gunakan untuk mentadbir, seperti dalam pengukuhan SSH pada VPS. Jika anda lebih suka mengendalikan ejen daripada sesi interaktif semasa anda membinanya, menjalankan Claude Code pada VPS dengan tmux adalah rakan yang baik. Sebaik sahaja anda mempunyai sesi kedua yang dibuka pada mesin yang sama, kedua-duanya boleh menghantar kerja antara satu sama lain dan bukannya anda membawa setiap arahan dari satu anak tetingkap ke anak tetingkap yang lain. Dan jika anda mahukan konsep di sebalik semua ini, tanpa mengikatnya kepada satu model, panduan saudara pada membina ejen AI anda sendiri pada VPS membentangkan asas-asasnya.

Jika pembantu pengekodan terminal adalah apa yang anda mahukan, menjalankan ejen AI pengekodan pada VPS meliputi Aider dan Goose.

FAQ

Model Claude yang manakah patut saya gunakan untuk membina ejen?

Mulakan dengan Claude Opus 4.8 (claude-opus-4-8), pilihan lalai yang berkemampuan, kemudian buat pelarasan mengikut keperluan. Claude Sonnet 5 (claude-sonnet-5) lebih murah dan pantas untuk kebanyakan kerja, Claude Haiku 4.5 (claude-haiku-4-5) adalah yang terbaik untuk langkah volum tinggi yang ringkas, dan Claude Fable 5 (claude-fable-5) adalah yang paling berkemampuan untuk tugasan paling sukar. Corak yang biasa digunakan ialah menggunakan model yang lebih murah untuk langkah rutin dan model yang lebih kuat untuk keputusan sukar, memandangkan penukaran model hanya memerlukan perubahan satu baris kod.

Adakah saya menjalankan keseluruhan ejen pada VPS saya, atau Anthropic yang menjalankannya?

Ia bergantung pada pendekatan yang diambil. Jika anda menulis gelung (loop) anda sendiri terhadap Claude API, atau menggunakan Claude Agent SDK, ejen tersebut berjalan sepenuhnya pada VPS anda dan hanya panggilan model yang dihantar ke Anthropic. Jika anda menggunakan Managed Agents, Anthropic menjalankan gelung tersebut dan mengehoskan persekitaran sandbox tempat alat (tools) dilaksanakan, jadi kurang komponen yang berada pada pelayan anda. Untuk ejen yang berjalan pada mesin anda sendiri, gunakan salah satu daripada dua pilihan pertama.

Apakah perbezaan antara Claude API dan Claude Agent SDK?

Claude API ialah titik akhir (endpoint) Messages yang mentah: anda menghantar perbualan dan alat, kemudian anda menulis gelung ejen di sekelilingnya, atau menggunakan pelaksana alat (tool runner) SDK untuk memacunya. Claude Agent SDK ialah pustaka peringkat lebih tinggi, iaitu Claude Code yang dibungkus untuk tujuan pembangunan, yang menyediakan gelung penuh serta alat fail, shell dan carian terbina dalam. Gunakan API apabila anda ingin menentukan segala-galanya sendiri, dan gunakan Agent SDK apabila anda mahukan ejen yang berkemampuan tanpa perlu memasang rangka kerja (harness) secara manual.

Bagaimanakah cara saya memastikan Claude API key saya selamat pada pelayan?

Simpan kunci tersebut di bahagian pelayan (server-side) dan jangan masukkan ke dalam kod anda. Simpan ia dalam fail yang hanya boleh dibaca oleh akaun yang menjalankan ejen tersebut, muatkan ia ke dalam servis sebagai pemboleh ubah persekitaran (environment variable), dan jangan sekali-kali melakukan commit ke dalam repositori atau mendedahkannya kepada pelayar web. Oleh kerana setiap permintaan kepada Claude dihantar dari pelayan anda, kunci tersebut tidak perlu sampai ke peranti pengguna, itulah sebabnya ejen yang dijalankan pada pelayan lebih mudah untuk diselamatkan berbanding ejen yang dibenamkan dalam aplikasi klien.

Adakah saya perlu mengehoskan model sendiri untuk membina ejen dengan Claude?

Tidak. Dengan Claude, model tersebut merupakan servis terhos yang anda panggil melalui API, jadi tiada apa-apa yang perlu dijalankan pada GPU. VPS anda menjalankan gelung ejen, alat, dan data, manakala proses penaakulan berlaku di pihak Anthropic. Inilah yang membolehkan pelayan yang sederhana menjalankan ejen yang berkemampuan. Jika anda mahukan model yang sepenuhnya tempatan, itu adalah laluan pengehosan sendiri (self-hosted) yang diliputi dalam panduan pendamping mengenai pembinaan ejen AI anda sendiri.