SSD Nodes Learn Hosting plans →
คู่มือ Matt Connorโดย Matt Connor · อัปเดตเมื่อ 2026-08-28

วิธีสร้าง AI Agent ด้วย Claude บน VPS ของคุณเอง

เรียนรู้วิธีใช้ Claude เป็นสมองสั่งการและ VPS เป็นฐานปฏิบัติการผ่าน Messages API และ Tool Use เพื่อสร้าง AI Agent ที่คุณควบคุมทรัพยากรและเครื่องมือได้ทั้งหมดด้วยตัวเอง

การสร้างเอเจนต์ด้วย Claude หมายถึงอะไร

การสร้างเอเจนต์ด้วย Claude หมายถึงการใช้ Claude เป็นแกนกลางในการประมวลผลเชิงตรรกะ ในขณะที่ลูปการทำงาน เครื่องมือ และข้อมูลทั้งหมดจะอยู่บนเซิร์ฟเวอร์ของคุณเอง Claude จะเป็นผู้ตัดสินใจว่าจะทำอย่างไร และ VPS ของคุณจะเป็นผู้ดำเนินการตามนั้น คุณส่งงานและสถานะปัจจุบันไปให้ Claude จากนั้น Claude จะตอบกลับมาเป็นคำตอบหรือคำขอให้ใช้เครื่องมือที่คุณเตรียมไว้ โค้ดของคุณจะทำหน้าที่รันเครื่องมือนั้นและส่งผลลัพธ์กลับไป โดยลูปนี้จะดำเนินต่อไปจนกว่างานจะเสร็จสิ้น ความฉลาดคือบริการที่คุณเรียกใช้งานผ่านอินเทอร์เน็ต ส่วนองค์ประกอบอื่นๆ ทั้งหมดเป็นของคุณ

การแบ่งส่วนการทำงานเช่นนี้คือจุดเด่นที่น่าสนใจ คุณจะได้รับความสามารถในการประมวลผลระดับแนวหน้าโดยไม่ต้องดูแลโมเดลด้วยตนเอง และคุณยังคงควบคุมสิ่งที่เอเจนต์สามารถเข้าถึงได้อย่างเต็มที่ เนื่องจากเครื่องมือต่างๆ รันอยู่บนฮาร์ดแวร์ที่คุณเป็นเจ้าของ หากคุณเคยสร้างโปรแกรม Claude โปรแกรมแรกมาแล้ว คู่มือการสร้างแอป Claude บน VPS จะครอบคลุมพื้นฐานที่จำเป็นซึ่งเนื้อหาในส่วนนี้จะนำมาต่อยอดต่อไป

Claude คือสมอง: Messages API

การเรียกใช้งาน Claude ทุกครั้งจะผ่าน endpoint เดียวคือ Messages API คุณจะต้องส่งบทสนทนาทั้งหมดที่ผ่านมาและรายการเครื่องมือที่เอเจนต์สามารถใช้ได้ จากนั้น Claude จะส่งข้อความถัดไปกลับมา ข้อความนั้นจะเป็นคำตอบสุดท้ายหรือคำขอให้เรียกใช้เครื่องมือ สำหรับแนวทางการสร้างด้วยตนเองนั้นจะไม่มี "agent API" แยกต่างหาก การใช้งานเครื่องมือเป็นฟีเจอร์หนึ่งของ endpoint นี้ และคุณจะต้องเป็นผู้จัดการลูปการทำงานด้วยตนเอง

Claude ไม่มีสถานะ (stateless) ระหว่างการเรียกใช้งาน ซึ่งหมายความว่ามันไม่จดจำสิ่งใดด้วยตัวเอง คำขอแต่ละครั้งจะต้องส่งบทสนทนาทั้งหมดไปด้วย โค้ดของคุณจะเป็นผู้เก็บประวัติและส่งไปในทุกเทิร์น ซึ่งเป็น เหตุผลว่าทำไมแต่ละเทิร์นในการสนทนาที่ยาวนานจึงใช้โทเค็นมากขึ้นเรื่อยๆ นี่ไม่ใช่ข้อจำกัดแต่เป็นการเลือกออกแบบ เพราะสถานะถูกเก็บไว้บนเซิร์ฟเวอร์ของคุณ คุณจึงเป็นผู้กำหนดสิ่งที่ Claude มองเห็นได้อย่างแม่นยำ และไม่มีข้อมูลใดเกี่ยวกับงานที่ถูกจัดเก็บไว้ในที่ที่คุณไม่สามารถควบคุมได้ อย่างไรก็ตาม สิ่งนี้หมายความว่า prompt จะยาวขึ้นเรื่อยๆ แม้ว่า context window ของ Claude จะรองรับเรื่องนี้ได้อย่างสบาย แต่โมเดลที่รันในเครื่อง (local model) ในลูปเดียวกันจะไม่สามารถทำได้ ซึ่งเป็นเหตุผลว่าทำไม Ollama จึงจำเป็นต้องเพิ่มค่า num_ctx ก่อนที่จะหยุดตัดข้อความใน prompt ที่ยาวเกินไป

การใช้งานเครื่องมือคือลูปการทำงานของเอเจนต์

ลูปการทำงานของเอเจนต์ร่วมกับ Claude นั้นอธิบายได้ง่าย คุณส่งคำขอที่รวมเครื่องมือของคุณไปด้วย Claude จะอ่านงานที่ได้รับ หากจำเป็นต้องดำเนินการ Claude จะตอบกลับด้วยคำขอใช้งานเครื่องมือที่ระบุชื่อเครื่องมือและกรอกข้อมูลอินพุตที่จำเป็น โค้ดของคุณจะรันเครื่องมือนั้น จากนั้นส่งผลลัพธ์กลับไปให้ Claude ในคำขอถัดไป Claude จะอ่านผลลัพธ์และตัดสินใจว่าจะเรียกใช้เครื่องมืออื่นต่อหรือเขียนคำตอบสุดท้าย เมื่อ Claude หยุดเรียกใช้เครื่องมือ แสดงว่างานเสร็จสิ้นแล้ว

คุณสามารถเขียนลูปดังกล่าวด้วยตนเองได้ในไม่กี่บรรทัด ซึ่งหลายคนเลือกทำเช่นนั้นเพราะสามารถตรวจสอบและควบคุมได้ง่าย นอกจากนี้ SDK อย่างเป็นทางการยังมีตัวรันเครื่องมือ (tool runner) ที่ช่วยขับเคลื่อนลูปให้คุณ โดยคุณเพียงแค่ระบุฟังก์ชันของเครื่องมือ ส่วน SDK จะจัดการขั้นตอนการโต้ตอบระหว่างการเรียกใช้ Claude การรันเครื่องมือ และการส่งผลลัพธ์กลับไปจนกว่า Claude จะทำงานเสร็จ ไม่ว่าจะใช้วิธีใด รูปแบบการทำงานก็เหมือนกัน ตัวรันเพียงแค่ช่วยให้คุณไม่ต้องเขียนลูปด้วยตัวเอง หากลูปยังดูเป็นนามธรรมเกินไป วิธีแก้ไขคือการลองเขียนลูปแบบพื้นฐานที่สุดก่อนที่จะไปใช้ตัวรัน ซึ่งเป็นขั้นตอนสำคัญที่ทุกอย่างจะอ้างอิงถึงใน เส้นทางการเรียนรู้การสร้าง AI เอเจนต์ตั้งแต่เริ่มต้น

สามวิธีในการสร้างเอเจนต์ และวิธีที่เหมาะสมกับ VPS

มีสามวิธีในการสร้าง Claude agent ซึ่งแตกต่างกันที่ปริมาณโครงสร้างพื้นฐานที่คุณต้องดูแลเอง

วิธีแรกคือการเขียนโค้ดของคุณเองเพื่อเรียกใช้ Claude API ด้วยเครื่องมือที่คุณกำหนดขึ้นเอง คุณเป็นผู้เขียนลูปการทำงานหรือใช้ตัวรันเครื่องมือของ SDK และโฮสต์ทุกอย่างไว้บน VPS ของคุณ นี่เป็นทางเลือกที่นิยมที่สุดเพราะช่วยให้คุณควบคุมเครื่องมือ ข้อมูล และความปลอดภัยได้อย่างสมบูรณ์ โดยโปรแกรมจะทำงานเป็นโปรเซสปกติบนเซิร์ฟเวอร์ของคุณ คู่มือส่วนใหญ่ในที่นี้จะเน้นไปที่แนวทางนี้

วิธีที่สองคือการใช้ Claude Agent SDK ซึ่งก็คือ Claude Code ที่เป็นเอเจนต์สำหรับเขียนโค้ด โดยถูกจัดทำในรูปแบบไลบรารีที่คุณสามารถนำไปต่อยอดได้ มันมาพร้อมกับลูปการทำงานของเอเจนต์ที่สมบูรณ์และเครื่องมือในตัวสำหรับการอ่านและเขียนไฟล์ การรันคำสั่ง shell และการค้นหา ทำให้คุณไม่ต้องสร้างสิ่งเหล่านี้ขึ้นใหม่ตั้งแต่ต้น วิธีนี้ยังทำงานบนเซิร์ฟเวอร์ของคุณเอง จึงเหมาะอย่างยิ่งสำหรับ VPS ในกรณีที่คุณต้องการเอเจนต์ที่มีความสามารถในการจัดการไฟล์และ shell โดยไม่ต้องสร้างระบบควบคุมเอง เอเจนต์ที่อ่านไฟล์และรันคำสั่ง shell จำเป็นต้องมีระบบจำกัดขอบเขตก่อนที่จะปล่อยให้ทำงานโดยไม่มีผู้ดูแล และ การรัน Claude Code อย่างปลอดภัยบนเซิร์ฟเวอร์ จะครอบคลุมถึงระบบสิทธิ์, sandbox และตัวเลือกในการแยกส่วนการทำงาน

วิธีที่สามคือ Managed Agents ซึ่ง Anthropic จะเป็นผู้รันลูปการทำงานและโฮสต์ sandbox ที่เครื่องมือของเอเจนต์จะเข้าไปทำงาน นี่เป็นทางเลือกที่ไม่ต้องลงมือจัดการเองมากนัก คุณมีภาระในการดูแลรักษาน้อยลงมาก แต่พื้นที่ทำงานของเอเจนต์จะอยู่บนโครงสร้างพื้นฐานของ Anthropic แทนที่จะเป็น VPS ของคุณ ให้เลือกวิธีนี้เมื่อคุณต้องการลดภาระการดำเนินงานและไม่จำเป็นต้องให้เครื่องมือทำงานบนเครื่องของคุณเอง สำหรับอีกสองวิธีที่เหลือ เซิร์ฟเวอร์ของคุณจะเป็นที่ตั้งของเอเจนต์ ซึ่งเป็นเนื้อหาหลักของคู่มือฉบับนี้

การเชื่อมต่อเครื่องมือด้วย MCP

ไม่ว่าคุณจะเลือกแนวทางใด คุณย่อมต้องการเชื่อมต่อเอเจนต์เข้ากับระบบจริง ซึ่ง Model Context Protocol เป็นวิธีที่เป็นระเบียบในการดำเนินการดังกล่าว MCP เป็นมาตรฐานเปิดสำหรับการเปิดเผยเครื่องมือและข้อมูลให้กับเอเจนต์ แทนที่จะต้องเขียนโค้ดเชื่อมต่อสำหรับทุกบริการด้วยตนเอง คุณสามารถชี้ Claude ไปยัง MCP server ที่นำเสนอความสามารถเหล่านั้นในรูปแบบของเครื่องมืออยู่แล้ว คุณสามารถรัน MCP server เป็นบริการขนาดเล็กบน VPS เดียวกัน โดยแต่ละตัวจะมีสิทธิ์เข้าถึงเท่าที่จำเป็นเท่านั้น ซึ่งผมได้อธิบายไว้ใน การรัน MCP servers บน VPS

การเลือกโมเดล

Claude มีโมเดลให้เลือกใช้งานหลายรุ่น การเลือกใช้ขึ้นอยู่กับการชั่งน้ำหนักระหว่างความสามารถ ความเร็ว และค่าใช้จ่าย ณ เวลาที่เขียนบทความนี้ ตัวเลือกหลักประกอบด้วย Claude Opus 4.8 (claude-opus-4-8) ซึ่งเป็นค่าเริ่มต้นที่มีประสิทธิภาพสำหรับการใช้เหตุผลที่ซับซ้อนและการรันงานแบบ agent ระยะยาว, Claude Sonnet 5 (claude-sonnet-5) ซึ่งเป็นตัวเลือกที่สมดุล มีราคาถูกกว่าและทำงานได้เร็วกว่าในขณะที่ยังคงประสิทธิภาพใกล้เคียงกับ Opus ในหลายงาน และ Claude Haiku 4.5 (claude-haiku-4-5) ซึ่งเป็นรุ่นที่เร็วและประหยัดที่สุดสำหรับงานขั้นตอนง่ายๆ ที่มีปริมาณมาก เหนือกว่ารุ่นทั้งหมดคือ Claude Fable 5 (claude-fable-5) ซึ่งเป็นโมเดลที่มีความสามารถสูงสุดสำหรับงานที่ต้องการประสิทธิภาพระดับสูงสุด ให้ใช้ตัวระบุโมเดลที่ถูกต้องในโค้ดของคุณโดยไม่ต้องระบุวันที่ต่อท้าย

รูปแบบการใช้งานจริงที่แนะนำคือการผสมผสานโมเดลเข้าด้วยกัน โดยให้โมเดลที่มีราคาถูกกว่าจัดการกับการเรียกใช้เครื่องมือทั่วไป และให้โมเดลที่ทรงพลังกว่าจัดการกับการตัดสินใจที่ยากลำบาก เนื่องจากโมเดลเป็นเพียงสตริงในคำขอของคุณ การสลับรุ่นจึงทำได้โดยการแก้ไขโค้ดเพียงบรรทัดเดียว ดังนั้นควรเริ่มต้นด้วยโมเดลที่มีความสามารถสูงเป็นค่าเริ่มต้น แล้วจึงปรับลดลงในกรณีที่ความเร็วหรือค่าใช้จ่ายมีความสำคัญมากกว่าคุณภาพในระดับสูงสุด

การรันในฐานะ service ที่มีความปลอดภัยสูงบน VPS

เอเจนต์จะมีประโยชน์ก็ต่อเมื่อทำงานอยู่ตลอดเวลา และจะปลอดภัยก็ต่อเมื่อถูกจำกัดขอบเขตไว้เท่านั้น บน VPS ทั้งสองประเด็นนี้ทำได้โดยการรันเอเจนต์เป็น system service ที่มีการตั้งค่าความปลอดภัย แทนการรันโปรแกรมด้วยมือใน terminal การรันเป็น service จะทำให้โปรแกรมเริ่มทำงานตอนบูตเครื่อง เริ่มทำงานใหม่หากเกิดการ crash และบันทึก log ลงใน journal ส่วนการตั้งค่าความปลอดภัยจะทำให้โปรแกรมรันด้วยสิทธิ์ของผู้ใช้ทั่วไปที่มีสิทธิ์เข้าถึงเท่าที่จำเป็นเท่านั้น ดังนั้นหากเกิดบั๊กหรือได้รับคำสั่งที่ไม่พึงประสงค์ ผลกระทบจะถูกจำกัดอยู่ในวงจำกัด Service unit สามารถจำกัดได้เพียงสิ่งที่กระบวนการนั้นได้รับอนุญาตให้เข้าถึง ดังนั้นส่วนที่เหลือจึงเป็นหน้าที่ของตัวเอเจนต์เอง ซึ่งเป็นงานที่ ปลั๊กอิน DeepSeek Harness ที่ควรติดตั้ง ทำใน stack อื่น เช่น การจำกัดงบประมาณ, กฎการอนุญาตรายเครื่องมือ และการสแกนหา prompt injection

กฎที่สำคัญที่สุดคือการเก็บ Claude API key ไว้ที่ฝั่งเซิร์ฟเวอร์เท่านั้น กุญแจนี้ใช้สำหรับการชำระเงินและอนุญาตทุกการเรียกใช้งาน จึงควรอยู่ในไฟล์ที่อ่านได้เฉพาะผู้ใช้ของเอเจนต์เท่านั้น โดยโหลดเข้าสู่ service ในรูปแบบ environment variable และห้ามใส่ไว้ในโค้ด ใน repository หรือที่ใดก็ตามที่เบราว์เซอร์เข้าถึงได้ สร้าง service unit ที่สมบูรณ์และปลอดภัยสำหรับเอเจนต์ของคุณได้ที่นี่:

ToolRun your agent as a hardened service

จากนั้นจึงดำเนินการตั้งค่าเซิร์ฟเวอร์ให้เสร็จสิ้น ให้ใช้เฉพาะ SSH key เท่านั้นและจำกัดสิทธิ์บัญชีที่คุณใช้ดูแลระบบ ดังที่อธิบายไว้ใน การเพิ่มความปลอดภัย SSH บน VPS หากคุณต้องการควบคุมเอเจนต์ผ่าน interactive session ในระหว่างการพัฒนา การรัน Claude Code บน VPS ด้วย tmux เป็นทางเลือกที่ดี เมื่อคุณเปิด session ที่สองบนเครื่องเดียวกัน ทั้งสอง session สามารถส่งต่องานระหว่างกันได้ แทนที่คุณจะต้องคอยป้อนคำสั่งจากหน้าต่างหนึ่งไปยังอีกหน้าต่างหนึ่งด้วยตัวเอง และหากคุณต้องการทราบแนวคิดเบื้องหลังทั้งหมดนี้โดยไม่ผูกติดกับโมเดลใดโมเดลหนึ่ง คู่มือพี่น้องในหัวข้อ การสร้าง AI agent ของคุณเองบน VPS ได้วางรากฐานไว้ให้แล้ว

หากสิ่งที่คุณต้องการคือผู้ช่วยเขียนโค้ดผ่าน terminal หัวข้อ การรัน coding AI agent บน VPS จะครอบคลุมถึง Aider และ Goose

FAQ

ฉันควรใช้ Claude รุ่นใดในการสร้างเอเจนต์

ให้เริ่มต้นด้วย Claude Opus 4.8 (claude-opus-4-8) ซึ่งเป็นรุ่นมาตรฐานที่มีความสามารถรอบด้าน แล้วจึงปรับเปลี่ยนตามความเหมาะสม Claude Sonnet 5 (claude-sonnet-5) มีราคาถูกกว่าและทำงานได้เร็วกว่าสำหรับงานส่วนใหญ่ Claude Haiku 4.5 (claude-haiku-4-5) เหมาะที่สุดสำหรับงานปริมาณมากที่เรียบง่าย และ Claude Fable 5 (claude-fable-5) มีความสามารถสูงสุดสำหรับงานที่ยากที่สุด รูปแบบการใช้งานที่พบบ่อยคือการใช้รุ่นที่ราคาถูกกว่าสำหรับขั้นตอนทั่วไป และใช้รุ่นที่ทรงพลังกว่าสำหรับการตัดสินใจที่ซับซ้อน เนื่องจากสามารถสลับรุ่นได้โดยการแก้ไขโค้ดเพียงบรรทัดเดียว

ฉันต้องรันเอเจนต์ทั้งหมดบน VPS ของฉัน หรือ Anthropic เป็นผู้รัน

ขึ้นอยู่กับแนวทางที่คุณเลือก หากคุณเขียนลูปการทำงานเองเพื่อเรียกใช้ Claude API หรือใช้ Claude Agent SDK ตัวเอเจนต์จะรันบน VPS ของคุณทั้งหมด โดยมีการส่งเฉพาะคำสั่งเรียกใช้โมเดลไปยัง Anthropic เท่านั้น หากคุณใช้ Managed Agents ทาง Anthropic จะเป็นผู้รันลูปและโฮสต์แซนด์บ็อกซ์สำหรับประมวลผลเครื่องมือ ทำให้ส่วนประกอบที่อยู่บนเซิร์ฟเวอร์ของคุณมีน้อยลง สำหรับเอเจนต์ที่รันบนเครื่องของคุณเอง ให้เลือกใช้แนวทางแรกหรือแนวทางที่สอง

Claude API และ Claude Agent SDK แตกต่างกันอย่างไร

Claude API คือ Messages endpoint แบบดิบ ซึ่งคุณต้องส่งบทสนทนาและเครื่องมือเข้าไป แล้วเขียนลูปควบคุมเอเจนต์เอง หรือใช้เครื่องมือรันคำสั่ง (tool runner) ของ SDK เพื่อขับเคลื่อนมัน ส่วน Claude Agent SDK เป็นไลบรารีระดับสูงที่นำ Claude Code มาบรรจุไว้เพื่อให้คุณพัฒนาต่อได้ โดยมาพร้อมกับลูปการทำงานที่สมบูรณ์และเครื่องมือจัดการไฟล์, shell และการค้นหาในตัว ให้ใช้ API เมื่อคุณต้องการกำหนดค่าทุกอย่างด้วยตนเอง และใช้ Agent SDK เมื่อคุณต้องการเอเจนต์ที่มีความสามารถโดยไม่ต้องสร้างโครงสร้างพื้นฐานเอง

ฉันจะรักษาความปลอดภัยของ Claude API key บนเซิร์ฟเวอร์ได้อย่างไร

เก็บคีย์ไว้ที่ฝั่งเซิร์ฟเวอร์และแยกออกจากโค้ดของคุณ จัดเก็บไว้ในไฟล์ที่อ่านได้เฉพาะบัญชีผู้ใช้ที่รันเอเจนต์เท่านั้น โหลดคีย์เข้าสู่เซอร์วิสในรูปแบบ environment variable และห้ามนำไป commit ลงใน repository หรือเปิดเผยผ่านเบราว์เซอร์โดยเด็ดขาด เนื่องจากทุกคำขอที่ส่งไปยัง Claude จะมาจากเซิร์ฟเวอร์ของคุณ คีย์จึงไม่จำเป็นต้องถูกส่งไปยังอุปกรณ์ของผู้ใช้ ซึ่งเป็นเหตุผลที่ทำให้เอเจนต์ที่รันบนเซิร์ฟเวอร์มีความปลอดภัยง่ายกว่าเอเจนต์ที่ฝังอยู่ในแอปพลิเคชันฝั่งไคลเอนต์

ฉันจำเป็นต้องโฮสต์โมเดลเองเพื่อสร้างเอเจนต์ด้วย Claude หรือไม่

ไม่จำเป็น สำหรับ Claude ตัวโมเดลเป็นบริการแบบโฮสต์ที่คุณเรียกใช้งานผ่าน API จึงไม่มีส่วนใดที่ต้องรันบน GPU VPS ของคุณจะทำหน้าที่รันลูปเอเจนต์, เครื่องมือ และจัดการข้อมูล ส่วนการประมวลผลเชิงตรรกะจะเกิดขึ้นที่ฝั่ง Anthropic นี่คือสิ่งที่ช่วยให้เซิร์ฟเวอร์ขนาดเล็กสามารถรันเอเจนต์ที่มีความสามารถสูงได้ หากคุณต้องการใช้โมเดลแบบ local ทั้งหมด นั่นคือแนวทางการโฮสต์ด้วยตนเองซึ่งครอบคลุมอยู่ในคู่มือฉบับคู่ขนานเกี่ยวกับการสร้าง AI agent ของคุณเอง