Claude AI Agent auf VPS selbst bauen
Lernen Sie, wie Sie Claude via Messages API und Tool Use als Reasoning-Core nutzen und den Agenten mit MCP auf Ihrem eigenen VPS steuern und ausführen.
Was die Erstellung eines Agenten mit Claude bedeutet
Einen Agenten mit Claude zu erstellen bedeutet, Claude als Reasoning-Core zu nutzen, während die Schleife (Loop), die Tools und die Daten auf Ihrem eigenen Server liegen. Claude entscheidet, was zu tun ist; Ihr VPS führt die Befehle aus. Sie senden Claude die Aufgabe und den aktuellen Zustand. Claude antwortet entweder mit einer Antwort oder mit einer Anfrage zur Nutzung eines Ihrer Tools. Ihr Code führt das Tool aus und sendet das Ergebnis zurück. Die Schleife läuft so lange weiter, bis die Aufgabe erledigt ist. Die Intelligenz ist ein Dienst, den Sie über das Internet aufrufen. Alles andere gehört Ihnen.
Diese Trennung ist der Vorteil. Sie erhalten Reasoning auf State-of-the-Art-Niveau, ohne ein Modell betreiben zu müssen, und behalten die volle Kontrolle darüber, worauf der Agent zugreifen kann, da die Tools auf Hardware laufen, die Ihnen gehört. Wenn Sie bereits ein erstes Claude-Programm erstellt haben, behandelt der erste Claude-App auf einem VPS Guide die Grundlagen, auf denen dieses hier aufbaut.
Claude ist das Gehirn: die Messages API
Jeder Aufruf an Claude erfolgt über einen Endpunkt, die Messages API. Sie senden den bisherigen Gesprächsverlauf und die Liste der Tools, die der Agent nutzen darf; Claude sendet seine nächste Nachricht zurück. Diese Nachricht ist entweder eine finale Antwort oder eine Anfrage zum Aufruf eines Tools. Für den Weg der Eigenentwicklung gibt es keine separate „Agent API“: Die Tool-Nutzung ist ein Feature dieses einzelnen Endpunkts, und die Schleife darum herum müssen Sie selbst ausführen.
Claude ist zwischen den Aufrufen zustandslos (stateless), was bedeutet, dass es sich nichts von selbst merkt. Jede Anfrage enthält den gesamten Gesprächsverlauf. Ihr Code hält den Verlauf bereit und sendet ihn bei jedem Durchgang, weshalb jeder Durchgang in einer langen Session mehr Token kostet als der vorherige. Dies ist weniger eine Einschränkung als eine Designentscheidung: Da der Zustand auf Ihrem Server liegt, entscheiden Sie genau, was Claude sieht, und nichts an der Aufgabe wird an einem Ort gespeichert, den Sie nicht kontrollieren.
Tool-Nutzung ist der Agent-Loop
Der Agent-Loop mit Claude ist einfach zu beschreiben. Sie senden eine Anfrage, die Ihre Tools enthält. Claude liest die Aufgabe und antwortet, falls er handeln muss, mit einer Tool-Nutzungs-Anfrage, die ein Tool benennt und dessen Eingaben ausfüllt. Ihr Code führt dieses Tool aus und sendet das Ergebnis im nächsten Request an Claude zurück. Claude liest das Ergebnis und fordert entweder ein weiteres Tool an oder schreibt seine finale Antwort. Wenn er aufhört, Tools anzufordern, ist die Aufgabe erledigt.
Sie können diesen Loop in wenigen Zeilen manuell schreiben, was viele tun, da er leicht einzusehen und zu kontrollieren ist. Die offiziellen SDKs bieten zudem einen Tool-Runner, der den Loop für Sie steuert: Sie stellen die Tool-Funktionen bereit, und das SDK übernimmt den Hin- und Her-Prozess zwischen dem Aufruf von Claude, dem Ausführen Ihrer Tools und dem Zurücksenden der Ergebnisse, bis Claude fertig ist. In beiden Fällen ist die Struktur gleich. Der Runner erspart Ihnen lediglich das manuelle Schreiben des Loops.
Drei Wege zum Bauen und welche für einen VPS geeignet sind
Es gibt drei Wege, einen Claude-Agenten zu bauen. Sie unterscheiden sich darin, wie viel der Mechanik Sie selbst betreiben.
Der erste Weg ist Ihr eigener Code, der die Claude API mit Ihren eigenen Tools aufruft. Sie schreiben den Loop oder nutzen den Tool-Runner des SDKs und hosten das gesamte System auf Ihrem VPS. Dies ist die gängige Wahl, da sie Ihnen die vollständige Kontrolle über Tools, Daten und Sicherheit gibt und als gewöhnliches Programm auf Ihrem Server läuft. Die meisten Teile dieses Guides setzen diesen Weg voraus.
Der zweite Weg ist das Claude Agent SDK. Dies ist Claude Code, der Coding-Agent, verpackt als Bibliothek, auf der Sie aufbauen können. Es liefert einen vollständigen Agent-Loop und integrierte Tools zum Lesen und Schreiben von Dateien, zum Ausführen von Shell-Befehlen und zur Suche, sodass Sie diese nicht von Grund auf zusammenstellen müssen. Es läuft ebenfalls auf Ihrem eigenen Server, was es ideal für einen VPS macht, wenn Sie einen leistungsfähigen Datei- und Shell-Agenten benötigen, ohne die Infrastruktur selbst zu bauen. Ein Agent, der Dateien liest und Shell-Befehle ausführt, benötigt eine Absicherung (Containment), bevor er unbeaufsichtigt arbeiten kann. Sicheres Ausführen von Claude Code auf einem Server behandelt das Berechtigungssystem, die Sandbox und die Isolationsoptionen.
Der dritte Weg sind Managed Agents, bei denen Anthropic den Loop ausführt und eine Sandbox hostet, in der die Tools des Agenten ausgeführt werden. Dies ist die wartungsfreie Option: Sie haben viel weniger zu betreiben, aber der Arbeitsbereich des Agenten liegt auf der Infrastruktur von Anthropic statt auf Ihrem VPS. Wählen Sie dies, wenn Sie minimalen operativen Aufwand wünschen und die Tools nicht auf Ihrer eigenen Maschine laufen müssen. Bei den anderen beiden ist Ihr Server das Zuhause des Agenten, worum es im restlichen Guide geht.
Verbindung von Tools mit MCP
Egal welchen Weg Sie wählen, Sie werden den Agenten mit realen Systemen verbinden wollen. Das Model Context Protocol ist der saubere Weg dafür. MCP ist ein offener Standard, um Tools und Daten einem Agenten zur Verfügung zu stellen. Anstatt für jeden Dienst eine Integration manuell zu programmieren, verweisen Sie Claude auf einen MCP-Server, der diese Funktionen bereits als Tools bereitstellt. Sie können MCP-Server als kleine Dienste auf demselben VPS ausführen, jeder mit nur den benötigten Zugriffen, was ich in Ausführen von MCP-Servern auf einem VPS beschreibe.
Auswahl eines Modells
Claude ist in verschiedenen Modellen verfügbar. Die Wahl eines Modells ist ein Kompromiss aus Leistungsfähigkeit, Geschwindigkeit und Kosten. Zum Zeitpunkt der Erstellung sind die gängigen Optionen Claude Opus 4.8 (claude-opus-4-8), der leistungsstarke Standard für komplexes Reasoning und lange Agenten-Laufzeiten; Claude Sonnet 5 (claude-sonnet-5), eine ausgewogene Option, die günstiger und schneller ist, bei vielen Aufgaben jedoch nah an Opus bleibt; und Claude Haiku 4.5 (claude-haiku-4-5), das schnellste und günstigste Modell für einfache, volumenintensive Schritte. Darüber steht Claude Fable 5 (claude-fable-5), das leistungsfähigste Modell für anspruchsvollste Aufgaben. Verwenden Sie in Ihrem Code die exakte Modell-ID ohne Datumszusatz.
Ein praktisches Muster ist das Mischen der Modelle. Lassen Sie ein günstigeres Modell Routine-Tool-Aufrufe bearbeiten und ein stärkeres Modell die schwierigen Entscheidungen treffen. Da das Modell nur ein String in Ihrer Anfrage ist, ist der Wechsel eine Änderung von nur einer Zeile. Beginnen Sie mit einem leistungsfähigen Standard und skalieren Sie nach unten, wenn Geschwindigkeit oder Kosten wichtiger sind als die letzte Nuance an Qualität.
Ausführung als gehärteter Dienst auf Ihrem VPS
Ein Agent ist nur nützlich, wenn er läuft, und nur sicher, wenn er isoliert ist. Auf einem VPS erreichen Sie beides, indem Sie den Agenten als gehärteten Systemdienst (System Service) betreiben, anstatt als ein Programm, das Sie manuell in einem Terminal gestartet haben. Als Dienst startet er beim Booten, startet bei einem Absturz neu und schreibt Logs in das Journal. Gehärtet läuft er als unprivilegierter Benutzer mit nur dem notwendigen Zugriff, sodass ein Bug oder ein fehlerhafter Befehl eine begrenzte Auswirkung hat.
Die wichtigste Regel ist, Ihren Claude API-Key serverseitig zu halten. Der Key bezahlt und autorisiert jeden Aufruf; er gehört daher in eine Datei, die nur vom Benutzer des Agenten lesbar ist, wird als Umgebungsvariable in den Dienst geladen und darf niemals im Code, in einem Repository oder an einem Ort stehen, den ein Browser erreichen kann. Generieren Sie hier eine vollständige, gehärtete Service-Unit für Ihren Agenten:
Vervollständigen Sie dann den Server selbst. Nutzen Sie für SSH nur Keys und schränken Sie das Konto ein, von dem aus Sie administrieren, wie in SSH-Härtung auf einem VPS. Wenn Sie den Agenten während der Entwicklung lieber aus einer interaktiven Session heraus steuern möchten, ist Ausführen von Claude Code auf einem VPS mit tmux ein guter Begleiter. Und wenn Sie die Konzepte hinter all dem verstehen wollen, ohne sie an ein bestimmtes Modell zu binden, legt der Leitfaden Einen eigenen KI-Agenten auf einem VPS bauen die Grundlagen dar.
Wenn Sie einen Terminal-Coding-Assistenten suchen, behandelt Ausführen eines Coding-KI-Agenten auf einem VPS Aider und Goose.
FAQ
Welches Claude-Modell sollte ich zum Bauen eines Agenten verwenden?
Beginnen Sie mit Claude Opus 4.8 (claude-opus-4-8), dem leistungsstarken Standard, und passen Sie dies von dort aus an. Claude Sonnet 5 (claude-sonnet-5) ist für die meisten Aufgaben günstiger und schneller, Claude Haiku 4.5 (claude-haiku-4-5) ist am besten für einfache, volumenintensive Schritte geeignet, und Claude Fable 5 (claude-fable-5) ist am leistungsfähigsten für die schwierigsten Aufgaben. Ein gängiges Muster ist die Nutzung eines günstigeren Modells für Routineaufgaben und eines stärkeren für schwierige Entscheidungen, da der Wechsel nur eine Zeilenänderung ist.
Läuft der gesamte Agent auf meinem VPS oder bei Anthropic?
Das hängt vom Ansatz ab. Wenn Sie Ihren eigenen Loop gegen die Claude API schreiben oder das Claude Agent SDK nutzen, läuft der Agent vollständig auf Ihrem VPS und nur die Modell-Aufrufe gehen an Anthropic. Wenn Sie Managed Agents nutzen, führt Anthropic den Loop aus und hostet die Sandbox, in der die Tools ausgeführt werden; somit liegt weniger davon auf Ihrem Server. Für einen Agenten, der auf Ihrer eigenen Maschine laufen soll, nutzen Sie eine der ersten beiden Optionen.
Was ist der Unterschied zwischen der Claude API und dem Claude Agent SDK?
Die Claude API ist der rohe Messages-Endpunkt: Sie senden einen Gesprächsverlauf und Tools, und Sie schreiben den Agent-Loop darum oder nutzen den Tool-Runner des SDKs. Das Claude Agent SDK ist eine höherwertige Bibliothek (Claude Code als Basis), die einen vollständigen Loop sowie integrierte Datei-, Shell- und Such-Tools mitliefert. Nutzen Sie die API, wenn Sie alles selbst definieren wollen, und das Agent SDK, wenn Sie einen leistungsfähigen Agenten ohne den Aufbau der Infrastruktur benötigen.
Wie halte ich meinen Claude API-Key auf einem Server sicher?
Halten Sie ihn serverseitig und außerhalb Ihres Codes. Speichern Sie ihn in einer Datei, die nur vom Account gelesen werden kann, unter dem der Agent läuft, laden Sie ihn als Umgebungsvariable in den Dienst und committen Sie ihn niemals in ein Repository oder legen Sie ihn einem Browser offen. Da jeder Request an Claude von Ihrem Server aus erfolgt, muss der Key niemals das Gerät eines Benutzers erreichen, was einen serverseitig laufenden Agenten einfacher zu sichern macht als einen, der in eine Client-App eingebettet ist.
Muss ich ein Modell selbst hosten, um einen Agenten mit Claude zu bauen?
Nein. Bei Claude ist das Modell ein gehosteter Dienst, den Sie über die API aufrufen; es muss also nichts auf einer GPU ausgeführt werden. Ihr VPS führt den Agent-Loop, die Tools und die Daten aus, während das Reasoning auf der Seite von Anthropic stattfindet. Das ermöglicht es einem bescheidenen Server, einen leistungsfähigen Agenten auszuführen. Wenn Sie stattdessen ein vollständig lokales Modell wünschen, ist dies der Self-Hosting-Weg, der im Begleitguide zum Bauen eines eigenen KI-Agenten behandelt wird.