Selbst gehostete Runner für Coding-Agenten, in der EU
Die Maschine, auf der Ihre Agenten wirklich laufen, in Prag oder Covilha, unter einem EU-Vertrag - damit die Antwort auf "wohin geht der Code" ein Rechenzentrum ist, das Sie benennen können, und keine Regionseinstellung.
Für wen es ist
Ein Team, dessen Agent den Perimeter nicht verlassen darf
Die Rechtsabteilung hat das Modell freigegeben, aber keine US-Sandbox, in der Checkout, Transkripte und Logs liegen, und die Prüfung kommt immer wieder darauf zurück, wo diese drei jeweils liegen.
Eine Plattform, die auf der Custom-Sandbox-API aufbaut
Sie brauchen keine weitere Orchestrierungsschicht über Ihrer. Sie brauchen Hosts mit vorhersehbarem Preis, Isolation, die Sie selbst konfigurieren, und Adressen, die Sie kontrollieren.
Ein Team, das sich schon für eine managed Sandbox entschieden hat
Es funktioniert, und dann kommt ein Fragebogen zur Datenresidenz mit der Frage, welche Gesellschaft die Daten verarbeitet und in welcher Region der Queue-Zustand liegt.
Die vier Formen, die ein Runner annimmt
- Ephemer: ein Container pro Aufgabe, zerstört wenn die Aufgabe fertig ist. Fehlersuche, Rechnungsauslesen, eine Dokumentübersetzung.
- Langlaufend: dauerhafte Container, die viele Sitzungen gleichzeitig halten. Ein Agent, der den ganzen Tag E-Mails sortiert, ein Chatbot, ein Site-Builder, der über Container-Ports ausliefert.
- Hybrid: ephemere Container, die beim Start aus einem Session-Store laden und beim Beenden zurückschreiben, für Arbeit über Stunden mit Leerlaufpausen.
- Multi-Agent: mehrere SDK-Subprozesse in einem Container, jeder mit eigenem Arbeitsverzeichnis, damit sie sich nicht gegenseitig überschreiben.
- Feste oder On-Demand-Runner für Claude-Code-Sitzungen im Web, mobil und auf dem Desktop, bereitgestellt von Ihnen statt von Anthropic.
- Ein eigener Sandbox-Client gegen Ihre eigene Infrastruktur, für den Fall, dass keiner der vier managed Provider in den Vertrag passt, den Sie unterschreiben müssen.
Grösse nach gleichzeitigen Agenten, nicht nach Gefühl
Anthropic setzt die Untergrenze bei 1 GiB RAM, 1 CPU und 5 GiB Disk pro Agent, und die Hostgrösse bei (Host-RAM minus Overhead) geteilt durch Ihre gemessene Obergrenze pro Sitzung. Die Untergrenze ist eine Untergrenze: messen Sie den Spitzen-RSS an einer repräsentativen Sitzung in Ihrer echten Länge, bevor Sie diesen Agentenzahlen trauen. Und gut zu wissen, bevor Sie die falsche Zahl optimieren: ihre eigene Dokumentation nennt für einen minimalen Container rund 0,05 USD pro Stunde, während eine einzige lange Sitzung Dollars an Tokens ausgibt - diese Rechnung wird also nicht von der Infrastruktur entschieden.
Was wir nicht sind
- Wir sind keine Sandbox-Plattform. Es gibt hier keine Control Plane, keine Session-API und kein Dashboard der Läufe. Den Runner oder den eigenen Sandbox-Client bringen Sie mit; wir stellen die Maschine, das Netz und die Adressen, die sie braucht.
- Wir sind nicht mit Anthropic verbunden. Claude, Claude Code und das Agent SDK gehören ihnen, selbst gehostete Runner sind eine Team- und Enterprise-Funktion ihres Produkts, und nichts auf dieser Seite ist von ihnen bestätigt.
- Die Modell-Inferenz ist auch nicht unsere. Ihr Runner ruft api.anthropic.com auf, oder eine EU-Region von Bedrock oder Vertex, wenn die Residenz nicht nur den Code, sondern auch den Prompt abdecken muss.
- Tokens rechnet ab, wer das Modell bereitstellt. Unsere Rechnung ist die Infrastruktur, und ihre Dokumentation merkt an, dass das meist die um eine Grössenordnung kleinere Zahl ist.
- Ein Coding-Agent braucht keine GPU - die Inferenz passiert auf der Seite des Modellanbieters. Wenn Sie ein Modell selbst bereitstellen, ist das ein GPU-Gespräch und eine andere Seite.
Die Teile, die Teams zu spät entdecken
- Der Sitzungszustand liegt im Dateisystem des Containers, deshalb braucht alles, was ein Nutzer fortsetzen will, einen SessionStore. S3-kompatibler Speicher, Postgres oder Redis im selben privaten Netz funktionieren alle; der Store bekommt eine Kopie, die lokale Platte bleibt maßgeblich.
- Der Store spiegelt nur Transkripte. CLAUDE.md-Speicherdateien und Artefakte des Arbeitsverzeichnisses brauchen ein eigenes Volume oder einen Objektspeicher-Sync - genau dieses Detail macht aus einem saubereren Neustart einen verlorenen Nachmittag.
- In der Produktion soll ausgehender Verkehr über einen Proxy laufen, der eine Domain-Allowlist erzwingt und Zugangsdaten ausserhalb des Containers einsetzt - der Agent macht den Aufruf und hält den Schlüssel nie.
- Mandantentrennung ist mehr als ein Verzeichnis pro Mandant: Einstellungsladen aus, Auto-Memory deaktiviert, ein Konfigurationsverzeichnis pro Mandant und getrennte ausgehende Adressen pro Mandant. Der letzte Punkt ist der Grund, warum ein Adressbroker mit eigenem AS ein praktischer Vermieter ist.
- Sitzungen laufen nicht von selbst ab - begrenzen Sie sie mit maxTurns. Der Speicher wächst über eine lange Sitzung, also recyceln Sie Subprozesse statt darauf zu vertrauen, dass einer ewig lebt.
- Telemetrie kommt aus dem SDK, wenn die Umgebung gesetzt ist, und den Collector können wir neben den Runnern betreiben, statt Traces auf einen anderen Kontinent zu schicken.
Eine managed Sandbox gegen einen Runner auf eigener Hardware
| Ein managed Sandbox-Dienst | Ein Runner bei DCXV | |
|---|---|---|
| Wo Code und Dateien liegen | Eine Anbieterregion, die Sie festlegen können | Eine Maschine in Prag oder Covilha, die Ihnen gehört |
| Wo Logs und Queue-Zustand liegen | Oft nicht festlegbar, selbst wenn die Rechenleistung festgelegt ist | Dieselbe Maschine, oder Ihr eigener Store daneben |
| Mit wem Sie den Vertrag schließen | Häufig eine US-Gesellschaft, mit einem DPA | Ein zyprisches Unternehmen, nach EU-Recht |
| Ausgehende Adresse pro Mandant | Geteilter Egress, wo er überhaupt sichtbar ist | Eine saubere IPv4 pro Mandant aus AS204057 |
| Abrechnungsform | Pro Sekunde oder pro Anfrage | Fest pro Monat, keine Überraschung nach einem langen Lauf |
| Kaltstart | Unter einer Sekunde, was ephemere Arbeit braucht | Ein warmer Host: schnell zu verbinden, nichts zu provisionieren |
| Isolation | microVM oder gVisor, für Sie verwaltet | Docker, gVisor oder Firecracker, von Ihnen konfiguriert |
Wie ein Runner-Pool anfängt
Sagen Sie, wie viele Sitzungen gleichzeitig laufen
Parallelität, wie lange eine Sitzung dauert, und ob die Agenten einen Browser steuern. Das plus ein gemessener Spitzen-RSS ergibt die Hostgrösse ohne Raten.
Wir übergeben den Host
Prag oder Covilha, statische Adressen, Root-Zugang, in Minuten. Bringen Sie Ihr eigenes Image mit, wenn Ihr Runner schon gebaut ist.
Richten Sie den Runner darauf
Der Self-hosted-Runner-Befehl für Claude Code, oder Ihr eigener Sandbox-Client für das Agent SDK. Wir sind das Ziel, nicht das Werkzeug.
Snapshot, dann seitwärts wachsen
Sitzungen werden per Consistent Hashing über die Session-ID an einen Host gebunden, ein Pool skaliert also durch weitere Hosts statt durch einen grösseren.
Warum uns wählen
- Tier-III-zertifizierte Einrichtungen, 99,982 % Facility-SLA
- Eigenes Netz, AS204057, IPv4 und IPv6 Dual-Stack
- Support 24/7/365 mit rund 10 Minuten durchschnittlicher Reaktionszeit
- Zyprische Gesellschaft, EU-Gerichtsbarkeit, DSGVO-konform seit 2007
FAQ
- Was braucht ein selbst gehosteter Agent-Runner wirklich?
Anthropic setzt die Untergrenze bei 1 GiB RAM, 1 CPU und 5 GiB Disk pro gleichzeitigem Agenten, und die Hostgrösse ist Host-RAM minus Overhead geteilt durch Ihre gemessene Obergrenze pro Sitzung. Behandeln Sie die Untergrenze als Untergrenze und messen Sie den Spitzen-RSS an einer echten Sitzung Ihrer echten Länge. Ausgehendes HTTPS zum Modell-Endpunkt ist nötig; eingehend ist nur, was Ihre eigene Anwendung öffnet
- Kann die Inferenz genauso wie der Code in der EU bleiben?
Der Runner kann es vollständig: Ihr Code, die Checkouts, Transkripte und Logs liegen auf einer Maschine in Prag oder Covilha unter einem zyprischen Vertrag. Für den Modellaufruf selbst richten Sie den Runner auf eine EU-Region von Amazon Bedrock (Frankfurt, Irland, Paris oder Stockholm) oder auf Vertex AI, was das SDK über die Einstellung des regionalen Endpunkts unterstützt. Die direkte API hat keine vom Kunden wählbare EU-only-Residenz, wenn also auch der Prompt in der EU bleiben muss, ist das der Weg
- Wie unterscheidet sich das von Modal, Daytona, Vercel oder Cloudflare?
Das sind Plattformen, und hier ist das Blech darunter. Sie geben Ihnen eine Control Plane und eine Session-API; wir geben Ihnen Hosts, Isolation, die Sie konfigurieren, und Adressen, die Sie kontrollieren. Zwei praktische Unterschiede, wenn Selbst-Hosting eine Anforderung und kein Wunsch ist: Daytona hat im Juni 2026 den Quellcode geschlossen und die Control Plane läuft weiter auf Daytonas Infrastruktur, und E2B-Self-Hosting zielt auf AWS und GCP. Eine Plattform mit Bring-your-own-Cloud kann auch einfach bei uns landen
- Wie viele Agenten passen auf einen Host?
Bei der Untergrenze von 1 GiB sind es etwa sechs auf 8 GB, vierzehn auf 16 GB und dreissig auf 32 GB, wenn Sie Luft für das Betriebssystem lassen. Browser-Automatisierung ändert das deutlich - Chromium nimmt 2 bis 4 GB pro Sitzung, ein Browsing-Agent liegt also näher bei 4 GB als bei 1 GB. Messen Sie, bevor Sie sich auf eine Zahl festlegen
- Geben Sie jedem Mandanten eine eigene ausgehende Adresse?
Ja, und das ist der Grund, Agenten bei einem Adressbroker zu hosten. Anthropic empfiehlt Egress-Regeln pro Mandant einschliesslich getrennter ausgehender IPs, damit ein kompromittierter Mandant nicht über die Policy eines anderen exfiltrieren kann. Wir betreiben AS204057, halten eigenen IPv4-Raum, führen Agenten-Workloads in Pools getrennt von Mail und von Adressen, die zum Verkauf bestimmt sind, und Sie können die Reputation jedes Blocks vorab selbst prüfen
- Was kostet das?
Ab 18,43 EUR pro Monat für einen ersten Runner mit 4 vCPU und 8 GB, etwa sechs gleichzeitige Agenten an der dokumentierten Untergrenze; 36,88 EUR für 16 GB und 59,92 EUR für 32 GB, jeweils mit einem Backup. Bare Metal gibt es, wenn Sie Firecracker- oder gVisor-Isolation auf Hardware wollen, die niemand teilt. Und die Verhältnisse im Blick behalten: Anthropics eigene Dokumentation nennt für einen minimalen Container rund 0,05 USD pro Stunde, während eine lange Sitzung Dollars an Tokens ausgibt
Wenn Sie Hilfe benötigen oder zusätzliche Fragen haben, wenden Sie sich bitte an die Manager oder schreiben Sie an das Support-Team unter support@dcxv.com
Cloud-Server ab 15 €/Mon.
Jetzt bestellen