Samodzielnie hostowane runnery dla agentów kodujących, w UE
Maszyna, na której twoi agenci naprawdę działają, w Pradze lub Covilhy, na umowie w UE - żeby odpowiedzią na pytanie "gdzie trafia kod" było centrum danych, które można wskazać, a nie ustawienie regionu.
Dla kogo to jest
Zespół, którego agent nie może opuścić perymetru
Dział prawny zaakceptował model, ale nie amerykańską piaskownicę, w której leży checkout, transkrypty i logi, a przegląd wciąż wraca do tego, gdzie dokładnie leży każde z tych trzech.
Platforma budowana na custom sandbox API
Nie potrzebujesz kolejnej warstwy orkiestracji nad swoją. Potrzebujesz hostów z przewidywalną ceną, izolacji, którą konfigurujesz sam, i adresów, które kontrolujesz.
Zespół, który już wybrał zarządzaną piaskownicę
Działa, a potem przychodzi ankieta o rezydencji danych z pytaniem, który podmiot przetwarza dane i w jakim regionie leży stan kolejki.
Cztery kształty, jakie przyjmuje runner
- Efemeryczna: kontener na zadanie, niszczony po jego zakończeniu. Analiza błędu, wyciąganie danych z faktur, tłumaczenie dokumentu.
- Długo działająca: trwałe kontenery trzymające wiele sesji jednocześnie. Agent, który cały dzień sortuje pocztę, chatbot, kreator stron serwujący przez porty kontenera.
- Hybrydowa: efemeryczne kontenery, które przy starcie wczytują stan z magazynu sesji i zapisują go z powrotem przy wyjściu, dla pracy trwającej godzinami z przerwami.
- Wieloagentowa: kilka podprocesów SDK w jednym kontenerze, każdy z własnym katalogiem roboczym, żeby się nie nadpisywały.
- Stałe lub on-demand runnery dla sesji Claude Code w webie, na telefonie i na desktopie, provisionowane przez ciebie, a nie przez Anthropic.
- Własny klient sandboxa na twojej infrastrukturze, na wypadek gdy żaden z czterech zarządzanych dostawców nie mieści się w umowie, którą musisz podpisać.
Rozmiar według równoczesnych agentów, nie na oko
Anthropic stawia dolną granicę na 1 GiB RAM, 1 CPU i 5 GiB dysku na agenta, a rozmiar hosta na (RAM hosta minus narzut) podzielone przez twój zmierzony pułap na sesję. Dolna granica to dolna granica: zmierz szczytowy RSS na reprezentatywnej sesji o twojej realnej długości, zanim uwierzysz tym liczbom agentów. I warto wiedzieć, zanim zoptymalizujesz zły parametr: ich własna dokumentacja wycenia minimalny kontener na około 0,05 USD za godzinę, podczas gdy jedna długa sesja wydaje dolary na tokeny - ten rachunek nie rozstrzyga się na infrastrukturze.
Czym nie jesteśmy
- Nie jesteśmy platformą sandboxową. Nie ma tu control plane, API sesji ani panelu uruchomień. Runner albo własnego klienta sandboxa przynosisz ty; my dajemy maszynę, sieć i adresy, których potrzebuje.
- Nie jesteśmy powiązani z Anthropic. Claude, Claude Code i Agent SDK należą do nich, samodzielnie hostowane runnery to funkcja ich produktu w planach Team i Enterprise, a nic na tej stronie nie jest przez nich firmowane.
- Inferencja modelu też nie jest nasza. Twój runner woła api.anthropic.com albo region Bedrock lub Vertex w UE, gdy rezydencja ma obejmować nie tylko kod, ale i prompt.
- Tokeny fakturuje ten, kto udostępnia model. Nasza faktura to infrastruktura, o której ich dokumentacja pisze, że zwykle jest liczbą mniejszą o rząd wielkości.
- Agent kodujący nie potrzebuje GPU - inferencja dzieje się po stronie dostawcy modelu. Jeśli sam udostępniasz model, to rozmowa o GPU i inna strona.
Elementy, które zespoły odkrywają za późno
- Stan sesji leży na systemie plików kontenera, więc wszystko, co użytkownik zamierza wznowić, potrzebuje SessionStore. Nadaje się magazyn zgodny z S3, Postgres albo Redis w tej samej sieci prywatnej: magazyn dostaje kopię, a źródłem prawdy pozostaje dysk lokalny.
- Magazyn odzwierciedla tylko transkrypty. Pliki pamięci CLAUDE.md i artefakty katalogu roboczego potrzebują własnego wolumenu albo synchronizacji do magazynu obiektowego - i to ten szczegół zamienia czysty restart w stracone popołudnie.
- Na produkcji ruch wychodzący powinien iść przez proxy, które wymusza listę dozwolonych domen i wstrzykuje dane logowania poza kontenerem - agent wykonuje wywołanie i nigdy nie trzyma klucza.
- Izolacja wielu najemców to więcej niż katalog na najemcę: wyłączone wczytywanie ustawień, wyłączona automatyczna pamięć, katalog konfiguracji na najemcę i osobne adresy wychodzące na najemcę. Ten ostatni punkt sprawia, że broker adresów z własnym AS jest wygodnym wynajmującym.
- Sesje same nie wygasają - ogranicz je przez maxTurns. Pamięć rośnie w trakcie długiej sesji, więc recykluj podprocesy, a nie licz na to, że jeden będzie żył wiecznie.
- Telemetria wychodzi z SDK, jeśli ustawione jest środowisko, a kolektor możemy trzymać obok runnerów, zamiast wysyłać trace na inny kontynent.
Zarządzana piaskownica a runner na własnym sprzęcie
| Zarządzana usługa piaskownicy | Runner w DCXV | |
|---|---|---|
| Gdzie leżą kod i pliki | Region dostawcy, który możesz przypiąć | Maszyna w Pradze lub Covilhy, która jest twoja |
| Gdzie leżą logi i stan kolejki | Często nie da się przypiąć, nawet gdy obliczenia są przypięte | Ta sama maszyna albo twój własny magazyn obok |
| Z kim podpisujesz umowę | Często podmiot z USA, z DPA | Firma cypryjska, pod prawem UE |
| Adres wychodzący na najemcę | Wspólne wyjście, jeśli w ogóle jest pokazane | Jeden czysty IPv4 na najemcę z AS204057 |
| Forma rozliczenia | Za sekundę albo za żądanie | Stała opłata miesięczna, bez zaskoczeń po długim uruchomieniu |
| Zimny start | Poniżej sekundy, czego chce praca efemeryczna | Ciepły host: szybko się podłączyć, nic do provisionowania |
| Izolacja | microVM albo gVisor, zarządzane za ciebie | Docker, gVisor albo Firecracker, konfigurowane przez ciebie |
Jak zaczyna się pula runnerów
Powiedz, ile sesji działa jednocześnie
Współbieżność, jak długo trwa sesja i czy agenci sterują przeglądarką. To plus zmierzony szczytowy RSS daje rozmiar hosta bez zgadywania.
Przekazujemy hosta
Praga albo Covilha, statyczne adresy, dostęp root, w minutach. Przynieś własny obraz, jeśli twój runner jest już zbudowany.
Skieruj runnera na niego
Komenda self-hosted runner dla Claude Code albo twój własny klient sandboxa dla Agent SDK. My jesteśmy celem, nie narzędziem.
Migawka, a potem rośnij w szerz
Sesje przypinają się do hosta przez consistent hashing po id sesji, więc pula skaluje się dodawaniem hostów, a nie powiększaniem jednego.
Dlaczego nas wybrać
- Obiekty certyfikowane Tier III, SLA obiektu 99,982 %
- Własna sieć, AS204057, IPv4 i IPv6
- Wsparcie 24/7/365 ze średnim czasem odpowiedzi około 10 minut
- Spółka cypryjska, jurysdykcja UE, zgodność z RODO od 2007 roku
FAQ
- Czego naprawdę potrzebuje samodzielnie hostowany runner agenta?
Anthropic stawia dolną granicę na 1 GiB RAM, 1 CPU i 5 GiB dysku na równoczesnego agenta, a rozmiar hosta to RAM hosta minus narzut podzielone przez twój zmierzony pułap na sesję. Traktuj dolną granicę jako dolną granicę i zmierz szczytowy RSS na prawdziwej sesji o twojej realnej długości. Potrzebny jest wychodzący HTTPS do endpointu modelu; wchodzący to tylko to, co udostępnia twoja własna aplikacja
- Czy inferencja może zostać w UE tak jak kod?
Runner może w całości: twój kod, checkouty, transkrypty i logi leżą na maszynie w Pradze lub Covilhy na umowie cypryjskiej. Samo wywołanie modelu skieruj na region UE Amazon Bedrock (Frankfurt, Irlandia, Paryż albo Sztokholm) lub na Vertex AI - SDK obsługuje to ustawieniem regionalnego endpointu. Bezpośrednie API nie ma wybieralnej przez klienta rezydencji tylko-UE, więc jeśli prompt też ma zostać w UE, to właśnie ta droga
- Czym to się różni od Modal, Daytona, Vercel czy Cloudflare?
To platformy, a tu jest blacha pod jedną z nich. One dają control plane i API sesji; my dajemy hosty, izolację, którą konfigurujesz, i adresy, które kontrolujesz. Dwie praktyczne różnice, jeśli samodzielny hosting jest wymogiem, a nie preferencją: Daytona zamknęła kod w czerwcu 2026, a jej control plane wciąż działa na infrastrukturze Daytony, a self-hosting E2B celuje w AWS i GCP. Platforma wspierająca bring-your-own-cloud może też po prostu wylądować u nas
- Ilu agentów mieści się na jednym hoście?
Przy dolnej granicy 1 GiB to około sześć na 8 GB, czternaście na 16 GB i trzydzieści na 32 GB, jeśli zostawisz zapas dla systemu. Automatyzacja przeglądarki zmienia to mocno - Chromium bierze 2 do 4 GB na sesję, więc agent z przeglądarką jest bliżej 4 GB niż 1 GB. Zmierz, zanim ustalisz liczbę
- Czy dajecie każdemu najemcy własny adres wychodzący?
Tak, i to jest powód, by hostować agentów u brokera adresów. Anthropic zaleca reguły egress na najemcę, w tym osobne wychodzące IP, żeby skompromitowany najemca nie mógł wyprowadzić danych przez politykę innego. Prowadzimy AS204057, mamy własną przestrzeń IPv4, trzymamy obciążenia agentów w pulach oddzielonych od poczty i od adresów przeznaczonych na sprzedaż, a reputację dowolnego bloku możesz sprawdzić sam przed startem
- Ile to kosztuje?
Od 18,43 EUR miesięcznie za pierwszy runner na 4 vCPU i 8 GB, około sześciu równoczesnych agentów przy udokumentowanej dolnej granicy; 36,88 EUR za 16 GB i 59,92 EUR za 32 GB, w każdym kopia zapasowa. Jest też bare metal, jeśli chcesz izolację Firecracker albo gVisor na sprzęcie, którego nikt nie dzieli. I warto trzymać proporcje: własna dokumentacja Anthropic wycenia minimalny kontener na około 0,05 USD za godzinę, podczas gdy jedna długa sesja wydaje dolary na tokeny
Jeśli potrzebujesz pomocy lub masz dodatkowe pytania, skontaktuj się z menedżerami lub napisz do zespołu wsparcia pod adresem support@dcxv.com
Serwery w chmurze od 15 €/mies.
Zamów teraz