Runner self-hosted per agenti di coding, nell'UE
La macchina su cui i tuoi agenti girano davvero, a Praga o a Covilha, con un contratto nell'UE - così la risposta a "dove finisce il codice" è un data centre che puoi nominare, non un'impostazione di regione.
Per chi è
Un team il cui agente non può uscire dal perimetro
Il legale ha approvato il modello ma non una sandbox statunitense che tiene il checkout, le trascrizioni e i log, e la revisione torna sempre su dove si trova ciascuna delle tre cose.
Una piattaforma costruita sulla custom sandbox API
Non ti serve un altro livello di orchestrazione sopra il tuo. Ti servono host con prezzo prevedibile, isolamento che configuri tu e indirizzi che controlli.
Un team che ha già scelto una sandbox gestita
Funziona, e poi arriva un questionario sulla residenza dei dati che chiede quale entità tratta i dati e in quale regione vive lo stato della coda.
Le quattro forme che prende un runner
- Effimera: un container per attività, distrutto quando l'attività finisce. Indagine su un bug, estrazione di fatture, la traduzione di un documento.
- Di lunga durata: container persistenti che tengono molte sessioni insieme. Un agente che smista la posta tutto il giorno, un chat bot, un site builder che serve dalle porte del container.
- Ibrida: container effimeri che si idratano da un session store all'avvio e riscrivono all'uscita, per lavoro che dura ore con pause di inattività.
- Multi-agente: diversi sottoprocessi dell'SDK in un solo container, ognuno con la propria directory di lavoro per non sovrascriversi.
- Runner fissi o on-demand per le sessioni Claude Code su web, mobile e desktop, provisionati da te e non da Anthropic.
- Un client sandbox personalizzato sulla tua infrastruttura, per quando nessuno dei quattro provider gestiti rientra nel contratto che devi firmare.
Dimensionato per agenti simultanei, non a occhio
Anthropic fissa il minimo a 1 GiB di RAM, 1 CPU e 5 GiB di disco per agente, e la dimensione dell'host a (RAM dell'host meno overhead) diviso il tuo tetto misurato per sessione. Il minimo è un minimo: misura l'RSS di picco su una sessione rappresentativa della tua durata reale prima di fidarti di questi conteggi. E vale saperlo prima di ottimizzare il numero sbagliato: la loro documentazione mette un container minimo intorno a 0,05 USD l'ora, mentre una sola sessione lunga spende dollari in token, quindi questa fattura non si decide sull'infrastruttura.
Cosa non siamo
- Non siamo una piattaforma di sandbox. Qui non c'è control plane, né API di sessione, né dashboard delle esecuzioni. Il runner o il client sandbox personalizzato li porti tu; noi diamo la macchina, la rete e gli indirizzi che le servono.
- Non siamo affiliati ad Anthropic. Claude, Claude Code e l'Agent SDK sono loro, i runner self-hosted sono una funzione Team ed Enterprise del loro prodotto, e nulla in questa pagina è approvato da loro.
- Nemmeno l'inferenza del modello è nostra. Il tuo runner chiama api.anthropic.com, o una regione UE di Bedrock o Vertex quando la residenza deve coprire il prompt oltre al codice.
- I token li fattura chi serve il modello. La nostra fattura è l'infrastruttura, che la loro documentazione indica come il numero più piccolo di un ordine di grandezza.
- Un agente di coding non ha bisogno di GPU: l'inferenza avviene dal lato del fornitore del modello. Se servi un modello da te, quella è una conversazione GPU e un'altra pagina.
Le parti che i team scoprono in ritardo
- Lo stato della sessione vive sul filesystem del container, quindi tutto ciò che un utente si aspetta di riprendere ha bisogno di un SessionStore. Vanno bene storage compatibile S3, Postgres o Redis sulla stessa rete privata: lo store riceve una copia e il disco locale resta la fonte di verità.
- Lo store rispecchia solo le trascrizioni. I file di memoria CLAUDE.md e gli artefatti della directory di lavoro hanno bisogno di un volume proprio o di una sincronizzazione su object storage, ed è questo dettaglio che trasforma un riavvio pulito in un pomeriggio perso.
- In produzione il traffico in uscita dovrebbe passare da un proxy che impone una allowlist di domini e inietta le credenziali fuori dal container, così l'agente fa la chiamata e non tiene mai la chiave.
- L'isolamento multi-tenant è più di una directory per tenant: caricamento delle impostazioni disattivato, memoria automatica disabilitata, una directory di configurazione per tenant e indirizzi in uscita distinti per tenant. Quest'ultimo punto è il motivo per cui un broker di indirizzi con un AS proprio è un padrone di casa utile.
- Le sessioni non scadono da sole: limitale con maxTurns. La memoria cresce nel corso di una sessione lunga, quindi ricicla i sottoprocessi invece di sperare che uno viva per sempre.
- La telemetria esce dall'SDK se l'ambiente è impostato, e il collector possiamo ospitarlo accanto ai runner invece di spedire le tracce in un altro continente.
Una sandbox gestita contro un runner sul tuo hardware
| Un servizio sandbox gestito | Un runner su DCXV | |
|---|---|---|
| Dove stanno codice e file | Una regione del provider che puoi fissare | Una macchina a Praga o a Covilha che è tua |
| Dove stanno i log e lo stato della coda | Spesso non fissabile, anche quando il calcolo lo è | La stessa macchina, o il tuo store accanto |
| Con chi firmi il contratto | Spesso un'entità statunitense, con un DPA | Un'azienda cipriota, sotto il diritto dell'UE |
| Indirizzo in uscita per tenant | Egress condiviso, quando è esposto | Un IPv4 pulito per tenant da AS204057 |
| Forma di fatturazione | Al secondo o a richiesta | Fisso al mese, senza sorprese dopo una lunga esecuzione |
| Avvio a freddo | Meno di un secondo, che è ciò che vuole il lavoro effimero | Un host caldo: veloce da agganciare, niente da provisionare |
| Isolamento | microVM o gVisor, gestiti per te | Docker, gVisor o Firecracker, configurati da te |
Come inizia un pool di runner
Dici quante sessioni girano insieme
Concorrenza, quanto dura una sessione e se gli agenti guidano un browser. Questo più un RSS di picco misurato dà la dimensione dell'host senza indovinare.
Consegniamo l'host
Praga o Covilha, indirizzi statici, accesso root, in minuti. Porta la tua immagine se il runner è già costruito.
Punta il runner su di esso
Il comando self-hosted runner per Claude Code, o il tuo client sandbox personalizzato per l'Agent SDK. Noi siamo il bersaglio, non lo strumento.
Snapshot, poi cresci in larghezza
Le sessioni si agganciano a un host tramite consistent hashing sull'id di sessione, quindi un pool scala aggiungendo host invece di ingrandirne uno.
Perché sceglierci
- Strutture certificate Tier III, SLA della struttura 99,982 %
- Rete propria, AS204057, IPv4 e IPv6
- Supporto 24/7/365 con circa 10 minuti di risposta media
- Società cipriota, giurisdizione UE, conforme al GDPR dal 2007
FAQ
- Cosa serve davvero a un runner di agente self-hosted?
Anthropic fissa il minimo a 1 GiB di RAM, 1 CPU e 5 GiB di disco per agente simultaneo, e la dimensione dell'host è la RAM dell'host meno overhead divisa per il tuo tetto misurato per sessione. Tratta il minimo come un minimo e misura l'RSS di picco su una sessione reale della tua durata reale. Serve HTTPS in uscita verso l'endpoint del modello; in ingresso solo ciò che espone la tua applicazione
- L'inferenza può restare nell'UE come il codice?
Il runner sì, del tutto: il tuo codice, i checkout, le trascrizioni e i log stanno su una macchina a Praga o a Covilha con contratto cipriota. Per la chiamata al modello, punta il runner a una regione UE di Amazon Bedrock (Francoforte, Irlanda, Parigi o Stoccolma) o a Vertex AI, cosa che l'SDK supporta con l'impostazione dell'endpoint regionale. L'API diretta non ha una residenza solo-UE selezionabile dal cliente, quindi se anche il prompt deve restare nell'UE, quella è la strada
- In cosa è diverso da Modal, Daytona, Vercel o Cloudflare?
Quelle sono piattaforme e questo è il ferro sotto una di esse. Loro ti danno un control plane e un'API di sessione; noi ti diamo host, isolamento che configuri tu e indirizzi che controlli. Due differenze pratiche se il self-hosting è un requisito e non una preferenza: Daytona ha chiuso il codice a giugno 2026 e il suo control plane gira ancora sull'infrastruttura di Daytona, e il self-hosting di E2B punta ad AWS e GCP. Una piattaforma che supporta il bring-your-own-cloud può anche semplicemente atterrare su di noi
- Quanti agenti stanno su un host?
Al minimo di 1 GiB, circa sei su 8 GB, quattordici su 16 GB e trenta su 32 GB lasciando margine al sistema operativo. L'automazione del browser cambia molto le cose: Chromium prende 2-4 GB per sessione, quindi un agente che navighi è più vicino a 4 GB che a 1 GB. Misura prima di fissare un numero
- Date a ogni tenant il proprio indirizzo in uscita?
Sì, ed è il motivo per ospitare agenti presso un broker di indirizzi. Anthropic raccomanda regole di egress per tenant, inclusi IP in uscita distinti, così un tenant compromesso non può esfiltrare tramite la policy di un altro. Gestiamo AS204057, abbiamo spazio IPv4 nostro, teniamo i carichi degli agenti in pool separati dalla posta e dagli indirizzi destinati alla vendita, e la reputazione di qualsiasi blocco puoi verificarla tu prima di andare live
- Quanto costa?
Da 18,43 EUR al mese per un primo runner con 4 vCPU e 8 GB, circa sei agenti simultanei al minimo documentato; 36,88 EUR per 16 GB e 59,92 EUR per 32 GB, con un backup incluso in ciascuno. C'è il bare metal se vuoi isolamento Firecracker o gVisor su hardware che nessuno condivide. E tenere le proporzioni: la documentazione di Anthropic mette un container minimo intorno a 0,05 USD l'ora, mentre una sessione lunga spende dollari in token
Se hai bisogno di assistenza o hai domande aggiuntive, contatta i manager o scrivi al team di supporto a support@dcxv.com
Server cloud da 15 €/mese
Ordina Ora