Runners autoalojados para agentes de código, en la UE
La máquina en la que tus agentes funcionan de verdad, en Praga o Covilha, bajo un contrato en la UE - así la respuesta a "dónde va el código" es un centro de datos que puedes nombrar, no un ajuste de región.
Para quién es
Un equipo cuyo agente no puede salir del perímetro
Legal aprobó el modelo pero no un sandbox estadounidense con el checkout, las transcripciones y los registros, y la revisión vuelve una y otra vez a dónde está cada una de esas tres cosas.
Una plataforma que se construye sobre la API de sandbox personalizada
No necesitas otra capa de orquestación encima de la tuya. Necesitas hosts con precio predecible, aislamiento que configuras tú y direcciones que controlas.
Un equipo que ya eligió un sandbox gestionado
Funciona, y luego llega un cuestionario de residencia de datos preguntando qué entidad procesa los datos y en qué región vive el estado de la cola.
Las cuatro formas que toma un runner
- Efímera: un contenedor por tarea, destruido cuando la tarea termina. Investigación de un bug, extracción de facturas, la traducción de un documento.
- De larga duración: contenedores persistentes que sostienen muchas sesiones a la vez. Un agente que clasifica correo todo el día, un chatbot, un constructor de sitios que sirve por los puertos del contenedor.
- Híbrida: contenedores efímeros que se hidratan desde un almacén de sesiones al arrancar y escriben de vuelta al salir, para trabajo que dura horas con huecos de inactividad.
- Multiagente: varios subprocesos del SDK dentro de un contenedor, cada uno con su directorio de trabajo para que no se sobrescriban entre sí.
- Runners fijos o a demanda para sesiones de Claude Code en web, móvil y escritorio, aprovisionados por ti y no por Anthropic.
- Un cliente de sandbox propio contra tu propia infraestructura, para cuando ninguno de los cuatro proveedores gestionados encaja en el contrato que tienes que firmar.
Dimensionado por agentes simultáneos, no a ojo
Anthropic pone el mínimo en 1 GiB de RAM, 1 CPU y 5 GiB de disco por agente, y el tamaño del host en (RAM del host menos overhead) dividido por tu techo medido por sesión. El mínimo es un mínimo: mide el RSS de pico en una sesión representativa con tu duración real antes de fiarte de estos recuentos de agentes. Y conviene saberlo antes de optimizar el número equivocado: su propia documentación sitúa un contenedor mínimo cerca de 0,05 USD por hora, mientras que una sola sesión larga gasta dólares en tokens, así que esta factura no la decide la infraestructura.
Lo que no somos
- No somos una plataforma de sandbox. Aquí no hay control plane, ni API de sesiones, ni panel de ejecuciones. El runner o el cliente de sandbox propio los traes tú; nosotros damos la máquina, la red y las direcciones que necesita.
- No estamos afiliados a Anthropic. Claude, Claude Code y el Agent SDK son suyos, los runners autoalojados son una función de sus planes Team y Enterprise, y nada de esta página está avalado por ellos.
- La inferencia del modelo tampoco es nuestra. Tu runner llama a api.anthropic.com, o a una región de Bedrock o Vertex en la UE cuando la residencia debe cubrir el prompt además del código.
- Los tokens los factura quien sirve el modelo. Nuestra factura es la infraestructura, que según su documentación suele ser el número más pequeño por un orden de magnitud.
- Un agente de código no necesita GPU: la inferencia ocurre del lado del proveedor del modelo. Si sirves un modelo tú mismo, esa es una conversación de GPU y otra página.
Las partes que los equipos descubren tarde
- El estado de la sesión vive en el sistema de archivos del contenedor, así que todo lo que un usuario espera reanudar necesita un SessionStore. Sirve almacenamiento compatible con S3, Postgres o Redis en la misma red privada: el almacén recibe una copia y el disco local sigue siendo la fuente de verdad.
- El almacén refleja solo las transcripciones. Los archivos de memoria CLAUDE.md y los artefactos del directorio de trabajo necesitan su propio volumen o una sincronización a almacenamiento de objetos, y es ese detalle el que convierte un reinicio limpio en una tarde perdida.
- En producción el tráfico de salida debe pasar por un proxy que imponga una lista de dominios permitidos e inyecte las credenciales fuera del contenedor, así el agente hace la llamada y nunca tiene la clave.
- El aislamiento multiinquilino es más que un directorio por inquilino: carga de ajustes desactivada, memoria automática desactivada, un directorio de configuración por inquilino y direcciones de salida distintas por inquilino. Ese último punto es la razón por la que un bróker de direcciones con su propio AS resulta un buen casero.
- Las sesiones no expiran por sí solas: acótalas con maxTurns. La memoria crece a lo largo de una sesión larga, así que recicla los subprocesos en vez de confiar en que uno viva para siempre.
- La telemetría sale del SDK si el entorno está configurado, y el colector podemos alojarlo junto a los runners en vez de enviar trazas a otro continente.
Un sandbox gestionado frente a un runner en tu propio hardware
| Un servicio de sandbox gestionado | Un runner en DCXV | |
|---|---|---|
| Dónde están el código y los archivos | Una región del proveedor que puedes fijar | Una máquina en Praga o Covilha que es tuya |
| Dónde están los registros y el estado de la cola | A menudo no se puede fijar, aunque el cómputo sí lo esté | La misma máquina, o tu propio almacén al lado |
| Con quién firmas el contrato | Con frecuencia una entidad estadounidense, con un DPA | Una empresa chipriota, bajo derecho de la UE |
| Dirección de salida por inquilino | Salida compartida, cuando se expone siquiera | Una IPv4 limpia por inquilino desde AS204057 |
| Forma de facturación | Por segundo o por petición | Fijo al mes, sin sorpresas tras una ejecución larga |
| Arranque en frío | Menos de un segundo, que es lo que quiere el trabajo efímero | Un host caliente: rápido de conectar, nada que aprovisionar |
| Aislamiento | microVM o gVisor, gestionados por ellos | Docker, gVisor o Firecracker, configurados por ti |
Cómo empieza un pool de runners
Di cuántas sesiones corren a la vez
Concurrencia, cuánto dura una sesión y si los agentes manejan un navegador. Eso más un RSS de pico medido da el tamaño del host sin adivinar.
Entregamos el host
Praga o Covilha, direcciones estáticas, acceso root, en minutos. Trae tu propia imagen si tu runner ya está construido.
Apunta el runner hacia él
El comando de runner autoalojado para Claude Code, o tu cliente de sandbox propio para el Agent SDK. Nosotros somos el destino, no la herramienta.
Instantánea, y luego crecer a lo ancho
Las sesiones se fijan a un host por hashing consistente sobre el id de sesión, así que un pool escala añadiendo hosts y no agrandando uno.
Por qué elegirnos
- Instalaciones certificadas Tier III, SLA de instalación del 99,982 %
- Red propia, AS204057, IPv4 e IPv6
- Soporte 24/7/365 con unos 10 minutos de respuesta media
- Sociedad chipriota, jurisdicción de la UE, conforme al RGPD desde 2007
FAQ
- ¿Qué necesita realmente un runner de agente autoalojado?
Anthropic pone el mínimo en 1 GiB de RAM, 1 CPU y 5 GiB de disco por agente simultáneo, y el tamaño del host es la RAM del host menos overhead dividida por tu techo medido por sesión. Trata el mínimo como un mínimo y mide el RSS de pico en una sesión real con tu duración real. Hace falta HTTPS de salida al endpoint del modelo; de entrada solo lo que exponga tu propia aplicación
- ¿Puede la inferencia quedarse en la UE igual que el código?
El runner sí, por completo: tu código, los checkouts, las transcripciones y los registros están en una máquina en Praga o Covilha bajo contrato chipriota. Para la llamada al modelo, apunta el runner a una región de la UE de Amazon Bedrock (Fráncfort, Irlanda, París o Estocolmo) o a Vertex AI, que el SDK admite mediante su ajuste de endpoint regional. La API directa no tiene una residencia solo-UE que el cliente pueda elegir, así que si el prompt también debe quedarse en la UE, esa es la vía
- ¿En qué se diferencia esto de Modal, Daytona, Vercel o Cloudflare?
Esos son plataformas y esto es el metal que hay debajo de una. Ellos te dan un control plane y una API de sesiones; nosotros te damos hosts, aislamiento que configuras y direcciones que controlas. Dos diferencias prácticas si autoalojar es un requisito y no una preferencia: Daytona cerró su código en junio de 2026 y su control plane sigue corriendo en infraestructura de Daytona, y el autoalojamiento de E2B apunta a AWS y GCP. Una plataforma con bring-your-own-cloud también puede simplemente aterrizar en nosotros
- ¿Cuántos agentes caben en un host?
Con el mínimo de 1 GiB, unos seis en 8 GB, catorce en 16 GB y treinta en 32 GB si dejas margen para el sistema operativo. La automatización de navegador cambia eso mucho: Chromium se lleva de 2 a 4 GB por sesión, así que un agente que navega está más cerca de 4 GB que de 1 GB. Mide antes de fijar un número
- ¿Dais a cada inquilino su propia dirección de salida?
Sí, y es la razón para alojar agentes con un bróker de direcciones. Anthropic recomienda reglas de salida por inquilino, incluidas IP de salida distintas, para que un inquilino comprometido no pueda exfiltrar por la política de otro. Operamos AS204057, tenemos espacio IPv4 propio, mantenemos las cargas de agentes en pools separados del correo y de las direcciones destinadas a la venta, y puedes comprobar la reputación de cualquier bloque tú mismo antes de ponerlo en marcha
- ¿Cuánto cuesta?
Desde 18,43 EUR al mes por un primer runner con 4 vCPU y 8 GB, unos seis agentes simultáneos en el mínimo documentado; 36,88 EUR por 16 GB y 59,92 EUR por 32 GB, con una copia de seguridad incluida en cada uno. Hay bare metal si quieres aislamiento Firecracker o gVisor en hardware que nadie comparte. Y conviene mantener la proporción: la propia documentación de Anthropic sitúa un contenedor mínimo cerca de 0,05 USD por hora, mientras que una sesión larga gasta dólares en tokens
Si necesita asistencia o tiene preguntas adicionales, por favor contacte a los gerentes o escriba al equipo de soporte en support@dcxv.com
Servidores en la nube desde 15 €/mes
Pedir Ahora