Runners autoalojados para agentes de código, en la UE

La máquina en la que tus agentes funcionan de verdad, en Praga o Covilha, bajo un contrato en la UE - así la respuesta a "dónde va el código" es un centro de datos que puedes nombrar, no un ajuste de región.

Certificado Tier III ISO 9001 ISO/IEC 27001 ISO 14001 Conforme con el RGPD

Para quién es

Un equipo cuyo agente no puede salir del perímetro

Legal aprobó el modelo pero no un sandbox estadounidense con el checkout, las transcripciones y los registros, y la revisión vuelve una y otra vez a dónde está cada una de esas tres cosas.

Una plataforma que se construye sobre la API de sandbox personalizada

No necesitas otra capa de orquestación encima de la tuya. Necesitas hosts con precio predecible, aislamiento que configuras tú y direcciones que controlas.

Un equipo que ya eligió un sandbox gestionado

Funciona, y luego llega un cuestionario de residencia de datos preguntando qué entidad procesa los datos y en qué región vive el estado de la cola.

Las cuatro formas que toma un runner

  • Efímera: un contenedor por tarea, destruido cuando la tarea termina. Investigación de un bug, extracción de facturas, la traducción de un documento.
  • De larga duración: contenedores persistentes que sostienen muchas sesiones a la vez. Un agente que clasifica correo todo el día, un chatbot, un constructor de sitios que sirve por los puertos del contenedor.
  • Híbrida: contenedores efímeros que se hidratan desde un almacén de sesiones al arrancar y escriben de vuelta al salir, para trabajo que dura horas con huecos de inactividad.
  • Multiagente: varios subprocesos del SDK dentro de un contenedor, cada uno con su directorio de trabajo para que no se sobrescriban entre sí.
  • Runners fijos o a demanda para sesiones de Claude Code en web, móvil y escritorio, aprovisionados por ti y no por Anthropic.
  • Un cliente de sandbox propio contra tu propia infraestructura, para cuando ninguno de los cuatro proveedores gestionados encaja en el contrato que tienes que firmar.

Dimensionado por agentes simultáneos, no a ojo

Anthropic pone el mínimo en 1 GiB de RAM, 1 CPU y 5 GiB de disco por agente, y el tamaño del host en (RAM del host menos overhead) dividido por tu techo medido por sesión. El mínimo es un mínimo: mide el RSS de pico en una sesión representativa con tu duración real antes de fiarte de estos recuentos de agentes. Y conviene saberlo antes de optimizar el número equivocado: su propia documentación sitúa un contenedor mínimo cerca de 0,05 USD por hora, mientras que una sola sesión larga gasta dólares en tokens, así que esta factura no la decide la infraestructura.

Un primer runner
18.43
por mes

Pedir Ahora
unos 6 agentes simultáneos
4 vCPU
8 GB RAM
80 GB NVMe
1 IPv4 estática
1 copia incluida
Un runner de equipo
36.88
por mes

Pedir Ahora
unos 14 agentes simultáneos
8 vCPU
16 GB RAM
160 GB NVMe
1 IPv4 estática
1 copia incluida
Un pool con carga
59.92
por mes

Pedir Ahora
unos 30 agentes simultáneos
8 vCPU
32 GB RAM
160 GB NVMe
1 IPv4 estática, más por inquilino
1 copia incluida

Lo que no somos

  • No somos una plataforma de sandbox. Aquí no hay control plane, ni API de sesiones, ni panel de ejecuciones. El runner o el cliente de sandbox propio los traes tú; nosotros damos la máquina, la red y las direcciones que necesita.
  • No estamos afiliados a Anthropic. Claude, Claude Code y el Agent SDK son suyos, los runners autoalojados son una función de sus planes Team y Enterprise, y nada de esta página está avalado por ellos.
  • La inferencia del modelo tampoco es nuestra. Tu runner llama a api.anthropic.com, o a una región de Bedrock o Vertex en la UE cuando la residencia debe cubrir el prompt además del código.
  • Los tokens los factura quien sirve el modelo. Nuestra factura es la infraestructura, que según su documentación suele ser el número más pequeño por un orden de magnitud.
  • Un agente de código no necesita GPU: la inferencia ocurre del lado del proveedor del modelo. Si sirves un modelo tú mismo, esa es una conversación de GPU y otra página.

Las partes que los equipos descubren tarde

  • El estado de la sesión vive en el sistema de archivos del contenedor, así que todo lo que un usuario espera reanudar necesita un SessionStore. Sirve almacenamiento compatible con S3, Postgres o Redis en la misma red privada: el almacén recibe una copia y el disco local sigue siendo la fuente de verdad.
  • El almacén refleja solo las transcripciones. Los archivos de memoria CLAUDE.md y los artefactos del directorio de trabajo necesitan su propio volumen o una sincronización a almacenamiento de objetos, y es ese detalle el que convierte un reinicio limpio en una tarde perdida.
  • En producción el tráfico de salida debe pasar por un proxy que imponga una lista de dominios permitidos e inyecte las credenciales fuera del contenedor, así el agente hace la llamada y nunca tiene la clave.
  • El aislamiento multiinquilino es más que un directorio por inquilino: carga de ajustes desactivada, memoria automática desactivada, un directorio de configuración por inquilino y direcciones de salida distintas por inquilino. Ese último punto es la razón por la que un bróker de direcciones con su propio AS resulta un buen casero.
  • Las sesiones no expiran por sí solas: acótalas con maxTurns. La memoria crece a lo largo de una sesión larga, así que recicla los subprocesos en vez de confiar en que uno viva para siempre.
  • La telemetría sale del SDK si el entorno está configurado, y el colector podemos alojarlo junto a los runners en vez de enviar trazas a otro continente.

Un sandbox gestionado frente a un runner en tu propio hardware

Un servicio de sandbox gestionadoUn runner en DCXV
Dónde están el código y los archivosUna región del proveedor que puedes fijarUna máquina en Praga o Covilha que es tuya
Dónde están los registros y el estado de la colaA menudo no se puede fijar, aunque el cómputo sí lo estéLa misma máquina, o tu propio almacén al lado
Con quién firmas el contratoCon frecuencia una entidad estadounidense, con un DPAUna empresa chipriota, bajo derecho de la UE
Dirección de salida por inquilinoSalida compartida, cuando se expone siquieraUna IPv4 limpia por inquilino desde AS204057
Forma de facturaciónPor segundo o por peticiónFijo al mes, sin sorpresas tras una ejecución larga
Arranque en fríoMenos de un segundo, que es lo que quiere el trabajo efímeroUn host caliente: rápido de conectar, nada que aprovisionar
AislamientomicroVM o gVisor, gestionados por ellosDocker, gVisor o Firecracker, configurados por ti

Cómo empieza un pool de runners

1

Di cuántas sesiones corren a la vez

Concurrencia, cuánto dura una sesión y si los agentes manejan un navegador. Eso más un RSS de pico medido da el tamaño del host sin adivinar.

2

Entregamos el host

Praga o Covilha, direcciones estáticas, acceso root, en minutos. Trae tu propia imagen si tu runner ya está construido.

3

Apunta el runner hacia él

El comando de runner autoalojado para Claude Code, o tu cliente de sandbox propio para el Agent SDK. Nosotros somos el destino, no la herramienta.

4

Instantánea, y luego crecer a lo ancho

Las sesiones se fijan a un host por hashing consistente sobre el id de sesión, así que un pool escala añadiendo hosts y no agrandando uno.

Por qué elegirnos

  • Instalaciones certificadas Tier III, SLA de instalación del 99,982 %
  • Red propia, AS204057, IPv4 e IPv6
  • Soporte 24/7/365 con unos 10 minutos de respuesta media
  • Sociedad chipriota, jurisdicción de la UE, conforme al RGPD desde 2007

FAQ

- ¿Qué necesita realmente un runner de agente autoalojado?

Anthropic pone el mínimo en 1 GiB de RAM, 1 CPU y 5 GiB de disco por agente simultáneo, y el tamaño del host es la RAM del host menos overhead dividida por tu techo medido por sesión. Trata el mínimo como un mínimo y mide el RSS de pico en una sesión real con tu duración real. Hace falta HTTPS de salida al endpoint del modelo; de entrada solo lo que exponga tu propia aplicación

- ¿Puede la inferencia quedarse en la UE igual que el código?

El runner sí, por completo: tu código, los checkouts, las transcripciones y los registros están en una máquina en Praga o Covilha bajo contrato chipriota. Para la llamada al modelo, apunta el runner a una región de la UE de Amazon Bedrock (Fráncfort, Irlanda, París o Estocolmo) o a Vertex AI, que el SDK admite mediante su ajuste de endpoint regional. La API directa no tiene una residencia solo-UE que el cliente pueda elegir, así que si el prompt también debe quedarse en la UE, esa es la vía

- ¿En qué se diferencia esto de Modal, Daytona, Vercel o Cloudflare?

Esos son plataformas y esto es el metal que hay debajo de una. Ellos te dan un control plane y una API de sesiones; nosotros te damos hosts, aislamiento que configuras y direcciones que controlas. Dos diferencias prácticas si autoalojar es un requisito y no una preferencia: Daytona cerró su código en junio de 2026 y su control plane sigue corriendo en infraestructura de Daytona, y el autoalojamiento de E2B apunta a AWS y GCP. Una plataforma con bring-your-own-cloud también puede simplemente aterrizar en nosotros

- ¿Cuántos agentes caben en un host?

Con el mínimo de 1 GiB, unos seis en 8 GB, catorce en 16 GB y treinta en 32 GB si dejas margen para el sistema operativo. La automatización de navegador cambia eso mucho: Chromium se lleva de 2 a 4 GB por sesión, así que un agente que navega está más cerca de 4 GB que de 1 GB. Mide antes de fijar un número

- ¿Dais a cada inquilino su propia dirección de salida?

Sí, y es la razón para alojar agentes con un bróker de direcciones. Anthropic recomienda reglas de salida por inquilino, incluidas IP de salida distintas, para que un inquilino comprometido no pueda exfiltrar por la política de otro. Operamos AS204057, tenemos espacio IPv4 propio, mantenemos las cargas de agentes en pools separados del correo y de las direcciones destinadas a la venta, y puedes comprobar la reputación de cualquier bloque tú mismo antes de ponerlo en marcha

- ¿Cuánto cuesta?

Desde 18,43 EUR al mes por un primer runner con 4 vCPU y 8 GB, unos seis agentes simultáneos en el mínimo documentado; 36,88 EUR por 16 GB y 59,92 EUR por 32 GB, con una copia de seguridad incluida en cada uno. Hay bare metal si quieres aislamiento Firecracker o gVisor en hardware que nadie comparte. Y conviene mantener la proporción: la propia documentación de Anthropic sitúa un contenedor mínimo cerca de 0,05 USD por hora, mientras que una sesión larga gasta dólares en tokens

Si necesita asistencia o tiene preguntas adicionales, por favor contacte a los gerentes o escriba al equipo de soporte en support@dcxv.com

Servidores en la nube desde 15 €/mes

Pedir Ahora