Servidor para agentes de IA

Um agente que só funciona enquanto o seu portátil está aberto não está realmente a funcionar. Esta é uma máquina que fica sempre ligada, na UE, com as suas chaves e mais ninguém.

Certificado Tier III ISO 9001 ISO/IEC 27001 ISO 14001 Conforme com o RGPD

Para quem é

Alguém que tem um agente assistente pessoal

Está ligado aos seus mensageiros e ao seu calendário, e fica offline sempre que fecha a tampa ou o wifi cai.

Uma equipa que automatiza trabalho com agentes

A automação corre no portátil de alguém, mais ninguém lhe chega, e quando essa pessoa está de férias para.

Quem não quer que os prompts saiam da Europa

O trabalho envolve dados de clientes, e enviar cada prompt para uma API fora da UE não é algo que o jurídico aprove.

O que executa nele

  • O OpenClaw, o agente assistente pessoal, mantém-se online e acessível pelos seus mensageiros, e não apenas enquanto um portátil está aberto
  • O Hermes, a família de modelos de pesos abertos, servido localmente por vLLM, Ollama ou llama.cpp para que os prompts nunca saiam da máquina
  • Outros modelos de pesos abertos nas mesmas condições: Llama, Qwen, Mistral, DeepSeek, GLM
  • Frameworks e agendadores de agentes: n8n, LangGraph, CrewAI, ou um simples cron que chama o seu próprio script
  • Um endpoint de inferência privado na sua própria rede, para que os seus outros serviços falem com ele e não com uma API de terceiros
  • Armazenamento vetorial e a memória do agente ao lado, no mesmo disco, com cópia de segurança noturna

Dimensionado pelo que o agente tem de manter em memória

Um agente que chama um modelo externo é pequeno: passa a maior parte do tempo à espera da rede. Servir um modelo por conta própria é o oposto, e a memória é o que decide o que cabe. Um modelo 8B quantizado corre nestes tamanhos em CPU; algo maior, ou que tenha de ser rápido, pede GPU, que orçamentamos em separado como em /gpu-server.

Um agente, modelo externo
15
por mês

Encomendar agora
Assistente que chama uma API, sempre ligado
2 vCPU
4 GB RAM
40 GB NVMe
1 IPv4 estático
1 cópia incluída
Agente com navegador e memória
18.43
por mês

Encomendar agora
Acesso web, armazenamento vetorial, várias ferramentas
4 vCPU
8 GB RAM
80 GB NVMe
1 IPv4 estático
1 cópia incluída
Modelo auto-alojado em CPU
59.92
por mês

Encomendar agora
8B quantizado servido localmente, nada sai da máquina
8 vCPU
32 GB RAM
160 GB NVMe
1 IPv4 estático
1 cópia incluída

O que está e não está incluído

  • Os pesos dos modelos e as chaves de API não estão incluídos. Os modelos de pesos abertos descarrega-os você sob as respetivas licenças, e uma API comercial fica na sua conta.
  • A aceleração por GPU não entra nestes preços. A inferência em CPU serve para um modelo pequeno quantizado e é lenta para o resto, por isso pergunte e orçamentamos a placa adequada.
  • Isto não é uma plataforma de agentes gerida. É um servidor com acesso root: o runtime, o modelo e o calendário de atualizações são escolhidos por você.
  • Um agente não é uma exceção à política de utilização aceitável. Os envios em massa, o scraping em grande escala e os testes de credenciais estão excluídos, seja quem ou o que os inicie.
  • Não inspecionamos o que o seu agente faz. Isso também significa que não o podemos depurar por você, salvo se contratar a administração do servidor.

Quando o agente trabalha e ninguém o vigia

  • O sentido é precisamente que não se apague. Um agente pessoal é avaliado por ter respondido enquanto dormia, e isso é uma questão de alojamento, não de modelo.
  • Dê-lhe uma máquina própria. Um agente guarda sessões de mensageiros, chaves de API e muitas vezes permissões de escrita, e nada disso deve estar ao lado da sua base de dados de produção.
  • Instantâneo antes de cada atualização. Os projetos de agentes avançam depressa e estragam o seu próprio estado; recuar em dois cliques é mais barato do que reconstruir um armazém de memória.
  • Vigie o tráfego de saída. Um agente que navega a partir de um endereço sujo apanha captchas e bloqueios, por isso os nossos estão limpos e pode definir rDNS neles.
  • Limite a despesa. Um agente num ciclo de tentativas contra uma API paga é o erro mais caro desta área, e o limite pertence à chave, não ao prompt.
  • Manter o modelo local é o que torna a conversa sobre o RGPD curta: o prompt, o contexto e a resposta nunca saem de uma instalação Tier III na UE.

Um serviço de agentes alojado versus o seu próprio servidor

Serviço de agentes alojadoO seu próprio servidor DCXV
Para onde vão os promptsPelo fornecedor, onde ele estejaA nenhum lugar, se servir o modelo você mesmo
Que agente pode executarApenas os que a plataforma suportaTudo o que corre em Linux
Versão e momento da atualizaçãoQuando a plataforma decideQuando você decide
Chaves e sessões de mensageirosGuardadas pelo fornecedorNo seu disco, sob o seu root
Recuperar de uma atualização falhadaAbrir um pedidoRecuo para o instantâneo em dois cliques
CustoPor utilizador, por execução ou por tokenDesde 15 EUR/mês, mensal, sem compromisso

Como começar

1

Diga o que o agente faz

Se chama um modelo externo ou serve um próprio, e se precisa de navegador. Isso basta para escolher o tamanho.

2

Entregamos o servidor

Uma VM cloud em Praga ou na Covilhã com endereço estático e acesso root, disponibilizada em minutos. Se preferir, arranque a partir da sua própria ISO.

3

Instale o agente e fixe a versão

O seu próprio utilizador, o seu próprio diretório, os segredos fora do repositório e um limite de gastos em qualquer chave paga antes de o deixar sem supervisão.

4

Instantâneo e deixe-o a correr

Tire o instantâneo quando já funcionar. Cada atualização seguinte é um recuo em dois cliques em vez de uma noite perdida.

Porquê escolher-nos

  • Instalações certificadas Tier III, SLA da instalação de 99,982 %
  • Rede própria, AS204057, IPv4 e IPv6
  • Suporte 24/7/365 com cerca de 10 minutos de resposta média
  • Empresa cipriota, jurisdição da UE, conforme o RGPD desde 2007

FAQ

- Quanto custa um servidor para um agente de IA?

Desde 15 EUR por mês para um agente que chama um modelo externo: 2 vCPU, 4 GB de RAM, 40 GB NVMe e um IPv4 estático. Junte navegador e armazenamento vetorial e são 18,43 EUR por 8 GB. Servir um modelo 8B quantizado na própria máquina são 59,92 EUR por 8 vCPU e 32 GB. A aceleração por GPU é orçamentada em separado

- Posso executar o OpenClaw nele?

Sim, e um servidor sempre ligado é precisamente o que falta ao agente num portátil: mantém-se acessível pelos seus mensageiros enquanto dorme, e não apenas enquanto a tampa está aberta. Corre com o seu próprio utilizador no seu próprio diretório, as chaves são suas, e um instantâneo antes de cada atualização torna uma má versão num recuo e não num armazém de memória reconstruído

- Posso auto-alojar o Hermes ou outro modelo de pesos abertos?

Sim. Hermes, Llama, Qwen, Mistral, DeepSeek e GLM servem todos localmente por vLLM, Ollama ou llama.cpp. Um modelo 8B quantizado é utilizável em CPU no nosso tamanho de 32 GB; algo maior, ou que tenha de responder depressa, pede GPU, e temos NVIDIA L4, L40S, A40, A100 e H100. Os pesos descarrega-os você sob as respetivas licenças

- Os meus prompts saem da UE?

Não, se servir o modelo você mesmo. O prompt, o contexto e a resposta ficam numa máquina numa instalação Tier III em Praga ou na Covilhã, e é isso que torna a conversa de conformidade curta. Se em vez disso o seu agente chamar uma API de terceiros, esse tráfego vai para onde esse fornecedor estiver, e vale a pena verificar antes de haver dados de clientes

- O meu agente vai ser bloqueado ou apanhar captchas quando navega?

Depende da reputação do endereço a partir do qual navega, que é a parte que a maioria dos alojamentos ignora. Somos corretor aprovado do RIPE NCC e operamos o nosso próprio espaço sob o AS204057, por isso os endereços estão limpos e no seu pode definir rDNS. É a única vantagem aqui que um revendedor não consegue copiar

- Posso usá-lo para scraping ou envios em massa?

Não. Um agente a fazê-lo é o mesmo que uma pessoa: o scraping em grande escala, os testes de credenciais e os envios em massa não solicitados estão fora da nossa política de utilização aceitável. Mantemos também as cargas de agentes em gamas de endereços separadas do espaço destinado a projetos de correio e à venda, para que um inquilino abusivo não estrague um ativo do qual outros clientes dependem

Se precisar de assistência ou tiver perguntas adicionais, por favor contacte os gestores ou escreva para a equipa de suporte em support@dcxv.com

Servidores na nuvem desde 15 €/mês

Encomendar agora