Server per agenti AI
Un agente che gira solo mentre il tuo portatile è aperto non sta davvero girando. Questa è una macchina che resta accesa, nell'UE, con le tue chiavi sopra e nessun altro.
Per chi è
Chi gestisce un agente assistente personale
È collegato ai tuoi messenger e al tuo calendario, ed è offline ogni volta che chiudi il coperchio o cade il wifi.
Un team che automatizza il lavoro con gli agenti
L'automazione gira sul portatile di qualcuno, nessun altro può raggiungerla, e quando quella persona è in vacanza si ferma.
Chi non vuole che i prompt lascino l'Europa
Il lavoro riguarda dati dei clienti, e inviare ogni prompt a un'API fuori dall'UE non è qualcosa che l'ufficio legale approverà.
Cosa ci esegui
- OpenClaw, l'agente assistente personale, resta online e raggiungibile dai tuoi messenger, non solo mentre un portatile è aperto
- Hermes, la famiglia di modelli a pesi aperti, servita in locale tramite vLLM, Ollama o llama.cpp così i prompt non lasciano mai la macchina
- Altri modelli a pesi aperti alle stesse condizioni: Llama, Qwen, Mistral, DeepSeek, GLM
- Framework e scheduler per agenti: n8n, LangGraph, CrewAI, o un semplice cron che chiama il tuo script
- Un endpoint di inferenza privato sulla tua rete, così gli altri tuoi servizi parlano con lui e non con un'API di terzi
- Lo storage vettoriale e la memoria dell'agente accanto, sullo stesso disco, con backup notturno
Dimensionato in base a cosa l'agente deve tenere in memoria
Un agente che chiama un modello esterno è piccolo: sta soprattutto ad aspettare la rete. Servire un modello da soli è l'opposto, ed è la memoria a decidere cosa ci sta. Un modello 8B quantizzato gira in queste dimensioni su CPU; qualsiasi cosa più grande, o che debba essere veloce, vuole una GPU, che quotiamo separatamente come su /gpu-server.
Cosa è incluso e cosa no
- I pesi dei modelli e le chiavi API non sono inclusi. I modelli a pesi aperti li scarichi tu sotto le loro licenze, e un'API commerciale resta sul tuo account.
- L'accelerazione GPU non è compresa in questi prezzi. L'inferenza su CPU va bene per un modello piccolo quantizzato ed è lenta per tutto il resto, quindi chiedi e quotiamo la scheda adatta.
- Non è una piattaforma gestita per agenti. È un server con accesso root: runtime, modello e calendario degli aggiornamenti li scegli tu.
- Un agente non è un'eccezione alla politica di uso accettabile. L'invio massivo, lo scraping su larga scala e il test di credenziali sono esclusi, chiunque o qualunque cosa li avvii.
- Non ispezioniamo cosa fa il tuo agente. Questo significa anche che non possiamo fare debug al posto tuo, a meno che non acquisti l'amministrazione del server.
Far girare un agente che nessuno sta guardando
- Il senso è proprio che non si spenga. Un agente personale si giudica dal fatto che abbia risposto mentre dormivi, e questa è una questione di hosting, non di modello.
- Dagli una macchina sua. Un agente conserva sessioni di messaggistica, chiavi API e spesso permessi di scrittura, e nulla di questo dovrebbe stare accanto al tuo database di produzione.
- Snapshot prima di ogni aggiornamento. I progetti di agenti si muovono in fretta e rompono il proprio stato; un ripristino in due clic costa meno che ricostruire una memoria.
- Tieni d'occhio il traffico in uscita. Un agente che naviga da un indirizzo sporco raccoglie captcha e blocchi, quindi i nostri sono puliti e puoi impostarci il rDNS.
- Metti un tetto alla spesa. Un agente in loop di retry verso un'API a pagamento è il bug più costoso di questo campo, e il limite va sulla chiave, non nel prompt.
- Tenere il modello in locale è ciò che rende breve la conversazione sul GDPR: prompt, contesto e output non lasciano mai una struttura Tier III nell'UE.
Un servizio di agenti ospitato contro il tuo server
| Servizio di agenti ospitato | Il tuo server DCXV | |
|---|---|---|
| Dove finiscono i prompt | Attraverso il provider, dove che sia | Da nessuna parte, se servi il modello tu |
| Quale agente puoi eseguire | Solo quelli supportati dalla piattaforma | Qualsiasi cosa giri su Linux |
| Versione e momento dell'aggiornamento | Quando lo decide la piattaforma | Quando lo decidi tu |
| Chiavi e sessioni di messaggistica | Le conserva il provider | Sul tuo disco, sotto il tuo root |
| Riprendersi da un aggiornamento andato male | Aprire un ticket | Ripristino dello snapshot in due clic |
| Costo | A postazione, a esecuzione o a token | Da 15 EUR/mese, mensile, senza vincoli |
Come partire
Dicci cosa fa l'agente
Se chiama un modello esterno o ne serve uno proprio, e se gli serve un browser. Basta questo per scegliere la dimensione.
Ti consegniamo il server
Una VM cloud a Praga o Covilhã con indirizzo statico e accesso root, attivata in pochi minuti. Se preferisci, avvia dalla tua ISO.
Installa l'agente e fissa la versione
Un utente dedicato, una directory dedicata, i segreti fuori dal repository e un limite di spesa su ogni chiave a pagamento prima di lasciarlo senza supervisione.
Snapshot, poi lascialo girare
Fai lo snapshot quando funziona. Ogni aggiornamento successivo è un ripristino in due clic invece di una serata persa.
Perché sceglierci
- Strutture certificate Tier III, SLA della struttura 99,982 %
- Rete propria, AS204057, IPv4 e IPv6
- Supporto 24/7/365 con circa 10 minuti di risposta media
- Società cipriota, giurisdizione UE, conforme al GDPR dal 2007
FAQ
Domande frequenti
Quanto costa un server per un agente AI?
Da 15 EUR al mese per un agente che chiama un modello esterno: 2 vCPU, 4 GB di RAM, 40 GB NVMe e un IPv4 statico. Aggiungi browser e store vettoriale e sono 18,43 EUR per 8 GB. Servire un modello 8B quantizzato sulla macchina stessa costa 59,92 EUR per 8 vCPU e 32 GB. L'accelerazione GPU si quota a parte
Posso eseguirci OpenClaw?
Sì, e un server sempre accesso è esattamente ciò che manca all'agente su un portatile: resta raggiungibile dai tuoi messenger mentre dormi, e non solo mentre il coperchio è aperto. Gira con un utente dedicato in una directory dedicata, le chiavi le tieni tu, e uno snapshot prima di ogni aggiornamento fa di una release sbagliata un ripristino e non una memoria da ricostruire
Posso self-hostare Hermes o un altro modello a pesi aperti?
Sì. Hermes, Llama, Qwen, Mistral, DeepSeek e GLM si servono tutti in locale tramite vLLM, Ollama o llama.cpp. Un modello 8B quantizzato è utilizzabile su CPU nella nostra taglia da 32 GB; qualsiasi cosa più grande, o che debba rispondere in fretta, vuole una GPU, e abbiamo NVIDIA L4, L40S, A40, A100 e H100. I pesi li scarichi tu sotto le loro licenze
I miei prompt lasciano l'UE?
No, se servi il modello tu. Il prompt, il contesto e l'output restano su una macchina in una struttura Tier III a Praga o Covilhã, ed è questo che rende breve la conversazione sulla compliance. Se invece il tuo agente chiama un'API di terzi, quel traffico va dove si trova quel provider, e vale la pena verificarlo prima che siano coinvolti dati dei clienti
Il mio agente verrà bloccato o riceverà captcha quando naviga?
Dipende dalla reputazione dell'indirizzo da cui naviga, che è la parte che la maggior parte degli host ignora. Siamo membro RIPE NCC e gestiamo spazio nostro sotto AS204057, quindi gli indirizzi sono puliti e sul tuo puoi impostare il rDNS. È l'unico vantaggio qui che un reseller non può copiare
Posso usarlo per scraping o invii massivi?
No. Un agente che lo fa è lo stesso di una persona che lo fa: lo scraping su larga scala, il test di credenziali e l'invio massivo non richiesto sono fuori dalla nostra politica di uso accettabile. Inoltre teniamo i carichi degli agenti su intervalli di indirizzi separati dallo spazio destinato ai progetti di posta e alla vendita, così un inquilino abusivo non rovina un asset da cui dipendono altri clienti
Se hai bisogno di assistenza o hai domande aggiuntive, contatta i manager o scrivi al team di supporto a support@dcxv.com
Pronto per iniziare?
- Fatturazione mensile
- Nessun costo di attivazione
- Nessun vincolo