Server per agenti AI
Un agente che gira solo mentre il tuo portatile è aperto non sta davvero girando. Questa è una macchina che resta accesa, nell'UE, con le tue chiavi sopra e nessun altro.
Per chi è
Chi gestisce un agente assistente personale
È collegato ai tuoi messenger e al tuo calendario, ed è offline ogni volta che chiudi il coperchio o cade il wifi.
Un team che automatizza il lavoro con gli agenti
L'automazione gira sul portatile di qualcuno, nessun altro può raggiungerla, e quando quella persona è in vacanza si ferma.
Chi non vuole che i prompt lascino l'Europa
Il lavoro riguarda dati dei clienti, e inviare ogni prompt a un'API fuori dall'UE non è qualcosa che l'ufficio legale approverà.
Cosa ci esegui
- OpenClaw, l'agente assistente personale, resta online e raggiungibile dai tuoi messenger, non solo mentre un portatile è aperto
- Hermes, la famiglia di modelli a pesi aperti, servita in locale tramite vLLM, Ollama o llama.cpp così i prompt non lasciano mai la macchina
- Altri modelli a pesi aperti alle stesse condizioni: Llama, Qwen, Mistral, DeepSeek, GLM
- Framework e scheduler per agenti: n8n, LangGraph, CrewAI, o un semplice cron che chiama il tuo script
- Un endpoint di inferenza privato sulla tua rete, così gli altri tuoi servizi parlano con lui e non con un'API di terzi
- Lo storage vettoriale e la memoria dell'agente accanto, sullo stesso disco, con backup notturno
Dimensionato in base a cosa l'agente deve tenere in memoria
Un agente che chiama un modello esterno è piccolo: sta soprattutto ad aspettare la rete. Servire un modello da soli è l'opposto, ed è la memoria a decidere cosa ci sta. Un modello 8B quantizzato gira in queste dimensioni su CPU; qualsiasi cosa più grande, o che debba essere veloce, vuole una GPU, che quotiamo separatamente come su /gpu-server.
Cosa è incluso e cosa no
- I pesi dei modelli e le chiavi API non sono inclusi. I modelli a pesi aperti li scarichi tu sotto le loro licenze, e un'API commerciale resta sul tuo account.
- L'accelerazione GPU non è compresa in questi prezzi. L'inferenza su CPU va bene per un modello piccolo quantizzato ed è lenta per tutto il resto, quindi chiedi e quotiamo la scheda adatta.
- Non è una piattaforma gestita per agenti. È un server con accesso root: runtime, modello e calendario degli aggiornamenti li scegli tu.
- Un agente non è un'eccezione alla politica di uso accettabile. L'invio massivo, lo scraping su larga scala e il test di credenziali sono esclusi, chiunque o qualunque cosa li avvii.
- Non ispezioniamo cosa fa il tuo agente. Questo significa anche che non possiamo fare debug al posto tuo, a meno che non acquisti l'amministrazione del server.
Far girare un agente che nessuno sta guardando
- Il senso è proprio che non si spenga. Un agente personale si giudica dal fatto che abbia risposto mentre dormivi, e questa è una questione di hosting, non di modello.
- Dagli una macchina sua. Un agente conserva sessioni di messaggistica, chiavi API e spesso permessi di scrittura, e nulla di questo dovrebbe stare accanto al tuo database di produzione.
- Snapshot prima di ogni aggiornamento. I progetti di agenti si muovono in fretta e rompono il proprio stato; un ripristino in due clic costa meno che ricostruire una memoria.
- Tieni d'occhio il traffico in uscita. Un agente che naviga da un indirizzo sporco raccoglie captcha e blocchi, quindi i nostri sono puliti e puoi impostarci il rDNS.
- Metti un tetto alla spesa. Un agente in loop di retry verso un'API a pagamento è il bug più costoso di questo campo, e il limite va sulla chiave, non nel prompt.
- Tenere il modello in locale è ciò che rende breve la conversazione sul GDPR: prompt, contesto e output non lasciano mai una struttura Tier III nell'UE.
Un servizio di agenti ospitato contro il tuo server
| Servizio di agenti ospitato | Il tuo server DCXV | |
|---|---|---|
| Dove finiscono i prompt | Attraverso il provider, dove che sia | Da nessuna parte, se servi il modello tu |
| Quale agente puoi eseguire | Solo quelli supportati dalla piattaforma | Qualsiasi cosa giri su Linux |
| Versione e momento dell'aggiornamento | Quando lo decide la piattaforma | Quando lo decidi tu |
| Chiavi e sessioni di messaggistica | Le conserva il provider | Sul tuo disco, sotto il tuo root |
| Riprendersi da un aggiornamento andato male | Aprire un ticket | Ripristino dello snapshot in due clic |
| Costo | A postazione, a esecuzione o a token | Da 15 EUR/mese, mensile, senza vincoli |
Come partire
Dicci cosa fa l'agente
Se chiama un modello esterno o ne serve uno proprio, e se gli serve un browser. Basta questo per scegliere la dimensione.
Ti consegniamo il server
Una VM cloud a Praga o Covilhã con indirizzo statico e accesso root, attivata in pochi minuti. Se preferisci, avvia dalla tua ISO.
Installa l'agente e fissa la versione
Un utente dedicato, una directory dedicata, i segreti fuori dal repository e un limite di spesa su ogni chiave a pagamento prima di lasciarlo senza supervisione.
Snapshot, poi lascialo girare
Fai lo snapshot quando funziona. Ogni aggiornamento successivo è un ripristino in due clic invece di una serata persa.
Perché sceglierci
- Strutture certificate Tier III, SLA della struttura 99,982 %
- Rete propria, AS204057, IPv4 e IPv6
- Supporto 24/7/365 con circa 10 minuti di risposta media
- Società cipriota, giurisdizione UE, conforme al GDPR dal 2007
FAQ
- Quanto costa un server per un agente AI?
Da 15 EUR al mese per un agente che chiama un modello esterno: 2 vCPU, 4 GB di RAM, 40 GB NVMe e un IPv4 statico. Aggiungi browser e store vettoriale e sono 18,43 EUR per 8 GB. Servire un modello 8B quantizzato sulla macchina stessa costa 59,92 EUR per 8 vCPU e 32 GB. L'accelerazione GPU si quota a parte
- Posso eseguirci OpenClaw?
Sì, e un server sempre accesso è esattamente ciò che manca all'agente su un portatile: resta raggiungibile dai tuoi messenger mentre dormi, e non solo mentre il coperchio è aperto. Gira con un utente dedicato in una directory dedicata, le chiavi le tieni tu, e uno snapshot prima di ogni aggiornamento fa di una release sbagliata un ripristino e non una memoria da ricostruire
- Posso self-hostare Hermes o un altro modello a pesi aperti?
Sì. Hermes, Llama, Qwen, Mistral, DeepSeek e GLM si servono tutti in locale tramite vLLM, Ollama o llama.cpp. Un modello 8B quantizzato è utilizzabile su CPU nella nostra taglia da 32 GB; qualsiasi cosa più grande, o che debba rispondere in fretta, vuole una GPU, e abbiamo NVIDIA L4, L40S, A40, A100 e H100. I pesi li scarichi tu sotto le loro licenze
- I miei prompt lasciano l'UE?
No, se servi il modello tu. Il prompt, il contesto e l'output restano su una macchina in una struttura Tier III a Praga o Covilhã, ed è questo che rende breve la conversazione sulla compliance. Se invece il tuo agente chiama un'API di terzi, quel traffico va dove si trova quel provider, e vale la pena verificarlo prima che siano coinvolti dati dei clienti
- Il mio agente verrà bloccato o riceverà captcha quando naviga?
Dipende dalla reputazione dell'indirizzo da cui naviga, che è la parte che la maggior parte degli host ignora. Siamo broker autorizzato RIPE NCC e gestiamo spazio nostro sotto AS204057, quindi gli indirizzi sono puliti e sul tuo puoi impostare il rDNS. È l'unico vantaggio qui che un reseller non può copiare
- Posso usarlo per scraping o invii massivi?
No. Un agente che lo fa è lo stesso di una persona che lo fa: lo scraping su larga scala, il test di credenziali e l'invio massivo non richiesto sono fuori dalla nostra politica di uso accettabile. Inoltre teniamo i carichi degli agenti su intervalli di indirizzi separati dallo spazio destinato ai progetti di posta e alla vendita, così un inquilino abusivo non rovina un asset da cui dipendono altri clienti
Se hai bisogno di assistenza o hai domande aggiuntive, contatta i manager o scrivi al team di supporto a support@dcxv.com
Server cloud da 15 €/mese
Ordina Ora