Servi modelli aperti al tuo team e alle tue applicazioni da un solo server, con un piano mensile fisso invece del prezzo a token.
*IVA esclusa.
INCLUSO IN OGNI PIANO
Ollama scarica modelli aperti e li serve dietro un'API locale. Basta un comando per far girare Llama, Qwen, Gemma, DeepSeek o gpt-oss. L'endpoint sulla porta 11434 parla il formato OpenAI, quindi quasi tutto il codice client esistente ci punta cambiando solo l'URL. Il progetto ha licenza MIT.
Open WebUI è l'interfaccia di chat che arriva nello stesso template. Gestisce gli accessi, il caricamento dei documenti per il RAG e i permessi per gruppo. Parla anche con qualsiasi backend compatibile con OpenAI, quindi dietro non deve esserci per forza solo Ollama. Far girare entrambi sul tuo VPS tiene i prompt, i documenti caricati e i pesi dei modelli su un disco che affitti tu invece che su quello di un fornitore.
Punta LangChain o il tuo client Python alla porta 11434 e funziona.
Scarica DeepSeek, Qwen, Gemma o gpt-oss e passa dall'uno all'altro in pochi secondi.
Carica documenti, dai un accesso a ogni collega e stabilisci cosa può raggiungere.
Open WebUI dà a tutti un accesso e un'interfaccia che già conoscono, mentre il modello gira sul tuo server. Niente viene mandato a terzi per l'addestramento. È l'amministratore a decidere quali modelli può raggiungere ogni gruppo.
Punta LangChain, un servizio Python o un plugin dell'IDE all'API di Ollama e cambia la base URL. Lo stesso codice che girava contro un fornitore commerciale continua a funzionare. E la fattura smette di crescere con l'uso.
La scelta del modello è in realtà una questione di memoria. Le build quantizzate piccole stanno comode nella RAM di un server con CPU. Le release più grandi vogliono vRAM prima di essere usabili a velocità di conversazione. Parti in piccolo, misura, poi dimensiona la macchina sul modello su cui ti fermi.
L'immagine del container tiene il runtime separato da tutto il resto della macchina, il che rende semplice fissare le versioni e tornare indietro. Gira allo stesso modo su un VPS normale o su un Docker VPS con il runtime già installato.
Agent e workflow bruciano token in fretta, ed è lì che un server mensile a costo fisso inizia a battere le chiamate API a consumo. Un'istanza n8n o un agent OpenClaw può chiamare il tuo endpoint Ollama sulla stessa rete privata.
L'inferenza su CPU va benissimo per i modelli piccoli e smette in fretta di andare bene sopra quella soglia. Un GPU VPS con passthrough completo fa girare le release più grandi a velocità di conversazione. È lo stesso account, quindi salire non significa ricostruire nulla.
Distribuisci qualsiasi template e specialisti certificati coprono tutto a livello di server, 24/7 e in più lingue. È incluso in ogni piano, affinato in 17 anni di gestione dell'infrastruttura.
Prototipa su core EPYC con un modello quantizzato piccolo, poi sposta la stessa configurazione su un GPU VPS quando serve vRAM vera. Tutto sta in un unico account e in un'unica dashboard, quindi non c'è nessuna migrazione da programmare.
I file dei modelli arrivano a decine di gigabyte e una libreria seria riempie un disco in fretta. Root completo su KVM più storage NVMe significa che sei tu a decidere cosa scaricare, cosa eliminare e con quali runtime flags parte Ollama.
Scaricare un modello è un download pesante. Servire un'API a un team è un flusso costante. Il traffico è illimitato su una porta da 1 Gbps, così nessuno dei due compare come voce in fattura.
I prompt e i documenti caricati vivono dove sta il server, e nell'inferenza questo pesa più che nella maggior parte delle cose che ospiteresti da solo. Nove località tra Europa, Regno Unito e Stati Uniti significa che scegli tu al momento dell'ordine.

Buon prezzo per quello che offre
2025-12-29"Uso i loro servizi da un po' ed è stata un'ottima esperienza. Le prestazioni sono buone e affidabili, e il prezzo rende il tutto ancora più interessante. Funziona tutto in modo fluido e sono molto reattivi quando hai bisogno di qualcosa."
Team e azienda fantastici
2025-03-01"Team e azienda fantastici. Mentre estendono la disponibilità dei servizi ad altre regioni del mondo, continuano a crescere in qualità ed efficienza."
La configurazione è stata rapida e il...
2025-09-01"La configurazione è stata rapida e il VPS da allora gira senza intoppi. L'assistenza clienti ha risposto alle mie domande senza complicare le cose, e francamente mi ha fatto piacere."