Sirva modelos abertos à sua equipa e às suas aplicações a partir de um só servidor, num plano mensal fixo em vez de pagar por token.
*IVA excluído.
INCLUÍDO EM CADA PLANO
O Ollama puxa modelos abertos e serve-os atrás de uma API local. Um só comando põe a correr o Llama, o Qwen, o Gemma, o DeepSeek ou o gpt-oss. O endpoint na porta 11434 fala o formato OpenAI, por isso a maior parte do código de cliente existente aponta para lá só com uma mudança de URL. O projeto tem licença MIT.
O Open WebUI é a interface de chat que vem no mesmo template. Trata dos logins, do carregamento de documentos para RAG e das permissões por grupo. Também fala com qualquer backend compatível com OpenAI, por isso o Ollama não tem de ser a única coisa por trás. Correr os dois no seu próprio VPS mantém os prompts, os documentos carregados e os pesos dos modelos num disco que você aluga em vez de um de um fornecedor.
Aponte o LangChain ou o seu próprio cliente Python para a porta 11434 e funciona.
Puxe o DeepSeek, o Qwen, o Gemma ou o gpt-oss e troque entre eles em segundos.
Carregue documentos, dê um login a cada colega e defina ao que cada um chega.
O Open WebUI dá a todos um login e uma interface que já percebem, enquanto o modelo corre no seu servidor. Nada é enviado a terceiros para treino. É o administrador que decide a que modelos cada grupo chega.
Aponte o LangChain, um serviço em Python ou um plugin do IDE para a API do Ollama e troque a base URL. O mesmo código que corria contra um fornecedor comercial continua a funcionar. A fatura deixa de crescer com o uso.
A escolha do modelo é na verdade uma questão de memória. As builds pequenas quantizadas cabem à vontade na RAM de um servidor com CPU. As versões maiores querem vRAM antes de ficarem utilizáveis a velocidade de conversa. Comece pequeno, meça e depois dimensione a máquina para o modelo em que assentar.
A imagem do contentor mantém o runtime separado de tudo o resto na máquina, o que torna simples fixar versões e reverter. Corre da mesma forma num VPS normal ou num Docker VPS com o runtime já instalado.
Agentes e fluxos de trabalho queimam tokens depressa, e é aí que um servidor mensal fixo começa a ganhar às chamadas de API medidas. Uma instância n8n ou um agente OpenClaw pode chamar o seu endpoint do Ollama na mesma rede privada.
A inferência em CPU serve bem para modelos pequenos e rapidamente deixa de servir acima disso. Um GPU VPS com passthrough completo corre as versões maiores a velocidade de conversa. É a mesma conta, por isso subir não significa reconstruir seja o que for.
Implementa qualquer template e especialistas certificados cobrem tudo ao nível do servidor, 24/7 e em várias línguas. Está incluído em cada plano, aperfeiçoado ao longo de 17 anos a gerir infraestrutura.
Faça o protótipo em cores EPYC com um modelo pequeno quantizado e depois mova a mesma configuração para um GPU VPS quando precisar de vRAM a sério. Está tudo numa conta e num painel, por isso não há migração para agendar.
Os ficheiros de modelos chegam às dezenas de gigabytes e uma biblioteca a sério enche um disco num instante. Root completo em KVM mais armazenamento NVMe significa que é você que decide o que se puxa, o que se apaga e com que runtime flags o Ollama arranca.
Puxar um modelo é um download grande. Servir uma API a uma equipa é um fluxo constante. O tráfego é ilimitado numa porta de 1 Gbps, por isso nenhum dos dois aparece como linha na fatura.
Os prompts e os documentos carregados vivem onde o servidor está, o que pesa mais na inferência do que na maioria das coisas que alojaria por conta própria. Nove localizações na Europa, no Reino Unido e nos EUA significa que escolhe isso logo na página de encomenda.

Bom preço pelo que recebes
2025-12-29"Uso os serviços deles há algum tempo e tem sido ótimo. O desempenho é bom e fiável, e o preço torna tudo ainda melhor. Funciona tudo sem problemas e são muito rápidos a responder quando precisas de alguma coisa."
Equipa e empresa fantásticas
2025-03-01"Equipa e empresa fantásticas. À medida que vão alargando a disponibilidade dos serviços a outras regiões do mundo, continuam a elevar o nível de qualidade e de eficiência."
A configuração foi rápida e o...
2025-09-01"A configuração foi rápida e o VPS tem estado a correr sem sobressaltos desde então. O apoio ao cliente respondeu às minhas questões sem complicar as coisas, e sinceramente adorei isso."
A LumaDock oferece alojamento VPS, GPU e servidores dedicados rápido e acessível para programadores, empresas e gamers, com armazenamento NVMe e AMD EPYC.
A LumaDock® é uma marca registada da LumaDock LTD, sediada em Londres W1S 1HN, Reino Unido, e registada em Inglaterra e País de Gales sob o número de empresa 15844051.