Servírujte otevřené modely svému týmu i svým aplikacím z jednoho serveru, za pevný měsíční tarif místo platby za token.
*Bez DPH.
SOUČÁSTÍ KAŽDÉHO PLÁNU
Ollama stahuje otevřené modely a servíruje je za lokálním API. Jediný příkaz rozjede Llamu, Qwen, Gemmu, DeepSeek nebo gpt-oss. Endpoint na portu 11434 mluví formátem OpenAI, takže většina existujícího klientského kódu na něj míří po změně URL. Projekt je pod licencí MIT.
Open WebUI je chatovací rozhraní, které přichází ve stejné šabloně. Řeší přihlašování, nahrávání dokumentů pro RAG i oprávnění po skupinách. Umí mluvit i s jakýmkoli backendem kompatibilním s OpenAI, takže za ním nemusí stát jenom Ollama. Když si obojí provozujete na vlastním VPS, prompty, nahrané dokumenty i váhy modelů zůstávají na disku, který si pronajímáte vy, ne dodavatel.
Namiřte LangChain nebo vlastního Python klienta na port 11434 a funguje to.
Stáhněte DeepSeek, Qwen, Gemmu nebo gpt-oss a přepínejte mezi nimi během vteřin.
Nahrajte dokumenty, dejte každému kolegovi přihlášení a nastavte, kam smí.
Open WebUI dá každému přihlášení a rozhraní, které už znají, zatímco model běží na vašem serveru. Nic se neposílá třetí straně na trénink. Správce rozhoduje, ke kterým modelům se která skupina dostane.
Namiřte LangChain, Python službu nebo plugin ve vývojovém prostředí na Ollama API a vyměňte base URL. Stejný kód, který běžel proti komerčnímu poskytovateli, funguje dál. Účet přestane růst s používáním.
Výběr modelu je ve skutečnosti otázka paměti. Malé kvantizované buildy se pohodlně vejdou do RAM na procesorovém serveru. Větší vydání chtějí vRAM, než začnou být použitelná konverzační rychlostí. Začněte v malém, změřte to a pak nastavte stroj podle modelu, u kterého zůstanete.
Kontejnerový image drží runtime oddělený od všeho ostatního na stroji, takže je přišpendlení verze i návrat zpátky jednoduchý. Běží stejně na běžném VPS i na Docker VPS s předinstalovaným runtime.
Agenti a workflow spotřebují tokeny rychle, a právě tam začne pevný měsíční server porážet měřená API volání. Instance n8n nebo agent OpenClaw můžou volat váš Ollama endpoint ve stejné privátní síti.
Inference na procesoru je pro malé modely v pořádku a nad nimi rychle v pořádku být přestane. GPU VPS s plným passthrough utáhne větší vydání konverzační rychlostí. Je to stejný účet, takže posun nahoru neznamená nic přestavovat.
Nasaďte jakoukoli šablonu a certifikovaní specialisté se postarají o vše na úrovni serveru, 24/7 a ve více jazycích. Je součástí každého plánu, vypilovaná za 17 let provozu infrastruktury.
Prototypujte na EPYC jádrech s malým kvantizovaným modelem a pak přesuňte stejné nastavení na GPU VPS, jakmile bude potřebovat skutečnou vRAM. Všechno sedí v jednom účtu a jednom dashboardu, takže není co plánovat za migraci.
Soubory modelů jdou do desítek gigabajtů a pořádná knihovna zaplní disk raz dva. Plný root na KVM plus NVMe úložiště znamená, že vy rozhodujete, co se stáhne, co se smaže a s jakými runtime flags se Ollama spustí.
Stažení modelu je velký download. Servírování API celému týmu je vytrvalý přenos. Provoz je neomezený na 1 Gbps portu, takže ani jedno se na faktuře neobjeví jako položka.
Prompty a nahrané dokumenty žijí tam, kde stojí server, což u inference váží víc než u většiny věcí, které byste si hostovali sami. Devět lokalit napříč Evropou, Británií a USA znamená, že si to vyberete rovnou v objednávce.

Dobrá cena za to, co dostaneš
2025-12-29"Jejich služby používám už nějakou dobu a je to super. Výkon je dobrý a spolehlivý, cena to ještě víc podtrhuje. Všechno prostě běží hladce a když něco potřebuješ, reagují rychle."
Skvělý tým a společnost
2025-03-01"Skvělý tým a společnost. Jak dál rozšiřují dostupnost služeb do dalších částí světa, pokračují v práci na vysoké úrovni a efektivitě."
Nastavení bylo rychlé a...
2025-09-01"Nastavení bylo rychlé a VPS od té doby běží bez problémů. Zákaznická podpora mi odpověděla na otázky bez zbytečných komplikací, což jsem upřímně ocenil."
LumaDock nabízí rychlý a cenově dostupný VPS, GPU a dedikovaný server hosting pro vývojáře, firmy i hráče, postavený na NVMe úložišti a AMD EPYC.
LumaDock® je registrovaná ochranná známka společnosti LumaDock LTD se sídlem v Londýně W1S 1HN, Spojené království, zapsané v Anglii a Walesu pod číslem společnosti 15844051.
GPU products are in high demand at the moment. Fill the form to get notified as soon as your preferred GPU server is back in stock.
We'll notify you when your preferred server is back in stock.