Udostępniaj otwarte modele swojemu zespołowi i swoim aplikacjom z jednego serwera, w stałej opłacie miesięcznej zamiast rozliczania za token.
*Bez VAT.
DOSTĘPNE W KAŻDYM PLANIE
Ollama pobiera otwarte modele i udostępnia je za lokalnym API. Jedno polecenie uruchamia Llamę, Qwena, Gemmę, DeepSeeka albo gpt-oss. Endpoint na porcie 11434 mówi formatem OpenAI, więc większość istniejącego kodu klienta celuje w niego po zmianie samego adresu URL. Projekt jest na licencji MIT.
Open WebUI to interfejs czatu, który przychodzi w tym samym szablonie. Ogarnia logowanie, wysyłanie dokumentów pod RAG i uprawnienia per grupa. Rozmawia też z dowolnym backendem zgodnym z OpenAI, więc za nim nie musi stać wyłącznie Ollama. Uruchomienie obu na własnym VPS trzyma prompty, wgrane dokumenty i wagi modeli na dysku, który wynajmujesz ty, a nie jakiś dostawca.
Skieruj LangChaina albo własnego klienta w Pythonie na port 11434 i po prostu działa.
Pobierz DeepSeeka, Qwena, Gemmę albo gpt-oss i przełączaj się między nimi w kilka sekund.
Wgrywaj dokumenty, daj każdemu z zespołu login i ustal, do czego ma dostęp.
Open WebUI daje każdemu login i interfejs, który wszyscy już rozumieją, a model działa na twoim serwerze. Nic nie trafia do zewnętrznej firmy na trening. To administrator decyduje, do których modeli sięgnie dana grupa.
Skieruj LangChaina, usługę w Pythonie albo wtyczkę w IDE na API Ollamy i podmień base URL. Ten sam kod, który chodził przeciwko komercyjnemu dostawcy, dalej działa. A rachunek przestaje rosnąć razem z użyciem.
Wybór modelu to w istocie pytanie o pamięć. Małe skwantyzowane buildy spokojnie mieszczą się w RAM na serwerze z CPU. Większe wydania chcą vRAM, zanim staną się używalne w tempie rozmowy. Zacznij od małego, zmierz, a potem dobierz maszynę do modelu, przy którym zostajesz.
Obraz kontenera trzyma runtime z dala od wszystkiego innego na maszynie, przez co przypinanie wersji i cofanie zmian jest proste. Działa tak samo na zwykłym VPS jak na Docker VPS z gotowym runtime.
Agenty i workflow palą tokeny błyskawicznie, i właśnie tam stały miesięczny serwer zaczyna wygrywać z rozliczanymi wywołaniami API. Instancja n8n albo agent OpenClaw może wołać twój endpoint Ollamy w tej samej sieci prywatnej.
Inferencja na CPU jest w porządku przy małych modelach i powyżej tego szybko przestaje być w porządku. GPU VPS z pełnym passthrough ciągnie większe wydania w tempie rozmowy. To to samo konto, więc przejście wyżej nie oznacza budowania czegokolwiek od nowa.
Wdróż dowolny szablon, a certyfikowani specjaliści zajmą się wszystkim na poziomie serwera, 24/7 i w wielu językach. Jest w cenie każdego planu, dopracowane przez 17 lat utrzymywania infrastruktury.
Prototypuj na rdzeniach EPYC z małym skwantyzowanym modelem, a potem przenieś tę samą konfigurację na GPU VPS, kiedy zacznie potrzebować prawdziwego vRAM. Wszystko siedzi na jednym koncie i w jednym panelu, więc nie ma żadnej migracji do zaplanowania.
Pliki modeli sięgają dziesiątek gigabajtów, a porządna biblioteka zapełnia dysk w mgnieniu oka. Pełny root na KVM plus dysk NVMe oznacza, że to ty decydujesz, co zostaje pobrane, co usunięte i z jakimi runtime flags startuje Ollama.
Pobranie modelu to duże ściąganie. Serwowanie API zespołowi to stały strumień. Transfer jest nielimitowany na porcie 1 Gbps, więc żadne z nich nie pojawi się jako pozycja na fakturze.
Prompty i wgrane dokumenty mieszkają tam, gdzie stoi serwer, a przy inferencji waży to więcej niż przy większości rzeczy, które stawiasz u siebie. Dziewięć lokalizacji w Europie, Wielkiej Brytanii i USA oznacza, że wybierasz to już na stronie zamówienia.

Dobra cena za to, co dostajesz
2025-12-29"Korzystam z ich usług już od jakiegoś czasu i jestem bardzo zadowolony. Wydajność jest dobra i stabilna, a cena tylko to podkręca. Wszystko po prostu działa płynnie, a jak czegoś potrzebujesz, odpowiadają bardzo szybko."
Świetny zespół i firma
2025-03-01"Świetny zespół i firma. W miarę jak udostępniają swoje usługi w kolejnych regionach świata, rozwijają także jakość i efektywność działania."
Konfiguracja poszła szybko, a...
2025-09-01"Konfiguracja poszła szybko, a VPS od tamtej pory działa bez zarzutu. Obsługa klienta odpowiedziała na moje pytania bez niepotrzebnego komplikowania sprawy i szczerze mówiąc bardzo mi się to spodobało."
LumaDock oferuje szybki i przystępny cenowo hosting VPS, GPU oraz serwerów dedykowanych dla deweloperów, firm i graczy, oparty na pamięci NVMe i procesorach AMD EPYC.
LumaDock® jest zastrzeżonym znakiem towarowym LumaDock LTD z siedzibą w Londynie W1S 1HN, Wielka Brytania, zarejestrowanej w Anglii i Walii pod numerem spółki 15844051.