قدّم النماذج المفتوحة لفريقك وتطبيقاتك من سيرفر واحد، بباقة شهرية ثابتة بدل الدفع لكل token.
*غير شامل لضريبة القيمة المضافة.
مضمّن في كل خطة
يسحب Ollama النماذج المفتوحة ويقدّمها خلف API محلي. أمر واحد يكفي لتشغيل Llama أو Qwen أو Gemma أو DeepSeek أو gpt-oss. والـ endpoint على المنفذ 11434 يتحدث بصيغة OpenAI، فمعظم أكواد العملاء الموجودة توجَّه إليه بتغيير الرابط فقط. والمشروع مرخّص تحت MIT.
أما Open WebUI فهو واجهة الدردشة التي تأتي في القالب نفسه. يتولى تسجيل الدخول ورفع المستندات لـ RAG والصلاحيات لكل مجموعة. كما يتحدث مع أي backend متوافق مع OpenAI، فلا يلزم أن يكون Ollama هو الشيء الوحيد خلفه. وتشغيلهما معاً على VPS خاص بك يبقي الـ prompts والمستندات المرفوعة وأوزان النماذج على قرص تستأجره أنت لا على قرص أي مزوّد.
وجّه LangChain أو عميل Python الخاص بك إلى المنفذ 11434 وسيعمل مباشرة.
اسحب DeepSeek أو Qwen أو Gemma أو gpt-oss وبدّل بينها خلال ثوانٍ.
ارفع المستندات، وامنح كل زميل حساباً، وحدّد ما يمكنه الوصول إليه.
يمنح Open WebUI الجميع حساباً وواجهة يفهمونها أصلاً، بينما يعمل النموذج على سيرفرك أنت. ولا يُرسل أي شيء إلى طرف ثالث لأغراض التدريب. والمشرف هو من يقرر أي النماذج تستطيع كل مجموعة الوصول إليها.
وجّه LangChain أو خدمة Python أو إضافة في محرر الأكواد إلى API الخاص بـ Ollama وبدّل الرابط الأساسي فقط. الكود نفسه الذي كان يعمل مع مزوّد تجاري يستمر في العمل. والفاتورة تتوقف عن التضخم مع الاستخدام.
اختيار النموذج هو في الحقيقة مسألة ذاكرة. النسخ الصغيرة المكمّمة تستقر بأريحية في الـ RAM على سيرفر معالج. أما الإصدارات الأكبر فتريد vRAM قبل أن تصبح قابلة للاستخدام بسرعة محادثة طبيعية. ابدأ صغيراً، وقِس، ثم اضبط حجم الجهاز على النموذج الذي استقررت عليه.
صورة الحاوية تبقي الـ runtime منفصلاً عن كل شيء آخر على الجهاز، ما يجعل تثبيت الإصدارات والتراجع عنها أمراً بسيطاً. ويعمل بالطريقة نفسها على VPS عادي أو على Docker VPS بالـ runtime مثبّتاً مسبقاً.
الوكلاء وسير العمل يحرقون الـ tokens بسرعة، وهنا يبدأ سيرفر شهري ثابت في التفوق على استدعاءات API المحسوبة. نسخة n8n أو وكيل OpenClaw يستطيع استدعاء endpoint الخاص بـ Ollama على الشبكة الخاصة نفسها.
الاستدلال على المعالج مناسب للنماذج الصغيرة، ويتوقف عن كونه مناسباً بسرعة فوق ذلك. GPU VPS مع passthrough كامل يشغّل الإصدارات الأكبر بسرعة محادثة طبيعية. وهو الحساب نفسه، فالانتقال لأعلى لا يعني إعادة بناء أي شيء.
انشر أي قالب ويتكفّل مختصّون معتمدون بكل شيء على مستوى الخادم، على مدار الساعة وبعدة لغات. مشمول مع كل خطة، مصقول عبر 17 عامًا من تشغيل البنية التحتية.
جرّب أولاً على أنوية EPYC بنموذج صغير مكمّم، ثم انقل الإعداد نفسه إلى GPU VPS حين يحتاج إلى vRAM حقيقية. كل شيء في حساب واحد ولوحة واحدة، فلا ترحيل تجدوله.
ملفات النماذج تصل إلى عشرات الجيجابايتات، ومكتبة جادة تملأ القرص بسرعة. صلاحية root كاملة على KVM مع تخزين NVMe تعني أنك من يقرر ما يُسحب وما يُحذف وبأي runtime flags يبدأ Ollama.
سحب نموذج تنزيل ضخم. وتقديم API لفريق كامل تدفق مستمر. الترافيك غير محدود على منفذ 1 Gbps، فلا يظهر أي منهما كسطر في الفاتورة.
الـ prompts والمستندات المرفوعة تعيش حيث يوجد السيرفر، وهذا يهم في الاستدلال أكثر مما يهم في معظم ما قد تستضيفه بنفسك. تسعة مواقع في أوروبا وبريطانيا والولايات المتحدة تعني أنك تختار ذلك في صفحة الطلب.

سعر ممتاز مقابل ما تحصل عليه
2025-12-29"أستخدم خدماتهم منذ فترة وقد كانت التجربة رائعة. الأداء جيد وموثوق، والسعر يجعل الأمر أفضل. كل شيء يعمل بسلاسة، وهم سريعو الاستجابة إذا احتجت أي شيء."
فريق وشركة مذهلان
2025-03-01"فريق وشركة مذهلان، ومع توسعهم بإتاحة الخدمات في مناطق أخرى من العالم، يواصلون التقدم في التميز والكفاءة."
الإعداد كان سريعًا و...
2025-09-01"الإعداد كان سريعًا وVPS يعمل بسلاسة منذ ذلك الحين. فريق الدعم أجاب عن أسئلتي دون تعقيد الأمور، وهذا ما أعجبني بصراحة."
GPU products are in high demand at the moment. Fill the form to get notified as soon as your preferred GPU server is back in stock.
We'll notify you when your preferred server is back in stock.