بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.

شعار Ollama

Ollama

شغّل نماذج اللغة الكبيرة مفتوحة المصدر على خادم VPS الخاص بك — واجهة متوافقة مع OpenAI، بلا تكلفة لكل توكن.

8 GB كحد أدنى (يُنصح بـ 16 GB) ذاكرة عشوائية 2 vCPU المنفذ 11434 متاح

المنظومة التقنية

DockerGollama.cpp
الحد الأدنى من RAM8 GB كحد أدنى (يُنصح بـ 16 GB)
الحد الأدنى من CPU2 vCPU
المنفذ الافتراضي11434
أنظمة التشغيل المتوافقةubuntu-24.04

Ollama هو بيئة تشغيل لنماذج اللغة الكبيرة مفتوحة المصدر تتيح لك تنزيل وتشغيل نماذج لغوية كبيرة (Llama 3، Mistral، Qwen، DeepSeek، Gemma) على بنيتك التحتية الخاصة بأمر واحد. يوفّر واجهة REST متوافقة مع OpenAI على المنفذ 11434، فأي أداة أو مكتبة تعمل مع OpenAI تعمل أيضًا مع نسختك المستضافة ذاتيًا — دون تغيير سطر واحد من الشيفرة.

عند نشره على خادم VPS من ServOrbit، يصبح Ollama واجهتك الخلفية الخاصة لاستدلال الذكاء الاصطناعي: طلبات غير محدودة بتكلفة شهرية ثابتة، مع بقاء جميع المُدخلات (prompts) والردود على خادمك. ويتكامل مباشرةً مع Open WebUI للحصول على واجهة محادثة، أو Flowise أو n8n للأتمتة، أو أي تطبيق مخصّص يستدعي `/v1/chat/completions`.

الميزات الرئيسية

واجهة متوافقة مع OpenAI — بدّل عنوان الأساس (base URL) وستعمل شيفرتك الحالية فورًا
إدارة النماذج بأمر واحد: ollama pull llama3.1:8b، ollama list، ollama rm
يدعم Llama 3 وMistral وQwen وDeepSeek وGemma وPhi وأكثر من 100 نموذج آخر
وضع المعالج المركزي (CPU) فقط يعمل جاهزًا؛ مع إمكانية تمرير كرت الرسوميات (GPU) اختياريًا لاستدلال أسرع
خادم متعدّد النماذج: حمّل عدة نماذج في آنٍ واحد، كلٌّ على منفذه أو سياقه الخاص
تخزين دائم للنماذج في وحدة تخزين Docker — تبقى النماذج بعد إعادة تشغيل الحاوية

متى تستخدم هذا الحل؟

1

واجهة خلفية خاصة للذكاء الاصطناعي

استبدل استدعاءات واجهة OpenAI بنقطة نهاية Ollama الخاصة بك. لا تغادر مُدخلاتك خادم VPS الخاص بك أبدًا — مثالي لمعالجة العقود أو المستندات الداخلية أو أي بيانات حساسة.

2

التطوير والاختبار محليًا

شغّل نموذجًا بحجم 7B أو 13B على خادم VPS مخصّص لبناء نماذج أولية لميزات الذكاء الاصطناعي قبل ربط نموذج لغوي في الإنتاج. تكلفة ثابتة، بلا فواتير مفاجئة، وأعد الضبط بـ ollama rm.

3

منظومة ذكاء اصطناعي مشتركة للفريق

اقرن Ollama مع Open WebUI لتمنح فريقك بأكمله واجهة مشتركة شبيهة بـ ChatGPT مدعومة بنماذج مفتوحة المصدر — على بنية تحتية تتحكّم بها.

نشر Ollama على خادم VPS الخاص بك

دليل محسّن لخوادم VPS Cloud من ServOrbit.

01

أنشئ خادم VPS

اطلب خادم VPS من ServOrbit بذاكرة 8 GB على الأقل لنموذج بـ 7 إلى 8 مليارات معامل مكمَّم بدقة Q4 على المعالج المركزي، و16 GB للنماذج الأكبر. والنظام المثبَّت هو Ubuntu 24.04. وللحصول على أزمنة استجابة بمستوى الإنتاج، يُحدث خادم مزوَّد بمعالج رسوميات فرقًا واضحًا في التجربة.

02

انشر Ollama

يُنشئ التثبيت من مساحة العميل حاوية ollama/ollama، ويركّب وحدة التخزين ollama على /root/.ollama كي تبقى نماذجك بعد إعادة التشغيل، وينشر الخدمة على واجهة الاسترجاع المحلية عند 127.0.0.1:11434. ولا شيء معرَّض للإنترنت في هذه المرحلة: وهذا مقصود، إذ لا يملك Ollama أي مصادقة على الإطلاق.

03

اتصل للمرة الأولى

لا توجد في Ollama شاشة تسجيل دخول: فهو واجهة برمجية HTTP مصحوبة بسطر أوامر. عبر SSH على الخادم، نفّذ docker exec -it ollama ollama pull llama3 ثم docker exec -it ollama ollama run llama3. ثم اربط واجهة استخدام، مثل Open WebUI، بدلًا من تعريض الواجهة البرمجية كما هي.

04

نزّل نموذجك الأول

اجلب نموذجًا بـ docker exec -it ollama ollama pull llama3.1:8b، وتحقّق من تسجيله بـ docker exec -it ollama ollama list، ثم اختبر من الخادم: curl http://127.0.0.1:11434/api/generate -d '{"model":"llama3.1:8b","prompt":"Hello"}'.

05

ضع في حسبانك غياب المصادقة

لا يطلب Ollama أي بيانات اعتماد ولا يعرف مفهوم مفتاح الواجهة البرمجية: فكل من يبلغ الخدمة يستطيع استجواب نماذجك وتنزيل نماذج أخرى. وبمجرد ربط نطاق، يضع ServOrbit مضيف nginx الافتراضي وشهادة TLS — غير أن التشفير يحمي النقل ولا يعرّف أحدًا. وهناك خياران يصمدان: ألّا تربط نطاقًا وتعمل عبر نفق SSH، أو أن تضع أمام Ollama بوابة تتولّى المصادقة، مثل LiteLLM، ولا تنشر سواها.

06

اربط أدواتك

في Open WebUI، افتح Settings ثم Connections وأدخل http://localhost:11434. ومن حزمة OpenAI SDK تعمل على الخادم نفسه، اضبط base_url='http://127.0.0.1:11434/v1' وapi_key='ollama'. ومن أي جهاز آخر، مُرّ عبر النطاق المربوط بالنسخة — base_url='https://<your-domain>/v1'. وبلا نطاق لا يوجد أي مدخل عام: افتح نفقًا عبر SSH بـ ssh -L 11434:127.0.0.1:11434 root@<your-vps-ip> ثم وجّه إلى http://localhost:11434/v1. وقد يُعاد تخصيص المنفذ عند التثبيت: اعتمد المنفذ المعروض في بطاقة التطبيق في مساحة العميل، فالمنفذ 11434 ليس إلا قيمة الكتالوج.

الأسئلة الشائعة

Ollama هو بيئة تشغيل مفتوحة المصدر تنزّل نماذج اللغة الكبيرة (LLM) وتشغّلها عبر واجهة REST محلية. اعتبره خادم استدلال محليًا: تنزّل النموذج مرة واحدة، ويمكن لأي تطبيق استدعاؤه تمامًا كما يستدعي واجهة OpenAI.

إضافة زر النشر

هل تدير مشروعًا يستخدم Ollama؟ يتيح هذا الزر لقرّائك نشره على خادم VPS بنقرة واحدة، دون قراءة وثائق Docker.

Deploy Ollama on ServOrbit
Markdown
[![Deploy Ollama on ServOrbit](https://servorbit.com/brand/deploy/button.svg)](https://servorbit.com/vps-cloud?template=ollama&utm_source=deploy-badge&utm_medium=referral&utm_campaign=ollama)
HTML
<a href="https://servorbit.com/vps-cloud?template=ollama&utm_source=deploy-badge&utm_medium=referral&utm_campaign=ollama"><img src="https://servorbit.com/brand/deploy/button.svg" alt="Deploy Ollama on ServOrbit" height="40"></a>

يشير الزر إلى طلب خادم ‎VPS مع تحديد القالب مسبقًا. تُقدَّم الصورة من ‎servorbit.com — لا شيء تستضيفه من جهتك.

بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.

فعّل Ollama على بنيتك التحتية.

خادم VPS Cloud مخصص — عنوان IPv4 مضمّن، مركز بيانات أوروبي، والدعم مضمّن. لا تغادر بياناتك خادمك أبدًا.

الإعداد الموصى به: 8 GB كحد أدنى (يُنصح بـ 16 GB) RAM · 2 vCPU

بحاجة إلى مساعدة؟

تصفّح مركز المساعدة والأسئلة الشائعة، أو تواصل مع فريقنا — معاودة اتصال أو WhatsApp أو بريد إلكتروني. الدعم بـ العربية والفرنسية والإنجليزية.