بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.

Logo Ollama

Ollama

شغّل نماذج اللغة الكبيرة مفتوحة المصدر على خادم VPS الخاص بك — واجهة متوافقة مع OpenAI، بلا تكلفة لكل توكن.

8 GB كحد أدنى (يُنصح بـ 16 GB) RAM 2 vCPU Port 11434 متاح

المنظومة التقنية

DockerGollama.cpp
الحد الأدنى من RAM8 GB كحد أدنى (يُنصح بـ 16 GB)
الحد الأدنى من CPU2 vCPU
المنفذ الافتراضي11434
أنظمة التشغيل المتوافقةubuntu-24.04

Ollama هو بيئة تشغيل لنماذج اللغة الكبيرة مفتوحة المصدر تتيح لك تنزيل وتشغيل نماذج لغوية كبيرة (Llama 3، Mistral، Qwen، DeepSeek، Gemma) على بنيتك التحتية الخاصة بأمر واحد. يوفّر واجهة REST متوافقة مع OpenAI على المنفذ 11434، فأي أداة أو مكتبة تعمل مع OpenAI تعمل أيضًا مع نسختك المستضافة ذاتيًا — دون تغيير سطر واحد من الشيفرة.

عند نشره على خادم VPS من ServOrbit، يصبح Ollama واجهتك الخلفية الخاصة لاستدلال الذكاء الاصطناعي: طلبات غير محدودة بتكلفة شهرية ثابتة، مع بقاء جميع المُدخلات (prompts) والردود على خادمك. ويتكامل مباشرةً مع Open WebUI للحصول على واجهة محادثة، أو Flowise أو n8n للأتمتة، أو أي تطبيق مخصّص يستدعي `/v1/chat/completions`.

الميزات الرئيسية

واجهة متوافقة مع OpenAI — بدّل عنوان الأساس (base URL) وستعمل شيفرتك الحالية فورًا
إدارة النماذج بأمر واحد: `ollama pull llama3.1:8b`، `ollama list`، `ollama rm`
يدعم Llama 3 وMistral وQwen وDeepSeek وGemma وPhi وأكثر من 100 نموذج آخر
وضع المعالج المركزي (CPU) فقط يعمل جاهزًا؛ مع إمكانية تمرير كرت الرسوميات (GPU) اختياريًا لاستدلال أسرع
خادم متعدّد النماذج: حمّل عدة نماذج في آنٍ واحد، كلٌّ على منفذه أو سياقه الخاص
تخزين دائم للنماذج في وحدة تخزين Docker — تبقى النماذج بعد إعادة تشغيل الحاوية

متى تستخدم هذا الحل؟

1

واجهة خلفية خاصة للذكاء الاصطناعي

استبدل استدعاءات واجهة OpenAI بنقطة نهاية Ollama الخاصة بك. لا تغادر مُدخلاتك خادم VPS الخاص بك أبدًا — مثالي لمعالجة العقود أو المستندات الداخلية أو أي بيانات حساسة.

2

التطوير والاختبار محليًا

شغّل نموذجًا بحجم 7B أو 13B على خادم VPS مخصّص لبناء نماذج أولية لميزات الذكاء الاصطناعي قبل ربط نموذج لغوي في الإنتاج. تكلفة ثابتة، بلا فواتير مفاجئة، وأعد الضبط بـ `ollama rm`.

3

منظومة ذكاء اصطناعي مشتركة للفريق

اقرن Ollama مع Open WebUI لتمنح فريقك بأكمله واجهة مشتركة شبيهة بـ ChatGPT مدعومة بنماذج مفتوحة المصدر — على بنية تحتية تتحكّم بها.

نشر Ollama على خادم VPS الخاص بك

دليل محسّن لخوادم VPS Cloud من ServOrbit.

01

أنشئ خادم VPS

اطلب خادم VPS من ServOrbit بذاكرة 8 GB على الأقل (لنموذج 7B/8B بترميز Q4 في وضع المعالج المركزي) أو 16 GB للنماذج الأكبر. يُنصح بنظام Ubuntu 22.04. وللحصول على زمن استجابة بمستوى الإنتاج، يُحدث خادم VPS مزوّد بكرت رسوميات GPU فرقًا كبيرًا في التجربة.

02

انشر Ollama

اتصل عبر SSH ونفّذ: docker run -d -v ollama:/root/.ollama -p 127.0.0.1:11434:11434 --name ollama --restart always ollama/ollama. يبقي الربط بـ 127.0.0.1 الواجهة بعيدة عن الإنترنت العام — إذ ستقع خلف الوكيل العكسي الخاص بك.

03

نزّل نموذجك الأول

نزّل نموذجًا: docker exec -it ollama ollama pull llama3.1:8b. تحقّق من أنه يعمل: docker exec -it ollama ollama list. اختبر محليًا: curl http://127.0.0.1:11434/api/generate -d '{"model":"llama3.1:8b","prompt":"Hello"}'.

04

أضف وكيلًا عكسيًا مع مصادقة

لا يتضمّن Ollama مصادقة مدمجة. استخدم Caddy أو Nginx لإنهاء TLS وإضافة طبقة رمز Bearer قبل كشف الواجهة خارجيًا. مثال Caddyfile: reverse_proxy localhost:11434 { header_up Authorization "Bearer {env.OLLAMA_TOKEN}" }.

05

اربط أدواتك

في Open WebUI ← Settings ← Connections، اضبط عنوان Ollama إلى http://localhost:11434. وفي أي حزمة OpenAI SDK، اضبط base_url='http://:11434/v1' وapi_key='ollama'. أصبحت أدواتك الآن تستخدم نماذجك.

الأسئلة الشائعة

Ollama هو بيئة تشغيل مفتوحة المصدر تنزّل نماذج اللغة الكبيرة (LLM) وتشغّلها عبر واجهة REST محلية. اعتبره خادم استدلال محليًا: تنزّل النموذج مرة واحدة، ويمكن لأي تطبيق استدعاؤه تمامًا كما يستدعي واجهة OpenAI.

بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.

فعّل Ollama على بنيتك التحتية.

خادم VPS Cloud مخصص — عنوان IPv4 مضمّن، مركز بيانات أوروبي، والدعم مضمّن. لا تغادر بياناتك خادمك أبدًا.

الإعداد الموصى به: 8 GB كحد أدنى (يُنصح بـ 16 GB) RAM · 2 vCPU

بحاجة إلى مساعدة؟

تصفّح مركز المساعدة والأسئلة الشائعة، أو راسل فريقنا — الدعم بـ العربية والفرنسية والإنجليزية.