بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.

شغّل نماذج LLM مفتوحة المصدر على المعالج (CPU) — دون الحاجة إلى GPU. واجهة متوافقة مع OpenAI، أكثر من 200 نموذج، مستضافة ذاتيًا بأمر واحد.
LocalAI (رخصة MIT، نحو 47 ألف نجمة على GitHub) هو بديل مجاني ومفتوح المصدر لواجهة OpenAI البرمجية. يعمل على عتاد استهلاكي دون GPU — إذ يمكن لأي خادم VPS بذاكرة 2 GB أن يخدم نماذج Llama 3 وMistral وPhi-3 وQwen وأكثر من 200 نموذج آخر عبر واجهة REST متوافقة مع OpenAI. تعمل شيفرتك الحالية التي تستدعي `openai.ChatCompletion.create()` دون أي تعديل: غيّر عنوان URL الأساسي إلى خادمك VPS فتُوجَّه جميع نداءات الواجهة البرمجية محليًا، بتكلفة صفرية لكل رمز (token) وخصوصية تامة للبيانات.
بعد نشره على خادم VPS من ServOrbit، يصبح LocalAI الواجهة الخلفية الخاصة بك لنماذج LLM: نقطة نهاية تستدعيها تطبيقات فريقك وخطوط أنابيب RAG وأطر الوكلاء بدلًا من OpenAI — دون أي اعتماد على السحابة، ودون حدود استخدام، ودون خروج أي بيانات من بنيتك التحتية. يدعم LocalAI توليد النصوص واستدعاء الدوال وتوليد الصور (Stable Diffusion) وتحويل الكلام إلى نص (Whisper) وتضمينات النصوص (embeddings) — كل ذلك من حاوية واحدة.
استبدل نداءات واجهة OpenAI البرمجية بنقطة نهاية LocalAI على خادمك VPS. يُرسل تطبيقك SaaS أو أداتك الداخلية أو خط أنابيب RAG الطلبات إلى `http://your-vps:8080/v1/chat/completions` — بنفس صيغة JSON ونفس حزمة التطوير (SDK) وبتكلفة صفرية لكل رمز. مثالي للاستخدامات كثيفة الحجم حيث يصبح التسعير لكل رمز عائقًا.
بالنسبة للتطبيقات القانونية أو الطبية أو المالية التي لا يمكن أن تغادر بياناتها بنيتك التحتية، يعمل LocalAI دون اتصال بالكامل بمجرد تنزيل النموذج. لا يصل أي طلب إلى واجهة برمجية خارجية. تُخزَّن ملفات نماذج GGUF في وحدة تخزين Docker على قرصك الخاص.
شغّل نماذج التضمين (nomic-embed-text وmxbai-embed-large) محليًا إلى جانب Qdrant على الخادم VPS نفسه لبناء خط أنابيب كامل للبحث الدلالي أو RAG. دون تكلفة واجهة تضمين OpenAI، ودون خروج أي بيانات من خادمك، ودون حدود على المعدل.
دليل محسّن لخوادم VPS Cloud من ServOrbit.
اطلب خادم VPS من ServOrbit بذاكرة 2 GB على الأقل ونظام Ubuntu 22.04 أو 24.04. للاستخدام المريح متعدد المستخدمين أو للنماذج الأكبر (7B فأكثر)، يُنصح بذاكرة 4 GB. عدد أنوية المعالج مهم لسرعة الاستدلال: يقلّل 4 vCPU زمن استجابة التوليد بوضوح على النماذج من فئة 3–7B.
اتصل عبر SSH ونفّذ: docker run -d --restart=always -p 8080:8080 -v local-ai:/build/models --name localai localai/localai:latest. تُشغّل الصورة (نحو 900 MB) خادم واجهة برمجية متوافقًا مع OpenAI. يؤدي أول طلب لنموذج ما إلى تنزيله تلقائيًا إلى وحدة التخزين الدائمة.
نزّل أول نموذج بنداء واحد للواجهة البرمجية: curl http://localhost:8080/models/apply -H 'Content-Type: application/json' -d '{"id":"llama-3.2-3b-instruct:q4_0"}'. يجلب LocalAI ملف GGUF ويسجّله. يتّسع تكميم 3B Q4 في ذاكرة 2 GB؛ بينما يحتاج 7B Q4 إلى نحو 4 GB.
اختبر الواجهة البرمجية: curl http://localhost:8080/v1/chat/completions -H 'Content-Type: application/json' -d '{"model":"llama-3.2-3b-instruct:q4_0","messages":[{"role":"user","content":"Hello!"}]}'. تكون الاستجابة مطابقة تمامًا لاستجابة OpenAI — غيّر عنوان URL الأساسي في شيفرتك الحالية فيعمل كل شيء.
في أي حزمة تطوير OpenAI، اضبط base_url='http://your-vps-ip:8080/v1' وapi_key='not-needed'. في LangChain: ChatOpenAI(base_url=..., api_key='x'). في LiteLLM: أضِف البادئة localai/. في Open WebUI: اضبط اتصال OpenAI بعنوان URL الخاص بخادمك VPS. لا تحتاج شيفرتك الحالية إلى أي تغيير آخر.
يكون LocalAI مفتوحًا افتراضيًا. لإضافة المصادقة، اضبط متغيّر البيئة LOCALAI_API_KEY=your-secret عند تشغيل الحاوية. للحصول على HTTPS، ضع Caddy في المقدمة: ai.yourdomain.com { reverse_proxy localhost:8080 } — يُصدر Caddy شهادة Let's Encrypt تلقائيًا. قيّد المنفذ 8080 على عنوان IP الخاص بمكتبك باستخدام ufw عند الحاجة.
شغّل نماذج اللغة الكبيرة (LLM) مفتوحة المصدر محليًا عبر واجهة برمجية بالغة البساطة. نزّل Llama 3 أو Mistral أو Qwen أو DeepSeek بأمر واحد — متوافق مع OpenAI، وبلا أي تكلفة لكل توكن.
الذكاء الاصطناعيبوابة API متوافقة مع OpenAI مستضافة ذاتيًا لأكثر من 100 نموذج لغوي كبير — وجّه الطلبات بين Ollama وAnthropic وAzure وغيرها من نقطة نهاية واحدة، مع حدود معدّل لكل مفتاح وتتبّع للإنفاق.
الذكاء الاصطناعيواجهة ويب للتفاعل مع نماذج اللغة المحلية أو البعيدة. بياناتك تبقى على بنيتك التحتية — دون أي طرف ثالث.
تصفّح مركز المساعدة والأسئلة الشائعة، أو راسل فريقنا — الدعم بـ العربية والفرنسية والإنجليزية.