بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.

شعار LocalAI

LocalAI

شغّل نماذج LLM مفتوحة المصدر على المعالج (CPU) — دون الحاجة إلى GPU. واجهة متوافقة مع OpenAI، أكثر من 200 نموذج، مستضافة ذاتيًا بأمر واحد.

2 GB (يُنصح بـ 4 GB للنماذج 7B فأكثر) ذاكرة عشوائية 2 vCPU (4 vCPU recommended) المنفذ 8080 متاح

المنظومة التقنية

DockerGollama.cpp
الحد الأدنى من RAM2 GB (يُنصح بـ 4 GB للنماذج 7B فأكثر)
الحد الأدنى من CPU2 vCPU (4 vCPU recommended)
المنفذ الافتراضي8080
أنظمة التشغيل المتوافقةتوزيعات Linux حسب اختيارك

LocalAI (رخصة MIT، نحو 47 ألف نجمة على GitHub) هو بديل مجاني ومفتوح المصدر لواجهة OpenAI البرمجية. يعمل على عتاد استهلاكي دون GPU — إذ يمكن لأي خادم VPS بذاكرة 2 GB أن يخدم نماذج Llama 3 وMistral وPhi-3 وQwen وأكثر من 200 نموذج آخر عبر واجهة REST متوافقة مع OpenAI. تعمل شيفرتك الحالية التي تستدعي `openai.ChatCompletion.create()` دون أي تعديل: غيّر عنوان URL الأساسي إلى خادمك VPS فتُوجَّه جميع نداءات الواجهة البرمجية محليًا، بتكلفة صفرية لكل رمز (token) وخصوصية تامة للبيانات.

بعد نشره على خادم VPS من ServOrbit، يصبح LocalAI الواجهة الخلفية الخاصة بك لنماذج LLM: نقطة نهاية تستدعيها تطبيقات فريقك وخطوط أنابيب RAG وأطر الوكلاء بدلًا من OpenAI — دون أي اعتماد على السحابة، ودون حدود استخدام، ودون خروج أي بيانات من بنيتك التحتية. يدعم LocalAI توليد النصوص واستدعاء الدوال وتوليد الصور (Stable Diffusion) وتحويل الكلام إلى نص (Whisper) وتضمينات النصوص (embeddings) — كل ذلك من حاوية واحدة.

الميزات الرئيسية

واجهة REST متوافقة مع OpenAI — بديل جاهز للاستبدال لـ OpenAI، يعمل مع كل حزم تطوير LangChain/LlamaIndex/LiteLLM دون تغيير.
استدلال على المعالج فقط — يعمل على أي خادم VPS دون GPU باستخدام llama.cpp؛ مع مسارات SIMD مُحسَّنة لمعالجات Intel وARM.
دعم أكثر من 200 نموذج — Llama 3 وMistral وPhi-3 وQwen 2.5 وDeepSeek وGemma 2 وFalcon وأي نموذج بصيغة GGUF.
متعدد الوسائط: توليد النصوص واستدعاء الدوال/الأدوات والتضمينات (embeddings) وتوليد الصور (Stable Diffusion) وتحويل الكلام إلى نص (Whisper).
اجلب النماذج بالاسم — curl http://localhost:8080/models/apply -d '{"id":"llama-3.2-3b-instruct:q4_0"}' يُنزّل أي نموذج مدعوم ويُفعّله.
رخصة MIT — قابل للتدقيق بالكامل، دون قياس عن بُعد (telemetry)، وقادر على العمل في بيئة معزولة تمامًا (air-gap)؛ الإصدار v4.6.2 (الصادر في 2026-07-06) يضيف وضع العنقود الموزّع والتوجيه المدرك للتخزين المؤقت بالبادئة (prefix-cache).
قابل للدمج مع LiteLLM وOpen WebUI — يوفّر LocalAI طبقة الاستدلال؛ ويضيف LiteLLM التوجيه متعدد المزودين؛ ويضيف Open WebUI واجهة المحادثة.

متى تستخدم هذا الحل؟

1

واجهة LLM خلفية خاصة لتطبيقاتك

استبدل نداءات واجهة OpenAI البرمجية بنقطة نهاية LocalAI على خادمك VPS. يُرسل تطبيقك SaaS أو أداتك الداخلية أو خط أنابيب RAG الطلبات إلى https://your-domain.com/v1/chat/completions — بنفس صيغة JSON ونفس حزمة التطوير (SDK) وبتكلفة صفرية لكل رمز. والوصول إلى نقطة النهاية من جهاز آخر يتطلب نطاقًا مربوطًا بالـVPS، لأن LocalAI لا ينصت إلا على الحلقة المحلية؛ أما الشيفرة التي تعمل على الخادم نفسه فتستدعي http://127.0.0.1:8080/v1/chat/completions. مثالي للاستخدامات كثيفة الحجم حيث يصبح التسعير لكل رمز عائقًا.

2

استدلال معزول تمامًا للبيانات الحساسة

بالنسبة للتطبيقات القانونية أو الطبية أو المالية التي لا يمكن أن تغادر بياناتها بنيتك التحتية، يعمل LocalAI دون اتصال بالكامل بمجرد تنزيل النموذج. لا يصل أي طلب إلى واجهة برمجية خارجية. تُخزَّن ملفات نماذج GGUF في وحدة تخزين Docker على قرصك الخاص.

3

التضمينات والبحث الدلالي دون مفتاح واجهة برمجية

شغّل نماذج التضمين (nomic-embed-text وmxbai-embed-large) محليًا إلى جانب Qdrant على الخادم VPS نفسه لبناء خط أنابيب كامل للبحث الدلالي أو RAG. دون تكلفة واجهة تضمين OpenAI، ودون خروج أي بيانات من خادمك، ودون حدود على المعدل.

نشر LocalAI على خادم VPS الخاص بك

دليل محسّن لخوادم VPS Cloud من ServOrbit.

01

أنشئ الخادم VPS

اطلب خادم VPS من ServOrbit بذاكرة 2 GB على الأقل؛ والنظام المثبَّت هو Ubuntu 24.04. وللاستخدام المريح لعدة مستخدمين، أو للنماذج من 7 مليارات معامل فأكثر، يُنصح بذاكرة 4 GB. وعدد الأنوية مهم للسرعة: تقلّل 4 vCPU زمن استجابة التوليد بوضوح على النماذج من 3 إلى 7 مليارات معامل.

02

انشر LocalAI

يُنشئ التثبيت من مساحة العميل حاوية localai/localai:latest، وهي صورة بحجم 900 MB تقريبًا، ويركّب وحدة التخزين local-ai على /build/models، وينشر خادم الواجهة البرمجية المتوافق مع OpenAI على واجهة الاسترجاع المحلية عند 127.0.0.1:8080. ولا يأتي التثبيت بأي نموذج: فأول طلب يذكر نموذجًا يطلق تنزيله إلى وحدة التخزين الدائمة.

03

اتصل للمرة الأولى

يفتح LocalAI دون أي بيانات اعتماد: فأول إجراء لك هو المرور بمعرض النماذج لتنزيل نموذج، إذ لا يوفّر التثبيت أي نموذج. وتستجيب الواجهة البرمجية المتوافقة مع OpenAI على العنوان نفسه ولا يحميها أي مفتاح — وما دامت الخدمة لا تستمع إلا على واجهة الاسترجاع المحلية، فلن يبلغها إلا من يملك وصول SSH إلى الخادم.

04

نزّل نموذجًا

يكفي نداء واحد للواجهة البرمجية: curl http://127.0.0.1:8080/models/apply -H 'Content-Type: application/json' -d '{"id":"llama-3.2-3b-instruct:q4_0"}'. يجلب LocalAI ملف GGUF ويسجّل النموذج. ويتّسع تكميم Q4 لنموذج بـ 3 مليارات معامل في 2 GB من الذاكرة؛ بينما يتطلّب نموذج بـ 7 مليارات نحو 4.

05

أجرِ أول نداء للواجهة البرمجية

اختبر الواجهة البرمجية من الخادم: curl http://127.0.0.1:8080/v1/chat/completions -H 'Content-Type: application/json' -d '{"model":"llama-3.2-3b-instruct:q4_0","messages":[{"role":"user","content":"Hello!"}]}'. وتأخذ الاستجابة شكل استجابة OpenAI تمامًا: يكفي تغيير عنوان الأساس في شيفرتك الحالية ليعمل كل شيء.

06

وجّه تطبيقاتك إلى LocalAI

في أي حزمة تطوير OpenAI، اضبط base_url='https://<your-domain>/v1' وapi_key='not-needed'؛ ويفترض هذا العنوان العام نطاقًا مربوطًا بالخادم. ومن الخادم نفسه استخدم base_url='http://127.0.0.1:8080/v1'. وبلا نطاق، افتح نفقًا عبر SSH — ssh -L 8080:127.0.0.1:8080 root@<your-vps-ip> — ثم وجّه إلى http://localhost:8080/v1. وقد يُعاد تخصيص المنفذ عند التثبيت: اعتمد المنفذ المعروض في بطاقة التطبيق في مساحة العميل، فالمنفذ 8080 ليس إلا قيمة الكتالوج. وفي LangChain يصبح ذلك ChatOpenAI(base_url=..., api_key='x')؛ وفي LiteLLM أضِف البادئة localai/ إلى اسم النموذج؛ وفي Open WebUI أعلِن اتصال OpenAI بعنوان الأساس نفسه. ولا تحتاج شيفرتك الحالية إلى أي تعديل آخر.

07

احمِ نقطة النهاية

يكون LocalAI مفتوحًا افتراضيًا: لا يُطلب أي مفتاح. ويعرف التطبيق كيف يطلب مفتاحًا عبر متغيّر البيئة LOCALAI_API_KEY، لكن تثبيت الكتالوج لا يضبط أي مفتاح — فاعتبر نقطة النهاية غير مُصادَق عليها. وبمجرد ربط نطاق، يضع ServOrbit مضيف nginx الافتراضي وشهادة TLS؛ والتشفير يحمي النقل ولا يعرّف أحدًا. وما دام لا مفتاح مضبوطًا، ابقَ بلا نطاق واعمل عبر نفق SSH، أو انشر بدلًا منه بوابة تتولّى المصادقة، مثل LiteLLM، وأبقِ LocalAI خلفها.

الأسئلة الشائعة

LocalAI هو خادم مجاني ومفتوح المصدر (رخصة MIT) يشغّل النماذج اللغوية الكبيرة محليًا على أي معالج (CPU). يُتيح واجهة REST متوافقة مع OpenAI، لذا تعمل شيفرتك الحالية دون تعديل — ما عليك سوى تغيير عنوان URL الأساسي للواجهة البرمجية إلى خادمك.

إضافة زر النشر

هل تدير مشروعًا يستخدم LocalAI؟ يتيح هذا الزر لقرّائك نشره على خادم VPS بنقرة واحدة، دون قراءة وثائق Docker.

Deploy LocalAI on ServOrbit
Markdown
[![Deploy LocalAI on ServOrbit](https://servorbit.com/brand/deploy/button.svg)](https://servorbit.com/vps-cloud?template=local-ai&utm_source=deploy-badge&utm_medium=referral&utm_campaign=local-ai)
HTML
<a href="https://servorbit.com/vps-cloud?template=local-ai&utm_source=deploy-badge&utm_medium=referral&utm_campaign=local-ai"><img src="https://servorbit.com/brand/deploy/button.svg" alt="Deploy LocalAI on ServOrbit" height="40"></a>

يشير الزر إلى طلب خادم ‎VPS مع تحديد القالب مسبقًا. تُقدَّم الصورة من ‎servorbit.com — لا شيء تستضيفه من جهتك.

بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.

فعّل LocalAI على بنيتك التحتية.

خادم VPS Cloud مخصص — عنوان IPv4 مضمّن، مركز بيانات أوروبي، والدعم مضمّن. لا تغادر بياناتك خادمك أبدًا.

الإعداد الموصى به: 2 GB (يُنصح بـ 4 GB للنماذج 7B فأكثر) RAM · 2 vCPU (4 vCPU recommended)

بحاجة إلى مساعدة؟

تصفّح مركز المساعدة والأسئلة الشائعة، أو تواصل مع فريقنا — معاودة اتصال أو WhatsApp أو بريد إلكتروني. الدعم بـ العربية والفرنسية والإنجليزية.