بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.

شغّل نماذج LLM مفتوحة المصدر على المعالج (CPU) — دون الحاجة إلى GPU. واجهة متوافقة مع OpenAI، أكثر من 200 نموذج، مستضافة ذاتيًا بأمر واحد.
LocalAI (رخصة MIT، نحو 47 ألف نجمة على GitHub) هو بديل مجاني ومفتوح المصدر لواجهة OpenAI البرمجية. يعمل على عتاد استهلاكي دون GPU — إذ يمكن لأي خادم VPS بذاكرة 2 GB أن يخدم نماذج Llama 3 وMistral وPhi-3 وQwen وأكثر من 200 نموذج آخر عبر واجهة REST متوافقة مع OpenAI. تعمل شيفرتك الحالية التي تستدعي `openai.ChatCompletion.create()` دون أي تعديل: غيّر عنوان URL الأساسي إلى خادمك VPS فتُوجَّه جميع نداءات الواجهة البرمجية محليًا، بتكلفة صفرية لكل رمز (token) وخصوصية تامة للبيانات.
بعد نشره على خادم VPS من ServOrbit، يصبح LocalAI الواجهة الخلفية الخاصة بك لنماذج LLM: نقطة نهاية تستدعيها تطبيقات فريقك وخطوط أنابيب RAG وأطر الوكلاء بدلًا من OpenAI — دون أي اعتماد على السحابة، ودون حدود استخدام، ودون خروج أي بيانات من بنيتك التحتية. يدعم LocalAI توليد النصوص واستدعاء الدوال وتوليد الصور (Stable Diffusion) وتحويل الكلام إلى نص (Whisper) وتضمينات النصوص (embeddings) — كل ذلك من حاوية واحدة.
curl http://localhost:8080/models/apply -d '{"id":"llama-3.2-3b-instruct:q4_0"}' يُنزّل أي نموذج مدعوم ويُفعّله.استبدل نداءات واجهة OpenAI البرمجية بنقطة نهاية LocalAI على خادمك VPS. يُرسل تطبيقك SaaS أو أداتك الداخلية أو خط أنابيب RAG نفسَ صيغة JSON وبنفس حزمة التطوير (SDK) وبتكلفة صفرية لكل رمز. ونقطة النهاية ليست عمومية — إذ لا ينصت LocalAI إلا على الحلقة المحلية لأنه يأتي بلا أي مصادقة: فالشيفرة التي تعمل على الخادم نفسه تستدعي http://127.0.0.1:8080/v1/chat/completions، والوصول من جهاز آخر يقتضي نفقًا عبر SSH. مثالي للاستخدامات كثيفة الحجم حيث يصبح التسعير لكل رمز عائقًا.
بالنسبة للتطبيقات القانونية أو الطبية أو المالية التي لا يمكن أن تغادر بياناتها بنيتك التحتية، يعمل LocalAI دون اتصال بالكامل بمجرد تنزيل النموذج. لا يصل أي طلب إلى واجهة برمجية خارجية. تُخزَّن ملفات نماذج GGUF في وحدة تخزين Docker على قرصك الخاص.
شغّل نماذج التضمين (nomic-embed-text وmxbai-embed-large) محليًا إلى جانب Qdrant على الخادم VPS نفسه لبناء خط أنابيب كامل للبحث الدلالي أو RAG. دون تكلفة واجهة تضمين OpenAI، ودون خروج أي بيانات من خادمك، ودون حدود على المعدل.
دليل محسّن لخوادم VPS Cloud من ServOrbit.
اطلب خادم VPS من ServOrbit بذاكرة 2 GB على الأقل؛ والنظام المثبَّت هو Ubuntu 24.04. وللاستخدام المريح لعدة مستخدمين، أو للنماذج من 7 مليارات معامل فأكثر، يُنصح بذاكرة 4 GB. وعدد الأنوية مهم للسرعة: تقلّل 4 vCPU زمن استجابة التوليد بوضوح على النماذج من 3 إلى 7 مليارات معامل.
يُنشئ التثبيت من مساحة العميل حاوية localai/localai:latest، وهي صورة بحجم 900 MB تقريبًا، ويركّب وحدة التخزين local-ai على /build/models، وينشر خادم الواجهة البرمجية المتوافق مع OpenAI على واجهة الاسترجاع المحلية عند 127.0.0.1:8080. ولا يأتي التثبيت بأي نموذج: فأول طلب يذكر نموذجًا يطلق تنزيله إلى وحدة التخزين الدائمة.
يفتح LocalAI دون أي بيانات اعتماد: فأول إجراء لك هو المرور بمعرض النماذج لتنزيل نموذج، إذ لا يوفّر التثبيت أي نموذج. وتستجيب الواجهة البرمجية المتوافقة مع OpenAI على العنوان نفسه ولا يحميها أي مفتاح — وما دامت الخدمة لا تستمع إلا على واجهة الاسترجاع المحلية، فلن يبلغها إلا من يملك وصول SSH إلى الخادم.
يكفي نداء واحد للواجهة البرمجية: curl http://127.0.0.1:8080/models/apply -H 'Content-Type: application/json' -d '{"id":"llama-3.2-3b-instruct:q4_0"}'. يجلب LocalAI ملف GGUF ويسجّل النموذج. ويتّسع تكميم Q4 لنموذج بـ 3 مليارات معامل في 2 GB من الذاكرة؛ بينما يتطلّب نموذج بـ 7 مليارات نحو 4.
اختبر الواجهة البرمجية من الخادم: curl http://127.0.0.1:8080/v1/chat/completions -H 'Content-Type: application/json' -d '{"model":"llama-3.2-3b-instruct:q4_0","messages":[{"role":"user","content":"Hello!"}]}'. وتأخذ الاستجابة شكل استجابة OpenAI تمامًا: يكفي تغيير عنوان الأساس في شيفرتك الحالية ليعمل كل شيء.
من الخادم نفسه، اضبط base_url='http://127.0.0.1:8080/v1' وapi_key='not-needed' في أي حزمة تطوير OpenAI — وهذه هي الحالة المعتادة، إذ يعمل التطبيق الذي يستهلك LocalAI على الجهاز نفسه. ومن حاسوبك أنت، افتح نفقًا عبر SSH — ssh -L 8080:127.0.0.1:8080 root@<your-vps-ip> — ثم وجّه إلى http://localhost:8080/v1. وقد يُعاد تخصيص المنفذ عند التثبيت: اعتمد المنفذ المعروض في بطاقة التطبيق في مساحة العميل، فالمنفذ 8080 ليس إلا قيمة الكتالوج. وفي LangChain يصبح ذلك ChatOpenAI(base_url=..., api_key='x')؛ وفي LiteLLM أضِف البادئة localai/ إلى اسم النموذج؛ وفي Open WebUI أعلِن اتصال OpenAI بعنوان الأساس نفسه. ولا تحتاج شيفرتك الحالية إلى أي تعديل آخر.
يكون LocalAI مفتوحًا افتراضيًا: لا يُطلب أي مفتاح. ويعرف التطبيق كيف يطلب مفتاحًا عبر متغيّر البيئة LOCALAI_API_KEY، لكن تثبيت الكتالوج لا يضبط أي مفتاح — فنقطة النهاية غير مُصادَق عليها، ولهذا بالضبط لا تُنشر خلف نطاق: فمحرّك استدلال مفتوح على الإنترنت يعني وضع معالجك وفاتورتك رهن إشارة من يعثر عليه. ولنشر واجهة برمجية عمومية، انشر بدلًا منه بوابة تتولّى المصادقة — مثل LiteLLM — وأبقِ LocalAI خلفها على الحلقة المحلية.
هل تدير مشروعًا يستخدم LocalAI؟ يتيح هذا الزر لقرّائك نشره على خادم VPS بنقرة واحدة، دون قراءة وثائق Docker.
[](https://servorbit.com/vps-cloud?template=local-ai&utm_source=deploy-badge&utm_medium=referral&utm_campaign=local-ai)<a href="https://servorbit.com/vps-cloud?template=local-ai&utm_source=deploy-badge&utm_medium=referral&utm_campaign=local-ai"><img src="https://servorbit.com/brand/deploy/button.svg" alt="Deploy LocalAI on ServOrbit" height="40"></a>يشير الزر إلى طلب خادم VPS مع تحديد القالب مسبقًا. تُقدَّم الصورة من servorbit.com — لا شيء تستضيفه من جهتك.
شغّل نماذج اللغة الكبيرة (LLM) مفتوحة المصدر محليًا عبر واجهة برمجية بالغة البساطة. نزّل Llama 3 أو Mistral أو Qwen أو DeepSeek بأمر واحد — متوافق مع OpenAI، وبلا أي تكلفة لكل توكن.
الذكاء الاصطناعيبوابة API متوافقة مع OpenAI مستضافة ذاتيًا لأكثر من 100 نموذج لغوي كبير — وجّه الطلبات بين Ollama وAnthropic وAzure وغيرها من نقطة نهاية واحدة، مع حدود معدّل لكل مفتاح وتتبّع للإنفاق.
الذكاء الاصطناعيواجهة ويب للتفاعل مع نماذج اللغة المحلية أو البعيدة. بياناتك تبقى على بنيتك التحتية — دون أي طرف ثالث.
تصفّح مركز المساعدة والأسئلة الشائعة، أو تواصل مع فريقنا — معاودة اتصال أو WhatsApp أو بريد إلكتروني. الدعم بـالعربية والفرنسية والإنجليزية.
راسلنا على WhatsAppيُفتح في علامة تبويب جديدة