[{"data":1,"prerenderedAt":110},["ShallowReactive",2],{"seo-verification":3,"marketplace-app-ar-local-ai":6},{"google":4,"bing":5},"EycwPY2XMyTkVzas3n1ygeNJFGAH513qrMjfDljzsMQ","",{"slug":7,"name":8,"description":9,"phase":10,"docsUrl":11,"logo":12,"github":13,"tagline":14,"longDescription":15,"features":16,"useCases":24,"steps":34,"faq":53,"specs":72,"compatibleOs":80,"relatedApps":81,"relatedPosts":103,"category":107},"local-ai","LocalAI","شغّل نماذج LLM مفتوحة المصدر على المعالج (CPU) — دون الحاجة إلى GPU. واجهة برمجية متوافقة مع OpenAI جاهزة للاستبدال، أكثر من 200 نموذج (Llama وMistral وPhi)، مستضافة ذاتيًا بالكامل على خادمك VPS.",1,"https:\u002F\u002Fservorbit.com\u002Fblog\u002Fself-host-localai-vps","https:\u002F\u002Fraw.githubusercontent.com\u002Fmudler\u002FLocalAI\u002Fmaster\u002Fcore\u002Fhttp\u002Fstatic\u002Flogo.png","https:\u002F\u002Fgithub.com\u002Fmudler\u002FLocalAI","شغّل نماذج LLM مفتوحة المصدر على المعالج (CPU) — دون الحاجة إلى GPU. واجهة متوافقة مع OpenAI، أكثر من 200 نموذج، مستضافة ذاتيًا بأمر واحد.","LocalAI (رخصة MIT، نحو 47 ألف نجمة على GitHub) هو بديل مجاني ومفتوح المصدر لواجهة OpenAI البرمجية. يعمل على عتاد استهلاكي دون GPU — إذ يمكن لأي خادم VPS بذاكرة 2 GB أن يخدم نماذج Llama 3 وMistral وPhi-3 وQwen وأكثر من 200 نموذج آخر عبر واجهة REST متوافقة مع OpenAI. تعمل شيفرتك الحالية التي تستدعي `openai.ChatCompletion.create()` دون أي تعديل: غيّر عنوان URL الأساسي إلى خادمك VPS فتُوجَّه جميع نداءات الواجهة البرمجية محليًا، بتكلفة صفرية لكل رمز (token) وخصوصية تامة للبيانات.\n\nبعد نشره على خادم VPS من ServOrbit، يصبح LocalAI الواجهة الخلفية الخاصة بك لنماذج LLM: نقطة نهاية تستدعيها تطبيقات فريقك وخطوط أنابيب RAG وأطر الوكلاء بدلًا من OpenAI — دون أي اعتماد على السحابة، ودون حدود استخدام، ودون خروج أي بيانات من بنيتك التحتية. يدعم LocalAI توليد النصوص واستدعاء الدوال وتوليد الصور (Stable Diffusion) وتحويل الكلام إلى نص (Whisper) وتضمينات النصوص (embeddings) — كل ذلك من حاوية واحدة.",[17,18,19,20,21,22,23],"واجهة REST متوافقة مع OpenAI — بديل جاهز للاستبدال لـ OpenAI، يعمل مع كل حزم تطوير LangChain\u002FLlamaIndex\u002FLiteLLM دون تغيير.","استدلال على المعالج فقط — يعمل على أي خادم VPS دون GPU باستخدام llama.cpp؛ مع مسارات SIMD مُحسَّنة لمعالجات Intel وARM.","دعم أكثر من 200 نموذج — Llama 3 وMistral وPhi-3 وQwen 2.5 وDeepSeek وGemma 2 وFalcon وأي نموذج بصيغة GGUF.","متعدد الوسائط: توليد النصوص واستدعاء الدوال\u002Fالأدوات والتضمينات (embeddings) وتوليد الصور (Stable Diffusion) وتحويل الكلام إلى نص (Whisper).","اجلب النماذج بالاسم — `curl http:\u002F\u002Flocalhost:8080\u002Fmodels\u002Fapply -d '{\"id\":\"llama-3.2-3b-instruct:q4_0\"}'` يُنزّل أي نموذج مدعوم ويُفعّله.","رخصة MIT — قابل للتدقيق بالكامل، دون قياس عن بُعد (telemetry)، وقادر على العمل في بيئة معزولة تمامًا (air-gap)؛ الإصدار v4.6.2 (الصادر في 2026-07-06) يضيف وضع العنقود الموزّع والتوجيه المدرك للتخزين المؤقت بالبادئة (prefix-cache).","قابل للدمج مع LiteLLM وOpen WebUI — يوفّر LocalAI طبقة الاستدلال؛ ويضيف LiteLLM التوجيه متعدد المزودين؛ ويضيف Open WebUI واجهة المحادثة.",[25,28,31],{"title":26,"body":27},"واجهة LLM خلفية خاصة لتطبيقاتك","استبدل نداءات واجهة OpenAI البرمجية بنقطة نهاية LocalAI على خادمك VPS. يُرسل تطبيقك SaaS أو أداتك الداخلية أو خط أنابيب RAG الطلبات إلى `http:\u002F\u002Fyour-vps:8080\u002Fv1\u002Fchat\u002Fcompletions` — بنفس صيغة JSON ونفس حزمة التطوير (SDK) وبتكلفة صفرية لكل رمز. مثالي للاستخدامات كثيفة الحجم حيث يصبح التسعير لكل رمز عائقًا.",{"title":29,"body":30},"استدلال معزول تمامًا للبيانات الحساسة","بالنسبة للتطبيقات القانونية أو الطبية أو المالية التي لا يمكن أن تغادر بياناتها بنيتك التحتية، يعمل LocalAI دون اتصال بالكامل بمجرد تنزيل النموذج. لا يصل أي طلب إلى واجهة برمجية خارجية. تُخزَّن ملفات نماذج GGUF في وحدة تخزين Docker على قرصك الخاص.",{"title":32,"body":33},"التضمينات والبحث الدلالي دون مفتاح واجهة برمجية","شغّل نماذج التضمين (nomic-embed-text وmxbai-embed-large) محليًا إلى جانب Qdrant على الخادم VPS نفسه لبناء خط أنابيب كامل للبحث الدلالي أو RAG. دون تكلفة واجهة تضمين OpenAI، ودون خروج أي بيانات من خادمك، ودون حدود على المعدل.",[35,38,41,44,47,50],{"title":36,"body":37},"أنشئ الخادم VPS","اطلب خادم VPS من ServOrbit بذاكرة 2 GB على الأقل ونظام Ubuntu 22.04 أو 24.04. للاستخدام المريح متعدد المستخدمين أو للنماذج الأكبر (7B فأكثر)، يُنصح بذاكرة 4 GB. عدد أنوية المعالج مهم لسرعة الاستدلال: يقلّل 4 vCPU زمن استجابة التوليد بوضوح على النماذج من فئة 3–7B.",{"title":39,"body":40},"انشر LocalAI","اتصل عبر SSH ونفّذ: `docker run -d --restart=always -p 8080:8080 -v local-ai:\u002Fbuild\u002Fmodels --name localai localai\u002Flocalai:latest`. تُشغّل الصورة (نحو 900 MB) خادم واجهة برمجية متوافقًا مع OpenAI. يؤدي أول طلب لنموذج ما إلى تنزيله تلقائيًا إلى وحدة التخزين الدائمة.",{"title":42,"body":43},"اجلب نموذجًا","نزّل أول نموذج بنداء واحد للواجهة البرمجية: `curl http:\u002F\u002Flocalhost:8080\u002Fmodels\u002Fapply -H 'Content-Type: application\u002Fjson' -d '{\"id\":\"llama-3.2-3b-instruct:q4_0\"}'`. يجلب LocalAI ملف GGUF ويسجّله. يتّسع تكميم 3B Q4 في ذاكرة 2 GB؛ بينما يحتاج 7B Q4 إلى نحو 4 GB.",{"title":45,"body":46},"أجرِ أول نداء للواجهة البرمجية","اختبر الواجهة البرمجية: `curl http:\u002F\u002Flocalhost:8080\u002Fv1\u002Fchat\u002Fcompletions -H 'Content-Type: application\u002Fjson' -d '{\"model\":\"llama-3.2-3b-instruct:q4_0\",\"messages\":[{\"role\":\"user\",\"content\":\"Hello!\"}]}'`. تكون الاستجابة مطابقة تمامًا لاستجابة OpenAI — غيّر عنوان URL الأساسي في شيفرتك الحالية فيعمل كل شيء.",{"title":48,"body":49},"وجّه تطبيقاتك إلى LocalAI","في أي حزمة تطوير OpenAI، اضبط `base_url='http:\u002F\u002Fyour-vps-ip:8080\u002Fv1'` و`api_key='not-needed'`. في LangChain: `ChatOpenAI(base_url=..., api_key='x')`. في LiteLLM: أضِف البادئة `localai\u002F`. في Open WebUI: اضبط اتصال OpenAI بعنوان URL الخاص بخادمك VPS. لا تحتاج شيفرتك الحالية إلى أي تغيير آخر.",{"title":51,"body":52},"اختياري: احمِ نقطة النهاية","يكون LocalAI مفتوحًا افتراضيًا. لإضافة المصادقة، اضبط متغيّر البيئة `LOCALAI_API_KEY=your-secret` عند تشغيل الحاوية. للحصول على HTTPS، ضع Caddy في المقدمة: `ai.yourdomain.com { reverse_proxy localhost:8080 }` — يُصدر Caddy شهادة Let's Encrypt تلقائيًا. قيّد المنفذ 8080 على عنوان IP الخاص بمكتبك باستخدام `ufw` عند الحاجة.",[54,57,60,63,66,69],{"q":55,"a":56},"ما هو LocalAI؟","LocalAI هو خادم مجاني ومفتوح المصدر (رخصة MIT) يشغّل النماذج اللغوية الكبيرة محليًا على أي معالج (CPU). يُتيح واجهة REST متوافقة مع OpenAI، لذا تعمل شيفرتك الحالية دون تعديل — ما عليك سوى تغيير عنوان URL الأساسي للواجهة البرمجية إلى خادمك.",{"q":58,"a":59},"هل أحتاج إلى GPU لتشغيل LocalAI؟","لا. يعتمد LocalAI على llama.cpp الذي يعمل بكفاءة على المعالج باستخدام تعليمات SIMD (AVX2\u002FAVX-512 على Intel، وNEON على ARM). يكفي خادم VPS بذاكرة 2–4 GB و2–4 vCPU للنماذج من فئة 3B–7B. تسريع GPU اختياري ومدعوم إذا كان خادمك يمتلك GPU متوافقًا مع CUDA.",{"q":61,"a":62},"ما النماذج التي يمكنني تشغيلها؟","يدعم LocalAI أي نموذج بصيغة GGUF، وهو ما يشمل تقريبًا جميع نماذج LLM مفتوحة المصدر: Llama 3.x وMistral 0.7–7B وPhi-3\u002F3.5\u002F4 Mini وQwen 2.5 وDeepSeek-R1 وGemma 2 وFalcon وغيرها. اجلب نموذجًا بنداء واحد للواجهة البرمجية — يُنزّله LocalAI من Hugging Face تلقائيًا.",{"q":64,"a":65},"كيف يُقارَن LocalAI بـ Ollama؟","كلاهما يشغّل نماذج LLM محليًا على المعالج. ميزة LocalAI هي توافقه الأوسع: فهو يدعم واجهات خلفية أكثر للنماذج (وليس llama.cpp فقط)، وتوليد الصور، وتحويل الكلام إلى نص (Whisper)، والتضمينات من واجهة برمجية واحدة. أما Ollama فأبسط في الإعداد ويمتلك مكتبة نماذج افتراضية أكبر. وكلاهما يُتيح واجهة برمجية متوافقة مع OpenAI.",{"q":67,"a":68},"هل بياناتي خاصة؟","نعم. يجري كل الاستدلال على خادمك VPS — ولا يُرسَل أي طلب إلى واجهة برمجية خارجية. تُخزَّن النماذج في وحدة تخزين Docker على قرصك الخاص. ولا يتضمّن LocalAI أي قياس عن بُعد افتراضيًا (رخصة MIT، وشيفرة مصدرية قابلة للتدقيق بالكامل).",{"q":70,"a":71},"ما متطلبات الذاكرة (RAM)؟","يحتاج نموذج 3B بتكميم Q4 إلى نحو 2 GB من الذاكرة. ويحتاج نموذج 7B إلى نحو 4 GB. ويحتاج نموذج 13B إلى نحو 8 GB. وبالنسبة لأصغر باقات VPS من ServOrbit (2 GB)، يعمل Phi-3 Mini (3.8B بتكميم Q4) جيدًا ويقدّم أداءً استدلاليًا قويًا مقارنةً بحجمه.",{"ram":73,"cpu":74,"stack":75,"port":79},"2 GB (يُنصح بـ 4 GB للنماذج 7B فأكثر)","2 vCPU (4 vCPU recommended)",[76,77,78],"Docker","Go","llama.cpp","8080",[],[82,91,97],{"name":83,"slug":84,"categorySlug":85,"categoryName":86,"categoryColor":87,"logo":88,"tagline":89,"description":90},"Ollama","ollama","ia","الذكاء الاصطناعي","text-purple-400 bg-purple-500\u002F10","https:\u002F\u002Fcdn.simpleicons.org\u002Follama","شغّل نماذج اللغة الكبيرة مفتوحة المصدر على خادم VPS الخاص بك — واجهة متوافقة مع OpenAI، بلا تكلفة لكل توكن.","شغّل نماذج اللغة الكبيرة (LLM) مفتوحة المصدر محليًا عبر واجهة برمجية بالغة البساطة. نزّل Llama 3 أو Mistral أو Qwen أو DeepSeek بأمر واحد — متوافق مع OpenAI، وبلا أي تكلفة لكل توكن.",{"name":92,"slug":93,"categorySlug":85,"categoryName":86,"categoryColor":87,"logo":94,"tagline":95,"description":96},"LiteLLM","litellm","https:\u002F\u002Favatars.githubusercontent.com\u002Fu\u002F132372032","بوابة API لنماذج اللغة الكبيرة مستضافة ذاتيًا — وجّه الطلبات بين Ollama وAnthropic وأكثر من 100 مزوّد من نقطة نهاية واحدة متوافقة مع OpenAI.","بوابة API متوافقة مع OpenAI مستضافة ذاتيًا لأكثر من 100 نموذج لغوي كبير — وجّه الطلبات بين Ollama وAnthropic وAzure وغيرها من نقطة نهاية واحدة، مع حدود معدّل لكل مفتاح وتتبّع للإنفاق.",{"name":98,"slug":99,"categorySlug":85,"categoryName":86,"categoryColor":87,"logo":100,"tagline":101,"description":102},"Open WebUI","open-webui","https:\u002F\u002Fcdn.jsdelivr.net\u002Fgh\u002Fselfhst\u002Ficons\u002Fsvg\u002Fopen-webui.svg","واجهة ويب لنماذج اللغة لديك — Ollama وOpenAI وMistral — مستضافة على خادمك الخاص.","واجهة ويب للتفاعل مع نماذج اللغة المحلية أو البعيدة. بياناتك تبقى على بنيتك التحتية — دون أي طرف ثالث.",[104,105,106],"self-host-litellm-vps","heberger-ollama-vps","deployer-dify-vps",{"key":85,"slug":85,"name":86,"objective":108,"icon":109,"color":87},"بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.","ai",1785714045843]