لماذا تستضيف PrivateGPT ذاتيًا على خادم VPS
صُمّم PrivateGPT حول RAG (التوليد المعزَّز بالاسترجاع): فهو يستوعب مستنداتك، ويقطّعها إلى أجزاء، ويحسب تضمينات مخزّنة في قاعدة بيانات متجهية (Qdrant افتراضيًا)، ثم يجيب عن الأسئلة معتمدًا حصريًا على هذه المجموعة. حجّته الأساسية هي السرّية: في الوضع المحلي، يعمل نموذج LLM والتضمينات على الجهاز، ولا يخرج أي طلب. على خادم VPS مخصّص، تحصل على مساعد مستندي مؤسسي آمن، معزول عن محطة عمل كل شخص، مع قاعدة معرفة مركزية يستعلم منها الفريق بأكمله، دون كشف العقود أو ملفات الموارد البشرية أو المستندات القانونية لخدمة سحابية أبدًا.
الفوائد الملموسة للاستضافة الذاتية
- سرّية تامة: لا تغادر المستندات والتضمينات خادم VPS أبدًا
- قاعدة بيانات متجهية Qdrant مركزية، يستعلم منها الفريق بأكمله في مكان واحد
- لا تكلفة API إذا استخدمت نموذج LLM محليًا عبر Ollama أو llama.cpp
- استيعاب ملفات PDF وDOCX والبريد الإلكتروني وصفحات الويب في مجموعة واحدة خاصة
- واجهة برمجة تطبيقات متوافقة مع OpenAI لربط PrivateGPT بأدواتك الداخلية
- امتثال مُيسَّر للبيانات الحسّاسة (اللائحة العامة لحماية البيانات، السر المهني)
المتطلبات العتادية والبرمجية
PrivateGPT في الوضع المحلي الكامل أكثر تطلّبًا من الأدوات الأخرى لأنه يشغّل نموذج التضمين ونموذج التوليد LLM معًا. احسب 8 GB من RAM على الأقل (يُوصى بـ 16 GB) و4 vCPU لنموذج 7B مكمّم، إضافةً إلى 20 GB من القرص للنماذج وقاعدة بيانات Qdrant والمستندات المُستوعَبة. إذا نقلت نموذج LLM إلى Ollama على خادم VPS نفسه، فحدّد حجم ذاكرة RAM تبعًا لذلك. على الجانب البرمجي: Docker وDocker Compose، وPython 3.11 إذا ثبّت خارج حاوية، ونطاق يشير إلى خادم VPS لكشف واجهة Gradio وواجهة برمجة التطبيقات.
نشر PrivateGPT في الوضع المحلي
تجهيز خادم VPS
ثبّت Docker واستنسخ المستودع: git clone https://github.com/zylon-ai/private-gpt && cd private-gpt. أنشئ وحدة تخزين دائمة للبيانات المُستوعَبة وقاعدة بيانات Qdrant لتصمد أمام عمليات إعادة النشر.
اختيار ملف تعريف التنفيذ
يعمل PrivateGPT عبر ملفات تعريف. لنشر محلي بنسبة 100% مع Ollama، شغّل Ollama ثم اسحب النماذج: ollama pull mistral للتوليد وollama pull nomic-embed-text للتضمينات.
تهيئة الإعدادات والتشغيل
فعّل ملف تعريف ollama في settings.yaml ثم ابدأ بـ PGPT_PROFILES=ollama make run أو عبر ملف compose المُوفَّر. تحقّق في السجلات من أن الاتصال بـ Ollama وQdrant قد تأسّس.
استيعاب مستنداتك
ضع ملفاتك في مجلد الاستيعاب وشغّل make ingest /chemin/vers/docs. يقطّع PrivateGPT المجموعة ويحوّلها إلى متجهات ويفهرسها في Qdrant. تابع التقدّم في السجلات حتى اكتمال الفهرسة.
إعداد الوكيل العكسي وشهادة SSL
اكشف واجهة Gradio (المنفذ 8001) خلف Caddy أو Nginx مع شهادة Let's Encrypt تلقائية. أضف مصادقة HTTP أساسية، لأن الواجهة لا توفّرها أصلاً.
إحكام الوصول
أغلق المنفذ 8001 في جدار الحماية للإبقاء على الوكيل العكسي وحده قابلاً للوصول. يصل مستخدموك إلى https://docs.yourdomain.com ويستعلمون عن المجموعة بلغة طبيعية.
يُنزّل ملف التعريف الافتراضي نماذج ثقيلة. لخادم VPS يعمل بالمعالج، حوّل نموذج LLM والتضمينات إلى Ollama (mistral + nomic-embed-text) بدلاً من روابط llama.cpp المُترجَمة محليًا: تتجنّب عمليات الترجمة الطويلة، وتتقاسم الذاكرة مع حاويات أخرى، وتكسب استقرارًا أثناء إعادة التشغيل.