لماذا يُعدّ LiteLLM الطبقة الناقصة في منظومات الذكاء الاصطناعي المستضافة ذاتيًا
Ollama رائع لتشغيل النماذج المحلية. ويغلّفه Open WebUI بواجهة محادثة. لكن حالما تبدأ ببناء التطبيقات — لا مجرّد المحادثة — تحتاج إلى شيء بينهما: وكيل يوحّد سطح واجهة API، ويتتبّع التكاليف لكل مشروع، ويتيح لك تبديل النماذج دون المساس بكود التطبيق. هذا بالضبط ما يفعله LiteLLM. فهو يقع بين تطبيقك وأي خلفية LLM، كاشفًا نقطة نهاية واحدة متوافقة مع OpenAI. يبقى كودك كما هو سواء وجّهت إلى Llama 3.1 على Ollama، أو Claude 3.5 Haiku، أو GPT-4o.
ما يمنحك إياه LiteLLM جاهزًا من الصندوق
- واجهة API موحّدة متوافقة مع OpenAI — تعمل مع كل حزمة SDK ومكتبة وأداة تستهدف واجهة OpenAI.
- أكثر من 100 تكامل مع مزوّدين: Ollama، Anthropic، OpenAI، Azure OpenAI، Mistral، Cohere، Bedrock وغيرها.
- مفاتيح API افتراضية بحدود إنفاق وحدود معدّل لكل مفتاح — أصدر مفاتيح للفرق واضبط سقف التكاليف الشهرية.
- لوحة تحكّم مدمجة على /ui مع تحليلات إنفاق فورية، وتفصيل لكل نموذج، وسجلّات للطلبات.
- موازنة حِمل وتجاوز تلقائي للأعطال عبر نقاط نهاية مزوّدين متعدّدة أو نسخ نماذج.
- رخصة Apache 2.0 — دون قياس عن بُعد، ودون اتصال خفي، وقابلة تمامًا للعمل معزولة عن الشبكة عند اقترانها بـ Ollama.
المتطلبات
خادم VPS بذاكرة 1 غيغابايت من RAM على الأقل ونظام Ubuntu 22.04. مع Docker وإضافة Compose مثبّتين. المنفذ 4000 مفتوح، أو وكيل عكسي Caddy/Nginx لتفعيل HTTPS. هذا كل شيء — فـ LiteLLM نفسه وكيل بلغة Python ويحتاج نحو 256 ميغابايت؛ ويستهلك PostgreSQL معظم ما يتبقّى من ميزانية RAM. أما للفرق ذات الحركة المتزامنة، فـ 2 غيغابايت أكثر راحة.
نشر LiteLLM على خادم VPS
توفير خادم VPS
اطلب خادم VPS من ServOrbit (1 غيغابايت من RAM كحدّ أدنى، Ubuntu 22.04). اتصل عبر SSH وثبّت Docker: curl -fsSL https://get.docker.com | sh. إضافة Compose مُضمّنة.
توليد الأسرار
نفّذ openssl rand -hex 32 لتوليد LITELLM_MASTER_KEY — فهذا يفتح لوحة التحكّم وجميع نقاط نهاية API الإدارية. أنشئ /opt/litellm/.env يتضمّن: LITELLM_MASTER_KEY، UI_USERNAME، UI_PASSWORD، DB_NAME=litellm، DB_USER=litellm، DB_PASSWORD=<strong-password>.
كتابة docker-compose.yml
أنشئ /opt/litellm/docker-compose.yml بخدمتين: db (postgres:16-alpine، متغيّرات البيئة من .env، الحجم litellm_db) وlitellm (ghcr.io/berriai/litellm:main-latest، المنفذ 4000:4000، depends_on db، DATABASE_URL + LITELLM_MASTER_KEY + UI_USERNAME + UI_PASSWORD، الحجم litellm_config:/app/data). نفّذ docker compose up -d.
فتح لوحة التحكّم
انتقل إلى http://<vps-ip>:4000/ui وسجّل الدخول بـ UI_USERNAME / UI_PASSWORD الخاصّين بك. ستصل إلى لوحة تحكّم LiteLLM. اذهب إلى Models لإضافة أول مزوّد لك. لنسخة Ollama محلية على الخادم نفسه، اضبط اسم النموذج على ollama/llama3.1 وقاعدة API على http://host.docker.internal:11434. أما لـ Anthropic، فالصق مفتاح API الخاص بك وأضف anthropic/claude-3-5-haiku-20241022.
اختبار البوابة
من محطّة عملك، اختبر: curl http://<vps-ip>:4000/v1/chat/completions -H "Authorization: Bearer <LITELLM_MASTER_KEY>" -H 'Content-Type: application/json' -d '{"model": "ollama/llama3.1", "messages": [{"role": "user", "content": "Hello"}]}'. ينبغي أن تستقبل ردًّا متدفّقًا — موجَّهًا عبر LiteLLM إلى Ollama لديك.
إصدار مفاتيح API للفرق
في لوحة التحكّم ضمن API Keys، انقر New Key. امنحه وصفًا (مثل 'frontend-team')، واضبط max_budget: 50 (دولار أمريكي شهريًا) وtpm_limit اختياريًا. شارك هذا المفتاح مع الفريق — يوجّهون حزمة OpenAI SDK إلى http://<vps-ip>:4000 ويستخدمون هذا المفتاح. ويُتتبَّع الإنفاق لكل مفتاح في لوحة التحكّم.
إضافة HTTPS بواسطة Caddy
ثبّت Caddy: apt install -y caddy. حرّر /etc/caddy/Caddyfile: llm.yourdomain.com { reverse_proxy localhost:4000 }. أعد التحميل: systemctl reload caddy. أغلق المنفذ 4000 في جدارك الناري — فكل الحركة تمرّ الآن عبر 443 مع TLS تلقائي.
أول تسجيل دخول
افتح واجهة الإدارة على المسار /ui: يعرض LiteLLM نموذج اسم مستخدم وكلمة مرور. أدخل اسم المستخدم admin وكلمة المرور المُسلَّمة إليك، ثم أنشئ مفاتيحك الافتراضية من لوحة التحكم.
اقرن LiteLLM بـ Ollama على الخادم نفسه للحصول على منظومة ذكاء اصطناعي معزولة تمامًا عن الشبكة. يتولّى Ollama استدلال النموذج؛ ويضيف LiteLLM طبقة البوابة — التوجيه وتحديد المعدّل وتتبّع الاستخدام. أما لأحمال العمل الحسّاسة للخصوصية (القانونية، المالية، الطبية)، فهذا يعني ألّا تغادر أي بيانات بنيتك التحتية.
الوثائق الرسمية
للإعداد المتقدّم والخيارات الخاصة بالأداة، ارجع إلى الوثائق الرسمية لـ LiteLLM. يغطّي هذا الدليل النشر على خادم VPS؛ وتبقى وثائق المُطوِّر المرجعَ للإعدادات الدقيقة والتحديثات الكبرى وحالات الاستخدام الخاصة.