بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.
بوابة API لنماذج اللغة الكبيرة مستضافة ذاتيًا — وجّه الطلبات بين Ollama وAnthropic وأكثر من 100 مزوّد من نقطة نهاية واحدة متوافقة مع OpenAI.
LiteLLM وكيل (proxy) مفتوح المصدر لنماذج اللغة الكبيرة يقدّم واجهة API موحّدة متوافقة مع OpenAI لأكثر من 100 مزوّد لنماذج اللغة الكبيرة. تحتفظ تطبيقاتك بنقطة نهاية واحدة — ويوجّه LiteLLM كل طلب إلى Ollama على خادم VPS نفسه، أو إلى Anthropic Claude، أو إلى Azure OpenAI، أو إلى أي واجهة خلفية أخرى تضبطها — دون تغيير سطر واحد من شيفرة التطبيق.
عند نشره على خادم VPS من ServOrbit، يمنح LiteLLM فريق التطوير لديك بوابة ذكاء اصطناعي خاصة مع لوحة تحكّم مدمجة لتحليلات الاستخدام، وحدود إنفاق لكل مفتاح، وتحديد للمعدّل. ويعمل جنبًا إلى جنب مع Ollama لاستدلال معزول تمامًا عن الشبكة (air-gapped)، أو أمام الواجهات التجارية لتوحيد تتبّع التكاليف عبر جميع مشاريعك.
وجّه المهام الحسّاسة للتكلفة إلى نسخة Ollama محلية، وطلبات الاستدلال المعقّدة إلى Anthropic Claude — كلّها من استدعاء OpenAI SDK نفسه في تطبيقك. غيّر التوجيه في إعدادات LiteLLM، لا في شيفرة التطبيق أبدًا.
أصدر مفاتيح API افتراضية لكل فريق أو مشروع مع حدّ إنفاق شهري. وعندما يبلغ مفتاح ميزانيته، يُعيد LiteLLM الرمز 429 — بلا فاتورة سحابية مفاجئة في نهاية الشهر.
انقل تطبيقك بالكامل من مزوّد إلى آخر بتحديث ملف إعدادات. فالواجهة المتوافقة مع OpenAI تعني عدم إجراء أي تغييرات على التطبيق — انتقل من GPT-4 إلى Llama 3 على Ollama دون المساس بأي عبارة استيراد واحدة.
دليل محسّن لخوادم VPS Cloud من ServOrbit.
اطلب خادم VPS من ServOrbit بذاكرة 1 GB على الأقل بنظام Ubuntu 22.04. يحتاج LiteLLM نفسه نحو 256 MB؛ ويستهلك PostgreSQL معظم المتبقّي. ويجب أن يكون المنفذ 4000 قابلًا للوصول، أو خطّط لوكيل عكسي على 80/443.
اتصل بخادم VPS عبر SSH ونفّذ openssl rand -hex 32 لتوليد LITELLM_MASTER_KEY — وهو مفتاح API الإداري الذي يفتح لوحة التحكّم وجميع نقاط النهاية الإدارية. واضبط أيضًا بيانات اعتماد قوية لقاعدة البيانات. واحتفظ بالمفتاح الرئيسي في أمان.
أنشئ /opt/litellm/.env مع DB_NAME وDB_USER وDB_PASSWORD وLITELLM_MASTER_KEY وUI_USERNAME وUI_PASSWORD. ثم أنشئ /opt/litellm/docker-compose.yml بخدمتين: LiteLLM (ghcr.io/berriai/litellm:main-latest، المنفذ 4000) وPostgreSQL 16. نفّذ docker compose up -d. وامنحه 30 ثانية للإقلاع الأول.
انتقل إلى http:// وسجّل الدخول باستخدام UI_USERNAME وUI_PASSWORD الخاصين بك. اذهب إلى Models، وانقر Add — أدخل اسم نموذج مثل ollama/llama3.1 مع عنوان الأساس http://host.docker.internal:11434 للتوجيه إلى Ollama محلي، أو الصق مفتاح API من Anthropic لـ anthropic/claude-3-5-haiku-20241022. اختبر باستخدام curl -H "Authorization: Bearer .
في لوحة التحكّم ضمن API Keys، أنشئ مفاتيح افتراضية لكل فريق مع max_budget اختياري (بالدولار الأمريكي) وtpm_limit وrpm_limit. شارك هذه المفاتيح مع مطوّريك — إذ يوجّهون OpenAI SDK لديهم إلى بوابة LiteLLM، ويُتتبَّع الإنفاق لكل مفتاح.
شغّل نماذج اللغة الكبيرة (LLM) مفتوحة المصدر محليًا عبر واجهة برمجية بالغة البساطة. نزّل Llama 3 أو Mistral أو Qwen أو DeepSeek بأمر واحد — متوافق مع OpenAI، وبلا أي تكلفة لكل توكن.
الذكاء الاصطناعيواجهة ويب للتفاعل مع نماذج اللغة المحلية أو البعيدة. بياناتك تبقى على بنيتك التحتية — دون أي طرف ثالث.
الأتمتة وسير العملأتمتة سير عملك بين التطبيقات دون كتابة أي شيفرة. أكثر من 400 تكامل، مستضاف ذاتيًا 100% على خادمك VPS.
تصفّح مركز المساعدة والأسئلة الشائعة، أو راسل فريقنا — الدعم بـ العربية والفرنسية والإنجليزية.