بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.

Logo LiteLLM

LiteLLM

بوابة API لنماذج اللغة الكبيرة مستضافة ذاتيًا — وجّه الطلبات بين Ollama وAnthropic وأكثر من 100 مزوّد من نقطة نهاية واحدة متوافقة مع OpenAI.

1 GB (يُنصح بـ 2 GB) RAM 2 vCPU Port 4000 متاح

المنظومة التقنية

DockerPythonPostgreSQL 16
الحد الأدنى من RAM1 GB (يُنصح بـ 2 GB)
الحد الأدنى من CPU2 vCPU
المنفذ الافتراضي4000
أنظمة التشغيل المتوافقةubuntu-24.04

LiteLLM وكيل (proxy) مفتوح المصدر لنماذج اللغة الكبيرة يقدّم واجهة API موحّدة متوافقة مع OpenAI لأكثر من 100 مزوّد لنماذج اللغة الكبيرة. تحتفظ تطبيقاتك بنقطة نهاية واحدة — ويوجّه LiteLLM كل طلب إلى Ollama على خادم VPS نفسه، أو إلى Anthropic Claude، أو إلى Azure OpenAI، أو إلى أي واجهة خلفية أخرى تضبطها — دون تغيير سطر واحد من شيفرة التطبيق.

عند نشره على خادم VPS من ServOrbit، يمنح LiteLLM فريق التطوير لديك بوابة ذكاء اصطناعي خاصة مع لوحة تحكّم مدمجة لتحليلات الاستخدام، وحدود إنفاق لكل مفتاح، وتحديد للمعدّل. ويعمل جنبًا إلى جنب مع Ollama لاستدلال معزول تمامًا عن الشبكة (air-gapped)، أو أمام الواجهات التجارية لتوحيد تتبّع التكاليف عبر جميع مشاريعك.

الميزات الرئيسية

واجهة REST متوافقة مع OpenAI — بديل جاهز للاستبدال، يعمل مع كل حزمة SDK تتحدّث لغة OpenAI
أكثر من 100 مزوّد لنماذج اللغة الكبيرة: Ollama، Anthropic، OpenAI، Azure، Mistral، Cohere، Bedrock وغيرها
تحديد المعدّل وحدود الميزانية لكل مفتاح — أوقف التكاليف الجامحة في البيئات متعدّدة الفرق أو المشاريع
تحليلات إنفاق آنية ولوحة تكاليف مع تفصيل لكل نموذج ولكل مفتاح
موازنة الأحمال والتحويل التلقائي عند الأعطال عبر نقاط نهاية المزوّدين
رخصة Apache 2.0 — قابل للتدقيق بالكامل، بلا قياس عن بُعد (telemetry)، وقادر على العمل معزولًا عن الشبكة مع Ollama

متى تستخدم هذا الحل؟

1

واجهة خلفية ذكاء اصطناعي متعدّدة النماذج

وجّه المهام الحسّاسة للتكلفة إلى نسخة Ollama محلية، وطلبات الاستدلال المعقّدة إلى Anthropic Claude — كلّها من استدعاء OpenAI SDK نفسه في تطبيقك. غيّر التوجيه في إعدادات LiteLLM، لا في شيفرة التطبيق أبدًا.

2

التحكّم في ميزانية الذكاء الاصطناعي للفريق

أصدر مفاتيح API افتراضية لكل فريق أو مشروع مع حدّ إنفاق شهري. وعندما يبلغ مفتاح ميزانيته، يُعيد LiteLLM الرمز 429 — بلا فاتورة سحابية مفاجئة في نهاية الشهر.

3

الانتقال بين مزوّدي نماذج اللغة الكبيرة

انقل تطبيقك بالكامل من مزوّد إلى آخر بتحديث ملف إعدادات. فالواجهة المتوافقة مع OpenAI تعني عدم إجراء أي تغييرات على التطبيق — انتقل من GPT-4 إلى Llama 3 على Ollama دون المساس بأي عبارة استيراد واحدة.

نشر LiteLLM على خادم VPS الخاص بك

دليل محسّن لخوادم VPS Cloud من ServOrbit.

01

جهّز خادم VPS

اطلب خادم VPS من ServOrbit بذاكرة 1 GB على الأقل بنظام Ubuntu 22.04. يحتاج LiteLLM نفسه نحو 256 MB؛ ويستهلك PostgreSQL معظم المتبقّي. ويجب أن يكون المنفذ 4000 قابلًا للوصول، أو خطّط لوكيل عكسي على 80/443.

02

ولّد الأسرار

اتصل بخادم VPS عبر SSH ونفّذ openssl rand -hex 32 لتوليد LITELLM_MASTER_KEY — وهو مفتاح API الإداري الذي يفتح لوحة التحكّم وجميع نقاط النهاية الإدارية. واضبط أيضًا بيانات اعتماد قوية لقاعدة البيانات. واحتفظ بالمفتاح الرئيسي في أمان.

03

انشر باستخدام Docker Compose

أنشئ /opt/litellm/.env مع DB_NAME وDB_USER وDB_PASSWORD وLITELLM_MASTER_KEY وUI_USERNAME وUI_PASSWORD. ثم أنشئ /opt/litellm/docker-compose.yml بخدمتين: LiteLLM (ghcr.io/berriai/litellm:main-latest، المنفذ 4000) وPostgreSQL 16. نفّذ docker compose up -d. وامنحه 30 ثانية للإقلاع الأول.

04

افتح لوحة التحكّم وأضف نموذجك الأول

انتقل إلى http://:4000/ui وسجّل الدخول باستخدام UI_USERNAME وUI_PASSWORD الخاصين بك. اذهب إلى Models، وانقر Add — أدخل اسم نموذج مثل ollama/llama3.1 مع عنوان الأساس http://host.docker.internal:11434 للتوجيه إلى Ollama محلي، أو الصق مفتاح API من Anthropic لـ anthropic/claude-3-5-haiku-20241022. اختبر باستخدام curl -H "Authorization: Bearer " http://:4000/v1/models.

05

أصدر مفاتيح API للفريق

في لوحة التحكّم ضمن API Keys، أنشئ مفاتيح افتراضية لكل فريق مع max_budget اختياري (بالدولار الأمريكي) وtpm_limit وrpm_limit. شارك هذه المفاتيح مع مطوّريك — إذ يوجّهون OpenAI SDK لديهم إلى بوابة LiteLLM، ويُتتبَّع الإنفاق لكل مفتاح.

الأسئلة الشائعة

LiteLLM وكيل (proxy) مفتوح المصدر لنماذج اللغة الكبيرة (Apache 2.0) يوفّر واجهة API موحّدة متوافقة مع OpenAI لأكثر من 100 مزوّد لنماذج اللغة الكبيرة — Ollama، Anthropic Claude، OpenAI GPT-4، Azure OpenAI، Mistral، Cohere وغيرها. وهو يقع بين تطبيقاتك وأي واجهة خلفية لنماذج اللغة الكبيرة، متكفّلًا بالتوجيه وتحديد المعدّل وتتبّع التكاليف.

بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.

فعّل LiteLLM على بنيتك التحتية.

خادم VPS Cloud مخصص — عنوان IPv4 مضمّن، مركز بيانات أوروبي، والدعم مضمّن. لا تغادر بياناتك خادمك أبدًا.

الإعداد الموصى به: 1 GB (يُنصح بـ 2 GB) RAM · 2 vCPU

بحاجة إلى مساعدة؟

تصفّح مركز المساعدة والأسئلة الشائعة، أو راسل فريقنا — الدعم بـ العربية والفرنسية والإنجليزية.