بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.

شعار LiteLLM

LiteLLM

بوابة API لنماذج اللغة الكبيرة مستضافة ذاتيًا — وجّه الطلبات بين Ollama وAnthropic وأكثر من 100 مزوّد من نقطة نهاية واحدة متوافقة مع OpenAI.

1 GB (يُنصح بـ 2 GB) ذاكرة عشوائية 2 vCPU المنفذ 4000 متاح

المنظومة التقنية

DockerPythonPostgreSQL 16
الحد الأدنى من RAM1 GB (يُنصح بـ 2 GB)
الحد الأدنى من CPU2 vCPU
المنفذ الافتراضي4000
أنظمة التشغيل المتوافقةubuntu-24.04

LiteLLM وكيل (proxy) مفتوح المصدر لنماذج اللغة الكبيرة يقدّم واجهة API موحّدة متوافقة مع OpenAI لأكثر من 100 مزوّد لنماذج اللغة الكبيرة. تحتفظ تطبيقاتك بنقطة نهاية واحدة — ويوجّه LiteLLM كل طلب إلى Ollama على خادم VPS نفسه، أو إلى Anthropic Claude، أو إلى Azure OpenAI، أو إلى أي واجهة خلفية أخرى تضبطها — دون تغيير سطر واحد من شيفرة التطبيق.

عند نشره على خادم VPS من ServOrbit، يمنح LiteLLM فريق التطوير لديك بوابة ذكاء اصطناعي خاصة مع لوحة تحكّم مدمجة لتحليلات الاستخدام، وحدود إنفاق لكل مفتاح، وتحديد للمعدّل. ويعمل جنبًا إلى جنب مع Ollama لاستدلال معزول تمامًا عن الشبكة (air-gapped)، أو أمام الواجهات التجارية لتوحيد تتبّع التكاليف عبر جميع مشاريعك.

الميزات الرئيسية

واجهة REST متوافقة مع OpenAI — بديل جاهز للاستبدال، يعمل مع كل حزمة SDK تتحدّث لغة OpenAI
أكثر من 100 مزوّد لنماذج اللغة الكبيرة: Ollama، Anthropic، OpenAI، Azure، Mistral، Cohere، Bedrock وغيرها
تحديد المعدّل وحدود الميزانية لكل مفتاح — أوقف التكاليف الجامحة في البيئات متعدّدة الفرق أو المشاريع
تحليلات إنفاق آنية ولوحة تكاليف مع تفصيل لكل نموذج ولكل مفتاح
موازنة الأحمال والتحويل التلقائي عند الأعطال عبر نقاط نهاية المزوّدين
رخصة Apache 2.0 — قابل للتدقيق بالكامل، بلا قياس عن بُعد (telemetry)، وقادر على العمل معزولًا عن الشبكة مع Ollama

متى تستخدم هذا الحل؟

1

واجهة خلفية ذكاء اصطناعي متعدّدة النماذج

وجّه المهام الحسّاسة للتكلفة إلى نسخة Ollama محلية، وطلبات الاستدلال المعقّدة إلى Anthropic Claude — كلّها من استدعاء OpenAI SDK نفسه في تطبيقك. غيّر التوجيه في إعدادات LiteLLM، لا في شيفرة التطبيق أبدًا.

2

التحكّم في ميزانية الذكاء الاصطناعي للفريق

أصدر مفاتيح API افتراضية لكل فريق أو مشروع مع حدّ إنفاق شهري. وعندما يبلغ مفتاح ميزانيته، يُعيد LiteLLM الرمز 429 — بلا فاتورة سحابية مفاجئة في نهاية الشهر.

3

الانتقال بين مزوّدي نماذج اللغة الكبيرة

انقل تطبيقك بالكامل من مزوّد إلى آخر بتحديث ملف إعدادات. فالواجهة المتوافقة مع OpenAI تعني عدم إجراء أي تغييرات على التطبيق — انتقل من GPT-4 إلى Llama 3 على Ollama دون المساس بأي عبارة استيراد واحدة.

نشر LiteLLM على خادم VPS الخاص بك

دليل محسّن لخوادم VPS Cloud من ServOrbit.

01

اطلب خادم VPS

يكفي خادم VPS من ServOrbit بذاكرة 1 GB للاستخدام الفردي: يستهلك LiteLLM نفسه نحو 256 MB، ويشغل PostgreSQL معظم ما تبقّى. واحسب 2 GB لفريق يرسل طلبات متوازية. وجهّز كذلك النطاق الذي ستُبلَغ البوابة من خلاله: فلا سبيل آخر للوصول إليها.

02

دع التثبيت يولّد الأسرار

لا شيء عليك صنعه يدويًا: يولّد النشر المفتاح الرئيسي LITELLM_MASTER_KEY، وبيانات اعتماد قاعدة بيانات PostgreSQL، وكلمة مرور واجهة الإدارة. ويفتح المفتاح الرئيسي لوحة التحكّم وجميع نقاط النهاية الإدارية — فعامله معاملة كلمة المرور واحتفظ به خارج الخادم.

03

سجّل الدخول للمرة الأولى

افتح واجهة الإدارة على https://<your-domain>/ui: يعرض LiteLLM نموذج اسم مستخدم وكلمة مرور. أدخل admin وكلمة المرور المولَّدة عند التثبيت، والمعروضة في بطاقة التطبيق في مساحة العميل، ثم أنشئ مفاتيحك الافتراضية من لوحة التحكّم.

04

ما الذي ينشره التثبيت

تنطلق حاويتان معًا: البوابة ghcr.io/berriai/litellm:main-latest المنشورة على 127.0.0.1:4000، وقاعدة بيانات postgres:16-alpine. وتبقى البيانات في وحدتَي تخزين: litellm_db لقاعدة البيانات وlitellm_config لإعدادات البوابة. واحسب نحو ثلاثين ثانية للإقلاع الأول.

05

أعلِن نموذجك الأول

في لوحة التحكّم، افتح Models ثم Add. وللتوجيه إلى Ollama مثبَّت على الجهاز نفسه، أدخل اسم نموذج من نوع ollama/llama3.1 مع عنوان الأساس http://host.docker.internal:11434؛ ولمزوّد بعيد، الصق مفتاح الواجهة البرمجية المقابل، مثلًا لـ anthropic/claude-3-5-haiku-20241022. تحقّق بـ curl -H "Authorization: Bearer <LITELLM_MASTER_KEY>" https://<your-domain>/v1/models: وهذا العنوان نفسه https://<your-domain>/v1 هو عنوان الأساس الذي تعطيه لحِزَم SDK لديك.

06

وزّع المفاتيح على فرقك

في قسم API Keys من لوحة التحكّم، أنشئ مفتاحًا افتراضيًا لكل فريق، مع max_budget عند الاقتضاء — وهو الميزانية التراكمية بالدولار — وtpm_limit بالرموز في الدقيقة وrpm_limit بالطلبات في الدقيقة. ويوجّه مطوّروك حزمة OpenAI SDK إلى البوابة، ويُحتسب الإنفاق مفتاحًا بمفتاح.

الأسئلة الشائعة

LiteLLM وكيل (proxy) مفتوح المصدر لنماذج اللغة الكبيرة (Apache 2.0) يوفّر واجهة API موحّدة متوافقة مع OpenAI لأكثر من 100 مزوّد لنماذج اللغة الكبيرة — Ollama، Anthropic Claude، OpenAI GPT-4، Azure OpenAI، Mistral، Cohere وغيرها. وهو يقع بين تطبيقاتك وأي واجهة خلفية لنماذج اللغة الكبيرة، متكفّلًا بالتوجيه وتحديد المعدّل وتتبّع التكاليف.

إضافة زر النشر

هل تدير مشروعًا يستخدم LiteLLM؟ يتيح هذا الزر لقرّائك نشره على خادم VPS بنقرة واحدة، دون قراءة وثائق Docker.

Deploy LiteLLM on ServOrbit
Markdown
[![Deploy LiteLLM on ServOrbit](https://servorbit.com/brand/deploy/button.svg)](https://servorbit.com/vps-cloud?template=litellm&utm_source=deploy-badge&utm_medium=referral&utm_campaign=litellm)
HTML
<a href="https://servorbit.com/vps-cloud?template=litellm&utm_source=deploy-badge&utm_medium=referral&utm_campaign=litellm"><img src="https://servorbit.com/brand/deploy/button.svg" alt="Deploy LiteLLM on ServOrbit" height="40"></a>

يشير الزر إلى طلب خادم ‎VPS مع تحديد القالب مسبقًا. تُقدَّم الصورة من ‎servorbit.com — لا شيء تستضيفه من جهتك.

بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.

فعّل LiteLLM على بنيتك التحتية.

خادم VPS Cloud مخصص — عنوان IPv4 مضمّن، مركز بيانات أوروبي، والدعم مضمّن. لا تغادر بياناتك خادمك أبدًا.

الإعداد الموصى به: 1 GB (يُنصح بـ 2 GB) RAM · 2 vCPU

بحاجة إلى مساعدة؟

تصفّح مركز المساعدة والأسئلة الشائعة، أو تواصل مع فريقنا — معاودة اتصال أو WhatsApp أو بريد إلكتروني. الدعم بـ العربية والفرنسية والإنجليزية.