[{"data":1,"prerenderedAt":148},["ShallowReactive",2],{"seo-verification":3,"blog-self-host-litellm-vps-fr":6},{"google":4,"bing":5},"EycwPY2XMyTkVzas3n1ygeNJFGAH513qrMjfDljzsMQ","",{"id":7,"slug":8,"slugs":9,"title":13,"excerpt":14,"readTime":15,"views":16,"isPinned":17,"publishedAt":18,"category":19,"categories":25,"featuredImage":27,"bgImage":28,"posterImage":29,"relatedSolution":30,"intro":33,"sections":34,"ctaTitle":86,"ctaBody":87,"ctaButton":88,"ctaUrl":89,"relatedPosts":90},156,"self-host-litellm-vps",{"fr":8,"en":10,"ar":11,"es":12},"self-host-litellm-on-a-vps-your-private-llm-api-gateway","استضف-litellm-ذاتيا-على-vps-بوابة-api-خاصة-لنماذج-llm","alojar-litellm-en-un-vps-pasarela-llm-privada","Héberger LiteLLM sur un VPS : votre passerelle d'API LLM privée","Déployez LiteLLM sur un VPS ServOrbit : passerelle d'API compatible OpenAI vers Ollama, Anthropic, Azure et 100+ LLM, avec suivi des dépenses et limites par clé.",4,0,false,"2026-01-21T00:00:00+00:00",{"id":20,"name":21,"slug":22,"color":23,"icon":24},7,"Self-hosting","self-hosting","bg-indigo-500\u002F10 text-indigo-400","cloud",[26],{"id":20,"name":21,"slug":22,"color":23,"icon":24},null,"\u002Fblog\u002Fcovers\u002Fbg.svg","\u002Fblog\u002Fcovers\u002Fself-host-litellm-vps-poster.svg",{"categorySlug":31,"appSlug":32},"ia","litellm","Votre application appelle un seul endpoint. LiteLLM décide quel modèle traite la requête — votre Ollama local, Anthropic Claude, GPT-4 ou n'importe lequel des plus de 100 autres fournisseurs. Il parle l'API d'OpenAI : aucune modification de SDK n'est jamais nécessaire. Auto-hébergé sur un VPS, il ajoute la limitation de débit, des plafonds de budget par clé d'API et un tableau de bord analytique intégré — de quoi donner à plusieurs équipes l'accès à l'IA sans craindre que les coûts ne s'emballent.",[35,39,49,52,80,83],{"type":36,"title":37,"body":38},"h2","Pourquoi LiteLLM est la couche manquante des stacks d'IA auto-hébergées","Ollama est excellent pour faire tourner des modèles en local. Open WebUI l'habille d'une interface de chat. Mais dès que vous vous mettez à construire des applications — et plus seulement à discuter — il vous faut un intermédiaire : un proxy qui normalise la surface d'API, suit les coûts par projet et vous permet de changer de modèle sans toucher au code applicatif. C'est précisément le rôle de LiteLLM. Il s'intercale entre votre application et n'importe quel backend LLM, en exposant un unique endpoint compatible OpenAI. Votre code reste identique, que vous acheminiez les requêtes vers Llama 3.1 sur Ollama, Claude 3.5 Haiku ou GPT-4o.",{"type":40,"title":41,"items":42},"ul","Ce que LiteLLM vous apporte d'emblée",[43,44,45,46,47,48],"API unifiée et compatible OpenAI — fonctionne avec tous les SDK, bibliothèques et outils qui ciblent l'API d'OpenAI.","Plus de 100 intégrations de fournisseurs : Ollama, Anthropic, OpenAI, Azure OpenAI, Mistral, Cohere, Bedrock et bien d'autres.","Clés d'API virtuelles avec limites de dépenses et de débit par clé — distribuez des clés aux équipes et plafonnez les coûts mensuels.","Tableau de bord intégré sur \u002Fui avec analyse des dépenses en temps réel, ventilation par modèle et journaux des requêtes.","Répartition de charge et bascule automatique entre plusieurs endpoints de fournisseurs ou réplicas de modèles.","Licence Apache 2.0 — aucune télémétrie, aucune remontée d'informations vers l'extérieur, entièrement compatible air-gap une fois associée à Ollama.",{"type":36,"title":50,"body":51},"Prérequis","Un VPS avec au moins 1 Go de RAM et Ubuntu 22.04. Docker et le plugin Compose installés. Le port 4000 ouvert, ou un reverse proxy Caddy\u002FNginx pour le HTTPS. C'est tout — LiteLLM est lui-même un proxy Python qui réclame environ 256 Mo ; PostgreSQL absorbe l'essentiel du budget RAM restant. Pour des équipes générant du trafic concurrent, 2 Go sont plus confortables.",{"type":53,"title":54,"steps":55},"steps","Déployer LiteLLM sur un VPS",[56,59,62,65,68,71,74,77],{"title":57,"body":58},"Provisionner le VPS","Commandez un VPS ServOrbit (1 Go de RAM minimum, Ubuntu 22.04). Connectez-vous en SSH et installez Docker : `curl -fsSL https:\u002F\u002Fget.docker.com | sh`. Le plugin Compose est inclus.",{"title":60,"body":61},"Générer les secrets","Lancez `openssl rand -hex 32` pour générer LITELLM_MASTER_KEY — elle déverrouille le tableau de bord et tous les endpoints d'API d'administration. Créez `\u002Fopt\u002Flitellm\u002F.env` avec : `LITELLM_MASTER_KEY`, `UI_USERNAME`, `UI_PASSWORD`, `DB_NAME=litellm`, `DB_USER=litellm`, `DB_PASSWORD=\u003Cstrong-password>`.",{"title":63,"body":64},"Rédiger docker-compose.yml","Créez `\u002Fopt\u002Flitellm\u002Fdocker-compose.yml` avec deux services : `db` (postgres:16-alpine, variables d'environnement issues du .env, volume litellm_db) et `litellm` (ghcr.io\u002Fberriai\u002Flitellm:main-latest, port 4000:4000, depends_on db, DATABASE_URL + LITELLM_MASTER_KEY + UI_USERNAME + UI_PASSWORD, volume litellm_config:\u002Fapp\u002Fdata). Lancez `docker compose up -d`.",{"title":66,"body":67},"Ouvrir le tableau de bord","Rendez-vous sur `http:\u002F\u002F\u003Cvps-ip>:4000\u002Fui` et connectez-vous avec vos UI_USERNAME \u002F UI_PASSWORD. Vous arrivez sur le tableau de bord de LiteLLM. Allez dans Models pour ajouter votre premier fournisseur. Pour une instance Ollama locale sur le même VPS, définissez le nom du modèle sur `ollama\u002Fllama3.1` et l'API base sur `http:\u002F\u002Fhost.docker.internal:11434`. Pour Anthropic, collez votre clé d'API et ajoutez `anthropic\u002Fclaude-3-5-haiku-20241022`.",{"title":69,"body":70},"Tester la passerelle","Depuis votre poste de travail, testez : `curl http:\u002F\u002F\u003Cvps-ip>:4000\u002Fv1\u002Fchat\u002Fcompletions -H \"Authorization: Bearer \u003CLITELLM_MASTER_KEY>\" -H 'Content-Type: application\u002Fjson' -d '{\"model\": \"ollama\u002Fllama3.1\", \"messages\": [{\"role\": \"user\", \"content\": \"Hello\"}]}'`. Vous devriez recevoir une réponse en streaming — acheminée par LiteLLM vers votre Ollama.",{"title":72,"body":73},"Distribuer des clés d'API aux équipes","Dans le tableau de bord, sous API Keys, cliquez sur New Key. Donnez-lui une description (par exemple « frontend-team »), définissez `max_budget: 50` (USD\u002Fmois) et un `tpm_limit` facultatif. Partagez cette clé avec l'équipe — elle pointe son SDK OpenAI vers `http:\u002F\u002F\u003Cvps-ip>:4000` et utilise cette clé. Les dépenses sont suivies par clé dans le tableau de bord.",{"title":75,"body":76},"Ajouter le HTTPS avec Caddy","Installez Caddy : `apt install -y caddy`. Éditez `\u002Fetc\u002Fcaddy\u002FCaddyfile` : `llm.votre-domaine.com { reverse_proxy localhost:4000 }`. Rechargez : `systemctl reload caddy`. Fermez le port 4000 dans votre pare-feu — tout le trafic passe désormais par le 443 avec TLS automatique.",{"title":78,"body":79},"Se connecter la première fois","Ouvrez l'interface d'administration sur \u002Fui : LiteLLM affiche un formulaire identifiant\u002Fmot de passe. Saisissez admin et le mot de passe fourni, puis créez vos clés virtuelles depuis le tableau de bord.",{"type":81,"body":82},"tip","Associez LiteLLM à Ollama sur le même VPS pour une stack d'IA entièrement isolée (air-gap). Ollama assure l'inférence des modèles ; LiteLLM ajoute la couche passerelle — acheminement, limitation de débit et suivi de la consommation. Pour les charges de travail sensibles en matière de confidentialité (juridique, finance, médical), cela signifie qu'aucune donnée ne quitte votre infrastructure.",{"type":81,"title":84,"body":85},"La documentation officielle","Pour la configuration avancée et les options propres à l'outil, référez-vous à la \u003Ca href=\"https:\u002F\u002Fdocs.litellm.ai\" target=\"_blank\" rel=\"noopener noreferrer\">documentation officielle de LiteLLM\u003C\u002Fa>. Ce guide couvre la mise en ligne sur VPS ; la doc éditeur reste la référence pour les réglages fins, les mises à jour majeures et les cas d'usage spécifiques.","Déployez votre passerelle LLM privée","Auto-hébergez LiteLLM sur un VPS ServOrbit — acheminez les requêtes entre Ollama, Anthropic et plus de 100 fournisseurs depuis un unique endpoint compatible OpenAI, avec un contrôle de budget par clé.","Déployer LiteLLM","\u002Fmarketplace\u002Fia\u002Flitellm",[91,112,129],{"id":92,"slug":93,"slugs":94,"title":98,"excerpt":99,"readTime":100,"views":16,"isPinned":17,"publishedAt":101,"category":102,"categories":107,"featuredImage":27,"bgImage":28,"posterImage":109,"relatedSolution":110},11,"heberger-ollama-vps",{"fr":93,"en":95,"ar":96,"es":97},"how-to-host-ollama-on-a-vps","كيفية-استضافة-ollama-على-خادم-vps","como-alojar-ollama-en-un-vps","Héberger Ollama sur un VPS : guide opérationnel avancé","Configuration avancée d'Ollama sur VPS : gestion des modèles, reverse proxy nginx, sécurité API, quantisation Q4_K_M\u002FQ8, CVE-2026-45672 Open WebUI et couplage sécurisé.",10,"2026-06-09T00:00:00+00:00",{"id":103,"name":104,"slug":105,"color":106,"icon":31},1,"Intelligence Artificielle","intelligence-artificielle","bg-purple-500\u002F10 text-purple-400",[108],{"id":103,"name":104,"slug":105,"color":106,"icon":31},"\u002Fblog\u002Fcovers\u002Fheberger-ollama-vps-poster.svg",{"categorySlug":31,"appSlug":111},"ollama",{"id":113,"slug":114,"slugs":115,"title":119,"excerpt":120,"readTime":121,"views":16,"isPinned":17,"publishedAt":122,"category":123,"categories":124,"featuredImage":27,"bgImage":28,"posterImage":126,"relatedSolution":127},2,"deployer-dify-vps",{"fr":114,"en":116,"ar":117,"es":118},"deploying-dify-on-a-vps-ai-workflows-under-control","نشر-dify-على-vps-سير-عمل-الذكاء-الاصطناعي-تحت-السيطرة","desplegar-dify-en-un-vps","Déployer Dify sur un VPS : workflows IA sous contrôle","Installez Dify sur VPS ServOrbit pour créer agents, chatflows et apps IA sans perdre la maîtrise des données.",3,"2026-02-11T00:00:00+00:00",{"id":103,"name":104,"slug":105,"color":106,"icon":31},[125],{"id":103,"name":104,"slug":105,"color":106,"icon":31},"\u002Fblog\u002Fcovers\u002Fdeployer-dify-vps-poster.svg",{"categorySlug":31,"appSlug":128},"dify",{"id":121,"slug":130,"slugs":131,"title":135,"excerpt":136,"readTime":137,"views":16,"isPinned":17,"publishedAt":138,"category":139,"categories":143,"featuredImage":27,"bgImage":28,"posterImage":145,"relatedSolution":146},"installer-n8n-vps",{"fr":130,"en":132,"ar":133,"es":134},"install-n8n-on-vps-with-docker-complete-2026-guide","تثبيت-n8n-على-vps-مع-docker-دليل-شامل-2026","instalar-n8n-en-vps-con-docker","Installer n8n sur VPS avec Docker : guide complet 2026","Déployez n8n sur VPS avec Docker, reverse proxy et HTTPS. Crash V8, 502 nginx, migration npm vers Docker et sécurisation des exécutions persistées (advisory août 2026).",12,"2026-06-05T00:00:00+00:00",{"id":113,"name":140,"slug":141,"color":142,"icon":141},"Automatisation","automatisation","bg-brand-action\u002F10 text-brand-action",[144],{"id":113,"name":140,"slug":141,"color":142,"icon":141},"\u002Fblog\u002Fcovers\u002Finstaller-n8n-vps-poster.svg",{"categorySlug":141,"appSlug":147},"n8n",1787974984012]