Pourquoi héberger Open WebUI sur un VPS plutôt qu'en local ?
L'hébergement local fonctionne pour les tests, mais présente des limites réelles en production : consommation de ressources machine, absence d'accès distant, aucune haute disponibilité. Un VPS résout ces problèmes : il tourne 24h/24, est accessible depuis n'importe quel appareil, et vous en avez le contrôle total.
Ce que vous pouvez faire avec Open WebUI
- Discuter avec des modèles locaux via Ollama (Mistral, LLaMA 3, Gemma, etc.) ou avec l'API OpenAI
- Gérer plusieurs modèles et passer de l'un à l'autre en un clic depuis une interface unifiée
- Créer et partager des assistants personnalisés avec des instructions système sur mesure
- Télécharger et analyser des documents (PDF, texte) directement dans le chat grâce au support RAG intégré
- Ouvrir l'accès à votre équipe avec un système de comptes utilisateurs et de rôles
- Consulter l'historique complet de vos conversations, stocké sur votre propre serveur
Prérequis
Open WebUI nécessite Docker pour fonctionner. Le modèle Ollama (si vous souhaitez faire tourner un LLM localement sur le serveur) est gourmand en RAM. Comptez au minimum 4 Go de RAM pour un modèle 7B, 8 Go pour un modèle 13B. Si vous utilisez uniquement les API externes (OpenAI, Anthropic), 2 Go de RAM suffisent pour l'interface.
Déploiement en 5 étapes
Préparer votre VPS
Commandez un VPS Cloud avec Ubuntu 22.04 LTS. Mettez à jour le système : apt update && apt upgrade -y. Activez le pare-feu UFW et autorisez les ports SSH (22), HTTP (80) et HTTPS (443).
Installer Docker
Installez Docker Engine via le dépôt officiel Docker. Ajoutez votre utilisateur au groupe docker pour éviter les commandes sudo répétées. Vérifiez l'installation : docker run hello-world.
Démarrer Open WebUI
Récupérez l'image Docker officielle et lancez le conteneur en exposant le port 3000. Montez un volume pour persister les données entre les redémarrages. Open WebUI est accessible sur http://votre-ip:3000.
Configurer un reverse proxy (Nginx)
Installez Nginx et configurez un virtual host qui proxy les requêtes vers le port 3000. Utilisez Certbot (Let's Encrypt) pour obtenir un certificat SSL gratuit. Votre interface sera accessible en HTTPS sur votre domaine.
Connecter vos modèles
Dans l'interface Open WebUI, configurez vos connexions API : Ollama local, OpenAI, Anthropic, ou tout autre fournisseur compatible. Créez les accès utilisateurs selon vos besoins.
Le raccourci : installer depuis le Marketplace
Si votre VPS est un VPS Cloud ServOrbit, vous n'avez pas à dérouler les étapes ci-dessus. Depuis votre espace client, ouvrez le Marketplace dans le panneau de gestion du serveur, cherchez Open WebUI et confirmez l'installation : le conteneur et ses dépendances sont déployés pour vous. Il reste deux gestes, que personne ne peut faire à votre place — créer le compte administrateur à la première connexion (le premier compte créé prend ce rôle, ouvrez-le donc vous-même sans attendre) et déclarer votre source de modèles dans les paramètres d'administration. Comptez au moins 4 Go de RAM et 2 vCPU si vous faites tourner Ollama sur la même machine : l'interface est légère, ce sont les modèles qui pèsent. La voie manuelle garde son intérêt dès que vous voulez maîtriser la composition Docker, épingler une version précise ou brancher Open WebUI sur une infrastructure existante.
Fixer la clé de signature dès le premier démarrage
Open WebUI signe chaque jeton de session avec WEBUI_SECRET_KEY. Si vous ne la déclarez pas, elle est tirée au hasard au premier lancement et écrite dans le répertoire de données : tant que le volume persiste, tout va bien. Le jour où ce volume est recréé, la clé change — et vous obtenez un refus d'accès avec des identifiants pourtant valides, symptôme trompeur qui envoie chercher du côté du mot de passe. La même clé chiffre aussi les secrets stockés (jetons OAuth, identifiants d'API) : la perdre ne coupe donc pas seulement les sessions, elle rend ces secrets illisibles. Générez-la une fois avec openssl rand -hex 32, posez-la dans votre fichier d'environnement, et traitez-la comme un secret de production. Si vous faites tourner plusieurs instances derrière un répartiteur, elles doivent toutes porter la même valeur, sans quoi un jeton émis par l'une est rejeté par l'autre.
Si vous souhaitez faire tourner un modèle Ollama directement sur le même VPS, optez pour un plan avec au moins 8 Go de RAM et des SSD NVMe pour réduire les temps de chargement des modèles.
La documentation officielle
Pour la configuration avancée, les options propres à l’outil et les changements de version, référez-vous à la documentation officielle de Open WebUI. Ce guide couvre la mise en ligne sur VPS ServOrbit ; la documentation éditeur reste la référence pour les réglages fins.