Créer, héberger et exploiter des solutions IA.
Assistant IA documentaire 100 % local — RAG sur vos fichiers, sans cloud, sans fuite de données.
En validation
L'installation automatique de cette solution est prête et passe actuellement nos tests sur serveur réel. La commande ouvrira dès que la validation sera terminée.
PrivateGPT est une plateforme RAG (Retrieval-Augmented Generation) open source qui vous permet d'interroger vos propres documents — PDF, DOCX, tableurs et e-mails — à l'aide d'un grand modèle de langage local. Contrairement aux assistants IA hébergés dans le cloud, PrivateGPT n'envoie jamais vos données hors du serveur : l'ingestion, la vectorisation, le stockage et l'inférence se déroulent entièrement sur votre VPS ServOrbit. Alimenté par un magasin de vecteurs intégré et connecté à tout serveur d'inférence compatible OpenAI (Ollama, llama.cpp, vLLM), il vous offre un pipeline RAG complet sous votre contrôle.
Déployé sur un VPS ServOrbit avec un sidecar Ollama, PrivateGPT devient un espace de travail IA privé et autonome : téléversez vos contrats, documents techniques ou comptes-rendus de réunions, et interrogez-les en langage naturel. Chaque réponse cite le passage source et le nom du fichier. L'API compatible OpenAI sur le port 8080 vous permet d'intégrer la même intelligence documentaire dans vos outils internes ou de construire des agents personnalisés sur le corpus indexé.
Téléversez vos contrats, accords et dossiers RH dans PrivateGPT. Posez la question « Quelles sont les clauses de résiliation du contrat X ? » et obtenez une réponse citée, sans qu'aucune donnée quitte le VPS — conformément à l'article 28 du RGPD.
Indexez la documentation technique, les runbooks et les comptes-rendus de votre équipe. Chaque membre dispose d'une interface en langage naturel, avec des réponses pointant vers le passage source exact pour vérifier et approfondir.
Alimentez PrivateGPT avec votre code source propriétaire ou vos rapports d'audit de sécurité. Interrogez l'architecture, repérez les fonctions non documentées ou croisez des descriptions CVE avec votre codebase — sans qu'une seule ligne de code source quitte le serveur.
Guide optimisé pour les VPS Cloud ServOrbit.
Prévoyez au minimum 8 Go de RAM : Ollama a besoin de 4 à 6 Go pour un modèle 7B (Q4_K_M), PrivateGPT lui-même consomme environ 500 Mo, et il faut de la marge pour l'ingestion de documents. Un VPS de 16 Go est l'option confortable. La machine est livrée avec Ubuntu 24.04 et Docker préinstallé.
Dans votre espace client ServOrbit : Marketplace → Intelligence Artificielle → PrivateGPT → Déployer. La pile démarre deux conteneurs : PrivateGPT (interface web + API sur le port 8080, lié à 127.0.0.1) et un sidecar Ollama (interne uniquement, non accessible depuis Internet). Les deux partagent un réseau Docker privé — seul le port 8080 est exposé sur le loopback.
Une fois la pile démarrée, téléchargez un modèle de langage dans Ollama via SSH : docker exec ollama ollama pull qwen2.5:7b. Pour un démarrage léger sur 8 Go de RAM, qwen2.5:3b (2,3 Go) est un bon point d'entrée. Pour des réponses plus riches sur des documents longs, mistral:7b ou llama3.1:8b sont recommandés. Pour les embeddings, nomic-embed-text améliore la qualité de la récupération sémantique.
L'interface de PrivateGPT est accessible sur http://127.0.0.1:8080/ui (loopback uniquement). Ouvrez un tunnel SSH depuis votre poste : ssh -L 8080:127.0.0.1:<port> root@<ip-vps> (remplacez <port> par le port affiché dans votre espace client), puis accédez à http://localhost:8080/ui dans votre navigateur.
Utilisez le bouton Upload dans l'interface ou le point d'API /v1/ingest/file pour téléverser vos documents. PrivateGPT les découpe en morceaux, calcule les embeddings via Ollama et les stocke dans le magasin de vecteurs local. L'ingestion d'un PDF de 50 pages prend généralement 30 à 90 secondes sur CPU.
Tapez votre question dans le chat. PrivateGPT récupère les morceaux les plus pertinents du magasin de vecteurs, les transmet en contexte au LLM et renvoie une réponse avec les passages sources cités. Le point d'API /v1/chat/completions est compatible OpenAI pour les clients API.
Workspace IA open-source : RAG sur vos documents, agents automatisés, multi-modèles. Alternative self-hosted à ChatGPT Teams — vos données ne quittent jamais votre serveur.
Intelligence ArtificielleInterface web pour interagir avec vos LLMs locaux ou distants. Vos données restent sur votre infrastructure — aucun tiers impliqué.
Intelligence ArtificielleCréez des applications LLM visuellement : chatbots, agents RAG, pipelines — sans écrire de code backend.
Parcourez notre centre d'aide et notre FAQ, ou contactez notre équipe — rappel, WhatsApp ou e-mail. Support en français, anglais et arabe.
Écrire sur WhatsApps'ouvre dans un nouvel onglet