Whisper est le modèle de reconnaissance vocale open source d'OpenAI, déployé ici comme API REST self-hosted via le moteur faster-whisper CTranslate2. Hébergé sur votre VPS, il transcrit des fichiers audio en 99 langues, traduit vers l'anglais et restitue des horodatages au niveau du mot — sans envoyer un seul octet à un service tiers. Le modèle `base` tourne confortablement sur un VPS 1 vCPU avec 1 Go de RAM ; `small` améliore la précision avec 2 Go. Utilisez-le pour alimenter le sous-titrage, l'indexation de recherche, les comptes-rendus de réunion, le traitement de podcasts ou tout workflow qui convertit la voix en texte.
Envoyez vos enregistrements confidentiels directement à votre endpoint privé et récupérez un texte horodaté. Aucune donnée RH ni légale ne quitte votre infrastructure.
Traitez les téléversements audio côté serveur et recevez des fichiers de sous-titres SRT. Branchez l'endpoint sur votre CMS ou pipeline médias pour automatiser la génération de sous-titres à coût marginal zéro.
Intégrez l'API REST dans votre CRM, vos tickets de support ou vos outils de prise de notes. Laissez les agents dicter, laissez l'API transcrire — à coût mensuel fixe au lieu d'une facturation à la minute.
Guide optimisé pour les VPS Cloud ServOrbit.
Ouvrez le tableau de bord ServOrbit, rendez-vous dans Marketplace → Intelligence Artificielle → Whisper, et cliquez sur Déployer. Docker tire l'image et démarre le conteneur en moins de deux minutes. Le premier démarrage télécharge également les poids du modèle de transcription (~270 Mo pour base) ; le téléchargement est mis en cache pour que les redémarrages suivants soient instantanés.
Après l'installation, utilisez l'adresse affichée dans votre espace client. La Swagger UI est disponible sur /docs pour des tests interactifs. L'endpoint principal est POST /asr : joignez votre fichier audio et définissez le paramètre output sur txt, json, srt, vtt ou tsv selon le format voulu.
Depuis un terminal ou votre application, envoyez une requête :
`
curl -F "[email protected]" "https://votre-adresse/asr?output=txt"
Vous récupérez la transcription complète en texte brut. Pour des segments horodatés, ajoutez output=json`.
Le modèle par défaut est base (rapide, ~140 Mo). Pour améliorer la précision, basculez sur small (meilleur pour les audios bruités, ~500 Mo) en mettant à jour la variable d'environnement ASR_MODEL. Un VPS avec 2 Go de RAM gère small confortablement. Contactez le support pour redimensionner votre VPS.
L'endpoint est compatible OpenAI Whisper : toute bibliothèque ou outil capable d'appeler l'API OpenAI de transcription peut être redirigé vers votre instance privée. Mettez à jour l'URL de base et retirez toute clé API — l'authentification est gérée au niveau du reverse proxy par ServOrbit.
task (transcribe ou translate).Vous maintenez un projet qui utilise Whisper ? Ce bouton permet à vos lecteurs de le déployer sur un VPS en un clic, sans lire de documentation Docker.
[](https://servorbit.com/vps-cloud?template=whisper&utm_source=deploy-badge&utm_medium=referral&utm_campaign=whisper)<a href="https://servorbit.com/vps-cloud?template=whisper&utm_source=deploy-badge&utm_medium=referral&utm_campaign=whisper"><img src="https://servorbit.com/brand/deploy/button.svg" alt="Deploy Whisper on ServOrbit" height="40"></a>Le bouton pointe vers la commande d'un VPS avec le template présélectionné. L'image est servie depuis servorbit.com — rien à héberger de votre côté.
Créer, héberger et exploiter des solutions IA.
VPS Cloud dédié — IPv4 incluse, datacenter européen, support inclus. Vos données ne quittent jamais votre serveur.
Configuration recommandée : 1 Go minimum (modèle base), 2 Go recommandé (modèle small) RAM · 1 vCPU
Parcourez notre centre d'aide et notre FAQ, ou contactez notre équipe — rappel, WhatsApp ou e-mail. Support en français, anglais et arabe.
Écrire sur WhatsApps'ouvre dans un nouvel onglet