OPENWHISPR : dictez à votre ordinateur, le texte apparaît où vous voulez — en local ou dans le cloud
📌 OPENWHISPR est une application de dictée vocale open source qui transforme votre voix en texte dans n’importe quelle application — avec transcription 100% locale via Whisper ou NVIDIA Parakeet, ou via votre propre clé API cloud, au choix.
Vous tapez à 40 mots par minute. Vous parlez à 150. OPENWHISPR capitalise sur cet écart avec un raccourci global : vous appuyez, vous parlez, le texte se colle là où se trouve votre curseur. Slack, Gmail, Google Docs, Cursor, n’importe quel champ qui accepte du texte fonctionne.
Les modèles proposés vont de Whisper Tiny (75 Mo, le plus rapide) à Whisper Turbo (1,6 Go, le plus précis), en passant par NVIDIA Parakeet pour le multilingue. Le choix entre local et cloud se règle à l’installation : vous téléchargez un modèle, ou vous collez une clé API OpenAI/Anthropic/Groq. L’audio traité en local ne quitte jamais votre machine — pas d’enregistrement, pas de logs, pas de copie côté serveur. D’après les retours utilisateurs, Whisper Base offre une transcription quasi instantanée en local.
Plus que de la dictée
OPENWHISPR ne se limite pas à la transcription. Trois aspects le distinguent d’un simple wrapper Whisper :
- Agent IA vocal : un raccourci dédié envoie votre dictée directement comme commande à un assistant IA nommé. Vous dites « nettoie cet email » ou « rédige une réponse à Mike », ça le fait.
- Transcription de réunions : détection automatique de Zoom, Teams, FaceTime, avec diarisation en direct et empreinte vocale pour reconnaître chaque intervenant. Aucun bot n’entre dans la réunion.
- Notes sémantiques : organisez vos transcriptions et notes avec recherche par similarité, synchronisation cloud optionnelle, et actions IA sur le contenu.
Le dictionnaire personnalisé apprend de vos corrections. Noms propres, jargon médical, termes techniques — l’application les mémorise pour les transcriptions suivantes.
Ce que j’en pense
Le pari « privacy-first sans compromis sur l’usage » est tenu. Beaucoup d’outils de dictée cloud vous vendent la facilité tout en gardant vos données. OPENWHISPR ne stocke rien : la base de données de transcription est locale, better-sqlite3 sur votre machine. Même en mode cloud, l’audio traverse juste pour la transcription, sans sauvegarde.
Côté technique, le projet est mature — 1 539 commits, 83 releases, la v1.7.5 est sortie le 11 juillet 2026. React 19, TypeScript, Tailwind v4, Electron 41, shadcn/ui, intégration sherpa-onnx pour Parakeet. Le code est ouvert sous MIT, l’interface est propre, et le serveur MCP permet de connecter votre assistant IA à vos notes par programmation.
Mon interrogation porte sur les réunions : la diarisation locale est prometteuse, mais la reconnaissance d’empreinte vocale à travers plusieurs réunions demande un calibrage. Les premiers retours sur Twitter sont positifs, mais la qualité dépendra de votre micro et du bruit ambiant.
Je trouve l’alternative pertinente face à WisprFlow et Granola — surtout si vous travaillez sur données sensibles (juridique, médical) ou sans connexion stable. Le mode hors ligne fonctionne réellement, ce qui n’est pas le cas de tous les concurrents.
- 🎙️ Raccourci global, colle automatiquement dans n’importe quelle app
- 🔒 Whisper/Parakeet en local, ou BYOK pour le cloud
- 🤖 Agent IA vocal avec raccourci dédié, pas de wake word
- 📅 Transcription de réunions avec diarisation et empreinte vocale
- 📝 Notes sémantiques, recherche par similarité, sync cloud optionnel
- 🌍 Plus de 100 langues, détection automatique, mode hors ligne
Sources
