RESCRIPT : couper sa vidéo comme on édite du texte
📌 RESCRIPT est un éditeur vidéo et audio open source qui transforme votre fichier en transcription minutée, puis laisse faire tout le montage dans ce texte : effacer un mot coupe la séquence correspondante, réécrire une phrase la fait prononcer par le locuteur d’origine. Il tourne dans le navigateur ou sur le bureau, sans que le fichier ne quitte votre machine.
On dépose une interview. En quelques secondes, Whisper transcrit localement avec un horodatage par mot et une étiquette de locuteur. Le montage se fait ensuite au clavier : vous sélectionnez « euh », vous appuyez sur Effacer, la séquence sort, et l’aperçu saute les coupes en temps réel. Un clic retire tous les « um », « uh » et les silences de plus de 0,3 seconde sur l’ensemble du fichier. Vous pouvez aussi importer votre propre SRT, VTT ou JSON et éditer directement dessus, sans transcription.
La fonction qui retient l’attention, c’est Regenerate. Vous avez bafouillé une phrase, vous la réécrivez et Rescript la synthétise dans la voix de la personne, clonée sur la machine à partir d’une dizaine de secondes d’audio propre déjà présente dans le fichier. La nouvelle ligne occupe exactement la fenêtre remplacée, un compteur d’ajustement prévient si elle ne rentre pas, et l’outil refuse d’accélérer au-delà de ce qui sonne juste. Cela fonctionne pour n’importe quel locuteur d’un enregistrement à plusieurs, en anglais, espagnol, français, allemand, italien et portugais. Je trouve l’approche maligne : pas d’entraînement, pas de profil vocal sur un serveur, la voix ne sort jamais de la machine. C’est ce que Descript fait dans le cloud ; ici, c’est gratuit et chez vous.
- 🖱️ Un mot effacé = la séquence correspondante est coupée
- 🧹 « Um », « uh » et silences retirés en un clic sur tout le fichier
- 🗣️ Regenerate réécrit une phrase dans la voix du locuteur, sur votre machine
- 📥 Import SRT, VTT ou JSON pour sauter la transcription
- 🎚️ Les coupes se réajustent à la main sur une timeline à vagues et poignées
- 📤 Export vidéo jusqu’en 4K, audio, transcription et sous-titres
Tout tourne en local : la transcription s’appuie sur Whisper en WebGPU avec repli WASM, et l’export repasse par ffmpeg.wasm. Les builds de bureau pour macOS, Windows et Linux se mettent à jour depuis GitHub Releases, tandis que le même éditeur s’ouvre dans le navigateur — idéalement Chromium, l’application ayant besoin de SharedArrayBuffer. Côté sortie, vous obtenez du MP4 ou WebM jusqu’en 4K, de l’audio M4A, MP3 ou WAV, une transcription TXT ou Markdown, des sous-titres SRT, VTT ou JSON, et même un export de timeline pour Resolve, Premiere, FCP, Pro Tools ou Reaper. L’image que je retiens : aucune dépendance, on peut débrancher le câble réseau après le premier téléchargement du modèle.
La réserve est la licence. Rescript est gratuit pour un usage non commercial sous PolyForm Noncommercial 1.0.0 ; l’usage commercial demande une licence payante, et la télémétrie anonyme — désactivable dans les réglages — est active par défaut. C’est cohérent avec la promesse de confidentialité, mais à connaître avant de l’utiliser sur un travail de client. Pour le montage de vos propres rushs, podcasts et entretiens, sans abonnement ni upload, l’approche me paraît difficile à battre.
Sources






