Convertir VTT en SRT

Déposez votre fichier VTT : le fichier SRT, lisible par VLC, les logiciels de montage et les plateformes vidéo, est créé sur votre appareil.

Traitement 100 % local, rien n'est envoyé

Comment ça marche ?

Déposez votre fichier .vtt : il est lu et converti sur votre appareil, puis le fichier .srt est téléchargé aussitôt, sous le même nom. Rien n’est envoyé sur un serveur.

La conversion garde les horaires et le texte, numérote les sous-titres et remplace les points avant les millisecondes par des virgules. Les éléments propres au WebVTT sont retirés : en-tête, commentaires (NOTE), styles, identifiants, réglages de position et balises (voix, classes, horodatages karaoké).

Le fichier SRT obtenu fonctionne avec VLC, YouTube, Facebook, Premiere Pro, DaVinci Resolve et la plupart des logiciels de montage.

Exemples

Les sous-titres d’un cours en ligne

Un cours de 45 min exporté d’une plateforme en WebVTT (environ 700 sous-titres) devient un SRT utilisable dans un logiciel de montage, en une fraction de seconde.

Un horaire sans heures

Le WebVTT autorise les horaires courts comme 01:02.500 : ils sont complétés en 00:01:02,500 dans le SRT, soit 62,5 s.

Questions fréquentes

Quelle différence entre SRT et VTT ?
Les deux contiennent les mêmes informations : un numéro ou un identifiant, l’heure de début et de fin, puis le texte. Le SRT (SubRip) est le plus répandu : YouTube, Facebook, VLC, Premiere Pro, DaVinci Resolve. Le WebVTT (.vtt) est le format des sites web (balise <track>) et de Vimeo ; il utilise un point avant les millisecondes au lieu d’une virgule, et commence par la ligne « WEBVTT ».
Les accents de mon fichier s’affichent mal : que faire ?
Les anciens fichiers de sous-titres français sont souvent enregistrés en Windows-1252 plutôt qu’en UTF-8. L’outil reconnaît automatiquement l’encodage (UTF-8, UTF-16 ou Windows-1252) et enregistre toujours en UTF-8, compris par tous les lecteurs récents : les accents sont corrigés au passage.
Que deviennent les balises de voix et de style ?
Le SRT ne gère ni les voix (<v Nom>) ni les classes de style : seules les paroles sont gardées. Si le nom de la personne qui parle doit rester visible, ajoutez-le au texte avec « Modifier un fichier SRT », par exemple « MARIE : Bonjour ».
Ma vidéo ou mon texte sont-ils envoyés sur un serveur ?
Non. La transcription est faite par votre navigateur, sur votre appareil : votre vidéo, son son et le texte obtenu ne sont envoyés nulle part, contrairement à la plupart des outils de sous-titrage en ligne. Seul le modèle de reconnaissance vocale (Whisper) est téléchargé une fois, depuis Hugging Face, avec son moteur depuis jsDelivr, puis gardé en cache. Votre travail (texte et horaires, jamais la vidéo) est enregistré sur votre appareil pour pouvoir le reprendre.