Übersetzung des Textes einer Anhörung in der Nationalversammlung

Je cherche à retranscrire une audition ministérielle

Je souhaite obtenir un résumé précis d’une audition récente entre la ministre du numérique et le directeur de l’ANSSI. Cette vidéo, disponible sur le site de l’Assemblée nationale, ne fait l’objet d’aucun compte-rendu écrit officiel. Mon objectif est clair : extraire le contenu pour l’analyser sereinement.

La vidéo est hébergée à cette adresse : vidéo.assemblee-nationale.fr. Je commence donc par inspecter le code source de la page pour identifier le fichier média.

🔍 Je localise le fichier source de la vidéo

J’ouvre les outils de développement de mon navigateur en appuyant sur la touche F12. Je fouille le code HTML à la recherche de la balise vidéo. Je trouve rapidement mon bonheur dans une balise <source> pointant vers un flux HLS.

Voici l’URL exacte que j’ai récupérée :

<source src="https://videos-an.vodalys.com/videos/definst/mp4/ida/domain1/2026/10/las2_20261001135205.smil/master.m3u8">

Le fichier source est donc identifié. Je peux maintenant procéder à sa récupération pour le convertir en un fichier MP4 classique, plus facile à manipuler pour la suite de mes tests.

📥 Je récupère et convertis la vidéo avec VLC

J’utilise mon couteau suisse multimédia, VLC Media Player, pour télécharger le flux. Une fois le fichier video.mp4 enregistré sur mon disque dur, je me concentre sur la retranscription.

Je me lance alors dans une quête pour trouver l’outil capable de transcrire un fichier aussi lourd en français.

Je teste les outils de transcription en ligne

Ma vidéo dépasse largement le gigaoctet. Je cherche une solution gratuite ou abordable pour obtenir un texte fidèle. Mon premier réflexe se tourne vers Turboscribe.ai.

🚫 Turboscribe.ai : une limite bloquante

Je me rends sur leur tableau de bord. J’ajoute mon fichier et je sélectionne le mode « Baleine » pour une précision maximale. La transcription se lance et la rapidité est au rendez-vous.

 

Cependant, je me heurte vite à un mur : la version gratuite s’arrête net à 30 minutes d’audio. Mon fichier étant bien plus long, je dois chercher une alternative.

 

🎵 Je contourne la limite de poids avec l’extraction audio

Je me tourne ensuite vers Notta.ai, réputé pour sa qualité sur la langue française. Nouveau problème : mon fichier vidéo est refusé car il dépasse la limite de 1 Go.

Pour résoudre ce souci, je décide d’extraire uniquement la piste audio. Le fichier sera bien plus léger. Je retourne sur VLC pour cette opération technique.

Voici la manipulation que j’effectue pour isoler le son :

 

  1. J’ouvre VLC et je vais dans le menu Média dann Convertir / Enregistrer.
  2. J’ajoute mon fichier video.mp4 et je clique sur le bouton de conversion.
  3. Dans le profil, je choisis Audio – MP3.
  4. Je lance la conversion et j’obtiens un fichier video.mp3 de seulement 177 Mo.

C’est beaucoup plus gérable pour les outils en ligne. Je retourne donc sur Notta.ai avec ce nouveau fichier.

⚠️ Notta.ai et Vook.ai : des essais infructueux

J’importe mon fichier MP3 sur Notta. L’outil travaille bien, mais lors de la récupération, je constate que seul un extrait de 30 minutes est disponible. L’inscription promise pour débloquer la suite ne fonctionne pas comme attendu : l’option payante revient systématiquement.

Je ne me décourage pas. Je teste Vook.ai en espérant mieux.

J’envoie mon fichier MP3, je laisse tourner… et c’est le même constat. Le service me bloque également à 30 minutes d’écoute.

Mon avis sur la recherche du bon outil

Face à ces limitations successives, je comprends que la gratuité a des plafonds stricts pour les gros fichiers. Je dois maintenant me tourner vers une dernière solution : Scribe.cemea.org.

Je continue mon test avec cet outil pour voir s’il parviendra à traiter l’intégralité de l’audition sans me demander de paiement.

46 minutes après, je reçois le fichier transcription.zip, il fait 630ko et contient 3 fichiers : phrases.txt subtitles.srt timed_phrases.txt

C’est vraiment parfait, j’ai exactement ce que je voulais.

Je peux injecter le fichier phrases.txt dans une IA et travailler tout cela pour résumer, extraire les points clés …