Sans compte

Transformez un fichier MP3 en texte

Le format audio le plus répandu, transcrit avec horodatages et chaque voix identifiée, en quelques minutes.

Faites glisser votre fichier ici

MP3, WAV, M4A, MP4, MOV… et tout autre audio ou vidéo, quelle que soit la taille

  • N’importe quel débit, mono ou stéréo
  • Détection automatique de la langue parmi plus de 90
  • Texte, sous-titres et résumé en une seule opération
  • MP3

À propos de cet outil

Le MP3 est le format habituel des dictaphones, des applications mobiles et des plateformes de podcast, et il convient parfaitement à la transcription. La compression retire des fréquences que l’oreille humaine ne perçoit pas, les mêmes dont la reconnaissance vocale n’a pas besoin non plus.

À partir de 64 kbit/s, la précision ne change pratiquement plus avec le débit. Ce qui pèse sur le résultat, c’est la distance au micro et plusieurs personnes qui parlent en même temps.

Ce qu’il fait

  • Compatible avec n’importe quel débit à partir de 32 kbit/s, mono ou stéréo, fixe ou variable.
  • Les fichiers longs sont traités en entier : un podcast de trois heures n’est pas découpé.
  • Les étiquettes ID3 et le nom du fichier n’ont aucun effet sur le résultat.
  • L’identification des voix marche même sur des mixages mono de plusieurs micros.

Comment ça marche

  1. 1

    Importez le MP3

    Jusqu’à 10 Go : plusieurs heures d’enregistrement dans un seul fichier.

  2. 2

    Il est transcrit automatiquement

    Environ trois minutes par heure d’audio, la progression visible à tout moment.

  3. 3

    Téléchargez le résultat

    DOCX, PDF, SRT, CSV ou JSON, vos corrections comprises.

Cas d’usage

Dictaphones

La plupart produisent du MP3 par défaut. Importez-le directement.

Épisodes de podcast

Le fichier publié suffit ; vous n’avez pas besoin des pistes de la séance d’enregistrement.

Mémos vocaux

N’importe quel enregistrement fait au téléphone se transcrit tout aussi bien.

Dans le détail

D’où viennent les MP3 qui arrivent sur cette page

En général d’un dictaphone. Ces appareils enregistrent à bas débit — 32, 48 ou 64 kbit/s — pour faire tenir de nombreuses heures dans peu de mémoire. Cela ne gêne pas la transcription : à ce niveau, la voix reste intacte, et ce qui est retiré, ce sont des fréquences que la parole n’utilise pas.

L’autre source fréquente est une vidéo dont l’audio a déjà été extrait, ou un podcast téléchargé. Les deux arrivent en général à 128 kbit/s ou plus, ce qui est largement suffisant. Les compresser davantage avant de les envoyer n’apporte rien : les minutes se comptent à la durée, pas au poids du fichier.

Quand l’enregistrement frôle les trois heures

Trois heures de MP3 occupent un peu plus de 150 Mo : la taille est donc rarement le problème. Ce qui vaut la peine d’être vérifié, c’est si le fichier commence par un passage sans intérêt : le couper au préalable réduit la consommation de minutes.

Si un même fichier contient plusieurs séances distinctes, il est conseillé de le découper. Non pour une raison technique, mais parce que chercher dans un texte de trois heures est inconfortable, et que le résumé doit couvrir des sujets sans rapport entre eux.

Questions fréquentes

Vous devez transcrire une vidéo ?

Importez-la et récupérez le texte horodaté, chaque voix identifiée et un résumé. Aucun compte n’est nécessaire pour commencer.