Accueil
Audio6
Vidéo9
Image2
Tous les outils
Ressources
Bibliothèque de voix
Documentation développeur
Blog
Français
Tarifs
Se connecter
Télécharger l'app
AudioAudio en texte
Podcast IASynthèse vocaleAudio en texteClonage de voixVoix IAVoix multiples

Audio en texte · Enregistrements et vidéo

Convertisseur audio en texte

Transformez un enregistrement en transcription

Importez l’audio ou la vidéo, la langue est reconnue toute seule. À la fin, copiez le texte, téléchargez un TXT ou exportez des sous-titres SRT. Un fichier de 2 heures ou 50 Mo maximum.

  • Langue détectée automatiquement
  • 17 formats audio et vidéo
  • Vocabulaire de référence pour les noms et le jargon
  • Export en TXT ou sous-titres SRT

Aucune transcription pour le moment

Vos derniers projets audio vers texte apparaîtront ici.

Comment convertir un audio en texte

  1. 1

    Importez un enregistrement

    Glissez un fichier audio ou vidéo : AAC, AMR, AVI, FLAC, FLV, M4A, MKV, MOV, MP3, MP4, MPEG, OGG, OPUS, WAV, WEBM, WMA et WMV sont acceptés, dans la limite de 2 heures ou 50 Mo. Le format, la taille et la durée sont vérifiés avant le début de l’envoi.

  2. 2

    Ajoutez un vocabulaire de référence

    Facultatif, mais utile pour tout ce qu’un modèle généraliste n’a jamais entendu : noms de personnes, marques, sigles, jargon interne. Jusqu’à 50 termes, conservés sur cet appareil pour votre prochain envoi.

  3. 3

    Copiez, téléchargez ou sous-titrez

    La transcription tourne sur nos serveurs : vous pouvez fermer l’onglet et y revenir plus tard. La page finale affiche la durée et le nombre de mots au-dessus du texte complet, prêt à être copié, téléchargé en TXT UTF-8 ou exporté en sous-titres SRT.

Utilisations de la transcription audio

Transcription d’entretiens

Obtenez un compte rendu citable de l’entretien enregistré, puis retrouvez par recherche la phrase dont vous ne vous souvenez qu’à moitié au lieu de réécouter l’audio.

Comptes rendus de réunion

Convertissez l’enregistrement d’une réunion en une transcription continue à coller dans vos notes de projet et à transmettre aux absents.

Cours et prises de notes

Relisez un cours ou une conférence à votre rythme et gardez les passages riches en terminologie sous forme de texte annotable.

Sous-titres pour vidéo

Exportez un SRT construit à partir du minutage de chaque phrase et chargez-le directement dans votre logiciel de montage, sans taper les sous-titres à la main.

FAQ sur la conversion audio en texte

Qu’est-ce que la transcription audio en texte ?

La reconnaissance vocale écoute l’enregistrement en entier et met par écrit ce qui a été dit. Elle remplace la saisie manuelle : une heure d’audio devient un document lisible et interrogeable en une fraction du temps.

Quels formats sont acceptés ?

Dix-sept formats audio et vidéo : AAC, AMR, AVI, FLAC, FLV, M4A, MKV, MOV, MP3, MP4, MPEG, OGG, OPUS, WAV, WEBM, WMA et WMV. Les vidéos s’envoient telles quelles, sans extraire la piste audio au préalable.

Quelle durée et quelle taille sont possibles ?

Un fichier à la fois, jusqu’à 2 heures et 50 Mo. Les deux limites sont vérifiées d’abord dans le navigateur : un fichier trop lourd est refusé immédiatement, et non au bout d’un long envoi.

Faut-il choisir une langue ?

Non. La langue parlée est détectée à partir de l’enregistrement lui-même, si bien que le fichier n’a pas besoin d’être dans la langue de l’interface.

Peut-on obtenir des sous-titres en plus du texte ?

Oui. Chaque phrase est enregistrée avec son début et sa fin, donc le même résultat s’exporte en fichier de sous-titres SRT en plus de la transcription en TXT UTF-8. Si un enregistrement ne fournit aucun minutage exploitable, l’export SRT est désactivé plutôt qu’inventé.

Comment les crédits sont-ils calculés ?

Un crédit par minute entamée de l’enregistrement original : un fichier de 90 secondes coûte 2 crédits. L’estimation s’affiche sur le bouton d’envoi avant de lancer, et rien n’est débité si la transcription échoue.

Quelle est la précision de la transcription ?

Cela dépend de l’enregistrement. Une voix claire, un seul interlocuteur à la fois et peu de bruit de fond donnent les meilleurs résultats. Le point faible habituel reste les noms propres, les marques et les termes spécialisés — c’est précisément le rôle du vocabulaire de référence.

Vous cherchez peut-être plutôt ceci

  • Générateur de podcast IA

    Quand vous préférez deux animateurs qui en discutent à une seule voix qui lit le texte du début à la fin.

  • Synthèse vocale en ligne

    Quand le script est déjà écrit et qu'il ne manque plus que la voix.