Audio en texte · Enregistrements et vidéo
Importez l’audio ou la vidéo, la langue est reconnue toute seule. À la fin, copiez le texte, téléchargez un TXT ou exportez des sous-titres SRT. Un fichier de 2 heures ou 50 Mo maximum.
Aucune transcription pour le moment
Vos derniers projets audio vers texte apparaîtront ici.
Glissez un fichier audio ou vidéo : AAC, AMR, AVI, FLAC, FLV, M4A, MKV, MOV, MP3, MP4, MPEG, OGG, OPUS, WAV, WEBM, WMA et WMV sont acceptés, dans la limite de 2 heures ou 50 Mo. Le format, la taille et la durée sont vérifiés avant le début de l’envoi.
Facultatif, mais utile pour tout ce qu’un modèle généraliste n’a jamais entendu : noms de personnes, marques, sigles, jargon interne. Jusqu’à 50 termes, conservés sur cet appareil pour votre prochain envoi.
La transcription tourne sur nos serveurs : vous pouvez fermer l’onglet et y revenir plus tard. La page finale affiche la durée et le nombre de mots au-dessus du texte complet, prêt à être copié, téléchargé en TXT UTF-8 ou exporté en sous-titres SRT.
Obtenez un compte rendu citable de l’entretien enregistré, puis retrouvez par recherche la phrase dont vous ne vous souvenez qu’à moitié au lieu de réécouter l’audio.
Convertissez l’enregistrement d’une réunion en une transcription continue à coller dans vos notes de projet et à transmettre aux absents.
Relisez un cours ou une conférence à votre rythme et gardez les passages riches en terminologie sous forme de texte annotable.
Exportez un SRT construit à partir du minutage de chaque phrase et chargez-le directement dans votre logiciel de montage, sans taper les sous-titres à la main.
La reconnaissance vocale écoute l’enregistrement en entier et met par écrit ce qui a été dit. Elle remplace la saisie manuelle : une heure d’audio devient un document lisible et interrogeable en une fraction du temps.
Dix-sept formats audio et vidéo : AAC, AMR, AVI, FLAC, FLV, M4A, MKV, MOV, MP3, MP4, MPEG, OGG, OPUS, WAV, WEBM, WMA et WMV. Les vidéos s’envoient telles quelles, sans extraire la piste audio au préalable.
Un fichier à la fois, jusqu’à 2 heures et 50 Mo. Les deux limites sont vérifiées d’abord dans le navigateur : un fichier trop lourd est refusé immédiatement, et non au bout d’un long envoi.
Non. La langue parlée est détectée à partir de l’enregistrement lui-même, si bien que le fichier n’a pas besoin d’être dans la langue de l’interface.
Oui. Chaque phrase est enregistrée avec son début et sa fin, donc le même résultat s’exporte en fichier de sous-titres SRT en plus de la transcription en TXT UTF-8. Si un enregistrement ne fournit aucun minutage exploitable, l’export SRT est désactivé plutôt qu’inventé.
Un crédit par minute entamée de l’enregistrement original : un fichier de 90 secondes coûte 2 crédits. L’estimation s’affiche sur le bouton d’envoi avant de lancer, et rien n’est débité si la transcription échoue.
Cela dépend de l’enregistrement. Une voix claire, un seul interlocuteur à la fois et peu de bruit de fond donnent les meilleurs résultats. Le point faible habituel reste les noms propres, les marques et les termes spécialisés — c’est précisément le rôle du vocabulaire de référence.