Audio a texto · Grabaciones y vídeo
Sube el audio o el vídeo y el idioma se detecta solo. Al terminar, copia el texto, descarga un TXT o exporta subtítulos SRT. Un archivo de hasta 2 horas o 50 MB.
Aún no hay transcripciones
Tus proyectos recientes de audio a texto aparecerán aquí.
Arrastra un archivo de audio o vídeo: se aceptan AAC, AMR, AVI, FLAC, FLV, M4A, MKV, MOV, MP3, MP4, MPEG, OGG, OPUS, WAV, WEBM, WMA y WMV, con un máximo de 2 horas o 50 MB. El formato, el tamaño y la duración se comprueban antes de empezar a subir.
Es opcional, pero merece la pena con todo lo que un modelo general nunca ha oído: nombres propios, marcas, siglas y jerga interna. Hasta 50 términos, guardados en este dispositivo para la próxima vez.
La transcripción se procesa en nuestros servidores, así que puedes cerrar la pestaña y volver más tarde. La página final muestra la duración y el número de palabras sobre el texto completo, listo para copiar, descargar en TXT UTF-8 o exportar como subtítulos SRT.
Ten un registro citable de la entrevista y busca esa frase que recuerdas a medias, en lugar de rebobinar el audio una y otra vez.
Convierte la grabación de una reunión en una transcripción continua que puedes pegar en las notas del proyecto y enviar a quien no pudo asistir.
Repasa una clase o una charla a tu ritmo y guarda como texto anotable los tramos cargados de terminología.
Exporta un SRT generado a partir de las marcas de tiempo de cada frase y cárgalo en tu editor sin teclear los subtítulos a mano.
El reconocimiento de voz escucha la grabación entera y escribe lo que se dijo. Sustituye al trabajo de teclearlo todo a mano, de modo que una hora de audio se convierte en un documento legible y consultable en una fracción del tiempo.
Diecisiete formatos de audio y vídeo: AAC, AMR, AVI, FLAC, FLV, M4A, MKV, MOV, MP3, MP4, MPEG, OGG, OPUS, WAV, WEBM, WMA y WMV. Los vídeos se suben tal cual, sin extraer antes la pista de audio.
Un archivo cada vez, de hasta 2 horas y 50 MB. Los dos límites se comprueban primero en el navegador, así que un archivo demasiado grande se detecta al momento y no después de una subida larga.
No. El idioma hablado se detecta a partir de la propia grabación, así que el archivo no tiene por qué coincidir con el idioma de la interfaz.
Sí. Cada frase se guarda con su tiempo de inicio y de fin, por lo que el mismo resultado se exporta como archivo de subtítulos SRT además de la transcripción en TXT UTF-8. Si una grabación no produce marcas de tiempo utilizables, la opción SRT se desactiva en lugar de inventarlas.
Un crédito por cada minuto empezado de la grabación original: un archivo de 90 segundos cuesta 2 créditos. La estimación aparece en el botón de envío antes de empezar y no se cobra nada si la transcripción falla.
Depende de la grabación. Cuanto más clara sea la voz, menos se solapen los hablantes y menos ruido de fondo haya, mejor será el resultado. El punto débil habitual son los nombres, las marcas y los tecnicismos: justo para eso está el vocabulario de referencia.