Audio in testo · Registrazioni e video
Carica l’audio o il video, la lingua viene riconosciuta da sola. Alla fine copia il testo, scarica un TXT o esporta i sottotitoli SRT. Un file fino a 2 ore o 50 MB.
Ancora nessuna trascrizione
Qui compariranno i tuoi progetti recenti da audio a testo.
Trascina un file audio o video: sono accettati AAC, AMR, AVI, FLAC, FLV, M4A, MKV, MOV, MP3, MP4, MPEG, OGG, OPUS, WAV, WEBM, WMA e WMV, fino a 2 ore o 50 MB. Formato, dimensione e durata vengono controllati prima che il caricamento inizi.
È facoltativo, ma vale i pochi secondi per tutto ciò che un modello generico non ha mai sentito: nomi di persona, marchi, sigle, gergo interno. Fino a 50 voci, conservate su questo dispositivo per il caricamento successivo.
La trascrizione gira sui nostri server, quindi puoi chiudere la scheda e tornarci più tardi. La pagina finale mostra durata e numero di parole sopra il testo completo, pronto da copiare, scaricare in TXT UTF-8 o esportare come sottotitoli SRT.
Ottieni un resoconto citabile dell’intervista registrata e cerca la frase che ricordi a metà invece di riascoltare l’audio avanti e indietro.
Converti la registrazione di una riunione in una trascrizione continua da incollare negli appunti di progetto e da girare a chi era assente.
Rileggi una lezione o un intervento al tuo ritmo e conserva come testo annotabile i passaggi più densi di terminologia.
Esporta un SRT costruito sui tempi di ogni frase e caricalo direttamente nel montaggio, senza digitare i sottotitoli a mano.
Il riconoscimento vocale ascolta tutta la registrazione e mette per iscritto ciò che è stato detto. Sostituisce la digitazione manuale: un’ora di audio diventa un documento leggibile e consultabile in una frazione del tempo.
Diciassette formati audio e video: AAC, AMR, AVI, FLAC, FLV, M4A, MKV, MOV, MP3, MP4, MPEG, OGG, OPUS, WAV, WEBM, WMA e WMV. I video si caricano così come sono, senza estrarre prima la traccia audio.
Un file alla volta, fino a 2 ore e 50 MB. Entrambi i limiti vengono controllati prima nel browser, così un file troppo pesante viene bloccato subito e non al termine di un lungo caricamento.
No. La lingua parlata viene rilevata dalla registrazione stessa, quindi il file non deve per forza essere nella lingua dell’interfaccia.
Sì. Ogni frase viene salvata con l’orario di inizio e di fine, perciò lo stesso risultato si esporta come file di sottotitoli SRT oltre che come trascrizione in TXT UTF-8. Se una registrazione non produce tempi utilizzabili, l’esportazione SRT viene disattivata anziché inventata.
Un credito per ogni minuto iniziato della registrazione originale: un file di 90 secondi costa 2 crediti. La stima compare sul pulsante di invio prima di iniziare e, se la trascrizione fallisce, non viene addebitato nulla.
Dipende dalla registrazione. Voce chiara, una persona che parla alla volta e poco rumore di fondo danno i risultati migliori. Il punto debole tipico sono nomi, marchi e termini specialistici: è esattamente ciò a cui serve il vocabolario di riferimento.