Sintesi vocale multi-speaker · Copioni di dialogo · 12 lingue
Incolla il copione: viene diviso in battute e ogni nome che compare riceve la sua voce. Su ogni battuta trovi un menu a tendina, così puoi passarla a un altro speaker quando vuoi.
Ancora nessun progetto
Incolla tutto il testo in una volta. Ogni blocco di dialogo diventa una battuta a sé — la divisione segue le righe vuote, oppure gli a capo quando righe vuote non ce ne sono — e non si perde niente. Puoi anche partire da una battuta vuota e scrivere qui, un blocco alla volta.
I nomi scritti come «Alice:» o [Alice] a inizio paragrafo diventano ruoli. Se nel copione non ci sono nomi davanti alle battute, tutto finisce sul ruolo 1 e gli speaker li assegni tu.
Apri il selettore voci di ogni ruolo e scegli la voce, con un'emozione se ti serve. Un nome che corrisponde a una voce della libreria è già collegato a quella voce; agli altri nomi le voci vanno nell'ordine in cui compaiono.
Con il menu a tendina sposti una battuta su un altro speaker, e infili una pausa o una risata dove la lettura lo chiede. Poi generi ed esporti l'audio con i sottotitoli SRT.
Hai scritto la puntata come botta e risposta tra conduttore e ospite. Dai una voce a ciascuno e le due parti suonano come due persone diverse.
Dai voce a una conversazione di esercizio, così chi studia sente due parlanti distinti. Esporta l'SRT insieme all'audio per il testo a schermo.
Ogni personaggio della scena ha la sua voce e la sua emozione; dove il testo chiede un respiro, metti un sospiro o una pausa da un secondo.
Copioni brevi a due personaggi per una promo o una clip social. Li scrivi nell'editor, te li fai leggere e aggiusti i ruoli finché lo scambio funziona.
Legge ad alta voce un copione di dialogo con una voce diversa per ogni speaker, così un testo scritto diventa una conversazione. Incolli il copione, assegni una voce per ruolo ed esporti un unico file audio.
Cerca un nome a inizio paragrafo: «Alice:» con i due punti, anche nella versione a tutta larghezza, oppure [Alice] tra parentesi quadre, con nomi fino a 12 caratteri. La divisione per speaker viene applicata solo se almeno il 60% dei paragrafi porta un nome e compaiono almeno due nomi diversi; altrimenti tutto va su un solo ruolo e gli speaker li assegni tu.
Fino a 10 ruoli, 200 battute e 20.000 caratteri in totale. La generazione è disponibile in 12 lingue.
Sì. Ogni battuta ha un menu a tendina, quindi la sposti su un altro speaker in qualsiasi momento. Subito dopo un incolla compare anche un annulla, una volta sola: puoi annullare l'incolla oppure solo la divisione per speaker, tenendo il testo.
Sì, in due modi. Ogni voce può avere un'emozione, impostata dentro il selettore voci; di default è automatica e l'interpretazione viene dedotta dal testo. Poi puoi inserire tag di tono nel punto in cui sei con il cursore: risata, risatina, sospiro, respiro, schiarita di voce, esitazione, più pause da 0,5s, 1s o 2s. Il supporto dipende dalla voce: le pause funzionano con più voci rispetto ai tag di onomatopea, che sulle voci giapponesi non sono disponibili, e un tag che la voce scelta non gestisce viene segnalato nell'editor e blocca l'invio finché non lo togli.
Sì. Esporti il file audio finito e, quando ti servono i sottotitoli, esporti anche l'SRT.
Quando il testo è già scritto e manca solo la voce che lo legga.
Quando vuoi due conduttori che ne parlano tra loro, non una voce sola che legge da cima a fondo.
Quando conta il modo di dirlo: più voci in un colpo solo, o una battuta che deve arrivare con vera emozione.