Home
Audio5
Video9
Immagine2
Tutti gli strumenti
Risorse
Libreria voci
Documentazione per sviluppatori
Blog
Italiano
Accedi
Scarica l'app
AudioVoci multiple
Podcast AISintesi vocaleClonazione vocaleVoce AIVoci multiple

Sintesi vocale multi-speaker · Copioni di dialogo · 12 lingue

Sintesi vocale a più voci

Incolla un copione di dialogo e dai a ogni personaggio la sua voce

Incolla il copione: viene diviso in battute e ogni nome che compare riceve la sua voce. Su ogni battuta trovi un menu a tendina, così puoi passarla a un altro speaker quando vuoi.

  • Suddivisione automatica degli speaker
  • Cambia chi dice cosa
  • Emozione per ogni voce
  • Tag di pausa e risata
  • Esporta audio e SRT
Incolla un copione, oppure scrivilo blocco per blocco.

Ancora nessun progetto

Come funziona la sintesi vocale a più voci

  1. 1

    Incolla il copione di dialogo

    Incolla tutto il testo in una volta. Ogni blocco di dialogo diventa una battuta a sé — la divisione segue le righe vuote, oppure gli a capo quando righe vuote non ce ne sono — e non si perde niente. Puoi anche partire da una battuta vuota e scrivere qui, un blocco alla volta.

  2. 2

    Lascia che riconosca gli speaker

    I nomi scritti come «Alice:» o [Alice] a inizio paragrafo diventano ruoli. Se nel copione non ci sono nomi davanti alle battute, tutto finisce sul ruolo 1 e gli speaker li assegni tu.

  3. 3

    Assegna una voce a ogni ruolo

    Apri il selettore voci di ogni ruolo e scegli la voce, con un'emozione se ti serve. Un nome che corrisponde a una voce della libreria è già collegato a quella voce; agli altri nomi le voci vanno nell'ordine in cui compaiono.

  4. 4

    Sistema la lettura ed esporta

    Con il menu a tendina sposti una battuta su un altro speaker, e infili una pausa o una risata dove la lettura lo chiede. Poi generi ed esporti l'audio con i sottotitoli SRT.

Dove serve una voce per ogni speaker

Podcast a due conduttori

Hai scritto la puntata come botta e risposta tra conduttore e ospite. Dai una voce a ciascuno e le due parti suonano come due persone diverse.

Dialoghi per lezioni di lingua

Dai voce a una conversazione di esercizio, così chi studia sente due parlanti distinti. Esporta l'SRT insieme all'audio per il testo a schermo.

Audiodrammi e narrativa

Ogni personaggio della scena ha la sua voce e la sua emozione; dove il testo chiede un respiro, metti un sospiro o una pausa da un secondo.

Spot e sketch

Copioni brevi a due personaggi per una promo o una clip social. Li scrivi nell'editor, te li fai leggere e aggiusti i ruoli finché lo scambio funziona.

Domande frequenti sulla sintesi vocale a più voci

Che cos'è la sintesi vocale a più voci?

Legge ad alta voce un copione di dialogo con una voce diversa per ogni speaker, così un testo scritto diventa una conversazione. Incolli il copione, assegni una voce per ruolo ed esporti un unico file audio.

Come capisce chi sta parlando?

Cerca un nome a inizio paragrafo: «Alice:» con i due punti, anche nella versione a tutta larghezza, oppure [Alice] tra parentesi quadre, con nomi fino a 12 caratteri. La divisione per speaker viene applicata solo se almeno il 60% dei paragrafi porta un nome e compaiono almeno due nomi diversi; altrimenti tutto va su un solo ruolo e gli speaker li assegni tu.

Quanti speaker e quanto testo posso usare?

Fino a 10 ruoli, 200 battute e 20.000 caratteri in totale. La generazione è disponibile in 12 lingue.

Posso cambiare chi dice una battuta dopo la divisione?

Sì. Ogni battuta ha un menu a tendina, quindi la sposti su un altro speaker in qualsiasi momento. Subito dopo un incolla compare anche un annulla, una volta sola: puoi annullare l'incolla oppure solo la divisione per speaker, tenendo il testo.

Posso decidere come viene letta una battuta?

Sì, in due modi. Ogni voce può avere un'emozione, impostata dentro il selettore voci; di default è automatica e l'interpretazione viene dedotta dal testo. Poi puoi inserire tag di tono nel punto in cui sei con il cursore: risata, risatina, sospiro, respiro, schiarita di voce, esitazione, più pause da 0,5s, 1s o 2s. Il supporto dipende dalla voce: le pause funzionano con più voci rispetto ai tag di onomatopea, che sulle voci giapponesi non sono disponibili, e un tag che la voce scelta non gestisce viene segnalato nell'editor e blocca l'invio finché non lo togli.

Posso scaricare l'audio?

Sì. Esporti il file audio finito e, quando ti servono i sottotitoli, esporti anche l'SRT.

Forse cerchi un altro strumento

  • Sintesi vocale online

    Quando il testo è già scritto e manca solo la voce che lo legga.

  • Generatore di podcast AI

    Quando vuoi due conduttori che ne parlano tra loro, non una voce sola che legge da cima a fondo.

  • Generatore di voce AI

    Quando conta il modo di dirlo: più voci in un colpo solo, o una battuta che deve arrivare con vera emozione.