KI-Audio-Tools · KI-Podcast · Text-to-Speech · Stimmklonen
Die Audio-Tools nutzen dieselbe ListenHub-Stimmbibliothek. Verwenden Sie KI-Podcast, wenn aus Quellen auch ein Skript entstehen soll; bei fertigem Skript wählen Sie das passende Sprachwerkzeug.
Aus einem Dokument eine Podcast-Folge machen — solo oder mehrstimmig.
Text-to-SpeechText in Sprache umwandeln — viele Stimmen und Sprachen
StimmklonenKlone deine Stimme und nutze sie überall wieder
KI-StimmeJeder Sprecherrolle im selben Skript eine eigene Stimme geben.
Mehrere SprecherDialogskript einfügen, jeder Sprecher bekommt seine eigene Stimme
Gib ein Thema, bis zu fünf Dateien oder einen Link hinein, und die Episode wird geschrieben und vertont. Wähle Solo oder Duo, danach Kompakt (3–5 Min.), Ausführlich (8–15 Min.) oder Debatte (5–10 Min.), wo die beiden Hosts gegensätzliche Positionen vertreten.
Text einfügen, eine Datei hochladen oder einen Link einfügen. Ohne KI-Feinschliff wird wortgetreu gelesen, mit KI-Feinschliff bringt das Tool den Text vorher in gesprochene Sprache. Vor dem Export kannst du alles im Browser anhören.
Füge das ganze Dialogskript auf einmal ein. Es wird nach dem Namen am Absatzanfang getrennt, und jede Rolle bekommt ihre eigene Stimme, bis zu 10 Rollen, 200 Abschnitte und 20.000 Zeichen. An jedem Abschnitt sitzt ein Rollen-Dropdown für Zeilen, die bei der falschen Person gelandet sind.
KI-Stimme läuft auf seed-audio und bringt die Charakterstimmen der offiziellen ListenHub-Stimmbibliothek mit, Tonfall, Emotion, Tempo und Betonung stellst du Zeile für Zeile ein. Stimmklonen ist der Schritt davor, wenn die Stimme deine eigene sein soll: 25–35 Sekunden Sprechen reichen.
Ohne Skript schreibt und vertont der KI-Podcast eine Episode aus einem Thema, einem Dokument oder einem Link. Steht der Text schon, liest Text-to-Speech ihn vor. Ist dieser Text ein Dialog mit mehreren Rollen, geh zu Mehrere Sprecher. KI-Stimme ist richtig, wenn der Vortrag zählt, und Stimmklonen, wenn du selbst sprechen sollst.
Ja. Sie teilen sich eine Stimmbibliothek, und jede Stimme darin lässt sich kostenlos anhören. Eine im Stimmklonen erstellte Stimme steht in derselben Auswahl und klingt in jedem Tool gleich.
Text-to-Speech, Mehrere Sprecher, KI-Stimme und Stimmklonen decken 12 Sprachen ab: Englisch, Mandarin, Japanisch, Spanisch, Portugiesisch, Französisch, Deutsch, Türkisch, Koreanisch, Italienisch, Thailändisch und Vietnamesisch. Der KI-Podcast erzeugt auf Englisch, Mandarin und Japanisch.
Der KI-Podcast nimmt ein getipptes Thema, bis zu fünf Dateien (PDF, Word, EPUB, Markdown, TXT) und einen Link von YouTube, Substack, Medium, X, Reddit oder einer Artikelseite. Text-to-Speech nimmt eingefügten Text, eine Datei oder einen Link. Mehrere Sprecher und KI-Stimme starten mit dem Skript, das du einfügst.
25–35 Sekunden natürlich gesprochene Sprache, im Browser per Sprachchat aufgenommen oder als wav, mp3 oder m4a bis 20 MB hochgeladen. Pro Stimme wird eine Klon-Sprache festgelegt, und vor dem Speichern hörst du sie ab. Danach erscheint sie in der Stimmenauswahl von KI-Podcast und Text-to-Speech und lässt sich auch in KI-Stimme und Mehrere Sprecher wählen; außerhalb der Audio-Tools taucht sie zusätzlich in Folien und Erklärvideo auf.
KI-Podcast, Text-to-Speech und Mehrere Sprecher exportieren die Audiodatei plus SRT-Untertitel. KI-Stimme liefert nur die Audiodatei zum Download, ohne SRT.