Start
Audio5
Video9
Bild2
Alle Tools
Ressourcen
Stimmbibliothek
Entwickler-Doku
Blog
Deutsch
Anmelden
App laden

KI-Audio-Tools · KI-Podcast · Text-to-Speech · Stimmklonen

KI-Audio-Tools

KI-Audio-Tools für Skripte, Dokumente und Links

Die Audio-Tools nutzen dieselbe ListenHub-Stimmbibliothek. Verwenden Sie KI-Podcast, wenn aus Quellen auch ein Skript entstehen soll; bei fertigem Skript wählen Sie das passende Sprachwerkzeug.

  • Podcast aus einem Thema, einem Dokument oder einem Link
  • Texte und Dokumente wortgetreu oder mit KI-Feinschliff vorgelesen
  • Dialogskripte nach Sprechern getrennt, eine Stimme pro Rolle
  • Deine geklonte Stimme, in allen Audio-Tools nutzbar
  • Jede Stimme der Bibliothek lässt sich kostenlos anhören

Alle Tools

5
KI-Podcast

Aus einem Dokument eine Podcast-Folge machen — solo oder mehrstimmig.

Text-to-Speech

Text in Sprache umwandeln — viele Stimmen und Sprachen

Stimmklonen

Klone deine Stimme und nutze sie überall wieder

KI-Stimme

Jeder Sprecherrolle im selben Skript eine eigene Stimme geben.

Mehrere Sprecher

Dialogskript einfügen, jeder Sprecher bekommt seine eigene Stimme

Welches Audio-Tool passt wann

Noch nichts geschrieben: KI-Podcast

Gib ein Thema, bis zu fünf Dateien oder einen Link hinein, und die Episode wird geschrieben und vertont. Wähle Solo oder Duo, danach Kompakt (3–5 Min.), Ausführlich (8–15 Min.) oder Debatte (5–10 Min.), wo die beiden Hosts gegensätzliche Positionen vertreten.

Das Skript steht schon: Text-to-Speech

Text einfügen, eine Datei hochladen oder einen Link einfügen. Ohne KI-Feinschliff wird wortgetreu gelesen, mit KI-Feinschliff bringt das Tool den Text vorher in gesprochene Sprache. Vor dem Export kannst du alles im Browser anhören.

Es sprechen mehrere: Mehrere Sprecher

Füge das ganze Dialogskript auf einmal ein. Es wird nach dem Namen am Absatzanfang getrennt, und jede Rolle bekommt ihre eigene Stimme, bis zu 10 Rollen, 200 Abschnitte und 20.000 Zeichen. An jedem Abschnitt sitzt ein Rollen-Dropdown für Zeilen, die bei der falschen Person gelandet sind.

Es kommt auf den Vortrag an, oder die Stimme soll deine sein: KI-Stimme und Stimmklonen

KI-Stimme läuft auf seed-audio und bringt die Charakterstimmen der offiziellen ListenHub-Stimmbibliothek mit, Tonfall, Emotion, Tempo und Betonung stellst du Zeile für Zeile ein. Stimmklonen ist der Schritt davor, wenn die Stimme deine eigene sein soll: 25–35 Sekunden Sprechen reichen.

Häufige Fragen zu den Audio-Tools

Welches Audio-Tool passt zu meiner Aufgabe?

Ohne Skript schreibt und vertont der KI-Podcast eine Episode aus einem Thema, einem Dokument oder einem Link. Steht der Text schon, liest Text-to-Speech ihn vor. Ist dieser Text ein Dialog mit mehreren Rollen, geh zu Mehrere Sprecher. KI-Stimme ist richtig, wenn der Vortrag zählt, und Stimmklonen, wenn du selbst sprechen sollst.

Nutzen die Audio-Tools dieselben Stimmen?

Ja. Sie teilen sich eine Stimmbibliothek, und jede Stimme darin lässt sich kostenlos anhören. Eine im Stimmklonen erstellte Stimme steht in derselben Auswahl und klingt in jedem Tool gleich.

In welchen Sprachen kann ich Audio erzeugen?

Text-to-Speech, Mehrere Sprecher, KI-Stimme und Stimmklonen decken 12 Sprachen ab: Englisch, Mandarin, Japanisch, Spanisch, Portugiesisch, Französisch, Deutsch, Türkisch, Koreanisch, Italienisch, Thailändisch und Vietnamesisch. Der KI-Podcast erzeugt auf Englisch, Mandarin und Japanisch.

Was kann ich hineingeben?

Der KI-Podcast nimmt ein getipptes Thema, bis zu fünf Dateien (PDF, Word, EPUB, Markdown, TXT) und einen Link von YouTube, Substack, Medium, X, Reddit oder einer Artikelseite. Text-to-Speech nimmt eingefügten Text, eine Datei oder einen Link. Mehrere Sprecher und KI-Stimme starten mit dem Skript, das du einfügst.

Was brauche ich zum Klonen, und wo funktioniert die Stimme?

25–35 Sekunden natürlich gesprochene Sprache, im Browser per Sprachchat aufgenommen oder als wav, mp3 oder m4a bis 20 MB hochgeladen. Pro Stimme wird eine Klon-Sprache festgelegt, und vor dem Speichern hörst du sie ab. Danach erscheint sie in der Stimmenauswahl von KI-Podcast und Text-to-Speech und lässt sich auch in KI-Stimme und Mehrere Sprecher wählen; außerhalb der Audio-Tools taucht sie zusätzlich in Folien und Erklärvideo auf.

Was kann ich exportieren?

KI-Podcast, Text-to-Speech und Mehrere Sprecher exportieren die Audiodatei plus SRT-Untertitel. KI-Stimme liefert nur die Audiodatei zum Download, ohne SRT.

Alle Tools