Lip Sync · PixVerse
Lade einen Clip von jemandem hoch, der spricht, und dazu das Audio, das er sagen soll. Der Mund wird auf die Tonspur abgestimmt, die du lieferst.
Noch keine Projekte
Ein Video der sprechenden Person, bis 60 Sekunden und 100 MB. Ein klares, frontales Gesicht liefert die beste Übereinstimmung.
Eine MP3 oder WAV zwischen 5 und 60 Sekunden, bis 100 MB. Diesem Audio folgt der Mund.
Der fertige Clip übernimmt Qualität, Seitenverhältnis und Länge des Videos, das du hochgeladen hast, deshalb hält diese Seite diese Steuerelemente aus dem Weg.
Prüf die Credit-Kosten, sieh dir die Synchronität in der Vorschau an und lade das Ergebnis herunter.
Liefer eine übersetzte Tonspur, und die Person im Bild bleibt dieselbe.
Nimm einen Satz neu auf und leg ihn zurück aufs Material, statt neu zu drehen.
Produzier mehrere Versionen einer Botschaft aus einem einzigen Stück Filmmaterial.
Frisch die Sprecherspur eines bestehenden Moduls auf und behalt den ursprünglichen Vortragenden.
PixVerse, das eine Modell mit Lip Sync, deshalb zeigt die Seite ein festes Modell statt einer Auswahlliste.
Lade eine Audiodatei hoch – MP3 oder WAV, zwischen 5 und 60 Sekunden. Die Mundbewegungen werden auf diese Aufnahme abgestimmt.
Bis zu 60 Sekunden, bei höchstens 100 MB. Das generierte Video behält die Länge des Clips, den du hochlädst.
Das Ergebnis übernimmt beides aus deinem Quellclip, deshalb bleiben diese Steuerelemente von dieser Seite fern: Was du hochlädst, bestimmt, was du zurückbekommst.
Eine ruhige Einstellung, in der das Gesicht klar sichtbar ist und zur Kamera zeigt, mit freiem Blick auf den Mund.
Das hängt von der Länge deines Audios und deines Quellclips ab, und der Wert steht vor dem Bestätigen neben dem Generieren-Button.
Benötigt Quellvideo + Sprachaudio