Tipps zu Medieninhalten
Die Qualität Ihrer Eingabemedien hat einen direkten Einfluss auf die endgültige Lipsync-Ausgabe. Um optimale Ergebnisse zu erzielen, befolgen Sie bitte diese Tipps zur Vorbereitung Ihrer Video- und Audioinhalte.
Tipps für Videoinhalte
Tipp für KI-generiertes Video: Fügen Sie beim Erstellen von Videos mit KI-Videogenerierungsmodellen von Drittanbietern diese Anweisung in die Textaufforderung ein: "the character should be speaking naturally". Das generierte KI-Video weist einige zufällige Mundbewegungen auf, die notwendig sind, um mit unserem lip syncsmodell die besten Ergebnisse zu erzielen.
Tipps für Audioinhalte
Optionen für den Synchronisierungsmodus
Wenn Ihr Video und Ihr Audio unterschiedlich lang sind, können Sie mithilfe des Parameters sync_mode auswählen, wie mit der Nichtübereinstimmung umgegangen werden soll. Die vollständige Verhaltensmatrix und Beispiele für die Ausgabedauer finden Sie im Sync-Modus-Leitfaden.
Der Synchronisierungsmodus gilt nur für Videoeingänge. Bei Bildeingaben (sync-3) wird der Synchronisierungsmodus ignoriert, da Bilder keine intrinsische Dauer haben, die mit dem Audio verglichen werden kann.
Standard-Sync Labs-Modus: Die Standardeinstellung hängt von Ihrem Generierungstyp und der Video-/Audiodauer ab: - Nicht segmentierte Generationen: - Video länger als Audio: cut_off ist die Standardeinstellung - Audio länger als Video: bounce ist die Standardeinstellung - Segmentierte Generationen (mit segments_secs oder segments_frames): remap ist die Standardeinstellung, empfohlen, um abrupte Schnitte mitten im Video zu vermeiden.
Auswahl des richtigen Sync Labs-Modus: Verwenden Sie bounce oder loop für kurze Videos mit längerem Ton, cut_off, wenn Sie die Videolänge priorisieren möchten, silence, wenn Sie das gesamte Video erhalten möchten, und remap, wenn Sie alle Video- und Audioinhalte beibehalten müssen.

