Zur Navigation springen

React-Modelle

react-1 führt das erste Primitive zur Performance-Steuerung für die Videobearbeitung ein. Als ausdrucksstarkes KI-Talking-Head-Modell kann react-1 Lippenbewegungen, Gesichtsausdrücke und Kopfbewegungen mit einem Zielaudio synchronisieren und dabei einem Emotions-Prompt folgen. Unten beschreiben wir einige Workflows, die nur mit react-1 möglich sind.

Hauptfunktionen

  • Model Modes: Du kannst wählen, welcher Gesichtsbereich bearbeitet wird: nur der Mund, die Gesichtsausdrücke oder sogar Kopfbewegungen
  • Ausdrucksstarker lipsync: react-1 arbeitet auf einem deutlich größeren Gesichtsbereich und liefert dadurch die ausdrucksstärksten Mundbewegungen passend zur Sprache
  • Gesichtsausdrücke: Gesichtsausdrücke werden mithilfe eines Emotions-Prompts neu geschrieben, und selbst kleinste Mikroausdrücke bleiben perfekt mit der Sprache synchron
  • Kopfbewegungen: react-1 kann auch Kopfbewegungen mit Tempo, Prosodie und Intonation des neuen Dialogs synchronisieren

Model Modes

Das Modell kann mit drei Betriebsmodi gesteuert werden: lips, face und head.

So kannst du den räumlichen Bereich festlegen, den du bearbeiten möchtest. Du kannst nur lipsync wählen oder zusätzlich Gesichtsausdrücke bzw. Kopfbewegungen einbeziehen. Standard ist face.

ModusLipsyncGesichtsausdrückeKopfbewegungen
lips✅❌❌
face✅✅❌
head✅✅✅

Emotions-Prompts

Du kannst Gesichtsausdrücke durch Emotions-Prompts steuern. Du kannst auch keinen Prompt angeben, dann folgt das Modell dem emotionalen Kontext des Eingabevideos. Siehe die Nutzung unten für weitere Details.

Nutzung

react-1 ist über denselben API-endpoint /v2/generate verfügbar wie standardmäßiger lipsync, mit zusätzlichen Parametern zur Steuerung von Emotion und Bewegung.

Um react-1 über die API zu nutzen, setze den Parameter model auf react-1 und konfiguriere die zusätzlichen Optionen:

from sync import Sync
from sync.common import Audio, Video, GenerationOptions
sync = Sync()
response = sync.generations.create(
input=[
Video(url="https://assets.sync.so/docs/example-video.mp4"),
Audio(url="https://assets.sync.so/docs/example-audio.wav")
],
model="react-1",
options=GenerationOptions(
prompt="happy",
model_mode="face"
)
)

API-Parameter

model

Setze auf react-1, um das react-1-Modell zu verwenden.

options.model_mode

Steuert den Bearbeitungsbereich und den Bewegungsumfang des Modells. Verfügbare Optionen:

  • lips: Nur lipsync mit react-1 (minimale Gesichtsänderungen)
  • face (Standard): Lipsync + Gesichtsausdrücke ohne Kopfbewegungen
  • head: Lipsync + Gesichtsausdrücke + natürliche Talking-Head-Bewegungen

Der Parameter model_mode funktioniert nur mit dem Modell react-1. Bei anderen Modellen wird dieser Parameter ignoriert.

options.prompt

Emotions-Prompt für die Generierung. Aktuell werden nur einwortige Emotionen unterstützt.

Verfügbare Optionen:

  • happy
  • angry
  • sad
  • neutral
  • disgusted
  • surprised

Der Parameter prompt funktioniert nur mit dem Modell react-1. Bei anderen Modellen wird dieser Parameter ignoriert.

react-1 ist in Sync Labs Studio mit einer intuitiven Oberfläche zur Steuerung von Emotionen und Kopfbewegungen verfügbar.

1

Zu Studio navigieren

Gehe zu Studio und erstelle ein neues Projekt oder öffne ein bestehendes.

2

Assets auswählen

Lade deine Video- und Audioeingaben hoch oder wähle sie aus. Beachte, dass react-1 Eingaben bis zu 15 Sekunden unterstützt.

3

react-1-Modell auswählen

Wähle react-1 im Model-Dropdown in den Generierungseinstellungen aus.

4

Model Mode konfigurieren

Wähle den gewünschten Model Mode:

  • Lips: Nur für lipsync
  • Face: Für lipsync mit Gesichtsausdrücken (Standard)
  • Head: Für lipsync mit Gesichtsausdrücken und natürlichen Kopfbewegungen
5

Ausdruck ändern

Wähle einen Ausdruck aus dem Emotion-Wheel, indem du in den Steuerungen des Videoplayers auf klickst.

6

Generieren

Klicke auf Generate, um deinen lipsync mit emotionalen Gesichtsausdrücken und optionalen Kopfbewegungen zu erstellen.

Best Practices

Den richtigen Modus wählen
  • Verwende den Modus lips, wenn du nur lipsync ohne emotionale Änderungen brauchst
  • Verwende den Modus face (Standard) für die meisten Fälle, in denen du natürliche Ausdrücke möchtest
  • Verwende den Modus head, wenn du die dynamischsten und natürlichsten Talking-Head-Bewegungen möchtest
Passende Emotionen wählen

Wähle Emotions-Prompts, die zum Ton und Kontext deines Audios passen. Das Modell erzeugt Gesichtsausdrücke, die über die gesamte Generierung mit der ausgewählten Emotion übereinstimmen.

Eingabedauer

Halte deine Eingaben unter 15 Sekunden. Für längere Inhalte teile dein Video in Segmente auf und verarbeite sie getrennt, oder verwende die standardmäßigen lipsync-Modelle für längere Dauern.

Aktuelle Einschränkungen

Die folgenden Funktionen werden für react-1 noch nicht unterstützt:

  • Input Duration: react-1 unterstützt Eingaben bis zu 15 Sekunden. Für längere Inhalte solltest du dein Video in Segmente aufteilen.
  • Segments: Multi-Segment-Generierung mit unterschiedlichen Audioeingaben ist nicht verfügbar. Verarbeite jedes Segment bei Bedarf separat.
  • Sprecher-Auswahl: Die Option active_speaker_detection wird nicht unterstützt, einschließlich automatischer Erkennung (auto_detect) und manueller Auswahl über Bounding Box oder Frame-Nummer. Stelle sicher, dass dein Eingabevideo eine einzelne, klar sichtbare sprechende Person enthält.
  • Occlusion detection: Die Option occlusion_detection_enabled zur Behandlung teilweise verdeckter Gesichter ist für react-1 nicht verfügbar.

Wann react-1 verwenden

react-1 ist ideal für:

  • Short-form-Inhalte (≤ 15 Sekunden), die emotionale Ausdrücke erfordern
  • Videos, bei denen natürliche Kopfbewegungen das Ergebnis verbessern
  • Inhalte, die von emotionsbewussten Gesichtsausdrücken profitieren
  • Projekte, bei denen du dynamischere und ausdrucksstärkere lipsync-Ergebnisse willst

Für längere Inhalte (> 15 Sekunden) oder wenn du nur standardmäßigen lipsync brauchst, verwende stattdessen lipsync-2 oder lipsync-2-pro.

Preise

react-1 ist in kostenpflichtigen Abonnements (Creator und höher) verfügbar. Die Preise sind nutzungsbasiert bei 25 fps und unterscheiden sich von lipsync-Modellen, jedes Sync Labs-Modell hat seinen eigenen Preis pro Sekunde.

PlanPreis pro Sekunde (bei 25 fps)
Hobbyist / Creator$0.167/sec
Growth (5% Rabatt)$0.158/sec
Scale (20% Rabatt)$0.133/sec

react-1 ist das ausdrucksstärkste Modell und wird höher bepreist als lipsync-Modelle. Einen vollständigen Vergleich findest du auf der pricing page.

Die Preise für Sync Labs-Modelle variieren je Modell. react-1 ($0.133-$0.167/sec) kostet deutlich mehr als lipsync-2 ($0.04-$0.05/sec) oder lipsync-2-pro ($0.067-$0.083/sec). Gehe nicht davon aus, dass Preise über Modelle hinweg gleich sind.

FAQs

react-1 kostet $0.133-$0.167 pro Sekunde Ausgabevideo bei 25 fps, abhängig von deinem Abonnement. Hobbyist- und Creator-Pläne zahlen $0.167/sec, Growth zahlt $0.158/sec (5% Rabatt) und Scale zahlt $0.133/sec (20% Rabatt). Es erfordert ein kostenpflichtiges Abonnement (Creator-Plan oder höher).

Nein. react-1 ist deutlich höher bepreist als lipsync-Modelle. Beim Basispreis kostet react-1 ($0.167/sec) mehr als das 3-Fache von lipsync-2 ($0.05/sec) und etwa das 2-Fache von lipsync-2-pro ($0.083/sec). Jedes Sync Labs-Modell hat einen eigenen Preis pro Sekunde.

Nein. react-1 erfordert ein kostenpflichtiges Abonnement (Creator-Plan oder höher). Der Free Trial enthält nur Modelle der lipsync-Familie (lipsync-1.9.0-beta, lipsync-2, lipsync-2-pro).