Passer à la navigation

Modeles React

react-1 introduit la premiere primitive de controle de performance pour le montage video. En tant que modele IA expressif de talking head, react-1 peut synchroniser les mouvements des levres, les expressions faciales et les mouvements de tete pour correspondre a un audio cible, tout en suivant un prompt emotionnel. Nous decrivons ci-dessous quelques workflows possibles uniquement avec react-1.

Fonctionnalites principales

  • Model Modes: Vous pouvez choisir la zone du visage a editer : seulement la bouche, les expressions faciales, ou meme les mouvements de tete
  • Expressive lipsync: react-1 opere sur une zone faciale bien plus large, ce qui donne les mouvements de bouche les plus expressifs et alignes sur la parole
  • Facial Expressions: les expressions faciales sont reecrites via un prompt emotionnel, et chaque micro-expression reste parfaitement synchronisee avec la parole.
  • Head Movements: react-1 peut aussi synchroniser les mouvements de tete pour correspondre au rythme, a la prosodie et a l’intonation du nouveau dialogue.

Modes du modele

Le modele peut etre controle avec trois modes de fonctionnement : lips, face et head.

Cela vous permet de definir la zone spatiale a editer. Vous pouvez choisir uniquement le lipsync, ou aussi les expressions faciales et les mouvements de tete. La valeur par defaut est face.

ModeLipsyncFacial ExpressionsHead Movements
lips✅❌❌
face✅✅❌
head✅✅✅

Prompts d’emotion

Vous pouvez guider les expressions faciales en precisant des prompts d’emotion. Vous pouvez aussi ne rien preciser ; dans ce cas, le modele suivra le contexte emotionnel de la video d’entree. Voir l’usage ci-dessous pour plus de details.

Utilisation

react-1 est disponible via le meme endpoint API /v2/generate que le lipsync standard, avec des parametres supplementaires pour controler les effets emotionnels et de mouvement.

Pour utiliser react-1 avec l’API, definissez le parametre model sur react-1 et configurez les options supplementaires :

from sync import Sync
from sync.common import Audio, Video, GenerationOptions
sync = Sync()
response = sync.generations.create(
input=[
Video(url="https://assets.sync.so/docs/example-video.mp4"),
Audio(url="https://assets.sync.so/docs/example-audio.wav")
],
model="react-1",
options=GenerationOptions(
prompt="happy",
model_mode="face"
)
)

Parametres API

model

Definissez react-1 pour utiliser le modele react-1.

options.model_mode

Controle la zone d’edition et l’amplitude de mouvement du modele. Options disponibles :

  • lips: Lipsync uniquement avec react-1 (changements faciaux minimes)
  • face (defaut): Lipsync + expressions faciales sans mouvements de tete
  • head: Lipsync + expressions faciales + mouvements naturels de talking head

Le parametre model_mode fonctionne uniquement avec le modele react-1. Pour les autres modeles, ce parametre est ignore.

options.prompt

Prompt emotionnel pour la generation. Actuellement, seules les emotions en un seul mot sont prises en charge.

Options disponibles :

  • happy
  • angry
  • sad
  • neutral
  • disgusted
  • surprised

Le parametre prompt fonctionne uniquement avec le modele react-1. Pour les autres modeles, ce parametre est ignore.

react-1 est disponible dans Sync Labs Studio avec une interface intuitive pour controler les expressions emotionnelles et les mouvements de tete.

1

Aller dans Studio

Allez dans Studio et creez un nouveau projet ou ouvrez un projet existant.

2

Selectionner vos assets

Upload ou selectionnez vos entrees video et audio. Rappelez-vous que react-1 prend en charge des entrees jusqu’a 15 secondes.

3

Choisir le modele react-1

Selectionnez react-1 dans la liste des modeles des parametres de generation.

4

Configurer le mode du modele

Choisissez le mode souhaite :

  • Lips: Pour le lipsync uniquement
  • Face: Pour le lipsync avec expressions faciales (par defaut)
  • Head: Pour le lipsync avec expressions faciales et mouvements de tete naturels
5

Changer l'expression

Selectionnez une expression depuis la roue des emotions en cliquant sur dans les controles du lecteur video.

6

Generer

Cliquez sur generate pour creer votre lipsync avec expressions emotionnelles et mouvements de tete optionnels.

Bonnes pratiques

Choisir le bon mode
  • Utilisez le mode lips si vous avez seulement besoin de lipsync sans changements emotionnels
  • Utilisez le mode face (defaut) pour la plupart des cas ou vous voulez des expressions naturelles
  • Utilisez le mode head si vous voulez les mouvements de talking head les plus dynamiques et naturels
Choisir les emotions adaptees

Choisissez des prompts d’emotion qui correspondent au ton et au contexte de votre audio. Le modele genere des expressions faciales alignees sur l’emotion selectionnee pendant toute la generation.

Duree d'entree

Gardez vos entrees en dessous de 15 secondes. Pour un contenu plus long, decoupez votre video en segments et traitez-les separement, ou utilisez les modeles lipsync standards pour les longues durees.

Limitations actuelles

Les fonctionnalites suivantes ne sont pas encore prises en charge pour react-1 :

  • Input Duration: react-1 prend en charge des entrees jusqu’a 15 secondes. Pour un contenu plus long, envisagez de decouper votre video en segments.
  • Segments: La generation multi-segments avec differents audios n’est pas disponible. Traitez chaque segment separement si necessaire.
  • sélection du locuteur: L’option active_speaker_detection n’est pas prise en charge, y compris la detection automatique (auto_detect) et la selection manuelle via bounding box ou numero de frame. Assurez-vous que votre video d’entree contient un seul locuteur clairement visible.
  • Occlusion detection: L’option occlusion_detection_enabled pour gerer les visages partiellement masques n’est pas disponible pour react-1.

Quand utiliser react-1

react-1 est ideal pour :

  • Des contenus courts (≤ 15 secondes) qui necessitent des expressions emotionnelles
  • Des videos ou des mouvements naturels de tete ameliorent le resultat
  • Des contenus qui beneficient d’expressions faciales sensibles a l’emotion
  • Des projets ou vous voulez des resultats lipsync plus dynamiques et expressifs

Pour les contenus plus longs (> 15 secondes) ou si vous avez seulement besoin de lipsync standard, envisagez d’utiliser lipsync-2 ou lipsync-2-pro.

Tarification

react-1 est disponible sur les abonnements payants (Creator et superieur). La tarification est basee sur l’usage a 25 fps et differente de celle des modeles lipsync ; chaque modele Sync Labs a son propre tarif par seconde.

PlanPer-second rate (at 25 fps)
Hobbyist / Creator$0.167/sec
Growth (5% discount)$0.158/sec
Scale (20% discount)$0.133/sec

react-1 est le modele le plus expressif et son prix est plus eleve que celui des modeles lipsync. Consultez la page de tarification pour une comparaison complete.

La tarification des modeles Sync Labs varie selon le modele. react-1 ($0.133-$0.167/sec) coute nettement plus cher que lipsync-2 ($0.04-$0.05/sec) ou lipsync-2-pro ($0.067-$0.083/sec). Ne supposez pas que les prix sont identiques entre modeles.

FAQ

react-1 coute $0.133-$0.167 par seconde de video de sortie a 25 fps, selon votre abonnement. Les offres Hobbyist et Creator paient $0.167/sec, Growth paie $0.158/sec (remise de 5 %), et Scale paie $0.133/sec (remise de 20 %). Un abonnement payant est requis (Creator ou superieur).

Non. react-1 est facture significativement plus cher que les modeles lipsync. Au tarif de base, react-1 ($0.167/sec) coute plus de 3x le prix de lipsync-2 ($0.05/sec) et environ 2x celui de lipsync-2-pro ($0.083/sec). Chaque modele Sync Labs a une tarification par seconde independante.

Non. react-1 necessite un abonnement payant (Creator ou superieur). L’essai gratuit inclut uniquement les modeles de la famille lipsync (lipsync-1.9.0-beta, lipsync-2, lipsync-2-pro).