Guide API du doublage vidéo
Le doublage vidéo combine un audio traduit avec une vidéo lipsync pour que le contenu doublé paraisse naturel dans la langue cible. Vous pouvez soit utiliser le flux de doublage intégré de Sync Labs avec dubParams, soit fournir vous-même l’audio traduit et utiliser Sync Labs pour l’étape lipsync.
Prérequis
- Une clé API Sync Labs
- Une vidéo source (URL ou asset uploadé)
- Pour le doublage intégré: audio source dans le fichier vidéo
- Pour le doublage manuel: audio traduit dans la langue cible (d’un service TTS ou d’un comédien voix)
Installez le SDK pour votre langage:
Définissez votre clé API:
Doublage API intégré avec dubParams
Utilisez dubParams quand vous voulez que Sync Labs extraie l’audio source de la vidéo, le traduise et le double via ElevenLabs, puis exécute le lipsync sur le résultat doublé. C’est le chemin le plus simple quand votre vidéo d’entrée contient déjà l’audio source.
Quand dubParams est présent:
- fournissez une seule entrée
videoavec audio - définissez
dubParams.targetLangsur le code langue cible, comme"es","fr"ou"hi" - définissez éventuellement
dubParams.sourceLang, omettez-le ou utilisez"auto"pour la détection automatique de la langue source dubParams.numSpeakersest obsolète et ignoré, Doublage v2 détecte automatiquement les intervenants- n’incluez pas d’entrée audio séparée pour la piste traduite, les entrées audio sont ignorées quand le doublage est activé
Le doublage intégré s’appuie sur ElevenLabs. Si la vidéo n’a pas d’audio source exploitable, fournissez plutôt votre propre audio traduit et suivez le pipeline manuel ci-dessous.
Pipeline de doublage manuel
Préparer l'audio traduit
Générez l’audio traduit avec un service synthèse vocale comme ElevenLabs, Google Cloud TTS ou Amazon Polly. Vous pouvez aussi utiliser un comédien voix. L’audio doit être hébergé sur une URL publique accessible.
Si vous avez déjà un fichier audio traduit, uploadez-le sur votre service d’hébergement et récupérez l’URL.
Envoyer à l'API Sync Labs
Envoyez la vidéo source et l’audio traduit à l’API Sync Labs. L’API génère de nouveaux mouvements de lèvres correspondant à l’audio traduit.
Interroger jusqu'à la fin
Vérifiez le statut de génération jusqu’à sa fin. Pour les systèmes de production, utilisez des webhooks au lieu du polling.
Utiliser l’intégration ElevenLabs
Sync Labs propose une intégration ElevenLabs intégrée qui gère synthèse vocale et lipsync dans un seul appel API. Au lieu de générer l’audio séparément, vous passez directement le texte traduit.
Le champ script a un maximum de 5 000 caractères par génération. Pour des scripts plus longs, découpez-les en segments. Voir la page Integrations pour les détails de configuration ElevenLabs.
Langues prises en charge
Les modèles lipsync de Sync Labs sont agnostiques à la langue. Ils fonctionnent avec de l’audio dans n’importe quelle langue, les modèles analysent les formes de bouche à partir de la forme d’onde audio, pas de la langue elle-même. Si votre audio traduit est clair et bien produit, la sortie lipsync correspondra.
Pour le flux dubParams intégré, choisissez un des codes targetLang pris en charge dans l’API Reference. Si vous avez besoin d’une langue hors de cette liste ou de plus de contrôle sur la traduction, générez ou enregistrez l’audio traduit séparément et utilisez le pipeline manuel ci-dessus.
Pour un walkthrough complet d’un pipeline de traduction (transcription, traduction, TTS et lipsync), voir le guide API de traduction vidéo.
Doublage multi-intervenants
Pour les vidéos avec plusieurs intervenants, utilisez la segments API pour assigner différentes pistes audio à différentes plages de temps. Chaque segment peut référencer une entrée audio distincte avec une voix différente.
Voir le guide des segments pour la documentation complète et plus d’exemples.
Conseils de performance
Étapes suivantes
- guide API de traduction vidéo — Construire un pipeline complet de la transcription au lipsync
- API de lots — Traiter des centaines de jobs de doublage en une fois
- guide des segments — Gérer les vidéos multi-intervenants
- [guide de lip sync avec synthèse vocale](/tutorials/synthèse vocale-lipsync) — Combiner TTS et lipsync

