Guía de API de doblaje de video
El doblaje de video combina audio traducido con video con lip sync para que el contenido doblado se vea natural en el idioma objetivo. Puedes usar el flujo de doblaje integrado de Sync Labs con dubParams, o proporcionar tú mismo el audio traducido y usar Sync Labs para el paso de lipsync.
Prerrequisitos
- Una API key de Sync Labs
- Un video fuente (URL o asset cargado)
- Para doblaje integrado: audio fuente en el archivo de video
- Para doblaje manual: audio traducido en el idioma objetivo (de un servicio TTS o un actor de voz humano)
Instala el SDK para tu lenguaje:
Configura tu API key:
Doblaje integrado por API con dubParams
Usa dubParams cuando quieras que Sync Labs extraiga el audio fuente del video, lo traduzca y lo doble mediante ElevenLabs, y luego ejecute lipsync sobre el resultado doblado. Este es el camino más simple cuando tu video de entrada ya tiene audio fuente.
Cuando dubParams está presente:
- proporciona una sola entrada
videocon audio - establece
dubParams.targetLangcon el código de idioma objetivo, como"es","fr"o"hi" - opcionalmente establece
dubParams.sourceLang; omítelo o usa"auto"para detección automática del idioma fuente dubParams.numSpeakersestá deprecado y se ignora - Doblaje v2 detecta hablantes automáticamente- no incluyas una entrada de audio separada para la pista traducida; las entradas de audio se ignoran mientras el doblaje esté habilitado
El doblaje integrado está respaldado por ElevenLabs. Si el video no tiene audio fuente utilizable, proporciona tu propio audio traducido y sigue el pipeline manual de abajo.
Pipeline manual de doblaje
Prepara tu audio traducido
Genera audio traducido usando un servicio de texto a voz como ElevenLabs, Google Cloud TTS o Amazon Polly. También puedes usar un actor de voz humano. El audio debe estar alojado en una URL pública y accesible.
Si ya tienes un archivo de audio traducido, súbelo a tu servicio de hosting y obtén la URL.
Envía a la API de Sync Labs
Envía el video fuente y el audio traducido a la API de Sync Labs. La API genera nuevos movimientos labiales que coinciden con el audio traducido.
Haz polling hasta completar
Revisa el estado de la generación hasta que termine. Para sistemas de producción, usa webhooks en lugar de polling.
Uso de la integración con ElevenLabs
Sync Labs tiene una integración integrada con ElevenLabs que maneja texto a voz y lipsync en una sola llamada de API. En lugar de generar audio por separado, pasas el texto traducido directamente.
El campo script tiene un máximo de 5,000 caracteres por generación. Para scripts más largos, divídelos en segmentos. Consulta la página Integrations para ver detalles de configuración de ElevenLabs.
Idiomas compatibles
Los modelos lipsync de Sync Labs son agnósticos al idioma. Funcionan con audio en cualquier idioma - los modelos analizan las formas de la boca desde la forma de onda de audio, no el idioma en sí. Si tu audio traducido es claro y está bien producido, la salida de lipsync coincidirá.
Para el flujo integrado con dubParams, elige uno de los códigos targetLang compatibles en la API Reference. Si necesitas un idioma fuera de esa lista o quieres más control sobre la traducción, genera o graba el audio traducido por separado y usa el pipeline manual anterior.
Para una guía completa de un pipeline de traducción (transcripción, traducción, TTS y lipsync), consulta la guía de API para traducción de video.
Doblaje con múltiples hablantes
Para videos con múltiples hablantes, usa la API de segments para asignar diferentes pistas de audio a distintos rangos de tiempo. Cada segmento puede referenciar una entrada de audio separada con una voz distinta.
Consulta la guía de segmentos para ver la documentación completa y más ejemplos.
Consejos de rendimiento
Próximos pasos
- guía de API para traducción de video — Construye un pipeline completo desde transcripción hasta lipsync
- API de lotes — Procesa cientos de jobs de doblaje a la vez
- guía de segmentos — Maneja videos con múltiples hablantes
- [guía de lip sync con texto a voz](/tutorials/texto a voz-lipsync) — Combina TTS con lipsync

