Guia da API de Dublagem de Vídeo
A dublagem de vídeo combina áudio traduzido com vídeo sincronizado nos lábios para que o conteúdo dublado pareça natural no idioma alvo. Você pode usar o fluxo de dublagem embutido da Sync Labs com dubParams, ou fornecer o áudio traduzido você mesmo e usar a Sync Labs apenas para a etapa de lipsync.
Pré-requisitos
- Uma chave de API da Sync Labs
- Um vídeo fonte (URL ou arquivo enviado)
- Para dublagem embutida: áudio fonte no arquivo de vídeo
- Para dublagem manual: áudio traduzido no idioma alvo (de um serviço TTS ou ator de voz humano)
Instale o SDK para sua linguagem:
Configure sua chave de API:
Dublagem via API embutida com dubParams
Use dubParams quando quiser que a Sync Labs extraia o áudio fonte do vídeo, traduza e duble via ElevenLabs, e então execute o lipsync no resultado dublado. Este é o caminho mais simples quando seu vídeo de entrada já possui áudio fonte.
Quando dubParams estiver presente:
- forneça uma única entrada
videocom áudio - defina
dubParams.targetLangpara o código do idioma alvo, como"es","fr"ou"hi" - opcionalmente defina
dubParams.sourceLang; omita ou use"auto"para detecção automática do idioma fonte dubParams.numSpeakersestá obsoleto e é ignorado - Dublagem v2 detecta os falantes automaticamente- não inclua uma entrada de áudio separada para a faixa traduzida; entradas de áudio são ignoradas enquanto a dublagem estiver ativada
A dublagem embutida é suportada pela ElevenLabs. Se o vídeo não tiver áudio fonte utilizável, forneça seu próprio áudio traduzido e siga o pipeline manual abaixo.
Pipeline Manual de Dublagem
Prepare seu áudio traduzido
Gere áudio traduzido usando um serviço de texto para fala como ElevenLabs, Google Cloud TTS ou Amazon Polly. Você também pode usar um ator de voz humano. O áudio deve estar hospedado em uma URL publicamente acessível.
Se você já tem um arquivo de áudio traduzido, faça o upload para seu serviço de hospedagem e obtenha a URL.
Envie para a API da Sync Labs
Envie o vídeo fonte e o áudio traduzido para a API da Sync Labs. A API gera novos movimentos labiais que correspondem ao áudio traduzido.
Verifique o status até a conclusão
Verifique o status da geração até que ela seja concluída. Para sistemas de produção, use webhooks em vez de polling.
Usando a Integração ElevenLabs
A Sync Labs possui uma integração embutida com ElevenLabs que lida com texto para fala e lipsync em uma única chamada de API. Em vez de gerar áudio separadamente, você passa o texto traduzido diretamente.
O campo script tem um máximo de 5.000 caracteres por geração. Para scripts mais longos, divida-os em segmentos. Veja a página de Integrações para detalhes da configuração do ElevenLabs.
Idiomas Suportados
Os modelos de lipsync da Sync Labs são independentes de idioma. Eles funcionam com áudio em qualquer idioma - os modelos analisam as formas da boca a partir da forma de onda do áudio, não o idioma em si. Se seu áudio traduzido for claro e bem produzido, a saída do lipsync corresponderá.
Para o fluxo embutido dubParams, escolha um dos códigos targetLang suportados na Referência da API. Se precisar de um idioma fora dessa lista ou quiser mais controle sobre a tradução, gere ou grave o áudio traduzido separadamente e use o pipeline manual acima.
Para um tutorial completo do pipeline de tradução (transcrição, tradução, TTS e lipsync), veja o Guia da API de Tradução de Vídeo.
Dublagem com Múltiplos Falantes
Para vídeos com múltiplos falantes, use a API de segmentos para atribuir diferentes faixas de áudio a diferentes intervalos de tempo. Cada segmento pode referenciar uma entrada de áudio separada com uma voz distinta.
Veja o Guia de Segmentos para documentação completa e mais exemplos.
Dicas de desempenho
Próximos Passos
- Guia da API de Tradução de Vídeo — Construa um pipeline completo de transcrição a lipsync
- API de lotes — Processe centenas de trabalhos de dublagem de uma vez
- Guia de Segmentos — Gerencie vídeos com múltiplos falantes
- [Guia de Texto para Fala com Lip Sync](/tutorials/texto para fala-lipsync) — Combine TTS com lipsync

