Ir para a navegação

Dicas de conteúdo de mídia

A qualidade da sua mídia de entrada tem um impacto direto na saída final da lip sync. Para obter melhores resultados, siga estas dicas para preparar seu conteúdo de video e áudio.

Dicas para conteúdo de video

Evite visualizações de perfil e obstruções

Para obter o melhor desempenho, evite fotos de perfil completo (vista lateral) e obstruções que cubram o rosto.

Garanta um movimento natural de fala

O modelo tem melhor desempenho quando o personagem do video parece estar falando naturalmente. Isso preservará o estilo do locutor durante a lip sync.

Dica para video gerado por IA: ao criar videos com modelos de geração de video por IA de terceiros, inclua esta instrução no prompt de texto: "the character should be speaking naturally". O video AI gerado terá alguns movimentos aleatórios da boca, que são necessários para obter os melhores resultados do nosso modelo de lip sync.

Dicas para conteúdo de áudio

Use áudio nítido

Para obter melhor desempenho, evite áudio com música, ruído de fundo ou vários alto-falantes simultâneos.

Opções do modo de sincronização

Quando o video e o áudio têm durações diferentes, você pode escolher como lidar com a incompatibilidade usando o parâmetro sync_mode. Consulte o Guia do modo de sincronização para obter a matriz de comportamento completa e exemplos de duração de saída.

O modo de sincronização aplica-se apenas a entradas de video. Para entradas de imagem (sync-3), o modo de sincronização é ignorado, pois as imagens não têm duração intrínseca para comparação com o áudio.

quicar

Quando o video é mais curto que o áudio, a reprodução do video será revertida no final para corresponder à duração do áudio. Caso contrário, o video será cortado para corresponder ao áudio.

laço

Quando o video é mais curto que o áudio, o video será repetido desde o início para corresponder à duração do áudio. Caso contrário, o video será cortado para corresponder ao áudio.

cortar

Quando o áudio for maior que o video, o áudio será cortado para corresponder à duração do video. Caso contrário, o video será cortado para corresponder ao áudio.

silêncio

Quando o video for maior que o áudio, o silêncio será adicionado ao áudio para corresponder à duração do video. Quando o áudio é maior que o video, a saída mantém a duração total do áudio.

remapear

A velocidade de reprodução do video será ajustada (acelerada ou desacelerada) para corresponder exatamente à duração do áudio, preservando todo o conteúdo de ambos.

Modo Sync Labs padrão: O padrão depende do tipo de geração e da duração do video/áudio: - Gerações não segmentadas: - Video mais longo que áudio: cut_off é o padrão - Áudio mais longo que video: bounce é o padrão - Gerações segmentadas (usando segments_secs ou segments_frames): remap é o padrão, recomendado para evitar cortes abruptos no meio do video.

Escolhendo o modo Sync Labs correto: Use bounce ou loop para videos curtos com áudio mais longo, cut_off quando quiser priorizar a duração do video, silence quando quiser preservar o video completo e remap quando precisar preservar todo o conteúdo de video e áudio.

Recursos relacionados - Suporte a formatos de mídia - formatos de video e áudio suportados, codecs e propriedades de entrada recomendadas - Modelo Lipsync - aprenda sobre os modelos lip sync disponíveis e como a qualidade da entrada afeta a saída