Saltar a la navegación

Consejos para el contenido multimedia

La calidad de los medios de entrada tiene un impacto directo en el resultado final de la sincronización labial. Para obtener resultados óptimos, siga estos consejos para preparar su contenido de video y audio.

Consejos para contenido de vídeo

Evite vistas de perfil y obstrucciones

Para obtener el mejor rendimiento, evite tomas de perfil completo (vista lateral) y obstrucciones que cubran la cara.

Garantice un movimiento de conversación natural

El modelo se desempeña mejor cuando el personaje del video parece hablar con naturalidad. Preservará el estilo del hablante durante la sincronización de labios.

Consejo para videos generados por IA: al crear videos con modelos de generación de videos de IA de terceros, incluya esta instrucción en el mensaje de texto: "the character should be speaking naturally". El vídeo de IA generado tendrá algunos movimientos bucales aleatorios, que son necesarios para obtener los mejores resultados de nuestro modelo de sincronización labial.

Consejos para contenido de audio

Utilice audio claro

Para obtener el mejor rendimiento, evite el audio con música, ruido de fondo o varios parlantes simultáneos.

Opciones del modo de sincronización

Cuando su video y audio tienen duraciones diferentes, puede elegir cómo manejar la falta de coincidencia usando el parámetro sync_mode. Consulte la Guía del modo de sincronización para obtener la matriz de comportamiento completa y ejemplos de duración de salida.

El modo de sincronización solo se aplica a las entradas de video. Para las entradas de imágenes (sync-3), el modo de sincronización se ignora ya que las imágenes no tienen una duración intrínseca para comparar con el audio.

rebotar

Cuando el vídeo es más corto que el audio, el vídeo invertirá la reproducción al final para igualar la duración del audio. De lo contrario, el vídeo se recorta para que coincida con el audio.

bucle

Cuando el vídeo es más corto que el audio, el vídeo se repetirá desde el principio para coincidir con la duración del audio. De lo contrario, el vídeo se recorta para que coincida con el audio.

cierre

Cuando el audio es más largo que el video, el audio se cortará para que coincida con la duración del video. De lo contrario, el vídeo se recorta para que coincida con el audio.

silencio

Cuando el vídeo es más largo que el audio, se agregará silencio al audio para que coincida con la duración del vídeo. Cuando el audio es más largo que el vídeo, la salida mantiene la duración completa del audio.

reasignar

La velocidad de reproducción del video se ajustará (acelerará o desacelerará) para que coincida exactamente con la duración del audio, preservando todo el contenido de ambos.

Modo Sync Labs predeterminado: El valor predeterminado depende del tipo de generación y de la duración del video/audio:

  • Generaciones no segmentadas:
  • Vídeo más largo que el audio: cut_off es el valor predeterminado
  • Audio más largo que el vídeo: bounce es el valor predeterminado
  • Generaciones segmentadas (usando segments_secs o segments_frames): remap es el valor predeterminado, recomendado para evitar cortes abruptos a mitad del video.

Elegir el modo Sync Labs correcto: use bounce o loop para videos cortos con audio más largo, cut_off cuando desee priorizar la duración del video, silence cuando desee conservar el video completo y remap cuando necesite preservar todo el contenido tanto del video como del audio.

Recursos relacionados