Avatar IA desde Videos

Cargar video

Haga clic o arrastre el archivo a esta área para cargar
Formato: mp4/mov, Duración: 3 segundos a 5 minutos Resolución recomendada 720P o 1080P, máximo 4K

(requerido para recorte de video)

Cargar imagen

Haga clic o arrastre el archivo a esta área para cargar
Formato: jpg/png, Tamaño: hasta 20M

Proceso de Operación de Avatar IA desde Videos

  1. Carga un video de ti mismo en formato MP4 o MOV. Puede ser horizontal o vertical, sin limitaciones de tamaño. La duración del video debe ser de al menos 3 segundos. Este video servirá como base para todos tus videos de personajes generados por IA posteriores. Asegúrate de que la persona en el video sea clara y atractiva.
  2. Después de cargar, haz clic en "Avatar Instantáneo" para iniciar el entrenamiento de IA (gratis por tiempo limitado).
  3. Espera 10 minutos, luego selecciona el video clon de IA que acabas de crear desde "Crear Sincronización de Labios" - "Mis Avatares".
  4. (Opcional) Si no estás satisfecho con el efecto de sincronización de labios del clon, primero verifica si tu video de entrenamiento cumple con los requisitos: debe haber solo un rostro en el video; la persona debe estar hablando en el video; el audio y los movimientos de labios deben estar sincronizados; evita ruido de fondo u otros sonidos. Si tu video de entrenamiento cumple con los requisitos, puedes hacer clic en la forma que ha completado el entrenamiento inicial y luego hacer clic en "Avatar de Estudio" (deducir un diamante) para realizar entrenamiento adicional de IA para tu personaje. Después de 2 horas, el sistema actualizará automáticamente tu modelo de IA. Elige el mismo personaje, y puedes generar videos con mejores efectos de sincronización de labios.

Precio: Se requieren 100 créditos para una sesión de "Avatar de Estudio".

Requisitos de Material Original

  • No uses videos con múltiples rostros apareciendo.
  • Asegúrate de que el rostro no sea ni demasiado grande ni demasiado pequeño. Todo el rostro debe estar dentro del área de la pantalla y no estar recortado. Se recomienda que el ancho del rostro ocupe entre un décimo y un tercio del ancho total del fotograma.
  • Asegúrate de que las características faciales no estén ocultas, garantizando la claridad de las características y contornos faciales.
  • La resolución de video recomendada es 720P o 1080P, con una resolución máxima que no exceda 4K.
  • La duración del video debe ser de no menos de 3 segundos y no más de 5 minutos (3s–5min).
  • Para mejores resultados de generación de sincronización de labios, se recomienda usar videos de personas hablando normalmente. El audio y los movimientos de labios en el video deben estar sincronizados, y se debe evitar el ruido de fondo u otros sonidos (excepto el habla). Mantén una velocidad de habla moderada; el habla demasiado lenta puede reducir la precisión de sincronización de labios, mientras que el habla demasiado rápida puede causar vibración en la sincronización de labios.
Ejemplo
Recomendado
Recomendado
Vista lateral
Vista lateral
Oclusión
Oclusión
Borroso
Borroso
Múltiples rostros
Múltiples rostros
Demasiado grande
Demasiado grande

Requisitos de Fondo Original

  • Si necesitas eliminar el fondo de la imagen o video cargado, por favor carga una imagen del fondo correspondiente. La imagen de fondo debe coincidir con el tamaño y resolución de la imagen o video original. La imagen de fondo no es la que reemplazarás en el futuro, sino la parte del fondo de tu imagen o video original. Por ejemplo, si tu video es una toma de ti hablando en una habitación, la imagen de fondo debe ser una foto de la habitación tomada desde el mismo ángulo.
  • Si tu imagen o video original tiene un fondo de color sólido, como una pantalla verde, también puedes seleccionar un color de la paleta de colores que coincida con el color de fondo de tu video.
  • Si no necesitas eliminar el fondo, por favor ignora la carga de la imagen de fondo.
Ejemplo
Material Original
Material Original
Fondo Original
Fondo Original
Efecto de Recorte
Efecto de Recorte

Avatar de Estudio

Continúa entrenando el modelo de aprendizaje profundo basado en el material de video proporcionado para mejorar aún más la claridad y similitud de los rostros generados. Si el material de video tiene buena sincronización audiovisual, el modelo después del entrenamiento continuo puede generar movimientos de labios con mayor sincronización. Si el audio y el video no están sincronizados o la calidad del sonido es pobre, por favor no uses "Avatar de Estudio".

  • No uses videos con múltiples rostros apareciendo.
  • Asegúrate de que el rostro no sea ni demasiado grande ni demasiado pequeño. Todo el rostro debe estar dentro del área de la pantalla y no estar recortado. Se recomienda que el ancho del rostro ocupe entre un décimo y un tercio del ancho total del fotograma.
  • Asegúrate de que las características faciales no estén ocultas, garantizando la claridad de las características y contornos faciales.
  • La resolución de video recomendada es 720P o 1080P, con una resolución máxima que no exceda 4K.
  • La duración del video debe ser de no menos de 3 segundos y no más de 5 minutos (3s–5min).
  • Para mejores resultados de generación de sincronización de labios, se recomienda usar videos de personas hablando normalmente. El audio y los movimientos de labios en el video deben estar sincronizados, y se debe evitar el ruido de fondo u otros sonidos (excepto el habla). Mantén una velocidad de habla moderada; el habla demasiado lenta puede reducir la precisión de sincronización de labios, mientras que el habla demasiado rápida puede causar vibración en la sincronización de labios.