AAI News Hub
InvestigaciónMon, August 17, 2026·2d ago

AnyTalk genera animación del habla sin datos de animación

El método adapta modelos de difusión de video para crear animación del habla en personajes 3D con sincronización labial.

Por qué importa

El trabajo apunta a una vía con menos datos para la animación del habla en personajes, reduciendo la dependencia de conjuntos de entrenamiento específicos de cada personaje, rigging o remallado. Si se valida en entornos de producción, los priors de movimiento basados en difusión podrían facilitar el despliegue de avatares 3D con sincronización labial en distintas mallas y sistemas de blendshape.

Puntos clave

  • 1.Genera animación del habla en 3D con sincronización labial para personajes arbitrarios.
  • 2.Usa ajuste específico del personaje sin datos de animación.
  • 3.AnyTalk_RT destilado apunta a rendimiento en tiempo real.

Investigadores presentaron AnyTalk, un método para generar animaciones del habla en 3D para personajes arbitrarios sin requerir datos de animación. El enfoque ajusta un modelo de difusión de video preentrenado con imágenes renderizadas de un personaje 3D objetivo emparejadas con embeddings de audio puestos a cero, y luego estima parámetros de blendshape para convertir el video generado de una cabeza parlante en animación del habla en 3D. Los autores también describen AnyTalk_RT, una versión destilada pensada para funcionar en tiempo real.

Pruébalo hoy

Lee el paper antes de construir pipelines de sincronización labial específicos para cada personaje que requieran datos de animación o rigging pesado.

Fuentes y cobertura original

Este resumen sintetiza y enlaza la cobertura de los medios siguientes.

¿Te gustó este resumen? Recibe el próximo en tu correo.

Más en Investigación