TAVR: genera tus avatares parlantes a partir de un vídeo de referencia
TAVR es un nuevo método presentado por HeyGen Research y NTU que revoluciona la creación de avatares parlantes al sustituir las referencias de imagen única por clips de vídeo cortos, logrando una preservación de la identidad significativamente mejor y una generación entre escenas distintos de mayor calidad. El sistema se fundamenta en un entrenamiento en tres fases que salva la brecha de dominio entre las escenas de referencia y las de destino. Sobre un nuevo banco de pruebas entre escenas, TAVR obtiene la mejor similitud de identidad y una puntuación de calidad global de 16,42 frente a los 14,13 del siguiente mejor método. El enfoque permite crear avatares digitales de alta fidelidad a partir de vídeos auto-grabados cortos en lugar de sesiones fotográficas de estudio, y ha sido aceptado en SIGGRAPH Asia 2026.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.