El nuevo modelo de IA de Tencent, HunyuanWorld-Voyager, crea videos cortos con apariencia 3D a partir de una sola imagen. Los usuarios pueden controlar la trayectoria de la cámara para explorar la escena virtual. La IA genera información de video y profundidad, permitiendo la reconstrucción 3D. Si bien no es un 3D verdadero, el video mantiene la consistencia espacial a medida que se mueve la cámara. Entrenado con 100.000 clips de video, está limitado por su dependencia de la imitación de patrones de sus datos de entrenamiento, lo que significa que tiene dificultades con situaciones no vistas. Cada video generado es corto (alrededor de dos segundos), pero se pueden combinar varios clips para obtener secuencias más largas.
Prepared by Jonathan Pierce and reviewed by editorial team.
Comments