Le nouveau modèle d'IA de Tencent, HunyuanWorld-Voyager, crée de courtes vidéos en 3D à partir d'une seule image. Les utilisateurs peuvent contrôler la trajectoire de la caméra pour explorer la scène virtuelle. L'IA génère à la fois des informations vidéo et de profondeur, permettant une reconstruction 3D. Bien qu'il ne s'agisse pas de véritable 3D, la vidéo maintient une cohérence spatiale lorsque la caméra se déplace. Entraîné sur 100 000 clips vidéo, il est limité par sa dépendance à l'imitation des schémas de ses données d'entraînement, ce qui signifie qu'il a du mal avec des situations inédites. Chaque vidéo générée est courte (environ deux secondes), mais plusieurs clips peuvent être combinés pour des séquences plus longues.
Prepared by Jonathan Pierce and reviewed by editorial team.
Comments