Toutes les news taguées avec ce sujet.
Un système transforme une image unique en scène 3D éditable pour contrôler conjointement caméra et mouvement des objets en génération vidéo.
Une méthode qui fige les anciens adaptateurs LoRA et n'autorise que des lectures en une seule direction pour ajouter de nouvelles compétences sans interférence.
Une méthode combine les avantages du in-context learning et du fine-tuning léger pour personnaliser des LLM directement sur smartphone.
Un framework léger convertit un générateur vidéo de 33B paramètres en modèle de monde interactif piloté par instructions en langage naturel.