RECHERCHE
Mind2Dialogue : entraîner des LLM 'human-aware'
Un cadre de travail simule les états mentaux des utilisateurs pour créer un signal d'entraînement privilégié.
arXiv cs.AI · cs.LG · cs.CL·Zixuan Wang, Yufan Zhou, Jinzhou Tang, Xinle Yu·14 septembre 2026
Le framework Mind2Dialogue simule les états mentaux et les intentions implicites des utilisateurs pour générer des données d'entraînement enrichies. Par une distillation privilégiée, le modèle apprend à répondre de manière personnalisée sans accès direct à ces états mentaux lors du déploiement. Les résultats montrent une amélioration des métriques de personnalisation par rapport aux modèles Qwen, Llama et OLMo.