Toutes les news taguées avec ce sujet.
Un modèle portugais de 9B paramètres annotait bien en surface, mais échoue les tests de validité théorique — accord n'est pas validité.
NVIDIA détaille comment combler les lacunes des datasets financiers déséquilibrés grâce à la génération de données synthétiques via NeMo.
Des chercheurs publient NAICS-GH, un corpus de 6 588 dépôts GitHub étiquetés par secteur industriel avec 97 % de précision.
Un nouveau framework résout les conflits de gradients entre modalités acoustique et sémantique qui dégradaient les modèles de parole full-duplex natifs.
Une analyse longitudinale de l'NLP en langues indiennes et une proposition de cadre « Culture Sensing » pour préserver la diversité linguistique face à l'homogénéisation par l'IA.
Un nouveau benchmark multidimensionnel pour mesurer si les modèles vocaux conversationnels se comportent vraiment comme des interlocuteurs humains.
Une étude computationnelle relie pour la première fois les qualités acoustiques de la narration (ton, rythme, volume) aux données de consommation des livres audio.