Toutes les news taguées avec ce sujet.
Deux modèles de retrieval de 149M et 307M paramètres, open-source et performants sur BEIR, exploitant la méthode translate-train.
Une méthode pour agrandir le vocabulaire d'un modèle déjà entraîné sans repartir de zéro, appliquée à LFM2.5-8B-A1B.
Un nouveau consortium allemand publie Soofi S, un modèle open de 30 milliards de paramètres qui surpasse les benchmarks en anglais et en allemand.
Un vaste corpus multilingue pour l'entraînement de modèles IA.
Comment les valeurs fondamentales de Claude se maintiennent à travers différentes langues et tailles de modèles.
Le laboratoire français dévoile une collection multilingue destinée à enrichir l'entraînement de modèles de langage.
Le lab français Pleias met en ligne CommonLingua sur Hugging Face, une ressource destinée à l'entraînement de modèles de langage.