Toutes les news taguées avec ce sujet.
Le laboratoire chinois DeepSeek déploie une application de bureau baptisée Harness, disponible sur macOS et Windows.
DeepSeek ajoute DeepSpec à ses ressources sur Hugging Face, sans détails techniques précisés à ce stade.
Un nouveau papier de DeepSeek décrit une architecture permettant d'ajuster dynamiquement les ressources de calcul lors de l'entraînement de grands modèles.
DeepSeek publie la version 3.2 de son LLM open-weights, apportant des améliorations de performance et de stabilité sur la précédente itération V3.
Un décryptage technique de l'architecture de DeepSeek-V4.1 Flash, centré sur ses optimisations agressives de compression du cache clé-valeur.
Enclave affirme que DeepSeek v4.1 Flash surpasse ses précédents modèles pour les tâches de piratage offensif automatisé.
Une interface pour visualiser en temps réel les heures de forte affluence et la disponibilité des serveurs de DeepSeek.
L'exécution de DeepSeek v4.1 flash affiche une vitesse de 23 secondes par token sur une configuration M1 de 2020.
DeepSeek lance une nouvelle architecture causale hybride 763B-P8B-D16B avec vision, remplaçant V4 Pro.
Le laboratoire chinois publie une nouvelle collection de modèles nommée DeepSeek-V4 sur Hugging Face, sans détails techniques accompagnant l'annonce.
DeepSeek dévoile v4.1 Flash, un modèle plus rapide et économique que sa version Pro actuelle.
Une librairie symbolique régénérée par des agents IA depuis des documents de conception, remplaçant le code par la spécification textuelle.
Une analyse technique décortique les choix d'ingénierie de DeepSeek-V3 face aux limites théoriques du matériel.