Quatre grands modèles de langage ont été lancés en Chine au cours du dernier mois : Kimi K3-2.8T, Qwen3.8-2.4T, DeepSeek-V4-Pro-0813-1.6T et GLM-5.3-743B.
Kimi K3, Qwen3.8, DeepSeek-V4-Pro-0813 et GLM-5.3 lancés en un mois
xAI publie Grok 4.6 ; Alibaba ouvre Qwen3.8-MoE ; DeepSeek V4 Pro GA
Les actualités IA de cette semaine mettent en avant les principales publications de xAI, Alibaba et DeepSeek, ainsi que des mises à jour sur les modèles vidéo ouverts et l'infrastructure d'inférence.
Thinking Machines lance Inkling, Tencent met à jour Hy3 avec la licence Apache 2.0
Le dernier tour d'horizon des artefacts de modèles ouverts met en avant les lancements significatifs de Thinking Machines et Tencent, ainsi que les mises à jour de Poolside et DeepSeek.
Sortie en poids ouverts de Qwen3.8, Kimi Code CLI, pile LLM de Netflix, logiciel de puce Alibaba
Alibaba a annoncé la sortie en poids ouverts de Qwen3.8, un modèle de 2,4 billions de paramètres, tout en open-sourçant sa pile logicielle Zhenwu AI pour réduire la dépendance à l'écosystème CUDA de Nvidia.
Kimi K3, DeepSeek V4 Pro et GLM-5.2 comparés sur les benchmarks, la licence et le coût de déploiement
Une comparaison de trois modèles Mixture-of-Experts à poids ouverts — Kimi K3 de Moonshot AI, DeepSeek V4 Pro et GLM-5.2 de Zhipu AI — évalue leurs capacités, leurs conditions de licence et leurs coûts de déploiement pour les charges de travail de codage et d'agents sur le long terme.
La distillation de deepseek-r1:8B dans Qwen3-0.6B permet un enrichissement structuré de texte rapide sur l'appareil
Les chercheurs démontrent que la distillation d'un professeur de raisonnement de 8 milliards (deepseek-r1:8B) dans un modèle étudiant de 0,6 milliard (Qwen3-0.6B via QLoRA) permet une extraction structurée à haut volume avec une latence et un coût significativement réduits. L'étude évalue cette approche sur la cartographie d'articles de presse en objets JSON contenant des résumés et des étiquettes catégorielles, comparant le modèle distillé aux bases de référence par few-shot prompting et décodage contraint.