GLM 5.3 publié
L'équipe GLM a publié la version 5.3 du modèle GLM.
L'équipe GLM a publié la version 5.3 du modèle GLM.
DeepSeek a annoncé le lancement de son nouveau modèle, DeepSeek-V4-Pro.
Meta a publié Muse Glimmer, un modèle multimodal dense de 30 milliards de paramètres optimisé pour les flux de travail d'agents locaux en continu. Les poids sont disponibles sous licence Apache 2.0.
DeepSeek a mis à jour son modèle V4 Flash, en publiant une nouvelle version le 2026-07-31 qui affiche des gains de performance significatifs par rapport à la précédente version d'aperçu. La mise à jour introduit des résultats pour plusieurs nouveaux benchmarks tout en améliorant les scores sur ceux existants.
La version officielle de DeepSeek-V4-Flash est désormais disponible sur l'API DeepSeek.
Moonshot AI a publié les poids de son modèle Kimi K3. Le checkpoint est désormais disponible sur Hugging Face.
Moonshot AI a lancé le modèle Kimi K3 2.8T, désormais disponible sur Hugging Face.
Moonshot AI a publié le modèle Kimi K3, désormais disponible sur Hugging Face.
Moonshot AI a rendu le compte à rebours de Kimi K3 disponible sur Hugging Face. Le modèle est désormais accessible via un lien direct fourni dans le document source.
Kimi K3 est désormais disponible via l'interface web et l'application mobile. Le modèle dispose de 2,8 billions de paramètres et prend en charge une fenêtre de contexte de 1 million de tokens.
Qwen a publié les poids ouverts pour son modèle Qwen 3.8 27B. Le checkpoint est disponible sur Hugging Face.
Qwen a publié le modèle Qwen3.8-27B, disponible au téléchargement sur ModelScope et Hugging Face.
Quatre grands modèles de langage ont été lancés en Chine au cours du dernier mois : Kimi K3-2.8T, Qwen3.8-2.4T, DeepSeek-V4-Pro-0813-1.6T et GLM-5.3-743B.
La sortie complète de Qwen 3.8 Max confirme les premières impressions selon lesquelles le modèle est exceptionnellement rapide, hautement capable en planification et habile à identifier la complexité inutile dans les problèmes.
Un utilisateur de Reddit met en avant le modèle DeepSeek DSv4 Flash 0731, soulignant ses solides capacités de performance par rapport à son coût. La publication fait référence à l'Artificial Analysis Intelligence Index v4.1.1 pour étayer l'affirmation selon laquelle le modèle offre des performances exceptionnelles.
Mistral héberge désormais le modèle GLM-5.2, qui est même moins cher que son modèle phare actuel, Mistral Medium 3.5.
dots-studio a publié le premier modèle à poids ouverts de sa famille dots3, nommé dots3-note preview. Ce modèle Mixture-of-Experts dispose de 280B de paramètres totaux avec 16B activés et prend en charge jusqu'à 512K tokens de contexte.
Le checkpoint du modèle DeepSeek-V4-Pro-0813 a été remis à disposition sur la plateforme Hugging Face.
DeepSeek AI a lancé DeepSeek Harness (dsh), un harnais d'agent open source actuellement en aperçu pour les développeurs. L'outil utilise une architecture basée sur des plugins alimentée par Cordis, conçue pour la composabilité spatio-temporelle.
DeepSeek a rendu disponible DeepSeek Harness v0.1 en préversion développeur, open-sourçant la base de code sous la licence MIT pour les développeurs construisant des harnesses d'agents.