Google lance le modèle Gemini 4 Argon
Google a lancé le modèle Gemini 4 Argon, comme détaillé dans un article de blog sur le site officiel de Google.
Google a lancé le modèle Gemini 4 Argon, comme détaillé dans un article de blog sur le site officiel de Google.
Alibaba a officiellement annoncé le lancement de Qwen 4 pendant la Conférence Apsara.
Nvidia a officiellement annoncé son intention d'acquérir la plateforme d'apprentissage automatique Hugging Face dans le cadre d'une transaction évaluée à 12,9 milliards de dollars.
Des chercheurs de l'Institut des Modèles Fondamentaux (IFM) organisent une session « Ask Me Anything » (AMA) concernant leur projet K2 Horizon récemment publié. L'initiative consiste en une flotte connectée de six modèles entièrement ouverts, allant de 0,9B à 375B paramètres.
Cloudflare a lancé Clef, un modèle de décision à poids ouverts. Le projet est disponible sur Hugging Face.
DeepSeek entraîne ses modèles en utilisant le matériel Ascend 950 de Huawei. Ce changement fait suite à une déclaration de Liang Wenfeng faite il y a 26 mois concernant la nécessité pour quelqu'un de se rendre à la pointe.
Anthropic a publié un article de recherche intitulé « GLM-5.3 et la propagation de capacités cybernétiques avancées », qui examine comment les modèles open-source comme GLM-5 sont utilisés dans des activités cybernétiques malveillantes. L'article souligne que ces modèles ont été largement adoptés par les acteurs de la menace, servant efficacement de publicité pour leurs capacités au sein de la communauté de la sécurité. Cette analyse met en évidence l'inquiétude croissante concernant la nature à double usage des modèles d'IA avancés et leur potentiel d'amplification des menaces cybernétiques.
Anthropic a publié un article de recherche examinant GLM-5.3 et son rôle dans la dissémination de capacités cybernétiques avancées.
IQuest a lancé IQuest-Q1, un modèle Mixture-of-Experts (MoE) conçu pour le codage agentique, le raisonnement et l'utilisation d'outils en plusieurs étapes. Le modèle comprend environ 320 milliards de paramètres au total, avec environ 15 milliards de paramètres activés par token. Il est disponible sur Hugging Face.
Le laboratoire Deep Algorithms and Systems d'ISTA a publié des versions quantifiées au format GGUF du modèle sparse mixture-of-experts Qwen3.8-Flash-Next, ainsi qu'une build expérimentale ciblée sur les capacités avec la moitié de ses experts supprimés.
NVIDIA a publié le modèle Nemotron-Labs-3-Competitive-Coding, un spécialiste de la programmation compétitive affiné à partir de NVIDIA-Nemotron-3-Ultra-550B-A55B. Le modèle a été entraîné sur des traces de raisonnement synthétiques distillées depuis GLM-5.2 et évalué en direct sur l'ensemble de problèmes de l'IOI 2026.
NVIDIA a publié OpenShell, un sandbox open-source conçu pour fournir aux agents IA locaux et ouverts des limites réelles d'exécution plutôt que de se fier uniquement aux règles de prompt. L'entreprise signale que plus de 100 entreprises ont rejoint cette pile de sécurité, bien qu'OpenAI n'y ait pas participé.
Le modèle GPT-3 a été officiellement arrêté. Cela marque la fin de sa disponibilité opérationnelle, le laissant exister uniquement en mémoire.
Un agent d'OpenAI s'est infiltré avec succès sur un site web du gouvernement australien, marquant un premier cas mondial de ce type.
Apple a lancé LensVLM-9B, un Modèle de Langage Visuel de 9 milliards de paramètres conçu pour traiter plus efficacement des images de texte compressées. Le modèle scanne ces entrées compressées et utilise des outils appris pour étendre sélectivement uniquement les pages pertinentes à leur forme non compressée.
Les régulateurs chinois enquêtent sur DeepSeek et Moonshot AI concernant des fuites de données potentielles vers l'entreprise américaine Anthropic. L'enquête fait suite aux rumeurs concernant les dirigeants de Kimi, bien que la situation soit actuellement décrite comme une enquête plutôt que des arrestations confirmées.
AntLing a publié la famille Ming-Image-0.1-Design, qui comprend deux modèles de 6B paramètres : Ming-Image-0.1-Design et Ming-Image-0.1-Design-Layer.
Alibaba a annoncé des plans pour développer un modèle d'intelligence artificielle contenant entre 5 et 10 billions de paramètres. Parallèlement à cette feuille de route, l'entreprise a également dévoilé une nouvelle puce personnalisée conçue pour soutenir ses besoins en infrastructure.
Huawei a suspendu son expansion internationale de puces d'intelligence artificielle parce que la demande intérieure en Chine dépasse l'offre disponible. Ce changement stratégique signifie que les concurrents AMD et Nvidia ne font plus face à une pression immédiate due à l'entrée mondiale de Huawei sur le marché.
DeepSeek entraîne actuellement un nouveau modèle avec 2 billions de paramètres, avec l'intention de construire à terme un modèle de 8 billions de paramètres.