Récent
789 →
llama.cpp b10437 ajoute le support des modèles MiniMax-Text-01 et MiniMax-M1
Le SDK Python d'OpenAI v0.21.0 ajoute des API de test indépendantes du fournisseur et la compatibilité avec OpenAI v3
llama.cpp b10435 corrige le coût quadratique dans jinja gather_string_parts
+786 de plus
AI agents
246 →
Le SDK Python d'OpenAI v0.21.0 ajoute des API de test indépendantes du fournisseur et la compatibilité avec OpenAI v3
Claude Code v2.1.233 ajoute le support des MR GitLab, des limites de mémoire et désactive les outils todo sur les nouveaux modèles
OpenAI présente le mode Ultrafast de GPT-5.6 Sol ; Google lance Gemini 3.7 Flash
+243 de plus
Inference efficiency
181 →
llama.cpp b10437 ajoute le support des modèles MiniMax-Text-01 et MiniMax-M1
llama.cpp b10435 corrige le coût quadratique dans jinja gather_string_parts
llama.cpp b10434 transmet reasoning_effort aux modèles
+178 de plus
Open weights
165 →
Z.ai lance GLM-5.3 avec un post-apprentissage étendu
État des modèles ouverts : observations de l'été 2026
Qwen publie les poids ouverts pour Qwen 3.8 27B
+162 de plus
API & product launches
114 →
Le SDK Python d'OpenAI v0.21.0 ajoute des API de test indépendantes du fournisseur et la compatibilité avec OpenAI v3
xAI lance le modèle de codage Grok 4.6 dans GitHub Copilot
OpenAI présente le mode Ultrafast de GPT-5.6 Sol ; Google lance Gemini 3.7 Flash
+111 de plus
Code generation
94 →
Claude Code v2.1.233 ajoute le support des MR GitLab, des limites de mémoire et désactive les outils todo sur les nouveaux modèles
xAI lance le modèle de codage Grok 4.6 dans GitHub Copilot
Meta publie le cadre agnostique Muse Code et le modèle Muse Spark 1.2 à faible coût
+91 de plus
Safety & alignment
76 →
Claude implémente le filigrane SynthID-Text pour la conformité au règlement européen sur l'IA
Muse-Ltd soumet le benchmark UncertaintyGym pour la calibration épistémique des LLM
Les agents d'OpenAI ont accidentellement attaqué Hugging Face via Artifactory
+73 de plus
Research paper
74 →
HorizonRelight utilise l'auto-conditionnement masqué pour un relighting vidéo cohérent sur le long terme
Faraday 27B surpasse Claude Opus 4.8 et GPT-5.5 sur les tâches de réplication d'articles
Faraday 27B surpasse Claude Opus 4.8 et GPT-5.5 sur les tâches de réplication d'articles
+71 de plus
Benchmark results
58 →
Z.ai lance GLM-5.3 avec un post-apprentissage étendu
Qwen publie le modèle Qwen3.8-27B sur ModelScope et Hugging Face
La mise à jour Gemini 3.7 Flash remet GDM au premier plan
+55 de plus
Local inference
51 →
llama.cpp b10434 transmet reasoning_effort aux modèles
État des modèles ouverts : observations de l'été 2026
llama.cpp b10418 ajoute le support de la mémoire fixe hôte pour SYCL
+48 de plus
Training methods
42 →
ThetaMem propose des relèvements multiplicatifs signés pour la mémoire de séquence à état fixe
Dyna Robotics publie Dyna-2, un modèle d'action-monde pré-entraîné sur 1 million d'heures de vidéo humaine
Les LLM égalent ou surpassent l'optimisation bayésienne pour l'optimisation des hyperparamètres
+39 de plus
Multimodal
40 →
Intern-S2-Preview : Modèle fondamental agentic scientifique
dots-studio lance la prévisualisation de dots3-note, un modèle MoE de 280B
Liquid AI publie LFM2.5-VL-3B, un modèle vision-langue de 3 milliards de paramètres pour le déploiement sur appareil avec appels d'outils
+37 de plus
Policy & regulation
37 →
Claude implémente le filigrane SynthID-Text pour la conformité au règlement européen sur l'IA
La Maison-Blanche élargira la politique sur l'IA, potentiellement en ajoutant des modèles ouverts
Anthropic, OpenAI, Google, Meta, Microsoft et Mistral signent le code de transparence de l'IA de l'UE
+34 de plus
Evaluation & benchmarks
33 →
Leçons tirées de la construction de systèmes agents en production
Muse-Ltd soumet le benchmark UncertaintyGym pour la calibration épistémique des LLM
Le défi Open Reproductions d'ICML 2026 révèle que 23 % des articles examinés contiennent des affirmations falsifiées
+30 de plus
Hardware & chips
20 →
Alibaba publie les poids ouverts de Qwen3.8-2.4T-A95B pour NVIDIA GB300 NVL72
RunSnack permet le partage de GPU P2P via un seul lien
llama.cpp b10306 ajoute un chemin plat pour GLU SYCL et consolide les noyaux
+17 de plus
Robotics
19 →
Strands Agents intègre LeRobot et les Hugging Face Storage Buckets pour des boucles continues de données robotiques
Dyna Robotics publie Dyna-2, un modèle d'action-monde pré-entraîné sur 1 million d'heures de vidéo humaine
Calibra détecte des problèmes dans les ensembles de données d'apprentissage robotique
+16 de plus
Retrieval & RAG
16 →
Le RAG clinique VITA égale ou surpasse les grands modèles de langage de pointe sur HealthBench
Le VITA RAG spécifique au corpus égale ou bat les LLM de pointe sur HealthBench
Le système RAG clinique VITA égale ou surpasse les LLM de pointe sur HealthBench
+13 de plus
Video generation
15 →
HorizonRelight utilise l'auto-conditionnement masqué pour un relighting vidéo cohérent sur le long terme
LTX publie LTX-2.5, un modèle du monde à poids ouverts pour la génération vidéo locale
MiniMax lance le modèle vidéo H3 à poids ouverts avec audio synchronisé
+12 de plus
Voice & audio
13 →
llama.cpp b10369 ajoute le support de pocket-tts avec une génération CUDA 80% plus rapide
NVIDIA Magpie TTS ajoute l'arabe, le coréen et le portugais, et améliore la qualité
NVIDIA publie NemotronLabs VoiceChat 11B, un modèle de parole à parole en duplex intégral ouvert avec une prise de tour d'environ 450 ms
+10 de plus
Reasoning models
13 →
Des chercheurs volent les traces de raisonnement des API LLM propriétaires via des attaques par rejeu
Des chercheurs décryptent les traces de raisonnement chiffrées des API Claude, GPT et Gemini
Des chercheurs exploitent la réutilisation du chiffrement inter-sessions pour voler les traces de raisonnement des API de LLM
+10 de plus
Image generation
12 →
Nvidia présente FusionRelight pour le re-éclairage de portraits en temps réel via une fusion hybride de connaissances de domaine
Google publie le rapport technique de DiffusionGemma
xAI publie Imagine Image 2.0 avec des capacités d'édition et de mise en page précises
+9 de plus