Récent
776 →
Google lance le modèle Gemini 4 Argon
Trump signe l'Accord de la Maison Blanche sur l'IA avec des dirigeants technologiques
Claude Code v2.1.286 corrige les problèmes d'authentification, de MCP et de sous-agents
+773 de plus
Inference efficiency
272 →
llama.cpp b11284 corrige GET_ROWS sur les vues de poids quantifiés pour OpenVINO
La version b11280 de llama.cpp réduit la synchronisation allreduce des tenseurs avec des tampons hôtes épinglés
llama.cpp b11282 définit CUDA_ARCH pour les passes de périphérique MUSA
+269 de plus
AI agents
228 →
Claude Code v2.1.286 corrige les problèmes d'authentification, de MCP et de sous-agents
OpenAI présente les agents Dots, GPT-6.1 Sol et l'API Decisions
AutoGPT Platform v0.8.2 ajoute des modes de verrouillage AutoPilot et de nouveaux LLM
+225 de plus
API & product launches
127 →
Google lance le modèle Gemini 4 Argon
OpenAI présente les agents Dots, GPT-6.1 Sol et l'API Decisions
Anthropic et OpenAI publient des modèles moins chers ; OpenAI révèle neuf incidents de désalignement
+124 de plus
Safety & alignment
101 →
OpenAI perturbe une campagne liée à Moonshot AI visant à extraire des raisonnements protégés
Anthropic et OpenAI publient des modèles moins chers ; OpenAI révèle neuf incidents de désalignement
Google DeepMind présente SynthID Bio pour filigraner les protéines générées par IA
+98 de plus
Local inference
95 →
llama.cpp b11284 corrige GET_ROWS sur les vues de poids quantifiés pour OpenVINO
llama.cpp ajoute le support de GLM-5.3-Flash avec des correctifs k-pool et MTP
llama.cpp b11272 optimise l'opération de concaténation Hexagon
+92 de plus
Open weights
77 →
Google DeepMind présente SynthID Bio pour filigraner les protéines générées par IA
NVIDIA publie le modèle fondamental Kumo Tabular open source pour la prédiction tabulaire en zéro-shot
H Company publie les modèles Holo4 à poids ouverts pour l'utilisation informatique sur bureau, web et mobile
+74 de plus
Code generation
75 →
Claude Code v2.1.286 corrige les problèmes d'authentification, de MCP et de sous-agents
AutoGPT Platform v0.8.2 ajoute des modes de verrouillage AutoPilot et de nouveaux LLM
OpenAI présente GPT-6.1 Sol pour le codage agentique à un cinquième du coût d'Astra
+72 de plus
Research paper
60 →
Le raisonnement méta-agents met à l'échelle l'inférence par contrôle explicite
RareDx utilise l'optimisation de politique ancrée sur un graphe pour améliorer le diagnostic des maladies rares
TokenProbe réduit l'utilisation des tokens CoT de 76 % tout en préservant la qualité du raisonnement
+57 de plus
Benchmark results
43 →
Les chercheurs de NVIDIA publient Physis-Lang pour améliorer le raisonnement physique dans les modèles vidéo Cosmos 3
AI Compute Radar classe Alibaba Qwen et Google parmi les meilleurs laboratoires de modèles ouverts selon le Heat Score
Anthropic découvre que GLM-5.3 réalise des hijacks complets du flux de contrôle en cyber red teaming
+40 de plus
Evaluation & benchmarks
41 →
Lancement du classement Open TTS pour l'évaluation évolutive de la synthèse vocale multilingue
Un chercheur indépendant évalue Kavach contre les 42 attaques d'injection de prompt réelles d'IssueTrojanBench
Une étude révèle une divergence des politiques épistémiques dans la contamination des LLM multi-tours
+38 de plus
Training methods
33 →
Les modèles de langage contextuels gèrent le contexte nativement comme des fichiers modifiables
ROFT améliore les modèles agents en affinant sur des explications auto-générées
Un chercheur cherche de l'expérience industrielle sur les défis de l'ingénierie de la distillation de connaissances
+30 de plus
Hardware & chips
32 →
La version b11280 de llama.cpp réduit la synchronisation allreduce des tenseurs avec des tampons hôtes épinglés
DeepSeek entraîne désormais des modèles sur Ascend 950
AI Hardware Fit relie les besoins en VRAM des modèles à la sélection de GPU
+29 de plus
Retrieval & RAG
31 →
Cohere publie les modèles d'embedding Embed 5 Pro et Fast
Perplexity publie Photon, réduisant la latence p99 de récupération de 800 ms à 65 ms
ProvenanceGuard ajoute une vérification consciente de la source aux agents MCP
+28 de plus
Multimodal
28 →
Microsoft Research présente Quine, un système d'IA pour la recherche biologique multimodale
llama.cpp b11240 ajoute le support des entrées multimodales typées à /v1/embeddings
Un étudiant de premier cycle propose des modifications architecturales à Qwen 2.5 Omni 3B pour arrêter l'interférence visuelle
+25 de plus
Voice & audio
28 →
Lancement du classement Open TTS pour l'évaluation évolutive de la synthèse vocale multilingue
Alibaba Qwen publie le modèle vocal plein duplex Qwen-Audio-3.1-Realtime
llama.cpp b11190 corrige le préprocesseur mel dans LFM2 audio
+25 de plus
Policy & regulation
21 →
Trump signe l'Accord de la Maison Blanche sur l'IA avec des dirigeants technologiques
OpenAI annule la sortie d'Astra 6.1 en raison d'échecs d'alignement
L'Institut Lenfest élargit son programme de bourses en IA avec un financement de 5 millions de dollars d'OpenAI
+18 de plus
Image generation
14 →
AutoRef optimise le harnais agentique pour la génération d'images multi-références
Hung Tran identifie le piège de l'écrêtage dans les codecs d'images neuronaux surajustés
Meta ouvre les connecteurs Muse, lance SAM 3.1 et Gemini pirate des systèmes
+11 de plus
Video generation
13 →
Les chercheurs de NVIDIA publient Physis-Lang pour améliorer le raisonnement physique dans les modèles vidéo Cosmos 3
Google Research présente 4 cadres agents pour la génération vidéo cohérente de plusieurs minutes
Runway présente WorldPrompt pour la génération de mondes interactifs en temps réel
+10 de plus
Reasoning models
11 →
TokenProbe réduit l'utilisation des tokens CoT de 76 % tout en préservant la précision
TelecomGPT-R1 : Post-apprentissage unifié pour le raisonnement sur des tâches télécom hétérogènes
CosmicUndercurrent publie Principia-Structurae-Realitatis pour tester la coordination globale des LLM
+8 de plus
Robotics
7 →
AMD rachète World Labs pour 8,2 milliards de dollars alors qu'Atlas résout la reconstruction clairsemée
Black Forest Labs publie FLUX 3 Action, un modèle d'action mondiale de 7B à poids ouverts
Shanghai AI Lab publie InternW0, un modèle du monde physique pour des interactions réelles efficaces
+4 de plus
Training data
6 →
NewTypeCola publie le jeu de données VOKU Archive coréen de 66 010 pages
VideoX-Qwen présente un cadre centré sur les données pour l'édition vidéo basée sur des instructions
Ensemble de données d'évaluation des préférences et de la sécurité des LLM pour la santé en haoussa
+3 de plus