EpistemeAI a publié Reasoning-Medical0.1-27B, un modèle médical fine-tuné basé sur l'architecture Qwen3.5-27B. Le modèle est disponible au téléchargement sur Hugging Face et prétend surpasser MedGemma en performance. Aucun score de benchmark spécifique ni spécifications techniques détaillées n'a été fourni dans le texte source.
EpistemeAI lance Reasoning-Medical0.1-27B, un modèle médical fine-tuné sur Qwen3.5-27B
IBM lance la famille Granite 4.2 avec raisonnement par chaîne de pensée intégré
IBM a lancé la famille de modèles de raisonnement open source Granite 4.2, comprenant les variantes phare 30B, milieu de gamme 8B et compacte 3B. Ces modèles exploitent les capacités natives de chaîne de pensée pour améliorer les performances en mathématiques, programmation et problèmes complexes multi-étapes.
AI9Stars lance G9v3-39A5B, un modèle à poids ouverts avec 39B de paramètres et 5 experts actifs
AI9Stars a lancé G9v3-39A5B, un modèle de langage à poids ouverts conçu pour offrir des capacités de raisonnement plus fortes que son prédécesseur, ai9stars/G9v3-3B. Le modèle dispose de 39 milliards de paramètres et de 5 experts actifs et est sous licence Apache 2.0 pour un usage personnel et commercial.
MiniMax prévoit de lancer le modèle M3 Pro à 2,7 billions de paramètres
L'entreprise chinoise d'IA MiniMax prépare la sortie d'un nouveau grand modèle de langage nommé M3 Pro, qui contient 2,7 billions de paramètres. Le modèle devrait être publié et open-sourcé dès le troisième trimestre de cette année.
Liquid AI publie Antidoom pour éliminer les boucles du désespoir dans les modèles de raisonnement
Liquid AI a publié Antidoom, une méthode open-source conçue pour éliminer le mode d'échec de la "boucle du désespoir" couramment trouvé dans les modèles de raisonnement. L'entreprise a fourni des scores d'évaluation démontrant des réductions significatives des taux d'erreur pour des points de contrôle de modèles spécifiques.
OpenAI publie les modèles de raisonnement gpt-oss-120b et gpt-oss-20b à poids ouverts
OpenAI a publié deux modèles de raisonnement à poids ouverts, gpt-oss-120b et gpt-oss-20b, sous la licence Apache 2.0. Ces modèles textuels uniquement sont conçus pour des flux de travail agéntiques avec un fort respect des instructions, l'utilisation d'outils et un effort de raisonnement ajustable.