GPT-5.5 Instant améliore les réponses de santé et bien-être de ChatGPT grâce à un raisonnement plus robuste, une meilleure gestion du contexte, une communication plus claire et des évaluations informées par des médecins.
GPT-5.5 Instant améliore les réponses de santé de ChatGPT
Système de parrainage : moniteur d'entropie Rust avec incertitude à porte NER pour l'inférence LLM par niveau
Le Système de parrainage utilise un moniteur d'entropie Rust pour détecter l'incertitude par token dans l'inférence locale Gemma 3 4B, en acheminant uniquement les tokens incertains vers Sonnet via l'extraction de span à porte NER et la récupération sémantique. Les benchmarks montrent qu'il atteint une précision de 71,4 % à 0,21 $, surpassant le modèle Anthropic Advisor (62,9 % à 0,44 $) sur sept ensembles de données Hugging Face, avec une amélioration clé sur SQuAD v2 en acheminant les chunks de passage source vers le modèle cloud.
Anthropic publie Claude Opus 4 et Sonnet 4 avec raisonnement hybride
Anthropic a publié deux nouveaux grands modèles de langage, Claude Opus 4 et Claude Sonnet 4, qui introduisent des capacités de « raisonnement hybride » pour fusionner des réponses rapides avec une réflexion étape par étape prolongée. Ces modèles succèdent à la génération Claude 3.x et conservent une fenêtre de contexte de 200 000 tokens tout en offrant une sécurité améliorée et des capacités agentic.
Google publie un modèle de raisonnement expérimental Gemini 2.5 Pro avec un contexte de 1M de tokens
Google a publié Gemini 2.5 Pro, son premier modèle de la famille Gemini 2.5 et le modèle de raisonnement le plus performant à ce jour. Le modèle dispose d'une fenêtre de contexte d'entrée de 1 million de tokens (avec des plans d'expansion), prend en charge les entrées multimodales incluant texte, image, audio et vidéo, et est actuellement disponible via l'abonnement Gemini Advanced et Google AI Studio.
xAI lance Grok-1.5 avec un raisonnement amélioré et un contexte de 128K
xAI a annoncé Grok-1.5, un nouveau modèle doté de capacités de raisonnement améliorées et d'une fenêtre de contexte allant jusqu'à 128 000 tokens. Le modèle sera disponible pour les premiers testeurs et les utilisateurs existants sur la plateforme 𝕏 dans les jours à venir.
TelecomGPT-R1 : Post-apprentissage unifié pour le raisonnement sur des tâches télécom hétérogènes
Les chercheurs présentent TelecomGPT-R1, une famille de modèles de raisonnement télécom unifiés et open-source conçus pour automatiser les tâches d'ingénierie en raisonnant sur les normes, les configurations et les journaux. Le modèle comble les lacunes des LLM généralistes et spécialisés existants grâce à une approche structurée couvrant les axes du protocole, des connaissances, de la modélisation et des pannes.