Google DeepMind a annoncé des mises à jour significatives de sa série de modèles Gemini 2.5, introduisant de nouvelles capacités pour le raisonnement, l'interaction audio et le contrôle par les développeurs. La mise à jour comprend le mode expérimental « Deep Think » pour 2.5 Pro, des fonctionnalités natives de sortie audio et des capacités étendues d'utilisation de l'ordinateur via Project Mariner.

  • Gemini 2.5 Pro mène désormais les classements WebDev Arena et LMArena et sert de modèle principal pour l'apprentissage basé sur les évaluations d'experts en éducation.
  • Le nouveau mode « Deep Think » permet à 2.5 Pro d'examiner plusieurs hypothèses, atteignant des scores élevés sur les benchmarks USAMO et LiveCodeBench.
  • Gemini 2.5 Flash est désormais plus efficace, utilisant 20 à 30 % de moins de tokens tout en améliorant les performances sur les benchmarks de raisonnement, multimodalité et codage.
  • La sortie audio native permet des expériences conversationnelles avec direction du ton, détection des émotions et synthèse vocale multi-locuteur dans plus de 24 langues.
  • Les capacités d'utilisation de l'ordinateur de Project Mariner sont intégrées à l'API Gemini et Vertex AI pour une expérimentation plus large par les développeurs.
  • Des garde-fous de sécurité renforcés protègent contre les injections indirectes de prompts, faisant de Gemini 2.5 la famille de modèles la plus sécurisée à ce jour.
  • Les outils de développement incluent désormais des résumés de réflexion pour la transparence, des budgets de réflexion étendus pour le contrôle des coûts et un support natif MCP pour l'intégration d'outils open-source.

Ces mises à jour visent à fournir aux développeurs des outils plus transparents, contrôlables et performants pour construire des applications complexes, tout en améliorant la sécurité et l'efficacité dans l'écosystème Gemini.