Google a publié une version expérimentale de Gemini 2.5 Pro, son modèle de raisonnement le plus avancé conçu pour des tâches complexes et des capacités de raisonnement améliorées. Le modèle fait ses débuts au sommet du classement LMArena avec une marge significative et démontre des performances de pointe sur divers benchmarks.

  • Tête du classement LMArena avec un style de haute qualité et un fort raisonnement.
  • Mène les benchmarks de mathématiques et de sciences comme GPQA et AIME 2025 sans techniques de test-time.
  • Marque 18,8 % à l'examen Humanity’s Last Exam, capturant la frontière du savoir humain.
  • Atteint 63,8 % sur SWE-Bench Verified pour l'évaluation de code agentique.
  • Dispose d'une fenêtre de contexte de 1 million de tokens avec un support natif multimodal.

Le modèle est désormais disponible dans Google AI Studio et l'application Gemini pour les utilisateurs avancés, avec des détails d'intégration Vertex AI et de tarification attendus dans les prochaines semaines.