Google a présenté Gemini 2.5, sa nouvelle famille de modèles d'IA « raisonnants » capables de réfléchir avant de répondre. La première version est une version expérimentale de Gemini 2.5 Pro, qui atteint des performances de pointe sur un large éventail de benchmarks et se classe #1 au classement LMArena.
- Gemini 2.5 Pro domine le classement LMArena avec une marge significative, indiquant un style et des capacités de haute qualité.
- Il est en tête des benchmarks de mathématiques et de sciences comme GPQA et AIME 2025 sans utiliser de techniques au moment du test comme le vote majoritaire.
- Le modèle obtient un score de pointe de 18,8 % à l'Humanity’s Last Exam, un jeu de données capturant la frontière des connaissances humaines.
- Sur SWE-Bench Verified, Gemini 2.5 Pro marque 63,8 % avec une configuration d'agent personnalisée pour l'évaluation du code agentic.
- Il dispose d'une fenêtre de contexte de 1 million de tokens, avec 2 millions de tokens à venir, supportant le texte, l'audio, les images, la vidéo et les dépôts de code.
Gemini 2.5 Pro est disponible dès maintenant dans Google AI Studio et l'application Gemini pour les utilisateurs avancés, avec une disponibilité sur Vertex AI prévue dans les prochaines semaines.