Google ha presentado Gemini 2.5, su nueva familia de modelos de IA "de pensamiento" capaces de razonar a través del pensamiento antes de responder. El primer lanzamiento es una versión experimental de Gemini 2.5 Pro, que alcanza un rendimiento de vanguardia en una amplia gama de benchmarks y se posiciona en el #1 del ranking de LMArena.
- Gemini 2.5 Pro encabeza el ranking de LMArena con un margen significativo, lo que indica un estilo y capacidad de alta calidad.
- Lidera los benchmarks de matemáticas y ciencias como GPQA y AIME 2025 sin utilizar técnicas en tiempo de prueba como la votación mayoritaria.
- El modelo obtiene un resultado de vanguardia del 18.8% en Humanity’s Last Exam, un conjunto de datos que captura la frontera del conocimiento humano.
- En SWE-Bench Verified, Gemini 2.5 Pro obtiene un 63.8% con una configuración de agente personalizada para la evaluación de código agéntico.
- Cuenta con una ventana de contexto de 1 millón de tokens, con 2 millones de tokens próximamente, y soporta texto, audio, imágenes, video y repositorios de código.
Gemini 2.5 Pro está disponible ahora en Google AI Studio y la aplicación Gemini para usuarios Avanzados, con disponibilidad esperada en Vertex AI en las próximas semanas.