O Google lançou uma versão experimental do Gemini 2.5 Pro, seu modelo de raciocínio mais avançado, projetado para tarefas complexas e capacidades aprimoradas de raciocínio. O modelo estreou no topo do ranking LMArena com uma margem significativa e demonstra desempenho de ponta em vários benchmarks.
- Lidera o ranking LMArena com estilo de alta qualidade e forte capacidade de raciocínio.
- Lidera os benchmarks de matemática e ciência, como GPQA e AIME 2025, sem técnicas de tempo de teste.
- Obtém 18,8% no Humanity’s Last Exam, capturando a fronteira do conhecimento humano.
- Alcança 63,8% no SWE-Bench Verified para avaliação de código agêntico.
- Apresenta uma janela de contexto de 1 milhão de tokens com suporte nativo à multimodalidade.
O modelo já está disponível no Google AI Studio e no aplicativo Gemini para usuários avançados, com detalhes de integração com Vertex AI e preços esperados nas próximas semanas.