O Google lançou uma versão experimental do Gemini 2.5 Pro, seu modelo de raciocínio mais avançado, projetado para tarefas complexas e capacidades aprimoradas de raciocínio. O modelo estreou no topo do ranking LMArena com uma margem significativa e demonstra desempenho de ponta em vários benchmarks.

  • Lidera o ranking LMArena com estilo de alta qualidade e forte capacidade de raciocínio.
  • Lidera os benchmarks de matemática e ciência, como GPQA e AIME 2025, sem técnicas de tempo de teste.
  • Obtém 18,8% no Humanity’s Last Exam, capturando a fronteira do conhecimento humano.
  • Alcança 63,8% no SWE-Bench Verified para avaliação de código agêntico.
  • Apresenta uma janela de contexto de 1 milhão de tokens com suporte nativo à multimodalidade.

O modelo já está disponível no Google AI Studio e no aplicativo Gemini para usuários avançados, com detalhes de integração com Vertex AI e preços esperados nas próximas semanas.