A Google apresentou o Gemini 2.5, sua mais nova família de modelos de IA "de raciocínio" capazes de refletir antes de responder. A primeira versão é uma experimental do Gemini 2.5 Pro, que alcança desempenho de ponta em uma ampla gama de benchmarks e estreia na posição #1 no ranking LMArena.

  • O Gemini 2.5 Pro lidera o ranking LMArena por uma margem significativa, indicando estilo e capacidade de alta qualidade.
  • Lidera em benchmarks de matemática e ciências como GPQA e AIME 2025 sem usar técnicas de tempo de teste como votação majoritária.
  • O modelo obtém um recorde de 18,8% no Humanity’s Last Exam, um conjunto de dados que captura a fronteira do conhecimento humano.
  • No SWE-Bench Verified, o Gemini 2.5 Pro pontua 63,8% com uma configuração personalizada de agente para avaliação de código agêntico.
  • Possui uma janela de contexto de 1 milhão de tokens, com 2 milhões de tokens chegando em breve, suportando texto, áudio, imagens, vídeo e repositórios de código.

O Gemini 2.5 Pro está disponível agora no Google AI Studio e no aplicativo Gemini para usuários Avançados, com disponibilidade no Vertex AI prevista para as próximas semanas.