O Google DeepMind anunciou atualizações significativas na série de modelos Gemini 2.5, introduzindo novas capacidades de raciocínio, interação por áudio e controle para desenvolvedores. A atualização inclui o modo experimental "Deep Think" para o 2.5 Pro, recursos nativos de saída de áudio e capacidades ampliadas de uso do computador por meio do Projeto Mariner.

  • O Gemini 2.5 Pro agora lidera os rankings WebDev Arena e LMArena e serve como o principal modelo para aprendizado com base em avaliações de especialistas educacionais.
  • O novo modo "Deep Think" permite que o 2.5 Pro considere múltiplas hipóteses, alcançando altas pontuações nos benchmarks USAMO e LiveCodeBench.
  • O Gemini 2.5 Flash agora é mais eficiente, utilizando 20-30% menos tokens enquanto melhora o desempenho em benchmarks de raciocínio, multimodalidade e codificação.
  • A saída de áudio nativa permite experiências conversacionais com direcionamento de tom, detecção de emoções e texto-para-fala multi-orador em mais de 24 idiomas.
  • As capacidades de uso do computador do Projeto Mariner estão sendo integradas à API Gemini e ao Vertex AI para experimentação mais ampla por parte dos desenvolvedores.
  • Reforços de segurança aprimorados protegem contra injeções indiretas de prompts, tornando o Gemini 2.5 a família de modelos mais segura até hoje.
  • As ferramentas para desenvolvedores agora incluem resumos de pensamento para transparência, orçamentos de raciocínio estendidos para controle de custos e suporte nativo ao MCP para integração de ferramentas de código aberto.

Essas atualizações visam fornecer aos desenvolvedores ferramentas mais transparentes, controláveis e capazes para construir aplicações complexas, enquanto melhoram a segurança e a eficiência em todo o ecossistema Gemini.