Google DeepMind ha anunciado actualizaciones significativas en su serie de modelos Gemini 2.5, introduciendo nuevas capacidades para el razonamiento, la interacción por audio y el control por parte de los desarrolladores. La actualización incluye el modo experimental "Deep Think" para 2.5 Pro, funciones nativas de salida de audio y capacidades ampliadas de uso del ordenador a través de Project Mariner.

  • Gemini 2.5 Pro lidera ahora las clasificaciones de WebDev Arena y LMArena, y se desempeña como el modelo principal para el aprendizaje basado en evaluaciones de expertos educativos.
  • El nuevo modo "Deep Think" permite que 2.5 Pro considere múltiples hipótesis, logrando altas puntuaciones en los benchmarks USAMO y LiveCodeBench.
  • Gemini 2.5 Flash es ahora más eficiente, utilizando entre un 20% y un 30% menos de tokens mientras mejora el rendimiento en los benchmarks de razonamiento, multimodalidad y programación.
  • La salida de audio nativa permite experiencias conversacionales con dirección del tono, detección de emociones y síntesis de voz a texto multi-orador en más de 24 idiomas.
  • Las capacidades de uso del ordenador de Project Mariner se están integrando en la API de Gemini y Vertex AI para una experimentación más amplia por parte de los desarrolladores.
  • Las salvaguardas de seguridad mejoradas protegen contra inyecciones indirectas de prompts, convirtiendo a Gemini 2.5 en la familia de modelos más segura hasta la fecha.
  • Las herramientas para desarrolladores ahora incluyen resúmenes del pensamiento para transparencia, presupuestos de pensamiento extendidos para el control de costos y soporte nativo de MCP para la integración de herramientas de código abierto.

Estas actualizaciones tienen como objetivo proporcionar a los desarrolladores herramientas más transparentes, controlables y capaces para construir aplicaciones complejas, al tiempo que mejoran la seguridad y la eficiencia en todo el ecosistema Gemini.