Google DeepMind объявила о значительных обновлениях серии моделей Gemini 2.5, представив новые возможности для рассуждений, аудиовзаимодействия и контроля со стороны разработчиков. Обновление включает экспериментальный режим "Deep Think" для 2.5 Pro, встроенные функции вывода аудио и расширенные возможности управления компьютером через проект Mariner.
- Gemini 2.5 Pro теперь лидирует в таблицах лидеров WebDev Arena и LMArena и является лучшей моделью для обучения на основе оценок экспертов по образованию.
- Новый режим "Deep Think" позволяет модели 2.5 Pro рассматривать несколько гипотез, достигая высоких результатов на бенчмарках USAMO и LiveCodeBench.
- Gemini 2.5 Flash стала более эффективной, используя на 20-30% меньше токенов при одновременном улучшении показателей в задачах рассуждения, мультимодальности и программирования.
- Встроенный вывод аудио обеспечивает разговорные взаимодействия с управлением тоном, обнаружением эмоций и синтезом речи для нескольких говорящих более чем на 24 языках.
- Возможности управления компьютером из проекта Mariner интегрируются в Gemini API и Vertex AI для более широкого экспериментирования разработчиков.
- Усовершенствованные механизмы безопасности защищают от косвенных инъекций промптов, делая Gemini 2.5 самым безопасным семейством моделей на сегодняшний день.
- Инструменты разработки теперь включают сводки мыслей для прозрачности, расширенные бюджеты на размышления для контроля затрат и встроенную поддержку MCP для интеграции инструментов с открытым исходным кодом.
Эти обновления призваны предоставить разработчикам более прозрачные, контролируемые и мощные инструменты для создания сложных приложений, одновременно повышая безопасность и эффективность во всей экосистеме Gemini.