Google представила Gemini 2.5, своё новейшее семейство моделей ИИ с функцией «мышления», способных обдумывать ответы перед их формированием. Первая версия — экспериментальная сборка Gemini 2.5 Pro, демонстрирующая лучшие результаты на широком наборе бенчмарков и занимающая первое место в рейтинге LMArena.
- Gemini 2.5 Pro значительно лидирует в рейтинге LMArena, что указывает на высокое качество стиля и возможностей.
- Она превосходит другие модели в математических и научных тестах, таких как GPQA и AIME 2025, без использования методов вроде голосования большинства.
- Модель набирает рекордные 18,8% на Humanity’s Last Exam — наборе данных, отражающем передний край человеческих знаний.
- На SWE-Bench Verified Gemini 2.5 Pro показывает результат 63,8% при использовании пользовательской конфигурации агента для оценки кода.
- Модель поддерживает контекстное окно на 1 миллион токенов, а поддержка 2 миллионов токенов появится в ближайшее время; она работает с текстом, аудио, изображениями, видео и репозиториями кода.
Gemini 2.5 Pro уже доступна в Google AI Studio и приложении Gemini для продвинутых пользователей, а её запуск в Vertex AI ожидается в ближайшие недели.