Google и Google DeepMind представили Gemini 1.0, новое семейство крупных мультимодальных моделей, предназначенных для понимания и объединения текста, кода, аудио, изображений и видео на нативном уровне.
- Первая версия включает три оптимизированных размера: Gemini Ultra для сложных задач, Gemini Pro для масштабирования по задачам и Gemini Nano для эффективности на устройстве.
- Gemini Ultra демонстрирует лучшие результаты в 30 из 32 широко используемых академических бенчмарков и является первой моделью, превзошедшей экспертов-людей на MMLU с результатом 90.0%.
- Модели созданы с нуля как мультимодальные, что позволяет им рассуждать о разнообразных входных данных без reliance на отдельные компоненты, соединенные вместе.
Этот релиз представляет собой значительный шаг в создании универсального ИИ, который может улучшить то, как разработчики и предприятия создают и масштабируют приложения.