Google 发布了 Gemini 2.0 Flash 的模型卡片,这是 Gemini 2.0 系列中原生多模态模型,旨在为智能体系统提供动力。该模型在质量上优于 Gemini 1.5 Flash,并在关键基准测试中超越 Gemini 1.5 Pro,速度是其两倍。
- 支持文本、图像、音频和视频输入,上下文窗口为 1,048,576 个 token。
- 在 MMLU-Pro 上达到 77.6%,在 LiveCodeBench (v5) 上达到 34.5%,在 MATH 基准测试中达到 90.9%。
- 通过 Multimodal Live API 提供低延迟的实时流支持。
- 使用 Google 的 Tensor Processing Units (TPUs)、JAX 和 ML Pathways 进行训练。
该模型定位为寻求增强质量或略高性能以及实时低延迟能力的用户的升级路径。