Google 发布了其 Gemini 2.5 Pro 模型的升级版预览版,将其定位为迄今为止最智能的产品,几周后将正式全面发布。
- 该模型在 LMArena 上 Elo 评分提升了 24 分(达到 1470),在 WebDevArena 上提升了 35 分(达到 1443)。
- 它在 Aider Polyglot 等困难编码基准测试中保持领先地位,并在 GPQA 和 Humanity’s Last Exam 上表现出顶级性能。
- 此次更新解决了之前的反馈,改进了响应风格、结构和创意性。
- 开发者可以通过 Google AI Studio 和 Vertex AI 中的 Gemini API 访问该模型,这些平台现在包含思考预算功能以控制成本和延迟。
升级版预览版今天已在 Gemini 应用中提供,并通过新的预算功能为开发者提供了对模型行为的增强控制。