Google推出了Gemini Omni 1.1 Flash,这是一套全新的创意控制工具与生成式视频能力,旨在通过Google AI Studio中的Gemini API使该模型具备面向专业用途的生产就绪状态。
- 场景扩展功能允许模型分析最多10秒的先前上下文,以每次10秒的增量继续生成视频片段,总时长可达40秒。
- 开发者可指定首帧与尾帧,在关键帧之间生成连续视频,实现平滑过渡与镜头运动。
- 以360p分辨率制作视频的速度比标准720p分辨率快多达60%,且成本仅为后者的三分之一。
- 该模型支持将输出上采样至1080p或4K分辨率,以获得精致的高清效果。
- 多模态输入现支持引用最多3秒的视频片段,以维持视觉上下文与角色一致性。
Omni 1.1正在Google开发者生态系统中逐步推出,涵盖Google AI Studio与Gemini Enterprise Agent Platform,并面向Google AI Plus、Pro和Ultra订阅用户在Google Flow中可用。