Googleは、Gemini APIを通じてGoogle AI Studioでプロフェッショナルな用途に本番環境対応させるために設計された、クリエイティブな制御機能と生成型ビデオ能力の新スイートであるGemini Omni 1.1 Flashを発表しました。
- シーン拡張により、モデルは最大10秒の過去のコンテキストを分析し、合計40秒まで10秒刻みで映像の生成を継続できます。
- 開発者はキーフレーム間の連続したビデオを生成するために最初のフレームと最後のフレームを指定でき、スムーズなトランジションやカメラ移動を実現します。
360p解像度でのビデオドラフト作成は、標準的な720p解像度と比較して最大60%高速化され、コストは3分の1になります。
- モデルは、洗練された高解像度の結果を得るために出力を1080pまたは4K解像度にアップスケールすることをサポートしています。
- マルチモーダル入力により、ビジュアルコンテキストとキャラクターの一貫性を維持するために最大3秒のビデオを参照できるようになりました。
Omni 1.1はGoogle AI StudioやGemini Enterprise Agent Platformを含むGoogle開発者エコシステム全体で展開されており、Google FlowのGoogle AI Plus、Pro、Ultraのサブスクライバーが利用可能です。