Googleは、ロボットが高速に思考しリアルタイムで多段階のタスクを計画できるように設計された新しい具現化推論モデルであるGemini Robotics ER 2を発売しました。今回のアップデートでは、以前のER 1.6バージョンと比較して大幅な改善がもたらされ、動画ベースの継続的な進捗追跡、精密な瞬間特定、ネイティブなマルチロボット協調機能が含まれています。
- 進捗分類は5つのレベルで57.4%の精度を達成し、ロボットがその場で行動を調整できるようにします。
- 瞬間特定は91.3%の精度と0.96秒の平均絶対距離を実現し、以前のモデルの実行速度の4倍で精密なタスク切り替えを可能にします。
- マルチロボット協調により、多様なマシンが共有された意味理解を通じて通信し、複雑なワークフローを完了できます。
- 空間知能の改善には、生動画での成功/失敗検出と10種類の機器読み取りの汎化が含まれます。
- セーフティベンチマークでは、指示のフォローや人間近接検出における向上が見られ、ロボットが近くにいる場合に停止できるようになります。
このモデルは現在、Gemini APIおよびGoogle AI Studioを通じて開発者に公開されており、停止して考える一時停止なしで流暢なオーケストレーションにより、より有用な物理AIタスクを可能にしています。