Google DeepMindは、推論、音声対話、開発者による制御のための新機能を加え、Gemini 2.5モデルシリーズに重大な更新を実施したと発表した。今回のアップデートには、2.5 Pro向けの実験的「Deep Think」モード、ネイティブの音声出力機能、およびProject Marinerを通じたコンピュータ操作機能の拡張が含まれる。
- Gemini 2.5 ProはWebDev ArenaおよびLMArenaのリーダーボードで首位に立ち、教育専門家の評価に基づく学習において最上位モデルとして採用されている。
- 新しい「Deep Think」モードにより、2.5 Proは複数の仮説を検討できるようになり、USAMOやLiveCodeBenchなどのベンチマークで高いスコアを達成している。
- Gemini 2.5 Flashはより効率的になり、推論、マルチモーダル性、コーディングの各ベンチマークでのパフォーマンスを向上させながら、トークン使用量を20〜30%削減した。
- ネイティブ音声出力により、トーン制御、感情検出、24以上の言語でのマルチスピーカーテキスト読み上げ機能を備えた対話型体験が可能になった。
- Project Marinerのコンピュータ操作機能は、より広範な開発者向けの実験のためにGemini APIおよびVertex AIに統合されつつある。
- 間接プロンプトインジェクションからの保護など、強化されたセキュリティ対策により、Gemini 2.5はこれまでで最も安全なモデルファミリーとなった。
- 開発者向けツールには、透明性を確保するための思考サマリー、コスト管理のための拡張された推論予算、オープンソースツール統合のためのネイティブMCPサポートが追加された。
これらのアップデートは、Geminiエコシステム全体の安全性と効率性を向上させながら、複雑なアプリケーションの構築に際して開発者により透明性が高く、制御可能で高性能なツールを提供することを目的としている。