Googleは、音声エージェントのニアリアルタイム推論を強化し、AI会話の滑らかさを向上させるために設計された2つの新モデル、Gemini 3.8 Liveと3.8 Live Extended Thinkingをリリースしました。
Gemini 3.8 Live Extended Thinkingは、Artificial AnalysisのSpeech to Speech Quality Indexでスコア82.6を獲得し、#1にランクインしています。エージェントタスク完了ベンチマークで首位となり、Big Bench Audioで97.7%を達成しました。Gemini 3.8 LiveはSpeech Agent Arenaで2位を獲得し、ビジュアル入力をニアリアルタイムで処理しながら97言語間の自動遷移をサポートします。
モデルは開発者向けにGemini APIおよびGoogle AI Studio経由で利用可能であり、エンタープライズアクセスはGemini Enterpriseを通じてプライベートプレビューで行われます。一般ユーザーはSearch Live、Gemini Live、および各種Google Workspaceアプリケーションで機能にアクセスできます。