Googleは、複雑なタスクと強化された推論能力のために設計された、最も先進的な思考モデルであるGemini 2.5 Proの実験版をリリースしました。このモデルはLMArenaリーダーボードで大きな差をつけてトップにデビューし、さまざまなベンチマークで最先端のパフォーマンスを示しています。

  • 高品質なスタイルと強力な推論能力でLMArenaリーダーボードのトップに位置します。
  • テスト時のテクニックを使用せずに、GPQAやAIME 2025などの数学および科学ベンチマークで首位を維持しています。
  • Humanity’s Last Examで18.8%を獲得し、人間の知識のフロンティアを捉えました。
  • エージェントコード評価用のSWE-Bench Verifiedで63.8%を達成しました。
  • ネイティブなマルチモーダルサポートを備えた100万トークンのコンテキストウィンドウを搭載しています。

このモデルは現在、Google AI StudioおよびGeminiアプリのアドバンストユーザー向けに利用可能であり、Vertex AI統合と価格の詳細は数週間以内に発表される予定です。