OpenAIは、以前のモデルシリーズを単一の適応型アーキテクチャに統合し、タスクの複雑さに応じて「思考の努力」を調整できる新しいAIシステムであるGPT-5を発表した。このシステムはリアルタイムルーターを活用し、標準的なクエリには高速なgpt-5-mainモデル、複雑な問題には深層のgpt-5-thinkingモデルに切り替える。
- GPT-5はSWE-bench Verifiedで74.9パーセント、Aider Polyglotで88パーセントを達成し、o3と比較してコーディングエラー率を3分の1に削減した。
- HealthBench Hardで46.2パーセント、AIME 2025で94.6パーセントのスコアを獲得し、事実ベースのベンチマークにおいてo3よりも約6倍少ない幻覚を生成した。
- 新しい「Safe Completions」システムが堅固な拒否に取って代わり、広範なレッドチーム演習を経て安全ガイドライン内で有用な出力を提供することを目指している。
- APIはgpt-5、gpt-5-mini、gpt-5-nanoの3つのモデルサイズを導入し、272,000トークンの入力コンテキストウィンドウと128,000トークンの出力トークンをサポートする。
- アクセスは階層化されており、無料ユーザーにはGPT-5とGPT-5-miniが提供され、Proサブスクライバーはより高性能なGPT-5 Proにアクセスできる。
OpenAIは、これらの改善により、プログラミング、医療、執筆のタスクにおいてより信頼性が高く正確な応答を提供することを目指していると述べている。ロールアウトは直ちにChatGPTユーザーとAPI開発者向けに開始される。