OpenAIは、最先端の推論能力とウェブブラウジング、Python実行、画像分析を含む完全なツール使用を組み合わせたo3およびo4-miniモデルをリリースしました。これらのモデルは、複雑な数学、コーディング、科学的課題を解決する能力を強化するために、思考の連鎖(chains of thought)における大規模強化学習を使用してトレーニングされています。

  • モデルは、画像の切り抜きやPython経由でのデータ分析など、能力を拡張するために思考プロセス内でツールを利用します。
  • OpenAIのSafety Advisory Groupは、そのPreparedness Frameworkのバージョン2に基づいてモデルをレビューしました。
  • 評価により、いずれのモデルも生物・化学的能力、サイバーセキュリティ、またはAI自己改善において「高」閾値に達していないことが判明しました。

今回のリリースは更新されたフレームワークの下での最初のローンチであり、先進的な推論が熟考によるアライメント(deliberative alignment)を通じて安全性と堅牢性を向上させる新たな道を提供していると同社は述べています。