OpenAI发布了其o3和o4-mini模型,这些模型将最先进的推理能力与完整的工具使用相结合,包括网页浏览、Python代码执行和图像分析。这些模型通过在思维链上进行大规模强化学习进行训练,以增强其解决复杂数学、编码和科学挑战的能力。
- 模型在其思维过程中利用工具来增强能力,例如裁剪图像或通过Python分析数据。
- OpenAI的安全咨询小组(Safety Advisory Group)根据其准备框架(Preparedness Framework)第2版对这些模型进行了审查。
- 评估确定,这两个模型在生物和化学能力、网络安全或AI自我改进方面均未达到“高”阈值。
此次发布标志着在更新后的框架下的首次推出,公司指出,高级推理通过深思熟虑的对齐(deliberative alignment)为提升安全性和鲁棒性提供了新的途径。