OpenAI已在ChatGPT中推出了“深度研究”功能,这是一种由优化版o3模型驱动的新型智能体能力,能够执行多步骤的互联网研究以生成综合报告。该功能专为高强度知识工作设计,允许用户将通常需要数小时才能完成的复杂网络研究任务转化为在几十分钟内即可完成的查询。

该系统利用推理能力搜索、解读和分析海量文本、图像和PDF文件,并整合数百个在线来源,提供清晰的引用。它通过端到端强化学习在复杂的浏览和推理任务上进行训练,使其能够规划多步骤路径并对实时信息做出反应。

在“人类最后的考试”(Humanity’s Last Exam)基准测试中,该模型在超过3,000道专家级问题上达到了26.6%的准确率。它还在GAIA基准测试中取得了新的最先进水平,该基准测试要求具备推理和工具使用能力的真实世界问题。

初始访问权限仅限于特定地区的Pro用户,Plus、Team、Enterprise和Edu用户将通过由o4-mini驱动的轻量版获得每月查询限额的增加。