梦晨 西风 发自 凹非寺量子位 | 公众号 QbitAI
就在开源的DeepSeek-R1被整合进各路AI搜索工具之际,OpenAI临时举行小型发布会。
4点27通知,8点开始直播。
ChatGPT上新“Deep Research”,把推理大模型的思考能力用于联网搜索。

另一项测试GAIA,在现实世界问题上评估AI的公开基准测试,Deep Research在3个级别的难度上均刷新记录。
推理Agent的第一步OpenAI表示,Deep Research专门为在金融/科学/工程等领域从事高强度知识工作、需要深入精确且可靠研究的人群而设计。
它由OpenAI o3驱动,通过基于真实任务(涉及浏览器和Python工具的使用)的训练,采用了与o1相同的强化学习方法。
只需一个提示,它就会查找分析并整合数百个在线资源,生成一份达到研究分析师水平的综合报告。
Deep Research对于OpenAI的重要性,官方原话是:
Deep Research标志着我们在开发AGI的宏伟目标上迈出了重要一步。我们长期以来一直设想AGI能够进行新颖的科学研究,而Deep Research正是这一愿景的重要进展。
使用方法,点击输入框下方的Deep Research按钮即可,支持上传文件添加额外资料。

侧边栏会显示所采取的步骤摘要和使用的信息来源。
完成任务的时间大概是5-30分钟,最终结果将以报告的形式输出。

OpenAI表示,接下来几周内,还将为这些报告添加嵌入式图片、数据可视化和其它分析输出。
和GPT-4o等相比,Deep Research对于需要深度和细节的多方面、特定领域的问题,能够进行广泛探索并引用每个观点。
不过,OpenAI也指出了Deep Research存在的局限性。
它有时会在回复中产生事实幻觉或做出错误的推断,尽管根据内部评估,其错误率明显低于现有的ChatGPT模型。
它可能在区分权威信息和谣言方面遇到困难,并且在自信度校准方面目前表现出弱点,常常无法准确传达不确定性。
报告和引用中可能会有轻微的格式错误,并且启动任务可能需要更长的时间。
下一步,OpenAI表示将在本月内将Deep Research推到移动和桌面APP端。目前,Deep Research可以访问公开网络和上传的文件,未来将能够连接到更多专业化的数据源,使其输出更加稳健和个性化。
我们预见ChatGPT将实现Agent体验的融合,用于异步、现实世界的研发和执行。Deep Research(可进行异步在线调查)与Operator(可进行现实行动)的结合,使ChatGPT能够执行越来越复杂的任务。
AI深度搜索是互联网的新界面OpenAI研究员Jason Wei分享了他对这项新研究的看法:
它不仅是出色的Agent,也可以看成是互联网的新界面
人类使用互联网需要大量时间来搜索和点击,受到时间和注意力的限制。
AI永远不会累,一次可以浏览许多网站,并拥有几乎无限的世界知识。
将来,通过浏览器手动浏览互联网将过时,就像手动计算数字而不使用计算器一样。

OpenAI toG业务负责人Felipe Millon则分享了一个个人故事。

他们做的测试包括:
撰写从2020年到今天每一天的历史阅读《战争与和平》的第1章,分析托尔斯泰的人物描写,回答他对人性的看法是什么?仔细查阅近期的 10-K 报告以发现未报告的财务违规行为……测试中发现的局限性包括:
有时信息缺失引用来源没有“停止”按钮,如果搜索歪了只能重头开始直播回看:https://www.youtube.com/watch?v=YkCDVn3_wiw
参考链接:[1]https://openai.com/index/introducing-deep-research/[2]https://x.com/_jasonwei/status/1886213911906504950[3]https://x.com/danshipper/status/1886203397004783996
— 完 —
量子位 QbitAI · 头条号签约
关注我们,第一时间获知前沿科技
相关文章









猜你喜欢
成员 网址收录40418 企业收录2986 印章生成263660 电子证书1157 电子名片68 自媒体105040