IT之家 7 月 18 日消息,OpenAI 今日凌晨宣布将在 ChatGPT 中推出一款通用型 AI 智能体,该公司表示该智能体可以帮助用户完成各种基于计算机的任务。
OpenAI 介绍称,该智能体可以自动生成可编辑的演示文稿和幻灯片、查看用户的日历来简要介绍即将到来的客户会议、计划并购买制作家庭早餐的食材,以及运行代码等。
该工具名为 ChatGPT agent,结合了 OpenAI 之前多种智能体工具的功能,包括 Operator 点击网站的能力,以及 Deep Research 从数十个网站中综合信息生成简洁研究报告的能力。OpenAI 表示用户只需通过自然语言提示 ChatGPT 即可与该智能体进行交互。
为了开发这个新工具,OpenAI 将其背后的 Operator 和 Deep Research 团队合并为一个统一的团队。外媒 The Verge 报道称,这个新团队由产品和研究部门共 20~35 人组成。
OpenAI 今日起将向 Pro、Plus 和 Team 计划的订阅用户推出 ChatGPT 智能体,今年夏末向 ChatGPT 企业和教育用户开放。要激活该工具,用户可以在 ChatGPT 的工具下拉菜单中选择“智能体模式(agent mode)”。
OpenAI 表示 ChatGPT 智能体比其之前的任何产品都要强大得多,可以访问 ChatGPT 连接器,允许用户连接像 Gmail 和 GitHub 这样的应用,智能体可以根据用户的提示找到相关信息。此外,OpenAI 表示 ChatGPT 智能体可以访问终端,并可以使用 API 来访问某些应用。
根据 OpenAI 的说法,ChatGPT 智能体的底层模型在多个基准测试中提供了最先进的性能。ChatGPT 智能体模型在 Humanity’s Last Exam(pass@1)中得分率为 41.6%,这是一项由数千个问题组成的、涵盖超过一百个学科的困难测试。这个分数大约是 OpenAI o3 和 o4-mini 得分的两倍。
在已知最难的数学基准测试之一 FrontierMath 中,OpenAI 表示,当 ChatGPT 智能体可以访问工具(IT之家注:如用于代码执行的终端)时,其得分为 27.4%,之前的最佳分数来自 o4-mini(得分仅为 6.3%)。