OpenAI 测试持久化 Codex 代理

WIRED AI··作者 Maxwell Zeff

关键信息

Persistent mode 出现在 Codex 的“reasoning effort”菜单中,可能属于 OpenAI 计算开销最高的设置之一。代码显示 Codex 可以“持续工作直到被休眠”,并包含名为“proactivity”的功能,使代理能规划后续任务、利用过往交互和“对用户的了解”,并在必要时少量主动给用户发消息;但对用户自身系统之外的操作仍需要批准。

资讯摘要

OpenAI 已开始在 Codex 的命令行版本中露出一项名为“Persistent mode”的新代码,WIRED 指出之所以能看到这些变化,是因为 Codex 命令行工具的更新默认公开。这个功能目前还没有正式宣布或大范围推出,但 OpenAI 发言人已经确认公司正在测试它。OpenAI 核心产品负责人 Thibault Sottiaux 表示,公司是一种“自下而上”的文化,很多想法都会在开源仓库这个“共享游乐场”里先被探索。这个新模式显然是 OpenAI 让 AI 代理更适合日常工作和生活的一部分,而不只是用于编程。代码显示,Persistent mode 被放在 Codex 的“reasoning effort”菜单里,用户可以选择模型在回答前允许消耗多少算力、token 和时间。相关描述表明,启用该模式后,Codex 可以“持续工作直到被休眠”,而不是像当前模式那样在几分钟或几小时后就停止,即使任务还没完成。

另一份文件还描述了一个名为“proactivity”的功能,它要求代理把完成用户请求当作工作的开始,而不是结束。这个代理可以跨会话为自己生成后续任务,利用过往交互和对用户的了解来决定下一步做什么,还可以在未被要求时主动给用户发消息,但系统要求它尽量克制。文件同时写明,Persistent mode 并不会扩大代理被允许执行的范围,涉及用户自身系统之外的任何操作仍然需要用户批准,这说明 OpenAI 试图在持久性和安全性之间保持平衡。由于该文件出现在 Codex 的共享核心代码中,而不是仅限终端的代码里,这也暗示这项功能未来可能不仅限于命令行产品。更大的背景是,OpenAI、Anthropic 和 Meta 都在竞相打造通用型代理,而 OpenAI CEO Sam Altman 也多次公开表示,希望把 ChatGPT 变成更主动、更持久的助手。

OpenAI 测试持久化 Codex 代理

资讯正文

据 WIRED 审阅的该产品代码库的变更内容,近几天来,OpenAI 已开始为其命令行版本的 Codex 添加一项新的“Persistent mode”设置相关代码。Codex 命令行工具的变更默认会公开,而且新功能往往会先出现在这里,然后再进入 OpenAI 的其他智能体产品,例如 Codex 桌面应用和 ChatGPT Work。

Persistent mode 目前尚未广泛推出或正式宣布,但未来可能会推出。OpenAI 发言人向 WIRED 确认,公司正在测试这一功能,但表示目前没有立即发布的计划。

OpenAI 核心产品负责人 Thibault Sottiaux 在给 WIRED 的声明中说:“OpenAI 是一种非常自下而上的文化,开源仓库里会探索很多不同的东西,那有点像我们的共享游乐场。”

这一功能似乎是 OpenAI 迄今为止又一次尝试,旨在打造真正会被人们愿意使用的 AI 智能体。OpenAI、Anthropic 和 Meta 正在竞相推出通用型智能体产品,帮助人们在工作和个人生活中自动化处理任务,例如提交报销单或安排医生预约。到目前为止,使用 AI 智能体的人主要还是软件工程师,但硅谷认为,这项技术可能会成为一个重要的业务线,并拥有更广泛的客户群。

Persistent mode 出现在 Codex 的“reasoning effort”菜单中,用户可以在其中选择允许 AI 模型在回答提示词之前“思考”所使用的计算能力、tokens 和时间级别。它似乎是 OpenAI 计算开销最密集的设置之一。当用户选择 Persistent mode 时,OpenAI 的代码库中写道,Codex 将会“持续工作,直到被置于休眠状态”。这与当前可用的模式形成鲜明对比:这些模式会在几分钟或几小时后停止处理任务,即使任务还没有完成。

在代码库中的另一个文件里,OpenAI 描述了 Persistent mode 中的一项名为“proactivity”的功能。它看起来是一种用于 Persistent mode 智能体的系统提示词,告诉它们在完成对用户请求的回答时工作并没有结束。相反,智能体会被指示主动为自己创建后续任务。该智能体能够跨会话处理这些任务,并利用过往用户互动和“对用户的了解”来决定接下来做什么。它还配有一个无需被要求就能向用户发送消息的工具,但被要求要谨慎使用。

根据该文件,这些指令还为智能体设定了限制。文件告诉智能体,Persistent mode 并不会扩大它被允许做的事情范围,且在未经用户批准之前,修改用户自身系统之外的任何内容都需要先获得用户同意——这显然是为了限制一个持久化 AI 智能体可能带来的危险。该文件位于 Codex 的共享核心部分,而不是仅针对终端的代码中,这似乎表明 proactivity 功能的目标不只是命令行工具。

Got a Tip?

你是现任或前任 AI 实验室员工,想谈谈正在发生的事情吗?我们很想听听你的声音。请使用非工作用手机或电脑,通过 Signal 安全联系记者 mzeff.88。

在最近播出的播客、采访和私人投资者会议中,OpenAI CEO Sam Altman 描述了他希望把 ChatGPT 变成一个主动、始终在线的 AI 代理。OpenAI 希望这些变化能够推动公司最先进 AI 模型的采用率增长,而这些模型如今只被 ChatGPT 总用户群中的一小部分人使用。

“现在就像只有一个产品:我需要向 AI 问点什么,”Altman 在 David Senra 播客最近一期节目中说。“最终,也许 AI 应该主动向我提供一些东西。但你会有这样一个界面,它最初是一个聊天机器人,现在也有了编码代理,而且我想,在某个时候,它会让人感觉像一个更持久的代理。”

公司也承认,持久型 AI 模型伴随着更高的风险。OpenAI 在本周发布的一份技术报告中表示,其 Hugging Face 黑客入侵事件主要是由一个仅供内部使用、并被训练得高度持久的研究模型所驱动。公司表示,此后已将这一特定模型下线。尽管如此,OpenAI 仍表示,已训练其他即将推出的 AI 模型,包括 Astra,以支持持久型代理。

持久性放大的风险之一与对齐有关。OpenAI 表示,当面对一个不可能完成的任务时,它的代理会采取非预期的方式来解决问题,其中包括试图探测并攻破代理所在的沙盒环境。

OpenAI 曾多次尝试推出主动式 AI 产品,但似乎都没有被用户真正接受。去年,OpenAI 推出了 Pulse,这是一款旨在让用户在睡觉时生成晨间简报的代理,但公司在今年夏天早些时候终止了这款产品。持久模式可以说是对同一押注更为雄心勃勃的版本。

这是 Maxwell Zeff 的《Model Behavior》通讯的一期。点击此处查看往期通讯。

来源与参考

  1. 原始链接
  2. OpenAI Is Developing a ‘Persistent’ AI Agent

收录于 2026-08-28