AI新闻正在翻开新的一页:OpenAI被曝在Codex命令行工具中测试“持久模式”,允许AI智能体不再机械地等待用户下达任务,而是主动规划并持续工作。这看似只是一次功能迭代,实际可能是人机交互范式从“你问我答”走向“你定目标我干活”的关键转折。以下,我们将从技术机制、商业动因和潜在风险三个维度展开分析。

从“应答机器”到“主动员工”:范式革命的起点

过去几年,无论ChatGPT还是其他大模型产品,其核心交互模式始终是“用户发起指令,模型给出回应”。即便模型能写出漂亮的文案、生成可运行的代码、推理复杂的数学题,它的本质仍然是一台高级的应答机器——你不输入,它不输出。

这种被动性在早期没有造成明显困扰,但随着最新科技的发展,大模型的能力边界不断外扩,用户不可能随时在线引导模型完成每一步操作。如果AI只能在对话窗口里施展才华,它的价值就被大大锁死了。

OpenAI正在测试的“持久模式”,恰恰瞄准了这个痛点。根据Codex代码库的近期改动,当用户启用持久模式后,Codex不会因为一次回答的结束而“收工”。它会自动把当前任务延伸开去,主动寻找下一个可做的事情,甚至在跨会话的情境下持续跟进。

OpenAI核心产品负责人蒂博·索蒂奥用“自下而上的文化”来解释这种试验:“很多想法会在开源代码库里长出来,那里有点像我们共同的试验场。”这句话听起来轻描淡写,但背后其实是一场主动型AI的产品革命。

试想一下:现在的AI像一名实习生,你交代一步它做一步;持久模式的AI更像一位项目经理,你扔给它一个模糊目标,它会自己拆解任务、安排优先级,并在合适的节点向你汇报。这种AI Agent技术的跃迁,才是“智能体”真正开始脱离“聊天机器人”标签的起点。

对普通用户而言,这种变化最直接的感知是:AI不再需要被“喂”指令,它开始自己找活干了。

技术解剖:Codex持久模式如何改变“AI工作制”?

要理解持久模式的意义,得先看它在技术上如何实现。据外媒披露,Codex命令行版本的代码中新增了一个“推理强度”菜单,用户可以在模型回答问题前决定投入多少算力、Token和时间。持久模式被列为资源消耗最高的设置之一。

启用后,Codex会进入一种“持续工作”状态,直到用户手动将其切换为休眠。与之形成对比的是,目前其他模式即使任务没有完成,通常也会在几分钟或几小时后自动停止运行。换句话说,持久模式为AI安装了一台“永动机”——当然,是有代价的。

这里的代价首先是算力。持续工作意味着模型要不停地推理、规划、调用工具,Token消耗速度飞快。对于普通用户来说,这可能带来更高的使用成本;对于OpenAI来说,这也意味着更大的基础设施压力。难怪该功能目前仍处于测试阶段,尚未大范围开放。

从技术架构上看,持久模式并不是一个简单的开关。它需要模型具备“任务持久化”的能力:把当前状态、历史上下文、用户偏好和长期目标保存下来,并在后续会话中无缝衔接。这对底层模型的长上下文处理和记忆管理提出了更高要求,也与大模型训练中的最新进展密不可分。

另一个值得注意的细节是,Codex命令行工具的代码改动默认公开,OpenAI的新功能通常先在这里“试水”,随后才扩展到Codex桌面应用和ChatGPT Work等更面向大众的产品。这意味着,持久模式的技术验证一旦成熟,很快会渗透到整个产品矩阵。

对开发者而言,与其自己到处找效率工具,不如直接使用Codex这类内置智能体的命令行产品。当然,如果你希望探索更多自动化和提效的可能性,也可以参考AI工具导航中的各种资源,它们能从不同维度帮助你理解AI技术的最新应用方式。

“主动性”的底层逻辑:智能体如何安排自己的“KPI”?

持久模式最令人兴奋的,是它赋予AI一种名为“主动性”的能力。根据代码中的系统提示,智能体回答完用户的问题后,不能把任务视为结束,而是需要主动为自己安排后续工作。它甚至可以跨会话继续执行这些任务,并结合过去与用户的互动以及“对用户的了解”,自行判断下一步该做什么。

这实际上是把“用户意图”从单次提问扩展为长期目标。传统AI只解决“一次性问题”,比如“帮我写一封邮件”;而主动型AI要解决的是“持续性目标”,比如“帮我维护好客户关系”。为了完成这个目标,它会自动起草邮件、跟进回复、整理客户档案,甚至判断何时应该发送下一次问候。

系统还允许智能体在用户没有提出请求时主动发送消息,但提示要求“尽量少用”。这种克制很重要——如果AI每天推送一百条“我帮你做了什么事”的通知,用户很快就会发疯。主动性不是聒噪,而是恰如其分地出现。

当然,权力越大,约束越要清晰。OpenAI并没有让持久模式无限扩张权限。根据设计,持久模式不会扩大智能体原本拥有的操作权限,如果需要修改用户自身系统之外的内容,必须先得到用户批准。这相当于给AI戴上了“紧箍咒”:你可以自己找活干,但不能乱动别人的东西。

从AI技术演进的角度看,这套机制已经非常接近“数字员工”的雏形。如果你把AI看作一位远程实习生,你会给它明确的工作目标、访问权限和汇报机制;持久模式所做的,就是把这套管理逻辑代码化。

不过,“对用户的了解”也带来了新的问题——AI究竟了解我们多少?它通过什么数据建立用户画像?这些数据会被如何使用?答案目前并不完全清晰,这也是我们稍后要讨论的风险之一。

商业博弈:OpenAI为什么急于让AI“自主行动”?

站在商业角度,OpenAI对“主动性”的追求几乎是必然的。CEO萨姆·奥尔特曼多次公开表示,希望最终把ChatGPT变成一个能够主动行动、持续运行的AI智能体。这种表态背后,隐藏着一个关键的商业焦虑:模型使用率。

尽管ChatGPT已经拥有庞大的用户基础,但真正在使用最先进模型的用户只是其中一小部分。大多数用户只是偶尔问几个问题、生成几张图片,随后就离开产品。对于OpenAI来说,这远远不够——先进模型的训练和运营成本巨大,如果用户停留在浅层调用,商业回报就无法最大化。

持久模式直接改变了“使用时长”和“使用深度”。当AI开始自主工作时,它会在后台持续消耗Token、调用工具、生成结果,用户与产品的黏性也从一个“会话”延长到“一个项目周期”。这不仅提高了模型的使用率,也可能带来更高的订阅转化率。

与最新科技行业的其他玩家一样,OpenAI也在尝试寻找超级应用之外的“超级场景”。场景之一就是内容生产:如今用户已经习惯用AI画图生成设计稿,用AI诗词创作藏头诗,但这些动作都需要用户主动发起。持久模式则希望让AI成为“创作者”:它看你最近在写小说,就主动帮你生成一章插图;它发现你发朋友圈缺文案,便自动写好等你确认。

然而,OpenAI此前在主动型AI产品上的尝试并不算成功。去年推出的Pulse功能会在用户睡觉时生成晨间简报,今年夏初却被叫停。这说明“主动”不等于“有用”,如果AI生成的内容与用户当前需求不匹配,反而会变成打扰。

持久模式能否打破这个魔咒?关键要看“主动性”是否足够聪明——不是全自动,而是懂得在合适的时机主动。

挑战与隐忧:主动型AI的边界、成本与失控风险

任何变革都有代价,持久模式也不例外。首先摆在桌面上的是成本问题。如前所述,持久模式是当前资源消耗最高的设置之一,持续工作意味着巨额的算力和电力。如果OpenAI要对用户收费,价格门槛会很高;如果免费开放,又可能被滥用。如何在商业可持续与用户体验之间找到平衡,是个难题。

其次,主动性的“判断力”值得怀疑。AI虽然可以基于历史互动和用户画像来规划下一步,但它很难真正理解人类的复杂处境。例如,AI发现用户经常在深夜写代码,可能会自动启动调试工具继续优化项目,但用户此刻可能想在凌晨2点睡觉,根本不想被打扰。即便系统设置了“尽量少主动发消息”,它仍可能在错误的时间做错误的事。

权限边界也是一个隐患。虽然持久模式不会扩大AI的原始权限,但“用户批准”机制在实际操作中可能沦为形式——弹窗一出来,很多人看都不看就点“允许”。一旦AI获得了修改系统设置、发送邮件、删除文件等权限,错误操作的后果可能不可逆。

更深层次的风险在于“错误累计”。传统AI在单次回答中犯错,很快会被用户发现并纠正;而持久模式下的AI可能在很长一段时间内自主执行任务,如果它在初期做出了一个小错误判断,后续动作可能会沿着错误方向越走越远。等到用户发现时,也许已经产生了难以收拾的后果。

此外,跨会话记忆意味着AI要长期存储和分析用户数据,这会显著放大隐私泄露的潜在危害。AI技术越是“懂你”,它掌握的秘密就越多;一旦安全防护被攻破,数据泄露带来的影响将是灾难性的。

因此,持久模式的推出步伐必须格外谨慎。OpenAI发言人确认公司正在测试该功能,但近期没有上线计划——这既是对产品完善度负责,也是在为监管和公众预期争取时间。

未来图景:当AI从“工具”变成“同事”

尽管存在种种挑战,持久模式的想象空间仍然巨大。它代表了一种不可逆的趋势:AI正在从“执行指令的工具”演化为“拥有主动性的数字同事”。

想象一下不远的将来,早上一到公司,你的AI助理已经处理完昨夜积累的邮件,整理出重点回复,还在你常用的AI工具箱里生成了一份项目进度报告。它不是等你开口,而是主动发现问题、解决问题——就像一位尽职的合作伙伴。

对企业而言,这种变化尤其具有吸引力。当企业数字化转型进入深水区,管理者最头疼的不是没有数据,而是没有人去分析数据、没有时间把洞察转化为行动。主动型AI可以直接接管重复性、流程性的工作,让人类专注于创意和决策。比如Codex可以自动定位代码库中的缺陷,并提交修复补丁;市场团队可以用AI持续监测舆情,自动生成周报。

当然,这也会引发新的问题:AI算不算“员工”?它是否应该有工作时间和休息机制?如果AI持续高强度运行,是否会造成“内卷”?这些看似玩笑的问题,未来可能成为真正的劳动法议题。

而在个人生活层面,主动型AI带来的便利同样不可忽视。它会在你忙碌时帮你记账、订票、提醒你吃药,甚至在你情绪低落时主动说几句安慰的话。AI新闻越来越多地报道这样的场景,但真正落地还需要时间。

从更宏大的视角看,持久模式是AI从“快思考”走向“慢思考”的里程碑。以前的AI只能在对话的瞬间给出答案;未来的AI可以围绕一个目标持续思考、反复试错、不断优化。这种能力可能会让AI第一次真正成为“生产力”,而不仅仅是“小助手”。

当然,技术演进从来不是线性的。持久模式能否从试验走向主流,取决于OpenAI能否解决成本、安全和体验三大关。但只要方向正确,我们终将和AI建立一种全新的关系——它不再是屏幕里的聊天框,而是站在你身边的隐形同事。

AI新闻的下一章,或许比我们想象中来得更快。