一、持久模式是什么,和现在 Codex 有什么不同
据 WIRED 披露、OpenAI 官方确认,Codex 正在测试一项叫”持久模式”的新特性。现在的 Codex 完成一轮交互后,即便任务没做完,跑一会就自动停;持久模式下,智能体持续工作直到用户手动”休眠”,测试环境里处理复杂开发任务最长连续运行约 25 小时。它出现在”推理强度”菜单里,属于高算力消耗选项,官方称仍在内部实验、近期无上线计划。
对中小企业最该关心的不是”它能跑多久”,而是”它会不会越权”。这一点官方设计里有明确边界:持久模式不扩大智能体原有权限,修改用户系统之外的内容仍必须先经用户批准。我们此前写 腾讯 CodeBuddy、阿里 Qoder 等 AI IDE 时就说过,AI 写代码正在从”说需求”变成”派活”,但权限闸门必须留在人手里。
二、25 小时连续自主:智能体从”助手”变”同事”
持久模式的关键变化是”主动性”。系统提示要求智能体不把任务当结束,答完问题要主动安排后续子任务,可跨会话保存项目上下文,并结合对用户的了解判断下一步;甚至可在用户没要求时主动发消息(官方要求尽量少用)。这等于把一个”你问我答”的助手,变成了一个”自己排活、自己跟进”的同事。
行业方向很清楚:OpenAI、Anthropic、Meta 都在抢”能持续运行的自主智能体”。但越自主,越需要护栏——这和今天另一条新闻(Claude 误删 700GB)恰好形成对照:自主越大,失控代价越大。
三、主动性 + 跨会话记忆:它真的会”自己安排活”
支撑持久模式的机制叫”线程自动化”——可理解为智能体的闹钟:保留长任务的上下文,支持后台检查与后续追踪,跨会话不丢思路;另有”/goal”模式让用户定义里程碑,Codex 会长期持续推进而不丢进度。这意味着智能体不再是”一次性工具”,而是有状态、有记忆的工作者。
这和我们讲的 智能体记忆 一脉相承:记忆让 Agent 连续,但记忆也要受治理——记什么、留多久、谁可看,都要有边界,否则”自主”会变成”失控”。
四、权限边界没扩大:改系统外仍要你批
这是设计里最该点赞的一点。持久模式提升自主性,但没有放宽操作权限:动系统外的东西必须先获批。对企业落地是铁律——无论智能体多”自觉”,删文件、发对外、改配置、动钱动数据,关键动作必须人工确认。我们在 GUI 智能体 与 MCP/A2A 治理 里反复强调同一原则。
五、算力账:高消耗选项的代价
持久模式被归类为”高算力消耗”,用户要手动在推理强度菜单里开启。连续跑 25 小时意味着 token 与算力开销指数级上升。企业算账时要算两笔:一是模型调用费,二是”它跑偏了”的纠错成本。我们写过 AI 算力计费大变天,核心就是:按 token 计费时代,长任务的成本与可控性要一起管。
六、风险:失控、低质代码、故障新模式
报道点出的风险很实在:一个自主跑 25 小时的 Agent,产出劣质代码的概率和产出优质代码一样高;当它不在每步之间暂停等批准,质量控制、评审与回滚机制就至关重要。持久模式的”默认开启”引入了传统问答系统不存在的故障模式。说白了:能力越强,兜底越要硬。
七、企业怎么用才稳:隔离环境 + 审批 + 回滚
给企业的落地建议就三句话:第一,让自主 Agent 跑在隔离环境(容器/微虚拟机),删错也只删沙盒;第二,关键动作人工审批,保留”随时休眠”的急停;第三,每次改动可回滚,代码有版本、数据有备份。这正好和 Claude 误删事件 的教训互补——护栏不是束缚效率,是让效率可持续。
八、和 Harness、AI IDE 的关系
把几层连起来看:AI IDE(CodeBuddy/Qoder)是”人指挥写代码”;DeepSeek Harness 这类运行框架 是”把模型、工具、权限编排成可靠生产系统”;持久模式则是把 Agent 从”被叫醒执行”变成”自己持续干”。三者不冲突,而是层层叠加。企业真要用,建议先用 Harness 把护栏搭好,再谈放开自主性。
九、与 Claude 误删事件的对照:自主越大越要护栏
今天的两条新闻放在一起读最有价值:一条讲”智能体闯了祸”(误删 700GB),一条讲”智能体要更自主”(持久 25 小时)。结论只有一个——自主程度越高,隔离、最小权限、人工确认、备份、回滚这套护栏越不能省。厂商的安全机制(如降级)不能替代企业自己的治理。我们在 商业秘密案 与 AI 落地卷 Harness 里都给过同一组动作:受治理地上线,才敢放心用。
十、郑州企业怎么落地(三步)
热点归热点,落到郑州本地企业,关键还是”先用起来、再谈先进”。我们给一套可照做的三步:
第一步,圈定一个高价值低风险场景。别一上来就让智能体动生产系统。客服问答、合同审查、内部知识库、报表生成,这些才是中小企业最先能吃到的 AI 红利,投入小、见效快。
第二步,选对部署方式。涉及合同、客户名单、财务数据等敏感信息的,优先考虑数据不出网的私有化或专属云;对外营销、公开问答类,用正规云服务按量计费更划算。我们可协助对接腾讯云、阿里云、华为云等正规渠道资源,具体方案与报价以咨询为准。
第三步,套智能体外壳再上线。直接调模型接口容易”看着能用、用着翻车”。用 Harness/工作流把模型、知识库、权限、人工确认串起来,再做等保测评与最小化授权,才敢进生产。相关思路可看我们关于 AI 落地从卷模型到卷 Harness 与 智能体记忆开源 的拆解。
需要帮忙落地?浩轩云智选提供企业级 AI 智能体定制、私有化部署、等保测评与云资源对接一站式服务。
📞 电话:13723241722 | ✉️ 邮箱:89016332@qq.com
郑州市金水区国基路与花园路御府3号院 · 正规合作服务商,方案与报价以咨询为准。
十一、常见问题(FAQ)
Q1:持久模式现在能用吗? 仍在 OpenAI 内部测试,近期无上线计划;企业可先按”隔离+审批”原则设计自己的自主 Agent。
Q2:它会不会自己乱删东西? 官方设计不扩大权限,改系统外仍需你批;但企业仍要隔离环境与回滚兜底。
Q3:和 Harness 什么关系? Harness 负责把护栏搭好,持久模式让 Agent 更自主,建议先 Harness 后放开。
Q4:算力贵吗? 属高消耗选项,长任务 token 与算力开销大,需把纠错成本一并算入。
Q5:郑州企业怎么起步? 先试点隔离环境的辅助 Agent,再谈自主;电话 13723241722 可聊方案。