2025 年 11 月 26 日,Anthropic 发布了一篇工程博客,《Effective harnesses for long-running agents》。文章向整个行业讲了一件事:Claude Code 之所以强,一半在 Claude 模型,另一半在模型外面那一整层工程系统。

那一层,他们叫 Harness。

模型负责提供智能,Harness 负责让智能真正变成一个可持续运行的 Agent:上下文怎么管理,工具怎么调用,状态怎么维护,出了错怎么恢复,权限怎么控制。这些事没有一件是模型自己会做的。

两个月后,2026 年 1 月 23 日,OpenAI 发布《Unrolling the Codex agent loop》,把支撑 Codex 运行的核心 Agent Loop 和执行逻辑,明确称为 Codex Harness。一个优秀的 Agent 不等于“大模型 + Prompt”,它需要一个完整的执行系统。

紧接着 2 月,OpenAI 又发了《Harness engineering: leveraging Codex in an agent-first world》,记录了一个内部实验:从空白的 git 仓库开始,让 Codex 当主力开发,人类只做审查。五个月,零行手写代码。

到这个时候,Harness 已经越出一个工程术语的范围,在变成一门新的 Agent 工程学。行业的认知完成了一次迁移:

Prompt Engineering 解决怎么向模型提问;Context Engineering 解决给模型提供什么信息;Harness Engineering 解决的是另一个量级的问题:怎么构建一个能够长期、稳定、自主完成任务的智能系统。

“Agent = Model + Harness”,逐渐成为共识。

但这个阶段有一个绕不开的局限:主流 Agent 的 Harness,无论 Claude Code 还是 Codex,都与厂商自己的模型、Runtime、工具链深度绑定。开发者可以扩展它,很难真正拆开它、重组它。说直白点:你能装修房子,改不了承重结构。

这个边界我踩了一年多。我在 Claude Code 里手工搭过四层环境:规则、技能、经验,还有一层放我自己的方法论。做得再深也是装修,楼是 Anthropic 的。

8 月 13 日,DeepSeek 把墙拆了

DeepSeek 发布了 Harness 的开发者预览版,MIT 协议开源。发布当天 GitHub 星数破三万,到今天,17 万。

又一个 Agent 框架开源,这本身不算新闻。真正激进的是它的架构理念:

Everything is a Plugin。

模型是插件。工具是插件。Skills 是插件。Agent Loop 本身是插件。Session、Sandbox、Storage、UI,全部是插件。按官方的说法,这个系统里没有特权内核。

区别在哪?过去你只能给 Agent 增加能力;现在你可以重新组装 Agent。前者是在房子里加家具,后者是动承重墙。

这件事抬高的,是整个行业对“什么才算真正开放的 Agent 平台”的期待。如果开发者可以直接复用成熟的 Harness,不必重复造 Agent Loop、上下文管理、工具调度、权限系统这些轮子,大量 AI 应用公司的竞争重心就会跟着转移,从造基础设施,转向真正值钱的东西:行业数据,工作流程,Skills,专业知识,用户体验。

8 月 19 日,OpenAI 也把门打开了

六天后,OpenAI 发布《Codex as a platform: build on the open agent harness》,把 Codex 从一个编程 Agent 产品,提升为一个供第三方构建应用的平台。

需要说准确一点:Codex CLI、App Server、SDK 这些组件早已开源,8 月 19 日的新东西不是开源,是定位。OpenAI 明确把 Harness 作为开放层,并划清了边界:应用拥有产品上下文、业务规则和工具,Harness 负责 Agent 循环。模型访问和托管服务,另算。

落到具体:第三方应用可以保有自己的界面和仪表盘,可以管理自己的业务上下文,可以接入自己的工具和 MCP 服务,可以设计自己的审批和权限流程。Cisco、Thrive Holdings、Current 这些团队,已经在把 Codex harness 嵌进自己的内部应用。

Codex 的身份变了:从一个会写代码的 AI,变成一个可以嵌入其他软件系统的 Agent Runtime。

真正的变化,不是谁先开源

把这两个日期并排放着看,很多人会问:是不是 DeepSeek 逼得 OpenAI 不得不开放?

这个因果我不下断言。公司决策的内部动因,外界永远无法证实。但有一个变化是明摆着的:行业竞争的标准,换了。

过去 AI Agent 的竞争问的是:谁的模型更强?

现在这个问题旁边多了一个:谁的 Harness 更开放?

未来它甚至可能反客为主。竞争的维度会变成:模型是否可替换,Agent Loop 是否可定制,Context 策略是否开放,Skills 是否可迁移,工具生态是否互通,是否允许开发者重新组合整个 Agent。

从这条时间线看:2025 年底,概念被行业认识;2026 年 8 月,DeepSeek 和 OpenAI 六天之内先后落子。Harness 从产品内部能力,走到了开放基础设施。

DeepSeek Harness 的意义,不一定是第一个做 Harness。它前面有 Claude Code,有 Codex。它的意义是把一个问题推到了所有厂商面前:

如果 Agent 是未来的软件形态,那 Agent 的操作系统,是否也应该属于开发者?

模型开放,协议开放,技能开放,前面都有人趟过路。下一个轮到的,是 Harness。

可以叫它:Harness 开放时代。


作者简介: 陈石律师,浙江海泰律师事务所副主任、高级合伙人、房地产与建设工程部主任,宁波市律师协会副秘书长、第七届宁波仲裁委员会仲裁员,聚焦建筑房地产、投融资、并购重组及商事争议解决。曾获多家法律媒体与专业机构认可,荣登 LegalOne 2025 中国区建工及房地产实务先锋 45 强、律新社 2025 年度管理合伙人 20 佳(华东),入选《商法》The A-List 法律精英,获评 ALB China 区域市场十五佳长三角地区律师新星,并获律新社 2024 年度并购领域品牌之星。长期为万科、华润置地、信达地产、保利置业、招商蛇口、中海地产等企业提供法律服务,承办“首宗百亿地王”“长春第一高楼”“台州第一高楼”等代表性项目,累计服务项目投资额超千亿。近年来持续推动 AI 与法律实务融合,强调以结构化方法打通技术逻辑、法律判断与商业场景;著有《赋能法律人:AI 底层思维与应用范式》,并在多地开展相关主题讲座与分享。四明山法师 AI 夜校(legalAGI.cn)发起人。