ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

Agent Runtime 时代:从 Harness 工程到开源治理的范式重构

2026/8/29 5:52:08 拓冰建站 浏览量
Agent Runtime 时代:从 Harness 工程到开源治理的范式重构 引言智能体运行时的崛起与工程范式的历史性转折人工智能的技术版图正在经历一场静默而深刻的权力转移。在深度学习浪潮的早期行业的注意力几乎全部集中在模型参数量、训练数据规模以及各类评测榜单的排名之上。然而当大模型从实验室的对话演示走向真实世界的复杂任务执行时一个残酷的工程现实逐渐浮出水面模型本身的推理能力再强也无法独立完成工具调用、状态管理、错误恢复与安全约束等系统性工作。智能体Agent要想在真实生产环境中稳定运行必须依赖一个介于模型与执行环境之间的关键基础设施——智能体运行时Agent Runtime也就是业界所称的 Harness 工程。Harness 的本质是连接高阶认知模型与物理世界操作能力的工程枢纽。它承担着智能体生命周期管理的全部重担包括上下文窗口的动态管理、外部工具的注册与调度、执行环境的隔离与防护、运行状态的持久化存储、人类审批流程的嵌入以及异常情况下的容错恢复。当前全球人工智能领域的头部玩家在这一基础设施的构建路径上已经呈现出两种截然不同的技术哲学与战略取向。一方以 DeepSeek 为代表选择了一条高度理论化、解构主义的路线推出了基于 Cordis 元框架的 DeepSeek HarnessDSH项目。DSH 以一切皆插件为核心设计理念试图通过形式化数学理论支撑将智能体运行时的所有核心能力彻底解耦为可热插拔的独立组件打造一个理论上无限可扩展的智能体操作系统元框架。另一方以 OpenAI 为代表则走向了完全相反的工业工程主义路线。OpenAI 不仅升级了其 Agents SDK更将基于 Rust 语言构建的 Codex Harness 核心仓库以 Apache-2.0 协议全面开源通过控制平面与计算平面的物理隔离、持久化状态引擎以及多层级沙盒机制构建了一套面向企业级生产环境的确定性工程方案。这两种路线的分野表面上是技术架构的选择差异深层则是学术理想主义驱动的理论解构与产业现实需求驱动的工程确定性之间的根本性博弈。深入剖析这两种范式的架构内核与开源战略不仅有助于理解全球智能体基础设施的演进方向更能为中国开源社区在治理理念、生态建设与产业协同方面提供有价值的镜鉴与思考。架构剖析DSH 与 OpenAI Harness 的两种技术哲学DeepSeek Harness以 Cordis 元框架为核心的理论驱动型架构DSH 在架构设计上展现出强烈的理论自觉与学术野心。其底层依赖的 Cordis 元框架形式化基础源自一篇关于时空可组合性编程范式的学术论文。DSH 彻底颠覆了传统智能体框架将调度循环与核心上下文视为不可触碰的特权内核的惯例将模型适配器、工具注册表、执行沙盒、会话日志、调度逻辑乃至前端交互界面全部降格为平权的 Cordis 插件。这种设计意味着理论上任何组件的替换与升级都无需修改框架主线代码只需在配置层重新注册服务即可完成。架构层级 核心构件与工程机制 理论与代码映射 战略设计意图理论底座 形式化时空可组合性理论 论文定理恢复精确性、定理依赖排序、定理汇合性 为长时运行智能体提供数学可证明的无副作用卸载与组合不变式。元框架层 (Cordis) 可逆效应与反应式余效应 状态与逆操作打包依赖关系图声明式自动解析 取消特权内核从架构根源消除修改框架导致的上游代码分叉成本。运行时层 (DSH) 纯追加式会话日志 基于事件流的轨迹视图支持断点复原、重放与分支派生 将智能体运行全过程记录为不可变的事实源确保可追踪性。预设模式层 四种运行模式标准、代码、极简、创造 涵盖全工具链 Coding、代码化工具编排、基准评估与动态插件创作 同时接管端侧开发体验与智能体自演进试验场。Cordis 元框架的核心工程突破在于尝试解决开源社区长期存在的扩展即分叉痛点。在 LangChain 等传统框架中开发者若需替换底层会话持久化逻辑或修改核心调度循环往往必须直接修改源码导致自定义代码与官方上游仓库逐步脱节后续升级成本极高。Cordis 通过反应式余效应机制使得任何核心组件的替换都可以通过配置层的服务重新注册来完成无需动用框架主线代码。同时Cordis 引入可逆效应要求每个插件在加载时必须声明对应的卸载与状态还原操作从而在理论上赋予了智能体在长时运行过程中无缝热重载组件的能力。OpenAI Codex Harness以沙盒隔离三阶产品化接口为核心的工业工程主义与 DSH 追求理论完备与高度解构的范式不同OpenAI 推出的 Agents SDK 与开源 Codex Harness 遵循严苛的工业工程主义。OpenAI 深刻认识到在企业级生产环境与真实软件开发场景中模型本身的灵活性必须受到严格的安全边界与产品化工程接口约束。因此OpenAI 在物理架构上确立了控制平面Harness与计算平面Sandbox的分离模式并通过 openai/codex 开源项目推出了面向不同接入深度的三阶集成战略。在计算与控制分离设计中Harness 专职承载智能体逻辑调度、多智能体手势接力、审批拦截以及内存决策其本身并不直接执行具有物理副作用的代码。所有真实的文件读写、代码编译及系统命令调用均被下沉至计算平面的独立沙盒中支持 macOS seatbelt、Linux landlock 及 Windows AppContainer 等 OS 级沙盒。通过声明式的 Manifest 编排机制开发者能够以 Unix 风格的只读或读写权限精确控制数据挂载。同时集成 Temporal.io 持久化引擎与 SQLite 状态机为系统提供了容错快照打点与 Rehydration 恢复能力。在产品接入与开发者操纵层面OpenAI 拒绝了统一强制重写框架的做法而是将开源 Codex Harness 拆解为针对三种典型场景的精准操纵工具链CLI 工具 codex exec无干预自动化流水线专为一次性后台任务、持续集成CI/CD流水线或自动化脚本设计。开发者只需传入指令或 Markdown 任务文件codex exec 即可在预置权限沙盒内运行有边界的智能体工作流并返回确定性的结构化 JSON/JSONL 结果。简单、高效彻底隔离外部副作用风险。官方 Codex SDK程序员的编程式终极操纵杆支持 TypeScript 与 Python 等主流语言为应用程序提供了直接的 API 级控制能力。开发者可以通过代码精准启动、暂停、恢复或流式传输 Codex 任务显式掌控 Thread会话线程与 Turn执行轮次的完整生命周期。Codex app-server 核心引擎彻底融入产品的智能体心脏作为本次开源的核心亮点app-server 是智能体嵌入复杂产品形态如 IDE 插件、团队协作平台、独立 Desktop 应用的关键。它通过详细记录的客户端协议标准 JSON-RPC 接口允许宿主应用与本地 Codex 守护进程建立长连接。宿主应用不仅能够跨轮次维持会话上下文、实时接收事件流还能灵活挂载应用侧拥有的 MCP 服务并在触发高危操作时无缝接入客户端自定义的人类审批流程。两种范式的横向技术对比DeepSeek Harness 与 OpenAI Codex Harness / Agents SDK 的技术路线差异构成了当前智能体基础设施演进的两个典型极点。比较维度 DeepSeek Harness (DSH) OpenAI Codex Harness / Agents SDK核心设计哲学 理论驱动解构特权内核一切皆插件 场景驱动控制与计算分离三阶集成工具链导向底层开源许可 MITTypeScript 编写 Apache-2.0Rust 编写核心仓库 openai/codex接入层级架构 统一 Web UI / Headless Profile完全依赖插件组装 codex exec (CLI) Codex SDK Codex app-server (JSON-RPC)安全隔离模型 进程内插件化隔离依赖 dispose 逆操作 进程外 OS 级沙盒隔离seatbelt / landlock / Manifest 权限状态持久化与重放 追加式事件日志Append-only Event Log SQLite 会话存储 Temporal.io 快照打点与 Rehydration 恢复主攻目标场景 智能体 Runtime 基础设施与自进化试验场 CI/CD 自动化、应用代码掌控力与深度嵌入产品的 Agent 引擎战略审视五级开源战略模型下的体系化观察五级开源战略分层模型定义为了准确判定各类开源项目的真实战略意图及其对产业生态的深远影响本研究引入五级开源战略分层模型。该模型超越了开源即无私或开源即营销的简单二元论以治理权归属、商业闭环路径以及国家数字主权属性作为核心评估基准。L1 级为市场战略在此层级开源主要被定位为获客漏斗、开发者心智占领工具以及品牌信任杠杆。发起方牢牢掌握项目治理权源码虽然开放但社区贡献门槛极高。L2 级为技术战略开源被视为跨组织协同研发的方式旨在通过社区力量降低重复造轮子的工程成本项目通常保持积极接收 Pull RequestPR的态度。L3 级为商业战略开源项目演变为行业共建的生态底座。发起方通常将治理权移交给中立基金会消除竞品厂商的安全顾虑进而通过上层商业化分层抽租。L4 级为资本战略开源社区活跃度被转化为资本市场的估值乘数其终极目标是通过并购或上市实现资本退出。L5 级为国家创新战略开源上升为国家数字主权、自主可控以及新质生产力的战略载体具备极高的合规门槛与政策托底属性。全球主流 Agent 与基础设施开源项目矩阵定位基于五级战略模型及涵盖治理权、PR 政策、商业模式、安全维护等维度的 10 题自检评估体系对全球代表性开源项目进行体系化扫描可以清晰勾勒出各项目的战略定性。项目名称 主导厂商/组织 治理权与代码贡献政策 核心开源许可 自检得分倾向 最终战略层级Claude Code Anthropic 完全闭源不开放源码 商业专有许可 全 A闭源 L0完全闭源产品DeepSeek Harness DeepSeek 单一公司独裁关闭核心 PR MIT 许可 9A / 1B L1市场战略极致形态OpenAI Codex OpenAI OpenAI 主导Apache-2.0 开源 Rust 核心 Apache-2.0 5A / 5B L2 到 L3技术协同向生态底层演进LangChain LangChain Inc. 公司主导积极吸收社区 PR MIT 许可 6A / 4B L1 到 L2技术协同过渡Redis Redis Ltd. 公司主导因变更许可引发社区分叉 BSD / SSPL 8A / 2B L1受制于商业收割JBoss Red Hat (原 JBoss) 公司独裁已被高价收购 LGPL 许可 9A / 1B L1已完成 L4 资本退出Kubernetes CNCF 基金会 多厂商共同治理TSC 决策 Apache-2.0 1A / 9B L3商业战略中立样板Android (AOSP) Google / OHA 联盟 开放源码GMS 闭源抽租 Apache-2.0 1A / 9B L3生态分层抽租巅峰OpenHarmony 开放原子开源基金会 基金会共治SIG 组协作 Apache-2.0 1A / 9B L5国家创新战略根社区DSH 的战略错位高维叙事与低维治权之悖论通过对 DSH 的深入剖析可以观察到一种显著的战略错位现象。在市场传播与技术叙事中DSH 被赋予了自进化 Agent 操作系统、Agent 时代的 Android以及递归自我改进RSI基石等极高维度L3 至 L5 级的产业愿景。然而通过自检工具严格度量DSH 在治理权归属、PR 接收政策、社区 LTS 维护以及安全审计等方面均表现出绝对的单一公司控制特征实际定位严格驻留在 L1 市场战略层级。这种高维叙事与低维治权之间的落差揭示了 DSH 当前面临的深层困境。DeepSeek 希望借助 MIT 许可和 Cordis 架构的开放性吸引全球开发者为其构建庞大的插件生态从而抢占智能体运行时的定义权。但同时DeepSeek 又保留了对核心仓库的绝对掌控权不仅在 rc 阶段关闭了主线代码的 PR 通道也未表现出任何将项目移交给中立机构的意愿。与 AndroidGoogle 联合 OHA 联盟共建或 EclipseIBM 彻底捐赠给独立基金会的成功经验对比DSH 这种舍不得让渡治理权的保守心态将成为其从高热度 AI 工具跨越为全球通用基础设施L3的实质性屏障。对比之下OpenAI 将其 Codex Harness 核心仓库以 Apache-2.0 协议开源并提供 codex exec、SDK 和 app-server 等完善的标准接口展现出了从 L2 向 L3 级平台化生态跃迁的明确战略路线。批判性反思DeepSeek 团队开源理念的认知局限与学术依赖过度学术化思维与工业真实场景的严重脱节DeepSeek 团队在设计 DSH 时展现了卓越的理论构建能力通过严密的数学推导将时空可组合性转化为 Cordis 元框架的代码实现。然而这种过度的学术第一性原理偏好导致项目在面对复杂真实的工业级产业挑战时暴露出了明显的工程适用性短板。学术推导的核心假设漏洞在于物理世界跨进程副作用的不可逆性。Cordis 在数学上证明了恢复精确性定理即通过插件提供的 dispose 逆操作可以完美复原系统的运行状态。这一数学定理在进程内的内存状态变更例如取消事件监听、释放内存变量中完全成立但在真实的智能体应用中智能体的大量核心行为必然涉及跨进程与物理世界的交互。当智能体通过 API 发起真实资金支付、发送不可撤回的电子邮件或对生产环境数据库执行破坏性写操作时代码层面的 dispose 逆操作在物理时域上根本无法撤销已发生的外部副作用。DeepSeek 过度执念于在框架内部通过纯数学机制解决一致性问题而忽略了工业界普遍采纳的强隔离沙盒 补偿事务机制Saga Pattern 显式人工审批这一更加实用的工程路径。相比之下OpenAI 通过 Codex app-server 的客户端 JSON-RPC 协议与沙盒 Manifest将高风险操作严格约束在客户端审批流程中体现了对物理工程副作用的敬畏。不收 PR背后的治理断层与生态信任黑洞DSH 在开源运作中推行允许并鼓励外部编写插件但长期关闭核心仓库代码 PR的政策。DeepSeek 团队将其解释为架构选择的必然结果即 Cordis 已经将所有能力解构为插件因此任何扩展均无需修改上游主线代码。这种看似优雅的技术解释在产业工程视角下掩盖了深层次的治理缺陷首先是补丁孤岛效应。在工业落地过程中开发者不可避免地会遇到 Cordis 核心逻辑在特定私有云环境、特殊操作系统或边缘硬件下的适配缺陷。拒绝接收 PR 意味着社区修复这些底层 Bug 的努力无法汇入官方主线开发者只能被迫维持各自私有的分叉版本这急剧增加了整个生态的长期维护成本。其次是生态供应链的安全黑洞。DSH 宣扬一切皆插件但其插件运行机制完全缺乏现代工业级操作系统的安全防护。DSH 插件与 Harness 核心运行在同一个 Node.js 进程中共享完全相同的系统权限。在缺少官方签名认证、安全准入审核以及进程级沙箱隔离的情况下第三方恶意插件可以轻易窃取环境变量中的敏感凭证或注入恶意代码。将供应链安全责任完全甩给终端开发者反映出团队在构建大型产业生态时对安全治理考量的缺失。预支远期期权与当前工程落地的非对称性部分资本与行业分析将 DSH 奉为自进化智能体与 Harness 级递归自我改进RSI的破局点。这类高维叙事在逻辑推演上固然令人振奋但在现阶段工程实现上存在严重的非对称性。智能体要实现真正的自进化必须形成闭环的感知-行动-评估-学习反馈回路。DSH 当前仅完成了底层运行时热重载这一单一工程动作即允许智能体在内存中动态替换自身配置或插件。然而实现自进化所必需的另外三个核心支撑模块在当前 DSH 版本中均处于缺失状态一是缺乏可靠的自动化评估闭环智能体无法客观判断自我修改后的 Harness 是否比修改前更优秀极易陷入死循环崩塌二是缺乏因果归因能力大模型目前无法准确诊断任务失败究竟源于模型本身推理缺陷、Prompt 表达不当还是 Harness 插件代码 Bug三是缺乏跨进程事务的安全回滚机制一旦自演进尝试造成破坏性外部影响系统无法实现安全自愈。将远期的理论可能性包装为当前的架构实效这种做法容易引发产业界对智能体基础设施落地难度的盲目乐观。远景破局中国开源大模型团队走向全球竞技舞台的战略路线图从学术出海转向工业共建跨越治权与生态壁垒中国开源大模型团队在过去几年凭借极高性价比的模型与出色的推理性能在全球开发者中建立了广泛的影响力。然而在从单体模型开源迈向智能体基础设施构建的新阶段中国团队必须完成从学术论文驱动代码开源向现代工业级开源治理的范式跨越。全球开发者对开源基础设施的信任不仅来源于代码的开放更来源于治理的中立。如果中国团队希望打造全球通用的智能体运行时标准就必须拿出让渡治理权的勇气。在项目度过早期孵化期后应主动推动将核心代码捐赠给 Linux 基金会、CNCF 或开放原子开源基金会等独立机构建立由多国工程师参与的技术监督委员会TSC彻底消除海外企业对单一商业公司掌控项目的安全顾虑。同时团队需要彻底改变封闭开发、拒绝 PR的态度建立透明的 RFCRequest for Comments演进机制积极接纳全球顶尖工程师的补丁与架构建议将社区智力真正转化为项目演进的动力。构建三位一体的全球开源 Agent 生态攻守策略面对 OpenAI以 codex exec / SDK / Codex app-server 构建的三阶架构与 Anthropic 等巨头在智能体基础设施领域的生态围剿中国开源团队在架构设计上应当摒弃单一的理论偏执采取汲取所长、三位一体的融合演进路线。下一代高竞争力的开源智能体基础设施应当在架构层面融合三个维度的核心能力理论解构与高扩展性汲取 DSH 优势保留解构特权内核的设计思想将模型适配、工具注册与调度逻辑解耦为标准化插件确保框架具备极强的场景自适应能力。产品化分层接口汲取 OpenAI Codex 优势提供类似 codex exec 的无干预 CLI、强类型的客户端 SDK 以及基于标准 JSON-RPC 协议的 app-server 引擎满足从 CI 流水线到复杂产品集成的多元消费诉求。工业级安全与沙盒隔离汲取 OpenAI 沙盒优势引入控制平面与计算平面的物理分离强制要求所有物理副作用操作运行在 OS 级强隔离容器沙盒中并建立插件机制的签名认证与权限控制。国家 L5 战略视角下的民企开源定位与协同机制中国将开源明确上升为国家战略强调促进开源生态繁荣与建设国家级 AI 开源社区。在此宏观背景下中国开源生态需要理清商业开源项目L1/L3与国家创新战略L5之间的分工与协同关系。必须认识到以 DeepSeek 为代表的商业创新企业其核心优势在于快速敏捷迭代、捕捉全球开发者心智以及在技术前沿领域进行高风险探索L1/L3。国家级 L5 战略如数字主权、信创根社区不应强行绑定于商业公司的早期探索项目之上否则容易导致创新项目因承载过重的合规与行政负担而失去国际竞争力。更为科学的模式是构建前店后厂的双轨协同机制允许商业公司与研发机构作为前店采用高度市场化、国际通用 permissive 许可如 MIT/Apache-2.0快速走向国际市场在全球竞技场抢占开发者心智与技术话语权而国家级开源基金会与研究机构作为后厂对经过市场检验的优秀开源项目进行工程加固、安全审计与标准化沉淀将其二次转化为支撑国家数字主权的安全底座L5。这种双轨机制既能保持前端创新的极致灵活性又能确保后端数字基础设施的自主可控。结论与行动建议DeepSeek Harness 的开源代表了中国技术团队在智能体基础设施领域一次极具深度的理论与架构探索。它通过 Cordis 框架把一切皆插件的技术范式推向了新的高度。然而OpenAI Agents SDK 及最新开源的 Codex Harnessopenai/codex演进路径明确地表明工业界生产环境与真实产品落地需要的是一套拥有强隔离沙盒、持久化容错机制以及 codex exec自动化 CLI、Codex SDK代码控制与 Codex app-server产品引擎三阶清晰接入界面的工程确定性方案。DeepSeek 团队并非缺乏开源技巧而是精明地将 L1 市场战略推演到了极致。但其过度的学术化思维、对物理世界不可逆副作用的忽视以及拒绝让渡治理权的封闭心态构成了其迈向全球统治级生态L3的实质性壁垒。综合上述分析针对不同生态参与方提出如下落地行动建议对于企业级技术选型与产品落地团队在面对长时运行、涉及资金交易或强合规要求的核心业务场景时应当保持工程理性优先选择控制平面与计算平面分离、具备沙盒隔离的确定性方案而在需要将 Agent 彻底融入自有产品生态时可参考 Codex app-server 的 JSON-RPC 守护进程设计模式实现会话持久化与端侧人类审批。对于科研机构与学术探索团队DSH 凭借其纯追加日志、全解耦的 Agent Loop 以及 Cordis 热重载能力依然是进行智能体范式研究、多模型 Harness 效应对比以及自进化机制探索的最佳试验平台。对于致力于走向全球舞台的中国开源大模型团队应当坚定不移地走技术高维创新 接入产品化 治理开放中立的联合路线。在架构上兼顾理论前沿与工业级确定性在接入上提供完善的 SDK 与 App Server 协议在治理上打破封闭的垄断心态主动拥抱全球中立基金会与开发者社区方能在全球智能体时代的竞技舞台上建立起真正不可替代的生态壁垒。参考文献:Agent Runtime: The Missing Layer in AI Infrastructure, Agent Runtime: The Missing Layer in AI Infrastructure – AI Infrastructure WeeklyWhy the Harness Matters More Than the Model in 2026 | by Sarah Chen | Medium, https://medium.com/Sarah-Chen/why-the-harness-matters-more-than-the-model-in-2026-eb72448fee04智能体基础设施开源战略全景分析报告.mdawesome-agent-runtime - AI Agents on GitHub | SkillsLLM, awesome-agent-runtime - AI Agents on GitHub | SkillsLLMAgent Runtime Tutorial: Architecture and Quick Start - Cloudsway, Cloudsway - CloudswayOpenAIs Agents SDK separates the harness from the compute - The New Stack, https://thenewstack.io/openai-agents-sdk-sandboxes/Codex — The OpenAI Agentic Harness in TeamDay, Codex — The OpenAI Agentic Harness in TeamDayCodex as a platform: build on the open agent harness | OpenAI Developers, https://developers.openai.com/blog/codex-as-a-platformagent-runtime: Swap Any Agent Component Without Forking | X-CMD, agent-runtime: Swap Any Agent Component Without Forking | X-CMD | agent-runtimeAgent Runtime developer preview: Everything is a plugin, Agent Runtime developer preview: Everything is a pluginAgents SDK | OpenAI API, https://developers.openai.com/api/docs/guides/agentsCodex GitHub Action - ChatGPT Learn, https://learn.chatgpt.com/docs/github-actionmoonbit-community/codex-sdk - GitHub, GitHub - moonbit-community/codex-sdk · GitHubAlways-running MetaHarness coding service on GCP - GitHub Gist, https://gist.github.com/ruvnet/e1008e2a4aa13bf2a991e6aca4028d03codex-app-server · GitHub Topics, codex-app-server · GitHub Topics · GitHub 开发工具————————————————版权声明本文为CSDN博主「AI 前沿观察」的原创文章遵循CC 4.0 BY-SA版权协议转载请附上原文出处链接及本声明。原文链接https://blog.csdn.net/aifrontier/article/details/163944246