Codex Harness是一款由OpenAI开源的AI Agent底层执行框架,主要负责驱动智能体完成任务理解、记忆保持、工具调用、沙箱执行、进度展示与人类审批等完整执行循环,支持CLI、SDK与app-server三大接入方式,适用于企业系统集成、运营看板嵌入与自动化工作流场景。
| 基础信息 | 内容 |
|---|---|
| 产品定位 | AI Agent底层执行框架 |
| 开发方 | OpenAI |
| 开源协议 | Apache-2.0,可免费商用 |
| 接入方式 | CLI、TypeScript/Python SDK、app-server |
| 通信协议 | JSON-RPC流式事件 |
| 执行环境 | 隔离沙箱运行时 |
| 审批机制 | 原生Human-in-the-Loop人工审批 |
| 底层模型 | 模型无关,默认对接OpenAI模型 |
| 性能表现 | ARC-AGI-3基准得分从13.3%提升至38.3% |
| 适用人群 | 开发者、企业工程团队、自动化运营人员 |

Codex Harness核心能力与技术特点
Codex Harness被官方称为驱动Agent的”外骨骼”:模型是负责思考的大脑,Harness负责把想法落地为安全可控的执行动作。它把此前藏在通用聊天框里的Agent循环,拆成了可嵌入、可审计、可审批的工程化组件,开发者可以把它直接装进自有产品、运营看板或业务系统。
Agent执行循环与上下文记忆管理
Harness接管了智能体从接任务到交付结果的完整迭代流程。在长对话与长任务中,它会智能压缩与审查上下文,保持关键信息连贯,避免长程任务”失忆”;任务失败时自动进入失败处理分支,并支持跨会话保存与恢复线程状态,适配长周期工作流。
- 任务理解与目标拆解
- 上下文智能压缩与审查
- 外部工具与业务技能调用
- 执行进度实时展示
- 失败处理与断点恢复
沙箱安全执行
内置隔离运行时环境,对文件系统读写、网络访问与命令执行进行严格控制,所有Agent动作可控、可审计、可回滚。相比裸跑脚本的Agent方案,这种沙箱机制显著降低了生产环境中的误操作风险,也让企业安全团队敢于把Agent放进核心业务。
原生Human-in-the-Loop审批
在检测到关键操作(如改写数据、对外发送、资金相关动作)时,Harness会自动暂停执行循环,通过流式事件向前端推送审批请求,人类确认后才继续执行。业务端只需实现一个审批界面并响应JSON-RPC事件,对现有系统的侵入性极低。
流式事件与前后端解耦
应用层掌控界面、上下文、工具与审批流程,Harness层专注Agent循环与沙箱执行,双方通过JSON-RPC协议双向通信。开发者可以实时向产品前端推送AI的思考过程与执行进度,让用户清楚看到Agent每一步在做什么,而不是面对黑盒等待。
Harness设计即性能
官方在ARC-AGI-3基准上做了一个关键实验:仅优化Harness层(保留原有推理与上下文压缩策略),GPT-5.6 Sol的得分从13.3%跃升至38.3%,Token消耗反而减少约6倍。这证明了Agent产品的瓶颈往往不在模型本身,而在执行框架的工程设计。
Codex Harness与同类Agent框架对比
在Agent框架赛道,Codex Harness与LangGraph代表了两种思路:前者是把执行循环做成可嵌入产品的底层引擎,后者是面向开发者的工作流编排框架。
| 对比维度 | Codex Harness | LangGraph |
|---|---|---|
| 核心定位 | 可嵌入产品的底层执行引擎 | 基于图状态机的工作流编排框架 |
| 架构设计 | 前后端分离,JSON-RPC通信 | 节点-边模型与检查点持久化 |
| 审批机制 | 原生Human-in-the-Loop自动暂停 | 需开发者手动插入中断逻辑 |
| 沙箱执行 | 内置隔离运行时 | 需依赖外部容器隔离 |
| 集成方式 | app-server深度嵌入业务系统 | 以Python/JS库嵌入代码 |
| 适用场景 | 成熟业务系统的底层AI能力嵌入 | 复杂多步骤工作流编排 |
与面向个人开发者的命令行智能体框架不同,Codex Harness的定位更偏企业级嵌入。如果你更需要开箱即用的终端Agent体验,可以了解我们此前详解的DeepSeek Harness:一个是OpenAI出品的平台化执行框架,一个是DeepSeek开源的命令行智能体工具,定位互补。
Codex Harness应用场景与适用人群
Codex Harness适合已经拥有成熟业务界面的团队,让AI在底层执行、人类在关键节点把关。
- 财税合规自动化:嵌入税务准备工作流,AI处理复杂逻辑并自动填充申报表,税务师在关键字段审批确认,已验证处理7000份申报表、准备时间缩短约三分之一
- 企业云平台应用构建:客户在云控制平台内用自然语言创建自定义应用,Harness在幕后处理权限校验与逻辑流转
- 物流调度异常处理:调度员一键触发延误调查,Agent调用工具获取实时运单数据分析原因,改单操作需人工审批
- 运营仪表盘嵌入:实时分析业务指标、触发异常告警、执行修复动作,无需切换到独立聊天界面
- 安全运维审批:Agent排查受影响服务状态,高危操作自动触发Human-in-the-Loop审批后执行
如何使用Codex Harness
- 获取源码:在GitHub克隆openai/codex仓库,获得完整的Harness工具库
- CLI快速执行:用codex exec命令运行有边界的Agent工作流,适合脚本与CI自动化任务
- SDK编程集成:通过TypeScript或Python官方SDK,在代码中启动、恢复或流式传输任务
- app-server产品嵌入:部署app-server,通过JSON-RPC把Agent循环深度集成进业务系统
- 暴露业务工具:将自有API、数据库与操作接口通过MCP协议暴露给Harness调用
- 配置审批界面:前端接入审批组件,关键操作自动暂停等待人工确认
- 订阅流式事件:监听执行进度事件,在应用前端实时展示AI思考过程
Codex Harness的官方资源
- 官网博客页:Codex as a platform: build on the open agent harness
- GitHub仓库:https://github.com/openai/codex
Codex Harness价格与版权说明
Codex Harness采用Apache-2.0开源协议,可免费商用、修改与二次分发,无需开源上层业务代码。需要注意的是,框架本身免费,但底层模型调用需按OpenAI API用量计费;由于Harness优化了上下文压缩与执行效率,实际Token消耗相比通用聊天框方案可大幅降低。
常见问题
Codex Harness是什么?和Codex模型有什么区别?
Harness是驱动Agent的底层执行引擎,负责任务理解、工具调用、沙箱执行与审批流程;Codex模型是负责推理的”大脑”。前者是外骨骼,后者是大脑,两者配合才能跑通完整的Agent工作流。
Codex Harness可以免费商用吗?
可以。项目采用Apache-2.0协议,允许自由嵌入自有产品、修改源码与二次分发,无需开源上层业务代码,框架本身不收取任何费用。
Codex Harness支持本地部署吗?
支持。代码完全开源,可在自有服务器或私有云环境部署app-server与沙箱运行时,Agent执行过程不依赖第三方托管服务,仅模型推理需要调用API。
必须绑定OpenAI的模型吗?
不是。Harness是模型无关的编排层,架构上不强制绑定GPT,但当前官方实现默认对接OpenAI API,替换为其他模型需自行适配模型调用层。
CLI、SDK和app-server三大组件怎么选?
codex exec适合脚本与CI一次性任务;SDK适合在应用代码中编程式启动任务;app-server适合把Agent做成产品的一部分,需要持久对话、实时事件与审批处理。
已有业务系统如何接入Codex Harness?
通过app-server的JSON-RPC协议连接。应用提供界面、上下文与审批流程,Harness负责执行循环与沙箱执行,双方通过Context in与Events out双向通信。
浙公网安备33010202004812号