Codex Harness – OpenAI开源的AI Agent底层执行框架

AI工具16小时前更新 智小研
30 0

Codex Harness是一款由OpenAI开源的AI Agent底层执行框架,主要负责驱动智能体完成任务理解、记忆保持、工具调用、沙箱执行、进度展示与人类审批等完整执行循环,支持CLI、SDK与app-server三大接入方式,适用于企业系统集成、运营看板嵌入与自动化工作流场景。

基础信息内容
产品定位AI Agent底层执行框架
开发方OpenAI
开源协议Apache-2.0,可免费商用
接入方式CLI、TypeScript/Python SDK、app-server
通信协议JSON-RPC流式事件
执行环境隔离沙箱运行时
审批机制原生Human-in-the-Loop人工审批
底层模型模型无关,默认对接OpenAI模型
性能表现ARC-AGI-3基准得分从13.3%提升至38.3%
适用人群开发者、企业工程团队、自动化运营人员
Codex Harness – OpenAI开源的AI Agent底层执行框架

Codex Harness核心能力与技术特点

Codex Harness被官方称为驱动Agent的”外骨骼”:模型是负责思考的大脑,Harness负责把想法落地为安全可控的执行动作。它把此前藏在通用聊天框里的Agent循环,拆成了可嵌入、可审计、可审批的工程化组件,开发者可以把它直接装进自有产品、运营看板或业务系统。

Agent执行循环与上下文记忆管理

Harness接管了智能体从接任务到交付结果的完整迭代流程。在长对话与长任务中,它会智能压缩与审查上下文,保持关键信息连贯,避免长程任务”失忆”;任务失败时自动进入失败处理分支,并支持跨会话保存与恢复线程状态,适配长周期工作流。

  • 任务理解与目标拆解
  • 上下文智能压缩与审查
  • 外部工具与业务技能调用
  • 执行进度实时展示
  • 失败处理与断点恢复

沙箱安全执行

内置隔离运行时环境,对文件系统读写、网络访问与命令执行进行严格控制,所有Agent动作可控、可审计、可回滚。相比裸跑脚本的Agent方案,这种沙箱机制显著降低了生产环境中的误操作风险,也让企业安全团队敢于把Agent放进核心业务。

原生Human-in-the-Loop审批

在检测到关键操作(如改写数据、对外发送、资金相关动作)时,Harness会自动暂停执行循环,通过流式事件向前端推送审批请求,人类确认后才继续执行。业务端只需实现一个审批界面并响应JSON-RPC事件,对现有系统的侵入性极低。

流式事件与前后端解耦

应用层掌控界面、上下文、工具与审批流程,Harness层专注Agent循环与沙箱执行,双方通过JSON-RPC协议双向通信。开发者可以实时向产品前端推送AI的思考过程与执行进度,让用户清楚看到Agent每一步在做什么,而不是面对黑盒等待。

Harness设计即性能

官方在ARC-AGI-3基准上做了一个关键实验:仅优化Harness层(保留原有推理与上下文压缩策略),GPT-5.6 Sol的得分从13.3%跃升至38.3%,Token消耗反而减少约6倍。这证明了Agent产品的瓶颈往往不在模型本身,而在执行框架的工程设计。

Codex Harness与同类Agent框架对比

在Agent框架赛道,Codex Harness与LangGraph代表了两种思路:前者是把执行循环做成可嵌入产品的底层引擎,后者是面向开发者的工作流编排框架。

对比维度Codex HarnessLangGraph
核心定位可嵌入产品的底层执行引擎基于图状态机的工作流编排框架
架构设计前后端分离,JSON-RPC通信节点-边模型与检查点持久化
审批机制原生Human-in-the-Loop自动暂停需开发者手动插入中断逻辑
沙箱执行内置隔离运行时需依赖外部容器隔离
集成方式app-server深度嵌入业务系统以Python/JS库嵌入代码
适用场景成熟业务系统的底层AI能力嵌入复杂多步骤工作流编排

与面向个人开发者的命令行智能体框架不同,Codex Harness的定位更偏企业级嵌入。如果你更需要开箱即用的终端Agent体验,可以了解我们此前详解的DeepSeek Harness:一个是OpenAI出品的平台化执行框架,一个是DeepSeek开源的命令行智能体工具,定位互补。

Codex Harness应用场景与适用人群

Codex Harness适合已经拥有成熟业务界面的团队,让AI在底层执行、人类在关键节点把关。

  • 财税合规自动化:嵌入税务准备工作流,AI处理复杂逻辑并自动填充申报表,税务师在关键字段审批确认,已验证处理7000份申报表、准备时间缩短约三分之一
  • 企业云平台应用构建:客户在云控制平台内用自然语言创建自定义应用,Harness在幕后处理权限校验与逻辑流转
  • 物流调度异常处理:调度员一键触发延误调查,Agent调用工具获取实时运单数据分析原因,改单操作需人工审批
  • 运营仪表盘嵌入:实时分析业务指标、触发异常告警、执行修复动作,无需切换到独立聊天界面
  • 安全运维审批:Agent排查受影响服务状态,高危操作自动触发Human-in-the-Loop审批后执行

如何使用Codex Harness

  • 获取源码:在GitHub克隆openai/codex仓库,获得完整的Harness工具库
  • CLI快速执行:用codex exec命令运行有边界的Agent工作流,适合脚本与CI自动化任务
  • SDK编程集成:通过TypeScript或Python官方SDK,在代码中启动、恢复或流式传输任务
  • app-server产品嵌入:部署app-server,通过JSON-RPC把Agent循环深度集成进业务系统
  • 暴露业务工具:将自有API、数据库与操作接口通过MCP协议暴露给Harness调用
  • 配置审批界面:前端接入审批组件,关键操作自动暂停等待人工确认
  • 订阅流式事件:监听执行进度事件,在应用前端实时展示AI思考过程

Codex Harness的官方资源

Codex Harness价格与版权说明

Codex Harness采用Apache-2.0开源协议,可免费商用、修改与二次分发,无需开源上层业务代码。需要注意的是,框架本身免费,但底层模型调用需按OpenAI API用量计费;由于Harness优化了上下文压缩与执行效率,实际Token消耗相比通用聊天框方案可大幅降低。

常见问题

Codex Harness是什么?和Codex模型有什么区别?

Harness是驱动Agent的底层执行引擎,负责任务理解、工具调用、沙箱执行与审批流程;Codex模型是负责推理的”大脑”。前者是外骨骼,后者是大脑,两者配合才能跑通完整的Agent工作流。

Codex Harness可以免费商用吗?

可以。项目采用Apache-2.0协议,允许自由嵌入自有产品、修改源码与二次分发,无需开源上层业务代码,框架本身不收取任何费用。

Codex Harness支持本地部署吗?

支持。代码完全开源,可在自有服务器或私有云环境部署app-server与沙箱运行时,Agent执行过程不依赖第三方托管服务,仅模型推理需要调用API。

必须绑定OpenAI的模型吗?

不是。Harness是模型无关的编排层,架构上不强制绑定GPT,但当前官方实现默认对接OpenAI API,替换为其他模型需自行适配模型调用层。

CLI、SDK和app-server三大组件怎么选?

codex exec适合脚本与CI一次性任务;SDK适合在应用代码中编程式启动任务;app-server适合把Agent做成产品的一部分,需要持久对话、实时事件与审批处理。

已有业务系统如何接入Codex Harness?

通过app-server的JSON-RPC协议连接。应用提供界面、上下文与审批流程,Harness负责执行循环与沙箱执行,双方通过Context in与Events out双向通信。

© 版权声明
AI工具站赚钱操作手册横幅,分享AI工具站SEO、GEO流量增长、CPS、CPA及数字产品变现经验

相关文章