就在昨天,OpenAI又完成一次升级。
这不是什么全新的模型发布,但它对开发者的影响力,甚至超过了模型本身的迭代。
OpenAI正式宣布:将大名鼎鼎的Codex底层核心框架(Harness),作为平台全面开源!

也就是说,OpenAI把驱动自家顶级AI智能体的发动机,免费送给大家。
开发者再也不需要去把业务流程硬塞进一个通用聊天框了!
你可以你直接把最强大的AI 智能体循环,无缝镶嵌进你自有的产品、工程工具、运营看板,甚至是最枯燥的财务报表软件中。
OpenAI总裁Greg Brockman在X上激动转发说:「Codex 能驱动的远不止编程工具!」
你可以在Codex Harness上,直接构建自己的产品。

从此,你的地盘你做主,界面、数据、权限审批都是你的,AI只负责在底层做「牛马」。
OpenAI这次的「开源大动作」,会如何彻底颠覆以后的软件开发范式?
天下苦「通用聊天框」久矣
回想一下,我们现在是如何使用AI的?
不管是写代码、做数据分析,还是处理客户投诉,标准动作似乎都是:打开一个网页/侧边栏,面对一个单调的聊天输入框,敲下一段背景说明,然后期待AI能给出完美的答案。
如果答案不对,就继续在聊天框里「拉扯」。

大多数人通过App、命令行界面(CLI)或IDE扩展认识了Codex。
但在OpenAI看来,这种单一的交互体验,实在是太狭隘了!
OpenAI在官方博客中一针见血地指出:
与其要求每一个团队都把他们原本熟悉的工作流程,强行搬到一个通用的代码助手中去,不如把Agent直接带入那些围绕实际工作设计的软件里。
毕竟,安全分析师看的是预警队列、受影响的服务状态;客服工程师看的是账户历史、产品日志;产品经理看的是需求看板。
对于这些真实的打工人来说,重要的不是那个「聊天框」,而是他们眼前的业务看板。界面的存在是有意义的,它本身就是最重要的「上下文」。
现在,随着Codex Harness的开源,这场「反套壳」的革命,正式打响了。
揭秘 Harness:AI Agent的「最强外骨骼」
那么,这次开源的主角——Harness,到底是个什么?
很多人误以为,一个强大的AI Agent = 好模型 + 好Prompt。
大错特错!
一个真正能在业务中跑起来的智能体,需要一套极其复杂的底层执行系统。
它需要理解任务、在漫长的对话中保持记忆、审查相关信息、熟练调用各种工具、对外展示进度、处理崩溃和失败、在关键时刻停下来请求人类的审批,最后再返回有用的结果。
这个包揽了所有脏活累活的「执行系统」和「智能体循环」,就是 Harness。

这次开源,OpenAI向外界证明了一件事:好的Harness设计,甚至能让模型脱胎换骨。
OpenAI给出非常有说服力的数据,来证明harness设计有多关键。
在难度极高的ARC-AGI-3基准测试中,他们仅仅对Harness进行了两项关键调整——保留推理与上下文压缩。
结果,GPT-5.6 Sol 模型的得分居然瞬间从 13.3% 飙升到了38.3%!更惊人的是,输出的Token数量竟然减少了六倍!
也就是说,在Harness的加持下,AI不仅变得聪明了三倍,还帮你省下了海量的API调用成本。
事实证明,模型能力固然重要,但如何管理这个模型(即Harness的设计),才是决定Agent最终表现的关键。
三大开源组件,零门槛集成
为了让开发者能够真正做到「拿来即用」,OpenAI在Apache-2.0许可下,一口气放出了完整的三大开源组件。
只要去GitHub上的 openai/codex 仓库,你就能解锁这个强大的武器库。
https://github.com/openai/codex
首先是CLI工具codex exec,它能运行自动化的流水线。
如果你只需要让AI跑一个脚本、执行一个CI(持续集成)任务,或者跑一个后台一次性任务,直接用CLI。
它能运行一个有边界的Agent工作流,并返回结构化的输出结果。简单、粗暴、高效。
第二个,就是官方 Codex SDK,它是程序员的终极操纵杆。
如果你正在写应用程序,需要用代码来启动、恢复或者流式传输Codex任务,官方SDK(支持TypeScript / Python)提供了直接的编程式接口。
你可以用代码精准控制线程与任务的生命周期。
第三个,也是本次开源中最耀眼的明星,就是是Codex app-server了。它是彻底融入产品的核心引擎。
当Agent需要成为你产品的一部分时,app-server 是最佳选择。它通过记录详细的客户端协议(JSON-RPC),让你的应用可以连接到本地Codex进程。
你可以用它:
保持持久的对话状态;
流式传输事件(实时看到AI在干嘛);
中途打断AI的工作;
将你自己应用的工具暴露给AI使用;
处理人类的审批请求(Human-in-the-loop)。

正如知名开发者 @ClusterProtocol 所感叹的:
将前端的审批界面,与底层的执行循环分离开来,让把Agent嵌入到业务仪表盘变得前所未有的简单!

绝不仅仅是写代码!,各行各业的「提效核武器」
如果你觉得Codex只是用来写代码的,那你就大错特错了。
正如Brockman所言,Codex 能驱动的远不止编程工具。
让我们来看看那些首批吃螃蟹的人,都在用它创造什么奇迹:

案例一:税务申报的「神级辅助」
你能想象AI去报税吗?财务工作最怕的就是出错,容错率极低。
合作伙伴 Thrive Holdings 和 Crete 利用这套开源Harness,将其嵌入到了专业的税务准备工作流中。
系统不仅能处理复杂的税务逻辑,还能完美融合税务师的反馈。
结果非常震撼, 这个试点项目成功处理了高达 7,000份 申报表,并将税务准备时间硬生生缩短了约三分之一!

这就是将AI嵌入垂直专业工具的巨大威力。
案例二:巨头Cisco的云端管家
科技巨头 Cisco (思科) 使用Codex SDK在其云控制平台内构建了App Builder。
现在,Cisco的客户可以直接使用自然语言来创建自定义的应用程序,而复杂的底层逻辑流转,全部由Codex Harness在幕后默默摆平。

官方演示模板:物流看板「Relay」
为了让大家更直观地理解,OpenAI官方展示了一个名为 Relay 的虚拟物流运营看板应用。
在这个看板里,没有任何让人出戏的「ChatGPT聊天框」。
1.交互巨变:用户不需要从零手写Prompt。他们只需选中一个延误的货单,点击「比较恢复方案」。
2.上下文无缝对接:应用会自动将当前界面的货单详情、物流数据作为上下文喂给AI。
3.MCP集成:Codex会自动调用应用自有的MCP工具,获取最新的实时运营数据。
4.人类把关:Agent分析出最优的重新订舱方案后,必须弹出审批框。只有当业务员点击「同意」,AI才会执行写入操作。
5.状态同步:操作完成后,业务看板自动刷新。

在这个过程中,Harness包揽了Agent循环、记忆维持、工具交互和实时反馈;而你的产品,依然掌控着属于它的仪表盘、数据记录和控制权。这才是真正的「人机协同」。
重塑边界,把权力和灵魂还给应用开发者
为什么我们说这次开源改变了软件构建的范式?
因为在过去的一年里,很多开发者陷入了「套壳」 的怪圈。大家都在做ChatBot,产品越来越像,护城河越来越浅。
Codex作为平台的开放,给了开发者三个维度的「最高控制权」:
Codex给用户绝对的界面控制权,不要再强迫用户去适应聊天框了!
让你的用户继续使用他们熟悉的仪表盘、编辑器、地图和列表。AI应该是一个隐形的帮手,而不是一个霸占屏幕的主角。
绝对的上下文与工具控制权让你安心把公司最核心的系统、机密文档、内部API,通过MCP服务直接开放给Agent。
AI不再是「不知道公司规章制度」的门外汉,而是精通你业务系统的专家。
最后,绝对的运营边界与安全控制权,这对企业级应用至关重要。宿主应用可以决定Agent在哪里运行、能访问什么文件。
最重要的是,你可以设定哪些危险动作(如修改数据库、发送给客户的邮件)必须经过人类的点击能放行。
这种「前端业务规则归你,底层Agent循环归OpenAI」的模式,彻底打通了AI落地企业级场景的最后一公里。
Codex harness的Apache-2.0许可,意味着任何人都能修改和商用。
真正的考验是:有多少开发者会放弃舒适的聊天框,把智能体拆成零件装进自己的产品。
Codex harness背后,深深体现了这种产品哲学——
我们要做的,绝不是用一个万能的聊天框去干掉所有专业界面;而是给这些界面装上一个聪明的大脑。
当通用聊天框消失,原生AI应用将蓬勃发展。
AI Agent的零门槛时代,已经来临了。
参考资料:
https://x.com/gdb/status/2090246288478814281?s=20https://developers.openai.com/blog/codex-as-a-platform

