就在昨日,OpenAI进行了一次重要的升级。这次并不是推出一个全新的模型,而是它对开发者的深远影响可能比模型的自身迭代更为重要。OpenAI正式宣布,将其著名的Codex核心框架Harness开放给公众。这意味着,OpenAI将驱动其顶级智能AI的关键技术免费提供给所有人,开发者不再需要把工作流程强行嵌入一个通用的聊天框。取而代之的是,开发者可以将这个功能强大的AI智能体无缝植入他们自己的产品、开发工具、运营面板,甚至是最繁琐的财务报告软件中。OpenAI总裁Greg Brockman在社交平台上兴奋地分享道:“Codex的能力不止于编程工具!”通过Codex Harness,开发者能够直接创建自己的产品。所有的界面、数据和权限管理都由开发者掌控,而AI仅需在幕后执行重要任务。这一开源举动,可能会彻底改变未来的软件开发模式。 回想我们如何使用AI,发现不论是编写代码、分析数据,还是处理客户投诉,操作方式似乎都非常单一:打开一个网页或侧边栏,面对一个简单的聊天输入框,描述需求后希望AI能给出满意的回答。如果结果不尽如人意,只能继续在聊天框中纠缠。许多人通过应用程序、命令行界面或IDE扩展接触到了Codex。然而在OpenAI看来,这种单一交流体验实在过于狭隘。OpenAI在其官方博客中明确指出,与其让每个团队强行将熟悉的工作流搬到一个通用的代码助手中,不如将智能代理直接嵌入那些为具体工作而设计的软件中。每个领域的从业人员都有各自专注的内容,安全分析师查看的是预警队列,客服工程师关注的是账户历史,产品经理则关注需求看板。对他们来说,真正重要的不是那个聊天框,而是面前的工作界面。这个界面本身就提供了至关重要的上下文信息。目前,随着Codex Harness的开源,反叛传统的革命浪潮已然开启。 那么,这次开源的核心——Harness究竟是什么呢?许多人误认为强大的AI智能体只需依靠优秀的模型和提示,但其实大错特错!一个真正能在实际业务中正常运作的智能体,需要一套复杂的底层执行系统。它需要能够理解任务,在长时间对话中保持记忆,审查相关信息,灵活调用各种工具,清晰展现进度,处理崩溃与失败,并在必要时请求人类的审批,最终返回有用的结果。而这个负责处理所有繁琐任务的“执行系统”与“智能循环”,正是Harness。通过此次开源,OpenAI向外界展示了一个道理:优秀的Harness设计,甚至可以让模型焕然一新。OpenAI提供了一些令人信服的数据,证明Harness设计的重要性。在艰难的ARC-AGI-3基准测试中,OpenAI仅对Harness进行了两项关键调整——保留推理和上下文压缩,结果GPT-5.6 Sol模型的得分迅速从13.3%上升至38.3%,而输出的Token数量减少了六倍!这表明,在Harness的支持下,AI的智能程度提升了三倍,同时极大地降低了API调用成本。由此可见,模型的能力固然重要,但如何管理模型(即Harness设计)才是决定智能代理表现的关键所在。 为让开发者能够真正实现“即拿即用”,OpenAI在Apache-2.0许可下,一次性开放了完整的三大开源组件。只需访问GitHub上的openai/codex仓库,你就能获取这套强大工具。首先是CLI工具codex exec,能够执行自动化的工作流程。如果你只需让AI运行某个脚本、执行持续集成任务或后台作业,使用CLI即可,它能够执行有界限的智能工作流,并返回结构化的结果,简单高效。其次是官方Codex SDK,程序员的终极控制工具。若你在编写应用程序时需要用代码启动、恢复或流式传输Codex任务,这个SDK(支持TypeScript与Python)提供了直接的编程接口,允许你精准控制线程与任务的生命周期。最后,最为耀眼的明星是Codex app-server,它在功能上彻底融入产品的核心引擎。当智能代理需成为产品一部分时,app-server便是最佳选项。它通过详细的客户端协议(JSON-RPC)连接本地Codex进程,使得应用能够保持持久的对话状态,实时流式传输事件,随时中断AI工作,并展示你自己的应用工具。