OpenAI 推出 Agents API:把 Codex 拆成云端服务,"造 Agent" 变成一次 API 调用

当地时间9月10日,OpenAI正式宣布Agents API进入公开测试阶段,面向所有开发者开放。此次推出的API核心是将原本藏在Codex产品背后的Codex Harness(负责长会话上下文压缩、工具调度、多子Agent协作的底层框架)服务端化,开发者无需再自行搭建复杂的Agent编排层,即可快速构建可投入生产的智能体应用。

OpenAI Agents API公测上线 四要素即可创建云端智能体

开发者仅需向API提供任务、模型、工具、运行环境四类信息,即可直接完成Agent创建。原本需要开发者自行维护的Harness由OpenAI统一托管和迭代,而Agent实际运行的执行环境可灵活选择:既可以使用OpenAI官方托管沙盒,也可以接入自有基础设施,或是Cloudflare、E2B、Modal、Vercel等第三方合作伙伴提供的沙箱环境。
收费规则方面,Agents API本身不收取额外的平台订阅费,开发者仅需为Agent实际消耗的模型Token、工具调用量付费,若使用OpenAI官方托管沙盒,计算资源费用另行计算。

三项核心能力解决长时运行Agent的共性痛点

针对长时运行Agent普遍存在的上下文溢出、工具调用效率低、多任务协同难等工程问题,Agents API内置了三项关键能力:

  • 上下文自动压缩:当会话内容接近上下文窗口上限时,系统会自动对早期会话内容进行压缩,保障Agent可连续运行数小时甚至数天,无需人工干预重置上下文;
  • 工具搜索与并行调用:按需加载对应任务的相关工具定义,降低无效Token消耗,同时支持并行执行多个工具调用,提升任务处理效率;
  • 多Agent协同:主Agent可将复杂任务拆解后下发至多个并行运行的子Agent,各子Agent独立维护上下文,最终由主Agent汇总各子Agent的执行结果,完成复杂任务的处理。
    同时Agents API采用版本化设计,每次模型更新都会对应开放相应能力入口,OpenAI负责持续维护和优化Harness,开发者无需在新模型发布后重构既有Agent架构,即可直接使用新模型的能力。

开源与托管双路线并行 差异化布局智能体生态

此次Agents API的推出,是OpenAI持续拆解Codex能力的又一步。早在2025年4月OpenAI发布o3、o4-mini模型时,就开源了Codex CLI,将本地终端运行的Agent框架完全开放,开发者可自行修改、部署;2025年5月Codex云端版正式上线,面向普通用户提供云端代码处理能力,支持独立沙盒运行、并行处理多任务;2025年10月OpenAI又发布Codex SDK,开源了Codex Harness的核心代码。
与行业其他玩家的路线相比,OpenAI此次的Agents API走出了差异化的托管服务路径:开发者既可以选择拿开源的Harness自行搭建Agent框架,也可以选择OpenAI托管的云端服务,省去底层维护成本。某种程度上,这一路线与走开放插件生态、让开发者自行组装零件的路线形成差异化——前者更倾向于做类似AWS的托管云服务,帮开发者解决所有底层问题,后者则更倾向于做类似Linux的开放生态,提供核心组件供开发者自由组合。

公测阶段已有客户验证效果 单案处理成本最高下降60%

从早期接入客户的反馈来看,Agents API的落地效果已经得到初步验证:安全合规服务商SafetyKit将案例审核工作流迁移至Agents API后,单案处理成本下降了60%;科技公司Hypha通过将代理执行框架与沙箱环境解耦,将Agent响应失败率降低了86%;科技公司Cirridae接入后,评估分数从0.71提升至0.85,同时实现4倍的延迟降低。
目前Agents API仍处于公测阶段,OpenAI表示将根据开发者的反馈快速迭代功能,后续逐步推进至正式发布。除上述核心能力外,该API还支持MCP协议、自定义函数、网页搜索等内置工具,进一步降低开发者的接入门槛。