Codex也断了:OpenAI三线齐崩,Agent时代的宕机账单怎么算

三线齐崩:黑色傍晚的1小时51分

7月25日傍晚,OpenAI的API、ChatGPT、Codex三大核心服务同时报错,31个服务组件性能下降,持续1小时51分钟后才逐步恢复。这并非孤立事件——OpenAI已连续17天出现不同程度的服务波动,而本次故障波及范围最广,从美国、欧洲到印度、日本、澳大利亚,付费开发者的自动化工作流与普通用户的网页、移动端访问一同中断。DownDetector上超过3000起报障,其中79%指向ChatGPT,9%涉及移动应用,8%归因于Codex平台。

Codex断联,Agent团队集体“哑火”

Codex早已不只是一款代码工具。根据OpenAI最新发布的《The Shift to Agentic AI: Evidence from Codex》报告,在OpenAI内部,Codex被用于研究、规划、沟通、招聘、销售、产品工作和数据分析,97.9%的内部员工是活跃用户,近30%的员工同时管理5个或以上的并发Agent,形成“人类监督一支Agent团队”的工作模式。当Codex断联时,这些Agent团队瞬间“哑火”——修bug、写测试、整理文档的自动化任务全部中断,依赖技能(Skills)和插件打包的工作流无法调用。截至2026年6月,26.6%的活跃用户已依赖技能实现任务复用,宕机直接导致这些封装好的AI工作流瘫痪。

每秒损失几何?企业级信任的“裂缝”

Agent时代的宕机账单不能仅按传统API调用量计算。组织用户中,Codex活跃用户占比17.3%,普通工程师26.8%的Token在Codex上生成,且自年初以来增长5倍。当这些高价值任务突然中断,企业不仅损失了正在执行的AI任务(如代码审查、数据分析、客户沟通),更面临交付延迟、信任危机和内部流程混乱。更关键的是,用户已习惯将最复杂的工作交给AI——需要8小时以上人工完成的任务,用户比例从2.1%飙升至25.6%,这意味着一次近2小时的宕机可能中断多个深度任务,实际损失远超可见的API计费。

连续17天暗流,OpenAI的可靠性红线

本次故障并非偶发。此前7月23日ChatGPT、Codex及多条API已出现错误率飙升,OpenAI当天下午完成临时修复,但仅隔两天再次集体“掉线”。连续17天的服务暗流,让开发者开始质疑OpenAI的可靠性红线。在Agent时代,企业将越来越深地将核心工作流委托给AI,而单次故障的恢复时间(1小时51分)对于依赖自动化流水线的组织而言,已足以触发连锁反应——电商客服中断、代码合并阻塞、研究分析暂停。OpenAI官方状态页上“错误率升高”的提示,正在变成企业决策者眼中的红色警报。

去中心化算力“捡漏”?

每一次OpenAI的宕机,都让去中心化算力网络获得一次聚光灯。Bittensor(TAO)通过子网组织机器学习任务,以代币激励模型输出,试图提供另一种不依赖单点故障的AI基础设施。尽管当前中心化AI企业估值约12万亿美元,而去中心化板块仅约120亿美元,差距悬殊,但宕机事件正在重塑用户对“可靠性”的认知——当Codex断联,企业是否愿意为去中心化网络的容错性支付溢价?本次事故后,Bittensor等网络的讨论热度再次上升,但TAO代币当日仍下跌约3.6%,市场尚未给出明确答案。