刚刚,Claude 造 Claude 半年暴涨 26 倍,3 万个 Agent 同时开工

本周五,Anthropic正式发布《衡量AI研发节奏》报告,首次公开了Claude参与乃至主导下一代AI研发的内部进度数据,相关数据不仅展现了AI研发自动化速度的陡峭攀升,也引发了外界对AI“自研AI”边界与安全管控的讨论。

Claude半年拿下26%AI研发主导权

Anthropic此次披露的研发自动化数据采用了Epoch AI制定的六级自动化评级标准,将AI参与研发的程度从低到高划分为AL0至AL5:

  • AL0:无AI参与,完全由人类完成研发工作
  • AL3:AI可在工程师密切指导下承担大量研发任务
  • AL4:AI接到高层目标后可独立完成大部分任务,仅在关键节点接受人类监督
  • AL5:AI可自主完成问题发现、任务规划、修改执行、测试及全流程部署,无需人类介入

Anthropic提到的“Claude主导26%的AI研发工作”对应的正是AL4等级。数据显示,今年2月该数值还不足1%,短短半年内暴涨26倍,AI在Anthropic内部的身份已从辅助工具转变为能接手完整任务的研发参与者。若放宽标准,目前超过90%的Anthropic内部研发流程已经达到AL3级的人机协作水平。
以夜间数据管道故障处理为例,AL3阶段仍需工程师查看日志、给出初步判断并持续指导Claude解决问题;进入AL4阶段后,工程师仅需提交故障提醒,Claude即可自主完成日志分析、故障定位、修复方案编写测试、异常情况处理及测试数据重跑全流程。

刚刚,Claude 造 Claude 半年暴涨 26 倍,3 万个 Agent 同时开工

3万Agent并发单月决策突破10亿次

随着研发自动化程度攀升,海量AI Agent的并行运行也给管理带来新挑战。截至2026年8月,Anthropic使用最频繁的内部平台上,任意时刻约有3万个Agent同时从事研究和工程工作,仅今年8月就产生了超过10亿次决策。
针对Agent的管控,Anthropic部署了实时监控+事后复查的双重机制:实时监控会在Agent执行动作前预检行为,重点拦截可能造成严重后果的操作(如模型权重复制到外部系统),所有Agent的操作都会经过该轮检查,通常几秒内即可完成;被拦截的行为会在1周内接受人工复查。8月的10亿次决策中,仅有约0.002%的高风险或异常行为被实时系统拦截,相当于每4.7万次决策触发一次阻止机制。

Claude Code Projects重构支持多线程并行开发

外部产品端,Anthropic也对Claude Code的Projects功能进行了彻底重构,终结了此前Projects仅作为静态提示词、参考文件存储夹的模式。新版本Projects以对话为核心驱动,内置Coordinator(协调器)作为调度大脑:开发者仅需下达高阶目标(如“将整个鉴权模块重构为OAuth 2.0并补全自动化测试”),协调器就会自动将复杂工程任务拆解为多个子任务,分配给平行的工作线程异步执行。
整个流程完全支持异步运行,开发者下达指令后即可离开,甚至可通过移动端实时查看各线程进度、微调指令,无需全程盯守。不过多Agent并行仍存在局限性,多分支重叠修改仍可能出现Git合并冲突,遇到这类问题仍需要人类工程师介入把关。目前Projects功能处于beta阶段,首批仅向部分使用云会话项目的Claude Pro、Max订阅用户开放,接下来一周将逐步放量Team、Enterprise、Cowork等版本的权限。

6%研发算力投向安全领域,开放第三方审计

为回应外界对AI自研AI的安全担忧,Anthropic也首次披露了安全相关算力的投入情况:在7月13日至20日当周,公司约6%的AI研发算力投入安全与对齐研究,而在AI驱动型的研发算力中,这一比例达到12%。
Anthropic表示欢迎第三方评估团队获取与内部风险团队同等级别的数据访问权限,对自动化研发数据进行独立审计。不过由于Anthropic此前曾被曝出花钱操控舆论、传播安全焦虑的争议,外界对其披露的安全数据仍存在不少质疑。此外,Anthropic也承认,当前“AI主导”与“AI协作”的边界存在一定主观性,未来需要统一行业标准并由第三方验证相关数据的可靠性。