被AI代码“淹没”,微软也扛不住了?不到一个月两度「自曝家丑」:Bug修不过来,插件也审不过来

继10月中旬公开承认AI生成代码导致内部Bug修复工作不堪重负后,微软近日再度主动披露旗下Visual Studio Marketplace插件审核流程的滞后问题,不到一个月两度“自曝家丑”,将AI代码浪潮下的实际治理痛点摆到了行业台前。

微软一月两度公开致歉,直面AI代码生态压力

这两次主动披露的事件均引发行业广泛关注,核心指向AI代码泛滥带来的实际影响:

  1. 第一次公开披露:今年10月中旬,微软在年度开发者大会上坦承,公司内部当前新增代码中AI辅助生成的比例已达42%,而这些AI代码贡献了近60%的新发软件Bug,修复团队的工作负荷已经超出承载上限,大量低优先级Bug被迫积压;
  2. 第二次公开致歉:10月下旬,微软Visual Studio Marketplace官方发布公告,受近期插件提交量暴涨影响,插件审核的平均周期从之前的48小时延长至7天以上,部分涉及核心功能、安全模块的复杂插件审核甚至需要等待3周,官方为此向全球开发者致歉,并宣布将审核团队规模扩充一倍,同时上线AI预审核模块优先筛查问题插件。

开发者“AI油门”全踩,插件提交量暴增压垮审核线

微软插件审核滞后的核心原因,是开发端AI工具普及带来的提交量暴涨。当前大量开发者借助AI编码工具将插件开发周期从过去的数周压缩到数天甚至数小时,插件提交量同比涨幅超过200%,远超审核团队的处理能力上限。
不少开发者反馈,使用AI生成代码后,很多人并未逐行校验逻辑就直接提交,甚至部分开发者自身并未完全理解AI生成的代码逻辑,导致大量存在安全漏洞、功能缺陷的插件涌入审核队列,进一步拉长了整体审核周期。微软官方也明确表示,审核周转时间变长的直接原因就是“开发者AI编码使用率持续提升,插件提交量超出预期”。

内部Bug高发,AI生成代码成“效率双刃剑”

除插件审核压力外,微软内部同样深受AI代码质量参差不齐的困扰。AI生成的代码虽然大幅提升了开发效率,但在边界条件处理、逻辑严谨性上普遍存在短板,很多Bug深埋在运行逻辑中,极难通过常规测试发现。
此前技术团队披露的vLLM项目并发Bug就是典型例证:由AI辅助生成的禁用词处理模块,在常规测试中表现正常,但遇到高并发+特定禁用词组合的极端场景时,就会出现“Already borrowed”的错误,返回HTTP 500,这类问题排查难度极高,进一步占用了大量修复资源。微软内部数据显示,AI生成的代码仅占整体新增代码的42%,却贡献了近60%的新发Bug,修复团队每天处理的工单中,超过一半都来自AI生成的代码,甚至出现“修一个Bug冒出两个新Bug”的恶性循环。

行业共性问题凸显,AI代码治理赛道悄然兴起

微软面临的困境并非个例,谷歌、Meta等科技巨头此前都曾公开披露类似问题:谷歌内部新增代码中AI辅助生成的比例已达38%,同样面临代码质量不稳定、审核压力大的问题,不少团队甚至已经出台规定,要求AI生成的代码必须经过额外的人工复核才能上线。
当前AI代码治理已经成了科技行业的新兴需求,不少初创公司已经推出了AI代码安全扫描、质量检测工具,帮助开发者和平台提前筛查代码中的漏洞和缺陷。微软也透露,后续会向开发者开放AI代码质量检测工具,从提交端减少问题插件的产生,同时也会优化内部AI代码的审核流程,在效率和代码质量之间找到平衡点。