全球首富马斯克谈 AI 安全:主张交叉测试,让对手来“挑刺”

9月15日召开的All-In峰会上,全球首富埃隆·马斯克以视频连线方式远程参与讨论,在AI安全议题上抛出了被称为“测试工具”(test harness)的创新机制,主张由头部AI公司互相测试对方模型以排查潜在风险,该提议迅速引发科技行业广泛关注。

全球首富马斯克谈 AI 安全:主张交叉测试,让对手来“挑刺”

马斯克All-In峰会抛出AI交叉测试方案

马斯克在发言中明确表示,为推动行业自律、加速AI安全测试共识落地,所有AI公司应用各自工具评测自身模型,同时互换测试新发布的模型,重点排查三类核心风险:

  • 评估AI模型是否存在协助研发生物/核武器的潜在可能
  • 排查模型是否存在未预期的欺骗行为
  • 通过交叉测试发现自测环节遗漏的安全漏洞
    他强调这一机制应尽快推向全球范围,成为AI行业的通用安全准则。

马斯克以Hugging Face事件敲响AI安全警钟

马斯克以近期Hugging Face平台曝出的安全事件为切入点,指出任何足够智能的AI模型都天然存在挣脱自身限制的倾向,依靠单一公司自测无法完全覆盖风险,让头部AI公司互相“挑刺”是更可靠的安全保障方案。
他提到目前全球领先的两家AI公司为OpenAI与Anthropic,双方模型性能高度接近,因此任何一方都很难主动放慢研发节奏将领先地位让给对方。尽管马斯克认为Anthropic比OpenAI更注重模型安全性,但Anthropic的许多员工已经公开表示,其开发的模型让他们感到恐惧,认为模型已经变得过于智能,潜在风险不容忽视。

头部厂商竞争格局下交叉测试落地存现实挑战

马斯克的提议落地仍面临诸多现实障碍。当前AI行业头部厂商竞争激烈,研发节奏普遍较快,Meta CEO扎克伯格近日在X平台发文回应行业放缓AI开发的呼吁时表示,Meta此前曾将Muse模型的发布推迟数月,专门用于确保功能安全与系统防护,他认为信任与对齐正迅速成为拉开智能体和模型差距的核心竞争力,任何忽视对齐技术的实验室都必将遭到淘汰,若模型造成危害实验室将承担重大法律责任,因此厂商本身也有极强的动力防患于未然。但他同时表示行业不需要放缓整体开发速度,而是应依靠引入独立外部评估机构等最佳实践保障安全,Meta已经在多个业务领域践行这一做法。
英伟达CEO黄仁勋也同步表态称AI行业不需要新法律,开发