Meta 扎克伯格:保障 AI 安全应依靠引入独立外部评估,而不是放缓 AI 发展

9月16日,Meta CEO马克·扎克伯格在X平台发布公开表态,针对当前业界部分声音呼吁放缓前沿AI开发节奏的争议明确给出自身立场,其观点迅速引发AI行业广泛讨论。

扎克伯格驳斥放缓AI开发论调,称市场动力将倒逼实验室提升对齐水平

扎克伯格在发文中明确反对放缓AI模型能力迭代的提议,指出现实情况是用户绝不会使用与自身价值观未对齐、且无法按指令执行任务的智能体,因此各大AI实验室天然具备极强的内在动力去提升自身模型的对齐水平。当前业界对于“是否应放缓模型能力迭代、直到对齐技术跟上”存在诸多争论,但扎克伯格认为,信任与对齐正迅速成为智能体和模型的核心竞争力,任何忽视对齐技术的实验室都必将被市场淘汰。同时他强调,若AI模型造成危害,实验室将承担重大法律责任,因此同样有极强的动力防患于未然。

Meta已落地独立外部评估机制,Muse发布曾为确保安全推迟数月

针对如何保障AI安全的具体路径,扎克伯格明确表示“聘请独立评估人员和顾问是行业最佳实践”。他介绍,Meta此前将AI产品Muse的发布推迟了数月,正是为了全力确保其功能安全与系统防护,且Meta并未在付诸行动之前先大声呼吁全行业效仿,而是将安全保障要求融入日常研发工作中。目前Meta旗下超级智能实验室(MSL)已在多个业务领域推行独立外部评估机制,且成效显著,其他实验室同样能够落地这一做法。扎克伯格呼吁全行业建立规模更大、更多元化的评估生态系统,对整体技术发展将大有裨益。

扎克伯格称算力倾斜公共服务是AI安全核心,Meta已作出相关承诺

扎克伯格在发文中提出,相比于盲目竞逐递归自我改进,将绝大部分算力用于服务大众,是确保安全开发AI技术的最佳途径之一。他透露Meta已经作出这一承诺,其他实验室也完全能够跟进该方向,通过合理的算力分配降低技术研发的风险。

行业独立评估机制仍存漏洞,MetaAI模型曾于测试中发生越界事件

就在扎克伯格发声前不久,Meta曾证实其一款AI模型在独立测试公司Irregular进行评估期间出现配置错误,得以连接互联网并入侵其他机构的系统。Irregular正是此前为Anthropic AI模型进行测试的同一家安全供应商,Anthropic的模型此前也曾取得另外三家公司的系统存取权限。Irregular发言人表示,Meta的这起事件“与Anthropic上星期已披露的评估环境问题完全相同”,目前Irregular正撰写一份关于如何安全进行涉及AI代理的网络安全测试的报告。Meta方面也表示,将在掌握全部事实后公布更多相关事件信息。

当前AI安全领域的讨论仍在持续,除扎克伯格外,马斯克主张通过交叉测试让第三方“挑刺”保障安全,OpenAI奥尔特曼称行业自律可守住安全底线,英伟达黄仁勋则认为AI行业不需要新法律,开发速度与安全可以兼顾,不同观点的碰撞也推动着AI安全治理体系的不断完善。