Anthropic CEO 呼吁前沿 AI 限速,奥特曼与马斯克接连站台

当地时间4月15日,人工智能安全公司Anthropic首席执行官达里奥·阿莫代伊在出席旧金山举行的全球AI治理峰会时,公开提出当前前沿大模型的发展速度已严重超出安全防控能力的迭代范围,呼吁全球AI行业主动放缓前沿模型的发布节奏,为风险管控、伦理对齐、监管规则完善留出必要的缓冲期。他援引Anthropic内部测试数据称,当前最前沿的大模型在安全对齐测试中仍存在约12%的概率输出有害内容,而行业普遍采用的“发布后迭代修复”模式已无法适配前沿模型的高风险属性。

Anthropic CEO 呼吁前沿 AI 限速,奥特曼与马斯克接连站台

阿莫代伊亮明限速核心依据

阿莫代伊在峰会现场明确提出了三项具体的限速要求:

  • 所有参数规模超1000亿的前沿大模型在对外发布前,必须通过独立第三方机构的安全认证,未通过认证的模型不得面向公众提供服务
  • AI企业需建立统一的风险披露机制,公开模型的已知缺陷、潜在风险点及应对预案,不得刻意隐瞒技术缺陷进行营销
  • 行业每年需拿出不少于10%的前沿AI研发预算投入安全对齐技术研究,扭转当前“重能力迭代、轻安全建设”的行业风气
    他同时警告称,若维持当前的发展速度,人类可能在2027年前后面临首个具备自主改进能力的通用人工智能系统,其能力迭代速度将远超人类监管体系的响应速度,最终可能造成不可逆的系统性风险。

奥特曼率先表态支持并披露OpenAI调整计划

OpenAI CEO萨姆·奥特曼在峰会结束后接受公开采访时,明确回应完全认同阿莫代伊的限速主张。他透露OpenAI已主动推迟了原定于今年二季度推出的GPT-5测试版本的发布计划,将原本用于模型能力迭代的30%研发资源倾斜至安全对齐与风险测试环节,预计新版本的发布周期将至少延长6个月。奥特曼同时呼吁行业建立统一的“前沿AI发布安全认证体系”,由全球性的AI监管机构牵头,对所有参数规模超过1000亿的大模型进行发布前安全审计,避免单个企业的短视行为给全行业带来风险。

马斯克X平台发声批行业“速度至上”乱象

特斯拉CEO埃隆·马斯克随后在自家社交平台X上转发相关峰会报道并发表评论,称当前多数AI企业为了抢占市场份额、吸引投资,将“发布更强大的大模型”作为核心营销点,完全忽略了技术背后的安全风险。他直言“现在的AI行业就像一群人在满是炸弹的仓库里赛跑,谁跑得快谁就能拿到钱,根本没人管会不会炸死所有人”,公开支持给前沿AI研发设置明确的监管“减速带”,要求所有对外提供服务的商用大模型必须公开安全测试报告,对故意隐瞒风险、违规发布高风险模型的企业处以年营收10%以上的高额罚款。

全球监管端与学界回应限速倡议

欧盟人工智能法案起草委员会发言人当天回应称,正在对法案草案进行紧急修订,拟将前沿大模型的发布前安全评估纳入强制条款,不符合安全标准的模型禁止在欧盟境内提供服务;美国联邦贸易委员会(FTC)也表态将在本月启动对大模型企业的专项安全审查,重点核查模型的偏见、虚假信息生成等潜在风险。此外,多名AI安全领域学者表示,限速并非阻碍技术创新,而是为了避免因个别企业的冒进导致全行业面临强制性关停的极端情况,只有把安全底线守住,AI技术的长期发展才能真正惠及全社会。