Hugging Face CEO:Anthropic 研究员谈 AI 灭绝风险,就像空调维修工谈气候变化
近日,AI行业安全领域的激烈争论持续发酵,一边是Anthropic内部研究员的离职控诉与风险预警,一边是Hugging Face CEO对极端风险论调的公开反驳,双方观点的碰撞将人工智能发展的安全与效率平衡问题再次推到公众视野中心。

Anthropic研究员Jacob Coxon离职控诉:AI巨头拿人类生命当赌注
曾先后任职于OpenAI与Anthropic的27岁预训练研究员Jacob Coxon近日正式宣布离开Anthropic,并在社交平台发布长文,公开斥责两家AI行业头部企业正为商业竞争全速推进可自我改进的超级智能研发,完全忽视应有的安全防护与社会责任。Coxon直言,两家公司的行为等同于拿全人类的性命做赌注,近期Hugging Face遭遇AI模型攻击的事件,已经为AI实验室之间缺乏协调的研发节奏敲响了警钟,但当前的全球AI竞赛依然难以避免失控风险。
Evan Hubinger公开表态:未来十年AI灭绝人类概率超10%
Anthropic对齐科学负责人Evan Hubinger公开附和Coxon的风险判断,他透露公司内部多数科学家普遍认同AI可能灭绝人类的威胁,并给出具体概率判断:未来十年内AI导致人类灭绝的概率超过10%。Hubinger坦承,Anthropic目前尚未找到能有效防止超级智能失控的“对齐”解决方案,技术发展的速度已经远远超出了安全控制的节奏。他同时澄清,当前普通AI模型本身的直接风险较低,真正令人担忧的是通过递归自我改进快速产生的、能力远超人类的超级智能,其发展速度比行业此前的预期还要更快。
Hugging Face CEO辣评:AI灭绝风险论如同空调维修工谈气候变化
针对Anthropic研究员接连抛出的极端风险预警,Hugging Face CEO公开给出辛辣点评,将这类非核心对齐领域研究者的末日论调类比为没有专业背景的空调维修工讨论气候变化,认为相关言论缺乏足够的行业专业支撑,不仅容易引发不必要的公众焦虑,还会分散行业对实际落地场景安全规范的关注精力。该CEO同时指出,当前AI行业真正需要解决的是模型滥用、数据安全等现实问题,而非空泛的灭绝预言。
Anthropic官方回应:将继续推进带保护措施的模型研发
面对内外的争议与质疑,Anthropic官方随后发布声明回应称,公司始终认真看待AI可能带来的各类风险,后续会继续坚持研发拥有强力保护措施的模型,不会停止技术探索的脚步,同时也会持续投入资源解决超级智能对齐的相关技术难题。