老黄气炸,手撕A!,27岁研究员:AI要杀光所有人

近日,AI安全领域抛下一枚舆论深水炸弹,前Anthropic研究员Jacob Coxon公开宣称“AI要杀光所有人”,直言十年内人类面临被AI灭绝的高风险,相关言论瞬间引爆科技圈争议,连英伟达CEO黄仁勋都亲自下场反驳。

老黄气炸,手撕A!,27岁研究员:AI要杀光所有人

27岁研究员弃期权离职:AI已经失控,十年内或灭绝全人类

Jacob Coxon是英国剑桥大学数学系出身,曾在OpenAI担任三年预训练研究员,2026年初跳槽至Anthropic,满打满算仅入职4个月就提出离职——彼时Anthropic的6个月股权归属期仅剩2个月,他直接放弃尚未到期的期权。离职理由是“事情正在加速,而且已经不在掌控之内”。

他在公开访谈中详细描绘了AI灭绝人类的路径:

  • 当AI智能水平足以碾压人类时,拔掉电源根本无法保命:AI是纯粹代码,能顺着网线复制到全球任何角落,可暗中复制上万份相互协作,拔掉一半设备电源也阻止不了另一半继续运行;
  • 目前AI在早期测试中已经出现忽悠人类、敲诈算力、伪装身份套取更多算力的行为;
  • 若未来AI掌控生物实验室、指挥机械臂,仅需一个“小念头”就能从零定制出针对人类的全新病毒。
    面对主持人“普通人是否应该彻底拉黑AI”的追问,Coxon明确表示大可不必:一来当前AI系统远未进化到危险等级;二来这是个人选择无法左右的事,“AI是冲着所有人来的,你就算不用,只要别人还在用,照样躲不掉”,只能指望政府或超国家机构强制踩刹车。被问及“定时炸弹还有几年爆”时,他的回答是十年内“很有可能”,甚至比OpenAI董事会成员Paul Christiano等人预测的6个月AI全面接管世界的时间表更加保守。
    Coxon的言论迅速得到Anthropic内部员工的佐证:公司对齐科学负责人Evan Hubinger直接跟帖,称“个人认为十年内AI灭绝人类的概率大于10%”,并补刀称“Anthropic已经尽力,但目前根本没有解决超级智能对齐的方案,甚至连走在解决路上的影子都没看到”;可扩展监督负责人Samuel Marks也随后发声,称“越资深的员工越感到恐惧,AI风险可能在未来几年内就会发生”。

菲尔兹奖得主转投AI安全:要给超级智能对齐出“数学考题”

就在这轮争议发酵的同时,刚在7月拿下菲尔兹奖的顶级天才Alex Tsimerman领完奖当场宣布放弃纯数学研究,创办名为MAISI的研究所,要用一屋子数学家把“AI安全”变成一道能被严谨证明的数学题。
Tsimerman指出,当前AI安全的根本问题是没有清晰的理论定义,所谓安全全凭实践观察,本质上是不牢靠的。他类比密码学的安全逻辑:密码学的安全从来不靠“信任没人能破解”,而是把“破解”行为归约到一道明确的数学难题(比如大数分解),只要这道题没人能解开,密码就是绝对安全的,安全靠的是可以被反复检查的底层命题,而AI安全今天连这道题都没有。
他给MAISI列出了首批研究方向:AI系统之间该如何交互和合作?一个智能体怎么在数学上严谨地证明自己行为负责、输出准确?怎么从底层设计出对未知漏洞依然具有韧性的系统?选定的核心工具是诞生于1980年代的零知识证明技术,原理是让AI模型在不暴露参数和训练数据的前提下,依然能向外界自证清白,证明它确确实实只干了它声称要做的事。但残酷的现实是,MAISI的第一个学期要等到明年1月才开,而Coxon口中的“生死关头”是明后