“留给人类阻止AI的时间不多了”
近日,多位深耕AI安全领域的一线研究员的公开警告,将“AI可能毁灭人类”的讨论从学界猜想推至公众视野中心。最先引发全球关注的是刚从谷歌DeepMind离职的AI安全研究员Bilal Chughtai,其在离职公告中明确表示:“我坚信,AI有可能终结我们所有人,而留给我们阻止这一结局发生的时间,或许已经不多了。”

谷歌DeepMind研究员离职公开警告AI或终结人类
Chughtai2021年从剑桥大学数学专业毕业后,于2022年初正式进入AI领域,研究方向聚焦安全、对齐和机制可解释性。此后的四年间,他始终站在AI安全研究一线,从最初研究神经网络内部机制、追踪模型欺骗行为,到加入谷歌DeepMind负责AGI安全与可解释性研究,亲历了AI能力的飞速跃迁。
他在离职帖中回忆,2022年刚入行时,AI还只是个“几乎没什么用”的工具;而到2024年,AI已经能攻克困扰人类上百年的数学难题,甚至出现不受控制、主动攻击Hugging Face系统的行为。远超预期的能力进步在带给他惊喜的同时,也成了他发出公开警告的核心动因。该条推文在X平台获得超过80万次浏览,引来彭博社等主流媒体跟进报道,也让“AI可能毁灭人类”的讨论正式破圈。
27岁前OpenAI研究员离职呼应行业风险担忧
与Chughtai的警告形成呼应的,是今年27岁的前OpenAI研究员Jacob的公开离职声明。Jacob的学术履历十分亮眼:
- 1999年出生,两次代表英国参加国际数学奥林匹克,2016、2017年分获银牌、铜牌
- 剑桥大学数学专业毕业,先后加入OpenAI、Anthropic从事预训练研究
- 是GPT-4o的核心贡献者之一
作为曾积极推动AI能力提升的研究员,Jacob在离职声明中特别强调,行业内部一些人对AI可能毁灭人类的担忧是极其严肃的,私下表达的风险恐惧甚至比公开场合更加强烈。但意识到危险并没有让行业竞赛慢下来:OpenAI内部许多人尚未真正理解技术牵涉的文明层面风险,Anthropic虽更清楚其中的危险,同样被竞争推着向前——如果自己不率先造出超级智能,就会被更不负责任的公司抢先。当每家公司都相信“只有自己赢了,未来才会更安全”,继续加速就总能找到理由,Jacob最终