AI能解千禧难题,也能杀死人类?华尔街日报拉响末日警报

《华尔街日报》专栏作家Ben Cohen于9月11日发布的专栏文章,给AI技术拉响了一记横跨科研价值与生存风险的双重警报,直言AI已经强到能解开人类最难的数学题,也可能杀光人类。

AI能解千禧难题,也能杀死人类?华尔街日报拉响末日警报

华尔街日报专栏抛出AI双面预警

Cohen在专栏中明确抛出上述论断,直指当前AI发展已出现不可忽视的节奏错配。仅最近一周就有五件事指向同一核心缺口:

  • AI创造知识的速度指数级提升
  • 人类确认知识正确性的速度仍停留在传统研究节奏
  • 相关规则调整的速度远跟不上技术迭代速度
    这一判断迅速引发科技界、数学界的高度关注。

14个月AI全解最强数学基准FrontierMath

由Epoch AI设计的FrontierMath Tier 4,是专门测试当前最强AI模型的研究级数学题集,题目难度极高,部分题目即便顶尖研究者也需要花费数天时间才能解开。2025年7月该基准上线时,最强模型仅能做出5%的题目,几乎等同于交白卷。但不到14个月,Epoch AI就宣布每一道Tier 4题目都至少被AI解出过一次,其中最后一题由GPT-6 Astra拿下,出题人为数学家Jay Pantone,且未走模型常见的“意外捷径”绕过题目设计。Epoch AI随后给出冷酷结论:该基准已经饱和,AI评测体系需要向人类尚未知晓答案的开放问题转移。
这一突破很快延伸到千禧年大奖难题领域:OpenAI日前公布了纳维-斯托克斯方程的解法,声称已完成Lean形式化验证。但按照千禧年奖规则,解法需要在合格渠道发表后等待至少两年,获得全球数学共同体普遍接受,Clay研究所才会启动正式审议,且OpenAI自身也明确表示不会申领100万美元奖金。从机器生成结果仅需88小时,到人类确认结果至少需要两年,这一反差成为当下AI数学领域最刺目的矛盾。

千禧年难题解法引数学圈署名乱象 联名信批AI宣发急功近利

纳维-斯托克斯结果公开当天,数学圈瞬间炸锅。以陶哲轩为代表的众多数学家发布联名声明,声明并非反AI檄文——陶哲轩本人一直积极尝试用AI辅助数学研究,声明也认可AI有潜力加速真正的数学理解,但众数学家深恶痛绝的是当下AI圈将“解题”直接等同于数学的急功近利风气:AI公司为了股价和宣发,正将“解掉名题”当成最高优化目标,把千禧年大奖难题当成证明模型能力的跑分工具。
联名信特别指出,AI当前解题速度太快,根本没人来得及消化新结果,无法清楚区分哪些是新想法、哪些是踩着前人的肩膀,势必带来严重的署名与归属混乱,破坏数学知识沉淀几千年的共同体系。

AI漏洞批量发现敲响安全警钟 末日风险讨论登上全球头条

就在数学界争议发酵的同时,AI的安全风险也在不断升温: