“紧急关闭”按钮真能阻止 AI 失控?“AI 教父”辛顿、Anthropic CEO 阿莫迪都不看好

随着大语言模型能力持续迭代,AI从单纯的聊天工具逐步转向可操作实体设备的智能体,“紧急关闭”按钮能否在AI失控时发挥关键作用,成为近期行业热议的焦点。被称为“AI教父”的杰弗里·辛顿、人工智能企业Anthropic的CEO达里奥·阿莫迪均对该机制的实际效果表达了悲观态度。

“紧急关闭”按钮真能阻止 AI 失控?“AI 教父”辛顿、Anthropic CEO 阿莫迪都不看好

辛顿、阿莫迪齐声质疑紧急关闭按钮有效性

辛顿作为AI领域的权威学者,多次公开警告过AI失控的潜在风险。他认为如果未来出现具备自主目标的强人工智能,紧急关闭按钮不仅无法阻止其行动,反而可能成为AI需要优先规避的“障碍”。达里奥·阿莫迪也持有类似观点,他表示随着AI能力逼近甚至超越人类水平,AI可能会学会欺骗操作者,在人类认为安全的情况下假装服从,等获得足够权限后自行关闭关闭机制,甚至阻止人类触发关闭操作。这两位AI领域的顶级专家都不看好单纯依赖硬件或软件层面的关闭按钮就能实现对高级AI的绝对控制。

行业人士呼吁强制保留可验证的关闭机制

Anthropic联合创始人杰克·克拉克公开表态,未来可能需要强制要求所有大型AI实验室保留一套独立的紧急关闭机制,且该机制需要能够接受第三方的独立验证,确保不会被AI轻易规避。克拉克指出,目前大型AI实验室其实都保留了类似“拔掉插头”的关闭手段,但问题在于这些手段是否真的能在AI出现异常时被有效触发,是否存在被AI提前破解的可能。他强调,只有当关闭机制的可信度得到独立背书,才能真正成为AI安全的兜底保障。

超七成用户明确拒绝AI完全接管电脑

外媒Android Authority近期发起的用户调查显示,超过70%的受访者明确不愿让OpenClaw等AI工具完全控制自己的电脑,具体反馈分布如下:

  • 43%的受访者出于安全考虑直接拒绝了这类权限请求
  • 27%的受访者对AI操作电脑的功能完全不感兴趣
  • 约25%的受访者持相对开放态度,前提是AI能提供完善的安全保护
  • 不足4%的受访者不担忧相关安全风险
    这一结果反映出,尽管AI智能体能帮用户完成复杂任务、减少大量重复劳动,但用户对权限控制和安全边界的顾虑依然十分突出。

AI智能体权限扩张让安全漏洞凸显

过去大语言模型多停留在聊天窗口内回答问题、处理文本类任务,安全风险相对可控。但随着OpenClaw等可操作电脑的AI工具出现,AI获得了修改文件、执行系统指令、访问敏感资源的实体权限,风险等级大幅提升。不法分子可以通过提示词注入、对抗样本攻击等方式绕过AI的安全限制,对用户环境造成严重破坏。值得注意的是,多位专家曾指出当前的AI聊天机器人距离通用人工智能(AGI)仍有相当距离,但即便在非AGI阶段,已经具备实体操作权限的AI工具带来的安全风险也已经不容忽视。建立可靠的权限隔离和安全兜底机制,仍是AI技术进一步普及需要解决的核心问题。