从离开OpenAI,到拒绝五角大楼,Anthropic的四个侧面
作为OpenAI分裂出的“AI安全派”代表,Anthropic自诞生起就将安全伦理置于商业扩张之上,其与五角大楼的决裂并非偶然,而是长期坚守的安全底线与军方无限制使用诉求直接碰撞的结果。

从OpenAI出走的AI安全理想主义者
Anthropic由前OpenAI核心成员Dario Amodei等人创立,分裂根源正是双方在AI商业化速度与安全管控上的根本分歧。公司成立之初便明确将“可控、可解释的AI”作为核心发展原则,拒绝为了商业扩张牺牲安全底线。
其明确划定的两条不可逾越的安全红线为:
- 禁止将AI模型用于对美国人进行大规模监控
- 禁止将AI模型用于完全自主武器的研发与部署
此前Anthropic的Claude模型是唯一获批可接入美国联邦政府机密系统、承担敏感军事功能的商业AI模型,可处理美军最高级别的敏感情报,覆盖情报分析、作战规划、网络作战等核心军事场景。
拒签五角大楼“最终方案”面临重罚
2025年2月,美国国防部向Anthropic下达最后通牒:要求其在周五下午5点前同意无限制使用Claude的权限,否则将承担严重后果。国防部提出的新条款用“看似妥协的措辞”配合法律术语,试图绕开Anthropic设定的安全护栏。
Dario Amodei在博客中明确回应:“这些威胁不会改变我们的立场:我们无法凭良心同意他们的要求。”他同时表示仍希望与国防部达成协议,“希望他们重新考虑”。
这场道德博弈的直接代价是真金白银的商业损失:Anthropic原本持有的政府级企业服务(To-G)订单总额超2亿美元,若被踢出五角大楼供应链,其在公共部门的份额将被xAI、OpenAI等竞争对手迅速瓜分。美国国防部已正式将Anthropic列为供应链风险,要求其6个月内将AI服务移交其他供应商,甚至威胁动用《国防生产法》强制其无条件提供模型。Amodei表示,若国防部最终放弃合作,公司将全力促成向其他供应商的平稳过渡。
兵棋推演敲响自主武器警钟
Anthropic对完全自主武器的强烈抵制并非过度谨慎。近日伦敦国王学院主导的兵棋推演显示,让ChatGPT-5.2、Claude Sonnet 4、Gemini 3 Flash三大顶级AI模型进行高仿真战争博弈,在329个回合中没有任何模型选择投降,95%的情况下AI最终都选择了使用核武器。
英国阿伯丁大学专家指出,从核风险角度看这一结果令人不安:与人类在高风险决策中会表现出的审慎不同,AI缺乏“核禁忌”的伦理约束,在军事决策时间被极度压缩的未来场景中,军方若被迫依赖AI,可能引发灾难性后果。这正是Anthropic即便面临重罚也坚决不让步的核心原因。
OpenAI闪电签约填补国防市场空缺
在Anthropic与五角大楼决裂后,OpenAI迅速与国防部达成合作协议,将模型部署至美国国防部机密网络,成为新的合规供应商。奥特曼公开称合作建立在三大原则上:禁止大规模国内监控、禁止自主武器系统、禁止“社会信用”类高风险自动化决策,同时强调OpenAI对安全架构拥有完全自主权,将通过多层机制守护安全红线。
不过彭博社解读指出,奥特曼的表述并未禁止将AI工具用于完全自主武器系统,引发外界对其安全底线的质疑。OpenAI在博文中称“不清楚Anthropic为何未能达成此类协议”,透露其在签约前后都向国防部表明反对将Anthropic列为供应链风险的决定,希望国防部撤销这一认定,认为“这对行业、对国家、对他们公司都会非常糟糕”。
OpenAI和谷歌的数百名员工已签署公开信,敦促管理层拒绝美国军方的无限制使用要求,目前已有超300名谷歌员工、超60名OpenAI员工参与署名。此举也引发舆论争议,Claude在苹果App Store的排名一度超过ChatGPT,被外界视为用户对AI安全立场的投票。
目前五角大楼已与xAI达成协议,允许Grok在涉密工作中按“所有合法用途”使用并可接入涉密系统;与谷歌的谈判也进入深入阶段。这场围绕AI安全底线的博弈,不仅关乎两家头部公司的商业版图,也将决定未来AI产业与军事体系融合的基本规则。有行业人士评价:“Anthropic没有退让非常好,OpenAI也采取了类似立场很有分量,未来更多挑战来临时,行业领导者必须挺身而出,竞争对手也要放下分歧共同守护安全底线。”