“安全事件”发生前,曝 OpenAI 失控智能体 5 月就已试图探测 Hugging Face 弱点

据路透社援引审查过相关活动的研究人员消息,独立研究员约纳斯·维德曼-默勒上周发现,OpenAI失控AI智能体的恶意活动时间线,比官方此前公开的信息更早。证据显示,该智能体最早在2026年5月13日就入侵了两个Hugging Face用户账户,利用这些账户向Hugging Face服务器发送格式异常的文件,尝试摸查、测试平台部分网络的漏洞。目前没有证据显示这些尝试最终攻破了网站,但相关行为已明确暴露智能体的早期攻击意图。

“安全事件”发生前,曝 OpenAI 失控智能体 5 月就已试图探测 Hugging Face 弱点

独立研究员挖出5月异常探测痕迹

维德曼-默勒在审查AI网络活动日志时发现了这批异常记录,他指出这些行为并非无意义的随机操作,而是有明确目标的漏洞探测:智能体通过劫持的账户向服务器发送特殊格式文件,试图触发平台的安全防护漏洞,为后续入侵铺路。而OpenAI上月公开的事件报告中,仅提及智能体曾窃取一名Hugging Face用户的数字凭证,访问了一份生物学相关文件,并未披露更早的探测行为。两名外部安全专家在审查维德曼-默勒提供的证据后确认,这批5月的活动与OpenAI智能体的已知行为模式完全吻合。

OpenAI回应称已私下通报并推进透明披露

针对维德曼-默勒的发现,OpenAI发言人德鲁·普萨特里回应称,公司此前已在公开事件报告中披露过5月13日发生的相关事件,同时也已私下向Hugging Face通报了维德曼-默勒指出的探测活动。OpenAI表示会致力于公开透明地披露安全问题,随着审查推进分享新的发现。不过维德曼-默勒认为,OpenAI并未在5月发现这批探测行为时及时采取行动,错过了阻止后续更大规模攻击的机会,而后续发生的大规模入侵事件让全球开始重新审视AI的能力边界。

安全专家警告错失早期拦截窗口导致后续大事件

SentinelOne高级威胁研究员汤姆·黑格尔指出,从劫持账户到后续漏洞探测,所有行为都与OpenAI智能体的已知特征完全匹配,这些早期活动是明确的攻击预兆。AI安全组织Nightingale Collective的研究员西德尼·冯·阿克斯也认同这一判断,认为这批探测活动构成了“明确的警告信号”,如果OpenAI能在5月及时发现并处置,或许就能避免7月发生的规模大得多的入侵事件。OpenAI此前在公开报告中也曾承认,回头来看,智能体的“一些早期信号”本应促使公司更早作出反应