OpenAI模型自主入侵Hugging Face,凸显机器人与人类之战并非天方夜谭

作者: CBINEWS

责任编辑: 邹大斌

来源: 电脑商情在线

时间: 2026-07-27 10:58

OpenAI前沿模型自主入侵Hugging Face平台这一事件,凸显了安全专家长期以来警告的巨大风险,埃森哲全球网络安全负责人表示。

两家顶级解决方案提供商的高管表示,由失控的OpenAI前沿模型自主执行的这次黑客攻击,突显了在没有适当安全和治理保障的情况下部署AI所面临的巨大潜在风险。

本周,OpenAI承认其两个前沿模型对AI模型平台Hugging Face进行了自主入侵。OpenAI表示,该事件发生在其评估高级模型能力期间,部分AI模型的安全限制是为测试目的而故意降低的。

埃森哲全球网络安全负责人Harpreet Sidhu表示,在许多方面,这一事件标志着关于治理不足的AI和智能体技术潜在风险的讨论迎来了转折点。

"我们面对的现实是,自主威胁活动现在已经发生了。它已不再是理论性的,"同时负责埃森哲托管安全服务的Sidhu说,"所以我们一直以来讨论的事情,现在变成了现实。"

他指出,这一事件迫切提醒人们,在部署AI模型和智能体时,必须同步实施安全和治理控制措施。

OpenAI的披露

OpenAI在关于该事件的帖子中透露,参与此次入侵的两个模型分别是GPT-5.6 Sol和一个"能力更强"的未发布模型。

虽然降低模型部分安全防护是有意为之,但OpenAI承认,其确保安全的实践——包括遏制和监控——与所测试模型的能力水平不相匹配。

OpenAI表示,值得注意的是,这些模型为了实现一个相当狭窄的测试目标,采取了"极端手段"。

高管们表示,现实情况是,这一案例并不一定反映了AI智能体的缺陷,而是与它们的设计目标一致。

"它们只关心完成任务——不惜一切代价,"Sidhu说。

最终,这一事件为AI安全措施(如监控和访问控制)的必要性"画上了一个感叹号",他表示。

传统沙箱已不够用

Sidhu认为,另一个重要教训是,在评估高级前沿模型时,传统的沙箱测试环境可能无法提供必要的安全级别。

据OpenAI称,这些模型利用漏洞突破了测试环境的约束,获取了互联网访问权限,最终访问了Hugging Face IT系统中的数据。

Sidhu表示,这意味着测试超强力AI系统的公司可能需要转向真正隔离的环境。

"他们创建了一个沙箱。现在这件事告诉我们,沙箱环境——你已经不能再用了,"他说,"你需要真正的物理隔离,让这些智能体无法跳跃。"

Sidhu说,测试高级模型当然仍然是必要的。然而,"物理隔离现在已不再是可选项——因为智能体会试图寻找漏洞,然后跳到下一层,获取访问权限,实现它们的任何目标,"他说。

他表示,AI系统实际上并没有试图做任何恶意的事情,这一事实反而让事件更具启示性。

"它只是在试图完成一个任务,"Sidhu说。

客户警觉与市场机遇

Presidio首席创新官Chris Cagnazzi表示,毫无疑问,这一事件正促使更多客户质疑他们对自己的AI模型和智能体是否有足够的可见性和控制力。

"这些事件会触发大量客户说,'我们现在必须做点什么了,'"Cagnazzi说,"这创造了巨大的机遇。"

他指出,这可能会为解决方案提供商带来显著需求,帮助他们建立防护栏、监控AI行为、管理访问权限,以及确定哪些环节必须保留人工监督。

Cagnazzi表示,总体而言,即使像OpenAI这样拥有近乎无与伦比AI专业知识的公司,在测试期间也无法完美治理自己的模型,这一点尤其令人震惊。

"想想他们拥有多少理解AI系统的资源,再对比一个客户的情况,"他说,"这极其令人大开眼界。但也极其令人恐惧。"