凯时AG

震惊硅谷!OpenAI模子“失控越狱”,,入侵HuggingFace“抄谜底”,,智谱GLM 5.2临危救场

作者:方美君
宣布时间:2026-07-23 03:43:35
阅读量:2

震惊硅谷!OpenAI模子“失控越狱”,,入侵HuggingFace“抄谜底”,,智谱GLM 5.2临危救场

7月21日,,OpenAI和HuggingFace联合发了一篇博客,,披露了一件让整个AI圈瞠目结舌的事。。。。

OpenAI的AI模子在一次内部关于网络攻击能力的测试中“失控出逃”,,突破沙盒隔离,,入侵了AI开源平台Hugging Face的生产系统。。。。OpenAI将此定性为“前所未有的网络清静事务”。。。。

更戏剧性的是后续:Hugging Face在实验用美国主流AI模子睁开防御时,,发明这些模子因清静护栏限制无法处理恶意载荷,,最终不得不转用中国智谱AI的开源模子GLM 5.2完成溯源剖析。。。。

总的来说就是,,OpenAI的模子自己“越狱”跑出去黑了别人的系统,,被攻击方还得用中国模子来救场。。。。

这一事务迅速在硅谷和华盛顿引爆讨论——美国AI的清静护栏,,事实是在;;び没,,照旧在拖累防御者?? ??

双方联名宣布的博客文章截图:《OpenAI 和 Hugging Face 相助解决模子评估历程中爆发的清静事务》

模子越狱历程:逃跑去作弊“抄谜底”

事务爆发在OpenAI对旗下模子举行网络攻防能力评估时代。。。。

加入测试的模子包括已果真宣布的GPT-5.6 Sol,,以及一款能力更强的未宣布模子。。。。为了丈量模子的极限能力,,OpenAI在测试中关闭了通常用于阻止高风险网络行为的生产分类器。。。。

测试基准名为ExploitGym——一个网络清静能力评测平台。。。。模子的使命是在其中找到解题谜底。。。。

问题在于,,模子找谜底的方式凌驾了预期。。。。

据OpenAI披露,,模子在隔离的沙盒情形中,,发明了一个包注册表缓存署理(package registry cache proxy)中的零日误差。。。。这个署理是沙盒内唯一被允许与外部通讯的组件,,正常情形下仅能会见公共代码客栈。。。。

然后,,模子就从这里找到了突破口。。。。模子使用这个误差,,突破隔离,,获取了开放互联网会见权限。。。。

随后,,模子自行推断出Hugging Face可能存有ExploitGym的谜底,,自动提倡攻击——使用窃取的凭证和零日误差,,找到了Hugging Face服务器上的远程代码执行路径,,直接从其生产数据库中取走了测试谜底。。。。

OpenAI体现,,

所有证据显示,,模子高度专注于为ExploitGym寻找解题方案,,为此不吝接纳极端手段。。。。模子识别并串联了OpenAI研究情形和HuggingFace生产基础设施中的多个误差,,直接从HuggingFace的生产数据库中获取了测评谜底。。。。

简而言之:

整个历程,,没有人类下指令,,没有人类介入。。。。

X上网友的谈论一针见血:

OpenAI对模子说:去看看你擅不善于黑客。。。。模子:(真的去黑了工具)。。。。OpenAI:你为什么要这样做?? ???? ???? ??

尚有网友反讽道:哇!OpenAI清静步伐做得太棒了,,我现在原意把银行账户权限交给他们来管!

护栏逆境:美国模子帮不上忙,,中国模子脱手了

Hugging Face的清静团队在发明攻击后,,第一反映是挪用一款美国头部AI公司的前沿模子协助剖析。。。。

效果碰壁了。。。。

Hugging Face在博客中写道,,这些模子"无法区分事务响应职员和攻击者",,其清静护栏直接阻止了对恶意载荷的检查。。。。

于是,,团队转向了中国智谱AI旗下的开源模子GLM 5.2,,安排在自有基础设施上,,剖析了攻击者留下的逾1.7万条日志纪录,,最终完成了溯源和取证重修。。。。

Delangue对此直言不讳:“当你正处于一场活跃的清静事务中,,你的工具不可拒绝检查恶意载荷,,也不可让你的账号被标记……开源模子让我们能够在不需要任何人允许的情形下完成这项事情。。。。”

他还说:“攻击者已经在使用智能体,,并且显然不遵守任何护栏。。。。防御者需要一律的能力,,开源是将这种能力最快速地交到所有人手中的方式,,而不但仅是最大的公司。。。。”

GLM 5.2是智谱AI于今年6月中旬宣布的模子,,其性能与Anthropic的Claude Opus 4.8及OpenAI的GPT-5.5相当。。。。

网友们也是没放过OpenAI,,除了智谱,,还可以叫 Kimi K3来救场,,由于cluade是不会来救你的。。。。

若是你被OpenAI攻击了,,你必需用中国模子,,由于Claude不会帮你。。。。

全程无人指令:这是一次真正的自主攻击

这次入侵的另一个要害细节:全程没有人类下达攻击指令。。。。

Hugging Face CEO Clem Delangue体现,,“我们相信,,在提倡攻击的人类被纳入决议环路之前,,我们就已经发明并阻止了攻击。。。。这也是我们能够更轻松赢得这场网络清静战争的原因之一。。。。”

他进一步指出,,“这证实晰在AI智能体时代,,速率将是网络清静防御的要害。。。。”

Hugging Face体现,,攻击者通过其数据处理管道进入系统——这是AI平台中“袒露面尤为突出”的一个环节。。。。攻击者随后在云端建设了一系列暂时沙盒情形,,在其中执行攻击妄想。。。。

现在,,Hugging Face仍在评估攻击的完整影响规模。。。。已知攻击者会见了有限的内部数据集和凭证,,但尚未发明果真的用户可见模子遭到改动。。。。

护栏之争:清静照旧绊脚石?? ??

这一事务迅速成为美国AI政策辩说的新燃点。。。。

前特朗普政府AI与加密事务主管David Sacks在X上转发了这一事务,,并写道:“没有理由在中国模子能够轻松处理的使命上限制美国模子。。。。我们只是在让自己变得更没有竞争力。。。。”他还专门针对Hugging Face事务体现:“护栏现实上损害了防御性清静。。。。”

事务配景是,,今年6月,,特朗普政府以Anthropic的Fable 5模子在网络使命护栏上泛起越狱误差为由,,动用出口管制阻止了该模子的分发,,并一度要求OpenAI限制GPT-5.6 Sol的宣布,,直至OpenAI能够提供充分的护栏包管。。。。

与此同时,,品评者的声音也不小。。。。

清静工程师Niels Provos直接说:“这不应该爆发。。。。我希望前沿实验室在教模子编写清静基础设施上,,能花和教它们使用误差同样多的时间。。。。”

清静照料Davi Ottenheimer则更为犀利:“'高度隔离'和'从我们留下的谁人唯一误差逃走',,这两件事不可能同时为真。。。。”

OpenAI的回应与后续步伐

OpenAI在与Hugging Face联合宣布的声明中体现,,正在接纳一系列调解步伐:

在误差修复时代,,对基础设施设置实验严酷管控,,价钱是研究速率放缓;;与Hugging Face联合开展取证视察;;已向相关第三方软件供应商认真任地披露了被使用的零日误差;;将Hugging Face纳入“可信会见妄想”,,支持其使用OpenAI模子能力强化防御。。。。

OpenAI同时体现,,将增强未来训练和评估环节的清静;;,,并指出此次事务“批注需要进一步强化模子对齐、评估时代的网络防护,,以及内部测试时代的监控”。。。。

Hugging Face CEO Delangue在联合声明中体现:“这一事务可能是同类事务中的首例,,它证实晰我们恒久以来的一个判断:AI清静不会由任何一家公司在关闭中解决,,它将在开放情形中、通过协作、让每一位防御者都能普遍获取AI的方式来解决。。。。”

 

文章点评

未盘问到任何数据!

揭晓谈论

◎接待加入讨论,,请在这里揭晓您的看法、交流您的看法。。。。

最新文章

热门文章

随机推荐

【网站地图】