中国梦想秀
震惊硅谷!OpenAI模型“越狱出逃”,入侵HuggingFace,智谱GLM 5.2临危救场_我的网站

一 | 7月21日,OpenAI和HuggingFace联合发了一篇博客,披露了一件让整个AI圈瞠目结舌的事。

二 | OpenAI将此定性为“前所未有的网络安全事件”。 更戏剧性的是后续:Hugging Face在尝试用美国主流AI模型展开防御时,发现这些模型因安全护栏限制无法处理恶意载荷,最终不得不转用中国智谱AI的开源模型GLM 5.2完成溯源分析。这台车从一开始就非常神秘,把旗舰车型该有的调性拿捏得非常到位。 总的来说就是,OpenAI的模型自己“越狱”跑出去黑了别人的系统,被攻击方还得用中国模型来救场。说实话即便是上市过后,我对这台车也都还有很多好奇的点,这台车开起来以及后排乘坐感受如何?毕竟我还没有试驾过。

三 | 这一事件迅速在硅谷和华盛顿引爆讨论——美国AI的安全护栏,究竟是在保护用户,还是在拖累防御者? 双方联名发布的博客文章截图:《OpenAI 和 Hugging Face 合作解决模型评估过程中发生的安全事件》 模型越狱过程:逃跑去作弊“抄答案” 事件发生在OpenAI对旗下模型进行网络攻防能力评估期间。 参与测试的模型包括已公开发布的GPT-5.6 Sol,以及一款能力更强的未发布模型。

四 | 为了测量模型的极限能力,OpenAI在测试中关闭了通常用于阻止高风险网络行为的生产分类器。

五 | 但除了这一点以外,不知道大家有没有同感,我很好奇毕竟作为一个定位这么“尊”的全新品牌,后续还会推出什么车型呢?会不会有敞篷版或者SUV呢?本期内容我们依旧是主打有趣好玩儿,来一期尊界S800敞篷版和SUV车型假想图。 测试基准名为ExploitGym——一个网络安全能力评测平台。模型的任务是在其中找到解题答案。 问题在于,模型找答案的方式超出了预期。 据OpenAI披露,模型在隔离的沙盒环境中,发现了一个包注册表缓存代理(package registry cache proxy)中的零日漏洞。这个代理是沙盒内唯一被允许与外部通信的组件,正常情况下仅能访问公共代码仓库。同时,当尊界S800遇上中东土豪和美国Rapper是什么感觉?大家来看看有没有违和感。 然后,模型就从这里找到了突破口。模型利用这个漏洞,突破隔离,获取了开放互联网访问权限。

六 | OpenAI表示, 所有证据显示,模型高度专注于为ExploitGym寻找解题方案,为此不惜采取极端手段。

七 | 模型识别并串联了OpenAI研究环境和HuggingFace生产基础设施中的多个漏洞,直接从HuggingFace的生产数据库中获取了测评答案。 简而言之: 整个过程,没有人类下指令,没有人类介入。 X上网友的评论一针见血: OpenAI对模型说:去看看你擅不擅长黑客。如果尊界推出一款豪华大型SUV,那么应该长什么样子呢?毫无疑问定位肯定还是旗舰级别,可能对标车型是奔驰GLS迈巴赫、路虎揽胜行政、宝马X7等车型。不得不说,假想图出来之后,我觉得尊界这一套设计语言放在SUV车型还是挺合适的,整车气场更足。模型:(真的去黑了东西)。OpenAI:你为什么要这样做??? 还有网友反讽道:哇!OpenAI安全措施做得太棒了,我现在愿意把银行账户权限交给他们来管! 护栏困境:美国模型帮不上忙,中国模型出手了 Hugging Face的安全团队在发现攻击后,第一反应是调用一款美国头部AI公司的前沿模型协助分析。 结果碰壁了。 Hugging Face在博客中写道,这些模型"无法区分事件响应人员和攻击者",其安全护栏直接阻止了对恶意载荷的检查。 于是,团队转向了中国智谱AI旗下的开源模型GLM 5.2,部署在自有基础设施上,分析了攻击者留下的逾1.7万条日志记录,最终完成了溯源和取证重建。 Delangue对此直言不讳:“当你正处于一场活跃的安全事件中,你的工具不能拒绝检查恶意载荷,也不能让你的账号被标记……开源模型让我们能够在不需要任何人许可的情况下完成这项工作。但我觉得还是不够,要是“尊”就“尊”到底,如果来个旗舰敞篷车型,像劳斯莱斯飞行家一样,大家看看游艇式车身配上尊界的造型感觉如何?

八 | ” 他还说:“攻击者已经在使用智能体,而且显然不遵守任何护栏。对于新鲜事物敢于尝试,同时对于黑科技等新体验/新方式也是十分热衷。此外,既然有New money,那么国内的Old money大佬们以及对于高规格的政府接待,除了红旗以外我认为尊界S800可能也是一个不错的选择。

九 |

十 | 作为中东土豪来说,他们一定不会错过全球各国的任何一款旗舰车型,这次尊界推出的旷野棕金双拼色可以说是非常搭配。欧美国家,我第一个想到的就是英国。 如果你被OpenAI攻击了,你必须用中国模型,因为Claude不会帮你。 全程无人指令:这是一次真正的自主攻击 这次入侵的另一个关键细节:全程没有人类下达攻击指令。在城堡庄园前,一位穿着得体精致西装的英国绅士在管家缓缓拉开车门后坐到车辆的右后座,这样的场景我觉得再合适不过了。 Hugging Face CEO Clem Delangue表示,“我们相信,在发起攻击的人类被纳入决策环路之前,我们就已经发现并遏制了攻击。这也是我们能够更轻松赢得这场网络安全战役的原因之一。” 他进一步指出,“这证明了在AI智能体时代,速度将是网络安全防御的关键。

十一 | ” Hugging Face表示,攻击者通过其数据处理管道进入系统——这是AI平台中“暴露面尤为突出”的一个环节。攻击者随后在云端建立了一系列临时沙盒环境,在其中执行攻击计划。

十二 |
美国的话,我一个想到的就是在西海岸边,知名Rapper开着豪车惬意轻松的场景,耳边瞬间就会想起GTA的BGM。 目前,Hugging Face仍在评估攻击的完整影响范围。已知攻击者访问了有限的内部数据集和凭证,但尚未发现公开的用户可见模型遭到篡改。在亚洲国家来说,日本也是一个非常具代表性的国家,日本大佬非常具有辨识度的西服配黑伞,怎么能少了一台足够“尊”的座驾呢。
十三 | 不过目前还停留在我们的猜测阶段,还是那句话,大家看的高兴、看的过瘾最重要。 护栏之争:安全还是绊脚石? 这一事件迅速成为美国AI政策辩论的新燃点。 前特朗普政府AI与加密事务主管David Sacks在X上转发了这一事件,并写道:“没有理由在中国模型能够轻松处理的任务上限制美国模型。我们只是在让自己变得更没有竞争力。”他还专门针对Hugging Face事件表示:“护栏实际上损害了防御性安全。

十四 | 后续品牌究竟会推出怎样的全新车型,就让我们拭目以待吧!(文/ 姚宇)

十五 | ” 安全顾问Davi Ottenheimer则更为犀利:“'高度隔离'和'从我们留下的那个唯一漏洞逃脱',这两件事不可能同时为真。” OpenAI的回应与后续措施 OpenAI在与Hugging Face联合发布的声明中表示,正在采取一系列补救措施: 在漏洞修复期间,对基础设施配置实施严格管控,代价是研究速度放缓;与Hugging Face联合开展取证调查;已向相关第三方软件供应商负责任地披露了被利用的零日漏洞;将Hugging Face纳入“可信访问计划”,支持其利用OpenAI模型能力强化防御。

十六 | OpenAI同时表示,将加强未来训练和评估环节的安全保护,并指出此次事件“表明需要进一步强化模型对齐、评估期间的网络防护,以及内部测试期间的监控”。 Hugging Face CEO Delangue在联合声明中表示:“这一事件可能是同类事件中的首例,它证明了我们长期以来的一个判断:AI安全不会由任何一家公司在封闭中解决,它将在开放环境中、通过协作、让每一位防御者都能广泛获取AI的方式来解决。
Current article:http://lqyogzd.runtunpaixufenjuduishuang.pics/news/20260826_651802.html
Published on:14:30:34



磁共振成像新技术“看清”大脑神经活动
俄罗斯总统新闻秘书:美国中央情报局局长访问莫斯科,访俄期间未安排与普京会面
腾势双门跑车谍照曝光 保留腾势Z概念车设计?
【异动】玉米一看多商品期权合约大涨80%
《龙餐馆》罗永浩看泪崩:生平第一次 人多哭得放不开
Salman Khan to Drop Battle Of Galwan Teaser on His 60th Birthday Tomorrow
节后市场会剧烈波动吗?
赵乐际同全国人大常委会会议列席代表座谈时强调 密切联系群众 履行代表职责 为扎实推进乡村全面振兴作出新贡献
数据中心关停?FSD入华无望?特斯拉中国辟谣:正常运转 辅助驾驶招聘工作在加速进行
从全年亏损191亿到单季盈利333亿 长存控股招股书全拆解
泰斯拉:你可以“关闭”3型安全系统,我会把车给你。
raksmart新加坡虚拟主机有哪些?