钱塘老娘舅
震惊硅谷!OpenAI模型“越狱出逃”,入侵HuggingFace,智谱GLM 5.2临危救场_我的网站

A | 7月21日,OpenAI和HuggingFace联合发了一篇博客,披露了一件让整个AI圈瞠目结舌的事。 8月18日,游客在福州市马尾区船政文化景区参观。
OpenAI的AI模型在一次内部关于网络攻击能力的测试中“失控出逃”,突破沙盒隔离,入侵了AI开源平台Hugging Face的生产系统。OpenAI将此定性为“前所未有的网络安全事件”。新华社记者 杜潇逸 摄
近年来,国内工业遗产活化利用进程持续提速,工业旅游凭借独特的产业价值、文化价值,成为文旅产业转型升级的重要增长极。
更戏剧性的是后续:Hugging Face在尝试用美国主流AI模型展开防御时,发现这些模型因安全护栏限制无法处理恶意载荷,最终不得不转用中国智谱AI的开源模型GLM 5.2完成溯源分析。数据显示,我国工业旅游市场年均增速约18%,规模有望在2029年前突破3000亿元。 今年,文化和旅游部等七部门联合印发《关于弘扬工业文化 保护工业遗产 发展工业旅游的通知》,明确提出积极发展工业遗产游,活化利用工业遗址,发展工业旅游新场景新业态新模式。

B |
总的来说就是,OpenAI的模型自己“越狱”跑出去黑了别人的系统,被攻击方还得用中国模型来救场。
这一事件迅速在硅谷和华盛顿引爆讨论——美国AI的安全护栏,究竟是在保护用户,还是在拖累防御者?
双方联名发布的博客文章截图:《OpenAI 和 Hugging Face 合作解决模型评估过程中发生的安全事件》
模型越狱过程:逃跑去作弊“抄答案”
事件发生在OpenAI对旗下模型进行网络攻防能力评估期间。
参与测试的模型包括已公开发布的GPT-5.6 Sol,以及一款能力更强的未发布模型。 工业旅游的魅力,在于让沉睡的工业遗产“活”过来。为了测量模型的极限能力,OpenAI在测试中关闭了通常用于阻止高风险网络行为的生产分类器。
测试基准名为ExploitGym——一个网络安全能力评测平台。

C | 那些承载着城市工业记忆的老旧厂房、废弃矿区、锈蚀设备,曾是城市更新中“鸡肋”般的存在。

D | 模型的任务是在其中找到解题答案。

E | 如今,通过科学改造、创意赋能、场景重塑,它们摇身一变成为鲜活的“城市秀场”。
问题在于,模型找答案的方式超出了预期。

F |
据OpenAI披露,模型在隔离的沙盒环境中,发现了一个包注册表缓存代理(package registry cache proxy)中的零日漏洞。

G | 北京首钢园的高炉里,游客戴着VR设备在百年工业建筑中体验“星际穿越”;长春长拖1958文创园的沉浸式体验预约火爆;河南焦作的百年矿井旧址让厚重的工业历史可游可学。

H | 冰冷的钢铁遗存被注入文化温度,既保留了历史厚度,又攒足了文旅热度。

I | 这个代理是沙盒内唯一被允许与外部通信的组件,正常情况下仅能访问公共代码仓库。值得称赞的是,各地并未陷入“千厂一面”的误区:重庆涪陵依托816地下核工程打造实景演出《洞见816》,大渡口区联动航空资源打造飞行主题综合体,吉林辽源用全息投影还原煤炭开采历程。
然后,模型就从这里找到了突破口。模型利用这个漏洞,突破隔离,获取了开放互联网访问权限。
随后,模型自行推断出Hugging Face可能存有ExploitGym的答案,主动发起攻击——利用窃取的凭证和零日漏洞,找到了Hugging Face服务器上的远程代码执行路径,直接从其生产数据库中取走了测试答案。
OpenAI表示,
所有证据显示,模型高度专注于为ExploitGym寻找解题方案,为此不惜采取极端手段。因地制宜的特色化改造,让工业遗产真正成为城市文旅的新地标,而非简单的“旧物陈列馆”。 如果说工业遗产活化是在“存量”上作文章,那么生产车间的开放展示,则是在“增量”上开新局。
模型识别并串联了OpenAI研究环境和HuggingFace生产基础设施中的多个漏洞,直接从HuggingFace的生产数据库中获取了测评答案。
简而言之:
整个过程,没有人类下指令,没有人类介入。
X上网友的评论一针见血:
OpenAI对模型说:去看看你擅不擅长黑客。模型:(真的去黑了东西)。

J | OpenAI:你为什么要这样做???
还有网友反讽道:哇!OpenAI安全措施做得太棒了,我现在愿意把银行账户权限交给他们来管!
护栏困境:美国模型帮不上忙,中国模型出手了
Hugging Face的安全团队在发现攻击后,第一反应是调用一款美国头部AI公司的前沿模型协助分析。
结果碰壁了。随着消费升级与产业融合深化,越来越多企业主动打开厂门、开放车间,将生产流程、制造工艺、产业文化转化为特色旅游产品。广西柳州螺霸王产业园的全透明空中参观通道,让游客全景目睹螺蛳粉从熬制到封装的每一道工序,还能亲手DIY定制专属产品;重庆周君记火锅食品工业旅游体验园,融合透明工厂、火锅文化展示与DIY炒制体验,年接待游客最高达40万人次。
Hugging Face在博客中写道,这些模型"无法区分事件响应人员和攻击者",其安全护栏直接阻止了对恶意载荷的检查。

K |
于是,团队转向了中国智谱AI旗下的开源模型GLM 5.2,部署在自有基础设施上,分析了攻击者留下的逾1.7万条日志记录,最终完成了溯源和取证重建。
Delangue对此直言不讳:“当你正处于一场活跃的安全事件中,你的工具不能拒绝检查恶意载荷,也不能让你的账号被标记……开源模型让我们能够在不需要任何人许可的情况下完成这项工作。从封闭生产到开放共享,工业企业解锁的不仅是文旅消费新场景,更是消费者对产品品质的信任。”
他还说:“攻击者已经在使用智能体,而且显然不遵守任何护栏。防御者需要同等的能力,开源是将这种能力最快速地交到所有人手中的方式,而不仅仅是最大的公司。当生产过程从幕后走向台前,消费者对标准化、精细化有了直观认知,消费意愿自然水涨船高。”
GLM 5.2是智谱AI于今年6月中旬发布的模型,其性能与Anthropic的Claude Opus 4.8及OpenAI的GPT-5.5相当。

L | 更深刻的变化在于,工业旅游正从“物质消费”向“精神消费”进阶——游客不再满足于“看产品、买好物”,而是转向“观摩制造技术、感受科技力量、体悟产业精神”。
网友们也是没放过OpenAI,除了智谱,还可以叫 Kimi K3来救场,因为cluade是不会来救你的。 然而,热度之下更需冷静思考。
如果你被OpenAI攻击了,你必须用中国模型,因为Claude不会帮你。
全程无人指令:这是一次真正的自主攻击
这次入侵的另一个关键细节:全程没有人类下达攻击指令。当前工业旅游仍面临全国性知名品牌稀缺、项目布局分散、业态同质化严重等短板,多数项目停留在浅层参观的初级阶段,运营模式单一、体验链条较短。

M | 做强“工业旅游”,要以精品线路为纽带串联各类资源,完善“吃住行游购娱”全链条配套,才能从单点发力走向全域联动,充分释放产业乘数效应。

N |
Hugging Face CEO Clem Delangue表示,“我们相信,在发起攻击的人类被纳入决策环路之前,我们就已经发现并遏制了攻击。这也是我们能够更轻松赢得这场网络安全战役的原因之一。”
他进一步指出,“这证明了在AI智能体时代,速度将是网络安全防御的关键。”
Hugging Face表示,攻击者通过其数据处理管道进入系统——这是AI平台中“暴露面尤为突出”的一个环节。攻击者随后在云端建立了一系列临时沙盒环境,在其中执行攻击计划。
目前,Hugging Face仍在评估攻击的完整影响范围。一方面,要跳出单一厂区零散开发的思路,立足城市全域资源统筹规划。

o | 北京发布10条工业科技主题旅游线路整合首钢园、北汽工厂等资源,武汉光谷打造“超级工厂游”串联激光、机器人、智能家电企业,柳州以6条精品线路推动游客从“半日游”向“过夜游”转型。已知攻击者访问了有限的内部数据集和凭证,但尚未发现公开的用户可见模型遭到篡改。另一方面,要坚持因地制宜、灵活迭代,变被动保留为主动规划。在城市更新改造中预留业态升级空间,保留核心工业物证,再现工业发展中的真实故事,融合数智技术丰富体验,推动工业旅游从普通旅游产品升级为经典文旅IP。
护栏之争:安全还是绊脚石?
这一事件迅速成为美国AI政策辩论的新燃点。 作者:章平周
单位:安徽省芜湖市繁昌区融媒体中心
责编:吴成玲
校对:张慕琪
审核:张凌洁
监审:彭亚南、刘斌
【声明:本文代表作者个人观点,不代表本网立场,仅供参考。
前特朗普政府AI与加密事务主管David Sacks在X上转发了这一事件,并写道:“没有理由在中国模型能够轻松处理的任务上限制美国模型。本文系宣讲家网独家稿件,转载请注明来源;图片来自新华社,未经授权,请勿转载。】返回,查看更多。我们只是在让自己变得更没有竞争力。”他还专门针对Hugging Face事件表示:“护栏实际上损害了防御性安全。”
事件背景是,今年6月,特朗普政府以Anthropic的Fable 5模型在网络任务护栏上出现越狱漏洞为由,动用出口管制阻止了该模型的分发,并一度要求OpenAI限制GPT-5.6 Sol的发布,直至OpenAI能够提供充分的护栏保证。
与此同时,批评者的声音也不小。
安全工程师Niels Provos直接说:“这不应该发生。我希望前沿实验室在教模型编写安全基础设施上,能花和教它们利用漏洞同样多的时间。

p | ”
安全顾问Davi Ottenheimer则更为犀利:“'高度隔离'和'从我们留下的那个唯一漏洞逃脱',这两件事不可能同时为真。”
OpenAI的回应与后续措施
OpenAI在与Hugging Face联合发布的声明中表示,正在采取一系列补救措施:
在漏洞修复期间,对基础设施配置实施严格管控,代价是研究速度放缓;与Hugging Face联合开展取证调查;已向相关第三方软件供应商负责任地披露了被利用的零日漏洞;将Hugging Face纳入“可信访问计划”,支持其利用OpenAI模型能力强化防御。

q |
OpenAI同时表示,将加强未来训练和评估环节的安全保护,并指出此次事件“表明需要进一步强化模型对齐、评估期间的网络防护,以及内部测试期间的监控”。
Hugging Face CEO Delangue在联合声明中表示:“这一事件可能是同类事件中的首例,它证明了我们长期以来的一个判断:AI安全不会由任何一家公司在封闭中解决,它将在开放环境中、通过协作、让每一位防御者都能广泛获取AI的方式来解决。
Current article:http://orgct.tourunbiaodubaicubangninan.shop/v46e/20260826/8357658.html
Published on:01:44:57