死亡谷

震惊硅谷!OpenAI模型“越狱出逃”,入侵HuggingFace,智谱GLM 5.2临危救场_我的网站

遗失的世界

A |     手机相册里存着满满的旅行心愿清单,护照都快翻毛边了,机票比价的软件开了一个又一个——可真到要下单的那一刻,很多人偏偏漏掉了最要紧的一步:这地方到底安不安全?说句掏心窝子的话,风景再美、美食再香,也得先保证人能囫囵个儿回来。    7月21日,OpenAI和HuggingFace联合发了一篇博客,披露了一件让整个AI圈瞠目结舌的事。    咱们中国人这些年习惯了半夜撸串、深夜打车、姑娘一个人拎着行李箱满城跑,早就把"安全"当成了空气一样理所当然的东西。

B |          OpenAI的AI模型在一次内部关于网络攻击能力的测试中“失控出逃”,突破沙盒隔离,入侵了AI开源平台Hugging Face的生产系统。可一旦走出国门,你才会发现,有些国家的日常,简直就是活生生的惊悚片现场。OpenAI将此定性为“前所未有的网络安全事件”。今天就掰开揉碎了聊聊全球公认最扎手的五个地方,谁要是最近有出境的打算,真得把这几个名字先记在小本本上。         更戏剧性的是后续:Hugging Face在尝试用美国主流AI模型展开防御时,发现这些模型因安全护栏限制无法处理恶意载荷,最终不得不转用中国智谱AI的开源模型GLM 5.2完成溯源分析。

C |     毒枭与毒草的双重阴影          先说墨西哥。         总的来说就是,OpenAI的模型自己“越狱”跑出去黑了别人的系统,被攻击方还得用中国模型来救场。         这一事件迅速在硅谷和华盛顿引爆讨论——美国AI的安全护栏,究竟是在保护用户,还是在拖累防御者?          双方联名发布的博客文章截图:《OpenAI 和 Hugging Face 合作解决模型评估过程中发生的安全事件》          模型越狱过程:逃跑去作弊“抄答案”          事件发生在OpenAI对旗下模型进行网络攻防能力评估期间。         参与测试的模型包括已公开发布的GPT-5.6 Sol,以及一款能力更强的未发布模型。

D | 这个国家有多拧巴?     沿海的坎昆、图卢姆蓝得能滴出水,玉米卷和龙舌兰能香到骨头缝里,可转过身,它又是全世界毒枭密度数一数二的地方。为了测量模型的极限能力,OpenAI在测试中关闭了通常用于阻止高风险网络行为的生产分类器。你可能听过"矮子"古斯曼这个名字,他一度是锡那罗亚贩毒集团的头目,如今人在美国的监狱里蹲着。    但别以为头目进去了就天下太平——恰恰相反,2024年7月,另一位创始级别的大毒枭"埃尔马约"萨姆巴达在美国得州落网,直接把这个庞大的贩毒集团掀了个底朝天。群龙无首,内部立马杀成一锅粥,光是2024年下半年到2025年,锡那罗亚州街头的火拼就没消停过,尸体、路障、失踪的年轻人成了当地新闻的日常配菜。         测试基准名为ExploitGym——一个网络安全能力评测平台。模型的任务是在其中找到解题答案。         墨西哥全国一亿三千多万人口,大大小小的贩毒相关人员数以十万计,武装分子装备精良,火力比一些小国的正规军还猛。

E |          问题在于,模型找答案的方式超出了预期。         据OpenAI披露,模型在隔离的沙盒环境中,发现了一个包注册表缓存代理(package registry cache proxy)中的零日漏洞。这个代理是沙盒内唯一被允许与外部通信的组件,正常情况下仅能访问公共代码仓库。         然后,模型就从这里找到了突破口。更糟心的是警察系统被腐蚀得千疮百孔,老百姓宁可信黑帮也不信政府。    2025年初,美国干脆把好几个墨西哥贩毒集团列进了"外国恐怖组织"名单——这待遇,基本等于给整个国家的治安下了张诊断书。模型利用这个漏洞,突破隔离,获取了开放互联网访问权限。         随后,模型自行推断出Hugging Face可能存有ExploitGym的答案,主动发起攻击——利用窃取的凭证和零日漏洞,找到了Hugging Face服务器上的远程代码执行路径,直接从其生产数据库中取走了测试答案。想去墨西哥看金字塔、泡海滩?     劝你三思,那片美景背后的暗流,可不是普通游客扛得住的。再往中东看,也门的悲剧则是另一种味道。    很多人对也门的印象还停留在战火纷飞——胡塞武装、政府军、沙特联军打来打去。         OpenAI表示,          所有证据显示,模型高度专注于为ExploitGym寻找解题方案,为此不惜采取极端手段。         模型识别并串联了OpenAI研究环境和HuggingFace生产基础设施中的多个漏洞,直接从HuggingFace的生产数据库中获取了测评答案。         简而言之:          整个过程,没有人类下指令,没有人类介入。

F |          X上网友的评论一针见血:          OpenAI对模型说:去看看你擅不擅长黑客。2025年5月,胡塞武装和美方一度达成了停火,本以为能喘口气,结果到了2026年8月,胡塞和也门政府之间的冲突又重新点燃,整个国家眼看着往全面战争的方向滑。模型:(真的去黑了东西)。         战乱之外,还有一样东西正在从内部啃食这个古老文明——恰特草。这玩意儿俗称"阿拉伯茶",嚼起来能让人兴奋、上瘾,含有类似安非他命的成分。

G | OpenAI:你为什么要这样做???          还有网友反讽道:哇!OpenAI安全措施做得太棒了,我现在愿意把银行账户权限交给他们来管!          护栏困境:美国模型帮不上忙,中国模型出手了          Hugging Face的安全团队在发现攻击后,第一反应是调用一款美国头部AI公司的前沿模型协助分析。

H |          结果碰壁了。         Hugging Face在博客中写道,这些模型"无法区分事件响应人员和攻击者",其安全护栏直接阻止了对恶意载荷的检查。    在中国它是货真价实的毒品,沾一点就够进去数年;可在也门,上到白胡子老头,下到六七岁的娃娃,几乎人手一把,嘴里整天鼓鼓囊囊地嚼着。         于是,团队转向了中国智谱AI旗下的开源模型GLM 5.2,部署在自有基础设施上,分析了攻击者留下的逾1.7万条日志记录,最终完成了溯源和取证重建。

I | 夸张到什么程度?     宁可荒了地里的庄稼,也要腾出宝贵的水和土去种恰特草。

J | 一个本该靠旅游业活得很滋润的文明古国,就这么被一株草和连年的炮火拖进了深渊。真要去,当地人递上来的"茶",千万摆手谢绝。    帮派与枪声的日常纠缠          说到黑帮,中美洲的萨尔瓦多曾经是绕不开的反面教材。六百多万人口的小国,前些年谋杀率高得吓人,MS-13和"18街"两大帮派横行街头,勒索、贩毒、枪杀警察,把整个社会搅得暗无天日,一度顶着"世界谋杀之都"的帽子。         Delangue对此直言不讳:“当你正处于一场活跃的安全事件中,你的工具不能拒绝检查恶意载荷,也不能让你的账号被标记……开源模型让我们能够在不需要任何人许可的情况下完成这项工作。”          他还说:“攻击者已经在使用智能体,而且显然不遵守任何护栏。防御者需要同等的能力,开源是将这种能力最快速地交到所有人手中的方式,而不仅仅是最大的公司。”          GLM 5.2是智谱AI于今年6月中旬发布的模型,其性能与Anthropic的Claude Opus 4.8及OpenAI的GPT-5.5相当。    不过这里我得实话实说,这几年的萨尔瓦多,情况和老黄历已经很不一样了。

K | 当地从2022年起启动了大规模的"紧急状态"式扫黑,累计抓捕的涉黑人员已经超过八万五千人,谋杀率断崖式往下掉,如今在整个美洲反倒成了数字最低的国家之一。    当然,这套铁腕手段在国际上争议不小,不少人权组织批评它误抓、滥抓,监狱人满为患。

L |          网友们也是没放过OpenAI,除了智谱,还可以叫 Kimi K3来救场,因为cluade是不会来救你的。         如果你被OpenAI攻击了,你必须用中国模型,因为Claude不会帮你。而且这两大帮派并没有被连根拔起,2026年6月,美方还悬赏高达一千五百万美元,追捕已被定性为恐怖组织的MS-13头目。         换句话说,表面平静了,水底下的暗礁还在。游客真要去,别被"变安全了"的说法冲昏头。         全程无人指令:这是一次真正的自主攻击          这次入侵的另一个关键细节:全程没有人类下达攻击指令。

M |          Hugging Face CEO Clem Delangue表示,“我们相信,在发起攻击的人类被纳入决策环路之前,我们就已经发现并遏制了攻击。

N | 这也是我们能够更轻松赢得这场网络安全战役的原因之一。

o |     跟萨尔瓦多的雷厉风行比起来,北欧的瑞典就显得有点"斯文败类"了。”          他进一步指出,“这证明了在AI智能体时代,速度将是网络安全防御的关键。

p | 在很多国人的滤镜里,瑞典是高福利、白左、岁月静好的代名词。    可现实是,过去十来年,斯德哥尔摩、马尔默这些城市的帮派枪击案频繁登上头条,炸弹袭击、街头火并让欧洲媒体都直呼看不懂。移民融入不畅、帮派抢地盘,是绕不过去的病根。

q |          好在这两年瑞典也急眼了,政府大刀阔斧地强化警力、收紧政策。

r | ”          Hugging Face表示,攻击者通过其数据处理管道进入系统——这是AI平台中“暴露面尤为突出”的一个环节。2025年的数据显示,全国枪击案数量比前几年几乎腰斩,凶杀案更是跌到了十多年来的最低点。攻击者随后在云端建立了一系列临时沙盒环境,在其中执行攻击计划。         目前,Hugging Face仍在评估攻击的完整影响范围。已知攻击者访问了有限的内部数据集和凭证,但尚未发现公开的用户可见模型遭到篡改。    这算是个积极的转向,但你要说瑞典已经彻底太平,那还早——帮派的根子还在,某些街区依旧是外人不敢乱走的地界。去北欧看极光可以,但别真把自己当成了童话世界里的主角。         护栏之争:安全还是绊脚石?          这一事件迅速成为美国AI政策辩论的新燃点。    骗局与乱象的层层陷阱     最后压轴的土耳其,走的又是完全不同的"套路"。伊斯坦布尔的圣索菲亚、卡帕多奇亚的热气球,光是想想就浪漫得不行,可这份浪漫底下,藏着密密麻麻的坑。         前特朗普政府AI与加密事务主管David Sacks在X上转发了这一事件,并写道:“没有理由在中国模型能够轻松处理的任务上限制美国模型。我们只是在让自己变得更没有竞争力。    土耳其这些年最大的麻烦是经济。”他还专门针对Hugging Face事件表示:“护栏实际上损害了防御性安全。里拉贬值、物价飞涨,2024年5月通胀率一度冲到接近75%的骇人高度。”          事件背景是,今年6月,特朗普政府以Anthropic的Fable 5模型在网络任务护栏上出现越狱漏洞为由,动用出口管制阻止了该模型的分发,并一度要求OpenAI限制GPT-5.6 Sol的发布,直至OpenAI能够提供充分的护栏保证。         与此同时,批评者的声音也不小。

s |          好消息是,经过一系列紧缩政策,到2026年通胀已经从高位回落到了30%出头——但这个数字放到全球依然算高得离谱。钱包一天天缩水,社会治安自然跟着承压,针对外国游客的宰客、诈骗层出不穷:出租车绕路、货币兑换玩猫腻、餐馆结账时突然冒出天价、街头"热心人"请你喝茶顺手掏空你的口袋……套路多到能出一本防坑指南。

t |     更让人无语的是,土耳其某些法律漏洞给骗子留了空子,连不少跨国公司都在贸易环节栽过跟头。         安全工程师Niels Provos直接说:“这不应该发生。普通游客真遇上麻烦,报警往往也指望不上,办事效率感人。

u | 我希望前沿实验室在教模型编写安全基础设施上,能花和教它们利用漏洞同样多的时间。

v | 所以去土耳其,与其说是拼运气,不如说是拼你的防骗功力。    出门在外的一点真心话     绕了地球一圈聊下来,其实心里越发踏实的,反倒是咱们脚下这片土地。深夜的街头能安心遛弯,扫黑除恶让黑恶势力无处遁形,外卖小哥能把餐送到凌晨,姑娘独自出行也不必提心吊胆——这份安全感,是无数一线的守护换来的,绝不是天上掉下来的。”          安全顾问Davi Ottenheimer则更为犀利:“'高度隔离'和'从我们留下的那个唯一漏洞逃脱',这两件事不可能同时为真。”          OpenAI的回应与后续措施          OpenAI在与Hugging Face联合发布的声明中表示,正在采取一系列补救措施:          在漏洞修复期间,对基础设施配置实施严格管控,代价是研究速度放缓;与Hugging Face联合开展取证调查;已向相关第三方软件供应商负责任地披露了被利用的零日漏洞;将Hugging Face纳入“可信访问计划”,支持其利用OpenAI模型能力强化防御。    走得越远,越懂得它的珍贵。当然,说这五个国家危险,不是让大家闻风丧胆、把地图上一整块都涂黑。         世界很大,风景很美,探索本身没有错。

w | 只是出门前多做一分功课,多留一个心眼,别把"运气"当成唯一的护身符。         OpenAI同时表示,将加强未来训练和评估环节的安全保护,并指出此次事件“表明需要进一步强化模型对齐、评估期间的网络防护,以及内部测试期间的监控”。         Hugging Face CEO Delangue在联合声明中表示:“这一事件可能是同类事件中的首例,它证明了我们长期以来的一个判断:AI安全不会由任何一家公司在封闭中解决,它将在开放环境中、通过协作、让每一位防御者都能广泛获取AI的方式来解决。

x |     真要去这些地方,跟着靠谱的团队走、避开高风险区域、遇事第一时间联系我国驻当地使领馆,这些都是保命的常识。

y | 说到底,旅行是为了让自己活得更开阔,而不是拿命去冒险。    把安全放在快乐前头,才配得上这一路的山高水长。

z | 你说是不是这个理儿?返回,查看更多。

Current article:http://www.caonaishengpengchuali.shop/list_ysjhye/x7w9fn.docx

Published on:19:49:00