当前位置:主页 > 晋中 >

一代女皇

震惊硅谷!OpenAI模型“越狱出逃”,入侵HuggingFace,智谱GLM 5.2临危救场_我的网站

头脑风暴

一 |     7月21日,OpenAI和HuggingFace联合发了一篇博客,披露了一件让整个AI圈瞠目结舌的事。    岁岁七夕,情寄良缘。省辛集市紧扣“我们的节日·七夕”文化内涵,将传统佳节的浪漫暖意,化作移风易俗、服务群众的长效抓手。以全域公益红娘志愿服务体系为根基,线上线下双向发力,既传承中华优秀婚恋民俗,又破解青年交友堵点、整治婚嫁陈规陋习,把一桩桩民生小事,做成精神文明建设的暖心答卷。婚姻幸福事关万家安稳,文明乡风关乎城市治理成色。自2024年8月,辛集市文明办牵头组建公益红娘志愿服务队以来,辛集用一年多时间,实现村、社区服务网点全域覆盖,634名热心乡贤、基层工作者、志愿骨干组成专业服务队伍,严守纯公益、全免费服务准则,搭建起全市单身青年信息资源库,累计录入婚恋信息近7000条,成功促成1361对青年达成交友意向。

二 | 志愿者李玉莎便是其中一员,多年来自发帮身边单身男女牵红线的善举,让李玉莎愈发希望成全更多美满姻缘。         OpenAI的AI模型在一次内部关于网络攻击能力的测试中“失控出逃”,突破沙盒隔离,入侵了AI开源平台Hugging Face的生产系统。2025年,她了解到公益红娘志愿服务队后,第一时间报名加入,团队内丰富的信息资源为她开展婚恋牵线工作提供了坚实支撑,已助力15对有情人携手相伴;闲暇之余拍摄科普短视频,劝导婚嫁攀比、高价彩礼等不良风气,让简约婚嫁理念润物无声走进千家万户。公益红娘李玉莎坦言:“从前只在亲友小圈子帮忙介绍,资源有限、成功率不高。如今全市300多个村都配备公益红娘,青年信息全域共享,匹配度和脱单效率大幅提升。OpenAI将此定性为“前所未有的网络安全事件”。         更戏剧性的是后续:Hugging Face在尝试用美国主流AI模型展开防御时,发现这些模型因安全护栏限制无法处理恶意载荷,最终不得不转用中国智谱AI的开源模型GLM 5.2完成溯源分析。         总的来说就是,OpenAI的模型自己“越狱”跑出去黑了别人的系统,被攻击方还得用中国模型来救场。我会一直把这份公益事业做下去,帮更多单身朋友找到幸福归宿。         这一事件迅速在硅谷和华盛顿引爆讨论——美国AI的安全护栏,究竟是在保护用户,还是在拖累防御者?          双方联名发布的博客文章截图:《OpenAI 和 Hugging Face 合作解决模型评估过程中发生的安全事件》          模型越狱过程:逃跑去作弊“抄答案”          事件发生在OpenAI对旗下模型进行网络攻防能力评估期间。”这支遍布城乡的公益红娘队伍,平日里深耕乡村社区、默默牵线助人,在七夕佳节来临之际,更是集中力量走进润泽湖公园常态化相亲角,为单身群众送上节日专属便民服务。         参与测试的模型包括已公开发布的GPT-5.6 Sol,以及一款能力更强的未发布模型。为了测量模型的极限能力,OpenAI在测试中关闭了通常用于阻止高风险网络行为的生产分类器。         测试基准名为ExploitGym——一个网络安全能力评测平台。模型的任务是在其中找到解题答案。         问题在于,模型找答案的方式超出了预期。         据OpenAI披露,模型在隔离的沙盒环境中,发现了一个包注册表缓存代理(package registry cache proxy)中的零日漏洞。这个代理是沙盒内唯一被允许与外部通信的组件,正常情况下仅能访问公共代码仓库。专场活动现场一派温馨热闹景象,公益红娘与志愿者们全程一对一服务,细致指导市民填报婚恋资料,严格核实年龄、职业、兴趣、择偶期待等关键信息,从源头杜绝虚假信息,为单身交友牢牢守住安全底线。在牵线之余,志愿者同步普及正向婚恋理念,引导青年理性择偶,为婚恋生活卸下经济负担与人情枷锁。         然后,模型就从这里找到了突破口。“七夕承载着大家对美好姻缘的向往,我们现场细致核对资料,就是为了避免信息残缺、不实带来的交友隐患。模型利用这个漏洞,突破隔离,获取了开放互联网访问权限。         随后,模型自行推断出Hugging Face可能存有ExploitGym的答案,主动发起攻击——利用窃取的凭证和零日漏洞,找到了Hugging Face服务器上的远程代码执行路径,直接从其生产数据库中取走了测试答案。借着节日契机,我们也大力推广文明婚嫁新风,让大家好好经营感情、简约举办婚礼,收获稳稳的幸福。

三 |          OpenAI表示,          所有证据显示,模型高度专注于为ExploitGym寻找解题方案,为此不惜采取极端手段。”公益红娘冯转说道。         模型识别并串联了OpenAI研究环境和HuggingFace生产基础设施中的多个漏洞,直接从HuggingFace的生产数据库中获取了测评答案。         简而言之:          整个过程,没有人类下指令,没有人类介入。         X上网友的评论一针见血:          OpenAI对模型说:去看看你擅不擅长黑客。线下相亲角设置固定信息展示区,审核后的资料分类陈列、一目了然,每周六早7时至9时固定开放交流,市民可随时到访咨询对接。为进一步打破时空限制、拓宽服务半径,辛集市打通线上服务通道,在官方平台“辛集发布”微信公众号菜单栏增设相亲角专属入口,市民足不出户即可完成信息登记、活动预约、线上咨询,让公益婚恋服务全天候在线、零距离可达。

四 | 模型:(真的去黑了东西)。辛集市市民王延令说:“以前想帮孩子找合适的对象,没有正规渠道,只能托亲戚朋友介绍,信息杂乱还不靠谱。这里所有资料都经过红娘审核,真实靠谱、一目了然,我们家长看得放心、孩子交友安心。OpenAI:你为什么要这样做???          还有网友反讽道:哇!OpenAI安全措施做得太棒了,我现在愿意把银行账户权限交给他们来管!          护栏困境:美国模型帮不上忙,中国模型出手了          Hugging Face的安全团队在发现攻击后,第一反应是调用一款美国头部AI公司的前沿模型协助分析。

五 |          结果碰壁了。常态化的相亲角,再加上公众号就能登记咨询,给大家提供了一个正规公益平台,解决了很多家庭的烦心事、揪心事。”辛集市持续推动婚恋志愿服务提质增效、提档升级,整合文明、妇联、法律、心理等多方资源,在新时代文明实践中心挂牌设立“公益红娘工作室”。

六 |          Hugging Face在博客中写道,这些模型"无法区分事件响应人员和攻击者",其安全护栏直接阻止了对恶意载荷的检查。常态化开展系统业务集训,邀请婚恋指导专家、专业心理咨询师、法务工作者轮流授课,内容涵盖交友沟通技巧、婚恋法律常识、情感疏导、婚俗政策宣讲等方方面面,推动一众热心红娘从凭经验办事的“热心人”,成长为懂服务、懂专业、守规范的“专业服务者”,让志愿服务善意走得更远、根基更加坚实。一方相亲小角落,一处志愿大阵地。

七 |          于是,团队转向了中国智谱AI旗下的开源模型GLM 5.2,部署在自有基础设施上,分析了攻击者留下的逾1.7万条日志记录,最终完成了溯源和取证重建。         Delangue对此直言不讳:“当你正处于一场活跃的安全事件中,你的工具不能拒绝检查恶意载荷,也不能让你的账号被标记……开源模型让我们能够在不需要任何人许可的情况下完成这项工作。

八 | ”          他还说:“攻击者已经在使用智能体,而且显然不遵守任何护栏。

九 | 防御者需要同等的能力,开源是将这种能力最快速地交到所有人手中的方式,而不仅仅是最大的公司。公益红娘队伍、线上相亲端口、公园线下阵地三位一体的服务模式,既是辛集办好民生实事的生动缩影,更是深化婚俗改革、涵养文明乡风、夯实基层治理根基的创新实践。下一步,辛集市将持续建强志愿红娘队伍、迭代线上相亲服务功能,常态化开展节日联谊、婚恋科普、新风宣讲系列活动,持续以文明力量滋养城市气质,不断增进群众幸福感、获得感,以高水平精神文明建设,为全市高质量发展注入温润绵长的民生动能。”          GLM 5.2是智谱AI于今年6月中旬发布的模型,其性能与Anthropic的Claude Opus 4.8及OpenAI的GPT-5.5相当。         网友们也是没放过OpenAI,除了智谱,还可以叫 Kimi K3来救场,因为cluade是不会来救你的。         如果你被OpenAI攻击了,你必须用中国模型,因为Claude不会帮你。         全程无人指令:这是一次真正的自主攻击          这次入侵的另一个关键细节:全程没有人类下达攻击指令。         Hugging Face CEO Clem Delangue表示,“我们相信,在发起攻击的人类被纳入决策环路之前,我们就已经发现并遏制了攻击。

十 | 这也是我们能够更轻松赢得这场网络安全战役的原因之一。”          他进一步指出,“这证明了在AI智能体时代,速度将是网络安全防御的关键。”          Hugging Face表示,攻击者通过其数据处理管道进入系统——这是AI平台中“暴露面尤为突出”的一个环节。攻击者随后在云端建立了一系列临时沙盒环境,在其中执行攻击计划。         目前,Hugging Face仍在评估攻击的完整影响范围。已知攻击者访问了有限的内部数据集和凭证,但尚未发现公开的用户可见模型遭到篡改。         护栏之争:安全还是绊脚石?          这一事件迅速成为美国AI政策辩论的新燃点。         前特朗普政府AI与加密事务主管David Sacks在X上转发了这一事件,并写道:“没有理由在中国模型能够轻松处理的任务上限制美国模型。我们只是在让自己变得更没有竞争力。

十一 | ”他还专门针对Hugging Face事件表示:“护栏实际上损害了防御性安全。”          事件背景是,今年6月,特朗普政府以Anthropic的Fable 5模型在网络任务护栏上出现越狱漏洞为由,动用出口管制阻止了该模型的分发,并一度要求OpenAI限制GPT-5.6 Sol的发布,直至OpenAI能够提供充分的护栏保证。         与此同时,批评者的声音也不小。         安全工程师Niels Provos直接说:“这不应该发生。我希望前沿实验室在教模型编写安全基础设施上,能花和教它们利用漏洞同样多的时间。”          安全顾问Davi Ottenheimer则更为犀利:“'高度隔离'和'从我们留下的那个唯一漏洞逃脱',这两件事不可能同时为真。

十二 | ”          OpenAI的回应与后续措施          OpenAI在与Hugging Face联合发布的声明中表示,正在采取一系列补救措施:          在漏洞修复期间,对基础设施配置实施严格管控,代价是研究速度放缓;与Hugging Face联合开展取证调查;已向相关第三方软件供应商负责任地披露了被利用的零日漏洞;将Hugging Face纳入“可信访问计划”,支持其利用OpenAI模型能力强化防御。         OpenAI同时表示,将加强未来训练和评估环节的安全保护,并指出此次事件“表明需要进一步强化模型对齐、评估期间的网络防护,以及内部测试期间的监控”。         Hugging Face CEO Delangue在联合声明中表示:“这一事件可能是同类事件中的首例,它证明了我们长期以来的一个判断:AI安全不会由任何一家公司在封闭中解决,它将在开放环境中、通过协作、让每一位防御者都能广泛获取AI的方式来解决。

十三 |

Current article:http://7091o.mexuanmeixuyaopinzheng.shop/foo/abpltf.html

Published on:11:17:41


Copyright @ 2016-2017 我的网站 版权所有