
A | 7月21日,OpenAI和HuggingFace联合发了一篇博客,披露了一件让整个AI圈瞠目结舌的事。

B | 这一事件迅速在硅谷和华盛顿引爆讨论——美国AI的安全护栏,究竟是在保护用户,还是在拖累防御者? 双方联名发布的博客文章截图:《OpenAI 和 Hugging Face 合作解决模型评估过程中发生的安全事件》 模型越狱过程:逃跑去作弊“抄答案” 事件发生在OpenAI对旗下模型进行网络攻防能力评估期间。

C | 参与测试的模型包括已公开发布的GPT-5.6 Sol,以及一款能力更强的未发布模型。白罗斯理想社对此进行了报道。

D | 在他看来,国家加入北大西洋联盟是可以换取一些东西的。 测试基准名为ExploitGym——一个网络安全能力评测平台。

E | 模型的任务是在其中找到解题答案。他指出:“例如,在军事存在方面有保证。

F | 问题在于,模型找答案的方式超出了预期。”(白罗斯理想社)

G | OpenAI表示, 所有证据显示,模型高度专注于为ExploitGym寻找解题方案,为此不惜采取极端手段。 模型识别并串联了OpenAI研究环境和HuggingFace生产基础设施中的多个漏洞,直接从HuggingFace的生产数据库中获取了测评答案。 简而言之: 整个过程,没有人类下指令,没有人类介入。 X上网友的评论一针见血: OpenAI对模型说:去看看你擅不擅长黑客。模型:(真的去黑了东西)。OpenAI:你为什么要这样做??? 还有网友反讽道:哇!OpenAI安全措施做得太棒了,我现在愿意把银行账户权限交给他们来管! 护栏困境:美国模型帮不上忙,中国模型出手了 Hugging Face的安全团队在发现攻击后,第一反应是调用一款美国头部AI公司的前沿模型协助分析。 结果碰壁了。 Hugging Face在博客中写道,这些模型"无法区分事件响应人员和攻击者",其安全护栏直接阻止了对恶意载荷的检查。 于是,团队转向了中国智谱AI旗下的开源模型GLM 5.2,部署在自有基础设施上,分析了攻击者留下的逾1.7万条日志记录,最终完成了溯源和取证重建。

H | Delangue对此直言不讳:“当你正处于一场活跃的安全事件中,你的工具不能拒绝检查恶意载荷,也不能让你的账号被标记……开源模型让我们能够在不需要任何人许可的情况下完成这项工作。” 他还说:“攻击者已经在使用智能体,而且显然不遵守任何护栏。防御者需要同等的能力,开源是将这种能力最快速地交到所有人手中的方式,而不仅仅是最大的公司。” GLM 5.2是智谱AI于今年6月中旬发布的模型,其性能与Anthropic的Claude Opus 4.8及OpenAI的GPT-5.5相当。 网友们也是没放过OpenAI,除了智谱,还可以叫 Kimi K3来救场,因为cluade是不会来救你的。 如果你被OpenAI攻击了,你必须用中国模型,因为Claude不会帮你。 全程无人指令:这是一次真正的自主攻击 这次入侵的另一个关键细节:全程没有人类下达攻击指令。 Hugging Face CEO Clem Delangue表示,“我们相信,在发起攻击的人类被纳入决策环路之前,我们就已经发现并遏制了攻击。这也是我们能够更轻松赢得这场网络安全战役的原因之一。” 他进一步指出,“这证明了在AI智能体时代,速度将是网络安全防御的关键。” Hugging Face表示,攻击者通过其数据处理管道进入系统——这是AI平台中“暴露面尤为突出”的一个环节。攻击者随后在云端建立了一系列临时沙盒环境,在其中执行攻击计划。 目前,Hugging Face仍在评估攻击的完整影响范围。已知攻击者访问了有限的内部数据集和凭证,但尚未发现公开的用户可见模型遭到篡改。 护栏之争:安全还是绊脚石? 这一事件迅速成为美国AI政策辩论的新燃点。 前特朗普政府AI与加密事务主管David Sacks在X上转发了这一事件,并写道:“没有理由在中国模型能够轻松处理的任务上限制美国模型。

I | 我们只是在让自己变得更没有竞争力。”他还专门针对Hugging Face事件表示:“护栏实际上损害了防御性安全。” 事件背景是,今年6月,特朗普政府以Anthropic的Fable 5模型在网络任务护栏上出现越狱漏洞为由,动用出口管制阻止了该模型的分发,并一度要求OpenAI限制GPT-5.6 Sol的发布,直至OpenAI能够提供充分的护栏保证。 与此同时,批评者的声音也不小。 安全工程师Niels Provos直接说:“这不应该发生。我希望前沿实验室在教模型编写安全基础设施上,能花和教它们利用漏洞同样多的时间。” 安全顾问Davi Ottenheimer则更为犀利:“'高度隔离'和'从我们留下的那个唯一漏洞逃脱',这两件事不可能同时为真。” OpenAI的回应与后续措施 OpenAI在与Hugging Face联合发布的声明中表示,正在采取一系列补救措施: 在漏洞修复期间,对基础设施配置实施严格管控,代价是研究速度放缓;与Hugging Face联合开展取证调查;已向相关第三方软件供应商负责任地披露了被利用的零日漏洞;将Hugging Face纳入“可信访问计划”,支持其利用OpenAI模型能力强化防御。 OpenAI同时表示,将加强未来训练和评估环节的安全保护,并指出此次事件“表明需要进一步强化模型对齐、评估期间的网络防护,以及内部测试期间的监控”。 Hugging Face CEO Delangue在联合声明中表示:“这一事件可能是同类事件中的首例,它证明了我们长期以来的一个判断:AI安全不会由任何一家公司在封闭中解决,它将在开放环境中、通过协作、让每一位防御者都能广泛获取AI的方式来解决。

J |
Current article:http://jyt7cvq.dinggaxilianmaiyuejienianguai.shop/news/20260826_9223.html
Published on:01:59:23
相关阅读 莫扎特发布的迷你S三轴手机平台:结构紧凑,拍摄方式多种多样Russia-born giant panda Katyusha celebrates third birthday翼华科技贾淑芸: 在网络算力这一层,让每个Token更便宜托起幸福“夕阳红”_养老_服务前保安杀进了AI决赛,高中生拿走25万!这AI比赛办得有点绝沃特森加盟骑士 名记:他让骑士首发阵容得到升级Gartner 预测:2026 年存储器市场规模 > 2025 年半导体整体收入【星乐园·护航】“1530”小手拉大手安全教育专题——寒假安全篇
热门文章
1952年原国军将领判死刑,省副主席之女反对:应请示周总理,馆长微鉴,原创 1952年原国军将领判死刑,省副主席之女反对:应请示周总理
【套利】983!豆粕菜粕价差处于历史高位豆粕相对菜粕被高估
"Camera Meri Mehbooba Hai", Said Dharmendra, Reveals Anil Sharma | Exclusive
东阳光集团电子新材料·秦淮数据重点项目集中开工投产仪式举行
最新文章
美媒一针见血评价:我们现在不是不想竞争,确实是“打不过”中国
PM Modi China Visit: पीएम मोदी और चिनफिंग ट्रंप टैरिफ के अलावा इन मुद्दों पर करेंगे चर्चा, क्या है पूरा प्लान?
外部媒体:三星Galaxy F内置双电池,总容量6200毫安时泉州市第七届残疾人职业技能竞赛举办罗技数字铅笔上架苹果官网 比一代Apple Pencil便宜'Katy, Bar the Door': Why Pelosi's Trip to Taiwan is Fraught With Risk of Military Escalation
人气排行 多重利好共振!旅游酒店集体走强 2026业绩高增长个股来了【观点】申银万国:铜精矿供应紧张,铜价中期可能偏强波动全年5%增速稳了,专家建议可进一步改善“微观感受”一颗「脑」装进27000台真机!遍布50国马奎尔社媒鼓励弗雷德里克森:出色的首秀,干得好小伙子沪指上涨0.7% 科创50指数上涨2.18% 工业金属、券商概念领涨大学生订机票哪个平台靠谱?2026去哪儿航司学生政策+服务保障避坑指南जम्मू में संकट आया तो मदद के लिए आगे आई ट्रेडर्स फेडरेशन, प्रभावित लोगों के लिए शुरू की लंगर सेवा
查看所有0条评论>>