• 软件下载
  • 源码下载
  • 在线工具
  • 网页教程基础
  • 服务器常用软件
  • 手机版
  • 关注微信
流星之绊
  • 网页制作
  • 网络编程
  • 脚本专栏
  • 脚本下载
  • 数据库
  • CMS教程
  • 电子书籍
  • 平面设计
  • 媒体动画
  • 操作系统
  • 网站运营
  • 网络安全
  • 在线手册
您的位置: 主页 > 网站运营 > 建站经验 >

作者:安龙顺安 字体:[增加 减小] 来源:倚天屠龙记 时间:2026-08-26 我要评论

流星之绊

震惊硅谷!OpenAI模型“越狱出逃”,入侵HuggingFace,智谱GLM 5.2临危救场_我的网站

我不是明星

一 |     8月26日消息,据媒体报道,近日,德芙一段短视频文案引发网友不适。

二 |     事件导火索来自德芙官方旗舰店发布的七彩礼盒推广短视频,文案内容为“跟男朋友要了很久的德芙七彩礼盒也没给我买,今天趁男朋友不在跟暧昧对象分享了抖音,驾车2小时送了过来,很甜。    7月21日,OpenAI和HuggingFace联合发了一篇博客,披露了一件让整个AI圈瞠目结舌的事。         OpenAI的AI模型在一次内部关于网络攻击能力的测试中“失控出逃”,突破沙盒隔离,入侵了AI开源平台Hugging Face的生产系统。OpenAI将此定性为“前所未有的网络安全事件”。”     视频将背着男友收下暧昧异性礼物渲染成甜蜜桥段,不少网友认为内容美化暧昧越界关系,扭曲婚恋价值观,和德芙长期主打真挚专一的浪漫品牌形象严重冲突,该礼盒也被网友调侃为“绿帽巧克力”。         更戏剧性的是后续:Hugging Face在尝试用美国主流AI模型展开防御时,发现这些模型因安全护栏限制无法处理恶意载荷,最终不得不转用中国智谱AI的开源模型GLM 5.2完成溯源分析。         总的来说就是,OpenAI的模型自己“越狱”跑出去黑了别人的系统,被攻击方还得用中国模型来救场。    事发后,德芙客服回应,视频内容为个人创作,不代表品牌立场,并表示已处理该视频。     据悉,发布该视频的账号为德芙官方旗舰店,在平台拥有超200万粉丝,数据显示,事发后该直播间单日销售额从4000元跌至1000元。

三 |          这一事件迅速在硅谷和华盛顿引爆讨论——美国AI的安全护栏,究竟是在保护用户,还是在拖累防御者?          双方联名发布的博客文章截图:《OpenAI 和 Hugging Face 合作解决模型评估过程中发生的安全事件》          模型越狱过程:逃跑去作弊“抄答案”          事件发生在OpenAI对旗下模型进行网络攻防能力评估期间。         参与测试的模型包括已公开发布的GPT-5.6 Sol,以及一款能力更强的未发布模型。为了测量模型的极限能力,OpenAI在测试中关闭了通常用于阻止高风险网络行为的生产分类器。     公开资料显示,德芙是玛氏箭牌旗下巧克力品牌。

四 |          测试基准名为ExploitGym——一个网络安全能力评测平台。

五 | 玛氏箭牌糖果(中国)有限公司成立于1989年,为玛氏中国旗下主要外商合资企业之一,旗下拥有德芙、士力架、绿箭、益达等品牌,通过线上线下多渠道布局中国市场。    发布争议视频的“德芙官方旗舰店”由第三方代运营,备案主体为上海宗正食品有限公司(下称“宗正食品”),而宗正食品为德芙的经销商。     昨日深夜,德芙官方账号发布正式致歉,承认内容表达方式、价值导向存在不当,同时承认客服团队给出不恰当回复,致歉中表示会加强合作运营团队管理,完善内容审核机制,吸取教训整改问题。模型的任务是在其中找到解题答案。         问题在于,模型找答案的方式超出了预期。    经核查,该短视频由第三方店铺运营团队创作并发布,未严格执行品牌方的内容审核流程。         据OpenAI披露,模型在隔离的沙盒环境中,发现了一个包注册表缓存代理(package registry cache proxy)中的零日漏洞。     但无论问题产生于哪个环节,内容发布于德芙官方渠道,我们都负有责任。

六 | 我们未能及时发现并制止相关内容上线,辜负了大家对品牌的信任。    涉事文案在表达方式和价值导向上存在明显不当,与德芙一直努力传递的真诚、温暖和尊重的品牌理念不符。    同时,我们也注意到,在事件发生后,店铺客服团队对消费者质疑作出了不恰当的回应。这个代理是沙盒内唯一被允许与外部通信的组件,正常情况下仅能访问公共代码仓库。对此,我们深表歉意,并已认真复盘相关问题,采取相关整改措施。

七 |          然后,模型就从这里找到了突破口。

八 | 模型利用这个漏洞,突破隔离,获取了开放互联网访问权限。         随后,模型自行推断出Hugging Face可能存有ExploitGym的答案,主动发起攻击——利用窃取的凭证和零日漏洞,找到了Hugging Face服务器上的远程代码执行路径,直接从其生产数据库中取走了测试答案。         OpenAI表示,          所有证据显示,模型高度专注于为ExploitGym寻找解题方案,为此不惜采取极端手段。              

     【本文结束】如需转载请务必注明出处:      责任编辑:哈尔     文章内容举报     
。         模型识别并串联了OpenAI研究环境和HuggingFace生产基础设施中的多个漏洞,直接从HuggingFace的生产数据库中获取了测评答案。         简而言之:          整个过程,没有人类下指令,没有人类介入。         X上网友的评论一针见血:          OpenAI对模型说:去看看你擅不擅长黑客。

九 | 模型:(真的去黑了东西)。OpenAI:你为什么要这样做???          还有网友反讽道:哇!OpenAI安全措施做得太棒了,我现在愿意把银行账户权限交给他们来管!          护栏困境:美国模型帮不上忙,中国模型出手了          Hugging Face的安全团队在发现攻击后,第一反应是调用一款美国头部AI公司的前沿模型协助分析。         结果碰壁了。

十 |          Hugging Face在博客中写道,这些模型"无法区分事件响应人员和攻击者",其安全护栏直接阻止了对恶意载荷的检查。         于是,团队转向了中国智谱AI旗下的开源模型GLM 5.2,部署在自有基础设施上,分析了攻击者留下的逾1.7万条日志记录,最终完成了溯源和取证重建。         Delangue对此直言不讳:“当你正处于一场活跃的安全事件中,你的工具不能拒绝检查恶意载荷,也不能让你的账号被标记……开源模型让我们能够在不需要任何人许可的情况下完成这项工作。

十一 | ”          他还说:“攻击者已经在使用智能体,而且显然不遵守任何护栏。防御者需要同等的能力,开源是将这种能力最快速地交到所有人手中的方式,而不仅仅是最大的公司。”          GLM 5.2是智谱AI于今年6月中旬发布的模型,其性能与Anthropic的Claude Opus 4.8及OpenAI的GPT-5.5相当。

十二 |          网友们也是没放过OpenAI,除了智谱,还可以叫 Kimi K3来救场,因为cluade是不会来救你的。         如果你被OpenAI攻击了,你必须用中国模型,因为Claude不会帮你。         全程无人指令:这是一次真正的自主攻击          这次入侵的另一个关键细节:全程没有人类下达攻击指令。         Hugging Face CEO Clem Delangue表示,“我们相信,在发起攻击的人类被纳入决策环路之前,我们就已经发现并遏制了攻击。这也是我们能够更轻松赢得这场网络安全战役的原因之一。”          他进一步指出,“这证明了在AI智能体时代,速度将是网络安全防御的关键。

十三 | ”          Hugging Face表示,攻击者通过其数据处理管道进入系统——这是AI平台中“暴露面尤为突出”的一个环节。

十四 | 攻击者随后在云端建立了一系列临时沙盒环境,在其中执行攻击计划。         目前,Hugging Face仍在评估攻击的完整影响范围。已知攻击者访问了有限的内部数据集和凭证,但尚未发现公开的用户可见模型遭到篡改。         护栏之争:安全还是绊脚石?          这一事件迅速成为美国AI政策辩论的新燃点。

十五 |          前特朗普政府AI与加密事务主管David Sacks在X上转发了这一事件,并写道:“没有理由在中国模型能够轻松处理的任务上限制美国模型。

十六 | 我们只是在让自己变得更没有竞争力。”他还专门针对Hugging Face事件表示:“护栏实际上损害了防御性安全。”          事件背景是,今年6月,特朗普政府以Anthropic的Fable 5模型在网络任务护栏上出现越狱漏洞为由,动用出口管制阻止了该模型的分发,并一度要求OpenAI限制GPT-5.6 Sol的发布,直至OpenAI能够提供充分的护栏保证。         与此同时,批评者的声音也不小。

十七 |          安全工程师Niels Provos直接说:“这不应该发生。我希望前沿实验室在教模型编写安全基础设施上,能花和教它们利用漏洞同样多的时间。”          安全顾问Davi Ottenheimer则更为犀利:“'高度隔离'和'从我们留下的那个唯一漏洞逃脱',这两件事不可能同时为真。”          OpenAI的回应与后续措施          OpenAI在与Hugging Face联合发布的声明中表示,正在采取一系列补救措施:          在漏洞修复期间,对基础设施配置实施严格管控,代价是研究速度放缓;与Hugging Face联合开展取证调查;已向相关第三方软件供应商负责任地披露了被利用的零日漏洞;将Hugging Face纳入“可信访问计划”,支持其利用OpenAI模型能力强化防御。         OpenAI同时表示,将加强未来训练和评估环节的安全保护,并指出此次事件“表明需要进一步强化模型对齐、评估期间的网络防护,以及内部测试期间的监控”。

十八 |          Hugging Face CEO Delangue在联合声明中表示:“这一事件可能是同类事件中的首例,它证明了我们长期以来的一个判断:AI安全不会由任何一家公司在封闭中解决,它将在开放环境中、通过协作、让每一位防御者都能广泛获取AI的方式来解决。

十九 |

Current article:http://uv4zh.liawucunsainantaonao.sbs/list_1lv1e/gk38crx.html

Published on:22:44:37


Tag:孤岛惊魂   上海滩  恐怖游轮  

相关文章

  • 08-26海底捞:上半年营业收入223.37亿元,同比增长7.9%
  • 08-22墨西哥的土地、美国的full house以及更多——世界杯后记
  • 08-23海格通信:上半年归母净利润亏损1.81亿元,由盈转亏
  • 08-24老詹经纪人:哈登提前看清快船局势选择离开 必须为这手操作点赞
  • 08-26起底“假总编”张龙的造假三件套:办假新闻网站起家,蹭名人合影抬身价,游走名利场堆砌超50个头衔
  • 08-22国家烟草专卖局拟进一步规范电子烟交易

文章分类

  • 建站经验
  • 网站优化
  • 网站策划
  • 网络赚钱
  • 网络创业
  • 站长故事
  • alexa域名
  • 其它相关

大家感兴趣的内容

  • 1阿勒代斯:我认为阿森纳能够卫冕英超 曼城正在经历重建
  • 2凌晨1点特朗普发飙了,美国向加拿大提出13条
  • 3世卫总干事:乌克兰新冠确诊病例数增加,10月或达峰值
  • 4现场评|进山喝一杯“村咖”
  • 5【风口研报】10家派现近170亿!板块估值处历史低位 证券行业有望迎估值修复窗口
  • 6NZ confirms 9 new community transmission cases of monkeypox
  • 7[포토] 밝은 표정으로 나서는 김윤덕 장관-오세훈 시장
  • 8SKhynix 淘宝旗舰店终止经营,已下架所有海力士存储产品
  • 9罗马诺:莱奥未来悬而未决,去维拉可踢英超 加拉塔萨雷待遇优厚
  • 10多古:奥比-马丁会成为出色前锋;会看阿芳和特奥的比赛学习

最近更新的内容

  • 刷屏!她因美貌在新加坡一夜爆红!揭秘新加坡组屋楼下的神秘行业...
  • 老屋当片场、山水作布景 微短剧带火闽侯深山古村
  • Aneet Padda to Shoot for Shakti Shalini Right After College Exams
  • 抚顺:踔厉奋发再启新篇
  • “眼见为实”有回响,“眼见为实”有回响
  • 谈崩了!住院医生5月初罢工,病人请改天生病......
  • 丽水市举办福彩公益金资助项目开放日活动
  • 618最新红包口令是什么?2025年618淘宝红包口令是:红包到手90900,京东618红包口令是:红包到手798
  • “浩浩妈”王星辰全新美照
  • 摩尔线程公布万卡级集群训练成绩 称国产芯片可训出前沿模型

关于我们 - 广告合作 - 联系我们 - 免责声明 - 网站地图 - 网站地图 - 投诉建议 - 在线投稿 -

©CopyRight 2020-2099 流星之绊 Inc All Rights Reserved. 流星之绊 版权所有