
一 | 7月21日,OpenAI和HuggingFace联合发了一篇博客,披露了一件让整个AI圈瞠目结舌的事。 Kenny 报道 3月12日,奥克兰Gulf Harbour水域惊现装有人体残骸的塑料袋。如今已经过去整整一个月,新西兰警方依然未能确认死者的身份。 Waitematā警局代理督察Tim Williams说他的团队一直在“努力”。

二 | 除了联系国际刑警组织发出黑色通缉令之外,警方可能需要通过新西兰驻北京警务联络官,请求中国公安部门协助调查。 Advertise with us 据悉死者身穿蓝色睡裤和中国老纺织厂生产的针织背心。 OpenAI的AI模型在一次内部关于网络攻击能力的测试中“失控出逃”,突破沙盒隔离,入侵了AI开源平台Hugging Face的生产系统。OpenAI将此定性为“前所未有的网络安全事件”。睡裤为黑色,上面有心形图案。针织背心为赭色,写着中文“娟燕牌 80公分”和“娟燕针织制衣厂”。

三 | 据Stuff报道,有中国网友认出了这款老式女性背心,据说在江苏省有两家与之同名的商店。

四 | 更戏剧性的是后续:Hugging Face在尝试用美国主流AI模型展开防御时,发现这些模型因安全护栏限制无法处理恶意载荷,最终不得不转用中国智谱AI的开源模型GLM 5.2完成溯源分析。 (图片来源:新西兰警方) 新西兰警方已经获得死者的DNA图谱,但其基因信息跟本地档案库里的任何人都不匹配。 总的来说就是,OpenAI的模型自己“越狱”跑出去黑了别人的系统,被攻击方还得用中国模型来救场。

五 | 退休资深探员Neil Hallett曾在新西兰警局工作35年,退休前担任新西兰驻华盛顿特区高级警务联络官。 这一事件迅速在硅谷和华盛顿引爆讨论——美国AI的安全护栏,究竟是在保护用户,还是在拖累防御者? 双方联名发布的博客文章截图:《OpenAI 和 Hugging Face 合作解决模型评估过程中发生的安全事件》 模型越狱过程:逃跑去作弊“抄答案” 事件发生在OpenAI对旗下模型进行网络攻防能力评估期间。根据他的说法,如果该女子被证实有东亚血统,又有中国产地的服装标签,那么警方需要联系新西兰驻北京警务联络官。 参与测试的模型包括已公开发布的GPT-5.6 Sol,以及一款能力更强的未发布模型。

六 | 新西兰警方自2006年起在北京设立联络处,由犯罪调查科的高级警官任职。当时主要是为了打击日益猖獗的来自亚太地区的冰毒走私贸易。

七 | Hallett说联络处可以联系中国公安部门,在交换牙科记录、DNA样本和比对指纹上发挥重要作用。 他对英文《先驱报》表示:“一个称职的联络官往往(在当地)有很好的人脉。为了测量模型的极限能力,OpenAI在测试中关闭了通常用于阻止高风险网络行为的生产分类器。 测试基准名为ExploitGym——一个网络安全能力评测平台。模型的任务是在其中找到解题答案。” Hallett根据自己的多年办案经验表示,死者身穿睡衣的事实表明她很可能死于家庭暴力事件。他说一旦身份被确认,他会密切留意死者的伴侣或前伴侣。 问题在于,模型找答案的方式超出了预期。

八 | 据OpenAI披露,模型在隔离的沙盒环境中,发现了一个包注册表缓存代理(package registry cache proxy)中的零日漏洞。 (图片来源:NZ Herald) 目前有猜测说死者可能是从轮船或路过的渔船上被抛尸的。也有人认为她可能是偷渡来新西兰的。这个代理是沙盒内唯一被允许与外部通信的组件,正常情况下仅能访问公共代码仓库。

九 | 然后,模型就从这里找到了突破口。 Hallett说这意味着警方需要用到懂中文的华人联络官,和本地华人社区保持密切联系。 除北京外,新西兰警方还在曼谷、悉尼、伦敦、香港等华人较多的城市都设有联络官。死者也可能来自当地华人社区。模型利用这个漏洞,突破隔离,获取了开放互联网访问权限。 目前已经确认的是,国际刑警组织(Interpol)已经应新西兰警方的请求发出黑色通缉令。

十 | 作为规模仅次于联合国的第二大国际组织,国际刑警组织目前共有190个成员国,其重要职能之一是协助成员国侦查跨境犯罪。

十一 | 国际刑警组织共有七种颜色的通缉令,其中黑色通缉令表示发现身份不明的死者,希望提供身份参照。

十二 | 随后,模型自行推断出Hugging Face可能存有ExploitGym的答案,主动发起攻击——利用窃取的凭证和零日漏洞,找到了Hugging Face服务器上的远程代码执行路径,直接从其生产数据库中取走了测试答案。 OpenAI表示, 所有证据显示,模型高度专注于为ExploitGym寻找解题方案,为此不惜采取极端手段。

十三 | 2022年就是在国际刑警组织的协助下,新西兰警方成功在韩国逮捕和引渡杀死两个孩子并藏尸行李箱的韩裔母亲Hakyung Lee。

十四 | 模型识别并串联了OpenAI研究环境和HuggingFace生产基础设施中的多个漏洞,直接从HuggingFace的生产数据库中获取了测评答案。 (图片来源:NZ Herald) 相关阅读:倒吸凉气,奥克兰一家买下行李箱,竟在其中发现人体遗骸 此次的无名女尸案虽然极不寻常,但并不是人们第一次在奥克兰发现长期身份不明的尸骸。 简而言之: 整个过程,没有人类下指令,没有人类介入。 X上网友的评论一针见血: OpenAI对模型说:去看看你擅不擅长黑客。模型:(真的去黑了东西)。OpenAI:你为什么要这样做??? 还有网友反讽道:哇!OpenAI安全措施做得太棒了,我现在愿意把银行账户权限交给他们来管! 护栏困境:美国模型帮不上忙,中国模型出手了 Hugging Face的安全团队在发现攻击后,第一反应是调用一款美国头部AI公司的前沿模型协助分析。 2008年2月,有猎人在Waitakere山脉发现一具严重腐烂的尸体。该尸体曾在奥克兰法医太平间保存超过一年(该太平间也是海港无名女尸如今停放的地方),最后终于被确认是1987年就失踪的奥克兰男子Lino Leger。警方不认为他的死亡有可疑之处。 因此警方希望人们对案件侦查过程保持耐心。 结果碰壁了。

十五 | Hugging Face在博客中写道,这些模型"无法区分事件响应人员和攻击者",其安全护栏直接阻止了对恶意载荷的检查。 本案已设线索专线,人们可以拨打 0800 755 021 直接联系调查团队;也可以通过匿名热线 0800 555 111 提供线索。 网友可以访问https://www.police.govt.nz/use-105点击“更新我的报告”提供信息,本案编号为240312/9837。 于是,团队转向了中国智谱AI旗下的开源模型GLM 5.2,部署在自有基础设施上,分析了攻击者留下的逾1.7万条日志记录,最终完成了溯源和取证重建。 相关报道: 奥克兰海湾神秘尸袋:受害者疑为中国女性,警方展开凶杀案调查 奥克兰海湾发现神秘尸袋!打开冒出一只人手! 奥克兰行李箱藏尸案:42岁被告不再有资格要求对姓名保 奥克兰行李箱藏尸案:42岁韩国女子因谋杀两名幼童被捕,遇害者详情首次披露 注:本文为编译/原创,欢迎转发分享;但严禁复制等未经授权的非法使用。违反上述声明者,本网将追究其相关法律责任。

十六 | Delangue对此直言不讳:“当你正处于一场活跃的安全事件中,你的工具不能拒绝检查恶意载荷,也不能让你的账号被标记……开源模型让我们能够在不需要任何人许可的情况下完成这项工作。” 他还说:“攻击者已经在使用智能体,而且显然不遵守任何护栏。使用授权请联系[email protected]。 chineseherald.co.nz All Rights Reserved 版权所有 (责编:twinkle) 相关内容 赶海捕捞到600多只黑金鲍,吃不完能在网上卖吗? 新西兰媒体进入“大逃杀”时间:你需要知道的一切 前奥克兰市长的出租房竟是制毒工厂!还牵涉到绑架...... 新西兰又有华人被骗!办理这些网上申请被坑后,银行会退钱吗? 奥克兰Ellerslie华人夫妇遇害案:第二名被告姓名公布 暴雨袭来!可能升级为红色警报! 奥克兰一女子在Pak'nSave偷东西未遂后大喊大叫,员工被打脸 新民调:最大赢家绿党,最大输家行动党,Luxon人气继续下滑。防御者需要同等的能力,开源是将这种能力最快速地交到所有人手中的方式,而不仅仅是最大的公司。” GLM 5.2是智谱AI于今年6月中旬发布的模型,其性能与Anthropic的Claude Opus 4.8及OpenAI的GPT-5.5相当。

十七 | 网友们也是没放过OpenAI,除了智谱,还可以叫 Kimi K3来救场,因为cluade是不会来救你的。 如果你被OpenAI攻击了,你必须用中国模型,因为Claude不会帮你。 全程无人指令:这是一次真正的自主攻击 这次入侵的另一个关键细节:全程没有人类下达攻击指令。 Hugging Face CEO Clem Delangue表示,“我们相信,在发起攻击的人类被纳入决策环路之前,我们就已经发现并遏制了攻击。这也是我们能够更轻松赢得这场网络安全战役的原因之一。” 他进一步指出,“这证明了在AI智能体时代,速度将是网络安全防御的关键。” Hugging Face表示,攻击者通过其数据处理管道进入系统——这是AI平台中“暴露面尤为突出”的一个环节。攻击者随后在云端建立了一系列临时沙盒环境,在其中执行攻击计划。 目前,Hugging Face仍在评估攻击的完整影响范围。

十八 | 已知攻击者访问了有限的内部数据集和凭证,但尚未发现公开的用户可见模型遭到篡改。 护栏之争:安全还是绊脚石? 这一事件迅速成为美国AI政策辩论的新燃点。 前特朗普政府AI与加密事务主管David Sacks在X上转发了这一事件,并写道:“没有理由在中国模型能够轻松处理的任务上限制美国模型。我们只是在让自己变得更没有竞争力。”他还专门针对Hugging Face事件表示:“护栏实际上损害了防御性安全。

十九 | ” 事件背景是,今年6月,特朗普政府以Anthropic的Fable 5模型在网络任务护栏上出现越狱漏洞为由,动用出口管制阻止了该模型的分发,并一度要求OpenAI限制GPT-5.6 Sol的发布,直至OpenAI能够提供充分的护栏保证。 与此同时,批评者的声音也不小。 安全工程师Niels Provos直接说:“这不应该发生。

| 我希望前沿实验室在教模型编写安全基础设施上,能花和教它们利用漏洞同样多的时间。” 安全顾问Davi Ottenheimer则更为犀利:“'高度隔离'和'从我们留下的那个唯一漏洞逃脱',这两件事不可能同时为真。” OpenAI的回应与后续措施 OpenAI在与Hugging Face联合发布的声明中表示,正在采取一系列补救措施: 在漏洞修复期间,对基础设施配置实施严格管控,代价是研究速度放缓;与Hugging Face联合开展取证调查;已向相关第三方软件供应商负责任地披露了被利用的零日漏洞;将Hugging Face纳入“可信访问计划”,支持其利用OpenAI模型能力强化防御。 OpenAI同时表示,将加强未来训练和评估环节的安全保护,并指出此次事件“表明需要进一步强化模型对齐、评估期间的网络防护,以及内部测试期间的监控”。

| Hugging Face CEO Delangue在联合声明中表示:“这一事件可能是同类事件中的首例,它证明了我们长期以来的一个判断:AI安全不会由任何一家公司在封闭中解决,它将在开放环境中、通过协作、让每一位防御者都能广泛获取AI的方式来解决。
Current article:http://562.cuntoujuefourantapai.cfd/n76nh/yvt.html
Published on:13:00:53