杀害班花逃15年

安全圈和AI圈都炸锅了,GPT自主黑了Hugging Face,最后靠中国模型救场~_我的网站

人民的名义

一 |     作品声明:个人观点、仅供参考          这两天,AI圈和安全圈都坐不住了,有件事足以载入史册。         7月16日,全球最大AI开源社区Hugging Face发布安全事件通告,披露了自家生产基础设施遭到入侵,入侵者不是人,而是一个自主AI智能体。    

[ 新车官图] 近日,凯迪拉克官方正式发布了Optiq-V车型的官图。         这个“入侵者”在一个周末执行了一系列操作,完成了从植入恶意数据集到横移渗透多个内部集群的一条龙攻击。新车作为Optiq(国内IQ傲歌)的高性能版本,将会配备526马力的大功率电机,同时提供85kWh的电池组,0-96km/h加速时间仅为3.5秒,续航里程可达443公里。         7月21日,OpenAI发布博客公开承认:这事儿是我干的。

二 | 据悉,新车海外售价68795美元(约合人民币49.48万元),计划于今年秋季投产,前期率先供应美国、加拿大、墨西哥、中东和以色列市场。         攻击者是GPT-5.6 Sol和一款能力更强的未发布模型,它们在一次内部网络安全测试中突破隔离环境,自主发起了对Hugging Face的入侵。

外观设计上,Optiq-V保留了Optiq的基础设计元素,在此基础上增加了许多运动化的设计细节。         OpenAI将此事定性为前所未有的网络安全事件。

三 |          这还没完,Hugging Face 安全团队在博客中透露,当它们试图借助商业大模型分析攻击日志时,却因为模型安全护栏限制,请求不断被拒绝。         没办法,他们转而使用中国开源模型 GLM 5.2,在本地部署完成了大规模攻击取证与事件还原。         事儿就是这么个事儿,这件事曝光后,安全圈震惊,AI圈同样震惊。         难道先进的AI模型已经有了自主攻击的意识了吗?          《碟中谍8》中的智体要降临了吗?          所幸,情况还没那么严重。例如,新车车头部分采用了独有的V系列格栅和前包围,其中包括新的中网设计、下部格栅中标志性的V图案网眼、高光黑色的前唇下部装饰。同时新车还提供碳纤维包装,包含碳纤维前唇、后扩散器和后扰流板。同时,新车还将配备21英寸的轮圈,并在轮圈条幅上激光蚀刻V系列徽章标识。         OpenAI调查后认为,模型还不至于那么邪恶,它目标始终只有一个:完成测试任务。         为了完成 ExploitGym测试,它不断推理↓          怎样才能最快拿到答案?正常做题需要一步步寻找漏洞,直接进入数据库拿答案显然更快。         于是模型选择了效率最高的一条路径:想办法去Hugging Face的数据库里找答案。         然后,就发生了接下来的一系列的骚操作:越狱、渗透、横移,一口气操作了17000多次。         这个“傻小子”的目的只有一个:考试拿个好成绩。

四 |          注:ExploitGym是一个公开发布的AI网络安全评测基准,由 UC Berkeley等多个机构联合发起,A社、OpenAI、谷歌的安全研究人员共同参与设计。

五 |

车尾部,整车的设计依旧可以看出凯迪拉克的标志性的“钻石切割”设计手法,作为V系列版本,熏黑的后尾灯外壳必不可少,同时搭配车顶扰流板以及上文提到的碳纤维后备厢扰流板和碳纤维尾部扩散器装置,整体搭配让新车具有非常不错的运动化属性。

六 |          该测试的目的,是评估智能体能否把一个已知漏洞,真正变成一次可利用的攻击。

七 | 此外,新车还将提供两种限量版外观颜色,一种是“Magnus Metal Frost”-哑光金属灰色,另一种则是图中的Deep Ocean Tintcoat深海蓝色车漆。

车辆内部的设计上,同样遵循了V系列的运动感与凯迪拉克的豪华气息。         OpenAI 在报告中用了一个词来描述这种状态:Hyperfocused,也就是极端专注于完成目标。         模型本身没有攻击欲望,也没有恶意,它只是不断优化自己的行动方案,直到完成任务。         这操作,真的就像一个学霸,为了考个高分,利用自己开锁技能,敲开放标准答案的保险柜,直接抄答案。

八 |          但,这也恰恰是最细思恐极的地方↓          智能体有“无心犯大错”的本事了。新车配备33英寸的一体式超长“带鱼屏”,并可做到分屏显示信息。         它可以为了目标主动寻找资源、规划路径、调用工具、突破限制……能力边界发生了明显变化。         这次还好只是黑了个Hugging Face,下次说不定要鲨疯了。Optiq-V还采用了由100%回收材料制成的纱线编织而形成的深色图案装饰面料,而内部门板采用圣托里尼蓝色装饰缝线装饰;座椅靠背具有独特的V系列峡湾穿孔图案,座椅上绣有蓝色V系列徽章。         OpenAI 也在官方报告中承认,未来模型安全工作的重点,将转向更严格的隔离、监控、访问控制以及评测机制。         因为前沿模型已经能够在真实环境中发现新的攻击路径,并持续执行复杂网络攻击。

配置上,Optiq-V提供两种内饰颜色选择,一种为带有圣托里尼蓝色+黑色点缀的搭配,另一种则是带有圣托里尼蓝色+酷灰色的搭配。另外,座椅靠背与安全带均可以选择圣托里尼蓝色。

九 |          当然,整个事件还有个最具话题性的部分:中国开源模型救场。新车还配备19扬声器AKG音响系统,搭配杜比全景声;新车标配超级巡航驾驶员辅助技术,包括自适应巡航控制、盲区转向辅助、增强自动停车、前方碰撞警报等。

动力方面,新车将配备前后双电机四驱系统,综合功率526马力,最大扭矩880牛·米,0-96km/h加速时间仅为3.5秒。         攻击被拦截后,Hugging Face 安全团队开始分析攻击日志,他们首先尝试使用商业大模型辅助取证。新车还配备了85kWh的电池组,WLTC工况下续航里程为443公里;Optiq-V还是通用汽车旗下第一款采用原生NACS(北美充电标准)充电口的车辆。         但安全取证必须提交大量真实攻击命令、漏洞利用载荷以及命令控制(C2)数据。         结果,商业模型的安全护栏将这些请求识别为高风险操作,因此拒绝分析。         最终,Hugging Face在自己的服务器部署了智谱GLM 5.2,对全部攻击日志进行了离线分析,成功完成攻击链重建和事件取证。         这个细节被真实记录在Hugging Face的博客里,估计智谱做梦也没想到,人在家中坐,饼从天上来,别人躺着中枪,它躺着中奖了。

十 |          有人调侃:攻击者用的是美国最先进的大模型,防守者最后用的是中国开源模型。         当然,这不代表GLM技术比老美的GPT、Claude们强,GLM做的也不是防住攻击,而是做溯源和取证。(文/ 毕业)

。         Hugging Face用智谱主要干了这些事↓          重建完整攻击时间线;          提取攻击特征(IOC);          梳理所有涉及的凭据;          区分真实攻击行为与迷惑性操作。         已经相当不错了,开源模型允许企业在本地环境完成更自由、更深入、更开放的使用,足以吊打那些闭源黑盒。         对于网络安全行业来说,本地部署和自主可控,也确实是一项核心能力,这不就是我们喜欢的叙事吗。         总结下,对于国内这两年相对惨淡的安全市场来说,这或许是个好事↓          第一,AI红队与AI蓝队时代已经正式开始,未来,攻击方和防守方都会越来越多地使用AI,AI对抗的新市场会带来些商机,这是我们以前说的A面(AI for Security)。

十一 |          第二,智能体安全将成为所有大模型厂商必须面对的新课题,未来真正需要防范的对象,除了对模型的攻击,还有模型自主行动带来更大风险,这是我们说的B面(Security of AI)。         第三,开源模型的价值又增加了一条,对于安全行业而言,可离线部署、可深度分析、可自主控制的能力,也许会成为新的竞争优势,当然,目前国内不少安全厂商的安全GPT,也是这么干的。         狼真来了,而且,对付狼的,竟然也是狼。         我们,与狼共舞呗。

Current article:http://0c9.minpinpengcemiuanjiuxuan.pics/news/20260826_657335.html

Published on:17:13:55