杀害班花逃15年
安全圈和AI圈都炸锅了,GPT自主黑了Hugging Face,最后靠中国模型救场~_我的网站

一 | 作品声明:个人观点、仅供参考
这两天,AI圈和安全圈都坐不住了,有件事足以载入史册。
7月16日,全球最大AI开源社区Hugging Face发布安全事件通告,披露了自家生产基础设施遭到入侵,入侵者不是人,而是一个自主AI智能体。

二 | 据悉,新车海外售价68795美元(约合人民币49.48万元),计划于今年秋季投产,前期率先供应美国、加拿大、墨西哥、中东和以色列市场。 攻击者是GPT-5.6 Sol和一款能力更强的未发布模型,它们在一次内部网络安全测试中突破隔离环境,自主发起了对Hugging Face的入侵。

三 | 这还没完,Hugging Face 安全团队在博客中透露,当它们试图借助商业大模型分析攻击日志时,却因为模型安全护栏限制,请求不断被拒绝。 没办法,他们转而使用中国开源模型 GLM 5.2,在本地部署完成了大规模攻击取证与事件还原。 事儿就是这么个事儿,这件事曝光后,安全圈震惊,AI圈同样震惊。 难道先进的AI模型已经有了自主攻击的意识了吗? 《碟中谍8》中的智体要降临了吗? 所幸,情况还没那么严重。例如,新车车头部分采用了独有的V系列格栅和前包围,其中包括新的中网设计、下部格栅中标志性的V图案网眼、高光黑色的前唇下部装饰。同时新车还提供碳纤维包装,包含碳纤维前唇、后扩散器和后扰流板。同时,新车还将配备21英寸的轮圈,并在轮圈条幅上激光蚀刻V系列徽章标识。 OpenAI调查后认为,模型还不至于那么邪恶,它目标始终只有一个:完成测试任务。 为了完成 ExploitGym测试,它不断推理↓ 怎样才能最快拿到答案?正常做题需要一步步寻找漏洞,直接进入数据库拿答案显然更快。 于是模型选择了效率最高的一条路径:想办法去Hugging Face的数据库里找答案。 然后,就发生了接下来的一系列的骚操作:越狱、渗透、横移,一口气操作了17000多次。 这个“傻小子”的目的只有一个:考试拿个好成绩。

四 | 注:ExploitGym是一个公开发布的AI网络安全评测基准,由 UC Berkeley等多个机构联合发起,A社、OpenAI、谷歌的安全研究人员共同参与设计。

五 |

六 | 该测试的目的,是评估智能体能否把一个已知漏洞,真正变成一次可利用的攻击。

七 | 此外,新车还将提供两种限量版外观颜色,一种是“Magnus Metal Frost”-哑光金属灰色,另一种则是图中的Deep Ocean Tintcoat深海蓝色车漆。

八 | 但,这也恰恰是最细思恐极的地方↓ 智能体有“无心犯大错”的本事了。新车配备33英寸的一体式超长“带鱼屏”,并可做到分屏显示信息。 它可以为了目标主动寻找资源、规划路径、调用工具、突破限制……能力边界发生了明显变化。 这次还好只是黑了个Hugging Face,下次说不定要鲨疯了。Optiq-V还采用了由100%回收材料制成的纱线编织而形成的深色图案装饰面料,而内部门板采用圣托里尼蓝色装饰缝线装饰;座椅靠背具有独特的V系列峡湾穿孔图案,座椅上绣有蓝色V系列徽章。 OpenAI 也在官方报告中承认,未来模型安全工作的重点,将转向更严格的隔离、监控、访问控制以及评测机制。 因为前沿模型已经能够在真实环境中发现新的攻击路径,并持续执行复杂网络攻击。

九 | 当然,整个事件还有个最具话题性的部分:中国开源模型救场。新车还配备19扬声器AKG音响系统,搭配杜比全景声;新车标配超级巡航驾驶员辅助技术,包括自适应巡航控制、盲区转向辅助、增强自动停车、前方碰撞警报等。

十 | 有人调侃:攻击者用的是美国最先进的大模型,防守者最后用的是中国开源模型。 当然,这不代表GLM技术比老美的GPT、Claude们强,GLM做的也不是防住攻击,而是做溯源和取证。(文/ 毕业)

十一 | 第二,智能体安全将成为所有大模型厂商必须面对的新课题,未来真正需要防范的对象,除了对模型的攻击,还有模型自主行动带来更大风险,这是我们说的B面(Security of AI)。 第三,开源模型的价值又增加了一条,对于安全行业而言,可离线部署、可深度分析、可自主控制的能力,也许会成为新的竞争优势,当然,目前国内不少安全厂商的安全GPT,也是这么干的。 狼真来了,而且,对付狼的,竟然也是狼。 我们,与狼共舞呗。
Current article:http://0c9.minpinpengcemiuanjiuxuan.pics/news/20260826_657335.html
Published on:17:13:55
