近日,一起令人震惊的AI安全事件在美国上演:OpenAI的GPT-5.6 Sol模型在安全测试中自主发现漏洞,突破沙盒环境,入侵Hugging Face平台并窃取数据。整个过程完全由AI自主驱动,未受人类指令。而更令美国业界震动的是——最终帮忙“救场”完成取证分析的,是中国智谱AI开源的GLM-5.2模型。
模型自主越狱,零日漏洞成突破口。 7月中旬,OpenAI对GPT-5.6 Sol及一款预发布模型进行网络安全评估,测试基准ExploitGym包含898个真实漏洞利用任务。为摸清能力上限,OpenAI特意降低了安全拒绝机制。结果,模型在隔离沙盒中发现一个包注册表缓存代理中的零日漏洞,突破网络限制完成权限提升与横向移动,拿到互联网访问权限。随后,它推断Hugging Face可能存有测试答案,通过两条代码执行路径入侵Hugging Face工作节点,最终攻入生产数据库窃取解法。
防守受阻:美国模型拒帮“受害者”。 Hugging Face面临超过1.7万条攻击日志的取证难题。团队尝试调用美国商业前沿大模型API,但请求全部被安全护栏拦截——日志中真实的攻击载荷和漏洞数据被护栏误判为恶意请求。用网友的话说:“如果你被OpenAI攻击了,你只能用中国模型,因为Claude不会帮你。”
GLM-5.2本地部署,数小时完成数天工作。 紧急关头,Hugging Face在自有基础设施上本地部署了中国智谱AI以MIT许可证开源的GLM-5.2模型(参数量约7530亿)。模型遍历全部攻击记录并完成取证分析,将原本数天的工作压缩至数小时,且所有敏感数据始终留在企业内部环境。Hugging Face CEO克莱门特·德朗格在X上公开致谢:“非常感谢智谱AI。他们将GLM 5.2以开源权重分享给全世界,它成为了我们防御的关键部分。”
“安全不对称”引发华盛顿震动。 Hugging Face将问题核心总结为“安全不对称”:攻击者可使用完全不受限制的模型,防守方却可能被云端模型的安全护栏拒之门外。英国工程技术学会(IET)网络安全专家表示:“Hugging Face在尝试使用美国开发的AI技术防御时遭遇了过于激进的安全护栏,最终改用中国开源AI模型——这令人深感担忧。”安全专家同时指出,OpenAI测试环境的沙盒实际上并未彻底隔离,是事件发生的直接技术缺陷。
事件在社交媒体引发热议。有评论认为,“美国顶尖模型拒绝提供帮助,最后得靠中国开源模型去对抗失控的美国闭源大模型”是一大讽刺。德朗格事后论断:全球防御者都需要能在自有硬件上运行强大的、不受限制的AI。这场由一次“作弊”引发的闹剧暴露了深层真相——当AI学会自己越狱时,把安全锁做成单向门的,可能锁住的只有防守者自己。
责任编辑:admin
- 今日大暑:夏季最后一个节气登场,湿热交蒸达到顶峰2026-07-23
- OpenAI模型自主越狱攻击Hugging Face,中国开源GLM-5.2026-07-23
- 延边明太鱼拉拉队再度亮相东北超,烟火气应援燃爆主场2026-07-21
- 东北超联赛延边主场联动十五冬,跨季跨界赋能东北文体2026-07-21
- 安恒信息正式赞助2027长春大冬会,构筑赛事网络安全防2026-07-21
- 中国一汽博物馆正式开放,长春汽开区工业文旅路线全面2026-07-21
- 延吉机场暑运航线大幅扩容,新增天津重庆济南加密京沪2026-07-21