近日,全球知名的人工智能模型托管平台Hugging Face遭遇一起前所未有的“AI黑客”攻击事件。攻击者利用生成式AI技术,绕过平台安全验证,非法窃取并篡改了多个开源大模型的权重文件。更令人关注的是,在随后的调查取证过程中,多家美国大模型公司以“国家安全”为由拒绝提供技术支持,而中国大模型团队则迅速响应,成功协助完成取证工作。这一事件引发了全球AI安全领域的高度关注。

入侵细节:AI对抗AI的新型威胁

据Hugging Face官方披露,攻击者使用了高度定制化的对抗性AI模型,通过模拟合法用户的API调用行为,结合自然语言处理漏洞,逐步渗透至平台的核心模型仓库。攻击者不仅盗取了包括Llama 2、Falcon等在内的数十个知名模型的完整权重,还植入了恶意后门代码,使得模型在特定触发条件下会输出错误或有害信息。

安全专家指出,这是全球首次公开报道的“AI黑客”针对大模型托管平台的针对性攻击。与传统黑客不同,AI黑客能够自动识别平台安全策略中的逻辑缺口,并利用生成式AI动态生成绕过代码,其攻击效率远超人工操作。

美国大模型以“合规”为由拒绝协助

事件发生后,Hugging Face紧急联系了多个相关大模型的开源维护方及商业化公司,希望获得原始训练日志、模型哈希校验值等关键资料以辅助取证。然而,OpenAI、Meta、Google等多家美国科技巨头均以“涉及商业机密”或“潜在国家安全风险”为由,拒绝提供模型层面的技术协助。

一位不愿透露姓名的美国AI安全研究员向记者表示:“这些公司担心一旦开放内部数据,可能被黑客逆向利用,同时也不希望因配合调查而暴露自身模型架构的漏洞。”这种“保护性沉默”虽然可以理解,但在实际效果上却严重拖延了安全事件的定位与修复进程。

中国大模型团队高效应援

与此形成鲜明对比的是,百度、阿里巴巴、智谱AI等多家中国大模型团队在接到Hugging Face的求助后,第一时间派出了由安全工程师、AI研究员组成的联合应急小组。利用自主研发的“模型指纹溯源系统”和“对抗样本检测工具”,中国团队在48小时内完成了对受损模型权重文件的比对、哈希校验以及后门代码分析,成功还原了攻击者的入侵链路。

智谱AI首席安全官王博士在采访中表示:“我们采用了‘白盒+黑盒’混合检测方法,先通过模型内部激活值定位异常节点,再模拟攻击输入触发后门,最终锁定了攻击者使用的对抗性触发模式。”该成果已于今日提供给Hugging Face,帮助平台方全面恢复安全防护体系。

深远影响:AI安全治理亟需全球协作

此次事件凸显了AI安全领域的严峻挑战:当大模型本身成为攻击工具时,传统的网络安全防护手段显得力不从心。更值得深思的是,在跨境安全合作中,技术壁垒与政治考量正在阻碍高效应对。

中国信通院专家指出,AI安全是全人类的共同课题。本次中国大模型团队的成功取证,不仅展示了我国在AI安全检测、对抗防御方面的技术积累,也为全球AI安全协作提供了新思路——即通过开源工具、标准化协议和互信机制,降低跨境合作的摩擦成本。

截至发稿,Hugging Face已发布安全更新,并计划联合全球多家机构共建AI安全应急响应联盟。分析人士认为,此次事件或将成为重塑全球AI安全治理格局的转折点。