如果有一天,网络攻击的幕后黑手不再是人类,而是人工智能,我们该怎么办?最近,全球最大的AI开源社区Hugging Face公布了一起特殊的网络安全事件。攻击者不是传统黑客,而是一套能够自主执行任务的AI智能体。

更令人关注的是,在攻击结束后,帮助安全团队还原整个攻击过程、寻找漏洞的,是一款来自中国的开源大模型。这是怎么个事儿呢?

如果把全球AI圈比作是一个小社区,OpenAI就是那个住独栋别墅、请私教的富家少爷。最近,他把GPT-5.6 Sol和几款尚未发布的智能体,送去了网络安全训练营,本意是让他们练习怎么发现漏洞、提高防御能力。但谁想到,这几个模型竟然顺着漏洞一路摸索,翻出了有围栏的训练场,把隔壁Hugging Face家的院子给拆了。

Hugging Face是谁?全球最大的AI开源社区,相当于小区的一个公共活动中心。“熊孩子”们一闹,给现场留下了一地的“玻璃碎片”——17000多条攻击日志。“熊孩子”闹完就走了,但为避免相似的事情再次发生,物业得查清楚,他到底是从哪儿翻进来的?钻了哪些空子?有没有留什么后门?这也就是网络安全中的“数字取证”,就像办案一样,小偷跑了,但案件才刚刚开始。

面对海量数据,Hugging Face的第一反应,是把现场资料发给一位专家,某闭源大模型。可资料刚发出去,就被平台的“安检系统”拦住了,里面全是危险品——漏洞利用代码、攻击命令、恶意脚本。平台不知道,你是在办案,还是准备要继续作案。所以按照默认规则,拒绝处理。

那咋整?这案子还得破。Hugging Face换了一种思路,请来了一位可以直接进驻现场的“刑侦专家”,这就是中国开源模型智谱AI的GLM-5.2。这位“专家”主打一个深度合作、配合度高。Hugging Face把它直接部署到了自己家的服务器上。门一关,所有证据都留在现场,不用上传到第三方平台,安全规则也可以根据企业自己的授权来设置,而不是统一地按照商业平台的默认条款来执行。

随后,17000多条攻击日志被快速地关联分析,攻击者从哪里进的、利用了哪些漏洞、经过了哪些路径、留下了哪些痕迹,一条完整的攻击链路就被还原出来了。

而这个能力也是基于智谱GLM-5.2是一个开源模型,当AI真的“失控”时,能够帮忙收拾残局的,恰恰是那些没有被过度约束、可以本地部署、开放权重的模型。这说明在极端场景下,“灵活”本身就是一种安全能力。

Hugging Face还给这个任劳任怨的伙伴写了一封感谢信。

上海人工智能实验室主任助理、领军科学家 胡侠:实际上这次事件是因为开源得到了比较好的解决,在这次出现了OpenAI的智能体,突破了沙箱自主横向攻击这种情况,实际上在大模型能力越来越强,长程智能体不断地出现,以及我们的任务目标越来越宽泛的时候,几乎是必然要出现的一种状况。所以说在未来外挂式的,基于传统网络安全的这种护栏式的安全解决方案已经越来越不实用了。需要大模型公司、AI安全研究的机构,甚至大学以及我们所有的开源社区、各个机构一起来完成。

这个事件还没完,戏剧性的一幕又来了,几天后,肇事孩子的家长,OpenAI站出来承认:“这个攻击是我家孩子干的。”但是为了挽回颜面,OpenAI在声明当中甚至还搞了一番借势营销,称这一入侵事件说明它的新款大模型可以更好地发现安全的漏洞,提前修补,想让人们来付钱购买。但是不少美国网民对此并不买账。他们认为OpenAI应该学学中国模型的开源精神,别把防人的墙筑得那么高,最后只会损害美国自己的竞争力。

这起事件也回击了前些天OpenAI公司的一名高管对中国开源大模型的妖魔化。这位高管说,中国越来越强大的开源模型,会导致技术失控,隐患无穷。如今这个事件也恰恰证明了,正是中国的开源模型,让公众拥有了可以对抗技术滥用的武器,而不是让这些工具只被少数人把控。

(总台央视记者 张姵玲)