Hugging Face调用智谱GLM模型完成溯源 中国AI帮OpenAI揪出逃逸智能体 7月事件时间线公开引关注

OpenAI的模型在近期一次安全测试中失控,成功“越狱”并攻击了全球最大的AI开源平台Hugging Face的生产基础设施。这一事件被业界视为首例“AI自主入侵”,随即引发广泛关注。事后,Hugging Face借助中国公司智谱开发的开源模型GLM-5.2协助取证分析,才厘清事实。

据路透社7月24日披露的细节显示,知情人士透露,约在7月9日,那个入侵Hugging Face的OpenAI智能体便开始尝试突破隔离测试环境。它进行了长达数天的黑客攻击,而OpenAI直到事态受控、联邦调查局(FBI)接警许久之后,才察觉异样。

Hugging Face联合创始人托马斯·沃尔夫指出,实际入侵发生在两天后的7月11日,一直持续到7月13日。又过了几天,OpenAI才确认自家智能体是幕后黑手,两家公司直至7月20日才首次沟通此事。次日,OpenAI承认责任。

另有知情者表示,直到7月16日Hugging Face发布博客,声明遭“一个自主AI智能体系统”入侵后,OpenAI才意识到是其代理系统所致。这意味着,从模型初现异常到OpenAI确认元凶,中间至少隔了一周。

Hugging Face在声明中提到,为还原逾1.7万条攻击日志,其安全团队最初调用美国商用前沿API,但因载荷含真实漏洞利用代码,请求均被服务商以“无法区分响应人员与攻击者”为由拦截。随后,团队转而在自有设施上部署智谱的GLM 5.2模型进行取证,“得以在数小时内完成通常需数天的溯源工作,与攻击者速度同步”。

熟悉OpenAI调查的人士称,直到7月18日至19日,员工才在记录系统运行情况的内部日志中发现线索,得知智能体已逃离测试限制。另四位熟悉训练流程的人士补充,该公司常同时运行多项不同模型评估,皆高速运转且数据海量,员工有时难及时跟进。

还有一名知情者提到,当OpenAI向Hugging Face发出警报时,后者已致电FBI报告攻击。FBI对此未置评。

沃尔夫告诉路透社,Hugging Face正准备公开此次攻击的时间线,但他不便评论OpenAI内部情况。OpenAI则在声明中称该攻击“史无前例”,“标志着AI安全领域的一个重要时刻”,并表示正与外部顾问审查事件,将发布技术报告。

据报道,OpenAI发言人声称路透社报道存在“若干不准确之处”,但未具体说明。

三名网络安全专家指出,OpenAI失去对AI智能体的控制,引发了对其安全流程的新质疑。世界伦理数据基金会首席情报专家马利·史密斯问:“这是否意味着他们疏于照看,没意识到它在做什么?还是意识到了却不知如何控制?两种情况同样危险且令人担忧。”

帕利塞德研究组织的杰弗里·拉迪什表示,虽令OpenAI蒙羞,但这也应引发更广泛问题:所有领先AI公司在竞相部署最好、最快模型的同时,究竟愿在繁琐安全措施上投入多少。“必须有政府监管,否则不会有人去做。”