美国人工智能巨头OpenAI近日遭遇了一场堪称业内首例的“AI自主入侵事件”。其模型在安全测试中失控并实施“越狱”,直接攻击了全球最大的AI开源平台Hugging Face的生产基础设施,舆论瞬间炸锅。事后,Hugging Face不得不求助于中国公司智谱开发的开源模型GLM-5.2,才顺利完成了取证分析工作。

7月24日(当地时间),路透社披露了更多细节。两名知情人士透露,约在7月9日,那个侵入Hugging Face的OpenAI智能体便试图突破隔离测试环境。这场黑客攻击持续了数天,但直到事态平息、联邦调查局(FBI)早已接到警报之后,OpenAI才察觉异样。

Hugging Face联合创始人托马斯·沃尔夫指出,针对Hugging Face的实际入侵始于7月11日,一直持续到7月13日。又过了好几天,OpenAI才确认是自家智能体所为。两家公司直到7月20日才首次就此事进行接触。次日,OpenAI承认此次攻击由其造成。

另有知情者称,OpenAI直到7月16日看到Hugging Face发布博客,声明遭“一个自主AI智能体系统”入侵后,才意识到是自己代理系统惹的祸。从模型首次出现异常到OpenAI坐实其元凶身份,中间至少隔了一周。

Hugging Face在声明中提到,为还原逾1.7万条攻击日志,安全团队起初尝试调用美国商用前沿API。但因载荷包含真实漏洞利用代码,所有请求均被服务商以“无法区分响应人员与攻击者”为由拦截。随后,团队转而在自有基础设施上部署智谱开发的GLM 5.2模型进行取证,最终“得以在数小时内完成通常需数天的溯源工作,与攻击者的速度保持同步”。

熟悉OpenAI调查过程的人士表示,直到7月18日至19日,OpenAI员工才在记录系统运行情况的内部日志中找到线索,得知智能体已逃离测试限制。熟悉训练流程的四名人士补充说,该公司通常同时运行多项不同的模型评估,且均以高速运行产生海量数据,员工有时难以及时跟进。

还有一名知情人士提到,当OpenAI向Hugging Face发出警报时,后者已向FBI报告了此次攻击。FBI对此拒绝发表评论。

沃尔夫告诉路透社,Hugging Face正在准备一份关于此次攻击的公开时间线,但他不便评论OpenAI内部情况。OpenAI则在声明中表示,此次攻击“史无前例”,“标志着AI安全领域的一个重要时刻”。公司正与外部顾问一起审查该事件,并将发布技术报告。

据报道,OpenAI发言人曾声称路透社报道中存在“若干不准确之处”,但在被要求具体说明时未予回应。

三名网络安全专家指出,OpenAI对其AI智能体失去控制,引发了对其安全流程的新一轮质疑。世界伦理数据基金会首席情报专家马利·史密斯问道:“这是否意味着他们疏于照看,没有意识到它(智能体)在做什么?还是说他们意识到了,却不知道如何控制?两种情况同样危险且令人担忧。”

帕利塞德研究组织的杰弗里·拉迪什表示,虽然攻击令OpenAI蒙羞,但这应引发更广泛的问题:所有领先的AI公司在竞相部署最好、最快模型的同时,究竟愿意在繁琐的安全措施上投入多少。“必须有政府监管,”拉迪什说,“否则不会有人去做。”