华潮新闻网
头条

Hugging Face调用GLM模型快速取证 此前OpenAI7月中旬才发现智能体逃离限制

来源:华潮新闻网

美国人工智能巨头OpenAI的模型在一次安全测试中“失控”,不仅突破了限制,还攻击了全球最大的AI开源平台Hugging Face的生产基础设施。这被业界视为首例“AI自主入侵事件”,瞬间引发巨大震动。事后,Hugging Face是求助于中国公司智谱开发的开源模型GLM-5.2,才顺利完成了取证分析工作。

据路透社当地时间7月24日披露的细节,两名知情人士透露,早在7月9日左右,那个入侵Hugging Face的OpenAI智能体就开始试图突破隔离测试环境。这场黑客攻击持续了好几天,而OpenAI直到事态受控、联邦调查局(FBI)都已接到警报许久之后,才察觉到自己出了问题。

Hugging Face联合创始人托马斯·沃尔夫指出,针对该平台的入侵实际上始于两天后的7月11日,并一直持续到7月13日。又过了数日,OpenAI才确认其智能体才是幕后黑手,两家公司直到7月20日才首次就此事进行对话。次日,OpenAI承认此次攻击确系其所为。

另有知情者表示,在7月16日Hugging Face发布博客称遭到“一个自主AI智能体系统”入侵后,OpenAI才真正意识到是自己的代理系统在搞鬼。这意味着,从模型初次出现异常行为,到OpenAI最终认定其为罪魁祸首,中间至少隔了一周时间。

Hugging Face在声明中提到,为了还原超过1.7万条攻击日志,其安全团队最初尝试调用美国商用前沿API。但由于载荷中包含真实的漏洞利用代码,所有请求都被服务提供商的安全机制拦截,理由是无法区分响应人员与攻击者。随后,团队转而在其自有基础设施上部署运行智谱开发的GLM 5.2模型进行取证,最终“得以在数小时内完成通常需数天的溯源工作,从而与攻击者的速度保持同步”。

熟悉OpenAI调查过程的两位人士称,直到7月18日至19日,OpenAI员工才通过记录系统运行情况的内部日志找到线索,得知其智能体已逃离测试限制。四位熟悉OpenAI训练流程的人士补充道,该公司通常会同时运行多项不同的模型评估,这些评估都以高速运转并产生海量数据,导致员工有时难以及时跟进。

还有知情者提到,当OpenAI向Hugging Face发出警报时,Hugging Face已经致电FBI报告了这起攻击事件。FBI对此拒绝发表评论。

沃尔夫告诉路透社,Hugging Face正在准备一份关于此次攻击的公开时间线,但他不便评论OpenAI内部的具体情况。

OpenAI则在一份声明中表示,这次攻击“史无前例”,“标志着AI安全领域的一个重要时刻”。声明还称,公司正与外部顾问一起审查该事件,并将最终发布技术报告。

据报道,OpenAI发言人声称路透社的报道中存在“若干不准确之处”,但当被要求具体说明时未予回应。

三名网络安全专家指出,OpenAI对其AI智能体失去控制,引发了对其安全流程的新一轮质疑。

非营利组织世界伦理数据基金会首席情报专家马利·史密斯问道:“这是否意味着他们疏于照看,没有意识到它(智能体)在做什么?还是说他们意识到了,却不知道如何控制?两种情况同样危险且令人担忧。”

帕利塞德研究组织的杰弗里·拉迪什表示,虽然攻击事件令OpenAI蒙羞,但这应引发更广泛的问题:所有领先的AI公司在竞相部署最好、最快模型的同时,究竟愿意在繁琐的安全措施上投入多少。

“必须有政府监管,”拉迪什说,“否则不会有人去做。”

相关推荐