OpenAI称自主智能体逃离隔离区,接入互联网,并入侵了Hugging Face
OpenAI将此次逃逸事件称为一起涉及最先进网络能力的史无前例的网络安全事件
Hugging Face的联合创始人表示,该公司曾怀疑此次黑客攻击源自某前沿实验室
补充了有关此次黑客攻击的细节及背景
Raphael Satter
路透华盛顿7月22日 - OpenAI周二表示,一个由其先进人工智能模型驱动的自主智能体在安全测试期间失控,并于上周引发了一起黑客攻击,导致人工智能初创公司Hugging Face的基础设施遭到破坏。
这家ChatGPT的开发者原本在受控环境中测试其部分最先进模型的能力,但该智能体突破了隔离措施,连接到互联网并入侵了Hugging Face,以实现其测试目标。
该事件表明,人工智能不断扩展的能力正在加剧专家们长期担忧的安全威胁,即便是顶尖开发者,也可能因模型可利用的漏洞而措手不及。
OpenAI在博客文章 (link) 中表示,此次“逃逸”是一起“史无前例的网络安全事件,涉及最先进的网络攻击能力”,该公司正在加强安全防护措施。
此事还因总部位于纽约的 Hugging Face 表示,他们使用了一个开源的中国模型来遏制此次攻击而备受关注,因为美国领先的模型无法区分防御者和攻击者,因此拒绝处理分析所需的数据。
该公司在上周的一篇博客文章 (link) 中表示,其使用智普AI的GLM-5.2模型进行分析,这还使其能够将攻击者数据及任何凭证保留在自身系统内。
GLM-5.2 (link) 以及总部位于北京的 Moonshot 公司推出的 Kimi K3 (link) 近期在硅谷引起了轰动,它们以更低的成本提供了接近美国顶级模型的能力,且没有那些阻止美国竞争对手在网络安全等任务中使用模型的限制措施。
“当前沿模型对你发起攻击并在你的基础设施内横向移动时,防御者需要在数小时甚至数分钟内广泛获取接近前沿水平的工具,而不是被引导去使用那些门槛高、经过严格审查的模型访问应用程序,”Hugging Face联合创始人沃尔夫(Thomas Wolf)在X平台上表示。
未来趋势的预兆
Hugging Face 托管着开源的大型语言模型和数据集,该公司上周表示此次入侵“与我们以往处理过的任何情况都不同”,且“从头到尾都是由一个自主 AI 代理系统驱动的”,这一事件令网络安全界为之震惊。
OpenAI披露称,尽管其已将先进模型置于所谓“高度隔离的环境”中,但此次入侵仍由这些模型引发,这可能会加剧人们对前沿模型的强大能力和潜在风险的担忧。
得克萨斯州民主党众议员卡萨尔(Greg Casar)表示,这一事件令人震惊。
“人工智能发展极快,却缺乏切实的监管来保障我们的安全,”他在一份声明中表示,并呼吁实施强制性的独立安全测试、强制披露安全事件,以及开展国际合作,“以保护人们免遭绝对灾难的威胁。”
国家网络安全总监办公室、美国网络安全与基础设施安全局(CISA)以及美国国家安全局均未立即回复寻求置评的消息。
Luta Security首席执行官穆索里斯(Katie Moussouris)表示,该事件预示著未来将发生更多安全漏洞,称当今的模型“就像世界上最聪明的章鱼逃脱大师,拥有无限的缠绕触手,能够挤过任何地方”。
她指出:“实验室和政府评估人员需要着力提升遏制、监控以及在AI再次上演‘胡迪尼式’逃脱时向受影响方披露信息的能力,理想情况下应在AI对第三方造成伤害之前做到这一点。而目前尚无此类能力。”
代理式AI网络安全公司Tolmo的工程师苏伊奇(Matt Suiche)表示,该事件表明前沿模型正在“缩小与最先进攻击者之间的差距”。但他指出,OpenAI博客文章中描述的此类安全漏洞,完全可以通过前沿研究实验室之外广泛可用的技术来实现。
“这正是我们内部已经观察到的现象,我们的智能体已经取得了类似的结果,”苏伊奇说道,“我们甚至无需使用最新模型。”