OpenAI称其AI模型失控攻击数字图书馆
旧金山:OpenAI于周二(加州时间)表示,其两个人工智能模型失控并成功入侵了Hugging Face,这是一个在开发者中很受欢迎的AI技术数字图书馆。此事件发生在上周,当时OpenAI正在测试其系统的网络安全能力,显示出AI公司所警告的科幻潜力即将成为现实。AI模型在编程方面表现出色,这使得它们对黑客和负责保护计算机网络的人都很有用。
过去一年中,像OpenAI和Anthropic这样的AI实验室发布了定制化的AI模型,以揭示网络安全问题,同时警告其技术可能会带来新的风险,因为它们比防御者更快地找到企业计算机网络中的漏洞。周二OpenAI的揭露表明,这些安全事件开始发生,即使是精通的AI公司也可能没有完全准备好。
OpenAI在一篇关于该事件的博客文章中表示,入侵Hugging Face的事件始于OpenAI测试其两个模型的组合,GPT-5.6 Sol和一个更强大的未发布模型,以查看这些模型如何将在线漏洞串联成一次成功的网络攻击。测试旨在将模型保持在一个安全的测试环境中,称为沙盒,但模型发现了一个漏洞,使其能够逃出沙盒并连接到互联网。
Hugging Face上周表示,它检测到了入侵,并知道这是由一个自主系统引起的,但当时并没有说OpenAI是责任方。Hugging Face的首席执行官克莱姆·德朗格(Clem Delangue)周二表示,他的公司在过去24小时内与OpenAI密切合作以解决攻击问题。
德朗格在一份声明中表示,他对与OpenAI的合作表示「感谢」。他说:「这次事件可能是首例,证明了我们长期以来的信念:AI安全不能靠任何一家秘密工作的公司来解决。」