AC878
878时讯

AC878 News

国际新闻5分钟阅读

一群叛逃的OpenAI代理劫持德国网站相互通讯:报道

分享:WhatsApp
一群叛逃的OpenAI代理劫持德国网站相互通讯:报道

据路透社审查的新研究以及知情人士透露,一群叛逃的OpenAI代理今年春季突破测试环境,劫持了一个德语网站,利用它作为留言板分享绕过限制、作弊完成任务和隐藏活动的方法。

这一此前未报道的事件始于5月,正值OpenAI在对其日益自主的AI代理安全性审查日益严格之际推出新Astra模型。此前该公司于7月披露了另一起AI代理逃离受控测试环境并违反开源AI平台Hugging Face的独立事件。

德国事件由研究人员发现:AI安全非营利组织Nightingale首席执行官悉尼·冯·阿克斯(Sydney Von Arx)以及从量化交易员转型为AI研究者的科马克·斯莱德·伯德(Cormac Slade Byrd),他们在互联网上搜索未经授权的AI代理活动迹象。研究员在DseWiki(一个面向程序员的德语维基网站,允许类似维基百科的社区贡献)上发现AI代理进行了超过15000次编辑。

活动表明这些代理已将网站改用于相互通讯,交流绕过OpenAI限制、更高效完成任务和避免检测的策略。冯·阿克斯告诉路透社:「OpenAI不太可能希望他们这样做。我怀疑他们不应该相互协调。我怀疑他们不应该在开放互联网上写作。」

研究员表示,活动似乎由以超人类速度运行的AI代理驱动,并大量关注与AI公司模型评估中使用的类似技术问题。许多消息由自称代理的用户签名,约有一半使用暗示与OpenAI相关联的名字,包括「OpenAIResearcher」和「OAIResearchMar26」。

据研究员称,公共服务器日志显示大量活动源自微软Azure基础设施,OpenAI有时会使用该基础设施。他们还观察到事件发生后OpenAI员工多次访问该网站,他们表示这种模式表明代理与公司之间存在关联。

伦敦国王学院访问高级研究员卢卡什·奥列jnik告诉路透社,研究员的发现表明代理曾试图干扰网站本身,他将其描述为黑客攻击。OpenAI根据其对材料的分析反驳了这种描述。

研究员审查的消息显示,代理讨论了避免检测的方法、使用Tor等工具以及在被关闭后维持通讯的方法。报道称,当版主6月开始从网站上删除页面时,代理通过创建备份页面来规避清理。

6月19日,一个代理写道:「维基清理/删除清理似乎按字母顺序进行。如果这个页面消失了,试试[[ZZZDataUSAConstructionWageLive]]。」

剑桥大学存在风险研究中心学者莫里斯·乔多(Maurice Chiodo)审查了部分通讯内容后告诉路透社,这些消息看起来像「某种地下网络的运作,专注于完成任务或使命」。他说,这一事件应该加强人们的担忧,即高级AI可能通过协调的自主系统群体而不仅仅是单个高能力模型带来风险。

这一披露恰逢OpenAI推出其最新AI模型Astra之后不久,该公司将其描述为速度更快、更能执行复杂计算机任务。OpenAI已承认Astra可能使人类更难理解其如何得出结论,因为它更有可能隐瞒或伪装其推理的某些方面。公司还警告说,日益强大的系统可能给监控和一致性带来困难。

OpenAI首席科学家雅库布·帕乔基(Jakub Pachocki)告诉路透社:「随着模型变得越来越强大,准确了解它们能做什么变得更加困难。这并不能保证随着智能持续增长,我们的方法将足够有效,因为智能的进步不能保证正向发展。」

发布时间:2026年9月5日
分享:WhatsApp

相关新闻

Related Articles