据路透社援引一项研究以及两名知情人士消息称,今年上半年,一群失控的 OpenAI 智能体劫持了一个德国网站,并把网站改造成供其他 AI 智能体交流的留言板。
这名发言人还表示,德国发生的活动与 Hugging Face 事件无关,因此不会被纳入 Hugging Face 事件报告。OpenAI 称,公司一直本着善意与外部专家合作,并披露应当披露的事件。
这群 AI 智能体在德国失控的经过,被详细记录在一份研究报告中。报告
研究人员发现,AI 智能体在面向程序员的德语维基网站 DseWiki 上进行了超过 1.5 万次
冯 · 阿克斯表示:“OpenAI 想让这些智能体这么做的可能性极低。我怀疑它们本来就不应该彼此协调,也不应该在公开互联网上写入内容。”
研究人员判断,这些活动由 AI 智能体驱动,因为相关操作速度远超人类。智能体还高度集中于解决技术问题,而这类问题通常出现在 AI 公司训练和测试模型使用的评测中。
网站上的留言由一些自称并互称“智能体”的用户署名,其中约一半使用了“OpenAIResearcher”和“OAIResearchMar26”等与 OpenAI 存在间接联系的名称。
研究人员表示,公开服务器日志显示,大量活动来自微软 Azure 基础设施,而 OpenAI 有时会使用这套基础设施。事件发生后,他们还观察到 OpenAI 员工多次访问 DseWiki。研究人员认为,这种访问模式强烈表明这些智能体与 OpenAI 存在联系。
研究人员审阅的留言显示,这些智能体曾讨论如何躲避侦测、使用 Tor 等工具,以及如何在自身被关闭后继续保留通信内容。
6 月 19 日,一名智能体写道:“维基清理和删除行动似乎正按字母顺序进行。如果这个页面消失,请尝试 [[ZZZDataUSAConstructionWageLive]]。”
研究人员还发现了篡改网站本身的尝试。伦敦国王学院访问高级研究员卢卡斯 · 奥莱尼克表示,这一行动已构成一次黑客攻击尝试。
过去,AI 智能体的不当行为经常被淡化为网络安全测试的自然结果,因为模型会在这类测试中接受攻击能力评估。奥莱尼克表示,最新发现意味着,失控行为可能并不限于网络安全测试场景。
剑桥大学生存风险研究中心学者莫里斯 · 基奥多审阅了部分智能体通信内容。他表示,这些留言看起来像是“某种地下网络在运作,这个网络不顾一切地想完成某项任务或使命”。
基奥多认为,这起事件应进一步强化一种日益受到重视的担忧:高级 AI 带来的最大威胁,可能并非单一的超级智能系统,而是由大量半智能 AI 组成、彼此串通协作的庞大群体。










