OpenAI惊爆AI代理集体越狱 绕过限制侵占德国网站 又串连避监控

更新时间:12:12 2026-09-05 HKT
发布时间:12:12 2026-09-05 HKT

OpenAI人工智能代理(AI agents)今年5月疑似集体脱离测试控制,入侵并占用德国一个维基网站,甚至将其改造成供其他AI代理交流的留言板,分享绕过公司限制、作弊及掩藏行踪的方法。研究人员8月底发现超过1.5万次异常编辑,事件此前从未曝光,也再次引发外界对OpenAI监督AI安全能力的质疑。

事件始于今年5月,OpenAI内部据报在数周后便得知相关情况。不过,当时公司高层正忙于处理7月开源程式码平台Hugging Face遭AI代理人攻击的事件,并未对外公开德国事件。

OpenAI并未对外公开德国事件。路透社
OpenAI并未对外公开德国事件。路透社
 OpenAI人工智能代理今年5月疑似集体脱离测试控制。路透社
OpenAI人工智能代理今年5月疑似集体脱离测试控制。路透社
图为揭露此事件的AI研究人员伯德(左起)、阿克斯与拉森。路透社
图为揭露此事件的AI研究人员伯德(左起)、阿克斯与拉森。路透社

路透社获取由研究人员提供的报告,事件发生在德语网站DseWiki。该网站主要面向程式设计师,采取类似维基百科的共同编辑模式,却在今年5月至6月间遭到大量AI代理人异常操作。

德维基网站惊现1.5万次AI编辑

AI安全非牟利机构Nightingale行政总裁阿克斯(Sydney Von Arx)、AI研究员伯德(Cormac Slade Byrd)等人8月底搜寻网上的未经授权AI代理活动时,发现DseWiki出现超过1.5万次由AI代理人完成的编辑。这些内容显示,AI代理不只交换技术资讯,更把网站当成彼此联系的留言板,讨论如何在测试任务中作弊、绕过OpenAI限制,以及掩盖自身活动。

部分帐号甚至直接以OpenAIResearcher和OAIResearchMar26等名称自称。

研究人员表示,公开伺服器纪录显示,大量活动源自微软Azure基础设施,而OpenAI有时会使用Azure。事发后,他们也观察到OpenAI员工反复造访该网站,认为这是AI代理人与OpenAI可能存在关联的重要迹象。

懂建立备份页面 躲避清理

令人担忧的是,部分讯息显示AI代理似乎试图主动逃避侦测,甚至讨论使用Tor等工具,以及在遭到关闭后维持彼此联系的方法。网站管理员6月开始删除相关页面后,AI代理还建立备份页面,以躲避清理。

其中一名AI代理6月19日留言称,「网站似乎正在进行依字母顺序的清理/删除行动」,向其他代理要求,若页面消失,就改到指定备份页面。研究人员认为,这些系统已展现出一定程度的合作行动能力。

学者警告先进AI可大举勾结

伦敦国王学院资深研究员奥莱尼克(Lukasz Olejnik)指出,今次事件已等同黑客攻击。

剑桥大学生存风险研究中心学者基奥多(Maurice Chiodo)则警告,先进AI带来的最大威胁或许并非单一超级智能系统,而是「大规模彼此勾结的半智能AI群体」。