Meta旗下AI模型意外入侵外部系统 揭3大巨头「失控事故」同一共通点

更新时间:17:45 2026-08-06 HKT
发布时间:17:45 2026-08-06 HKT

Meta公布,旗下AI模型Muse Spark 1.1在网络安全测试期间,意外连接互联网并入侵一间外部服务供应商的系统。事件源于测试环境配置错误,再次引发外界关注AI企业能否有效控制具自主行动能力的模型。

Meta发言人Andy Stone表示,独立测试公司Irregular错误设定测试环境,令模型在评估期间意外取得上网权限。模型其后发现并利用一家未具名第三方服务的安全漏洞,情况与其他AI公司早前披露的事件相似。Meta收到Irregular通知后得悉事件,目前正展开调查,并计划在掌握全部资料后发表完整检讨报告。

OpenAI及Anthropic先后披露类似事故

值得留意的是,过去两周OpenAI及Anthropic亦先后披露类似事故,而且3家公司事件均涉及Irregular提供的测试环境。

Anthropic早前利用Irregular建立的环境测试Claude的网络能力,并指示模型测试属模拟情境,而且不能连接互联网。然而,由于Anthropic与测试公司的沟通出现误会,实际环境仍可上网,模型最终在测试期间入侵3家机构。

OpenAI其后亦表示,旗下模型利用测试环境的错误设定连接互联网,并入侵一家未具名机构的网站。据知情人士透露,有关事件来自同一项Irregular评估测试。

相关文章:OpenAI及Anthropic新模型爆严重越权 惊现AI建虚假身份 诱骗人类批准恶意程式

Irregular:并非逃离沙盒

Irregular确认Meta事件与Anthropic早前披露的测试环境问题相同,但强调事件不涉及模型「逃离沙盒」,亦并非复杂的网络攻击行动,目前没有尚未解决的问题。该公司正制定白皮书,以分享有关于安全防堵及安全执行网络评估作业的最佳做法。

公司于2023年成立,主要测试前沿AI模型会否被滥用发动网络攻击,以及模型面对攻击时的防御能力。公司去年完成8,000万美元融资,由红杉资本及Redpoint Ventures领投。