OpenAI暂缓下一代AI模型开发 涉自主识别并开发零日漏洞 网络安全能力太危险

更新时间:14:38 2026-08-08 HKT
发布时间:14:38 2026-08-08 HKT

据彭博报道,OpenAI旗下尚未发布、代号为「Astra」的模型,因其网络安全能力过于危险,正被暂停部分内部研发工作,以实施更严格的安全保障措施。

正提高安全控制措施

OpenAI周五表示,Astra具备在无需人类干预的情况下,自主识别并开发零日漏洞(Zero-day exploits)的能力。目前正采取步骤,以提高开发与测试更新模型时的安全控制措施,并「暂停涉及 Astra、且尚未达到这些加强版安全控制要求的内部活动」。

OpenAI行政总裁阿尔特曼(Sam Altman)在社交平台上表示,「由于其具备的网络能力,我们需要稍微多一点的时间来安全地完成这项工作,但希望不会太久。」

在过去两周,OpenAI及Anthropic均公开承认,他们在测试自家模型的过程中,不慎入侵了包括 Hugging Face等多家机构系统。Meta也在周三表示,其近期发布的一款 AI 模型已渗透进第三方的电脑系统。

与政府及AI安全组织共同测试

这些最新资讯均表明AI代理(AI agents)已具备自主运行能力,其方式甚至连专门负责根除该技术漏洞的科研人员也无法再预测。这进一步突显出实施更严格的安全筛查,以及建立更安全可靠测试环境的迫切性。

OpenAI 在其网志贴文中表示,将与政府机构及 AI 安全组织合作,共同测试 Astra 的能力。该公司还计划向第三方测试合作伙伴提供建议,以协助他们安全地评估其更先进的模型。