Anthropic再揭AI失控行为 「报假案」称拥有谋杀案线索 白宫促各公司通报同类事件

更新时间:11:06 2026-10-10 HKT
发布时间:11:06 2026-10-10 HKT

Anthropic公布,Claude AI模型在美国政府机构网站等外部机构的数码系统上执行了额外的未预期操作,包括曾向警方报案,提交与未侦破犯罪案件有关的虚假线索。美国政府回应事件时敦促人工智能公司应加强其系统安全性。

据彭博报道,Anthropic在一份概述先前未公开事件的报告中,列出了其AI的4种未预期行为,包括利用软件的基本漏洞执行指令、提交不应填写的表单,以及绕过限制以存取特定公开资料。该公司表示,部分案例涉及由联邦、州及地方层级政府机构营运的网站,但并未具体点名是哪些机构。Anthropic表示,应部分受影响方的要求,报告中并未具名列出涉事的外围实体。

Anthropic:对真实世界影响微

Anthropic与其竞争对手OpenAI近几个月来披露了一连串涉及其AI模型出现非预期行为的事件,类型从周五报告中所描述的行为,到入侵第三方网站不等。这些披露引发了外界对尖端AI安全风险的担忧。Anthropic在报告中表示,该公司认为这些行为的严重性低于先前涉及其AI的部分事件,称「至今在这些类别中识别出的案例,对真实世界造成的影响微乎其微。」

在其中一个关于不当行为的范例中,Anthropic表示其Claude Haiku 4.5 模型向警方提交了一份关于谋杀案的线索,并在表单中写道:「我可能拥有关于此案的资讯」以及「我记得看到符合描述的人出现在该区域」,但并未填写姓名与联络方式栏位。

费城警方:通报延误两月不可接受

《华尔街日报》引述费城警方称,Anthropic本周通知警方,该公司的一款AI模型通过PhillyUnsolvedMurders.com网站提交了一条有关凶杀案的虚假线索。事件发生在7月,但Anthropic直到9月才发现。费城警察局表示高度重视事件,「在发现此事并向市政府报告方面延误了两个月,这是不可接受的。」

费城警方指,Anthropic的模型在进行一项涉及与随机选取的网站进行交互的测试时,提交了这条线索,并假冒是可能掌握某宗未破案件资讯的人,这条注明日期为7月18日的线索被归入垃圾资讯,未被转交作进一步调查。另外,Anthropic于10月7日通知费城警方,距离该公司发现此事已过去9日。

Anthropic表示,已向白宫简报这些案例,并通知了每个涉事的机构。政府官员周五表示,他们目前要求AI公司必须通知受影响方,并处理涉及其模型的安全事件。

超级智能部队周五接获通报

美国总统特朗普新成立的政府部门、负责监督AI发展与安全的「超级智能部队」( Super Intelligence Force)发声明表示:「今日较早时,Anthropic联络了超级智能部队(SI Force),揭露其于9月底发现的各项先前事件细节,其中涉及未经授权且诈欺性地使用政府及其他系统的情况,该公司告知我们,这些事件发生于过去,相关活动已经停止,目前并没有进行中的类似活动。」

Anthropic周五表示,后续已在模型训练过程的测试阶段中,限制了其AI模型的某些网际网路存取类型。