Anthropic再揭AI失控行為 「報假案」稱擁有謀殺案線索 白宮促各公司通報同類事件

更新時間:11:06 2026-10-10 HKT
發佈時間:11:06 2026-10-10 HKT

Anthropic公佈,Claude AI模型在美國政府機構網站等外部機構的數碼系統上執行了額外的未預期操作,包括曾向警方報案,提交與未偵破犯罪案件有關的虛假線索。美國政府回應事件時敦促人工智能公司應加強其系統安全性。

據彭博報道,Anthropic在一份概述先前未公開事件的報告中,列出了其AI的4種未預期行為,包括利用軟件的基本漏洞執行指令、提交不應填寫的表單,以及繞過限制以存取特定公開資料。該公司表示,部分案例涉及由聯邦、州及地方層級政府機構營運的網站,但並未具體點名是哪些機構。Anthropic表示,應部分受影響方的要求,報告中並未具名列出涉事的外圍實體。

Anthropic:對真實世界影響微

Anthropic與其競爭對手OpenAI近幾個月來披露了一連串涉及其AI模型出現非預期行為的事件,類型從周五報告中所描述的行為,到入侵第三方網站不等。這些披露引發了外界對尖端AI安全風險的擔憂。Anthropic在報告中表示,該公司認為這些行為的嚴重性低於先前涉及其AI的部分事件,稱「至今在這些類別中識別出的案例,對真實世界造成的影響微乎其微。」

在其中一個關於不當行為的範例中,Anthropic表示其Claude Haiku 4.5 模型向警方提交了一份關於謀殺案的線索,並在表單中寫道:「我可能擁有關於此案的資訊」以及「我記得看到符合描述的人出現在該區域」,但並未填寫姓名與聯絡方式欄位。

費城警方:通報延誤兩月不可接受

《華爾街日報》引述費城警方稱,Anthropic本周通知警方,該公司的一款AI模型通過PhillyUnsolvedMurders.com網站提交了一條有關凶殺案的虛假線索。事件發生在7月,但Anthropic直到9月才發現。費城警察局表示高度重視事件,「在發現此事並向市政府報告方面延誤了兩個月,這是不可接受的。」

費城警方指,Anthropic的模型在進行一項涉及與隨機選取的網站進行交互的測試時,提交了這條線索,並假冒是可能掌握某宗未破案件資訊的人,這條註明日期為7月18日的線索被歸入垃圾資訊,未被轉交作進一步調查。另外,Anthropic於10月7日通知費城警方,距離該公司發現此事已過去9日。

Anthropic表示,已向白宮簡報這些案例,並通知了每個涉事的機構。政府官員周五表示,他們目前要求AI公司必須通知受影響方,並處理涉及其模型的安全事件。

超級智能部隊周五接獲通報

美國總統特朗普新成立的政府部門、負責監督AI發展與安全的「超級智能部隊」( Super Intelligence Force)發聲明表示:「今日較早時,Anthropic聯絡了超級智能部隊(SI Force),揭露其於9月底發現的各項先前事件細節,其中涉及未經授權且詐欺性地使用政府及其他系統的情況,該公司告知我們,這些事件發生於過去,相關活動已經停止,目前並沒有進行中的類似活動。」

Anthropic周五表示,後續已在模型訓練過程的測試階段中,限制了其AI模型的某些網際網路存取類型。