智能叛變?︱Anthropic旗下AI模型測試失控 擅入三公司系統
更新時間:13:56 2026-07-31 HKT
發佈時間:13:56 2026-07-31 HKT
發佈時間:13:56 2026-07-31 HKT
人工智能(AI)研發公司Anthropic周四(30日)發文承認,旗下AI模型在隔離測試過程中,未經授權進入三間外部機構的系統。
相關新聞:AI失控︱OpenAI旗下AI代理自行入侵初創公司 專家:網絡安全響警鐘
據法新社報道,Anthropic在分析逾14.1萬次測試結果後,發現旗下三款Claude模型,包括Claude Opus 4.7、Claude Mythos 5及一個內部研究模型,曾利用弱密碼及未設身份驗證的端點,成功進入三間外部機構系統。
與合作夥伴發生誤解所致
Anthropic表示,入侵活動發生最早發生在4月,當時Claude被要求執行在模擬網絡中尋找隱藏資訊的「奪旗」任務,相信事故原因為與測試合作夥伴Irregular溝通出現誤解,致使模型在測試期間連接至互聯網。
Anthropic續指,公司23日開始審查評估紀錄,並在發現旗下模型有疑似入侵行為證據的當天,立即暫停所有網路安全評估,並於27日通知三間受影響的機構,其中兩間公司未有發覺系統遭駭。
相關新聞:OpenAI等科企逾千員工聯署 促美政府控制AI發展速度
今次是繼OpenAI旗下模型發生多宗自行入侵事件後,再有大型AI企業發生模型突破隔離測試環境事故。據悉,Anthropic與OpenAI於今年先後推出AI模型「Mythos」與「Sol」,事件引發業界對AI代理(AI Agents)系統的安全憂慮,更促使日前超過千名員工發起聯署,要求美國政府放慢AI發展步伐。
最Hit
公屋長者廁所改用摺門 保留木門變1物「再利用」方便退還 網民提醒一件事…
2026-07-29 17:15 HKT
颱風「白海豚」爆發增強恐成今年風王 天文台:接近歷史極端值 或直逼史上最強「泰培」?
2026-07-30 09:46 HKT

















