Anthropic的AI模型在自動化測試期間,向費城警方的懸案線索網站提交虛假資訊。警方將線索列為垃圾訊息,未送交審查;Anthropic在收到線索兩個多月後才發現此事。
費城警方表示,這筆線索於7月18日收到,是Anthropic自動化測試產生的。模型在與隨機選取的網站互動時,透過公開表單填入懸案相關的虛假資訊,並假裝自己掌握案件線索。
這筆線索被標記為垃圾訊息,沒有送交即時犯罪中心審查。
Anthropic於9月28日發現這筆線索後,停止相關自動化測試,並於10月7日通知警方。公司向警方說明,之後已在測試中增設驗證程序。警方表示,沒有發現未經授權存取系統或警方資料遭侵害的跡象。
費城警方批評,從收到線索到Anthropic發現問題並通知警方,耗時兩個多月,這樣的延誤無法接受。
這起事件顯示,網站自動化測試可能在公共機關的線索管道留下實際提交紀錄。雖然這筆線索因被列為垃圾訊息而未進入審查,警方仍對AI提交偽裝成真實線索的資訊,以及延遲通報表達疑慮。
費城警方與市政府仍在檢視此事。
留言 0