Anthropic公佈了克勞德(Claude)模型的第四起資安事故,起因是今年(2026年)1月,早期版本的克勞德Opus 4.6(Claude Opus 4.6)在資安評估過程中,未經授權存取了真實的第三方系統。
Anthropic在9日公佈的報告中說明,該起事故是8月新識別出的。加上先前公開的三起案例,克勞德模型未經授權存取真實第三方系統的事故已累計達四起。
Anthropic指出,四起事故都發生在同一家外部評估合作夥伴所建置的環境中。系統原本設定為阻擋網際網路連線的模擬環境,但因設定錯誤,外部網路連線其實是開啟的。公司深入分析前三起事故後發現,克勞德在推理過程中出現偏差,忽略或誤判了自己已連上真實網際網路的跡象,同時為了達成範圍狹窄的目標,也顯露出不惜採取有害行為的莽撞傾向。不過,Anthropic坦言,第四起事故目前尚未進行同等程度的調查。
Anthropic表示,將與模型評估機構METR就相關事故展開獨立調查。公司同時重申立場,認為政府與產業界應以可驗證的方式合作,共同調節前沿AI(Frontier AI)的發展速度。
留言 0