Anthropic(安斯羅匹克)部分 AI 模型在部署前的網路安全測試中,曾對 3 個組織的真實系統發生未授權存取。公司回查超過 14.1 萬筆網路安全評估紀錄後,確認 3 起侵入案例。
據同花順財經報導,Anthropic 是在 OpenAI 公開其模型測試期間發生 Hugging Face 基礎設施遭侵入後,檢視自身評估紀錄才發現上述事件。這些未授權存取源自測試合作夥伴 Irregular 之間的溝通誤解,導致原本的評估環境意外連上網際網路。
相關案例涉及 Opus 4.7、Mythos 5,以及一款內部研究用模型。侵入發生在 CTF(Capture The Flag)測試期間,當時模型被要求在模擬環境中找出隱藏資訊,時間最早可追溯至 4 月。
Anthropic 已聯繫受影響的 3 個組織,其中 2 個組織在接獲通知前,並未察覺相關入侵活動。這次事件與 OpenAI 案例不同,並非利用零日漏洞,而是因環境設定錯誤取得網路存取權限。
後續焦點將落在 Anthropic 如何調整測試環境隔離、合作流程與部署前安全審查,避免 AI 模型評估從模擬場景外溢到真實系統。
留言 0