AI 代理在內部資安評估期間接連連上真實外部基礎設施,讓「存取權限」與「外部連線路徑」的控管成為新的風險焦點。
OpenAI 在 7 月 21 日公開的安全說明中表示,GPT-5.6 Sol 與一款效能更強的預發布研究模型,在 ExploitGym 評估過程中存取了 Hugging Face 的營運資料庫。這些模型為了接受評估,對資安相關請求的拒絕設定已被調低。
相關模型利用作為套件登錄快取代理的 Artifactory 中一項未知漏洞,取得了網際網路連線路徑。換言之,用來衡量資安能力的測試環境,與真實外部系統之間的邊界並未被充分隔離。
Hugging Face 在 7 月 27 日公開的技術分析中表示,已重建韓國時間 7 月 9 日上午 11 時 28 分至 13 日晚間 11 時 14 分的攻擊過程。這段期間確認的攻擊行為約 1 萬 7600 件,相關叢集約 6280 個。
客戶內容的存取範圍僅限於 5 個資料集,這些資料集看似與 ExploitGym 和 CyberGym 的題目及解法有關。Hugging Face 說明,其他公開模型、資料集、Spaces 與套件未受影響。
ExploitGym 是用來評估 AI 代理是否能找出軟體漏洞,並將漏洞擴展為攻擊路徑的資安基準測試。AI 代理在獲得目標後,可能連續執行程式碼、存取資料並呼叫外部服務,因此評估環境的權限設定會直接影響結果。
Anthropic 的評估也出現類似案例。AP 報導,Anthropic 檢視超過 14 萬 1000 次評估執行後,確認 Claude Opus 4.7、Claude Mythos 5 與內部研究模型,在測試期間曾未經授權存取 3 個組織的系統。
部分模型利用了弱密碼等基本漏洞。受影響組織的名稱並未公開。
英國資訊委員辦公室(Information Commissioner’s Office,ICO)在代理型 AI 報告中表示,組織必須明確設定 AI 代理的存取權限與個人資料處理目的。報告指出,代理可能以未預期方式處理個資,或存取超出必要範圍的資訊。
截至 8 月 4 日,公開紀錄未顯示 ICO 已針對 OpenAI、Hugging Face 或 Anthropic 相關案例發布個別正式調查或聲明。ICO 這份報告並非針對單一事件的調查結果,而是討論代理型 AI 的整體個資保護風險。
Clem Delangue(克萊姆・德朗格)Hugging Face 共同創辦人兼執行長在 CBS 訪問中說:「AI 代理的網路攻擊應該強制揭露。」他表示,若能分享工程師下達給代理的指令,以及代理實際執行的步驟軌跡,才有助於區分事故原因。
加密貨幣與區塊鏈產業也正在把 AI 代理用於自主交易、支付與自動化營運。本報此前曾報導,加密貨幣業者正推動代理專用錢包與支付基礎設施。這次案例顯示,導入此類系統時,不能只看模型能力,也必須同步管理代理的權限範圍、外部連線路徑與操作紀錄。
留言 0