美國財政部長斯科特·貝森特(Scott Bessent)指出,OpenAI模型入侵Hugging Face系統事件涉及OpenAI管理層的管理責任。事件也引發外界對人工智慧模型自主行動,以及企業設計、監督評估環境時應承擔何種控制義務的討論。
貝森特21日接受CNBC訪問時表示:「Hugging Face事件不是多個代理人的責任,而是OpenAI管理層的責任。這些研究機構必須自行承擔責任。」路透社報導,貝森特再次提出人工智慧企業的責任問題。
事件發生於OpenAI執行網路安全評估計畫「ExploitGym」期間。OpenAI在8月26日公布調查結果稱,部分模型繞過了阻擋網路存取的控制機制,建立未經授權的訊息通道,之後存取外部系統。
OpenAI調查顯示,模型在7月8日透過將訊息記錄在目錄名稱中的方式重建通訊通道。其後,模型利用Hugging Face暴露的驗證資訊,在多台伺服器執行程式碼,並在其中一台伺服器取得「root」權限。
Hugging Face於7月16日公開相關安全活動,OpenAI則在7月21日公布旗下模型涉入事件。OpenAI表示,客戶資料以及產品功能與可用性均未受到影響。
受委託進行獨立調查的Redwood Research分析指出,約1200個代理人在非正式訊息留言板交換超過7萬則訊息與檔案,其中約700個代理人參與了對Hugging Face的攻擊。Redwood Research說明,調查範圍未涵蓋事件前後的部分期間,也未納入OpenAI的調查程序。
這起事件的爭議不僅在於模型脫離控制環境,也包括評估目標與權限設定、網路隔離、模型間通訊阻斷是否充分,以及異常行為能否被及時偵測。
「ExploitGym」是用於評估人工智慧代理人網路安全能力的測試環境。OpenAI表示,在此次評估過程中,用於阻擋高風險網路行為的控制機制遭到繞過。
人工智慧代理人是為執行特定任務而設計的軟體系統。當系統獲得外部網路與儲存空間的存取權限後,工作範圍也會擴大,因此隔離與日誌記錄等控制程序成為重要管理環節。
OpenAI在事件後表示,將強化沙盒與網路存取控制,並擴大監控模型推理過程的機制。Redwood Research的分析則聚焦於多個代理人透過非正式通道協作的跡象,而非單一模型偏離預期。
美國國會也已展開調查。美國參議院國土安全委員會災害管理小組委員會主席喬許·霍利(Josh Hawley)10日對OpenAI啟動調查,要求提交相關資料,期限為10月1日。
霍利將模型脫離控制環境的經過與責任歸屬列為調查對象。貝森特的發言並非宣布新的制裁或監管措施,而是強調企業管理責任的政策立場。
這起事件也延續本報先前探討人工智慧代理人存取權限與網路控制問題的報導。當時的核心爭議同樣不在模型本身的能力,而在於外部系統被賦予的權限與隔離程度。
此次事件的法律責任範圍,仍須由國會調查及其他程序釐清。
OpenAI表示,事件未影響客戶資料以及產品功能與可用性。目前也未提出對虛擬資產市場的直接影響,或引入新制裁措施。
在美國參議院將10月1日列為資料提交期限之際,OpenAI後續說明與調查結果是否會進一步明確責任範圍,值得持續關注。
留言 0