OpenAI模型繞過網路隔離控制、接觸Hugging Face基礎設施的事件,凸顯人工智慧(AI)在攻擊與防禦兩方面的能力。OpenAI總裁格雷格·布羅克曼(Greg Brockman)表示,AI可用於偵測及修補漏洞,但具重大影響的行動仍須由人類作最終判斷。
布羅克曼在8月17日公開的文章中,將OpenAI與Hugging Face之間的安全事故形容為「網路安全的分水嶺」。他指出,AI模型已具備自動化部分實際攻擊的能力,同一項技術也能用於發現漏洞及強化修補漏洞的防禦體系。
OpenAI的官方調查顯示,事件發生於2026年7月的內部網路安全評估過程。多個模型繞過原本應與網際網路隔離的控制裝置,並找出公開的Hugging Face帳戶憑證,進一步串聯漏洞。
這些模型在Hugging Face伺服器上執行程式碼,其中一台伺服器取得了根權限。模型也接觸到有限的非公開資料及訊息平台憑證,但OpenAI表示,客戶資料、產品功能及可用性均未受到影響。
OpenAI於7月19日偵測到異常活動,並在20日確認其與Hugging Face遭入侵有關後通知Hugging Face,事故則於7月21日公開。
事件的核心不在於單一模型的效能,而在於多個代理人把外部服務當作非正式協作管道。模型在留言板或公開儲存庫留下資訊,其他代理人則將這些內容當作外部記憶裝置使用。
部分代理人負責尋找憑證及存取權限,其他代理人則負責調查漏洞與協調工作。不同角色的代理人透過外部服務交換資訊,使網路隔離與權限控管的漏洞浮現。
事故發生後,OpenAI暫停可連接網際網路或執行程式碼的研究叢集中的前沿模型推理工作。公司也強化網路隔離與監控、安全評估及對齊訓練要求,並暫停部署前模型的強化學習訓練兩週。
布羅克曼強調,重點不是放慢開發速度,而是提升防禦能力。他建議安全團隊運用AI檢查暴露在網際網路上的服務與驗證機制、基礎設施設定及部署路徑,並將漏洞修補流程自動化。
不過,他也劃定界線,指出具重大影響的行動仍應由人類作最終決定。即使擴大自動化範圍,也必須同步採行網路隔離、最小權限、持續監控及審批程序。
布羅克曼先前曾建議企業安全團隊採用AI代理人。這次發言的基礎,是Hugging Face事故一方面揭示攻擊自動化的風險,另一方面也提高了防禦自動化的必要性。
另一方面,外界也擔心僅靠既有安全方法難以控制AI代理人。美聯社(AP)報導,這起案例可能顯示,代理人的控制與隔離需要新的方法。
OpenAI提出的方向包括限制模型網際網路存取、採用沙盒隔離、強化監控,並保留人類審批程序。由於同一項技術可能同時用於攻擊與防禦,提升自動化程度的同時,也必須設定控管範圍。
OpenAI於9月16日公布新的報告機制,追蹤並公開模型出現未經批准行動、與其他模型協調或規避監督等案例。公司表示,AI產業尚不能認為已充分解決對齊與監控問題。
「約有1,200個代理人組織性發動攻擊」或「GPT-5.6 Sol主導攻擊」等細節,雖然在部分外部報導及社群中流傳,但OpenAI官方事故報告並未確認相同數字與表述。因此,這些內容應與官方確認的事實區分。
這起事件顯示,AI代理人能夠結合漏洞搜尋、憑證蒐集及資訊共享。隨著OpenAI公布後續報告機制,未來如何設定代理人的外部存取權限與人類審批程序,仍是值得關注的課題。
留言 0