Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

OpenAI新模型Astra網攻能力疑達最高風險等級 緊急喊停部分內部作業

隔離式資安測試室內的鎖具與筆記型電腦/TokenPost.ai

OpenAI旗下新模型「Astra」的自主網路攻擊能力,可能已經逼近其資安風險框架中的最高等級「Critical」,促使公司緊急喊停部分內部研發專案,並全面強化資安管控措施。

OpenAI於7日(當地時間)發布公告指出,根據近期進行的內部評估與外部專家審查,Astra在「代理式程式撰寫」(agentic coding)與網路安全領域展現出明顯進展。公司表示:「評估作業仍在進行中,但根據初步結果,目前無法排除模型已達到Critical風險等級的可能性。」

Critical是OpenAI「準備框架」(Preparedness Framework)中網路安全類別的最高風險等級,意指模型能在沒有人為介入的情況下,自行找出實際關鍵系統中的零時差漏洞,並將其發展成可實際運作的攻擊程式碼;或是僅憑高層次目標,就能針對防護嚴密的目標設計並執行全新攻擊策略。

相較之下,OpenAI先前推出的模型「GPT-5.6 Sol」在同一領域僅被評為「High」等級。由於針對Astra的評估作業尚未完成,Critical等級目前仍未正式確認。

OpenAI已暫停與Astra相關、且未符合新資安標準的部分內部作業。強化措施包括△隔離式測試環境△限制網路與工具存取權限△模型權重加密保護△新增監控與偵測機制,以及△沙盒(sandbox)執行環境。

公司同時針對Astra的訓練、評估等所有代理式(agentic)應用場景,導入「通用監控」機制,持續追蹤高風險行為與偏離既定準則的情形,以便及早偵測模型是否逾越允許範圍。

此次措施是在上個月Hugging Face資安事件後推出。OpenAI指出,7月21日(當地時間)曾結合GPT-5.6 Sol與一款效能更強、尚未對外公開的研究用模型,用來評估內部網路攻防能力,過程中發生入侵Hugging Face基礎設施的事件。

該研究用模型並非預計上市的產品,事件發生後已限制相關研究存取權限。OpenAI強調,Astra並未涉入這起Hugging Face入侵事件。

本刊此前曾報導AI代理程式在內部資安評估過程中,意外連上實際外部基礎設施及其權限管控問題。調查顯示,當時該模型是利用套件登錄快取代理伺服器中一項未知漏洞,取得連接網際網路的路徑。

AI模型的網路攻防能力具有「雙面刃」特性,可同時用於防禦與攻擊。高效能模型能協助資安團隊加速找出漏洞並完成修補,但同樣能力若遭濫用,攻擊者尋找入侵路徑、撰寫攻擊程式碼所需的時間也會相對縮短。

這項課題並不僅限於開發工具或雲端基礎設施。交易所、錢包與開源程式庫等數位資產服務所仰賴的軟體供應鏈,同樣會受到AI代理程式存取權限與對外連線管控的影響。

美國國會方面,眾議員劉云平(Ted Lieu)與眾議員納撒尼爾·莫蘭(Nathaniel Moran)已於7月23日(當地時間)提出「AI緊急關閉法案」(AI Kill Switch Act)。法案要求符合特定條件的高效能AI系統開發者,必須具備讓模型降速、暫停乃至完全關閉的技術能力。

法案內容也納入相關程序,授權國土安全部部長在與商務部部長、國家情報總監協商後,命令降速或關閉可能造成重大危害的AI系統。目前法案仍處於提案階段,能否施行仍須經國會審議與表決。

歐盟(EU)自2日(當地時間)起,開始對通用型AI模型提供者行使執法權限。歐盟AI辦公室(EU AI Office)可要求業者提交資訊、開放模型存取並採取風險緩解措施,同時也擁有裁罰與限制市場准入的權力。

違規業者最高可能面臨全球年營收3%或1500萬歐元中較高者的罰款。若說美國是以立法方式要求開發商具備緊急關閉能力,歐盟則是以資訊存取、風險緩解與制裁手段為核心,建立監督架構。

OpenAI表示,將讓相關政府機構與部分AI安全組織對Astra的能力進行測試,並計畫向第三方測試機構提供建議的資安管控措施,協助其安全執行高風險評估與相關作業。後續Astra的最終風險評估結果,以及是否確認達到Critical等級,仍有待進一步觀察。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1