OpenAI(OpenAI)宣布,次世代模型Astra(阿斯特拉)已在自家「準備框架」(Preparedness Framework)中觸及網路資安能力「Critical」(最高風險)門檻,這是OpenAI首度將模型列入此一等級。
OpenAI於1日在官方部落格發文指出,Astra只要具備適當工具與存取權限,不需人類逐步下達指令,就能自行找出未知的資安漏洞,並研發出可利用的攻擊手法。在評估「已知漏洞」攻擊開發能力的測試項目「ExploitBench」中,Astra拿下100%的成績。
OpenAI也說明,在以近期公開的20個高風險V8漏洞組成的內部測試中,Astra相較GPT-5.6 Sol使用更少輸出token,卻達成更高的任意程式碼執行成功率。測試過程中,Astra在攻擊鏈中發現並利用了2個先前未知的零時差漏洞,OpenAI表示,目前正對相關維護單位進行漏洞揭露程序。
OpenAI強調,上述結果並非來自一般使用者可用的Astra,而是在開啟進階資安功能的「Daybreak Blue」權限環境下測得。此外,OpenAI提到,先前因Hugging Face(Hugging Face)相關資安事件而中止的大規模全方位強化學習(RL)訓練,已於8月28日重新啟動,但部分實驗性訓練目前仍持續暫停。
留言 0