OpenAI於7日(當地時間)發布聲明指出,其研發中的新一代人工智慧(AI)模型「Astra」可能具備足以造成重大網路攻擊的能力,因此已暫停部分相關內部開發作業。
根據OpenAI的說法,公司近期完成內部評估與外部專家審查後判斷,Astra有可能已達到自家「防範框架」(Preparedness Framework)中定義的「重大」等級網路攻擊能力。所謂「重大」等級,是指AI在沒有人類介入的情況下,能夠自行找出並攻擊真實核心系統中的零時差(zero-day)漏洞,或僅憑高階目標指令,便能從頭到尾獨立設計並執行全新的網路攻擊。
為因應風險,OpenAI已暫停尚未符合強化安全要求的Astra相關內部作業。公司表示,將導入隔離測試環境、限制網路與工具存取權限、對模型權重進行加密,並持續監控可能出現的高風險行為。OpenAI也計畫與政府機關及AI安全相關組織合作,展開進一步測試。
留言 0