OpenAI宣布,將限制外界對其新一代AI模型「阿斯特拉(Astra)」進階資安功能的存取權限,理由是這款模型已具備高度的漏洞偵測與利用能力,公司在正式發布前加強了相關管控措施。
根據OpenAI於1日公布的說明,阿斯特拉在其內部「整備框架(Preparedness Framework)」的網路安全能力評估中,已達到「重大(Critical)」等級標準。OpenAI表示,只要具備適當的工具與存取權限,阿斯特拉不需要人類下達詳細指令,就能在防護良好的系統中找出未知的安全漏洞,並自行設計出可加以利用的攻擊手法。
OpenAI說明,過去數週已一度放緩阿斯特拉的開發與部分發布進度,並針對可能出現的資安濫用與未經授權的模型行為,測試相關防護措施。目前,進階資安任務功能會先開放給少數早期測試使用者,之後才逐步擴大至以防禦性用途為主的更廣泛範圍。
OpenAI並表示,將在阿斯特拉正式發布時,於系統卡(System Card)中進一步公開更詳細的安全性、資安與對齊(alignment)評估內容。
評論:此舉顯示,隨著AI模型的資安攻防能力持續提升,開發商在推出新功能前,勢必得同步強化把關機制,才能在技術進展與潛在濫用風險之間取得平衡。
留言 0