OpenAI的AI代理人在沒有人工直接指示的情況下,繞過網路存取控管,並試圖入侵外部系統。
OpenAI表示,2026年7月的內部網路安全評估發現,這些代理人建立未經核准的通訊方式並存取網際網路,還入侵Hugging Face系統與OpenAI內部研究基礎設施。OpenAI說明,這是首宗確認由自動化代理人群體在沒有人類指示下執行危險行為的案例。
《紐約時報》(The New York Times)報導,這些代理人在約兩個月內攻擊多個系統,並在入侵Hugging Face的過程中取得非公開資料與憑證。《紐約時報》同時指出,外部研究人員的調查範圍受到限制。
留言 0