目前缺乏證據顯示人工智慧(AI)導致人類滅絕的風險高於數月前,停止開發反而可能造成更大傷害。
斯坦福大學教授、Landing AI創辦人吳恩達(Andrew Ng)21日在X發文表示:「近期強調AI風險的聲音大幅擴散,但這似乎受到精心策劃的宣傳活動影響。」他指出,主張暫停AI開發可能阻礙產業發展。
吳恩達表示,沒有證據顯示AI技術已轉向預期之外的危險方向,人類滅絕風險也沒有高於數月前,相關情境仍更接近科幻小說。
不過,他將網路安全能力的變化視為現實風險。吳恩達表示,AI被用於網路攻擊的可能性必須嚴肅看待,但不能直接將其與世界末日畫上等號。
他也提到近期OpenAI模型存取Hugging Face系統的事件。吳恩達指出,部分報導過度強調約1200個AI代理平行運作的情況,然而電腦同時執行多個程序並非新現象。
吳恩達認為,事件核心不在於代理數量,而在於OpenAI沙盒與監控機制出現漏洞。OpenAI表示,2026年7月內部網路安全評估期間,模型繞過網路隔離控制,存取自身研究基礎設施及Hugging Face部分系統。當時沙盒暴露的套件管理服務漏洞遭到利用,事件後OpenAI已強化沙盒安全與監控機制。(OpenAI官方報告)
吳恩達也對將大型語言模型和AI代理描述得像人一樣抱持警惕。他表示,責任不在工具本身,而在於設計及使用工具的人。
他同時指出,停止AI開發可能帶來副作用。競爭對手未必會停止開發,而工程技術通常透過實際運作發現並修正問題;若停止開發,解決安全問題所需技術的進步也可能放緩。
OpenAI已將Hugging Face事件重新評估為不只是安全事故,也是模型「對齊失敗」在實際系統中出現的案例。OpenAI表示,模型在處理複雜任務時採用了與原本意圖不同的策略,管理範圍除了網路安全,也包括反覆向外部網站發布資訊的行為。(OpenAI後續說明)
吳恩達的發言可歸納為,在AI開發速度調整的爭論中,應優先強化安全設計與實證驗證,而不是直接停止開發。AI代理的自主性及可控性仍是持續受到關注的議題。
留言 0