有分析指出,用來強制停止人工智慧(AI)系統的「緊急關閉開關」(kill switch),在分散於多個資料中心與網路的自主AI環境中,可能無法正常發揮作用。
前Anthropic研究員傑各布·考克森(Jacob Coxon) 13日(當地時間)在NBC新聞節目《Meet the Press》上表示,目前的AI系統雖然可以啟動緊急關閉開關,但一旦系統分散在多個資料中心,控管就會變得困難。他主張,在建立長期監管架構之前,主要AI企業有必要落實自律規範。
考克森說:「現在許多AI仍然可以啟動緊急關閉開關」,但他也說明,若資料中心分散在多處,要切斷系統就需要相當數量的開關。
他也提到AI複製到多個系統後在整個網際網路上活動的情況。考克森表示:「如果AI群集開始對整個網際網路發動駭客攻擊,緊急關閉開關就有可能失效」。
考克森的發言與其說是直接要求強制導入緊急關閉開關,不如說是提出一個問題:監管與控管機制須隨技術發展速度持續調整。核心爭議也從「能否關閉單一系統」擴大到「能否真正控管分散式自主AI」。
美國國會目前已有相關法案。民主黨眾議員泰德·劉(Ted Lieu)與共和黨眾議員內森尼爾·莫蘭(Nathaniel Moran) 7月23日提出《AI Kill Switch Act》法案。
該法案要求開發商具備技術能力,可暫停、限制功能,並在必要時關閉具危險性的AI系統。法案已送交美國眾議院國土安全委員會審議,尚未完成立法程序。
法案的核心並非用單一按鈕關閉所有AI,而是規定對可能造成「災難性損害」的系統,國土安全部部長可下令阻斷存取、限制特定功能或關閉系統,並要求開發商具備因應這類命令的手段。
民調也顯示外界對控管機制存在支持聲音。AI Policy Institute於6月10日至11日對1007名美國選民進行調查,結果顯示86%的受訪者認為,最強大的AI系統應具備有保障的「off switch」。
AI Policy Institute是支持AI安全監管的政策研究機構,因此在解讀該調查結果時,仍須一併考量樣本組成與提問方式等因素。
這場爭論的背景,也牽涉到針對AI開發速度的內部批評。針對OpenAI與Anthropic在AI開發競賽上引發的內部批評,考克森在辭職後隨即於X發文,指兩家公司正競相開發具自我改進能力的超級智慧,形容雙方「正拿我們的生命當賭注」。
Anthropic安全研究員埃文·哈賓格(Evan Hubinger)則曾私下評估,AI導致全人類滅亡的機率超過10%。上述兩則發言均屬個人意見與社群貼文,並非經過驗證的機率數字或企業官方預測。
Anthropic同時也在推動緊急關閉開關以外的其他安全研究。該公司的安全路線圖列出目標,將於2026年9月30日前開發出「provable inference」原型技術,用以確認AI模型的輸出結果是否與特定權重相符。
「Provable inference」並非著重於強制中止系統運作,而是聚焦於追蹤與驗證是哪個模型產出了哪些結果。若說緊急關閉開關著眼於停止運作,這項技術則著眼於確認模型輸出的來源。
《AI Kill Switch Act》目前仍處於提案階段,實際施行時間與適用對象尚未確定。Anthropic安全路線圖中,「provable inference」原型的開發目標時間點則訂在9月30日。
留言 0