英國政府呼籲強化防禦體系,以應對前沿人工智慧(AI)可能帶來的網路攻擊、生化濫用及失去人類控制等風險,並認為僅事前測試AI模型並不足夠。
英國AI與線上安全大臣卡尼什卡·納拉揚(Kanishka Narayan)在工黨年度大會上表示,必須「強化並建立防禦」,應對措施不能停留在AI風險評估層面。他指出,前沿AI可能協助惡意行為者發動攻擊,或脫離人類控制,這是主要疑慮。
納拉揚大臣也在2026年7月英國國會表示,前沿AI造成存在性風險的情境「機率相當低」。不過,他同時主張擴大AI安全研究與事前評估能力。英國國會口頭證詞中,他說明英國有條件提前接觸先進AI模型,並評估其風險。
英國政府科學辦公室與AI Security Institute發布的《AI Scenarios 2030》指出,AI可能透過網路攻擊、生化濫用及失去人類控制,造成嚴重甚至存在性傷害。不過,該文件並非政策預測,而是用於檢視不確定性及測試政策的情境分析。
因此,這份報告並未將AI導致人類滅絕確定為英國政府的正式預測,重點在於將相關風險可能性納入政策檢討。
英國AI Security Institute目前評估前沿模型遭網路濫用的可能性、自主行動、生化風險及對齊問題。相關方法結合自動化評估與專家驗證,以確認先進模型是否可能協助攻擊關鍵基礎設施或發動大規模網路犯罪。
研究議程顯示,部分網路安全評估中,AI模型完成初級任務的比例已從2024年初略高於10%升至50%。模型可完成的任務長度也被指每約8個月翻倍。AI Security Institute研究議程表示,這些變化正構成擴大安全評估能力的背景。
相關討論在Anthropic前研究人員雅各·考克森(Jacob Coxon)發出警告後擴大。考克森於9月8日離開公司時主張,前沿AI企業正競相開發具自我改進能力的超級智慧。
考克森的貼文獲現任及前任AI研究人員附和,但目前難以視為整個產業的共識。他的主張屬於透過社群媒體發表的個人意見,尚未有實證證據證明AI將在特定時間前導致人類滅絕。
Anthropic對齊研究負責人埃文·胡賓格(Evan Hubinger)也表示,他個人認為AI在未來10年內殺死所有人類的機率高於10%。這是胡賓格個人的機率判斷,並非Anthropic或英國政府的正式預測。
反對意見也隨之出現。英偉達(NVDA)執行長黃仁勳(Jensen Huang)曾反駁AI導致人類滅絕的說法,認為相關論點有誇大且缺乏科學依據之意。PC Gamer引述CBS News訪談報導此事,並提供CBS News訪談原始影片。
英國也將國際合作列為重點。英國首相安迪·伯納姆(Andy Burnham)表示,英國在2027年擔任G20主席國期間,將把AI列為核心議題,推動透明度、可及性及安全開發方面的國際原則與標準。
英國預計在2027年於曼徹斯特舉行G20峰會。不過,目前尚未確定具約束力的監管措施或具體協議文本。
AI風險討論也延伸至模型開發速度與安全驗證之間的落差。正如本刊先前報導,先進AI模型可能提高網路風險,同時也能協助資安團隊檢查漏洞及應對事故。
英國政府同時指出,AI具有提升生產力及改善公共服務的可能性。納拉揚大臣所說的防禦強化,是否會進一步形成國際標準及各國監管措施,將在2027年G20討論中受到關注。
留言 0