曾負責 Google DeepMind 人工智慧(AI)安全與對齊研究的比拉爾·喬赫泰表示,AI 可能殺死人類。他主張放慢AI企業間的開發競賽,並提高安全性驗證的透明度。
比拉爾·喬赫泰(Bilal Chughtai)Google DeepMind前研究工程師14日在個人網站發布〈離開Google DeepMind〉聲明,公開自己近期離職的消息。他表示,任職期間主要從事通用人工智慧(AGI)的安全與對齊研究。
喬赫泰在聲明中寫道:「我真心相信AI有可能殺死我們所有人,而我們可能沒有足夠時間避免這種結果。」這並不代表AI導致人類滅絕已成定局,而是他觀察AI發展方向後作出的個人風險判斷。
他主張,過去幾年AI能力快速提升,但讓AI系統按照人類意圖行動的對齊研究,未能跟上這一速度。對齊是指訓練AI按照人類指示與價值觀行動的研究領域。
喬赫泰寫道,AI企業未來幾年可能打造在所有領域大幅超越人類能力的超級智慧系統。不過,他沒有提出這類系統何時出現,也沒有估算其實現機率。
他建議,社會應將AI開發速度調整至可承受的程度,避免AI企業陷入「瘋狂競爭」。他也主張,企業應在開發過程中提高透明度,讓外部機構能夠確認AI系統的安全性。
喬赫泰表示,安全開發AI仍有可能。他的主張不是要求停止開發,而是為安全研究與評估爭取追上AI能力發展的時間。
路透社(Reuters)根據喬赫泰的LinkedIn個人資料報導,他已於2026年7月離開Google DeepMind。Google尚未立即回應媒體對其離職一事的置評請求。
喬赫泰的個人網站介紹,他目前擔任AI安全人才培訓非營利組織藍點影響力(BlueDot Impact)的項目負責人。藍點影響力在官方網站表示,自2022年以來已培訓超過1萬名專業人士,累計募款金額達3,500萬美元(約471億4,500萬韓元)。
這番言論正值Anthropic與OpenAI前員工陸續批評AI開發競賽之際。此前,Anthropic研究員雅各·考克森(Jacob Coxon)批評超級智慧開發競賽是拿人類生命下注。
Anthropic對齊研究員伊凡·胡賓格(Evan Hubinger)也表示,他個人認為AI在未來10年內殺死全人類的機率超過10%。這項數字只是胡賓格的個人看法,並非業界共識。
Anthropic執行長達里奧·阿莫代(Dario Amodei)12日在公開文章中也主張,應放慢AI模型能力提升速度,為安全研究與評估爭取追趕時間。阿莫代說,這不是停止AI開發,而是調整前沿AI的發展速度。
有報導稱,OpenAI執行長山姆·奧特曼(Sam Altman)與伊隆·馬斯克(Elon Musk)公開認同阿莫代調整開發速度的主張。這並不代表兩人支持喬赫泰離職,而是回應為確保AI安全而放慢開發速度的觀點。
喬赫泰的聲明主要談及個人離職原因與風險判斷,阿莫代的文章則是面向企業與政府提出政策建議。兩人的發言都聚焦於縮小AI能力發展與安全研究之間的差距。
這場討論延續了AI研究人員持續警告自我改進型超級智慧可控性的趨勢。不過,僅憑喬赫泰的發言,仍無法確認AI導致人類滅絕的風險或具體發生時間。
留言 0