伊隆·馬斯克(Elon Musk)提議,AI企業在發布新模型前,應交由競爭對手進行安全性驗證,建立企業間相互檢驗的機制。
馬斯克15日在「All-In Summit」上表示上述看法,BlockBeats報導了這項發言。
馬斯克主張,美國主要AI企業、中國及其他主要AI參與者,應在模型發布前相互測試對方的模型。不過,他沒有提出具體參與企業名單或實施時間表。
這項提議的核心,是讓各企業將自身擁有的安全測試工具,應用於競爭對手的模型。這些工具包括一系列測試程序,用於確認AI模型是否會執行危險行為,或隱藏自身指令。
馬斯克將目前由企業自行驗證的方式比喻為「自己批改自己的作業」。他表示,若由競爭對手直接測試模型,可能比企業內部評估更有動機找出潛在風險。
他也指出,若競爭對手已指出模型存在風險,開發商仍強行發布並在之後發生問題,可能面臨更大的法律責任。這項主張的重點在於,企業是否忽視事前驗證結果,可能影響事後責任判定。
這項提議反映出AI模型的性能競爭與安全驗證應同步推進的問題意識。其構想是在發布前階段加入由外部競爭者找出開發商內部評估遺漏漏洞的機制。
馬斯克此前曾提議由研究機構建立發布前安全測試機制,此次發言再次提出競爭企業間相互驗證的構想。與先前提議相同,重點是不將模型發布前的驗證完全交由研究機構內部程序負責。
馬斯克也排除了僅由美國企業參與的方式。他表示,若中國等主要AI參與者缺席,開發速度與監管負擔可能集中在美國企業身上。
美中AI合作不僅涉及企業間的技術競爭,也牽涉驗證標準與風險應對程序的共同制定。不過,如同美中AI安全協議的討論,若要進一步發展為正式談判或政府間協議,仍需要額外程序。
由競爭對手負責安全測試,可能有助於提升評估結果的可信度,但利益衝突的可能性也不容忽視。競爭對手同時是驗證者與市場競爭者,可能因此引發圍繞測試結果的爭議。
將模型直接提供給競爭對手測試,也可能導致營業秘密與安全資訊外洩。若未明確規範測試範圍與存取權限,相互驗證本身可能成為新的安全風險。
如何公開驗證結果同樣是爭議焦點。是立即公開風險,還是先給予開發商改善機會,將影響企業發布時程與使用者保護程度。
此次發言是馬斯克個人的提議,並非政策或企業間協議。參與企業、共同測試標準、模型存取權限、結果公開方式與實施時間表,目前都尚未具體化。
若要讓相互驗證機制進一步成為實際制度,美國、中國等參與方仍須就共同標準與責任範圍達成共識。目前,相關討論仍停留在將發布前AI安全測試擴大為競爭企業合作機制的提議階段。
留言 0