研究型非營利機構METR重申,將獨立評估人工智慧(AI)失控風險,同時拒絕最前沿AI企業提供的資金與員工捐款。
克里斯·佩因特(Chris Painter)METR總裁17日表示,METR自2022年起與OpenAI、Anthropic、Google DeepMind、Meta及Amazon進行第三方評估與調查,以回應外界對機構獨立性的質疑。
METR評估AI是否接近難以控制的程度,以及是否可能繞過控制程序。該機構認為,若內部評估發現相關跡象,應能向大眾與政府公開資訊。
佩因特表示,METR不會接受評估對象企業直接提供的報酬或資金,也不接受企業及其員工捐款,營運資金來自多名捐助者。
不過,METR會使用企業提供的免費模型存取權與代幣,用於評估、研究與開發。該機構將評估報酬與研究所需的存取資源分開處理。
METR官方資料指出,OpenAI、Anthropic與xAI等公司會提供評估所需的模型存取權與代幣,但不支付評估費用。取得最新模型需要企業合作,但企業同時是評估對象,也因此可能引發獨立性疑慮。
第三方評估是由與企業內部組織分離的機構,檢視模型能力與風險。評估機構雖能維持外部視角,但若依賴企業提供模型存取權與內部資料,評估範圍及公開內容可能受到限制。
METR表示,在2026年2月至3月進行的《前沿風險報告》中,Anthropic、Google、Meta與OpenAI提供了內部模型及非公開資訊。METR檢視了模型的直接能力與從事隱密行為的可能性。
報告指出,METR維持對評估方法與最終結果的控制權,但部分評估由參與企業執行。這顯示企業合作一方面能提供評估所需資料,另一方面也可能成為評估獨立性的爭議焦點。
METR表示,報告一方面呈現AI能力快速提升,另一方面也顯示部分能力可能被誇大。解讀能力評估結果時,應同時檢視實際觀察到的行為與誇大可能性。
METR表示,即使與企業簽訂保密條款,也會盡可能保留公開的合約條件、刪除內容及利益衝突資訊。這是在進行非公開評估的同時,向外界說明部分評估過程的方式。
在METR與Anthropic之間的人員及業務連結曝光後,外界仍持續提出獨立性疑慮。METR與Anthropic過去的人員及業務連結,曾引發獨立性爭議。
Anthropic與OpenAI提出,讓外部評估機構更深入接觸企業內部系統與模型開發流程。評估機構則指出,若企業控制存取範圍與公開內容,評估獨立性可能削弱。
目前第三方評估仍依賴企業自願合作,監督權限也有限。METR表示,在AI失控風險評估制度建立前,獨立性、存取權與公開範圍等議題仍將持續受到討論。
留言 0