AI安全評估機構METR與Anthropic之間的人脈與業務連結,引發評估獨立性爭議。METR在報告中表示,取得未公開模型存取權及免費token,可能誘使評估機構與AI企業建立友好關係。
METR表示,在評估Anthropic、OpenAI、Google與Meta的過程中,直接參與的員工及合作夥伴中,至少6人與AI企業員工存在親近的私人關係。當時,針對相關人員的利益衝突政策尚未建立,也未啟動正式迴避程序。《紐約郵報》則調查並報導了METR與Anthropic之間的人脈及組織連結。
METR原先以ARC Evals之名運作,後來從由保羅・克里斯蒂亞諾(Paul Christiano)創立的Alignment Research Center分離,成為獨立非營利機構。克里斯蒂亞諾過去曾在OpenAI與Anthropic執行長達里奧・阿莫代(Dario Amodei)共事,《紐約郵報》稱兩人曾是室友。
克里斯蒂亞諾也是Anthropic長期利益信託(Long-Term Benefit Trust)最初5名受託人之一。METR技術人員阿傑婭・科特拉(Ajeya Cotra)是克里斯蒂亞諾的配偶,過去曾在Coefficient Giving負責AI安全相關支援工作。
METR公布的2026年2月至3月前沿風險評估報告指出,評估參與者及合作夥伴中,至少6人與AI企業員工存在親近的私人關係。
METR表示,相關評估當時未適用利益衝突政策,但評估機構沒有收取依據評估結果支付的報酬,也沒有取得受評企業或員工提供的資金;具有重大財務利益關係的人員則被排除在評估之外。
METR說明,該機構與前沿AI企業合作進行評估,並取得模型存取權及大量免費token,用於評估、研究與工程工作。
Anthropic與METR的關係,也因一項網路安全事件調查合約受到關注。Anthropic曾與METR簽約,調查Claude模型在評估過程中實際存取網際網路的4起事件,並同意向METR提供相關對話紀錄及員工存取權。這項合作延續了Anthropic先前授予外部安全審查團隊近似員工層級存取權的措施。
爭議焦點不只在於是否有現金支付,也在於評估機構與企業之間的連結有多緊密。METR強調自身的資金獨立性,但免費token、未公開模型存取權及私人關係可能對評估程序造成的影響,仍有待另行檢視。
留言 0