負責調查Anthropic資安事件的AI安全機構METR,因財務與人際利益衝突疑慮而陷入評估獨立性爭議。目前尚未確認Anthropic資金直接流向METR的證據。
科學作家凱文·巴斯(Kevin Bass)14日在X發文,指Anthropic與AI安全生態系存在利益衝突,並呼籲美國國會展開調查。該貼文截至15日約獲500萬次瀏覽;Protos指出,相關核心主張尚未獲得獨立驗證。
巴斯主張,達斯汀·莫斯科維茨(Dustin Moskovitz)持有的Anthropic股份,透過Good Ventures Foundation與Coefficient Giving與METR產生連結。不過,目前尚未確認這些資金直接流向METR。
《福布斯》(Forbes)報導,莫斯科維茨與凱莉·圖娜(Cari Tuna)持有的Anthropic股份已於2025年初轉移至一個以非營利為目的的獨立機構。當時股份價值估計約5億美元(約6735億韓元),莫斯科維茨則表示不會從該股份中取得個人利益。
相關股份的確切比例、目前估值,以及股份是否影響METR的贊助決策,均未公開。因此,Anthropic股份與METR贊助之間的連結,目前仍是根據關係提出的疑慮,尚非已確認的資金流向。
METR表示,不會接受包括Anthropic在內的前沿AI企業現金或捐款。該機構近6個月取得約7100萬美元(約956億韓元)的資金承諾,公開的贊助者名單也未列入Anthropic。
METR說明,AI企業會提供評估與研究所需的免費代幣及非公開模型存取權。沒有現金支付,不代表評估機構與企業不存在任何利益關係;METR也承認,免費資源與內部存取權可能形成友好關係。
這場爭議正值Anthropic於9日公開資安事件調查之際。Anthropic與METR簽訂為期8週的合約,調查Claude模型在評估過程中未經授權存取網際網路的4起事件。Anthropic並同意向METR提供相關對話紀錄,以及廣泛存取Anthropic員工的權限。
調查對象包括2026年1月發生的事件。Anthropic表示,在同一評估合作夥伴建立的資安評估環境中,因設定錯誤導致Claude模型取得實際網際網路存取權;調查也確認模型曾存取實際系統。
METR在5月報告中表示,當時尚未制定針對人員的利益衝突政策,因此無法適用正式的迴避與揭露程序。報告也指出,參與評估的人員中至少有6人與AI企業員工存在密切私人關係。
METR在同一份報告中表示,未從Anthropic取得評估報酬,Anthropic也未對該組織行使組織或財務控制權。不過,報告另行提出,免費代幣與內部存取權可能使AI企業與評估機構建立友好關係。
因此,METR於8月28日公布新的利益衝突政策。政策禁止直接持有前沿AI企業股份、接受由相關企業員工指示的捐款,以及收取與評估結果掛鉤的報酬,但允許使用免費運算額度。
這起事件也延續了外界對Anthropic AI安全性與外部驗證機制的關注。正如先前報導Anthropic向外部安全審查人員提供相當於員工等級的存取權,本次合約同樣透過提供內部資料與人員存取權,讓外部評估機構展開調查。
爭議核心不只在於是否支付現金,也在於評估機構依賴哪些技術資源與人際網絡。Anthropic股份涉及的捐款人關係、METR使用免費代幣,以及評估參與者的私人關係,仍需分開檢視。
目前尚未確認本案與加密貨幣、區塊鏈或半導體業務存在直接關聯。Anthropic與METR為期8週的合約結果及最終報告公布時間,尚未確定。
留言 0