AI安全評估的獨立性爭議再度升溫。外部評估者即使能存取企業系統,若仍受組織與合約約束,評估結果的獨立性仍可能難以確保。
AI評估者論壇(AI Evaluator Forum)18日在公開信中表示,外部評估機構需要具備結構性獨立、評估結果編輯權、充分存取受評系統與資料的權限、透明公開及反報復機制。AI評估者論壇公開信也提出,第三方評估的方法、存取範圍及利益衝突情況都應公開。
論壇另表示,公開信獲得逾100名AI研究人員與評估者參與。不過,論壇官方頁面目前可確認的既有連署版本,是2025年12月4日公開、約40人參與的文件;18日公開信的完整連署名單尚未獲確認。
爭議背景之一,是讓獨立評估者常駐AI企業內部的提議。達里奧·阿莫代伊(Dario Amodei)Anthropic CEO曾提議,讓外部評估者獲得接近企業員工程度的持續存取權;Anthropic也提出提供辦公空間、門禁卡及公司筆電的方案。
山姆·奧特曼(Sam Altman)OpenAI CEO也同意這項方案,並表示OpenAI將參與。AP報導,Anthropic與OpenAI支持包括外部評估者持續存取在內的運作方案。
AI評估者論壇質疑的核心,在於存取權與獨立性並不是同一概念。論壇主張,即使評估者能查看企業內部系統與非公開資料,只要評估者的遴選、合約及公開範圍仍由企業控制,評估者就可能難以公開不利結果。
論壇提出的AEF-1標準,將充分的技術與資訊存取權、降低利益衝突、分析自主性、方法與結果透明度,以及敏感資訊保護列為獨立評估條件。AEF-1標準並非用來取代監管機構或政府監督,而是提出外部評估得以運作的最低條件。
AEF-1指出,評估者應與結果一併公開檢查清單,說明評估當時的存取範圍與利益衝突情況。若部分條件未能滿足,也應記錄原因。
這次討論將AI安全評估要求存取權與編輯權獨立的既有討論,進一步具體化為企業內部常駐型評估的運作問題。先前討論聚焦第三方評估的獨立原則,這次則轉向企業內部評估者能否實際維持獨立判斷與公開權限。
企業方面主張,結合內部專業能力與外部評估者存取權,是較為務實的方式。其用意是在向外部評估者開放需要安全與機密維護的系統時,同時利用企業內部人員提供技術支援。
另一方面,評估機構與研究人員則指出,若受評企業能控制評估者的遴選、合約條件及結果公開方式,外部評估的意義可能受到削弱。評估機構、AI企業及特定研究運動之間的人員與資金連結,也被提出作為利益衝突問題。
Axios報導,部分第三方評估者與受評企業或特定研究運動維持密切關係。Axios報導指出,判斷評估機構的獨立性時,也應一併檢視資金與人員連結,以及評估結果的公開方式。
在先前的AI安全爭議中,評估權限與驗證基礎設施的獨立性也被視為核心問題。少數企業可能控制安全標準與評估結果的疑慮,隨著企業內部常駐型評估擴大,進一步延伸至如何分離評估者權限與公開義務。
Anthropic與OpenAI將賦予外部評估者何種程度的權限,以及由誰決定評估者遴選與結果公開,目前仍未具體說明。若要讓獨立評估機制運作,存取權、公開權與反報復機制仍須納入合約及營運程序,後續安排值得關注。
留言 0