由伊隆·馬斯克(Elon Musk)領軍的人工智慧公司xAI,旗下聊天機器人「Grok」被控告在訓練過程中使用了兒童性剝削影像(CSAM),因而捲入一起民事訴訟。原告主張,真實受害影像與AI生成的衍生內容,都被納入了Grok的訓練資料流程中。
根據Ars Technica與CyberScoop報導,這起訴訟於26日(當地時間)向美國加州北區聯邦法院提起。兩家媒體指出,原告過去曾是兒童性剝削事件的受害者,如今主張自己的影像重新出現在Grok相關的生成結果中。
原告主張,自己的受害影像屬於FBI兒童剝削通報計畫列管的識別對象,且已被列入美國全國失蹤與剝削兒童防治中心(NCMEC)與加拿大兒童保護中心的雜湊(hash)比對清單中。原告進一步指控,xAI在訓練Grok的影像與影片生成能力時,使用了這些已被列管的影像。
所謂「雜湊」,是用來識別影像或檔案的一種數位指紋。在打擊兒童性剝削影像的實務中,相關機構會將已確認的非法影像雜湊建立資料庫,用來偵測相同或相似的檔案。這起訴訟爭執的核心,正是這類已列管的識別影像,是否在未經過濾的情況下被納入了生成式AI的訓練流程。
原告一方認為,Grok不只重複使用既有的受害影像,還把AI生成的衍生影像重新送回訓練資料流程。訴狀中提到,Grok會將公開的X貼文與自身輸出結果納入訓練資料的服務條款結構,是問題發生的可能路徑。不過,僅憑服務條款的設計,尚不足以直接證明特定的兒童性剝削影像確實被用於訓練。
根據xAI公開的常見問題(FAQ),Grok主要以公開網路資料進行預訓練,使用者的提問、搜尋紀錄與提交內容,以及Grok的回覆,都可能被用於模型訓練。X的說明頁面也指出,公開的X資料與用戶和Grok的互動,可能被用於Grok及其他生成式模型的訓練與微調,同時列出部分退出訓練同意的設定與私訊例外規定。
這起訴訟牽涉到的核心問題,是生成式AI服務中資料如何循環使用。一般而言,使用者輸入內容、公開貼文與模型輸出結果,都可能被用於服務優化與安全性評估;但若非法影像或未經同意的性影像混入同一流程,傷害就可能被重複製造。原告一方主張,這種風險已經在Grok身上成真。
這起訴訟出現之際,Grok的色情深偽(deepfake)爭議仍未平息。加拿大隱私監管機構在6月11日發布的報告中認定,X與xAI在生成色情深偽內容方面未取得適當同意,因應措施也不足。對此,xAI與X在報告中反駁,強調兒童性剝削影像與未經同意的性影像在其平台上沒有立足之地,並表示已採取必要措施加以防堵。
圍繞xAI的民事訴訟持續累積。自3月起,多起集體訴訟陸續就Grok生成兒童性剝削影像的責任提出究責;7月的修正訴狀中新增了受害者與Stability AI作為被告;8月也有另一起獨立訴訟提出。
這起案件把爭議往前推進了一步。過去外界關注的是Grok是否「生成」了非法影像,如今爭點延伸到訓練模型所用的資料本身,是否已經混入了真實的受害影像。這部分若沒有經過證據開示與技術驗證,很難得出結論。
對讀者而言,這起事件的核心在於資料控管與模型安全。Grok作為與X深度結合的生成式AI服務,公開貼文、使用者互動與影像生成結果究竟有多少比例被用於模型優化,如今已成為法律爭議的焦點。本報先前也曾報導,隨著Grok擴展為企業辦公用AI工具,各帳號的存取權限與活動紀錄管理也變得日益重要。
企業導入AI服務時,也面臨類似課題。模型效能愈高,使用者資料、內部文件與生成結果的重複使用範圍,就愈需要明確劃分。攔截非法或敏感資訊、處理刪除請求,以及訓練後的影響評估,都將成為服務可信度的關鍵防線。
Ars Technica報導指出,xAI並未回應置評請求。目前公開資訊中,尚未確認與本次報導完全對應的案件編號。相關聯邦法院案件包括3月受理的Doe 1 et al v. X.AI Corp. et al,以及8月18日受理的Doe I et al v. X.AI Corp. et al等。
法院接下來將審查原告主張的事實,以及xAI的資料處理架構。真正的兒童性剝削影像是否曾被納入訓練資料、若有其範圍有多大、刪除請求提出後對模型又留下了什麼影響,都將是審理的核心焦點。
留言 0