美國媒體主張,法院應限制性解讀美國司法部將使用受著作權保護內容訓練人工智慧(AI)視為合理使用的意見。這場攻防已成為AI企業使用訓練資料,以及內容提供者權利與補償標準訴訟的核心爭點。
美國司法部9月1日向紐約南區聯邦地方法院提交利害關係陳述,表示原則上以受著作權保護的文字訓練大型語言模型(LLM)並不違反著作權法。司法部以AI產業競爭力與國家安全為依據,主張訓練過程複製受著作權保護內容屬於「轉化性」使用。
司法部說明,應區分訓練階段與AI向使用者重現受著作權保護內容的輸出階段。訓練過程會將文件中的詞彙、文法與知識關係量化,以生成新的回答;但若輸出內容實質上重構並散布特定作品,則需另行判斷。
紐約時報(The New York Times)等原告在9月28日提交的回應文件中反駁稱,司法部意見更接近政策主張,而非以證據為基礎的法律分析。原告指出,該意見與美國著作權局既有立場衝突,也未充分檢視著作權人與AI企業之間的授權市場是否能實際運作。
原告並指出,政府強調AI產業競爭力與國家安全,卻未充分處理著作權人應獲得的補償問題。司法部則強調,訓練所使用的資料與提供給使用者的輸出內容,在功能與效果上有所不同。
本案由紐約南區聯邦地方法院法官西德尼·H·斯坦(Sidney H. Stein)審理,並以多地區合併訴訟(MDL)形式進行,涵蓋OpenAI與媒體、作家提出的多起著作權爭議。
司法部提交的利害關係陳述,是政府向法院說明公共利益或政策考量的程序。該文件不是判決或具拘束力的命令,法院將在多大程度上採納其中論點,仍由審理法庭判斷。
法院將處理兩大爭點。第一,將受著作權保護內容複製至AI模型進行訓練,本身是否屬於合理使用。第二,AI若提供類似新聞報導的摘要或回答,是否會取代原文瀏覽,以及廣告與訂閱市場。
美國著作權法判斷合理使用時,會綜合考量使用目的與性質、作品性質、使用內容的分量,以及對原作品市場造成的影響。因此,訓練資料的性質與使用方式,以及輸出結果的市場效果,都可能成為審理對象。
司法部認為,訓練目的的複製與原文具有不同功能,因此屬於「高度轉化性」使用。媒體則反駁稱,AI服務若以摘要或回答形式提供新聞內容,可能使讀者不再造訪原文。
如何看待訓練資料取得與AI輸出內容對市場的取代效果,是雙方對立的核心。兩者應視為同一問題,或拆分為不同問題處理,也將影響法院的判斷。
司法部提交意見並不代表所有AI訓練行為都已合法。司法部文件也指出,合理使用的判斷可能因個別使用方式而異;未經授權的蒐集方式、使用付費或非公開內容,以及重現原文的輸出,都可能成為獨立的法律判斷對象。
本案也可能影響AI企業與媒體之間的授權協商。若訓練階段的複製獲得較廣泛的允許,資料取得成本與補償結構可能改變;但若法院認定輸出內容取代原文市場,企業的責任範圍可能擴大。
隨著國內生成式AI服務摘要與重構新聞及其他內容的案例增加,本案判斷可作為觀察AI訓練資料與著作權關係的參考。不過,美國法院的判斷不會直接適用於國內法律關係,本案直接當事人也是美國企業與媒體。
法院最終將在判決過程中決定對政府意見給予多少權重。如何區分訓練資料的複製與AI輸出內容對市場的取代效果,仍是後續審理的核心爭點。
留言 0