Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

AI學習恐成「史上最大勞動剝削」?微軟內部文件曝光

紐約法院檔案室的訴訟資料夾 / TokenPost.ai

微軟($MSFT)內部文件警告,為人工智慧(AI)學習蒐集新聞內容,可能被視為「人類歷史上最大的勞動剝削」,並形成削弱新聞內容供應鏈、進而降低模型品質的「末日循環」。

《紐約時報》(The New York Times)根據17日公開的美國紐約南區聯邦地方法院訴訟資料報導,上述文件包括微軟應用科學部門主管布倫特·赫克特(Brent Hecht)於2023年撰寫的內部文件。隨著微軟內部文件與法院資料公開,AI學習資料與新聞產業的關係再次成為爭議焦點。

赫克特在文件中寫道,大型AI模型吸收新聞內容,可能損害內容生產基礎。大眾可能將AI學習視為「前所未有規模的竊取」;若內容生產減少,AI可用於學習的可靠資料也可能隨之減少。

公開文件是《紐約時報》2023年12月對OpenAI與微軟提起著作權訴訟時提交的資料。《紐約時報》主張,兩家公司將新聞報導用於AI模型訓練,且聊天機器人運作方式相當於以服務取代原始報導。

文件也收錄OpenAI內部的疑慮。OpenAI前政策主管傑克·克拉克(Jack Clark)在2020年備忘錄中寫道,AI系統可能取代塑造社會文化人士的勞動。

曾任ChatGPT產品負責人的尼克·特利(Nick Turley)則被指評估,AI產品可能具有取代出版內容的性質。這些內部文件反映出,生成式AI擴散可能改變內容生產者與平台之間既有收益結構。

文件也公開了有關如何將使用者導向新聞原文的討論。OpenAI工程師在2023年備忘錄中寫道,即使將連結放在醒目位置,使用者也不會點擊原文。《紐約時報》據此主張,AI服務可能取代原文消費,而不是為新聞網站帶來流量。

微軟表示,赫克特的文件不代表公司的正式立場。公司說明,赫克特並非決策者,而是負責提出相互矛盾且不對稱觀點的研究工作。

《紐約時報》公開的資料還顯示,微軟主張AI訓練及Copilot的使用,符合美國著作權法下的轉化性使用。轉化性使用是公平使用判斷中,用來考量既有作品是否被用於新的目的或方式的概念。

OpenAI則反駁,使用公開資料訓練AI模型符合美國著作權法下的「公平使用」。OpenAI在9月4日提交的簡易判決聲請中主張,模型以自身表達方式說明新聞中的事實與資訊,並未逐字重現原始報導。

OpenAI也在案件說明中表示,以公開資料為基礎的模型訓練屬於轉化性使用。不過,法院將如何判斷學習資料的取得方式與使用目的、對原文市場造成的影響,以及AI輸出取代原文的程度,目前仍未確定。

本案中,內部員工提出疑慮並不代表公司因此承擔法律責任。法院將依訴訟當事人的主張與提交資料,判斷是否構成著作權侵害,以及是否適用公平使用。

此次公開資料凸顯AI企業取得資料的方式,與新聞產業永續性之間的衝突。內容生產萎縮是否會減少AI可學習的可靠資料,並進一步造成模型效能下降,目前尚未獲得確認。

AI學習資料與原始內容的關係,也是台灣持續關注的議題。對台灣投資人與企業而言,AI服務在多大程度上取代新聞原文,以及與內容提供者約定何種使用條件,仍須配合法院後續判斷持續觀察。

《紐約時報》主張,內部文件顯示OpenAI與微軟已意識到AI產品的取代效果,以及內容供應鏈可能受損。兩家公司則認為,AI訓練屬於不會取代原文市場的轉化性使用,最終仍應依著作權法的公平使用標準判斷。

訴訟下一步將是法院依公平使用標準審理學習資料與AI輸出之間的關係。OpenAI與微軟是否須承擔著作權責任,將由法院最終判決決定。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1