人工智慧公司Anthropic宣布,將為聊天機器人Claude生成的文字內容嵌入人眼看不到、但機器能夠辨識的「隱形浮水印」,讓外界得以追蹤內容是否出自AI之手。根據Anthropic官方支援文件,2026年8月2日之後在歐盟(EU)推出的Claude模型,從上市當下就會支援這項標記功能,既有模型則會分階段跟進。
Anthropic在支援文件中說明,公司會在Claude生成的文字裡植入「內嵌浮水印」,並針對可支援的檔案格式加上具數位簽章的來源中繼資料,讓使用者能確認檔案內容是否經過Claude處理、以及後續是否遭到修改。
這項機制涵蓋Claude平台API,以及Claude、Claude Code、Claude Cowork、Claude Tag等產品線。只要該地區能使用支援的模型,這套標記機制就會在全球範圍內生效。
透過亞馬遜雲端服務(AWS)、Google雲端(Google Cloud)與微軟(MSFT)旗下Microsoft Foundry使用支援模型時,同樣會套用文字浮水印。換句話說,標記並非加在服務介面上,而是直接嵌入模型輸出的內容本身。
檔案的處理方式與純文字不同。支援的檔案格式會加入含數位簽章的來源中繼資料,用來確認該檔案是否曾經Claude處理。
此次公告,將本站先前報導中提到「Claude生成文句與檔案標記涵蓋範圍」的內容進一步具體化。先前報導階段外界關注的「是否涵蓋全產品線」與「雲端服務涵蓋範圍」等疑問,如今已透過Anthropic官方文件明確交代。
這項浮水印肉眼無法察覺,也不會改變文字原本的語意、品質與可讀性。即使經過複製貼上仍可被追蹤,部分經過編輯的句子也可能保留標記痕跡。
不過,大幅改寫、翻譯、過短的句子,或是與其他文章混合使用,都可能降低偵測的準確度。檔案中嵌入的來源中繼資料一旦遭到刪除,同樣難以確認來源。
Anthropic也強調,即使偵測到浮水印,也不能當作「整篇文章都由Claude撰寫」的證據,因為在校對、翻譯、摘要或檔案格式轉換等過程中,只要Claude有部分參與,浮水印仍可能留下痕跡。
反過來說,沒有偵測到浮水印,也不代表內容百分之百出自人類之手。不支援浮水印的舊版模型輸出,或是經過大幅編輯的內容,標記同樣可能消失或無法偵測。
此次措施是為了因應8月2日起生效的歐盟人工智慧法(EU AI Act)透明度義務。該法第50條規定,AI系統生成或竄改的語音、圖像、影片與文字內容,都必須以機器可讀的形式加以標示。
本站先前報導曾提到,歐盟AI法上路後,生成式AI浮水印已成為各大科技公司因應法規的重點課題,而文字標記在維護與判讀上,難度又高於圖像或影片,原因在於文字內容在複製、引用、摘要與翻譯過程中,原始樣貌很容易被改變。
Google DeepMind旗下的SynthID,目前已能為圖像、音訊、文字與影片加入隱形浮水印。Substack則推出功能,用來推估貼文與留言是否由AI生成;YouTube也加強了AI使用揭露標籤的顯示力度。
整體來看,各大平台的因應方式,正從「一律禁止使用生成式AI」轉向「標示內容來源、偵測AI可能參與程度」。至於Claude既有模型,也將在過渡期後陸續納入浮水印支援範圍。
留言 0