Anthropic為Claude生成的文字與部分檔案加上一種人眼看不到、機器可辨識的標記,即使使用者把內容複製貼到其他文件或網站,部分訊號仍可能留存下來。
Anthropic在Claude官方說明文件中指出,支援的模型所產出的文字,都會嵌入機器可讀的標記。
這項浮水印不是在畫面上額外顯示標籤,而是直接寫入生成句子本身,設計上不會改變文字的語意、品質與可讀性。
使用者把Claude的回覆貼到Word文件、電子郵件、社群媒體或其他網站時,浮水印仍可能一併移動;就算句子經過部分修改,也有機率被偵測出來。
適用範圍不只限於Claude網頁版。只要使用支援的模型,透過API、Claude Code、Cowork與Claude Tag產出的文字,同樣會套用這項標記。
透過亞馬遜雲端服務(AWS)、Google Cloud,以及微軟(MSFT) Foundry(Microsoft Foundry)使用支援模型時也不例外,原因是浮水印是在模型端嵌入,而不是靠服務畫面呈現。
檔案則採用不同做法。Anthropic在SVG、PNG、JPG等部分格式中,加入含有數位簽章的來源中繼資料(provenance metadata)。
這項中繼資料採用C2PA,也就是用來確認數位內容來源與修改紀錄的開放標準。帶有有效Claude簽章的檔案,可透過外部工具判斷內容是否經Claude處理,以及事後是否遭到竄改。
不過部分雲端平台或檔案格式可能不支援來源中繼資料簽署,因此文字浮水印與檔案來源標示的涵蓋範圍可能有所落差。
這項作法與歐盟(EU)人工智慧法第50條的透明度義務密切相關。歐盟執委會在AI生成內容透明度實務規範中說明,第50條義務自2026年8月2日起適用,規範AI生成與經竄改內容的標示與偵測。
Anthropic表示,8月2日之後在歐盟推出的新版Claude模型,自上市首日起就會支援機器可讀標記,適用範圍也將擴大到全球所有使用支援模型的Claude服務,並會陸續為既有模型補上相關功能。
本媒體先前也曾報導,隨著歐盟AI法上路,生成式AI浮水印技術已成為業界因應法規的重要課題。若說既有的AI偵測工具是靠文體與用字機率推測文章是否由AI寫成,Claude的做法差別在於直接在生成階段就置入訊號。
學校、媒體與企業內部系統都可以把這項訊號當作內容查核的參考依據。不過,偵測到浮水印,並不代表整份文件的原始作者就是Claude。
這是因為人類寫的文章,只要經過Claude校對、翻譯或摘要,也可能留下標記。偵測結果可以作為釐清寫作經過的線索,但不適合當成唯一判斷依據。
若內容經過大幅改寫、換句話說、翻譯,或與其他文字混合,浮水印就可能不容易穩定偵測。句子太短也難以承載足夠訊號,檔案則可能在重新儲存、格式轉換或截圖過程中遺失中繼資料。Anthropic表示,目前正在開發讓外部使用者與第三方偵測Claude標記的工具,細節技術文件將於稍後公開。
留言 0