Anthropic在「克勞德(Claude)」生成的內容中導入機器可辨識的浮水印機制。這項機制不是把隱藏字元或代碼埋進句子裡,而是利用生成過程中留下的統計訊號,來標示內容是否經過克勞德處理。
Anthropic在克勞德說明文件中指出,公司已簽署歐盟《人工智慧法案》第50條「AI生成內容透明度」執行準則,2026年8月2日以後在歐盟推出的新款克勞德模型,將自推出當天起就支援這項標示功能。適用範圍涵蓋克勞德平台(API)、克勞德、克勞德程式(Claude Code)、克勞德協作(Claude Cowork)、克勞德標籤(Claude Tag)等所有採用支援模型的服務。本社稍早已報導,克勞德生成文字將導入人眼看不見、僅機器可讀取的浮水印方針。
這項浮水印會嵌入文字中,但肉眼看不出來。Anthropic說明,這種標示不會改變回答的語意、品質或可讀性。至於檔案,僅限支援格式才會附上經過簽署的來源中繼資料,範例格式包括SVG、PNG、JPG,這些中繼資料遵循用來記錄內容來源資訊的「C2PA」標準。
Google DeepMind公開的「SynthID Text」,處理的是同一類問題。大型語言模型在挑選下一個詞元(token)時,會計算多個候選詞的機率,SynthID Text則是對這些機率值做微調,藉此產生人眼無法察覺的浮水印。Google DeepMind表示,這種做法的設計原則是不會對文字品質或生成速度造成明顯影響。
關鍵在於,這項機制與「使用者追蹤」是兩回事。Anthropic表示,偵測結果只是顯示內容「有可能」經過克勞德處理的訊號,並不能確定完整的內容來源。即使是人類寫好草稿,只交給克勞德校對、翻譯或摘要,浮水印痕跡也可能留下。相反地,如果句子很短、被大幅改寫,或是與其他文字混合,標示就有可能偵測不到。
律動(BlockBeats)報導,浮水印機制上線後,部分克勞德用戶取消了訂閱,但Anthropic表示並未觀察到整體退訂率上升的趨勢。至於浮水印是否會改變著作權或所有權歸屬,Anthropic也說明,依照服務條款,這項機制不會改變使用者原有的權利。
這項措施也牽動著AI內容驗證領域的平台競爭。隨著生成式AI被廣泛用於製作文章、程式碼、報告與圖像,市場上要求區分「內容出自人手」還是「模型處理」的呼聲也逐漸升高。Anthropic表示,未來將再公開偵測工具與相關技術文件。
評論:浮水印屬於機率性訊號而非鐵證,這也代表未來若要以此追究AI生成內容的責任,仍需搭配其他佐證資料,才能站得住腳。
留言 0