Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

Claude文字浮水印曝光 對程式碼影響有限

窗邊光線下,一疊文件上覆蓋著透明覆蓋層 / TokenPost.ai

Anthropic公布了在「Claude」生成文字中嵌入隱形「浮水印」的技術原理。這不是讀者能從句子裡直接看出的標記,而是在詞彙選擇過程中留下統計上的規律。

Anthropic於15日透過官方部落格表示,未來Claude模型產出的文字都將內建浮水印。此舉是為了因應歐盟(EU)人工智慧法案的透明度規定,同時也具體說明了先前公布的Claude文字浮水印政策實際運作方式。

浮水印的關鍵在於語意差異不大的用詞選項。大型語言模型在造句時,需要從多個候選詞彙中挑選下一個字,而Claude會在風險較低的選字環節,依據特定金鑰與前文脈絡形成特定的選字模式。人眼無法察覺這種差異,但持有金鑰的偵測系統卻能計算出某段文字出自Claude之手的機率。

Anthropic說明,浮水印不會在文字中加入額外字元,也不會嵌入隱藏字元。由於不會產生額外的權杖(token),因此不會提高使用成本,也不含任何可識別個人、組織或對話內容的資訊。該公司表示:「浮水印是套用在Claude與其輸出結果上,並不會識別個別使用者身分。」

這項技術延續了Google DeepMind的「SynthID-Text」做法。Google DeepMind在2024年曾說明,SynthID會在文字生成過程中調整權杖機率,藉此嵌入人眼無法察覺的浮水印。Anthropic表示,這項技術對輸出內容的品質、創意與可讀性沒有實質影響。

文字浮水印與既有的AI偵測工具運作方式不同。既有偵測工具多半是分析文體或慣用語等痕跡,藉此推估內容是否由AI寫成。相對地,Claude的做法是在生成階段就埋入訊號,之後再確認訊號是否仍然存在。

不過,浮水印並非在所有情況下都能維持相同強度。事實已經固定的句子或篇幅較短的段落,因為選字空間有限,偵測可信度也可能隨之下降。如果是人類寫好的文章、Claude只負責校正拼字或標點符號,由於Claude重新選字的部分很少,能附加浮水印的空間同樣有限。

對「程式碼」而言,影響同樣有限。程式碼講求能否正確執行,可任意選擇的空間本來就小。Anthropic說明,在程式碼註解等可以自由選字的區域,浮水印仍可能發揮作用,但對實際程式碼產出的影響很小。

換句話說,對開發者來說,比起擔心品質下降,更值得討論的是產出內容的辨識問題。Claude在變數命名或註解等可自由選擇表達方式的區域可能留下訊號,但在攸關執行結果的程式碼結構本身,選擇空間原本就不大。

編輯是否能消除浮水印,也是討論焦點之一。Anthropic表示,僅做小幅修改很可能無法完全去除浮水印,但如果進行把每個字都重新改寫的「全面重寫」,則有可能移除浮水印。該公司補充,即便如此,這段文字是否仍應被視為AI生成內容,屬於另一個層次的判斷問題。

檔案則採用不同做法。當Claude產出PNG、JPG、SVG等支援格式的檔案時,會依照「C2PA」標準,以中繼資料(metadata)形式附加內容憑證。這與文字浮水印把訊號藏在內容裡的方式不同,而是附上一份經過簽署的紀錄,證明該檔案由Claude製作或處理過。

歐盟人工智慧法案第50條要求,AI生成或竄改的內容必須以機器可讀的格式標示。Anthropic表示將提供浮水印偵測API,並會在未來數月內,配合歐盟法規的過渡期,為既有Claude模型陸續導入浮水印功能。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1