作者stpiknow (H)
看板AI
標題[新聞] Claude隱形浮水印上線即遭破解,AI內容透
時間Fri Aug 21 17:27:38 2026
標題:Claude隱形浮水印上線即遭破解,AI內容透明機制陷入攻防戰
來源:iknow科技產業資訊室
原文網址:
https://iknow.stpi.niar.org.tw/article/3/25239
原文:
Anthropic為因應歐盟《AI法案》(AI Act)最新透明度規範,開始在新一代Claude模型
產生的文字中導入不可見、可由機器辨識的浮水印,希望建立AI生成內容的來源識別機制
。然而制度才剛推出,開發者便迅速提出移除或干擾浮水印的方法,顯示AI內容透明機制
正面臨「標記與規避」同步演進的新一輪技術攻防。根據報導指出,Anthropic確認全球
導入浮水印後僅數小時,便已有開發者公開相關繞道工具。
這項爭議的核心,在於Claude的文字浮水印並非一般認知中的隱藏字元或額外標籤。
Anthropic表示,其技術採用Google DeepMind提出的SynthID-Text方法,在語言模型面臨
多個合理詞彙選擇時,透過特定金鑰影響隨機選字來源,使長篇文字逐漸形成可統計辨識
的模式,一般讀者無法察覺,也不會增加token成本。Anthropic並強調,浮水印不包含使
用者、組織或聊天紀錄等身分資訊。
Anthropic此舉直接回應歐盟AI監管制度。歐盟AI Act第50條相關透明度義務自2026年8月
2日起適用,要求特定生成式AI業者以機器可讀方式標記AI生成或操控內容,以降低欺騙
、錯假資訊與內容來源不明等風險。歐盟執委會公布的透明度實務準則則提供業者合規方
法,目前已有超過180家組織簽署,包括多家主要AI與科技公司,使「內容來源可驗證」
逐漸成為生成式AI產業的新基礎要求。
問題在於,統計式浮水印天然存在耐久度限制。Anthropic自身也承認,完整改寫文字可
能消除浮水印,短篇文章、精確事實敘述與程式碼因可供模型選擇的詞彙較少,辨識效果
也較弱;若Claude僅負責文法校對或少量編輯,訊號甚至可能不足以被偵測。換言之,浮
水印較適合判斷「Claude是否可能參與內容生成」,卻無法直接證明整篇文章由AI撰寫,
更不能單獨作為作者身分或著作權判定依據。
這項弱點也迅速成為開發者測試目標。WIRED報導,開發者Guillaume Meyer公開的工具利
用未加入相同浮水印機制的大型語言模型重新改寫文字,藉由替換同義詞、調整句型與重
新組織內容,破壞原有統計模式;其他開發者亦嘗試利用濃縮文章、翻譯後再翻回原語言
等方式降低辨識機率。不過在Anthropic正式推出偵測API前,目前這些工具是否能穩定移
除浮水印,仍缺乏完整驗證。
浮水印也衍生另一層使用者權益爭議。部分專業工作者擔心,即使只使用Claude進行校稿
、摘要或文字潤飾,最終內容仍可能被認定曾有AI參與,進而在學術、出版、求職或專業
文件中造成不必要質疑。Business Insider報導,目前已有多款所謂AI watermark
remover工具出現;法律專家則指出,EU AI Act主要要求AI業者建立具韌性的標記機制,
目前並未明文禁止獨立第三方研究或移除浮水印,但若刻意將AI生成內容冒充為純人工成
果,仍可能涉及其他平台規範、契約或法律責任。
Claude浮水印事件凸顯,生成式AI治理已從「是否應揭露AI使用」進一步走向「如何建立
可信且不易被破壞的內容來源證明」。單一統計浮水印恐怕難以解決所有問題,未來更可
能結合C2PA數位內容憑證、加密簽章、模型端標記與平台端揭露制度形成多層次溯源架構
。真正的挑戰並非打造完全無法移除的標記,而是讓來源識別具備足夠可信度,同時避免
將「AI曾參與」簡化為「內容完全由AI創作」,這將成為AI透明度制度能否真正落地的重
要關鍵。
心得:
AI浮水印的必要性在於讓內容來源多一層可驗證的依據,降低AI生成內容被誤認為人工創
作的風險;但反感的地方也正在於此,即使只是用AI校稿、潤飾,文字仍可能留下可被追
蹤的AI參與痕跡,讓原本中性的工具使用被轉化成需要被辨識的標記。
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 203.145.192.245 (臺灣)
※ 文章網址: https://webptt.com/m.aspx?n=bbs/AI/M.1787304460.A.F46.html
1F:推 xinyi101: 一套可信賴標準水印,ai有聯盟要誕生? 08/21 17:33