作者stpiknow (H)
看板AI
标题[新闻] Claude隐形浮水印上线即遭破解,AI内容透
时间Fri Aug 21 17:27:38 2026
标题:Claude隐形浮水印上线即遭破解,AI内容透明机制陷入攻防战
来源:iknow科技产业资讯室
原文网址:
https://iknow.stpi.niar.org.tw/article/3/25239
原文:
Anthropic为因应欧盟《AI法案》(AI Act)最新透明度规范,开始在新一代Claude模型
产生的文字中导入不可见、可由机器辨识的浮水印,希望建立AI生成内容的来源识别机制
。然而制度才刚推出,开发者便迅速提出移除或干扰浮水印的方法,显示AI内容透明机制
正面临「标记与规避」同步演进的新一轮技术攻防。根据报导指出,Anthropic确认全球
导入浮水印後仅数小时,便已有开发者公开相关绕道工具。
这项争议的核心,在於Claude的文字浮水印并非一般认知中的隐藏字元或额外标签。
Anthropic表示,其技术采用Google DeepMind提出的SynthID-Text方法,在语言模型面临
多个合理词汇选择时,透过特定金钥影响随机选字来源,使长篇文字逐渐形成可统计辨识
的模式,一般读者无法察觉,也不会增加token成本。Anthropic并强调,浮水印不包含使
用者、组织或聊天纪录等身分资讯。
Anthropic此举直接回应欧盟AI监管制度。欧盟AI Act第50条相关透明度义务自2026年8月
2日起适用,要求特定生成式AI业者以机器可读方式标记AI生成或操控内容,以降低欺骗
、错假资讯与内容来源不明等风险。欧盟执委会公布的透明度实务准则则提供业者合规方
法,目前已有超过180家组织签署,包括多家主要AI与科技公司,使「内容来源可验证」
逐渐成为生成式AI产业的新基础要求。
问题在於,统计式浮水印天然存在耐久度限制。Anthropic自身也承认,完整改写文字可
能消除浮水印,短篇文章、精确事实叙述与程式码因可供模型选择的词汇较少,辨识效果
也较弱;若Claude仅负责文法校对或少量编辑,讯号甚至可能不足以被侦测。换言之,浮
水印较适合判断「Claude是否可能参与内容生成」,却无法直接证明整篇文章由AI撰写,
更不能单独作为作者身分或着作权判定依据。
这项弱点也迅速成为开发者测试目标。WIRED报导,开发者Guillaume Meyer公开的工具利
用未加入相同浮水印机制的大型语言模型重新改写文字,藉由替换同义词、调整句型与重
新组织内容,破坏原有统计模式;其他开发者亦尝试利用浓缩文章、翻译後再翻回原语言
等方式降低辨识机率。不过在Anthropic正式推出侦测API前,目前这些工具是否能稳定移
除浮水印,仍缺乏完整验证。
浮水印也衍生另一层使用者权益争议。部分专业工作者担心,即使只使用Claude进行校稿
、摘要或文字润饰,最终内容仍可能被认定曾有AI参与,进而在学术、出版、求职或专业
文件中造成不必要质疑。Business Insider报导,目前已有多款所谓AI watermark
remover工具出现;法律专家则指出,EU AI Act主要要求AI业者建立具韧性的标记机制,
目前并未明文禁止独立第三方研究或移除浮水印,但若刻意将AI生成内容冒充为纯人工成
果,仍可能涉及其他平台规范、契约或法律责任。
Claude浮水印事件凸显,生成式AI治理已从「是否应揭露AI使用」进一步走向「如何建立
可信且不易被破坏的内容来源证明」。单一统计浮水印恐怕难以解决所有问题,未来更可
能结合C2PA数位内容凭证、加密签章、模型端标记与平台端揭露制度形成多层次溯源架构
。真正的挑战并非打造完全无法移除的标记,而是让来源识别具备足够可信度,同时避免
将「AI曾参与」简化为「内容完全由AI创作」,这将成为AI透明度制度能否真正落地的重
要关键。
心得:
AI浮水印的必要性在於让内容来源多一层可验证的依据,降低AI生成内容被误认为人工创
作的风险;但反感的地方也正在於此,即使只是用AI校稿、润饰,文字仍可能留下可被追
踪的AI参与痕迹,让原本中性的工具使用被转化成需要被辨识的标记。
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 203.145.192.245 (台湾)
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/AI/M.1787304460.A.F46.html
1F:推 xinyi101: 一套可信赖标准水印,ai有联盟要诞生? 08/21 17:33