Anthropic刚公开Claude文本水印原理,几天后很快打脸:MIT开源去水印工具已破万星,AI内容溯源的“攻防战”瞬间白热化!
上周Anthropic详细披露了Claude文本水印的工作机制,基于Google DeepMind的SynthID-Text思路,通过改变词选择时的随机源来嵌入统计模式,对人眼完全不可见,也不影响输出质量,且会随复制粘贴传播,轻度编辑后仍可能残留。几乎同时,一个MIT许可的GitHub项目迅速蹿红,目前已超1.1万星,专门针对Claude、SynthID-Text、OpenAI相关标记,以及图像/PDF中的C2PA和EXIF等 provenance 元数据进行剥离。该工具采用分层处理:确定性脚本清理不可见Unicode等表面痕迹,统计水印则通过智能改写攻击,文件层面则直接清除元数据。
