今早,一个去水印神器代码库在GitHub上彻底爆火,狂揽11,000颗星!
Github项目:http://t.cn/AXNrsdry
它采用MIT开源协议,不仅能抹除Claude的水印,还让谷歌的SynthID-Text和OpenAI的隐形标记也难逃一劫。
更狠的是,连图像和PDF文件中的C2PA鉴权数据、EXIF元数据,它也能清得干干净净。
本来,就在上周,Anthropic还在高调炫技,发了一篇洋洋洒洒的官方博客,详细拆解了引以为傲的「文本水印追踪技术」。
没想到才没过几天,回旋镖就打到自己头上了。
面对这个项目,开发者们一致叫好。大模型的水印防线,就这样被一脚踩碎了。
Anthropic的「绝对防御」
偷换概率的隐形魔法
要理解这个开源神器的厉害之处,我们首先得看看Anthropic在官方博客里,是怎么吹捧自家水印技术的。
根据Anthropic工程师的解密,Claude的文本水印堪称「AI圈最反直觉的秘密」。
在过去,给数字内容加水印:要么在图片上盖个半透明Logo,要么在文本里塞几个肉眼看不见、但机器能读出来的「零宽字符」。
这种初级手段,懂点代码的人用正则匹配一秒钟就能删干净。
但这次,Anthropic采用了基于谷歌的SynthID-Text 方案。这是一种「统计型文本水印」。
LLM生成文字的本质是「词接龙」。每次吐出Token,都是做概率选择。
Anthropic的黑科技就在于:偷偷换掉了这个「骰子」。他们把原本真正的随机数,替换成了基于官方密钥和前文内容的「哈希值」。
他们在官方博客里这样打比方:
想象大家在玩大富翁,原本是靠掷骰子决定走几步。现在,官方偷偷把骰子换成了一本《圆周率》。玩家每次走几步,直接按照圆周率小数点后的数字来。
对于玩家来说,每次的步数依然是「随机」的,文本质量没有任何下降。但只要官方事后拿着那本《圆周率》(密钥)去核对你的步数轨迹,就能瞬间抓包:「嘿,这段话是你用Claude生成的!」
Anthropic自信满满地表示:没有额外Token消耗,没有隐藏字符。
只要你不把逐字重写,哪怕你做轻微的修改,这个统计学上的「圆周率轨迹」依然存在,水印就永远洗不掉。
对此,开源社区给出的答案是:既然你逼我重写,那我就用魔法打败魔法!
