【Anthropic上线Claude内容识别器:是合规的“投名状”还是防伪的“护城河”?】Anthropic最近低调上线了一个网页工具,允许用户上传文件检测是否由Claude生成。目前该工具主要识别C2PA标准——这是一种类似数字水印的加密元数据,常见于摄影和绘图软件,用于标记内容的来源。与此同时,针对文本生成的隐形水印API也已进入小范围测试。这件事的本质是AI巨头在监管压力下的集体“防御性合规”。欧盟AI法案和加州法律都明确要求大型模型必须对生成内容进行标注,Anthropic此举更像是为了拿到进入市场的准考证。但从技术逻辑看,这种基于C2PA的检测极易被“洗掉”:只需将图片截图、压缩或放入压缩包重新下载,元数据就会丢失;甚至有用户发现,把文件传回Claude让它“原样展示”一遍,原本干净的文件反而会被打上标记。相比之下,文本水印的争议更大。它通过调整Token预测的概率分布来植入特定统计特征,虽然难以肉眼识别,但这种对概率空间的微调不可避免会干扰表达的自然度,甚至降低输出质量。对于用户而言,这更像是一种单向的“免责声明”:它无法证明内容未经AI修改,也无法防止恶意滥用,却可能在学术或版权争议中成为某种并不绝对可靠的证据。与其说这是为了保护真相,不如说是在AI生成内容泛滥的时代,厂商给监管层递上的一把钝刀。
发布于 北京
