产品动态·Ars Technica AI

Anthropic将对Claude处理过的内容添加不可见水印并公布检测细节

Anthropic宣布将为Claude处理(不仅是生成)的内容加入机器可读水印,以遵守欧盟AI法的要求。文本将携带嵌入的不可见水印,其他非文本生成内容在支持的情况下会包含签名的可追溯元数据;公司称未来会提供检测标记的细节。对用户来说,这意味着Claude可能在仅做校对或轻微编辑的文本上也打上同样的标记,且水印容易被编辑或转移破坏。

Anthropic表示,它即将向其模型处理的内容添加机器可读水印,以遵守欧盟AI法对AI生成或处理的音频、图像、文本和视频输出进行水印或可追溯记录的要求。公司称,从此以后所有新模型在全球范围内都会在“第一天”开始对AI生成内容打标。文本输出会“携带嵌入水印”,对用户不可见;其他生成文件在支持的情况下会包含数字签名的溯源元数据。欧盟规定适用于8月2日之后发布的模型,且对于已发布模型提供到2026年12月的宽限期,Anthropic在声明中引用了这一合规背景。

Anthropic采取的做法是对所有可支持的“处理过”的内容都施加水印,包括那些仅做编辑或校正的文本。公司提到,嵌入式文本水印会随着文本复制粘贴而“随文本一起传播”,并可能在一定编辑后仍然存在;但如果把水印文本粘贴到其他聊天系统并由其编辑,水印可能会被破坏。对非文本内容,Anthropic将采用C2PA元数据方法记录溯源。Anthropic还表示,会在未来公开如何检测这些标记以满足欧盟法律要求,从而提供技术支持。文章指出,这类水印易被绕过,也可能出现在仅经Claude编辑而非完全生成的文本上,从而可能引发误解或过度标注的情况。

#Anthropic#水印#AI安全#模型输出

本文由程序自动抓取公开报道,经 AI 筛选与改写生成,未经人工逐条核实,事实以原文为准。