
8月2日起,Claude生成的每一段文字都将携带一道看不见的标记。复制、粘贴带不走它,部分编辑也抹不掉它。
Anthropic本周在帮助文档中正式公布了这项计划。触发它的是欧盟AI法案Article 50的透明度要求——生成式AI提供商必须通过技术手段让合成内容可被识别。Anthropic签署了相关实践准则,但标记范围远超法规管辖:全球所有Claude产品的输出一律适用,不限欧盟用户。
第一层是文本水印。Claude在生成文本时,会在Token选择过程中引入一种不可见的统计偏置。官方文档的说法是:你看不到它,它不会改变Claude回复的含义、质量或可读性。这种水印内嵌于文本本身,不依赖外部元数据。水印会随文本的复制粘贴一起传播,经过部分编辑后仍可能存在。
一种通行的技术思路是:模型在生成文本时,按照检测算法预设的模式略微偏向某些Token,使输出的统计分布偏离自然概率。这种偏置肉眼看不出来,但检测工具可以识别。Anthropic没有公开自身方案的技术细节。
第二层是文件溯源元数据。Claude生成.svg、.png、.jpg等格式的文件时,会附上遵循C2PA开放标准的数字签名溯源信息。C2PA签名能标记文件经过Claude处理,并检测文件是否遭篡改。
两层标记的覆盖范围不同。文本水印在模型层面生效,所有文本输出都带;C2PA元数据只附加在受支持的文件类型上。
欧盟AI法案约束的是在欧盟市场上线的AI系统,Anthropic选择把标记推向全球。官方文档写明:标记适用于所有受支持模型的输出,在Claude提供服务的所有地区生效,覆盖Claude Platform(API)、Claude、Claude Code、Claude Cowork、Claude Tag五条产品线。通过AWS、Google Cloud、Microsoft Foundry接入的云客户同样适用。
时间线上,8月2日是新模型的生效日期,当天及之后在欧盟上线的Claude新模型必须在发布时就支持标记。8月2日之前发布的旧模型有过渡期,合规截止日延至12月2日。Anthropic正在为旧模型适配标记功能。违规代价也写在了法案里:最高1500万欧元罚款,或全球年营收的3%,取较高者。
Anthropic在文档中用了大量篇幅描述水印的局限,几乎把每一种可能的误读都提前堵住了。
有水印不等于Claude原创。用户经常用Claude校对、翻译、摘要或做格式转换,输出带有水印,但内容来自用户自己。Anthropic的原文说得很清楚:Claude可能不是原始作者。检测到水印只说明内容可能经过Claude处理。
反过来,没有水印也不能证明内容是人写的。官方列出了几种场景:旧模型生成的内容本就不带水印;大幅修改、改写、翻译或混入其他文字后,水印可能衰减到不可检测;过短的段落没有足够的文本量供检测算法识别;文件经过格式转换、重新保存或截图后,元数据可能被剥离。
Anthropic表示将向用户和第三方提供水印检测工具,但技术文档尚未发布。
Anthropic是第一家在文本输出上大规模部署水印的主流AI公司。谷歌DeepMind的SynthID覆盖了文本、图像和音频。OpenAI讨论过水印方案,部署节奏更慢。
这一变化在用户层面引发了激烈争议。付费用户无法关闭水印。对于用Claude代写邮件、起草内部文档或生成任何需要溯源中性内容的用户来说,文本从此携带可被识别的来源标记。网友已经集体开麦,有评论称其为纯狗皮膏药。有网友认为,即便AI生成内容能够被检测出来,如果社交平台不主动利用这些标记进行提示或管理,互联网仍可能被大量低质量AI内容充斥。
这也可能提升开源模型的吸引力——不带水印是开源模型天然的一项特征。对API开发者,Anthropic在文档中提醒:在自己产品中部署Claude的开发者,需要自行评估Article 50对自身产品和服务的合规要求。
水印的价值取决于检测的可靠性和可得性——嵌入容易,识别难。Anthropic承诺的技术文档和检测API何时落地、检测精度如何、能否经受对抗性攻击,将决定这套标记机制是真正可用的透明度基础设施,还是仅限于一份交给欧盟的合规文书。而检测工具是整套方案的关键一环。