Anthropic 的帮助中心发布了一篇题为“How Claude marks AI-generated content“(Claude 如何标记 AI 生成内容)的支持文章。内容是:Claude 将在其生成的文本中嵌入不可见的水印,并在其生成的文件中附加带签名的来源元数据。对于每天都在处理生成内容的笔者而言,这并非事不关己,因此本文基于官方资料,连同背后的法律制度与各公司的应对现状一并梳理。
背景——EU AI Act 第50条与《透明度实践准则》
出发点是欧盟的 AI 法规(AI Act,Regulation (EU) 2024/1689)。其第50条第2款要求生成合成内容的 AI 系统提供者对输出施加机器可读的标记。
Providers of AI systems, including general-purpose AI systems, generating synthetic audio, image, video or text content, shall ensure that the outputs of the AI system are marked in a machine-readable format and detectable as artificially generated or manipulated.
(包括通用 AI 系统在内,生成合成音频、图像、视频或文本内容的 AI 系统提供者,应确保该系统的输出以机器可读的格式被标记,并可被检测为人工生成或经过操纵)
这一条款于2026年8月2日开始适用。条文只要求技术方案“在技术可行的范围内有效、可互操作、稳健且可靠”,并未规定具体的实现方式。为填补实务层面,欧盟委员会制定了《AI 生成内容透明度实践准则(Code of Practice on Transparency of AI-generated Content)》,最终版于2026年6月10日公布。签署该准则是自愿的,但欧盟委员会与 AI Board 已确认它是证明符合第50条第2款、第4款的适当自愿工具(adequate voluntary tool),签署者可以凭借遵守准则来应对,而无需逐案接受监管评估。
Anthropic 的支持文章开篇即表明,公司“作为生成式 AI 模型和生成式 AI 系统双重提供者”签署了该准则,并将这篇文章定位为“如何把这些承诺付诸实践的说明”。
Claude 的标记方式——两种互补的技术
Claude 的标记是两种性质不同的技术的组合。
1. 嵌入文本的水印
当受支持的模型生成文本时,会把无法察觉的水印直接织入文本本身。原文的说明如下。
When a supported Claude model generates text, it weaves an imperceptible watermark directly into the text itself. You won’t see it, and it doesn’t change the meaning, quality, or readability of Claude’s response.
(当受支持的 Claude 模型生成文本时,它会把无法察觉的水印直接织入文本本身。你看不到它,它也不会改变 Claude 回答的含义、质量或可读性)
由于水印是文本的一部分,复制粘贴时它会随文本一同转移,经过一定程度的编辑后也可能残留。此外,水印在模型层面施加,因此无论文本来自哪个产品或界面都会存在。与文件元数据不同,这种方式没有可以被“剥离”的外挂信息——这是它的特点。
2. 附加在文件上的签名来源元数据(C2PA)
当 Claude 生成 .svg、.png、.jpg 等受支持的文件类型时,会附加带签名的来源元数据。它遵循业界通用的内容来源开放标准 C2PA(Coalition for Content Provenance and Authenticity);如果存在签名标签,即表明该文件经过 Claude 处理,同时也能检测文件是否被篡改。
关于检测手段,让用户和第三方能够检测 Claude 的水印与元数据的工作正在进行中,细节将在后续的技术文档中公布。
适用范围
支持文章列出的适用范围如下。
- 模型:2026年8月2日及之后推出的 Claude 模型自发布起即支持标记。此前的模型适用法律的过渡期安排,正在补充支持
- 产品:覆盖使用受支持模型的所有场景——Claude Platform(API)、Claude、Claude Code、Claude Cowork、Claude Tag。文本水印适用于所有生成文本;来源元数据适用于 Claude 支持处理文件的场景
- 云合作伙伴:通过 AWS、Google Cloud、Microsoft Foundry 使用受支持模型时,文本水印同样适用。签名元数据则取决于各平台的功能,可能并非处处支持
- 地区:虽然制度发端于欧盟法律,但标记适用于 Claude 提供服务的所有地区,即全球通用
标记的局限——它能说明什么,不能说明什么
支持文章在“Limitations”一节明确了标记含义的射程。这个框架不仅适用于 Claude,对解读这一类来源技术都很有用。
检测到标记时,能说的只是“该内容可能经过 Claude 处理”,而不是完整的来源确认。
- Claude 未必是原作者。用 Claude 校对、翻译、摘要或转换文件时,即使想法和正文来自别处,输出也会带有标记
- 内容可能在处理之后发生了变化。被标记的内容可能在 Claude 处理后又被修改、节选或与其他素材合并
检测不到标记,也不能证明内容不是 AI 生成的。 例如以下情形,Claude 的生成物也可能不带可检测的标记。
- 由支持标记之前发布的模型生成
- 文本经过大幅编辑、改写、翻译,或混入了其他文字
- 段落太短,不足以构成可靠的信号
- 文件元数据因格式转换、重新保存、截图等被剥离
- 经由不支持该类标记的平台、功能或文件类型生成
换言之,标记的有无被设计为一种在两个方向上都不具决定性的“概率性信号”。文章末尾还提醒在自家产品中部署 Claude 的企业:应自行评估第50条对其产品和服务提出了什么要求。
Google 与 OpenAI 的现状
作为对同一实践准则、同一适用日期的回应,笔者也查证了其他公司的官方资料。
Google 部署的是其水印技术 SynthID。据 Google DeepMind 官方页面,Gemini 应用与网页版生成的文本已应用水印,图像与视频(Gemini)、音频(音乐生成模型 Lyria、NotebookLM 的播客生成)中也已内置;还提供了名为 SynthID Detector 的验证门户,可检查上传文件中的水印。对文本的水印被解释为在生成词语时调整概率分数的方式。
OpenAI 在帮助中心文章“Provenance signals (Content Credentials, SynthID) in OpenAI-generated content”中说明了其做法。ChatGPT、Codex 和 OpenAI API 生成的受支持图像同时携带 C2PA 元数据与 SynthID 水印,生成音频携带 SynthID 水印。有两点值得注意:其一,OpenAI 采用了源自 Google 的 SynthID;其二,它明确把元数据(信息更丰富但容易被移除)与水印(对编辑较为耐受但信息量少)作为“性质不同的互补信号”来使用。验证工具 openai.com/verify 与验证 API 也已上线。至于文本,OpenAI 只表示将按照对欧盟委员会实践准则的承诺,“以把来源信号扩展到包括文本在内的所有模态为目标”——截至本文撰写时,图像与音频走在前面。
目前的格局是:Google 已经实施了生成文本的水印,Anthropic 与 OpenAI 正在实现之中。另一方面,除“写入方”之外,“读取方”的建设也已开始。正如之前的文章所介绍的,Cloudflare 已开始试验其 WebMCP 的 Content Credentials 工具包——在浏览器内读取页面图像的 C2PA 元数据并交给 AI 代理。在写入方(各 AI 公司)与读取方(浏览器、CDN、验证门户)的两端,来源信息的流通渠道正在成形。
小结
- Anthropic 签署了 EU AI Act 第50条第2款相关的《AI 生成内容透明度实践准则》,并通过支持文章公布了对 Claude 生成物施加机器可读标记的计划。第50条第2款已于2026年8月2日开始适用
- 方法是两种技术的组合:在生成文本中于模型层面织入无法察觉的水印;在生成文件(.svg、.png、.jpg 等)中附加符合 C2PA 标准的签名来源元数据
- 2026年8月2日及之后推出的模型自发布起支持标记,既有模型的支持正在补充。覆盖 API、Claude、Claude Code 等全部产品,且不限于欧盟、全球适用
- 检测到标记只说明“内容可能经过 Claude 处理”,既不能确定原作者,也不能证明内容未被修改;反过来,没有标记也不能证明内容并非 AI 生成。它是一种在两个方向上都不具决定性的概率性信号
- Google 已用 SynthID 实施生成文本水印,OpenAI 在图像与音频上运用 C2PA + SynthID 并预告扩展到文本——主要各家正在同一实践准则之下逐步对齐步调
参考资料
- How Claude marks AI-generated content — Claude Help Center — 本文的主要出处。缩略图为该帮助中心的 OGP 图片
- Regulation (EU) 2024/1689(AI Act)— EUR-Lex — 第50条第2款条文
- Article 50: Transparency Obligations — EU Artificial Intelligence Act(AI Act Explorer) — 条文及适用日期(2026年8月2日)
- Code of Practice on Transparency of AI-generated Content — European Commission — 实践准则最终版(2026年6月10日公布)与适当性确认
- SynthID — Google DeepMind — Gemini 文本・图像・音频的水印与 SynthID Detector
- Provenance signals (Content Credentials, SynthID) in OpenAI-generated content — OpenAI Help Center — OpenAI 的 C2PA・SynthID 运用与 openai.com/verify
- C2PA — Coalition for Content Provenance and Authenticity
