Anthropic 在全球范围内为 Claude 生成的文本和文件添加水印
TECH

Anthropic 在全球范围内为 Claude 生成的文本和文件添加水印

36+
Signals

战略概览

  • 01.
    自2026年8月2日起或之后发布的 Claude 模型会直接在生成的文本中嵌入机器可读、不可见的水印,而早期模型也正在被回溯性地更新。由于该标记是编织在文本本身之中,而非作为独立元数据附加,因此它可以通过复制粘贴传播,并能在一定程度的下游编辑中持续存在。
  • 02.
    对于 SVG、PNG 和 JPG 等生成的文件,Claude 使用 C2PA 开放标准附加数字签名的来源元数据,且标记覆盖整个 Claude 产品体系——包括 API、Claude 应用程序、Claude Code、Claude Cowork 和 Claude Tag——以及云合作伙伴 AWS、Google Cloud 和 Microsoft Foundry。
  • 03.
    尽管这一要求源于2026年8月2日生效的《欧盟人工智能法案》第50条透明度规范,但 Anthropic 并未将其限制在面向欧盟的流量中,而是将标记应用于全球范围。
  • 04.
    Anthropic 自身的文档警告称,检测到的标记仅表明内容可能曾由 Claude 处理过——并不能确认完整的来源信息或识别原始作者。文本水印本身可能因重度编辑、改写、翻译或将生成文本与其他写作混合而被削弱或去除;而文件级的 C2PA 元数据则可通过格式转换、重新保存或截图被彻底移除。

深度分析

一张收据,而非判决书

Anthropic 自身的文档明确指出,检测到的标记并非作者身份的证明——它只能显示内容可能曾由 Claude 处理 [1],而无法确认实际撰写者是谁。社区视频评论也捕捉到了这一观点并进一步延伸,将该标记描述为一种来源收据而非作者身份判决:它仅标志模型接触过文本,而不反映人类在此前后做了什么。该评论还指出,标记已内置于模型行为中,而非以开关形式暴露,因此任何基于已标记模型构建的产品、代理或工作流,无论其开发者是否意识到,都会继承该水印;并且预测其他受欧盟监管的西方实验室将继续追随 Anthropic 和 Google 此前在隐形文本水印方面的做法,而发布开源权重模型的实验室可能感受到的压力较小。

两种不同的技术性质疑,而非一种

该公告还从讨论中的两个不同方向引发了截然不同的技术性质疑。一位自称从事 AI 检测技术工作的业内人士首先警告称,Claude 的水印“可能并不像人们假设的那样起作用”,随后试图解释 Anthropic、Google 和 OpenAI 各自如何构建文本水印,并具体探讨这种方法是否可以被击败——提出的是技术可破解性问题,而非断言特定结论。另一位评论者则提出了一个无关的担忧:如果水印嵌入在文本本身的统计序列中,意味着不重写输出就无法剥离,那么这是否必然导致底层生成的实用性下降,因为模型的一部分下一个词选择现在服务于水印而非用户请求。这是对同一设计选择的两种不同批评——一种关注标记在面对人为移除尝试时是否能够存活,另一种则关注即使无人攻击,它是否在输出质量上付出了代价。

代码库问题,以及互联网对此无害论的怀疑程度

由于 Claude Code 的输出也被加了水印,开发者们担心嵌入生成代码中的隐形字符在标准差异查看器中可能不可见,可能干扰 linter 和构建工具,并使代码审查和供应链信任复杂化 [3]。独立的 DevSecOps 评论进一步指出,组织的安全态势需要从仅担心离开组织的内容,转向仔细审查 AI 生成内容带入了什么 [3]。开发者论坛上的反应明显偏负面,反复出现的抱怨是水印功能如同一枚猩红字母——将经过人类有意义编辑的代码或散文标记为完全由 AI 生成——并对在每个输出中嵌入信号不会带来任何质量成本的说法持公开怀疑态度,尤其是对于代码而言。一个社区讨论引用了一个未经证实的二手数据,声称另一模型的轻微重写在58个测试案例中约有57次成功移除了类似的水印;该数字追溯不到任何 Anthropic 或任何媒体确认的一手来源或研究,应视为该讨论中流传的未经证实的说法,而非经验证的结果。一小部分更具同情心的评论则完全反驳了这种反弹,认为披露 AI 生成内容是直截了当的良好实践,并认为对其唯一真正的反对意见只是想将 AI 文本冒充为人类撰写。

无人能完全验证的水印,在一个具有真实处罚的监管制度下

Anthropic 尚未发布公开的检测工具,并表示有关其水印技术的进一步技术文档将在稍后公布 [4],这使得外界目前无法验证该技术的实际鲁棒性。这一空白早有先例:据报道,OpenAI 曾开发出准确率约为99.9%的文本水印检测器,但延迟了约两年才公开发布 [4]。在每一条 Claude 输出中嵌入来源指纹也重新引发了关于 AI 生成内容被标记后归谁所有的问题 [4],特别是考虑到 Anthropic 自身的指南明确指出,文本水印可能因重度编辑、改写、翻译或与其他写作混合而被削弱或剥离,而文件级的 C2PA 元数据则可通过格式转换、重新保存或截图被彻底移除 [1][2]——而引发这一切的欧盟法规对违规行为处以高达1500万欧元或全球年营业额3%的罚款 [2]

历史背景

《欧盟人工智能法案》第50条下的透明度义务生效,要求生成式 AI 提供商将合成内容标记为机器生成。
Anthropic 通过更新的 Claude 帮助中心文章公开确认,将为 Claude 生成的文本添加水印,并为生成的文件附加 C2PA 来源元数据,且该政策在全球范围内实施,而不仅限于欧盟。

关键关系图

关键玩家
主题

Anthropic 在全球范围内为 Claude 生成的文本和文件添加水印

事实来源

4 条引用
  1. [1] How Claude marks AI-generated content
  2. [2] EU compliance, delivered globally: Anthropic to watermark Claude's output worldwide
  3. [3] Claude Code Watermark: A DevSecOps Wake-Up Call
  4. [4] Anthropic watermarks all Claude outputs globally with marks that may persist through some editing

来源文章

Top 5

THE SIGNAL.

Analysts

警告隐藏的水印字符在标准差异查看器中可能完全不可见,可能破坏代码审查,并主张需要自动化预提交和 CI 检查,而非依赖人工审查。

Independent DevSecOps analysis
DevSecOps 评论

主张组织安全策略必须从仅关注离开组织的内容,演变为审查 AI 生成内容带入了什么。

Independent DevSecOps analysis
DevSecOps 评论
The Crowd

🚨 JUST IN: Claude models will now have invisible watermarks embedded in ALL text, and ALL metadata attached to files… https://t.co/TqBF55dRoK

@@ns123abc27226

Claude's watermark probably doesn't work how you think. As the CTO of GPTZero, I'll explain how Anthropic, Google and OpenAI are building text watermarking in this brief explainer and whether it can be defeated. Almost all forms of watermarking that are fast and cheap enough for

@@alexcdot3919

If the “watermark” is embedded in the statistical sequencing of text ie it can’t be stripped out without rewriting the text - doesn’t that necessarily make LLM text generation less useful? The model is no longer performing purely for the user’s request. Some fraction of its

@@Pv1566

Claude will watermark generated content, thank you EU

@u/N_P_K3100
Broadcast
Claude Watermark (Are we screwed?)

Claude Watermark (Are we screwed?)

Claude Code Steganography — Every Request Has a Hidden Fingerprint

Claude Code Steganography — Every Request Has a Hidden Fingerprint

Claude Is Secretly Watermarking Your Text

Claude Is Secretly Watermarking Your Text