OpenAI textGrain:欧盟推出的隐形文本水印
TECH

OpenAI textGrain:欧盟推出的隐形文本水印

49+
Signals

战略概览

  • 01.
    textGrain是OpenAI专有的系统,可将一种不可见的统计信号嵌入ChatGPT和Codex输出的词汇选择中,之后可通过专用检测器识别。
  • 02.
    该系统使用一个秘密数学密钥来偏置词项选择的概率分布,而非插入隐藏字符,因此这种模式存在于句子结构本身之中。
  • 03.
    API的可选访问功能(默认关闭)已于2026年10月5日向全球开放;针对欧盟地区的ChatGPT和Codex部署将在未来几周内展开,合规宽限期持续至2026年12月2日。
  • 04.
    在欧盟以外地区,textGrain仍为可选、默认关闭的API功能,与Anthropic不同——后者在全球范围内应用其水印,因为它表示无法可靠地按区域限制该功能。
  • 05.
    检测器的访问最初仅限于经批准的研究人员和合作伙伴,而欧盟关于AI生成内容透明度的《行为准则》则单独要求向欧盟监管机构、执法部门、媒体、事实核查机构及民间社会组织提供访问权限。
  • 06.
    OpenAI声称,textGrain在文本检测性能上达到或超过了谷歌DeepMind的SynthID等竞争对手的方法。

深度分析

textGrain的实际工作原理

textGrain不会插入隐藏字符、元数据或任何读者能察觉的内容。相反,它使用一个秘密数学密钥来偏置模型对下一个词预测的概率分布,将统计模式直接嵌入普通句法结构中[1]。OpenAI将其简单描述为在模型的词汇选择中添加一种不可见的统计信号[2],之后可通过专用分类器检测。在2026年10月5日发布的约20页技术报告中,该公司描述了一种“熵预算”机制,用于平衡水印强度与模型输出多样性的约束程度[3]。由于信号需要足够的词元级自由度以隐藏可检测的模式,因此非常短的段落或低熵内容(如数学答案)本质上难以可靠标记[3]。

欧盟强制启用,其他地区需手动开启

其发布时间表明确按司法管辖区划分:全球范围内的API可选访问(默认关闭)已于2026年10月5日开放,而符合条件的欧盟地区ChatGPT和Codex文本将在未来几周内自动加水印,合规宽限期持续至2026年12月2日[3][4]。这一设计与Anthropic形成鲜明对比——后者在全球范围内应用基于SynthID-Text的水印,没有区域性开关,因其表示无法持久地按区域限定该功能[3]。截至2026年7月,约有190个组织(包括OpenAI、Anthropic、微软、谷歌和Meta)已签署欧盟关于AI生成内容透明度的《行为准则》[4],未遵守第50条者可能面临高达全球年收入3%的罚款[1]。实际效果是形成了一个固有的合规缺口:除非开发者主动启用,否则大多数欧盟以外的ChatGPT和API流量仍将不带水印。

一种无法抵御编辑的水印

根据OpenAI自己的数据,在200个词元长度的段落中检测率约为80%,在400个词元长度下约为95%(误报率为1%)[3][4],但这种表现极为脆弱。仅替换段落中10%的词语为同义词,检测率就从约92%降至66%;替换率达到25%时,检测率暴跌至约17%[1][5]。数学类内容及其他低熵文本的检测率远低于普通散文,且可靠性因语言而异,根据OpenAI自身的测试,罗马尼亚语约为42.2%,西班牙语则为69.0%[3]。OpenAI的技术报告坦承实验室条件与现实之间的差距,指出理想条件下表现出色并不能保证日常使用中的可靠检测[2],并强调检测到水印只能说明某段文字曾由OpenAI系统生成或处理过,却无法反映其中包含多少人类判断、编辑或创造性加工[4][5]。

谁可以检查,以及为何存在争议

与水印本身不同,检测器并未公开。访问权限最初仅限于经批准的研究人员及合作机构,包括康奈尔大学、苏黎世联邦理工学院(ETH Zurich)和KInIT;而欧盟《行为准则》则另行规定必须向欧盟监管机构、执法部门、媒体、事实核查机构及民间社会组织提供访问权限[3]。OpenAI还声称textGrain的检测性能达到甚至超过了谷歌DeepMind的SynthID文本方案[6],试图从技术层面证明其系统的竞争力,尽管其访问模式仍受严格控制。这种组合——仅在一个区域内强制实施、其他地区默认需手动启用、检测器仅对审核通过方开放——正是引发公众广泛质疑的原因:textGrain究竟是真正的透明工具,还是仅仅为了应付合规要求而打勾?

历史背景

欧盟《人工智能法案》第50(2)条生效,要求生成式AI输出必须以机器可读、可检测的方式进行标记。
Anthropic已在OpenAI推出面向欧盟的特定部署之前,率先在全球范围推出了类似的基于SynthID-Text的Claude水印。
签署方数量达到约190个,包括OpenAI、Anthropic、谷歌、Meta和微软。
OpenAI宣布推出textGrain,并在其技术报告发布当天同步向全球开放API水印功能的可选接入。

关键关系图

关键玩家
主题

OpenAI textGrain:欧盟推出的隐形文本水印

OP

OpenAI

textGrain的构建者与运营方;必须在2026年12月2日前遵守欧盟《人工智能法案》第50条,否则将面临高达全球年收入3%的罚款;掌控检测器访问权限及部署节奏。

AN

Anthropic

竞争对手,已在全球范围内部署了类似的基于SynthID-Text的水印,且无区域性退出选项,成为与OpenAI更有限、区域性且需手动启用方式的关键对比对象。

GO

Google DeepMind

SynthID的开发者,OpenAI将textGrain与其进行性能对标,并声称检测性能达到或超过SynthID。

EU

European Union / EU AI Act regulators

制定了第50条机器可读标记义务(自2026年8月2日起生效,合规截止日期为2026年12月2日),直接促成了此次部署;并通过《行为准则》要求向欧盟监管机构提供检测器访问权限。

MI

Microsoft, Google, Meta

截至2026年7月,与OpenAI和Anthropic一同成为约190个签署欧盟《AI生成内容透明度行为准则》的组织之一,表明业界普遍倾向于顺应而非对抗合规框架。

RE

Research partners (University of Pennsylvania, Yale, Cornell, ETH Zurich, KInIT)

学术合作方,参与共同开发textGrain或被授予早期检测器访问权限,用于评估其可靠性与负责任使用情况。

事实来源

6 条引用
  1. [1] OpenAI's ChatGPT Text AI Watermark for the EU
  2. [2] OpenAI Will Add a Digital Watermark to Text and Code Generated in the EU
  3. [3] OpenAI Will Watermark ChatGPT in the EU, But Leaves the API Opt-In
  4. [4] OpenAI Plans to Watermark ChatGPT and Codex Text Output in EU Amid AI Transparency Push
  5. [5] OpenAI Introduces Text Watermarks for the EU to Comply With the AI Act
  6. [6] OpenAI Is Adding Text Watermarking in ChatGPT and Codex

来源文章

Top 5

THE SIGNAL.

Analysts

“OpenAI自身警告称,实验室中的良好表现并不意味着现实中可靠的检测能力。”

OpenAI (technical report authors)
公司技术报告

“水印只能表明某段文字曾由OpenAI系统生成或处理过,无法反映其中有多少内容体现了人类的编辑、判断或创意。”

OpenAI (technical report)
公司技术报告

“两家公司均认为,未能检测到水印信号不能作为证明文本由人类撰写的确凿证据。”

OpenAI and Anthropic (joint framing, per Actu IA)
媒体报道引用的行业共识
The Crowd

“OpenAI is rolling out text watermarking for the EU AI Act - opt-in for API customers globally for select models starting today, ChatGPT and Codex text in the EU gets an invisible watermark over the coming weeks textGrain adds an invisible statistical signal to the model's word...”

@@btibor91307

“Announcing our work textGrain, @OpenAI's text watermark in response to the EU AI Act. OpenAI is rolling out textGrain in the EU and opening detector access to researchers. We'll open-source it so the community can build on top.”

@@weijie444230

“CHATGPT WILL START HIDING AN INVISIBLE MARK IN EVERYTHING IT WRITES FOR YOU openai just confirmed it. its called textGrain and it hits chatgpt and codex in the EU over the next few weeks, because the EU AI Act forces it you wont see anything. no weird symbols, no hidden...”

@@0xDepressionn41

“OpenAI explains how it will watermark ChatGPT text to comply with EU provenance rules”

@u/rhiever417
Broadcast
ChatGPT, Claude, Gemini are now hiding watermarks in your text: What it means for you

ChatGPT, Claude, Gemini are now hiding watermarks in your text: What it means for you

ChatGPT Watermarks Just Dropped!

ChatGPT Watermarks Just Dropped!

OpenAI Has Started Adding Something Invisible to ChatGPT Texts

OpenAI Has Started Adding Something Invisible to ChatGPT Texts