OpenAI textGrain:欧盟推出的隐形文本水印
战略概览
- 01.textGrain是OpenAI专有的系统,可将一种不可见的统计信号嵌入ChatGPT和Codex输出的词汇选择中,之后可通过专用检测器识别。
- 02.该系统使用一个秘密数学密钥来偏置词项选择的概率分布,而非插入隐藏字符,因此这种模式存在于句子结构本身之中。
- 03.API的可选访问功能(默认关闭)已于2026年10月5日向全球开放;针对欧盟地区的ChatGPT和Codex部署将在未来几周内展开,合规宽限期持续至2026年12月2日。
- 04.在欧盟以外地区,textGrain仍为可选、默认关闭的API功能,与Anthropic不同——后者在全球范围内应用其水印,因为它表示无法可靠地按区域限制该功能。
- 05.检测器的访问最初仅限于经批准的研究人员和合作伙伴,而欧盟关于AI生成内容透明度的《行为准则》则单独要求向欧盟监管机构、执法部门、媒体、事实核查机构及民间社会组织提供访问权限。
- 06.OpenAI声称,textGrain在文本检测性能上达到或超过了谷歌DeepMind的SynthID等竞争对手的方法。
深度分析
欧盟强制启用,其他地区需手动开启
其发布时间表明确按司法管辖区划分:全球范围内的API可选访问(默认关闭)已于2026年10月5日开放,而符合条件的欧盟地区ChatGPT和Codex文本将在未来几周内自动加水印,合规宽限期持续至2026年12月2日[3][4]。这一设计与Anthropic形成鲜明对比——后者在全球范围内应用基于SynthID-Text的水印,没有区域性开关,因其表示无法持久地按区域限定该功能[3]。截至2026年7月,约有190个组织(包括OpenAI、Anthropic、微软、谷歌和Meta)已签署欧盟关于AI生成内容透明度的《行为准则》[4],未遵守第50条者可能面临高达全球年收入3%的罚款[1]。实际效果是形成了一个固有的合规缺口:除非开发者主动启用,否则大多数欧盟以外的ChatGPT和API流量仍将不带水印。
一种无法抵御编辑的水印
根据OpenAI自己的数据,在200个词元长度的段落中检测率约为80%,在400个词元长度下约为95%(误报率为1%)[3][4],但这种表现极为脆弱。仅替换段落中10%的词语为同义词,检测率就从约92%降至66%;替换率达到25%时,检测率暴跌至约17%[1][5]。数学类内容及其他低熵文本的检测率远低于普通散文,且可靠性因语言而异,根据OpenAI自身的测试,罗马尼亚语约为42.2%,西班牙语则为69.0%[3]。OpenAI的技术报告坦承实验室条件与现实之间的差距,指出理想条件下表现出色并不能保证日常使用中的可靠检测[2],并强调检测到水印只能说明某段文字曾由OpenAI系统生成或处理过,却无法反映其中包含多少人类判断、编辑或创造性加工[4][5]。
谁可以检查,以及为何存在争议
与水印本身不同,检测器并未公开。访问权限最初仅限于经批准的研究人员及合作机构,包括康奈尔大学、苏黎世联邦理工学院(ETH Zurich)和KInIT;而欧盟《行为准则》则另行规定必须向欧盟监管机构、执法部门、媒体、事实核查机构及民间社会组织提供访问权限[3]。OpenAI还声称textGrain的检测性能达到甚至超过了谷歌DeepMind的SynthID文本方案[6],试图从技术层面证明其系统的竞争力,尽管其访问模式仍受严格控制。这种组合——仅在一个区域内强制实施、其他地区默认需手动启用、检测器仅对审核通过方开放——正是引发公众广泛质疑的原因:textGrain究竟是真正的透明工具,还是仅仅为了应付合规要求而打勾?
历史背景
关键关系图
事实来源
[1] OpenAI's ChatGPT Text AI Watermark for the EU
[2] OpenAI Will Add a Digital Watermark to Text and Code Generated in the EU
[3] OpenAI Will Watermark ChatGPT in the EU, But Leaves the API Opt-In
[4] OpenAI Plans to Watermark ChatGPT and Codex Text Output in EU Amid AI Transparency Push
[5] OpenAI Introduces Text Watermarks for the EU to Comply With the AI Act
[6] OpenAI Is Adding Text Watermarking in ChatGPT and Codex
来源文章
OpenAI向欧盟递交答卷:textGrain水印系统实测检测率与易碎争议解析
OpenAI unveils textGrain, a new text watermarking system
ChatGPT text is getting an invisible watermark in Europe to comply with the EU AI Act. Here’s how it works
OpenAI Is Hiding a Secret Fingerprint in ChatGPT’s Words
OpenAI will watermark ChatGPT and Codex output in Europe
THE SIGNAL.
“OpenAI自身警告称,实验室中的良好表现并不意味着现实中可靠的检测能力。”
“水印只能表明某段文字曾由OpenAI系统生成或处理过,无法反映其中有多少内容体现了人类的编辑、判断或创意。”
“两家公司均认为,未能检测到水印信号不能作为证明文本由人类撰写的确凿证据。”
“OpenAI is rolling out text watermarking for the EU AI Act - opt-in for API customers globally for select models starting today, ChatGPT and Codex text in the EU gets an invisible watermark over the coming weeks textGrain adds an invisible statistical signal to the model's word...”
“Announcing our work textGrain, @OpenAI's text watermark in response to the EU AI Act. OpenAI is rolling out textGrain in the EU and opening detector access to researchers. We'll open-source it so the community can build on top.”
“CHATGPT WILL START HIDING AN INVISIBLE MARK IN EVERYTHING IT WRITES FOR YOU openai just confirmed it. its called textGrain and it hits chatgpt and codex in the EU over the next few weeks, because the EU AI Act forces it you wont see anything. no weird symbols, no hidden...”
“OpenAI explains how it will watermark ChatGPT text to comply with EU provenance rules”

ChatGPT, Claude, Gemini are now hiding watermarks in your text: What it means for you

ChatGPT Watermarks Just Dropped!

OpenAI Has Started Adding Something Invisible to ChatGPT Texts