OpenAI 10 月 5 日发文回应欧盟《AI 法案》对生成文本「机器可识别」的要求:自即日起,全球 API 客户可对部分模型选择开启文本水印(API 默认关闭);未来几周,欧盟地区所有套餐的 ChatGPT 与 Codex 合格文本输出将加入隐形水印。技术名为 textGrain,通过对词选择施加统计信号实现,官方称效果持平或优于 SynthID 文本版,并计划开源。检测器暂只向获批研究者开放。在 1% 误报率下,200 token 段落检出约 80%、400 token 约 95%,替换 25% 同义词后降到 17%;Astra 各基准有无水印差异不明显。
核心要点速览
- ✓范围:欧盟 ChatGPT + Codex 合格文本输出未来几周加隐形水印(所有套餐);API 全球可选开启、默认关闭(官方公告)
- ✓检出率:1% 误报率下,200 token ≈80%、400 token ≈95%;数学类文本明显更低
- ✓鲁棒性:400 token 段落替换 10% 同义词,检出从约 92% 降到 66%;替换 25% 降到 17%
- ✓质量:Astra(max)有/无水印 DeepSWE v1.1 72.80% vs 71.68%、Terminal-Bench 4.0 53.90% vs 56.06%、GPQA Diamond 94.44% vs 93.94%
- ✓开放:textGrain 技术报告 已发布并计划开源;检测器仅向获批研究者/机构开放申请

开发者 3 秒速决决策指标
把技术选型换算成你的开发预算
29+ 款主流编程套餐横向比价,支持输入/输出 Token 真实账单模拟
相关资源与官方项目出处
免代理直达深度技术解析与实战评估
核心背景与行业痛点
欧盟《AI 法案》要求生成式 AI 提供方让生成文本「可被机器识别」。图像和音频已有 C2PA、SynthID 等方案,文本却极易被改写、翻译,水印一直是难题。OpenAI 在 EU 文本溯源公告 中给出分阶段答案,而且直接波及开发者最常用的 Codex:欧盟地区生成的代码与文本将带隐形水印。
架构亮点与底层机制
方案名为 textGrain:在模型选词时注入不可见的统计信号,检测器据此判断段落是否含 OpenAI 水印,细节见 textGrain 技术报告,官方称效果持平或优于 SynthID 文本版,并计划开源。部署分三步:API 客户即日起可对部分模型选择开启(默认关闭);未来几周欧盟 ChatGPT 与 Codex 合格输出默认加水印;检测器仅向获批研究者开放。水印不识别用户,也不记录提示词。
权威 Benchmark 与实测跑分对比
官方数据:1% 误报率下,200 token 段落检出约 80%,400 token 约 95%,数学类文本明显更低;替换 10% 同义词检出从约 92% 降到 66%,替换 25% 降到 17%。质量方面,Astra(max)有/无水印对比:DeepSWE v1.1 为 72.80% / 71.68%,Terminal-Bench 4.0 为 53.90% / 56.06%,GPQA Diamond 为 94.44% / 93.94%,差异不明显。
开发者实战落地与开箱指南
面向欧盟用户的产品,可评估在 API 中开启文本水印来满足透明度义务,具体以 OpenAI 开发者文档 和帮助中心说明为准;图像与音频可用 Content Provenance API 校验。需要注意:短文本、代码这类低熵输出水印很弱,「没检测到水印」并不能证明是人写的,不要把它当作判定 AI 代写的依据。
即刻查看该技术对应模型与主流工具的实测差异,或一键测算团队 API 调用与 $20/月套餐盈亏平衡点。
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察