OpenAI给欧盟ChatGPT文本加水印:textGrain检出92%,改词后17%

OpenAI 于 10 月 6 日公布欧盟文本溯源方案,ChatGPT 与 Codex 在欧盟地区的文本输出将在未来数周内嵌入名为 textGrain 的隐形水印,覆盖全部套餐。技术路线是在模型选词的概率分布里加入不可见的统计信号,而不是嵌入零宽字符这类可以被直接剥离的标记。API 端全球客户可自选启用,默认为关闭。

检出率的真实数字

OpenAI 自己的测试数据是这样的:在 1% 误判率下,200 token 的段落约 80% 能检出,400 token 约 95%。但数学类内容因为选词空间小,检出率明显更低。换词编辑的影响更大——替换 10% 的词,检出率从约 92% 掉到 66%;替换 25% 掉到 17%。官方称在自家Astra 模型的评测里,加水印与不加水印的分数差异极小。

检测器不公开

检测工具目前只向经审核的研究人员和专业机构开放申请,首批包括康奈尔、ETH 苏黎世和斯洛伐克 KInIT。OpenAI 说计划开源这项技术,但没有给时间表。

对比之下Anthropic 的做法更宽:从 8 月 2 日起在所有地区给 Claude 文本加水印,API 端也一样,OpenAI 这次只限欧盟范围。另一处细节是 ChatGPT 用户是否可以退出,OpenAI 没有说。OpenAI 已有的图片和音频验证工具(包括 openai.com/verify 网页工具和内容溯源 API)继续对公众组织开放。违规成本方面,《人工智能法案》第 50 条的罚款上限是 1500 万欧元或全球营业额的 3%,2026 年 8 月 2 日之前上市的系统可宽限到 12 月 2 日。

相关阅读:智谱发布 GLM-5.3:基座没换只炼后训,编程提升 50% 登顶开源