OpenAI将为欧盟ChatGPT与Codex文本加textGrain水印,全球API可选
OpenAI will watermark ChatGPT text in the EU but makes it optional for API users worldwide
OpenAI将在未来数周为欧盟的ChatGPT和Codex用户开启textGrain不可见水印,在用词中嵌入统计信号以符合欧盟规则,同时把全球API水印设为可选,不同于Anthropic对Claude的强制方案。
OpenAI 正在为 ChatGPT 文本添加隐形水印,以遵守欧盟规定。与 Anthropic 不同,它将允许全球 API 客户关闭这些水印。
据报道,欧盟《人工智能法案》要求 AI 提供商以机器可读格式标注生成的文本。OpenAI 的方案是 textGrain,这项技术会在模型的用词选择中嵌入不可见的统计信号。它的工作方式与 Claude 的 SynthID 水印 非常相似,后者使用了 Google 的开源技术。
OpenAI 表示,将在未来几周内为欧盟的 ChatGPT 和 Codex 用户开启水印。API 水印将在全球范围内采用选择加入方式,这与 Anthropic 对 Claude 强制实施的水印 不同,后者无论用户以何种方式访问模型都会在全球适用。OpenAI 的 API 水印也将在未来几周内通过 Microsoft Azure 等云合作伙伴提供。
文本编辑会大幅降低检测率
OpenAI 表示,textGrain 在内部测试中达到或超过了其他方法,包括 Google 面向文本的 SynthID。该公司还计划将这项技术开源,以便其他人在此基础上进行开发。
检测率在很大程度上取决于文本长度和主题。当检测器的目标误报率设为 1% 时,它在约 95% 的 400 token 心理学段落中识别出了水印。在 200 token 时,这一比例降至约 80%。
OpenAI 表示,数学内容的检测率“大幅更低”,因为模型在这类内容中选择用词的自由度更小。更长的段落可能会增强统计信号并提高检测率,不过结果仍可能取决于内容。OpenAI 没有提供数据来验证这一假设。

编辑文本也会使水印更难被检测。OpenAI 表示,仅将 10% 的单词替换为同义词,就会使 400 token 段落的检测率从约 92% 降至 66%。替换四分之一的单词后,检测率降至 17%,水印很容易被规避。这一弱点可能反而对 OpenAI 有利。如果水印变得更难去除,不想让自己使用 ChatGPT 的情况被检测出来的用户,可能会转向开放权重模型。

一份 技术报告 深入解释了 textGrain 的工作原理。Anthropic 尚未公布 Claude 水印的检测率,不过它表示其系统能够很好地抵御编辑。
OpenAI 表示水印不会损害输出质量,并援引了其前沿模型 Astra 的测试。该公司报告称,在包括 GPQA Diamond、BrowseComp 和 DeepSWE 在内的八项基准测试中,开启或关闭水印没有显著的性能差异。这些结果并不能确定水印是否会影响写作质量,而 批评者也对 Claude 的水印提出了同样的质疑。
OpenAI 还表示,检测到的水印并不能说明文本中融入了多少人类创造力或编辑。它不能确立所有权、分配责任、识别用户,也不能表明文本是否准确;未能检测到水印同样不能证明文本是人类撰写的。这段文本可能过短、经过编辑或翻译,或者来自检测器不支持的模型。
OpenAI 目前将限制检测器的访问权限
最初只有选定的研究人员和专业机构才能使用 textGrain 的检测器。他们可以通过申请表申请。OpenAI 将根据欧盟的行为准则逐案授予访问权限。Anthropic 采取了类似的对其检测 API 的做法。
该工具只会报告是否检测到 OpenAI 水印。它不会识别用户,也不会透露他们的提示词或对话。
OpenAI 表示,限制访问是因为检测器可能会标记未加水印的文本,或漏检水印。该公司计划“在我们认为结果能够被负责任地解读时”扩大访问范围。它尚未说明这可能在何时发生。
现有的图像和音频验证工具仍然公开可用,包括 openai.com/verify 和 Content Provenance API。
没有炒作的 AI 新闻 – 由人工策划
订阅 THE DECODER,即可享受无广告阅读、每周 AI 新闻通讯、每年六期独家“AI Radar”前沿报告、完整存档访问权限,以及评论区访问权限。
来源:The Decoder · the-decoder.com