Moran StudioMoran Studio

形势大于实际,OpenAI 上线了文本水印技术 textGrain

•3 分钟阅读
形势大于实际,OpenAI 上线了文本水印技术 textGrain

为了应对欧盟 AI 法案的监管要求,OpenAI 宣布上线文本水印技术 textGrain。

Claude 在今年 8 月的时候也是因为欧盟合规要求和「安全人设」,直接基于 Google DeepMind 的 SynthID-Text 技术给模型加上了文本水印。

OpenAI 的这项技术两年前就已经做出来了,当时华尔街日报就披露过内部测试数据,基于统计偏差的水印识别准确率高达 99.9%。

但 OpenAI 自己做的内部调研结果显示,如果加上水印,将近三分之一的 ChatGPT 核心用户会立刻流失,因此迟迟没有应用。

当然,前提是竞对没有上,这下 Claude 已经上了,欧盟又有要求,就顺势上了。

不过并非全量上线,这项技术只在欧盟范围内对 ChatGPT 和 Codex 的文本输出默认开启。全球 API 客户默认关闭,提供了主动启用的选项。至于检测器,普通用户几乎用不上,也只向少数审核通过的研究机构和专家组织开放申请。

为了打消用户对文本水印是否影响推理性能的疑虑,OpenAI 特意使用 Astra 跑了一圈基准测试,证明加了水印之后编程和推理性能几乎没有下降。其实 Claude 已经跑了那么久了,也都习惯了。

从官方提供的数据来看,textGrain 的水印技术还是比较脆弱的。

文本只要被稍微改写或者替换 10% 的近义词,检测率就会从 92% 降到 66%。换掉 25% 的词,检测率直接跌到 17%。遇到数学推导或者逻辑严密的内容,几乎无法检测。

检测手段不公开,其实该怎么用还是怎么用,本身水印只能验证是否是 AI 生成内容,无法验证是谁生成的。

结果水印本身也不够强,叠个模型稍微再改改,润色一下,水印就没了。

咋说呢?这都不是脆弱了,这是相当脆弱,只能说防监管的作用大于实际作用。