OpenAI 也给 ChatGPT 的文字加水印了
OpenAI 今天宣布,未来几周内,欧盟用户在 ChatGPT 和 Codex 里生成的文字会带上一种看不见的水印,用来满足欧盟《人工智能法案》(EU AI Act)的要求。
顺便说一下 8 月,Anthropic 已经给 Claude 加了水印,原因也是一样的。
起因是欧盟 AI 法案的透明度条款在今年 8 月 2 日生效,要求 AI 生成的内容能被机器识别。7 月欧盟出了一份配套的行为准则,Anthropic、OpenAI、Google、Meta、微软等约 190 家签了字。
两家的差别主要在范围。
OpenAI 只在欧盟给 ChatGPT 和 Codex 默认加水印,其他地区的 ChatGPT 用户不受影响。API 这边,全球开发者可以在项目或组织设置里自己打开,部分模型今天就能用,默认关闭。
Anthropic 的方案是全球统一,水印直接做在模型层面,网页版、API、Claude Code 输出的文字都带,用户关不掉。Anthropic 给的理由是,暂时没有可靠的办法按地区区分。新模型已经带上水印,旧模型会在未来几个月陆续更新。图片和文件另外用 C2PA 标准,在文件元数据里附一段加密签名的来源说明。
两家加水印的算法都差不多,大模型生成水印时,每一步都要在几个差不多合适的词里随机挑一个。水印就是把这个“随机”换成一套带密钥的规则,让选词带上一种统计规律。人读起来没有区别,检测工具拿着密钥一算,就能判断这段话大概率出自哪家的模型。OpenAI 把自己的技术叫 textGrain,Anthropic 的原理基本相同。
检测工具两家都没对公众开放。OpenAI 只接受审核通过的研究人员和专业机构申请。Anthropic 的检测接口在内测,面向监管机构、执法部门、媒体、事实核查机构、研究人员、教育机构和有合规需求的企业。普通人想贴一段文字进去自己查,目前两家都做不到。
理论上来说,你手动稍微改写或换个开源模型润色修改下,标记就会变弱。
所以两家都强调:查不出水印,不能证明是人写的。水印也说明不了人改了多少、版权归谁、内容对不对。
真是脱裤子放屁——多此一举!