OpenAI 将在欧盟为 ChatGPT 文本加水印,API 可选手动开启
OpenAI 用改选词的方式给 AI 文本埋不可见水印以合规欧盟,但改同义词就能大幅绕过,实际是检测能力有限下的过渡方案。
OpenAI 周一宣布,将在未来几周为欧盟地区的 ChatGPT 和 Codex 用户添加不可见水印,以符合 8 月 2 日生效的欧盟 AI Act 透明度规则。水印不插符号,而是微调模型的选词,可随复制粘贴一起走,全球 API 开发者即日起可对部分模型手动开启,默认关闭。
正文摘录
OpenAI 将在欧盟开始为 ChatGPT 的文本加水印 OpenAI 周一在一篇 [博客文章](https://openai.com/index/eu-text-provenance/) 中表示,为遵守欧盟 AI Act(《人工智能法案》),它将开始在欧盟地区为 ChatGPT 和 Codex 生成的文本添加不可见水印。 [欧盟 AI Act 的透明度规则](https://digital-strategy.ec.europa.eu/en/policies/guidelines-ai-transparency-obligations) 已于 8 月 2 日生效,要求 AI 公司以其他系统可识别的方式标记 AI 生成内容。 OpenAI 表示,水印将在未来几周内向所有套餐中符合条件的 ChatGPT 和 Codex 用户推出,但仅限于欧盟。世界任何地方使用 OpenAI API 的开发者,从今天起可以针对部分模型开启这项功能;它默认关闭。OpenAI 表示,发布之初不会把文本水印设为全球默认。 水印并不是一个实际的符号,而是通过微妙地塑造模型的用词选择来运作,留下一种读者看不见、但检测器能捕捉到的模式。因为水印藏在词语本身之中,所以文本被复制粘贴时,水印会随之移动。OpenAI 表示,水印不会识别用户身份,而且开启后其模型性能没有出现有意义的变化。 OpenAI 还在发布公告的同时,公开了其方法的技术报告——名为 textGrain 的 [技术报告](https://cdn.openai.com/pdf/e9508624-d767-41b6-a26d-e34ca798ada6/textgrain-entropy-calibrated-watermarking-for-language-model-text.pdf)。