OpenAI 将在欧盟逐步为 ChatGPT 和 Codex 文字加入水印
欧盟地区符合条件的文字输出将逐步加入不可见水印,API 客户可主动开启。检测有误报和漏报,不能据此判断作者身份、文字真伪或人的贡献。
以后看到一段文字,“有没有 AI 水印”可能会成为一个新问题。但水印能回答的,比“这篇文章是不是人写的”窄得多。
OpenAI 在 10 月 5 日宣布,将逐步给欧盟地区符合条件的 ChatGPT 和 Codex 文字输出加入不可见水印。全球 API 客户可以为部分模型主动开启,API 默认仍关闭。检测工具最初只向获批研究者和专业机构开放,尚不是人人可用的公开鉴定器。
水印藏在文字选择里
这不是在页面角落加一个标志,也不是把账号名字写进文章。textGrain 技术报告描述的是一种生成时加入的统计信号:模型选择词语的过程受到密钥相关规则影响,检测器再从文字中寻找这种关联。
可以把它粗略想成词语组合里留下了一种机器能识别的倾向。肉眼读起来仍是普通句子;判断依靠统计证据,而不是某个特殊字符。这个比喻只是为了理解机制,不代表任意长度的文章都能可靠识别。
OpenAI 也明确说明,短文字和被修改过的文字更难检测,而且存在误报和漏报。检测出信号,不等于知道用户是谁,也无法衡量作者贡献了多少判断和修改;没检出信号,也不能证明全文由人独立写成。
内容判断仍要回到文章本身
这一点对写作者和读者都很实际。用 AI 调整过一句话,和让它从头编了一整篇,是不同的创作过程。一个检测结果不能替你还原这些过程,更不能替代对事实、引用和论证的检查。
例如,一篇报道把来源、采访对象和时间交代清楚,即使编辑借助 AI 整理语言,读者依然有材料可以核对。相反,一篇没有依据、数字互相矛盾的文章,不能因为检测器没发现信号就获得可信度。这是编辑对阅读方式的建议。
因此,值得期待的是它能不能为内容来源提供一条有用线索,而不是用一个标签给文章定性。涉及具体作者时,保留草稿、材料和修改记录,通常比争论一个孤立的检测分数更能解释作品是怎样形成的。