ARTICLE DETAIL

资讯详情

深耕商务建站与企业官网运营的一线实战洞察。

ChatGPT文本将带隐形水印:改写一遍还能查出来吗

ChatGPT文本将带隐形水印:改写一遍还能查出来吗 10 月 5 日,OpenAI 宣布了一件不太显眼的事:未来几周,欧盟用户拿到的 ChatGPT 和 Codex 文本会被加上机器可识别的隐形水印,技术名字叫 textGrain。你在屏幕上什么都看不到,但检测器能认出来。这件事的关键不是"加了个标记",而是它到底加在哪里。水印不在文末,藏在选词里一句话说清:它不是往文本里塞一段隐藏字符,而是让模型在挑词的时候带上一点统计上的偏好。模型每写一个词,都是在若干近义候选里做一次选择。textGrain 会在这些选择上按一段密钥施加极小的偏移,单看一句话完全看不出差别,但一段 400 个 token 的文字累积下来,选词分布就会呈现出某种"笔迹"。检测器读的正是这段分布,判断它是否来自带水印的 OpenAI 模型。这也解释了一个反常识的现象:水印的检出率跟文本长度、用词自由度直接挂钩。心理学这类可以换着说法写的内容,信号最容易积起来;数学推导里能替换的词本来就少,检出率会明显往下掉。官方给出的几个数字,比新闻标题有意思OpenAI 公布的测试结果是:200 个 token 的心理学文本,检出率约 80%;同样的内容写到 400 个 token,约 95%。把 10% 的词换成近义词,检出率从约 92% 掉到 66%。换掉 25% 的词,检出率只剩大约 17%。翻译一遍、或者大改一遍,同样会削弱信号。也就是说,这个水印能回答"这段文字像不像 OpenAI 写的",回答不了"整篇是不是 AI 写的",更量不出人到底改了多少。还有一条边界容易被忽略:检测器的结果只有"命中"和"未命中",它不会告诉你这句话是谁问的、提示词写了什么、对话里聊过什么。OpenAI 自己也承认当前的文本水印技术有明显局限,检测器可能误报,也可能漏掉真实存在的水印。为什么只在欧盟推,还推得这么小心原因写在公告里:为了遵守欧盟《人工智能法案》的透明度
返回列表
PREV
查看更多资讯
NEXT
返回资讯列表