Claude开始在你说过的每句话上「盖章」:最容易翻车的不是AI代笔党,而是只让AI润色过简历的你

源自13位全网作者

03:48

这两天,AI 工具圈最热闹的事,是 Claude 的「隐形水印」。8 月 11日,Anthropic 正式确认:从 2026 年 8 月 2 日起发布的新 Claude 模型,生成的所有文本都会在模型层嵌入肉眼不可见、机器可检测的水印。微博它不是文件属性里的一个标签,你复制到微信、邮件、Word 或网站后,水印仍然跟着走,部分编辑后也可能保留。知乎

Claude开始在你说过的每句话上「盖章」:最容易翻车的不是AI代笔党,而是只让AI润色过简历的你

消息一出,官方解释推文被 1020 万人围观,评论区一边倒地炸锅。知乎另一边,开源去水印工具 watermarks-remover 上线三天左右便冲上万 Star,截至 8 月 19 日,Star 数已一路飙升至 13800+。36氪有人喊「天塌了,不能用 AI 写文章了」,也有人忙着收藏各种去水印教程。先别慌,这篇把水印到底能干什么、不能干什么,替你算清楚——因为真正的风险点,和大多数人想的不一样。

一、先停慌:这枚水印不能干什么

先说原理,一句话版本:水印不往文字里塞隐藏字符,也不改变语句含义,Anthropic 做的事情,是换掉模型选词时那个随机数的来源。知乎模型在「高兴」和「开心」之间做选择时,会被一把密钥导出的伪随机信号影响,读者读起来一模一样,持密钥的人却能从选词规律里统计出这是不是 Claude 写的。这套技术来自谷歌 DeepMind 的 SynthID-Text,谷歌早就在 Gemini 上部署过,近 2000 万条回复的测试里,用户好评率和差评率的差异不到 0.02%,对输出质量基本无感。

所以有三件事值得记住:

  1. 它定不了你的身:水印不含任何用户身份信息,检测只能说明内容可能被 Claude 处理过,不能直接判定整篇都是 AI 代写,更查不出是谁的账号生成的。知乎

  2. 短文本很难测出来:信号要靠足够多的选词累积,有博主按学界主流方案估算,干净、一个字没改的文本,50 个 token 就够;被人认真改写过的,要 800,差 16 倍。小红书注意,这是学界数据,不是 Claude 的官方参数——Anthropic 至今没公开技术细节,目前官方检测工具还没正式放出来,说正在做。小红书

  3. 它不是判决书:水印能证明「Claude 来过」,却证明不了「全文都是 Claude 写的」,也证明不了内容的真假。至于「Claude 水印一夜被废」这类标题,也属于夸大——官方确实承认重度改写、大段重写、来回翻译、混进大量人工内容,信号会变弱甚至消失,但这和「作废」是两码事。小红书

Claude开始在你说过的每句话上「盖章」:最容易翻车的不是AI代笔党,而是只让AI润色过简历的你

二、风险账:哪种用法水印信号最强

这是最反直觉的部分。水印信号的强弱,取决于「有多少词是 Claude 选的」:

用法

水印信号

原因

把中文稿交给 Claude 翻译

最强,必带水印

译文的每个词都是 Claude 选的

全文润色、重组段落

Claude 重新选择的词越多,信号越明显

轻度校对、改错别字

改动的选词少,可能积累不够统计信号

用 Claude 写代码

正文很弱,注释是重灾区

代码语法固定、选择空间小,注释是自然语言

AI 当参谋,自己动笔写

每个词都是你选的

也就是说,翻译是用法里的头号重灾区,翻译则必带水印。知乎这样一来,真正危险的人群就清楚了:不是天天让 AI 代笔的人——他们早就该担心了;而是「原稿自己写的,只让 Claude 稍微改一下」的人。虽然简历是你写的,Claude 只调整了表达;论文数据和结论也是你的,它只改了英文,但导出的文字,仍可能带有 Claude 标记。知乎简历润色党、论文语言润色的留学生、申请文书党、周报公文党,恰好都在这条线上。老师、公司或平台如果检测到标记并把它当成 AI 证据,麻烦就来了——哪怕它并不能证明整篇是代写。

还有一个比「被查出来」更扎心的隐藏风险:被栽赃。苏黎世联邦理工的研究显示,只靠查询公开 API,洗除和伪造的成功率都超 80%,成本不到 50 美元。小红书水印洗掉的结果是 AI 文本装成人写的,伪造的结果却是人写的被栽赃成 AI——在学术诚信这些场景里,冤枉一个人的代价远大于漏掉一个。

三、去水印工具破万 Star,先把这三笔账算清

watermarks-remover 三天冲上万 Star,是因为它确实把 AI 标记拆成了三层来处理:A 层用确定性脚本处理不可见 Unicode 与双向文本,B 层通过 Agent 重写应对统计水印,文件层覆盖 C2PA、EXIF 等元数据。知乎前两层基本无损,真正贵的是第三层:藏在选词里的统计水印,只能靠另一个模型把全文重写一遍。

Claude开始在你说过的每句话上「盖章」:最容易翻车的不是AI代笔党,而是只让AI润色过简历的你

具体拆开,是三笔账:

  1. 重写不是免费的,也不是无害的。工具自己的 README 都在追问:如果最后仍要让便宜模型把全文重写一遍,最初为什么要为高端模型付费?知乎重洗一遍,原文的语气、节奏和细节可能被一并洗掉,还要多付一次调用费。

  2. 自己跑也不轻松。处理图像水印的组件 CtrlRegen 一次要拉下来约 10GB 模型,16GB 内存更稳,没有 GPU 就要做好久等的心理准备。36氪

  3. 最讽刺的一笔:有人让 Claude 帮忙安装这个工具,Claude 拒绝了。知乎哪怕用户反复强调,内容是自己写的,水印也是自己不想要的,Claude 依旧选择拒绝。36氪它可以帮你生成、帮你检测,但不肯亲手拆掉自己留下的标记。

最后必须提醒一句:别把网上的 Claude 去水印神器用在论文、商业文档或私有代码上,别水印还没弄掉,未发布内容反而先泄露给了陌生网站。知乎

四、普通人怎么办:一份行动清单

不用卸载 Claude,但值得做这几个调整:

  1. 把 Claude 从「代笔」挪到「参谋」位。用它帮忙理思路、出草稿,然后自己认真改一遍。小红书这不是妥协,是官方都承认信号会因此变弱的最稳用法。

  2. 留好创作过程。保留提纲、资料来源和修改记录,比争论检测分数更可靠。小红书万一被质疑,过程证据比任何申辩都硬。

  3. 翻译重度用户多做一步:AI 翻译之后,自己完整过一遍全文。注意,简单换几个同义词基本没用,官方明确说过这种程度洗不掉信号。

  4. 敏感文档别碰去水印工具,尤其是没发布过的论文、商业材料和私有代码。

  5. 盯住三个后续信号:Anthropic 何时放出官方公开检测器;约 190 家签了欧盟透明度准则的机构里,OpenAI、谷歌、Meta、微软还有谁跟进。知乎以及今年 12 月 2 日之前,Claude 的存量老模型也将逐步完成水印适配。知乎

Claude开始在你说过的每句话上「盖章」:最容易翻车的不是AI代笔党,而是只让AI润色过简历的你

另外有个背景值得知道:给 AI 内容打标不是欧盟独有的动作。国家网信办等四部门联合发布的《人工智能生成合成内容标识办法》已于 2025 年 9 月 1 日正式施行,所有 AI 生成的文字、图片、视频等内容都要「亮明身份」。微博从欧盟法案到国内办法,「用 AI 留痕」是全球已经落定的方向,躲是躲不掉的,能决定的只有怎么留下对自己有利的痕迹。

写在最后

这场争论里最扎心的一句话说得很透:你花十个小时查资料、想选题、搭框架,最后让 Claude 帮你顺两句话;另一个人把整篇文章丢给 Claude,从头到尾一键生成,在水印面前,两者可能是一个待遇。36氪这正是水印的不完美之处,也正是你不必恐慌的原因:Claude 水印能提供线索,但不能充当「AI 写作」的判决书。小红书对认真用 AI 工具的普通人来说,这件事不是 AI 写作的终点,而是「AI 使用留痕时代」的起点——AI 可以参与你的工作,但创作过程和最终责任,得留在自己手里。这篇建议收藏,不为焦虑,为那份账。

内容由AI生成

精选参考来源

1. Claude「隐形水印」冲上热搜:1020 万人围观,全球网友彻底炸锅!

2. 离谱!Claude 给文字加上隐形水印,复制粘贴也会跟着走

3. Claude AI水印要多少字才测得出来

4. Claude文字水印来了:它到底能证明什么?

5. 天塌了 Claude 也开始给文字加水印了

6. Anthropic 宣布将给 Claude 的输出内容加上机器可读的标记,包括文本中嵌入的隐形水印,以及生成文件中附加的数字签名元数据

7. 【#隐形水印上线AI写作开始留痕#】“这段文字是人写的还是AI生成的?”随着技术进步,或许这样的问题可以一定程度得到解决

8. Anthropic 今天确认,从 2026 年 8 月 2 日起发布的新 Claude 模型,生成的所有文本都会在模型层嵌入肉眼不可见、机器可检测的水印

9. AI开源推荐 | watermarks-remover 中文版:让 AI 代理少写无效代码

10. 因为一枚看不见的AI水印,Anthropic又成了大反派

11. Claude的水印原理解析

12. Claude输出嵌入隐形水印,为了合规还是为了溯源?网上一堆"水印移除工具"到底有没有用?

13. 【#明起AI生成内容必须亮明身份##AI生成图文视频内容须标识#】《人工智能生成合成内容标识办法》明天(9月1日)起将正式施行,所有AI生成的文字、图片、视频等内容都要“亮明身份”

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章