Claude 隐形水印上线了,但你论文上那个"AI率"和它没关系:先别交恐慌税

源自73位全网作者

14:10

8 月 2 日起,Anthropic 新发布的 Claude 模型默认给输出文字打上人眼看不见、设置里关不掉、复制粘贴也"跟着走"的水印。微博微博上那条讲这事的主帖拿了 462 赞、63 条评论;紧接着 GitHub 上一款去水印工具 11 天狂揽 1.6 万星;知乎开学季版面里,"降 AIGC 率"的帖子和"自写论文被判 10% AI"的求助开始成片出现。

如果你平时用 AI 起草邮件、润色报告、改论文,这两周你大概率刷到过"AI 写作开始留痕"的话题,并且想过同一个问题:我写的东西,机器到底能不能看出来?

我把 Anthropic 的官方说明、欧盟法条背景、那款 1.6 万星工具的文档,以及这两周的社区恐慌贴全部翻了一遍。先把结论放这:水印这件事是真的;"AI 代写检测器"的说法是假的;而急着卖你"去水印/降 AI 率"服务的钱,现在一分都不用花。

一、水印不是藏字符,是改了"掷骰子"的方式

评论区最高赞的误解,是以为水印=在文字里塞零宽字符,“一个脚本就洗掉了”。完全不是。

Claude 文本水印的真实机制,Anthropic 在 8 月 14 日专门做了说明:用的是 Google DeepMind 那套 SynthID-Text 方法的变体——大模型逐词生成文字时,本来靠随机数在多个同样合理的候选词里挑一个,水印做的事情是用一把密钥悄悄改变这个"随机性的来源"。选出来的词照样正常、读感没变化,但一整段话的用词序列里,藏着只有持密钥者能核对的统计模式。知乎有人拿大富翁打比方:本来掷骰子,现在改用圆周率小数位决定步数——玩家体验毫无区别,但事后拿着走法记录和圆周率,就能反推这局是不是"π 掷的"。

第二层标记才轮到文件:Claude 生成的 PNG、SVG 等文件会附加 C2PA 标准签名元数据(就是 Adobe、微软那批公司推的内容溯源协议)。微博另外确实存在"零宽字符注入"这条路子的水印,但那是别家工具的方案,Claude 官方明确说了不是——巧的是,后面会讲到那款最火的去水印工具,README 里恰恰把 Claude 标成了"Unicode 注入",这条误标本身就是信息混乱的来源之一。知乎

推手也很直接:欧盟《人工智能法案》第 50 条的机器可读标记义务 8 月 2 日正式生效,违规最高罚 1500 万欧元或全球营收 3%。知乎据知乎技术梳理,约 190 家机构签了配套透明度行为准则,Google、Meta、微软、OpenAI 都在列——但到目前为止真正把文本水印落到写作模型上的,只有 Anthropic 一家(Google 主要在图像侧的 SynthID;OpenAI 做过文本方案一直没上线)。微博所以这不是良心发现,是合规抢跑;全球生效是因为模型跑在服务器端,没法按护照分版本。

Claude 隐形水印上线了,但你论文上那个

二、“新模型都带水印"不等于"你写的每段字都被标了”

这是这两周被传丢得最狠的一个限定词:官方说法始终是 supported models(支持标记的模型),不是"所有 Claude 输出"。知乎

截至 8 月下旬的公开资料:Anthropic 现役主力阵容——Fable 5(6 月 9 日发布)、Opus 5(7 月 24 日)、Sonnet 5(6 月 30 日)、Haiku 4.5(去年 10 月)——全都发布于 8 月 2 日之前。官方承诺"此日期后发布的新模型从第一天支持,之前的逐步补齐",但补齐清单没公布,模型页也没有可查询的水印状态字段,配套检测 API 只有"即将推出",阈值、误报率、语言覆盖全部未公开。微博36氪

所以严格说,目前有三件事必须分开:制度启动了(真)、你用的那个模型补齐了没(无法审计)、你这段文字能被可靠检出吗(官方自己都列了一串失效情形:短文本、重度修改、换说法改写、交给外部流程翻译、和人类内容混写;截图、转格式、重新保存则丢文件元数据)。把这三层压成一个"都有水印"的布尔值,恐慌和无所谓两种反应都超出了证据。知乎

Claude 隐形水印上线了,但你论文上那个

三、学校查的"AIGC率",读不到 Claude 的水印

这是对学生和自媒体最有用的一条澄清:这是两套互不相通的系统。

知网、维普这类 AIGC 检测走的是文体统计学——看你的用词分布像不像大模型的高频模式。界面新闻它拿不到 Anthropic 的密钥,也没有对接任何官方检测接口(接口根本没发布)。所以你论文上那个百分比,和"Claude 水印"没有读取关系。反过来,你的 Claude 水印也不可能"被知网扫出来"。

那"完全自己写的,检测显示 10% AI"是怎么回事?同一问题下有个回答前半段其实说对了:学术写作的规范句式(模板化连接词、去人格化表达、工整排比)恰好和 AI 的高频统计特征高度重合,写得太"标准"就会在分布上"撞脸"。知乎这是文体检测的固有噪音,和水印无关,也不是你被抓到了什么。

把三个"检测器"摆在一起就清楚了:

谁在检测

检测原理

能读 Claude 水印吗

今天的真实水平

学校/期刊的 AIGC 检测

文体统计特征

不能(没密钥没接口)

有误报,"写得太规范"也会中

Anthropic 官方检测 API

持密钥核对统计模式

未发布,只有 soon

第三方"Claude 水印扫描器"

自称模式识别

不能可靠

无权威依据,别用于自动处罚

Claude 隐形水印上线了,但你论文上那个

四、两周恐慌税:谁在收割这件事

事件发酵速度比技术落地快得多,围绕它的生意已经排好队了。

第一拨:卖检测的。 我随手点开知乎"自写论文被判 10%“的问题,最高赞回答前半段科普误报原理,后半段直接挂出"全国多所高校指定系统、注册享 5 折"的检测服务链接,自称"准确率 94.75%、误报率<0.05%”——没有任何第三方审计口径,纯自报数。618" data-quote-text="全国多所高校指定系统,公开数据集准确率 94.75%,误报率 < 0.05%。" data-highlight-text="准确率 94.75%,误报率 < 0.05%">知乎“降AI率工具红黑榜”"免费提示词降AI"这类帖子最近一周在知乎成片刷,互相之间的"实测"结论都对得上一个方向:指向自家链接。

第二拨:卖"去水印"的。 8 月 11 日当天就有 GitHub 项目抢跑,最火的 watermarks-remover 14 天迭代到 v0.5.0,拿下 16549 星、1895 复刻。知乎微博看它的文档,诚实的部分和心虚的部分一样明显:它的 Layer A 是清除零宽字符——对 Claude 的统计水印基本打不着(因为人家根本不是零宽字符方案,作者自己把 Claude 标错了);它的 Layer B 是让 Agent 重新改写打乱 token 分布,作者原话承认这是"尽力而为,不是保证清除",“别拿它去对抗持有密钥的官方检测系统”;Layer C 清文件元数据,倒是对 C2PA 有效。也就是说,这套 1.6 万星的核心业务是"用另一个模型洗一遍稿"。而洗稿的代价你自己也能想到:文风漂移、事实细节被改坏,以及——换一个模型的统计指纹而已,学校那套文体检测器照样可能重新打分。

第三拨:卖恐慌本身的。 “AI 写的东西不属于你了”“时代结束了"这类标题拿了不少转发。实际上 Anthropic 官方的表述克制得多:检测到水印只能说明内容"可能经过 Claude 处理”——润色、翻译、总结都算;检测不到也不代表是人写的。它从来不是作者身份证,更不是作弊鉴定器。微博

所以判断很简单:官方检测 API 还没发布、你的模型大概率还在补齐队列里、学校的检测器读不到水印——这三件事同时成立的今天,任何让你掏钱的"被抓到了怎么办",都早得可疑。

Claude 隐形水印上线了,但你论文上那个

五、不同身份现在该做的,其实各只有一件事

学生/职称申报党: 别买付费降AI率。要做的两件不花钱的事——① 留证据链四件套:与 AI 的完整对话记录、你的初稿版本、修改过程的时间戳文档、你的提纲笔记;真被判高就申诉,学校要求逐段说明时这套材料才顶用。② 自查"撞脸"句式:通篇模板连接词、排比、去人格化长句是误报重灾区,人工过一遍反而更像你。继续观察信号:本校 AIGC 检测用哪家、阈值多少——这比水印重要一百倍。

打工人(邮件/报告/文案): 当下实际影响接近零。微博真要动,就做一件事:重要交付文档保留"用哪个模型、哪天生成"的记录,这是 C2PA 元数据在转存时丢不掉也补不回的那部分上下文。观望官方检测 API 和补齐清单发布。

自媒体/公众号号主: 你的合规压力根本不在 Claude 水印,在国内已经施行的《人工智能生成合成内容标识办法》——显式标识+文件元数据类隐式标识。发布时按平台要求勾选 AI 声明,比研究水印有用得多。平台后续是否读取隐式标识做限流,是值得盯的信号。

API 开发者/企业方: Anthropic 建议各自评估第 50 条义务,这句话是认真说的。工程上:把水印信号当辅助来源信号降级使用,别接进自动裁决链路;在逐模型状态表出来之前,保存请求日志、模型 ID 和编辑记录——这比任何第三方扫描器都可审计。知乎

结语:留痕时代开始了,裁决时代还没有

“AI 生成内容完全无法分辨"的时代,确实从 8 月 2 日起有了裂缝——这一步值得被认真对待,它就像纸币第一次印上防伪线:不能杜绝假币,但让"验一下"有了起点。央视网但这两周舆论把"可留痕"直接吹成了"可裁决”,中间隔着一整个没发布的检测体系。

值得收藏的继续观察清单就五条:Anthropic 的逐模型支持清单、官方检测 API(含阈值和误报率数据)、OpenAI 会不会跟进文本水印、国内大厂模型在文本隐式标识上的动作、欧盟第 50 条的第一张真实罚单。哪条落地,这篇内容的对应结论就该更新一次。在那之前——看到"你的 AI 写作已经被标记"的推送,先想想第四节的三拨生意,再决定要不要点那个"5 折"。

内容由AI生成

精选参考来源

1. 【#隐形水印上线AI写作开始留痕#】“这段文字是人写的还是AI生成的?”随着技术进步,或许这样的问题…

2. 同样的候选词,不同的骰子:Claude 文本水印的采样、检测与移除

3. Anthropic 宣布将给 Claude 的输出内容加上机器可读的标记,包括文本中嵌入的隐形水印,…

4. 开源 11 天狂揽 1.6 万星!这个工具帮你清除 Claude / Codex / DeepSee…

5. 不是零宽字符、不是可见字符、不在文本里藏特殊符号,Claude水印的原理是什么?

6. Claude 已经给文本加水印了吗?真正缺的不是声明,而是逐模型状态

7. 刚刚,Claude文字水印细节全曝光,官方检测工具即将推出

8. 隐写数字水印上线,AI内容急需留痕

9. 完全自己写的论文,进行AIGC检测居然显示有10%是AI生成的,这是为什么呢?

10. 已经有移除文本水印的开源项目了,看起来还很受欢迎guillaumemeyer/watermarks-…

11. Claude也要有隐形水印了?说是后面会给文字也加上隐形水印,以后你把Claude生成的一段文字复制…

12. 隐形水印上线,AI写作开始留痕

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章