最近在用ChatGPT写东西的朋友,大概率刷到过这条新闻:Anthropic给Claude生成的文字加上了"隐形水印",全球生效,免费付费一个都不放过。晨枫北林然后短短几天,一个叫watermarks-remover的开源去水印工具在GitHub上冲到了1.38万星。36氪
我后台也被问麻了,归结起来就两个问题:第一,ChatGPT会不会跟进?第二,我之前用AI写过论文、报告、公众号,会不会被"抓个正着"?
这几天我把欧盟的法案、Anthropic和谷歌的官方说明、GitHub上的攻防战、国内平台的落地情况翻了一遍,今天把这件事讲清楚。先说结论:水印这条线一定会来,但它瞄准的,大概率不是"用AI润色过稿子"的你。
两周之内发生了什么
先把时间线捋顺,30秒看完:
7月底,包括OpenAI、谷歌、Meta、微软在内的约190家机构,签署了欧盟的《AI生成内容透明度行为准则》,承诺给AI生成的内容做标记。
8月2日,欧盟《人工智能法案》第50条的透明度义务正式生效:AI生成内容必须带机器可读的标记,违规最高罚1500万欧元或全球年营业额的3%。晨枫北林
8月中旬,Anthropic官宣:新Claude模型生成的所有文本默认嵌入隐形水印,图片、文件再加一层带数字签名的出处元数据。注意,是全球统一生效。Anthropic的原话很直白——“目前还没有可靠的方法把适用范围限定在特定地区”。翻译一下:欧盟立法,全球用户买单。晨枫北林

官宣后第三天,GitHub上出现了watermarks-remover。这工具把Claude的、谷歌的、OpenAI的标记一网打尽,文本、图片、PDF里的元数据全能洗,Star数一路冲到13800+。36氪

最有意思的是,有用户让Claude帮忙运行这个去水印工具,被Claude一口回绝——可以帮你生成,可以帮你检测,但不能亲手拆掉自己留下的标记。36氪
同一周,谷歌给Gemini上了可见水印开关,用户自己选开不开。知乎然后"OpenAI承认正研发ChatGPT文本水印"这个话题在知乎又被顶上去了——先别急着惊讶,这事下面细说,其实是2024年的旧闻。
水印到底是什么:不是藏字符,是改"口癖"
很多人以为水印是往文字里塞零宽空格、隐藏字符这类东西。不是。格局没那么小。
Claude用的是谷歌DeepMind的SynthID-Text方案。原理一句话:大模型写文章,本来就是在好几个差不多的同义词里挑一个,“今天天气很冷"后面接"阴沉"还是"灰暗”,对读者没区别。水印系统就拿着一个密钥,在这种无关紧要的选择上轻轻推一把。单个词看完全正常,累积成几千字,就形成了一种统计规律。肉眼看不见,但拿密钥的检测器一扫就知道。晨枫北林

说白了,水印不是贴在文字上的标签,而是文字本身的选词习惯。这带来两个反直觉的结论:
第一,复制粘贴洗不掉,截图再OCR也洗不掉。因为你复制的就是选词结果本身,就像把一首押韵的诗拍照再识别,押韵不会消失。全天候科技
第二,重写能洗掉。不看原文、把意思从头重新表达一遍,统计规律就断了。
那这玩意儿到底扛不扛打?数据比想象中残酷。
三组数据,看清水印的真实战斗力
第一组:不加任何处理的原文,SynthID的检测率高达99.8%。全天候科技
第二组:2025年的WaterPark基准测试,系统评估了10种水印方案。中等程度的改写攻击,SynthID检测率掉到49.8%;只要过一轮AI改写工具,所有方案的检测率全部跌破30%。全天候科技
第三组:2026年7月的一项实验,对包括SynthID在内的3种主流方案做了846次改写攻击,SynthID的水印移除率超过98%,另外两种被100%移除。更扎心的是,SynthID在纯人类写的文本上还有5.4%的误报率,对自己80%的水印文本给出"不确定"的结论。研究者的结论很直接:目前的文本水印,够不上司法采纳的门槛。全天候科技
所以这东西的真实定位很清晰:对"AI输出原样复制、批量自动发布"的内容农场,它是降维打击;对认真改过稿子的人,它基本没辙。
连Anthropic自己都承认一个逻辑漏洞:你把一篇自己写的文章交给AI校对、翻译,输出也可能带上水印。晨枫北林“这段内容经过Claude处理"不等于"这段内容是Claude写的”。水印只能证明AI来过,证明不了AI干了多少活。
ChatGPT离水印还有多远:枪早就有了,只是没开
回到OpenAI用户最关心的问题。我的判断是:方向确定,但OpenAI大概率会磨一磨。

先说为什么确定。欧盟的管辖不看公司国籍,OpenAI跑不掉。OpenAI自己签了那份190家的透明度行为准则。晨枫北林谷歌今年I/O大会披露,OpenAI已经加入了SynthID生态。国内这边,四部门的《人工智能生成合成内容标识办法》2025年9月1日就施行了,抖音、B站、小红书早就上线了AI内容标识。全天候科技海外模型想在国内好好做生意,标识这关早晚要过。而且ChatGPT的图其实已经在留痕了——有网友解码GPT Image生成的图片,扫出了SynthID水印,C2PA出处元数据也在。新智元
再说为什么"磨一磨"。OpenAI不是没技术,恰恰相反,它是这条路上最早的玩家:2023年1月上线过AI文本检测工具,5个月后自己下架,因为准确率太低——只能认出26%的AI写作,还把9%的人类文章误判成AI。全天候科技2024年8月,OpenAI承认研发过ChatGPT文本水印。网易检测效果不错、扛得住局部改写,但最后没推向市场,理由就是担心用户反感。36氪这次知乎上疯传的"OpenAI承认研发水印",就是当年那条旧闻被翻出来重新炒了一遍。
现在Claude先踩进雷区,等于替全行业做了一场大型用户情绪测试:官宣之后,X上陆续有用户晒退订,技术圈骂它"破坏写作语义",还有一条传播很广的批评——用盗版内容训练模型,转头给输出加水印,这算怎么回事。晨枫北林对靠订阅费过日子的OpenAI来说,这些反馈值得反复盘。
所以比较合理的预期是:图片先行(事实上已经在做),文本随后,节奏跟着欧盟执法力度和Anthropic的口碑数据走。
谁该真正紧张
分情况说。
如果你是做内容搬运、批量矩阵号的:这轮就是冲你来的。水印加国内平台的强制标识,两张网正在合拢,趁早转型。
如果你是学生:别赌"检测不出来",也别被"水印万能"吓到。检测本身有误报、有大量"不确定",学校怎么认定是政策问题不是技术问题。真正稳的策略只有一条:真实参与写作,留好过程痕迹。
如果你是打工人:拿ChatGPT写会议纪要、内部文档、周报,这类内容本来就没人做作者身份审查,基本不受影响。
如果你是内容创作者:有篇分析说得挺好——认真修改润色AI初稿的人,反而最不容易被检测到。全天候科技水印说不清AI参与了多少,人的劳动不该被一枚水印一笔勾销。它是一张身份证,不该变成案底。36氪
接下来盯三个信号
一,ChatGPT官方博客和设置页,有没有出现水印相关的开关或说明。二,OpenAI会不会开放水印检测API——Claude已经承诺向第三方提供检测接口,但这个设计本身有个bug:洗稿的人可以一边改写一边调接口验证,等于给去水印装了导航。全天候科技三,第三方评测的误报率和漏检率变化,这决定水印会不会被平台拿去当处罚依据。
最后说一句。大家一边怕网上全是AI在装人,一边又怕自己的劳动被盖上"AI生成"的章,这两种恐惧都是真的,而且互相矛盾。水印解决不了这个矛盾,它只是把矛盾摆上了台面。
对普通用户,我的建议就八个字:该用就用,认真改稿。