Claude全面嵌入隐形水印 所有AI文本可被检测

源自30位全网作者

14:52

精选参考来源

1
Anthropic宣布,新版Claude模型将在AI生成的文本中直接嵌入一种“无法察觉的水印”,这种水印“不会改变文本的含义或可读性”,即使用户复制、粘贴文本,水印也会保留,并且“经过部分编辑后仍可能存在”。“水印”不是加在文字上的,而是混在内容之中的一些特定编码字符,相当于一种高级的藏头诗。这个作法很Anthropic,非常的恶心,特别是在代码安全上,正常的公司肯定不能再用claude来写代码了。它可以植入水印,就可以植入后门,非常危险。这将导致内容的严重污染。号称Ai安全的Anthropic纯放屁一样。在技术实现上有两种方法:一、置入特殊的unicode编码,比如不可见字符插入到行间。二、token采样偏置,在生成内容时会混入一个特定词库的概率,然后在全文统计时能够扫描出来,确定这个搭配组合绝对是某个模型生成的“暗语”。Anthropic公司真是个奇葩,狂得没边了。
2
Anthropic 宣布将给 Claude 的输出内容加上机器可读的标记,包括文本中嵌入的隐形水印,以及生成文件中附加的数字签名元数据。8 月 2 日起(也就是上周),所有新发布的 Claude 模型已经开始执行这套标记机制。这是 Anthropic 为遵守欧盟 AI 法案第 50 条签署的透明度行为准则。但执行范围不限于欧盟,全球所有使用 Claude 的地方都会生效。具体来说有两层标记。第一层是文本水印:Claude 生成文字时,会在文本中织入人眼不可见的水印,不影响阅读体验和内容质量。这个水印的特点是“跟着文字走”,你把 Claude 写的一段话复制粘贴到邮件、文档或博客里,水印依然在,一定程度的编辑修改后也可能保留。第二层是文件元数据:Claude 生成 SVG、PNG、JPG 等文件时,会附加符合 C2PA 标准的签名元数据。C2PA 是 Adobe、微软、Google 等公司共同推动的内容溯源开放协议,OpenAI 和 Google 的图像生成工具已经在用。覆盖面很广。API、Claude 官网、Claude Code、Claude Cowork、Claude Tag,所有产品线都适用。通过 AWS、Google Cloud 或 Microsoft Foundry 调用 Claude 时,文本水印同样生效,但文件元数据取决于各云平台的功能支持。在此之前,Claude 一直没有公开部署过文本水印。OpenAI 此前开发过文本水印方案,但出于各种考虑一直没上线。Anthropic 这次直接在文本层面落地水印,算是 AI 大模型厂商中走得比较靠前的一步。对于用 Claude 写东西的人来说,一个直接的影响是:你用 Claude 起草的邮件、报告、文章,里面都会携带可被机器检测的水印。Anthropic 表示正在开发配套的检测工具,未来第三方也能检测。不过限制也很实际。检测到水印只能说明内容“可能经过 Claude 处理”,不能确认 Claude 是原始作者,因为很多人用它润色、翻译、总结已有内容。反过来也一样,检测不到水印不代表内容不是 AI 写的,文本被大量改写后水印会消失,太短的文本信号不够可靠,文件经过格式转换或截图也会丢失元数据。8 月 2 日之前发布的现有 Claude 模型,Anthropic 正在补充标记功能,具体时间表还没公布。如果你基于 Claude API 构建产品,Anthropic 建议你独立评估欧盟 AI 法案第 50 条对自己的合规要求。相关文档:网页链接
全部
来源
内容由AI生成

精选参考来源

1. Anthropic宣布,新版Claude模型将在AI生成的文本中直接嵌入一种“无法察觉的水印”,这种水印“不会改变文本的含义或可读性”,即使用户复制、粘贴文本,水印也会保留,并且“经过部分编辑后仍可能存在”。“水印”不是加在文字上的,而是混在内容之中的一些特定编码字符,相当于一种高级的藏头诗。这个作法很Anthropic,非常的恶心,特别是在代码安全上,正常的公司肯定不能再用claude来写代码了。它可以植入水印,就可以植入后门,非常危险。这将导致内容的严重污染。号称Ai安全的Anthropic纯放屁一样。在技术实现上有两种方法:一、置入特殊的unicode编码,比如不可见字符插入到行间。二、token采样偏置,在生成内容时会混入一个特定词库的概率,然后在全文统计时能够扫描出来,确定这个搭配组合绝对是某个模型生成的“暗语”。Anthropic公司真是个奇葩,狂得没边了。

2. Anthropic 宣布将给 Claude 的输出内容加上机器可读的标记,包括文本中嵌入的隐形水印,以及生成文件中附加的数字签名元数据。8 月 2 日起(也就是上周),所有新发布的 Claude 模型已经开始执行这套标记机制。这是 Anthropic 为遵守欧盟 AI 法案第 50 条签署的透明度行为准则。但执行范围不限于欧盟,全球所有使用 Claude 的地方都会生效。具体来说有两层标记。第一层是文本水印:Claude 生成文字时,会在文本中织入人眼不可见的水印,不影响阅读体验和内容质量。这个水印的特点是“跟着文字走”,你把 Claude 写的一段话复制粘贴到邮件、文档或博客里,水印依然在,一定程度的编辑修改后也可能保留。第二层是文件元数据:Claude 生成 SVG、PNG、JPG 等文件时,会附加符合 C2PA 标准的签名元数据。C2PA 是 Adobe、微软、Google 等公司共同推动的内容溯源开放协议,OpenAI 和 Google 的图像生成工具已经在用。覆盖面很广。API、Claude 官网、Claude Code、Claude Cowork、Claude Tag,所有产品线都适用。通过 AWS、Google Cloud 或 Microsoft Foundry 调用 Claude 时,文本水印同样生效,但文件元数据取决于各云平台的功能支持。在此之前,Claude 一直没有公开部署过文本水印。OpenAI 此前开发过文本水印方案,但出于各种考虑一直没上线。Anthropic 这次直接在文本层面落地水印,算是 AI 大模型厂商中走得比较靠前的一步。对于用 Claude 写东西的人来说,一个直接的影响是:你用 Claude 起草的邮件、报告、文章,里面都会携带可被机器检测的水印。Anthropic 表示正在开发配套的检测工具,未来第三方也能检测。不过限制也很实际。检测到水印只能说明内容“可能经过 Claude 处理”,不能确认 Claude 是原始作者,因为很多人用它润色、翻译、总结已有内容。反过来也一样,检测不到水印不代表内容不是 AI 写的,文本被大量改写后水印会消失,太短的文本信号不够可靠,文件经过格式转换或截图也会丢失元数据。8 月 2 日之前发布的现有 Claude 模型,Anthropic 正在补充标记功能,具体时间表还没公布。如果你基于 Claude API 构建产品,Anthropic 建议你独立评估欧盟 AI 法案第 50 条对自己的合规要求。相关文档:网页链接

3. 【不可见的签名:Claude 正在给每一行文本打上“思想烙印”】Anthropic 正式确认在所有 Claude 生成的文本和文件中嵌入隐形水印。文字水印通过在 Transformer 预测概率时进行微小的 Token 偏移来实现统计学可读,而文件则采用 C2PA 标准嵌入元数据。这意味着无论你是通过 Web 界面还是 API 调用,生成的每一句话都携带了无法肉眼察觉的溯源证据。社区评论对此反应剧烈,认为这种道德监管式的做法是对付费用户的背叛,且强制偏移 Token 可能会导致表达质量下降。从行业深处看,这不仅是版权防御,更是 Anthropic 为未来企业级合规建立的隐形护城河。当合规审计要求强制披露内容来源时,这种签名将成为合法的入场券。但这同时也加速了核心用户向不受控的开源模型流失。如果你在乎输出的绝对拥有权和表达的纯净度,这枚隐形的标签或许就是你转投开源的最后一根稻草。

4. Claude 宣布给文字打上隐形水印,你用 AI 写的每个字都藏不住了

5. 这篇推文关于文本水印 网页链接 原理讲的很清楚。生成文本的时候,模型每要输出下一个 token,就拿前面已经生成的所有词加上一个密钥,算出一个哈希值。这个哈希值会把词表里的词随机分成两组,比方说绿组和红组。然后模型在选下一个词时,悄悄提高绿组词被选中的概率。最终输出的文本看起来完全正常,但统计上会偏向绿组词。检测的时候反过来。拿着同一个密钥,对文本里的每个词重新算一遍哈希,还原出当时的绿组和红组。如果整篇文本中绿组词的占比显著超过 50%,就判定这段文本带有水印。几个常见疑问:1. 改写能破解水印吗?大部分情况下可以。因为你一改词,前面的 token 序列变了,哈希也跟着变,绿组红组就对不上了。但也有改进方案用统计模型而不是确定性函数来生成哈希,让水印对改写有一定的适应能力。2. 水印会降低文本质量吗?理论上会,因为模型不再完全自由地选最优词,而是被约束在绿组里选。但 Google 在两万条文本的人类反馈实验中称,大多数人感知不到质量下降,因为表达同一个意思的词有很多种组合。不过在短文本或者高度确定的输出上(比如1+1=2),水印确实会失效。3. 密钥会被逆向破解吗?理论上需要指数级数量的样本才能还原绿组红组的划分,所以直接暴力破解不现实。但如果检测器公开了,攻击者可以通过不断试探来摸索出规律。工程难点第一,大模型是流式输出文本的,一个词一个词往外蹦,没法像学术方案那样等整段写完再调整。第二,如果密钥泄露,水印就废了,所以需要多组密钥轮换。第三,代码类输出不能随意换词,否则代码会出错,水印只能加在注释、变量名这类可替换的部分。如果 Anthropic 公开检测器,等于给了攻击者一个免费的练习靶,水印会被快速找到绕过策略。如果像 Google 的 SynthID 那样把检测器留在内部,更安全一些,但学术界已经有论文展示了不需要检测器也能零样本破解水印的方法。密集改写(同义词替换加句法重组)可以有效消除水印,免费的改写工具就能绕过 Google 的 SynthID。前沿实验室对此心里有数,也没指望水印能拦住刻意绕过的人。大多数普通用户不会专门去除水印,而欧盟监管方也只需要足够好就行。水印更多是一种应对欧盟监管的合规动作。推文地址:x.com/alexcdot/status/2087078010524406137

6. #Claude生成的内容自带水印# Anthropic 更新了一则官方说明:8月2日之后发布的 Claude 新模型,会支持一种机器可读的内容标记,生成的文本会被嵌入水印。(8月2号之前发的会有一段过渡期)反正以后 Claude 生成的每一段文字,都会带着一个你肉眼看不见的水印。#差评说AI# 按照 A 出的说法,水印主要就两种,文本用嵌入式水印;文件则是用带数字签名的出处元数据。水印是在模型那一层就打上了,别说什么复制粘贴、截图识别,都甩不掉嗷。你把两万字论文发给 Claude,它给你改了两个字也会打上它的水印哦。所以 Anthropic 自己也特意强调,检测到 Claude 水印,只能作为这份内容可能被 Claude 处理过的一个信号,并不能证明整篇东西就是 Claude 从头到尾写的。我只能说,水印至少不是空口鉴 AI。就是感觉挺烦的,AI 一开始模仿人类怎么写东西,结果学着学着,把人类逼得要证明自己写得不像 AI。现在写东西生怕有人来一句你这 AI 味儿也太冲了。。。

7. //@刘群MT-to-Death:很多人不理解文本水印是怎么回事。文本水印是嵌入到语言生成中的一种印记,比如可以用A/B两个同义词的时候总是选择B、可以用两种表达方式C/D的时候总是选择次高概率的D,这样文本看起来没有任何问题,但实际上是可以检测到的。由于水印是加在文本内容上的,转变成图像再用OCR扫描出文本也没有任何用处。这种水平的添加和检测都是由大模型来做的,人很难感知到。当然修改文本有可能破坏这种水印,但由于人不知道这些水印会加在那些词上,所以水印也很难全部破坏掉。

8. 还在用 Claude 写内容当原创?小心被溯源Anthropic 宣布,从 8 月 2 日起推出的 Claude 模型,生成的文字和图片,都将开始加入 AI 身份标记。官方后续将开放检测手段,未来可直接检测内容来源。 优设AIGC的微博视频

9. Claude骂声中启动「隐形水印」:新模型全量嵌入,标记所有文字

10. 刚刚,Claude上线隐形水印,所有文本可全球追踪,网友震怒

11. 刚刚,Claude偷偷上线隐形水印,每个字都可全球追踪

12. Claude竟然把水印藏进了文字里,人眼根本看不出来

13. #AI论道# 【Claude 启动"隐形水印":新模型全量嵌入,标记所有生成文本】大模型之家讯 8月11日,Anthropic 宣布将在新款 Claude 模型的生成文本中直接嵌入肉眼不可见的水印,该机制适用于 2026 年 8 月 2 日及之后发布的所有模型,并将在全球范围内推行。水印会随文本一起被复制、粘贴,经一定程度的编辑后仍可能保留;Claude 生成的 .svg、.png、.jpg 等文件将附加遵循 C2PA 标准的数字签名来源元数据,API、Claude、Claude Code、Claude Cowork、Claude Tag 等全产品线均覆盖。该措施的直接推手是 Anthropic 已签署的欧盟《AI 法案》。Anthropic 同时强调水印机制的边界:检测到标记仅说明内容经过 Claude 处理,不等于底层想法和数据来自 AI。目前水印算法细节尚未公开,引发行业广泛讨论。#Anthropic# #Claude#

14. Anthropic将为Claude生成文本加入隐形水印,防范AI内容冒充原创

15. AI写文章以后要留痕了吗?Claude宣布文本默认加隐形水印 8月10日,人工智能公司Anthropic宣布,自2026年8月2日起推出的新一代Claude模型,将默认为生成文本加入机器可识别的”隐形水印“,同时为图片等文件添加数字来源标识。消息一出,不少网友开始讨论:这是否意味着,AI生成内容全面”留痕“的时代已经开始? 据Anthropic发布的最新说明,今后使用支持的新模型生成文本时,Claude会在内容中嵌入一种”人眼无法察觉“的机器可识别水印。官方表示,这种水印不会影响文章的阅读体验,也不会改变文字本身的意思,但复制、粘贴后仍会随文本一起保留,在经过部分修改后依然有可能被检测出来。 除了文本,Claude生成的PNG、JPG、SVG等文件,也将加入符合国际C2PA标准的数字来源元数据,用于记录文件是否经过Claude生成或处理,以及后续是否被篡改。 值得注意的是,这项措施并不仅针对欧盟用户。Anthropic表示,虽然此次调整是为了履行欧盟《人工智能法案》(EU AI Act)关于AI生成内容透明度的承诺,但相关标记将覆盖Claude网页版、API、Claude Code以及AWS、Google Cloud、Microsoft Foundry等平台,并在全球范围内统一启用。 不过,Anthropic也特别强调,检测到Claude标记,并不意味着内容完全由Claude原创。例如,用户将自己写好的文章交给Claude润色、翻译、校对或总结,最终输出同样可能带有Claude标记。 官方消息公布后,国内外社交平台上出现大量讨论。有网友认为,即便AI生成内容能够被检测出来,如果社交平台、搜索平台不主动利用这些标记进行提示或管理,互联网仍可能被大量低质量AI内容充斥。"问题不是有没有水印,而是谁会真正去使用它。" 也有人表示,AI内容标记未来很可能成为行业趋势,但短时间内未必能够解决AI内容泛滥的问题。"如果一家模型开始加入标记,用户完全可以转向其他模型,甚至使用开源模型继续生成内容。"(见习记者 张岑晏) https://weibo.com/tv/show/1034:5330826980950136?from=old_pc_videoshow

16. AI写的文章以后都要“留痕”了?Claude宣布文本默认加入隐形水印,网友热议:这会成为行业新趋势吗?

17. Claude给所有输出盖了个"隐形章",复制粘贴都甩不掉 用Claude写东西的朋友注意了。 从8月2号开始,Claude输出的每一段文字,都带着肉眼看不见的标记。复制粘贴带得走,改几个词还在,发到任何一个平台都能被检测出来。 这不是段子,是Anthropic的官方动作。 这个"隐形水印"不是贴在表面的一串代码,而是嵌在文字的统计分布里。什么意思呢?它改变了文字中某些词出现的概率分布——人读起来完全自然,但专门的检测工具一扫就知道"这是AI写的"。 同时还配了数字签名元数据,相当于每个输出都有一个全球可验证的"身份证"。 为什么这么干? 直接原因:欧盟AI法案要求,AI生成的内容必须能被识别出来。Anthropic这是提前合规。 但往深了想,这件事释放了一个更大的信号:AI内容的"可追溯时代"正式开始了。 以后你看到一篇公众号文章、一条微博、一份商业报告,技术上就可以检测出它是AI写的还是人写的。不是靠猜,不是靠举报,是靠实打实的技术手段。 你可能会说,我又不用Claude,跟我没关系。 但水印技术不会只停留在Claude上。OpenAI、Google迟早都会跟——欧盟的规矩摆在那里,其他市场只是时间问题。 对普通人来说,这意味着什么? 用AI辅助写作没问题,但你要知道:AI帮你写的那段文案,发出去的那一刻,它身上就带着一个"标记"。这个标记不会消失。 最聪明的做法:把AI当助手,不当替身。让它帮你查资料、列框架、改语法,但核心观点和关键表达自己写。效率提高了,也不用担心哪天被人"验出来"。 AI写的内容,现在有了永久的"出生证明"。这个趋势,不可逆。 #你认为AI会让人失业吗# #AI水印# #Claude#

18. Claude给AI内容加隐形水印了✨。Claude开始给AI内容留“指纹”了。 * 根据官方说明,2026年8月2日之后在欧盟推出的新模型,从发布起就支持机器可读标记。 * 文字里会加肉眼看不见的水印,复制粘贴后可能还留着;PNG、JPG、SVG这些文件,则会写入符合C2PA标准的签名来源信息。 听起来好像以后能直接抓出AI内容?但事情没这么简单: * 哪怕只是用Claude校对或翻译过的文章,也可能带上标记; * 反过来,如果内容经过大量改写、混合创作、截图或者格式转换,标记又可能消失。 所以这套机制真正解决的,不是“判断有没有用AI”,而是给内容加一条可追溯的来源线索。未来判断内容真假,恐怕不能只看有没有AI味,得看它从哪来、经过谁处理、有没有完整的来源记录。 你觉得AI内容应该强制标记吗? 信息 #Claude #人工智能 #AI水印 #欧盟AI法案 #科技资讯

19. Claude开始偷偷给所有输出"盖章"了:AI生成的内容以后无处遁形 Anthropic干了一件事:从8月2日起,Claude生成的所有文本都会被打上"隐形标记"。 两层保护: 隐形文本水印——肉眼看不见,但机器能识别 数字签名元数据——嵌入在输出里,删不掉 为什么? 主要是为了遵守欧盟AI法案。欧盟要求AI生成的内容必须可追溯、可标识。 这意味着什么? 以后你拿到一段文字,技术手段可以直接判断"这是AI写的"还是"人写的"。 对普通人的影响: 用AI写论文、写报告,可能被检测出来 AI生成的营销文案、新闻稿,平台可能自动标记 想靠AI内容"以假乱真"的路越来越窄 但反过来想:能追溯也是好事。至少你知道哪些内容是AI帮你写的,哪些是真人原创。

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章