Claude 生成的文字现在带隐形水印:复制粘贴也洗不掉
2026年8月17日1 次阅读
Claude 生成的文字现在带隐形水印:复制粘贴也洗不掉
你用 Claude 写的每一句话,现在都悄悄带了一个"身份证"。
8 月 15 日,Anthropic 公布了 Claude 文本水印的更多技术细节:从现在起,Claude 生成的所有文字都内嵌了隐形水印——不是什么隐藏字符或特殊标记,而是一种编织在词选择中的统计模式。你肉眼完全看不出来,但专用检测工具可以识别。
水印怎么做到"看不见又洗不掉"?
这个水印基于 Google DeepMind 的 SynthID-Text 技术。原理并不复杂:大模型生成文字时,每一步都要从一堆候选词里选一个。SynthID-Text 会微妙地调整这个选择概率,让最终文本呈现出一种特定的统计"指纹"。
关键点:水印不改变文字的意思,也不影响可读性。它只是让"选词模式"变得可识别,就像笔迹鉴定一样——你写的内容没变,但写字的习惯留下了痕迹。
什么操作能活,什么会死?
根据 Anthropic 的说明和多家媒体验证:
- 复制粘贴:水印完整存活。无论你复制到 Word、邮件还是社交媒体,水印都在。
- 格式转换:存活。加粗、换行、改字体都不影响。
- 轻度编辑:大部分存活。改几个错别字、调整语序,水印仍然可检测。
- 让 Claude 润色你自己的文字:取决于编辑程度。如果 Claude 大幅改写,水印会留下;如果只是改了几个词,可能检测不到。
- 完全重写:水印消失。如果你把每个词都替换了,统计模式就被破坏了。
- 翻译:水印消失。换成另一种语言后,原始的词选择模式不复存在。
- 文本太短:不可靠。几句话的长度不足以建立统计信号。
对普通用户意味着什么?
这件事的实际影响比听起来更大:
- 你用 Claude 写的东西,别人能查出来。 不管你是写论文、写邮件还是写文案,接收方如果有检测工具,就能知道这段文字来自 Claude。
- 即使你只是让 Claude "润色"一下,也可能被标记。 Anthropic 明确说了,如果 Claude 编辑得足够多,水印会留在文本里——哪怕原文是你自己写的。
- 模型自己不知道在加水印。 Anthropic 工程师确认,Claude 本身并不知道自己输出带水印,也无法利用水印传递信息。这排除了"AI 之间用水印秘密通信"的阴谋论。
为什么现在做这件事?
时机并非偶然。欧盟《AI 法案》对 AI 生成内容的标识提出了明确要求,违规罚款可达 1500 万欧元。Anthropic 此举既是技术探索,也是合规布局。
不过,水印目前并非强制开启,用户理论上可以选择关闭。Anthropic 将其定位为"来源追溯"(provenance)工具,而非监控手段。
还远不是完美方案
坦率说,这个水印的局限性很明显:能被完全重写绕过,翻译就失效,短文本不可靠。它更像是一个"防君子不防小人"的机制——对诚实标注的人有用,对刻意伪造的人无效。
但作为 AI 内容溯源的第一步,它的意义在于:至少有人开始认真解决这个问题了。当所有主流 AI 产品都加上类似机制,"这段文字是不是 AI 写的"才可能有一个靠谱的答案。
---
基于多家媒体转述整理,主要来源:TechCrunch、Forbes、IBTimes。