Claude 的新“红字”水印暂时不可见
摘要
Anthropic 宣布将对其 Claude 模型处理的所有内容(不仅仅是 AI 生成的文本)添加隐形水印,以符合欧盟《人工智能法案》。这种“焦土”式做法可能连仅经过轻微编辑的人类文字也会被打上标记,引发对过度干预和恶意行为者易于规避的担忧。
<p>Anthropic 透露,其将很快对其任何模型处理的内容(<em>不仅仅是生成的内容!</em>)添加水印。在一篇<a href="https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content">支持文章</a>中,Anthropic 解释称,其正在推出机器可读的水印,以符合欧盟《人工智能法案》。该法案<a href="https://artificialintelligenceact.eu/article/50/">要求</a>所有 AI 系统提供商为 AI 生成或操纵的音频、图像、文本和视频输出添加水印。该法律适用于 8 月 2 日之后发布的任何 AI 模型,并为提供商更新之前发布的模型提供了至 2026 年 12 月的宽限期。</p><p>Anthropic 确认,今后其在全球提供的所有新模型——不仅限于欧盟——将“从第一天起”对 AI 生成的内容进行标记。Anthropic 表示,文本输出将“携带嵌入式水印”,对用户不可见,其他“生成的文件将在支持的情况下包含数字签名的来源元数据”。</p><p>值得注意的是,Anthropic 正在部署一种“<a href="https://en.wiktionary.org/wiki/nuke_it_from_orbit">从轨道上核平</a>”式的做法,在支持的情况下对所有处理过的内容添加水印,尽管欧盟并不要求在 AI 系统执行“标准编辑的辅助功能”(指南自身的例子是语法纠正)或未“实质性改变”用户文本或其含义的情况下添加水印。在模型层面添加的水印无法区分整体生成与修改一个逗号,因此 Claude 最终可能会给法律本应放过的那类内容打上标记。在 Anthropic 发布可测试的检测工具之前,其真正水印的彻底程度将不得而知。该公司表示,计划最终分享如何检测水印的细节,以提供欧盟法律所要求的技术支持。</p><p><a href="https://arstechnica.com/tech-policy/2026/08/claudes-new-scarlet-letter-watermark-is-invisible-for-now/">阅读全文</a></p><p><a href="https://arstechnica.com/tech-policy/2026/08/claudes-new-scarlet-letter-watermark-is-invisible-for-now/#comments">评论</a></p>
查看缓存全文
缓存时间: 2026/08/13 15:40
Claude 的新“红字”水印——目前不可见
来源:https://arstechnica.com/tech-policy/2026/08/claudes-new-scarlet-letter-watermark-is-invisible-for-now/
该标记会标记任何经 Claude 处理过的内容,即使是它仅编辑过的人类写作内容。
[](https://cdn.arstechnica.net/wp-content/uploads/2026/08/claude-psycho-watermark.jpg)
“看那微妙的米白色调,那有品位的厚实感。天哪,它甚至还有水印。”图片来源:Aurich Lawson | American Psycho(Lions Gate Films)
“看那微妙的米白色调,那有品位的厚实感。天哪,它甚至还有水印。”图片来源:Aurich Lawson | American Psycho(Lions Gate Films)
Anthropic 透露,它将很快对其任何模型处理(*不仅仅是生成!*)的内容添加水印。在一篇[支持文章](https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content)中,Anthropic 解释说,它正在推出机器可读的水印,以遵守欧盟的《人工智能法案》,该法案[要求](https://artificialintelligenceact.eu/article/50/)所有 AI 系统提供商对 AI 生成或操纵的音频、图像、文本和视频输出添加水印。该法律适用于 2026 年 8 月 2 日之后发布的任何 AI 模型,并为提供商提供了到 2026 年 12 月为止的宽限期,以更新先前发布的模型。
Anthropic 确认,未来所有面向全球提供的新模型——不仅仅是欧盟的——将从“第一天起”就为 AI 生成的内容打上标记。文本输出将“携带嵌入的水印”,对用户不可见,而其他“生成的文件在支持的情况下将包含数字签名的来源元数据”,Anthropic 表示。
值得注意的是,Anthropic 正在部署一种[“从轨道上核平”](https://en.wiktionary.org/wiki/nuke_it_from_orbit)的方式,在支持的情况下对所有处理过的内容应用水印,尽管欧盟并不要求在 AI 系统执行“标准编辑的辅助功能”(该指南自己的例子是语法纠正)或不“实质性改变”用户文本或其含义的情况下这样做。
在模型层面应用的水印无法区分整体生成和逗号修正,因此 Claude 最终可能会给法律原本要求不加标记的内容打上标记。在 Anthropic 发布可供测试的检测工具之前,其真正的水印覆盖程度将不得而知。该公司表示,计划最终分享如何检测标记的细节,以提供欧盟法律要求的技术支持。
Anthropic 还指出,水印在“某些不支持它们的平台或功能”上无法生效。对于非文本内容,Anthropic 将使用 C2PA 元数据方法来记录来源。
## 容易绕过,也容易误解
欧盟所描述并由 Anthropic 实施的方法,不幸的是,对恶意行为者来说非常容易绕过,同时可能会惩罚那些信任系统能准确标记其输出的用户。文本水印的工作原理是以一种遍布整个文档的模式来偏置模型的用词选择,只有通过正确的工具才能聚合检测到。问题在于,“不可见”也可能意味着模型偶尔会用稍差一点的词来替代最佳用词,只是为了保持信号完整。
Anthropic 指出,这些标记“在文本被复制粘贴到其他地方时会随文本一起传播,并且可能会在部分编辑后仍然存在。”但如果带水印的文本被粘贴到另一个会编辑文本的聊天机器人系统中,水印可能会被破坏。对于图像和视频内容,截屏/录屏或使用任何像样的元数据编辑工具都足以移除这些信息。而且一旦 Anthropic 向全世界公布如何识别这些水印,构建一个移除水印的系统将变得微不足道。
此外,误读的可能性似乎很高;水印并不是特别有信息量。Anthropic 解释说,“检测到的标记提供了一个信号,表明内容经过 Claude 处理,但并非完全确定。”Anthropic 表示,该标记唯一真正传达的信息是“内容可能经过 Claude 处理”,而且该标记甚至可能出现在并非由 Claude 生成的内容上。
除此之外,还有普通大众,他们可能无法理解经处理文本与完全生成文本之间的区别。如果系统仅仅因为人类撰写的文本在涉及 Claude 的工作流中被编辑过就给其打上水印,那么它突然就与完全生成的文本具有了相同的含义。而这一切都发生在一个“未检测到标记并不意味着内容不是 AI 生成的或未经处理”的系统中,Anthropic 说道。
## Claude 可能会标记超出要求的更多 AI 内容
值得肯定的是,Anthropic 承认它可能会标记一些《人工智能法案》不要求标记的内容:“人们经常使用 Claude 来校对、翻译、总结或转换文件。即使底层的思想、文本或数据来自其他来源,输出也可能带有 Claude 标记。”因此,尽管法律[明确豁免](https://artificialintelligenceact.eu/transparency-rules-article-50/)了这些情况,Claude 仍将标记对原始写作所做的任何编辑工作。
如果水印成为 Claude 任何用途的一刀切标记,从拼写检查到完全重写,Anthropic 的解决方案很可能会让用户感到沮丧,因为它在标记内容方面超出了必要的限度,反而可能无意中混淆来源。例如,教师或教授不应该将这个水印信号解读为“AI 碰过这个”以外的任何含义,但很容易想象他们会这么做。毕竟,一个无法区分轻度编辑与完全生成文本的水印有什么意义呢?
当我们转向《欧盟人工智能法案》的另一部分——第 50(4) 条,即规定那些发布此类文本的人如何明确标记内容时,事情变得更加模糊。根据他们的标记制度,完全生成的 AI 文本在大多数情况下不需要标签。AI 写的小说?不需要标签。AI 生成的营销文案?也不需要。但如果文本旨在“就公共利益事项向公众提供信息”,则必须对其进行标记,*除非*有人类对其进行编辑性审查(即,编辑者是已知且需负责的)。于是,我们看到了一个奇怪的局面:在模型层面是“给所有东西打水印”,而在公开披露层面却是“如果有 Joe 看过,就不需要给这段 AI 文本加标签”。
Ars 联系了 Anthropic,询问是否有发布检测细节的时间表,或该公司能否分享任何评估假阴性或假阳性可能性的测试结果。我们还询问 Anthropic 能否说明其水印如何与标准编辑以及《人工智能法案》的其他豁免条款相冲突,但 Anthropic 发来的一份声明并未回应 Ars 的问题。
“我们正在为 Claude 的输出添加标记,以遵守欧盟《人工智能法案》,其他实验室也在采取类似措施,”Anthropic 表示。“识别 AI 生成的文本很困难,而这为人们提供了更好的识别工具。来自受支持的 Claude 模型(包括 Claude Code 的输出)的文本将携带不可见的水印,这不会改变 Claude 回复的含义、质量或可读性。我们还计划推出一个文本检测 API,以便用户自己更多地完成这项工作。”
## 好戏才刚刚开始
在欧盟,透明度要求旨在确保像 Claude 这样的 AI 工具不会破坏“信息生态系统中的完整性和信任,从而带来大规模错误信息和操纵、欺诈、冒充以及欺骗消费者的新风险。”一篇[欧盟支持文章](https://artificialintelligenceact.eu/transparency-rules-article-50/)预测,这些义务将成为许多 AI 公司“主要的合规挑战”。
“人们应该知道他们何时在与 AI 交互,或何时接触到 AI 生成的内容,”欧盟委员会的[指南](https://digital-strategy.ec.europa.eu/en/policies/guidelines-ai-transparency-obligations)表示。“这将帮助他们做出明智的决定,调整对 AI 的信任和依赖,并避免错误信息或欺骗。”尽管如此,这一事实很难与下列情况调和:一篇完全生成的、涉及公共利益的文章,如果经过编辑的适当审查,会带有水印,却没有面向读者的标签。
欧盟期望,像 Anthropic 这样的 AI 公司最有能力开发水印解决方案,因为 AI 发展迅速,并且将持续存在“需要新的方法和技术来追溯信息起源”的需求。
但这在很大程度上将此类标记的社会价值交由科技公司来决定,欧盟只规定“在技术上可行的范围内,技术和方法应足够可靠、可互操作、有效且稳健。”
Anthropic 在其帖子中表示,计划继续改进符合欧盟要求的水
相似文章
Anthropic表示将为其AI模型生成的文本添加水印
Anthropic宣布将为其AI模型(包括Claude)生成的文本添加水印,以符合欧盟《人工智能法案》的透明度义务。水印在模型层面应用,复制粘贴后依然保留,并对文件使用C2PA标准。
Claude 现在在所有文本输出中嵌入不可见水印,并为文件添加签名元数据
Anthropic 正在为所有 Claude 文本输出添加不可见水印,并为受支持的文件添加带签名的 C2PA 来源元数据,这符合《欧盟人工智能法案》透明度行为准则,检测机制将在稍后详细说明。
AI水印在纯文本中的隐藏位置(5分钟阅读)
Anthropic 宣布将对所有 Claude 文本输出添加水印,这种水印嵌入在词语选择中而非字节中,几乎无法察觉;本文分析其工作原理以及文本水印可以隐藏的层级。
一些Claude用户对Anthropic的新水印感到不满,担心在工作或课堂上使用AI会被发现
Anthropic已开始对Claude的输出添加水印,以遵守欧盟《人工智能法案》,这引发了一些用户的批评,他们担心在工作或学校使用该AI会被发现,不过许多网友认为这些抱怨有些夸大其词。
关于Claude的新水印
一篇批评性观点文章,认为Anthropic在Claude生成的文本中加入隐形水印对恶意用户无效,同时不公平地污名化诚实用户,并质疑该公司因此获得的集中权力。