三伍新闻资讯,有趣实用的生活常识!

最新更新文章排行

三伍新闻资讯

当前位置: 首页 > AI智能

Claude 上线隐形水印

时间:2026-08-13人气: 作者: 佚名

从上周起, 开始在 模型的所有文本输出中嵌入了隐形水印。

Claude 上线隐形水印(图1)

水印公告

这个隐形水印不是元数据,也不是外挂标签,它是在文本生成过程中直接编织进文字本身的不可见标记。即使你把模型输出的内容复制粘贴到邮件、文档或者你的博客里,水印也依然会保留。

甚至,即使文字经过一定程度的编辑和修改,水印也有可能仍被保留。

而背后的原因,虽然缘于欧盟《AI 法案》第 50 条的透明度准则,但执行范围却并不限于欧盟,而是全球所有使用 的人都会被动生效。

双层标记

01

标记的机制一共有两层。

第一层是文本水印。

在生成文字时,会自动在文本中织入人眼不可见的水印。

从 官方文档中可以看到,这是在模型层面直接植入的,通过微调词汇的选择来实现水印的植入(不过具体是怎么微调的,文档里没有详细说明),并且不会影响文本的可读性和内容质量。

Claude 上线隐形水印(图2)

水印技术说明

第二层是文件元数据。

当 生成各种文件如 SVG、PNG、JPG 等格式时,会在文件头信息中附加符合 C2PA 标准的签名元数据。

这是介绍一下,C2PA 是早前由 Adobe、微软、 等公司共同推动的内容溯源开放协议。所以, 和 的图像生成模型已经在图片文件中添加了该签名信息。

这两层标记的区别在于,文本水印是跟着文字自身走的,不论你复制粘贴到哪里它都会在;而文件级的 C2PA 签名则附加在文件本身,截图或格式转换或修改调整后就会丢失。

全球生效

02

此次水印添加的范围非常之广。

涵盖了 API、 官网、 Code、 、 Tag 等所有产品线,且无论是通过 AWS、 Cloud 还是通过 调用 ,文本水印都已经生效了。

不过,文件级元数据则仍需要各云平台完成自身的功能支持。

Claude 上线隐形水印(图3)

水印覆盖范围

时间点上,从 8 月 2 日及之后发布的新模型,从发布首日起便会自带标记。而之前已经发布的现有模型, 正在补充标记功能,尚未公布具体的时间表。

注意事项

03

关于这个隐形水印,有几个在实际使用中需要注意的点。

检测到文字水印只能说明内容「可能经过 的处理」,并不能由此确定 是文字的原始作者。

毕竟有太多人用 来润色、翻译和总结各种人写的或其他 AI 写的内容了,即使是人类写的东西,一旦被 染指,也同样会带上水印。

反过来也一样。

检测不到水印,也不代表不是 写的。一旦文本被大量改写后水印可能就被抹掉了,同时对于太短的文本,信号也会很微弱不太可靠;而文件经过格式转换或截图后,同样会丢失元数据。

所以 的这个水印,更多也就是提供了一个参考信号,仅此而已。

还表示正在开发配套的标识检测工具,并会在未来协助第三方进行水印检测。

04

其实在文本水印这事上, 并不是第一个。

的 模型在 2024 年就已经用密钥来偏置模型的 token 输出,从而在所有 生成的文本中留下可被检测到的统计特征。不过 并没有像 这样把整个机制的文档公开出来。

而 此前也开发过文本水印方案,但出于各种考虑最后却没有上线……据说考虑的因素有对非英语语言文本质量的影响,以及用户可能会流失到没有水印的竞品……

但 可能不会考虑这么多了,它才不会认为用户会跑到其他竞品那里去……(最近 Fable 似乎有点降智,莫非也是因为这个?)

影响

05

对于绝大多数的普通用户来说,最直接的影响是:用 写的文章、邮件、报告、代码,里面都会携带可被检测的 AI 水印了。但其实影响并不大……

而对基于 API 构建产品的企业而言,影响可能要大一些。标记机制会在全球生效,企业没有办法仅通过隔离欧盟租户来规避。

最后,我好奇的是:

如果我让 “给出圆周率的前 1000 位”,这个圆周率会带上水印吗?

Claude 上线隐形水印(图4)

官方文档:

标签: Claude   隐形水印   Anthropic   AI法案   C2PA