Claude 引入隐形水印:AI 复制粘贴作弊时代要终结了?

Anthropic 为 Claude 全系产品嵌入隐形水印,覆盖 API、应用及代码工具,未来输出均可溯源。该技术基于绿名单机制,但短文本与改写内容难以识别,用户端检测工具将后续上线。

Anthropic 目前会在 Claude 所写的每一段文本中嵌入隐形水印。读者无法看见水印,即便将文本复制到别处,水印也依旧存在。

新模型在全球范围内携带该标记。Anthropic 同时表示,面向用户和第三方机构的检测工具将随后推出。

Claude 水印如何工作

Anthropic 在模型层面应用水印,因此 API、Claude 应用和 Claude Code 的输出都会附带该标记。

覆盖范围还包括 Anthropic 面向日常办公的文件与任务代理 Claude Cowork,以及嵌入 Slack 的 Claude Tag。

通过 AWS、Google Cloud 和 Microsoft Foundry 访问 Claude 模型同样适用,且不受地域影响。

Anthropic 尚未公开具体实现方法。但关于文本水印的公开研究指向一种“绿名单”机制。

该技术在每个词的位置将词汇表划分为绿名单和红名单,由前一个词决定划分方式,因此在读者眼中呈现出随机性。

模型会倾向于选择绿名单中的词,而非严格按照规则选择。检测器统计绿词数量,并判断其占比是否显著高于随机概率。

这一设计也解释了 Anthropic 指出的两个短板:短文本因词数过少而无法可靠统计;改写文本则可能将绿词替换掉。

文件则走另一条路径。生成的 .svg、.png 和 .jpg 文件会携带符合 C2PA 开放标准的签名来源元数据,也能识别篡改。

Claude 用户接下来应期待什么

旧模型将在过渡期内获得水印功能。该升级仅针对未来的输出,不会追溯标记此前生成的文本。因此,在水印功能上线之前生成的内容不会在日后变成可溯源。追溯标记旧文档不在计划之内。

检测功能是此次部署的核心。Anthropic 承诺为用户和第三方提供检测工具,具体细节将在后续技术文档中公布。一次命中可能并不像许多读者想象的那样具有决定性——它仅表示该内容可能经过 Claude 处理,仅此而已。

用户也可能使用模型来校对、翻译和总结自己的写作。因此,带有水印的文档并不能证明存在作弊行为。

这一变化背后的法规依据是欧盟《人工智能法案》。Anthropic 已签署关于 AI 生成内容透明度的第 50(2) 条行为准则,该准则于 2026 年 8 月 2 日生效。其他地区的监管机构则采取了更直接的手段,例如中国在今年夏天下架了 14,000 个 AI 产品。

Anthropic 过往的记录将影响用户对该系统的信任程度。该公司此前披露过三次 Claude 在评估过程中发生未授权访问的事件。此外,法院也接受了其扫描图书用于训练的做法。

此前 Fable 5 的护栏调整引发的反弹表明,模型变更很可能会招致抵制。然而,几乎没有开发者会放弃一个在编程基准测试中仍领先竞品的模型。因此,这项变更大概率会被行业平静消化。

已上市的系統须在 2026 年 12 月 2 日前完成合规调整。在检测工具正式推出之前,水印将一直是一个沉默的存在。

免责声明:本文提供的信息不是交易建议。BlockWeeks.com不对根据本文提供的信息所做的任何投资承担责任。我们强烈建议在做出任何投资决策之前进行独立研究或咨询合格的专业人士。

(0)
区块链小猫的头像区块链小猫作者
上一篇 13小时前
下一篇 13小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部