Anthropic新模型将在生成的文本中嵌入不可见的标记

cryptonews.ru发布于2026-08-11更新于2026-08-11

文章摘要

Anthropic公布了一项新政策:自2026年8月2日起,在欧盟及其他所有运营地区发布的新版Claude模型,都将在生成的文本中嵌入机器可读的不可见水印。此规则适用于API、Claude应用及其合作伙伴平台。目前已发布的模型(如Claude Opus 5)暂不包含此功能,但公司表示正在为其添加支持。 文本水印将直接编织在模型回复中,不影响内容质量,且能在复制粘贴及部分编辑后留存。这与用于图像等文件的C2PA元数据签名标准是两套独立机制。 目前,用于检测文本水印的工具尚未发布,Anthropic承诺后续将公开技术细节。需要注意的是,即使未来能检测出水印,它也无法作为文本绝对出自Claude的最终证据,因为模型也常用于编辑或总结他人内容。 此举的时间点与欧盟《人工智能法案》关于AI内容标注的强制性规定生效日期一致,被视为应对监管要求的合规措施。文章最后提出一个未解的技术问题:此类水印在经过其他AI意译或翻译后是否能保持可检测性,仍有待观察。

Anthropic披露了一项先前未公布的细节:自2026年8月2日起,在欧盟发布的新版Claude模型,在推出时将支持对生成文本进行机器可读的标记。这指的是未来的版本——在此日期之后目前尚未有模型发布,目前最新版本仍是2024年7月24日发布的Claude Opus 5。这在2026年8月10日更新的帮助中心文章中有说明。该规则不仅适用于欧盟,而且在所有提供Claude服务的地方都将生效——包括API、Claude应用、Claude Code、Claude Cowork、Claude Tag,以及像AWS、Google Cloud和Microsoft Foundry这样的合作伙伴平台。

文本与文件——两种不同的机制

对于文本,Anthropic将使用不可见的水印,这些水印将直接编织在模型生成的回答中,不会改变其含义、质量或可读性。由于标记将成为文本本身的一部分,它在复制粘贴后仍能保留,甚至在部分编辑后也可能保留。此机制与C2PA标准无关。

对于文件——例如.svg、.png和.jpg——则适用另一种已生效的机制:Claude会按照开放的C2PA(内容来源与真实性联盟)标准附加经过签名的来源元数据。此类签名表明文件经过了Claude的处理,并能够检测到事后对元数据的篡改。对此功能的支持取决于具体平台。

旧型号不具备文本标记

关于文本的规则仅适用于新版本的Claude。在2026年8月2日之前发布的模型——即当前所有可用的模型,包括Claude Opus 5——正处于过渡期,不会嵌入文本水印。Anthropic表示,正在努力为这些模型也添加标记支持,相关文档将在准备就绪后更新。

目前尚无法检查文本

Anthropic声称,正在开发独立的工具,以允许用户和第三方检测文本水印。该公司承诺稍后将在技术文档中披露检测机制的详细信息——目前此类工具尚不存在。像c2pa.org或contentcredentials.org这样的网站不适合用于此目的:它们检查的是文件中的元数据,而不是文本水印。

一个重要细节是:即使未来检测工具出现,标记的存在也不能作为文本作者就是Claude的最终证据,因为该模型常被用于编辑、翻译或总结他人内容。标记的缺失同样不能证明任何事。

人工智能观点

从宏观经济监管的角度看,日期的重合似乎并非偶然。欧盟自2026年8月2日起已强制执行《人工智能法案》第50条关于人工智能内容标记的强制性要求,而欧盟委员会早在7月20日就批准了对该条款的最终解释,规定违反透明度要求的罚款最高可达1500万欧元或公司全球营业额的3%。Claude在此时推出文本水印功能,似乎并非技术上的巧合,而是针对特定监管日期的合规应对。

文章未披露的技术方面是:此类水印对通过另一模型进行的转述和翻译的抵抗能力。行业内关于文本标记的实验表明,转述会显著降低检测准确率,而将文本翻译成另一种语言通常会将标记完全去除。经过第三方人工智能处理后,Claude的不可见标记是否仍可识别——这是一个目前只有该公司自己知道答案的问题。

end-content

相关问答

Q从何时起,Anthropic为在欧盟推出的新版Claude模型嵌入不可见的文本水印?

A从2026年8月2日起,在欧盟推出的新版Claude模型将开始嵌入机器可读的文本水印。

Q文章提到Claude为文本和文件分别采用了哪两种不同的标记机制?

A对于文本,使用嵌入文本内部的不可见水印;对于文件(如.svg, .png, .jpg),则采用遵循C2PA开放标准的签名元数据来标记来源。

Q在2026年8月2日之前发布的现有Claude模型(如Claude Opus 5)是否会嵌入文本水印?

A不会。在2026年8月2日之前发布的所有现有模型(包括Claude Opus 5)目前都处于过渡期,不嵌入文本水印。Anthropic正在努力为它们添加支持。

Q用户目前能否检测Claude生成的文本中是否存在水印?为什么?

A目前不能。Anthropic表示正在开发独立的工具,以供用户和第三方检测文本水印。相关检测机制的细节和工具将在未来的技术文档中公布,目前此类工具尚不存在。

Q文章分析认为,Claude选择在2026年8月2日启动文本水印功能,其主要原因可能是什么?

A文章分析认为,这很可能不是技术上的巧合,而是为了遵守欧盟法规的合规性反应。因为欧盟的《人工智能法案》第50条关于AI内容标记的强制性要求恰好于2026年8月2日生效。

你可能也喜欢

交易

现货
活动图片