美国人工智能公司Anthropic计划推出一种隐形水印技术 ,用于识别由 AI 生成的文本内容 。

Anthropic表示,自 8 月 2 日及之后发布的模型起,该公司会在Claude AI 生成的文本中直接嵌入人类无法察觉、仅机器可识别的水印。人类肉眼看不到该水印 ,不会降低文本质量与可读性。即便复制粘贴文本,水印也会随之保留,部分轻度编辑操作也无法清除水印 。(但大规模改写或翻译操作大概率会破坏该水印标识。)

由于该水印内置在模型底层 ,Claude生成的所有内容都会自带水印,用户通过对话机器人 、应用程序接口(API),甚至 Claude Code 这类工具使用Claude时,生成内容都会携带水印。图片文件同样会嵌入水印 ,用于标识该文件经由Claude处理,一旦后续有人篡改文件,水印系统也能识别出来 。

Anthropic推出这项水印技术 ,部分原因是为了符合 8 月 2 日正式生效的欧盟《人工智能法案》透明度相关规定。该法案要求生成式人工智能服务商,必须保证人工合成内容可被机器识别、检测。
其他人工智能企业此前也推出过同类水印技术,但大多仅针对图片内容。文本一直很难通过水印溯源 ,因为文本会被频繁复制、改写 、翻译、拆分,或是混入他人的文稿中 。Anthropic表示,这款全新检测标记仅能证明Claude参与过文本创作 ,无法判定整篇内容完全由Claude生成。哪怕只是让模型校对、翻译一段文字,文本中也会留下水印痕迹。如果你使用的是旧版Claude模型,近来 暂不支持该水印功能 ,Anthropic称仍在推进水印技术的全模型适配工作 。