首页 / 资讯 / Claude 的文字现在带有只有机器能读懂的隐藏签名
Anthropic

Claude 的文字现在带有只有机器能读懂的隐藏签名

2026年8月12日4 分钟阅读
Claude 的文字现在带有只有机器能读懂的隐藏签名

新闻摘要

Anthropic已开始将不可见的水印直接嵌入其Claude模型生成的文本中,该公司表示,此举将让用户、平台和研究人员能够验证某段文字是否由AI生成。与传统元数据标签(只需将文本复制到另一文档即可剥离)不同,新水印被编织进措辞本身,这意味着它可以在复制粘贴操作后存活,并且在许多情况下,经过适度编辑后依然存在。

水印的工作原理

据Anthropic称,该系统通过微妙地影响Claude在生成回复时选择的词汇和措辞来运作。这些变化被设计为对人类读者不可感知——它们不会改变输出的含义、语气或质量——但它们形成一种统计模式,专门的检测器可以随后分析该模式,以确定文本是否可能源自Claude。Anthropic表示,它打算发布解释检测过程的技术文档,以及让第三方、出版商和研究人员检查段落中是否存在Claude水印的工具。

推出与范围

水印适用于自2026年8月2日起发布的所有新Claude模型,Anthropic已确认该功能在提供Claude的所有地区均处于激活状态,不仅限于任何单一地区或产品层级。该公司还正在将类似的来源信号扩展到图像输出,使用广泛采用的C2PA内容凭证标准,该标准嵌入可验证的元数据,描述JPEG或PNG文件的创建方式。

Anthropic为何这样做

这一时机与欧盟生效的新透明度义务相吻合。Anthropic是欧盟《人工智能法案》关于AI生成内容透明度行为准则的签署方,该准则属于第50条第2款的一部分,要求生成式AI系统的提供商标记其输出,以便识别为机器生成。虽然该要求源于欧盟法规,但Anthropic表示水印将全球适用,而非仅针对欧洲用户进行地理围栏,这反映了该公司在其全球所有用户群中推动一致来源标准的更广泛努力。

Anthropic已承认的局限性

该公司坦承水印并非万无一失的检测机制。大量改写、实质性重写或通过其他编辑工具处理文本,都可能稀释或完全抹除统计信号。非常短的段落包含的文本太少,无法可靠地嵌入或检测模式。Anthropic还警告说,即使检测到水印,它仅表明Claude在某个时刻参与了文本的生成——它无法确认谁发布了内容,是否经过事实核查,或之后被人类编辑修改了多少。

对读者、教育工作者和出版商的意义

对于应对AI生成内容传播的新闻编辑室、学术机构和在线平台,行业支持的检测信号提供了一个新的(尽管不完美的)验证层。评估学生提交内容的教育工作者、审查自由撰稿的编辑,以及审核用户生成内容的平台,都可能将即将推出的检测工具作为评估文本是否由AI辅助的多个输入之一。Anthropic将此举措定位为构建生成式AI透明度基础设施的更广泛行业趋势的一部分,将其与科技行业已在进行的AI生成图像和视频的类似来源工作并列。

AnthropicAI水印