观点网讯:近日,Anthropic首次公开说明Claude文字浮水印的技术细节,最新一批Claude模型已内建相关机制,旧版模型也将陆续适配。这项技术的核心,是在模型生成文字时调整选词所使用的随机机制,让文字表面上与一般输出没有明显差异,但持有密钥的一方可以进一步验证其中是否存在浮水印讯号。
Anthropic表示,这项机制不会刻意改变Claude生成文字的品质。文字浮水印透过预先植入的讯号进行验证,与依赖文字风格及语言特征的传统AI侦测器不同。
Claude生成文字时,会逐步选择下一个词。当多个候选词的生成机率相近时,模型原本可以透过随机机制决定最终选项。Anthropic的做法,是在这个选词阶段调整随机数产生方式,利用密钥推导出具有特定规律的数值,取代原本无法预测的随机数。因此,从使用者阅读的角度来看,生成结果不会因此变得明显不自然,也不会刻意加入特殊词汇。然而,掌握密钥的一方,则可以透过分析文字中的选词规律,确认其中是否存在浮水印讯号。
浮水印只会作用于Claude实际选择的词汇,在翻译、程式码、短篇文字、事实陈述等选词空间受限的场景下效果有限。Anthropic承认,浮水印最多只能判断Claude「可能参与过」某段文字,无法确认其参与程度。
2026年7月一项研究发现,59篇原本能被检测出浮水印的文章经AI释义工具改写后,有58篇无法再检测出浮水印,比例达98.3%。按照当时的服务价格,重新处理一篇约1000字文章的成本约4美分。
免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。