Anthropic 官方宣布,未来的 Claude 模型将生成带有水印的文本,这是一种确定 Claude 是否参与文本创作的方式。此举是为了遵循欧盟人工智能法案的要求,Anthropic 与其他主要人工智能供应商一起实施这项变更。
水印技术的运作方式
根据官方说明,水印技术不会对 Claude 的输出质量或内容产生实际影响。水印文本与未水印文本之间的区别对读者来说是不可察觉的。官方指出:“我们使用的水印方法不会对 Claude 的输出质量或内容产生任何实际影响;水印文本与未水印文本之间的差异对读者来说不会可辨识。”(”The difference between watermarked and un-watermarked text will not be distinguishable to readers.”)Anthropic
水印的技术背景
Claude 的水印技术基于 Google DeepMind 在 2024 年发表的 SynthID-Text 方法,这种方法的设计原则是改变选择单词时随机性的来源。官方表示:“水印只改变用于选择单词的随机性来源。”(”The watermark only changes the source of the randomness used to pick among words.”)Anthropic
水印技术的影响及限制
水印技术的有效性存在一定限制。根据官方说明,水印无法确认文本是否由人类创作,也无法判断文本是否由其他人工智能生成。官方指出:“使用我们的密钥,只能回答‘这是否部分由 Claude 写的可能性有多大?’” (”Using our key, one can only answer the question ‘What is the likelihood this was partly written by Claude?’”)Anthropic
水印在文本编辑中的应用
在 Claude 进行文本校对或编辑时,水印仅适用于 Claude 选择的单词。由于大部分文本是人类撰写的,Claude 的修改通常较少,因此水印的附着空间有限。官方强调:“水印仅适用于 Claude 选择的单词。”(”The watermark only applies to words Claude chooses.”)Anthropic
资料来源:Anthropic 官方公告

