区块链文库报道:
Anthropic详解Claude新水印机制及其对用户的影响
Anthropic发布了一篇详细博文,阐明其如何为AI聊天机器人Claude生成的文本添加水印。自本周早些时候公司首次宣布这一举措以来,用户间已引发热议。该水印机制是Anthropic为遵守欧盟《人工智能法案》透明度规范而采取的措施,该规范要求AI公司实施可识别AI生成内容的系统。
Claude的水印如何运作
Anthropic解释称,当Claude进行“低风险选择”时——例如在描述天气时选用“overcast”还是“grey”这类词汇——它可以在回复中嵌入一种模式,这种模式“对读者而言无法察觉,但任何持有对应密钥的人都能检测到”。公司强调,水印不会影响输出质量:“对读者来说,带水印的回复与不带水印的回复毫无区别。”
Anthropic将采用Google DeepMind在2024年开发的SynthID-Text方案,并计划发布水印检测API。该方法不同于Pangram等AI检测工具(后者通过分析写作风格中的“痕迹”进行判断)。Anthropic指出:“识别这些模式与检测水印存在本质区别。”
水印能被去除吗?
Anthropic承认,轻度编辑可能无法完全去除水印,但“如果彻底重写并替换每个单词,则会消除水印”。不过公司补充道:“在后一种情况下,当然有理由质疑文本是否还能被定义为AI生成。”
对于Claude仅做校对或轻度编辑的文本,水印是否存在取决于“文本长度以及Claude的编辑程度”。如果仅做轻度编辑,“几乎所有单词”都来自人类作者,那么“几乎没有什么(如果有的话)可以附着水印”。
对代码生成的影响
Anthropic表示,代码中的水印会比其他文本更少,因为模型必须生成功能正常的代码,限制了其在同等有效选项间的自由选择。尽管如此,“在代码内特定词汇或术语存在任意选择的情况下,水印仍可使用”,但这对实际生成的代码“影响微乎其微”。
这对用户意味着什么
该公告引发了反弹,Reddit上部分用户称其为“针对无辜Claude用户的阴谋”,而另一些人则认为反对意见暴露了欺骗意图。Business Insider报道称,X平台上有“数十位”用户声称已取消订阅。Anthropic还指出,其他主要AI开发者已签署同一份行为规范,并将实施各自的水印方案,这表明行业范围内的广泛采用。
结论
Anthropic的水印机制旨在满足监管要求,同时将对用户的干扰降至最低。公司详尽的解释回应了关于检测、编辑和代码生成的常见担忧,但这场争议凸显了AI透明度与用户自主权之间的持续张力。随着其他开发者纷纷效仿,水印很可能成为行业标准实践。
常见问题解答
Q1:水印会降低Claude的回复质量吗?
Anthropic表示,水印不会影响输出质量;对读者而言,带水印的回复与不带水印的回复无法区分。
Q2:编辑能去除水印吗?
轻度编辑可能无法完全去除,但彻底重写并替换每个单词则会消除。如果仅做轻度编辑,可能几乎没有可检测的水印。
Q3:水印如何影响Claude生成的代码?
代码中的水印较少,因为模型必须生成功能正常的代码。在存在任意选择的情况下,水印可能被应用,但对代码本身影响微乎其微。
免责声明:以上内容(如有图片或视频亦包括在内)均为平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。
本站尊重他人的知识产权、名誉权等法律法规所规定的合法权益!如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到qklwk88@163.com,本站相关工作人员将会进行核查处理回复




