程序员称已找到绕过Claude隐形水印的方法
3 天前 1 阅读来源:Wired AI

AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
Anthropic上周宣布,旗下Claude模型将在全球范围内为所有AI生成内容嵌入隐形、机器可读的水印,以符合欧盟《人工智能法案》的要求。然而,这一举措在发布后不到四小时内就被开发者找到了破解之道。法国开发者纪尧姆·迈耶迅速发布了一段代码,声称可以移除Claude生成文本中的水印。这段代码在GitHub上迅速走红,在X平台上被收藏超过2万次,吸引了100多位贡献者参与完善,还有更多人将其整合进自己的项目中。一位AI专家在社交媒体上写道:“Anthropic在Claude文本中嵌入水印……但这个问题在一天后实际上就已经成为历史了。”
迈耶向WIRED表示,他和其他人之所以研究水印技术,是因为他们不认同所有AI生成内容都应被标记的观点,也有人纯粹是享受技术挑战的乐趣。他还透露,一些自由撰稿人和社交媒体创作者已经联系他,希望获得使用这段代码的帮助。欧盟新规于本月早些时候生效,要求Anthropic和OpenAI等模型提供商必须为合成音频、图像、视频或文本添加标签,以便机器能够检测出AI生成的内容,否则将面临高达年营业额3%的罚款。虽然规定禁止提供商营销规避工具,但对独立工具并无法律限制。迈耶强调:“我并不反对透明度,也完全支持内容归属。我只是认为水印本身是一个糟糕的解决方案,因为它有重大缺陷和风险。”他担心误报风险,以及水印可能无法区分轻度或重度AI使用——尤其是他作为法语母语者,经常使用Claude和Grammarly等AI工具来润色自己的写作。如果雇主仅凭水印检测结果(连Anthropic自己都承认只能给出文本被Claude处理过的概率)就拒绝候选人,或者研究人员被过度指控使用AI,那将是不公平的。
Anthropic的水印技术通过在Claude的措辞和短语选择中留下人类无法察觉、但机器可以识别的模式来实现。由于这会影响Claude的输出,一些用户担心这会降低Claude回复的质量,尽管Anthropic坚称不会。这项技术名为SynthID,由谷歌开发,自2023年起谷歌就将其用于AI生成内容的水印。计算机科学家斯科特·阿伦森在OpenAI工作期间曾提出类似方法,但该公司因担心水印会吓跑客户而从未部署。迈耶的移除方法使用不加水印的大语言模型进行多次重写,替换同义词并稍微重组内容。当然,这依赖于使用其他不插入水印的大语言模型——这可能不是万无一失的,因为包括OpenAI、微软和Meta在内的190家组织已签署欧盟透明度行为准则。目前尚不清楚这些实验室中有多少会实施水印,但从8月起发布的所有新模型都必须包含水印,现有模型则需在12月前整合。首席技术官韦恩·潘表示,虽然在该工具真正生效前无法确定其有效性,但基于对Claude水印所依赖的SynthID文本方法的理解,他们相当确信这种方法可行。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
