AI水印与检测器或适得其反
8 小时前 1 阅读来源:time.com
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
AI水印和检测工具,可能正在给我们挖一个更大的坑。最近,Claude为遵守欧盟透明度规则,给AI生成的文本打上了水印;OpenAI和谷歌则在AI生成的图片里加入了隐形指纹;Substack也在推广一项扫描文章是否由AI撰写的功能。看起来,我们似乎终于有办法分辨互联网上内容的真假了。但现实是,这套基于“隐藏信号”的验证体系,非但不能让我们更安全,反而可能因为制造出一种“标注为真就是真”的虚假安全感,让整个信息环境变得更糟。
问题的根源在于,我们正在用一套过时的逻辑来应对全新的挑战。过去,判断一个网站是否可信,看它的设计是否精美、有没有错别字、链接是否有效,这些“视觉线索”确实管用,因为当时只有大机构才有资源做出漂亮的网站。但如今,Wix、Squarespace这类建站工具让骗子也能轻松做出以假乱真的页面。我2022年发布的一项研究显示,美国96%的顶尖高校仍在向学生传授这种早已失效的评估方法。这种对表面特征的执着,衍生出一个危险的认知陷阱:如果“有信号”代表真,那“没信号”就代表假。但事实是,一个设计精美、域名是.org的网站,同样可能是仇恨组织的宣传阵地。我们2019年的研究就发现,近半数的仇恨团体都注册了.org域名。坏人早就学会了如何伪装成可信的样子。
AI内容检测面临同样的困境。即便AI生成的视频偶尔还会出现物理扭曲的破绽,但这些破绽的消失并不意味着内容就是真实的。在2024年大选前夕,我和斯坦福教授Sam Wineburg就曾警告过,那些建议民众通过观察光线、阴影来识别深度伪造的官员,给出的建议在AI技术迭代后早已失效。到了2026年,很多所谓的“AI内容识别指南”还在用同样的错误方法误导读者。至于水印和检测器,它们承诺算法能捕捉到人眼看不到的信号,但实际操作中漏洞百出。我虽然不是软件工程师,但仅仅通过截图就能轻松剥离一些AI生成图片的元数据。Anthropic也承认,文件元数据可以通过格式转换、重新保存、截图等方式被移除。谷歌的SynthID水印虽然更坚固,但我用免费在线工具就把它去掉了。谷歌自己也承认,当用户彻底改写AI生成的文本后,水印检测的准确率会“大幅下降”,而且它“并非旨在”应对所有篡改手段。更关键的是,任何能被识别的信号,都会被精明的攻击者找到规避的方法。当水印和检测器成为标准配置,那些真正想作恶的人,恰恰是最有能力绕过这些机制的人。到头来,这些工具只会让普通用户对“标注为真”的内容放松警惕,而对那些没有标注的内容更加疑神疑鬼。我们需要的不是更多表面上的验证手段,而是重新教会人们如何批判性地思考信息的来源和动机——这比任何技术水印都更难被伪造。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
