AI评分 一般 (62)AI 中文改写

他为AI抓取所有艺术,现合作开发工具助艺术家

6 小时前 1 阅读来源:Wired AI
他为AI抓取所有艺术,现合作开发工具助艺术家

AI 中文改写

原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接

摄影师张静娜和她的志愿者团队自2023年初以来,一直在维护一个名为Cara的图像分享和作品集应用,至今已吸引约150万艺术家入驻。这些艺术家之所以选择这个平台,是因为他们共同反对自己的作品在未经授权的情况下被用于训练AI模型,同时希望在不被大型科技公司剥削的前提下展示自己的艺术。尽管Cara会过滤AI生成的图像,并提供包括Glaze在内的保护功能——这是一种旨在掩盖被爬虫抓取图像风格、以干扰AI模仿的工具——但完全阻止爬虫抓取几乎是不可能的。就在本月,从8月13日开始,Cara遭受了三次大规模的数据抓取,导致服务器费用飙升,也让从Instagram等平台迁移过来的创作者感到恐慌,因为在这些平台上,所有内容都明确可供Meta作为训练数据使用。 第一起事件曝光时,肇事者在Reddit的r/DefendingAIArt版块发布了一个包含1200万件Cara作品——几乎是其全部公开图像库——的12TB压缩包,并称这是一次“有趣的实验”,成本不到10美元。张静娜表示,团队是通过用户标记才得知此事,因为该爬虫在Reddit上“炫耀并寻找其他人加入他的行列,利用这些数据集做点什么”,这引发了AI相关论坛上关于其行为伦理的激烈辩论。她补充说,这感觉像是“有针对性的、非常伤人的”行为,并指出“法律尚未跟上”此类数据采集的保护措施,这意味着爬虫者往往可以辩称其行为在技术上是合法的。张静娜本人还参与了两起由视觉艺术家提起的集体诉讼,分别针对Stability AI、Midjourney等公司以及Google,指控它们的图像生成工具使用了受版权保护的作品进行训练。 然而,令人意外的是,这位从Cara抓取所有艺术作品的肇事者后来对自己的行为感到后悔,并同意与张静娜合作开发一个开源工具来保护艺术家。与此同时,不幸的是,其他爬虫者继续利用Cara的漏洞和有限的资源。尽管许多AI支持者反对针对Cara的行为,但一些人显然受到MandarinDawnPoppy994的鼓舞,实施了张静娜所称的“模仿式”攻击。第二个爬虫者从Cara抓取了约850万条链接以及用户名、标题和标签等元数据,并将其上传到AI开发者平台Hugging Face。在Hugging Face收到大量下架请求后,该公司回应称,虽然会通知用户“CaptiveDreamer”删除个人元数据,但无法对URL采取同样措施,因为“这里不托管任何艺术作品的副本”,这些链接“指向艺术家在Cara上发布的副本”。该公司总结道,“基于同样理由的进一步版权报告不会改变这一结果”。最后,在8月22日,第三个爬虫者从Cara获取了12.3万张图像,以及包含个人信息的文本帖子和用户简介,并将其分享在名为Academic Torrents的网站上。 张静娜随后在GoFundMe上发起了一项法律费用众筹,目标为12万美元,她解释说这笔钱将用于探索通过网络和版权法保护Cara的各种策略。截至周四,她已筹集超过10万美元,并表示Cara正在积极寻求额外的法律援助。张静娜不仅对爬虫行为感到沮丧,还对Cara团队能采取哪些实际措施来保护艺术家免受恶意行为者侵害的困惑感到不满,她表示一些用户已经删除了自己的作品集并离开了该网站。“我们已经做了所有正确的事情,但法律和平台政策显然还没有跟上这种新型侵权的步伐,”她无奈地表示。这场风波凸显了AI时代艺术家面临的困境:技术发展速度远超法律和平台规则的更新,而小型平台在对抗系统性数据抓取时往往力不从心。

以上为 AI 中文改写版本,如需查看英文原文请访问

英文原文 · Wired AI

内容版权归原作者及 Wired AI 所有

这篇文章对你有帮助吗?
觉得有用?分享给更多人

留言 · 0

暂无留言,来说两句吧

留言经合规过滤后展示,禁止违法内容