Project Panama:Anthropic秘密销毁数百万册图书以训练AI
1 小时前 1 阅读来源:euronews.com
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
美国法院近期解封的文件,揭开了AI巨头Anthropic一项代号“巴拿马计划”的秘密行动:这家公司曾大规模购买、销毁并扫描了数百万本纸质书,用于训练其AI聊天机器人Claude。这一消息由《华盛顿邮报》率先披露,随即在科技与出版界引发轩然大波,也让外界得以一窥AI军备竞赛背后对创作者版权的漠视程度。
事情的起因并不复杂。Anthropic的高管们发现,互联网上的文本质量参差不齐,充斥着“低质量的网络用语”,如果Claude长期学习这些内容,会严重影响其写作能力的上限。相比之下,书籍拥有大量经过专业编辑、由人类精心撰写的优质文本,且尚未被AI生成内容“污染”。但问题在于,如何合法且高效地获取这些受版权保护的书籍。于是,从2024年初开始,Anthropic从Better World Books和英国World of Books等多家供应商处批量购入数十万册图书,再外包给第三方公司,用液压机器切掉书脊、逐页扫描,将内容数字化后用于模型训练。而这些完成使命的纸质书,最终被送往回收厂打成纸浆,变成了卫生纸和纸板箱。
更令人震惊的是,法院文件显示Anthropic内部对此事高度保密,规划文件明确写道“我们不希望外界知道我们在做这件事”。联合创始人Ben Mann甚至被曝在2021年就曾从盗版网站LibGen下载大量受版权保护的书籍,并在内部通讯软件中与同事分享盗版资源链接,还兴奋地写道“来得正是时候!!!”这些行为如今都成了集体诉讼中的关键证据。2024年,以小说家Andrea Bartz和纪实作家Charles Graeber等人为首的作者群体对Anthropic提起集体诉讼,指控其未经授权使用受版权保护的作品训练AI。随着案件推进,数千页法庭文件被解封,“巴拿马计划”的全貌才得以浮出水面。
这一事件对中国跨境电商卖家和AI从业者而言,至少有三层启示。首先,它揭示了AI训练数据获取的灰色地带远未结束,即便像Anthropic这样的头部公司也在铤而走险,版权诉讼风险是悬在AI行业头上的达摩克利斯之剑。其次,对于依赖AI工具进行内容创作和营销的卖家来说,如果底层模型训练数据存在版权瑕疵,未来可能面临内容合规性的连带风险。最后,从商业角度看,高质量、合法授权的数据将成为AI公司的核心竞争力,这也意味着未来数据交易市场将更加活跃,卖家手上的产品描述、用户评价等一手数据,或许能成为新的资产。目前,Anthropic尚未对“巴拿马计划”的曝光作出正式回应,但这场官司的走向,很可能重塑整个AI行业的游戏规则。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
