OpenAI是否实施了史上最大知识产权盗窃?
3 小时前 1 阅读来源:hollywoodreporter.com
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
一场围绕AI训练数据的法律战正在升级,而最新解封的法庭文件让OpenAI和微软的处境变得相当尴尬。本周四公开的内部文件显示,微软和OpenAI的高管们早在2023年就意识到,他们用版权内容训练AI模型的做法可能构成"前所未有的盗窃"。微软应用科学总监Brent Hecht在一份内部文件中直言,将受版权保护的作品"吸入"AI系统是"人类历史上最大规模的劳动盗窃"。这些文件来自《纽约时报》等12家出版商对微软和OpenAI提起的集体诉讼,目前案件正在审理中。
核心争议:这些文件之所以引发震动,是因为它们直接触及了AI公司一直以来的核心辩护——合理使用(Fair Use)。合理使用是美国版权法中的一项原则,允许在未经授权的情况下有限度地使用受版权保护的作品。AI公司一直声称,用公开数据进行模型训练属于"转化性使用",理应受到合理使用原则的保护。但出版商们现在拿出了内部证据,证明这些公司的高管自己都不相信这套说辞。最致命的一则交流发生在OpenAI工程师与总裁Greg Brockman之间:工程师告知Brockman有一个"绕过纽约时报付费墙的黑客方法",Brockman回复"啊不错"。出版商认为这表明OpenAI高管不仅知道如何规避访问限制,还实际采用了这些手段。更耐人寻味的是微软CEO萨提亚·纳德拉的证词——他表示"任何设有付费墙的内容,使用者都应该获得授权",并称如果知道OpenAI抓取了受限内容进行训练,他会"行使"微软的权利要求OpenAI重新训练模型。这与Brockman的轻描淡写形成了鲜明对比。
对跨境电商和AI从业者意味着什么:这起案件的走向将直接影响AI工具的训练数据合规性,进而波及所有依赖大模型的应用和服务。如果法院最终认定AI公司不构成合理使用,那么模型训练的数据来源、授权成本乃至整个AI产业链的商业模式都可能被重构。对于出海企业而言,使用AI生成内容时也需要更加关注版权风险——如果训练数据本身来源不合法,基于这些模型产出的内容也可能面临法律挑战。目前案件仍在审理中,OpenAI和微软需要承担举证责任,证明其行为符合合理使用的四要素检验标准。而那份2023年的微软内部文件——"几乎没有人希望自己创作的内容被这样使用,他们也没有得到任何补偿"——或许会成为出版商手中最有力的证据之一。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
