索尼与环球音乐再诉Suno:指控其用旧模型输出“洗白”侵权数据
索尼音乐与环球音乐集团(UMG)再次将AI音乐生成公司 Suno 告上法庭。这一次,两大唱片巨头把矛头对准了 Suno 新发布的 v6 模型,指控其通过“模型洗白”(model laundering)的方式,继续使用未经授权、从 YouTube 等来源抓取的音乐数据。
诉讼核心:新模型并非“全新开始”
根据索尼和 UMG 提交的诉状,Suno 的 v6 模型虽然号称“从头训练”,但实际上使用了旧版模型的用户输出作为训练数据。而这些旧模型本身,据称是在未获授权的情况下,用抓取自 YouTube 等平台的音乐训练出来的。
唱片公司在诉状中写道:
“在一个侵权模型的输出上训练‘新’模型,并不能消除侵权;它只是把侵权洗白了——把原告表达的价值从被复制的录音传递到受污染的模型,再从模型传递到输出,最后从输出传递到 v6……V6 不是全新的开始,它是同一棵毒树结出的果子。”
诉状还进一步指控 Suno 使用了知识蒸馏技术来训练 v6,即让新模型模仿旧版“教师模型”的输出结果。而旧版模型据称正是基于侵权数据构建的。索尼方面认为,即便新模型没有直接使用原告的录音进行训练,它依然“受益于 Suno 保留的未经授权的副本”。
Suno 的回应:训练数据来自“合作伙伴授权”与“社区创作”
面对指控,Suno 方面曾对 The Verge 表示,v6 是“从头开始训练的,使用了全新的数据集”,其中包括“用户数据”。Suno 发言人 Rachel Racusen 后来确认,这些数据包括用户的“创作”,并称:
“v6 的训练数据来自我们合作伙伴授权的内容、社区互动(包括创作和偏好信号),以及我们团队积累的学习成果。”
但 Suno 并未明确说明,这些数据是否包括用户上传的音频,或者基于上传音频生成的输出内容。
为什么这件事重要?
索尼和 UMG 是与 Suno 未签署授权协议的主要坚持者。在 AI 音乐生成领域,版权问题一直是悬而未决的核心争议。Suno 和另一家主要竞争对手 Udio 此前已被多家唱片公司起诉,但部分公司后来选择了和解并签署授权协议。
此次诉讼的关键在于“模型洗白”这一概念。如果法院认可唱片公司的逻辑,那么 AI 公司就不能通过“用旧模型的输出训练新模型”来规避版权责任。这将对整个生成式 AI 行业产生深远影响——不仅仅是音乐,还包括图像、文本等所有依赖大规模训练数据的领域。
目前,Suno 尚未对最新诉讼作出公开回应。案件仍在进一步审理中。
