索尼音乐与华纳音乐日前联合对AI公司Anthropic提起诉讼,指控其在与生成式AI模型训练相关的行为中,存在“公然且系统性的知识产权盗窃”。这起诉讼被外界视为迄今针对AI公司音乐版权侵权指控中“范围最广、指控最犀利”的一例,焦点直指非法盗版行为。
诉讼核心:从“输入”到“输出”的全链条指控
原告方指出,Anthropic在训练其AI大模型(如Claude系列)时,未经授权批量抓取并复制受版权保护的音乐作品,包括歌曲的歌词、乐谱、录音等原始素材。更关键的是,诉讼不仅停留在“训练输入”环节,还剑指“生成输出”环节——即AI在用户要求下生成的回应中,能够近乎逐字还原受版权保护的歌词片段,甚至能够根据用户提示“复现”特定歌曲的旋律与结构特征。
索尼与华纳强调,这种行径不能简单归结为技术上的“合理使用”。他们认为,Anthropic的模型在商业运营中被持续用于生成可能替代原作的表达性内容,与合法授权的流媒体或翻唱服务形成直接竞争,从而严重挤压了原创音乐及其权利人的商业价值。
版权方利益受损的“实锤”
诉讼文件中特别提到,Anthropic的行为已构成“对现有授权市场的全方位拆台”。过去,音乐作品的使用需经由唱片公司、词曲版权代理机构等多方授权,并支付相应版税。而Anthropic的做法相当于绕开所有合法渠道,将数以百万计的音乐作品“无声无息”地吸入训练数据库,再以AI生成物的形式输出,让版权方既无法追踪使用痕迹,也无法获得报酬。
原告认为,这种做法与“盗版网站”的运作逻辑如出一辙,只是换了一身“技术创新”的外衣。两家唱片公司援引了美国版权法中的“复制权”“演绎权”以及数字千年著作权法(DMCA)相关条款,要求法院判令Anthropic停止侵权、销毁涉事数据,并提供实质性赔偿。由于Anthropic尚未公开其训练语料的完整清单,版权方要求法院介入进行证据保全,以查明实际侵权规模。
AI行业的版权困境再添新案例
这并非AI公司与音乐行业之间的第一场法律纠纷。此前,环球音乐、迪士尼等公司也曾对生成式AI工具提出过类似的版权质疑,但多以拆解式、零散式诉讼为主。此次索尼与华纳的联合起诉,首次系统性地将AI模型从数据采集、模型训练到内容生成的整条技术链路悉数纳入指控范围,被视为一次“教科书式”的法律围剿。
值得玩味的是,Anthropic一直以“AI安全”和“负责任训练”为品牌标签,强调其模型追求可靠性与边界约束。但在版权方眼中,这种自我标榜与内部数据的实际来源之间存在着巨大落差。诉讼指出,Anthropic在训练时不会告知用户歌词来自哪位词曲作者,也不会对输出的版权内容做屏蔽处理,反而会主动迎合用户对热门歌曲的查询请求——这无疑暴露了其内部版权合规流程的严重缺失。
影响与展望:AI训练的数据“灰区”正在被压缩
这起诉讼的走向,可能对整个人工智能行业产生深远影响。如果法院最终支持索尼和华纳的主张,那么过去几年里AI公司普遍采用的“爬取+训练”模式将面临更为严苛的法律审视。不仅仅是音乐,包括文字、图片、影视剧等所有受版权保护的内容,都可能成为下一个诉讼的靶心。
对于中小型AI开发者而言,这无疑是一场寒潮——高昂的授权成本将抬高入局门槛;而对巨头而言,或许会加速其与版权方建立合规数据池的进程。但更深层的矛盾依然存在:AI的创造力从根本上依赖于对既有文化作品的统计与模仿,如果这条路径被彻底堵死,生成式AI的“创作”边界又将如何界定?
至少在这份诉讼中,索尼与华纳给出了一个明确信号:技术再炫目,也不能成为盗版的遮羞布。法庭上的最终判决,将不仅决定两家唱片公司与Anthropic之间的胜负,更会成为定义AI时代文化生产规则的关键路标。