Sony Music Publishing、Warner Chappell 以及其他出版商起诉 Anthropic 及其创始人,指控该公司下载并通过种子传播数百万份受版权保护的作品,用于训练 Claude。此案发生在此前一项判决之后:该判决要求 Anthropic 因通过盗版获取受保护内容而支付 15 亿美元,尽管法院认定将这些内容用于训练属于合法行为。
Sony Music Publishing、Warner Chappell 以及多家音乐出版商对 Anthropic 及其创始人 Dario Amodei 和 Benjamin Mann 提起诉讼,指控这家人工智能实验室开展大规模行动,以非法方式获取受版权保护的作品,并随后将其用于训练 Claude 模型。
该诉讼于周五晚些时候向美国加利福尼亚北区联邦地区法院提起。原告称,Anthropic 的做法包括使用种子、抓取以及未经授权下载数千份受版权保护的作品。TechCrunch 在报道发布前未能获得该公司的评论。
指控超出单纯将内容用于训练的范围
该案并不局限于通常所讨论的问题,即使用受保护材料训练人工智能模型是否属于合法使用。诉讼称,Anthropic 通过种子非法获取了数百万本书籍的副本,其中包括包含歌词和乐谱的书籍。
出版商将这些行为描述为“公然盗窃”和“明目张胆的盗版”。但这些描述属于原告在诉讼中的指控,并不构成针对 Anthropic 的最终司法裁决。材料中也没有表明该公司的法律立场或其对这些指控的回应。
该案与此前争议的关联
这起新诉讼发生在 Anthropic 面临一系列知识产权案件的背景下。参与本案的部分律师也在 1 月提起的一起案件中代理 Concord Music Group 和 Universal Music Group;他们还与 Bartz v. Anthropic 案有关。在该案中,作者指控该公司使用受版权保护的书籍训练 Claude 等产品。
据该材料,Anthropic 在 Bartz 案中被要求支付 15 亿美元,此前一名法官认定,使用受保护作品训练人工智能系统属于合法行为,但通过盗版获取这些作品并不合法。
为什么这条消息重要?
当前诉讼为围绕人工智能训练数据的争议增添了更具体的层面:即使法院在特定情况下接受将受保护内容用于训练的原则,数据来源及其获取方式也可能产生独立的法律责任。这使模型发布者面临一个与训练来源记录和内容获取程序有关的实际问题,而不仅仅是模型设计或其输出的问题。
本案的结果仍未确定;现有材料不包含 Anthropic 的回应,也没有法院作出的新判决。此外,该诉讼涉及包含歌词和乐谱的书籍,权利人要求保护的材料类型使其在这一点上不同于此前的案件。