Sony Music Publishing, Warner Chappell et plusieurs éditeurs de musique ont intenté une action en justice contre Anthropic et ses fondateurs, Dario Amodei et Benjamin Mann, accusant le laboratoire d’intelligence artificielle d’avoir mené une vaste campagne visant à obtenir illégalement des œuvres protégées par le droit d’auteur, puis à les utiliser pour entraîner le modèle Claude.
La plainte a été déposée vendredi en fin de journée devant le tribunal fédéral du district nord de la Californie. Selon les plaignants, les pratiques d’Anthropic comprenaient l’utilisation de torrents, le scraping et le téléchargement non autorisé de milliers d’œuvres protégées. TechCrunch n’a pas pu obtenir de commentaire de l’entreprise avant la publication de l’article.
Une accusation qui va au-delà de la simple utilisation de contenu pour l’entraînement
L’affaire ne se limite pas à la question habituelle de savoir si l’entraînement de modèles d’intelligence artificielle sur des contenus protégés constitue un usage légal. La plainte accuse Anthropic d’avoir obtenu illégalement, par torrent, des millions de copies de livres, dont certains contiennent des paroles de chansons et des partitions musicales.
Les éditeurs qualifient ce qui s’est passé de « vol éhonté » et de « piratage flagrant ». Ces qualificatifs constituent toutefois des allégations des plaignants dans la plainte et ne représentent pas une décision judiciaire définitive contre Anthropic. L’article ne contient pas non plus d’indication sur la position juridique de l’entreprise ni sur sa réponse aux accusations.
Le lien avec des litiges antérieurs
Cette nouvelle action intervient dans le contexte d’une série d’affaires auxquelles Anthropic fait face au sujet de la propriété intellectuelle. Certains des avocats qui y participent représentent également Concord Music Group et Universal Music Group dans une affaire déposée en janvier, et ont aussi été associés à l’affaire Bartz v. Anthropic, dans laquelle des auteurs ont accusé l’entreprise d’utiliser des livres protégés pour entraîner des produits tels que Claude.
Selon l’article, Anthropic a été contrainte de verser 1,5 milliard de dollars dans l’affaire Bartz après qu’un juge a conclu que l’utilisation d’œuvres protégées pour entraîner des systèmes d’intelligence artificielle était légale, mais que l’obtention de ces œuvres par le piratage ne l’était pas.
Pourquoi cette information est-elle importante ?
La présente action ajoute une dimension plus précise au débat sur les données d’entraînement de l’intelligence artificielle : même si les tribunaux acceptent le principe de l’utilisation de contenus protégés pour l’entraînement dans certaines circonstances, la source des données et la manière dont elles ont été obtenues peuvent entraîner une responsabilité juridique distincte. Cela confronte les éditeurs de modèles à une question pratique concernant les registres des sources d’entraînement et les procédures d’obtention des contenus, et pas seulement la conception du modèle ou ses résultats.
L’issue de cette affaire reste ouverte : les éléments disponibles ne contiennent aucune réponse d’Anthropic ni nouvelle décision du tribunal. En outre, le champ de la plainte, qui comprend des livres contenant des paroles de chansons et des partitions musicales, la distingue des affaires précédentes par les types de contenus que les titulaires de droits cherchent à protéger.