Sony Music Publishing, Warner Chappell и ряд музыкальных издателей подали иск против Anthropic и её основателей Dario Amodei и Benjamin Mann, обвинив лабораторию искусственного интеллекта в проведении масштабной кампании по незаконному получению защищённых авторским правом произведений, которые затем использовались для обучения модели Claude.
Иск был подан поздно вечером в пятницу в окружной суд США Северного округа Калифорнии. По утверждению истцов, методы Anthropic включали использование торрент-сетей, скрейпинг и несанкционированное скачивание тысяч защищённых произведений. TechCrunch не удалось получить комментарий компании до публикации материала.
Обвинение выходит за рамки простого использования контента для обучения
Дело не ограничивается обычным вопросом о том, является ли обучение моделей искусственного интеллекта на защищённых материалах законным использованием. В иске Anthropic обвиняется в незаконном получении миллионов копий книг через торрент-сети, в том числе книг, содержащих тексты песен и нотные записи.
Издатели называют произошедшее «вопиющей кражей» и «откровенным пиратством». Однако эти формулировки представляют собой утверждения истцов в иске и не являются окончательным судебным решением против Anthropic. В материале также нет сведений о правовой позиции компании или её ответе на обвинения.
Связь дела с предыдущими спорами
Новый иск подан на фоне серии дел, с которыми Anthropic сталкивается в связи с интеллектуальной собственностью. Некоторые участвующие в нём адвокаты также представляют Concord Music Group и Universal Music Group в деле, поданном в январе, а также связаны с делом Bartz v. Anthropic, в котором авторы обвинили компанию в использовании защищённых книг для обучения таких продуктов, как Claude.
Согласно материалу, Anthropic обязали выплатить 1,5 миллиарда долларов по делу Bartz после того, как судья пришёл к выводу, что использование защищённых произведений для обучения систем искусственного интеллекта было законным, однако получение этих произведений посредством пиратства — незаконным.
Почему эта новость важна?
Нынешний иск добавляет более конкретный аспект к спору о данных для обучения искусственного интеллекта: даже если суды признают принцип использования защищённого контента для обучения при определённых обстоятельствах, источник данных и способ их получения могут повлечь отдельную юридическую ответственность. Это ставит перед разработчиками моделей практический вопрос, связанный с учётом источников обучающих данных и процедурами получения контента, а не только с архитектурой модели или её результатами.
Исход этого дела остаётся открытым: доступный материал не содержит ответа Anthropic или нового решения суда. Кроме того, охват иска, включающего книги с текстами песен и нотными записями, отличает его от предыдущих дел с точки зрения видов материалов, защиту которых требуют правообладатели.