Sony Music и Warner Publishers подали иск к Anthropic из-за предполагаемого пиратства, использованного для обучения Claude

Sony Music и Warner Publishers подали иск к Anthropic из-за предполагаемого пиратства и несанкционированного обучения ИИ, расширяя риски авторского права вокруг Claude и источников данных.

AI News

Sony Music Publishing, Warner Chappell и другие музыкальные издатели подали иск против Anthropic и ее руководителей в федеральный суд, утверждая, что ИИ-компания незаконно получила и использовала защищенные авторским правом песни, тексты и нотные партитуры для разработки Claude. В иске спор представлен не просто как вопрос о том, можно ли использовать материалы, защищенные авторским правом, для обучения ИИ, а о том, как Anthropic, по утверждению истцов, эти материалы получила.

Иск подан в Окружной суд США по Северному округу Калифорнии; в числе ответчиков указаны Anthropic, генеральный директор Dario Amodei и сооснователь Benjamin Mann. Издатели обвиняют компанию в том, что она без разрешения скачивала через torrent, скрапила и загружала большие объемы защищенных произведений. Anthropic сообщила TechCrunch, что не согласна с обвинениями и намерена защищаться.

Новый спор об авторском праве для Anthropic

Иск добавляет серьезный вызов со стороны музыкальной индустрии к уже значительной юридической проблеме Anthropic. Согласно сообщениям TechCrunch и The Decoder, истцы утверждают, что в процессе разработки моделей Claude были использованы десятки тысяч музыкальных произведений, главным образом в форме текстов песен, а также нотные партитуры и связанные материалы.

Издатели описывают предполагаемые действия в исключительно жестких выражениях, называя их крупномасштабным и продолжающимся хищением интеллектуальной собственности. Эти формулировки — утверждения из иска, а не выводы суда.

Это дело следует за предыдущим спором Anthropic с авторами и издателями в деле Bartz v. Anthropic. В том деле компания согласилась выплатить 1,5 млрд долларов после того, как суд установил, что приобретение книг, защищенных авторским правом, путем пиратства было незаконным, хотя отдельный вопрос использования материалов, защищенных авторским правом, для обучения рассматривался иначе. TechCrunch сообщал, что суд обязал произвести выплату; The Decoder описал это как урегулирование.

Это различие имеет ключевое значение для нового дела. Музыкальные издатели пытаются опереться на предыдущее решение, утверждая, что несанкционированное приобретение может само по себе влечь ответственность, независимо от того, были ли файлы затем напрямую включены в коммерческую модель.

Дело нацелено на получение данных, а не только на выходные данные модели

В иске, по сообщениям, основной акцент сделан на использовании Anthropic торрент-сетей и так называемых пиратских библиотек, включая LibGen и PiLiMi. The Decoder сообщил, что издатели утверждают: Anthropic скачала через торрент как минимум семь миллионов книг из этих источников, в том числе книги с текстами песен и музыкальными материалами. Вопрос о том, использовались ли эти книги напрямую в коммерческих моделях Claude, вероятно, станет одним из главных в ходе discovery.

Истцы, по сообщениям, также оспаривают сбор текстов песен из лицензированных сервисов вроде MusixMatch и LyricFind, утверждая, что скрапинг нарушал условия платформ и права издателей. Среди других наборов данных, упомянутых в иске, — Books3, The Pile и Common Crawl; издатели заявляют, что в них содержались несанкционированные материалы.

Обвинения выходят за рамки цифровых файлов. The Decoder сообщил, что в иске Anthropic обвиняют в сканировании и уничтожении подержанных сборников песен и коллекций нот. Также утверждается, что некоммерческая модель, обученная на материалах из LibGen и PiLiMi, сгенерировала синтетические данные, которые затем использовались при разработке или в процессе обратной связи для коммерческой модели Claude.

Anthropic ранее отрицала, что напрямую использовала книги из LibGen и PiLiMi для обучения коммерческих продуктов. По версии издателей, как пишет The Decoder, такое отрицание может зависеть от определения «обучения», принятого Anthropic, и может не затрагивать использование производных или синтетических данных.

Доказательства, претензии и возможные убытки

Наиболее твердо установленные факты на данный момент таковы: издатели подали иск, Anthropic и ее руководители указаны в качестве ответчиков, а Anthropic отвергла обвинения. Более детальные утверждения о torrenting, наборах данных, путях разработки модели и указаниях руководства исходят из иска истцов, как сообщили TechCrunch и The Decoder. Они остаются спорными.

The Decoder сообщил, что иск требует до 150 000 долларов за каждое нарушенное произведение и до 25 000 долларов за каждое нарушение, связанное с удалением информации об управлении авторскими правами, например уведомлений или идентифицирующих метаданных. Итоговые риски будут зависеть от того, какие требования выживут, сколько произведений будет признано охваченными и примет ли суд теории ответственности издателей.

Дело также поднимает сложный вопрос доказывания для ИИ-компаний: что считается использованием защищенного контента, когда он проходит через наборы данных для предварительного обучения, конвейеры синтетических данных, системы оценки или процессы обучения с подкреплением? Компания может различать исходный файл и последующую модель, в то время как правообладатели могут утверждать, что каждый этап отражает первоначальное несанкционированное приобретение или воспроизведение.

Решение Мюнхенского земельного суда в ноябре 2025 года, на которое ссылается The Decoder, добавляет международный ориентир. Этот суд постановил, что защищенные тексты песен могут считаться воспроизведением внутри параметров модели, а сгенерированные текстовые выводы могут представлять собой незаконное публичное раскрытие. Это решение не относится к делу в США, но показывает, как суды рассматривают и внутреннее устройство модели, и сгенерированный контент.

Почему это должно волновать разработчиков ИИ и корпоративных покупателей

Для разработчиков моделей иск усиливает давление в пользу документирования происхождения данных на уровне, который выходит за рамки общих названий наборов данных. Командам могут понадобиться записи о том, откуда взялись файлы, какие лицензии применялись, как трактовались условия использования и попадали ли ограниченные материалы в конвейеры синтетических данных или обучения с подкреплением.

Для корпоративных покупателей спор добавляет еще один слой к проверке поставщиков. Вопросы о политике модели в отношении авторского права теперь включают не только то, воспроизводит ли она тексты песен или книги, но и может ли поставщик доказать законность получения и управления обучающими данными. Договорные гарантии, права на аудит, контроль версий модели и ограничения на высокорисковые выходы могут стать более важными при закупках.

Дело также может повлиять на экономику обучения ИИ. Если суды будут рассматривать пиратское приобретение как отдельный источник ответственности, компаниям, возможно, придется тратить больше на лицензированные корпуса, фильтрацию, системы происхождения данных и юридическую проверку до того, как данные попадут в обучающий прогон. Это не решит все вопросы авторского права, но может сделать источники данных более заметным конкурентным фактором среди поставщиков фундаментальных моделей.

Что смотреть дальше

Первые сигналы появятся из официального ответа Anthropic и любых ходатайств, оспаривающих иск. Discovery должен показать, вошли ли спорные файлы в коммерческий обучающий конвейер Claude, использовались ли косвенно через синтетические данные или были сохранены для иных целей разработки.

Разработчикам стоит следить за судебными решениями о личной ответственности руководителей, о трактовке torrenting как самостоятельного нарушения и о способности издателей связать конкретные произведения с определенными моделями или этапами обучения. Лицензионные соглашения между ИИ-компаниями и правообладателями в музыкальной сфере также покажут, подталкивает ли иск рынок к согласованному доступу.

Особенно важным будет взаимодействие дела с Bartz v. Anthropic. Если предыдущее решение станет основанием для ответственности за способы приобретения, другие правообладатели могут предъявить похожие претензии к разработчикам моделей, в наборах данных которых содержатся спорные материалы.

Взгляд Creati.ai

Этот иск смещает внимание с привычного вопроса о том, что выдает ИИ-модель, на менее заметные системы, которые формируют ее обучающие данные. Для Anthropic юридический риск может зависеть не только от поведения Claude на уровне запросов, но и от закупок, контроля скрапинга и внутренней истории данных.

Для более широкого рынка практический вывод более узкий, но важный: формулировка «не обучалась напрямую на» может оказаться недостаточной с точки зрения комплаенса, если суды начнут изучать промежуточные модели, синтетические данные и конвейеры обратной связи. ИИ-компании, которые смогут доказать, откуда пришли их данные — и что они делали, когда права были неясны, — будут в лучшем положении по мере того, как споры об авторском праве будут проникать глубже в инфраструктуру разработки моделей.

Реклама