Sony MusicとWarnerの出版各社は、海賊版の疑いと無許可のAI学習をめぐってAnthropicを提訴し、Claudeとデータの出所を巡る著作権リスクを広げた。

Sony Music Publishing、Warner Chappell、その他の音楽出版社は、AI企業Anthropicとその上級経営陣を連邦裁判所に提訴し、Claudeの開発のために著作権で保護された楽曲、歌詞、楽譜を違法に入手・使用したと主張している。訴状は、この争いを単に著作権保護素材をAI学習に使えるかどうかの問題としてではなく、Anthropicがそれをどう入手したのかという点も問題視している。
この訴訟はカリフォルニア州北部地区連邦地方裁判所に提起され、Anthropic、CEOのDario Amodei、共同創業者Benjamin Mannが被告として名指しされている。出版社側は、同社が許可なく保護作品の大量のコピーをトレント、スクレイピング、ダウンロードしたと非難している。AnthropicはTechCrunchに対し、主張に同意せず、争う方針だと述べた。
この訴訟は、すでに大きな法的問題を抱えるAnthropicに、音楽業界からの重要な挑戦を加えるものだ。TechCrunchとThe Decoderの報道によると、原告は、Claudeモデルの開発に数万件の楽曲作品が使用されたと主張しており、主に歌詞の形で、楽譜や関連作品も含まれていたという。
出版社側は、疑惑の行為を極めて深刻な言葉で表現し、知的財産の大規模かつ継続的な窃盗だと位置づけている。これらの記述は訴状中の主張であり、裁判所の認定ではない。
今回の訴訟は、Anthropicが以前、著者や出版社と争ったBartz v. Anthropicに続くものだ。その事件では、裁判所が海賊行為による著作権付き書籍の取得は違法だと判断した後、同社は15億ドルの支払いに同意した一方、学習のために著作権素材を使う別の問題は別扱いだった。TechCrunchは裁判所が支払いを命じたと報じ、The Decoderはこれを和解と表現した。
この区別は新たな事件の中心だ。音楽出版社は、無許可の取得それ自体が、後にそのファイルが商用モデルに直接組み込まれたかどうかとは独立して責任を生じさせると主張し、前回の判断を土台にしようとしている。
訴状は、Anthropicがトレントネットワークやいわゆる海賊ライブラリ、特にLibGenとPiLiMiを利用したことに焦点を当てているとされる。The Decoderは、出版社側がAnthropicが少なくとも700万冊の書籍をこれらのソースからトレントで取得したと主張しており、その中には歌詞や音楽資料を含む書籍もあったと報じた。これらの書籍が商用のClaudeモデルに直接使われたかどうかは、証拠開示で大きな争点になる見込みだ。
原告はまた、MusixMatchやLyricFindのようなライセンスサービスから歌詞を収集した行為にも異議を唱えていると報じられており、スクレイピングがプラットフォーム規約と出版社の権利に違反したと主張している。訴状で挙げられている他のデータセットにはBooks3、The Pile、Common Crawlがあり、出版社側はそこに無許可の素材が含まれていたと主張している。
主張はデジタルファイルにとどまらない。The Decoderによると、訴状はAnthropicが中古の歌集や楽譜コレクションをスキャンして破棄したと非難している。また、LibGenとPiLiMiの素材で学習した非商用モデルが、その後、商用Claudeモデルの開発またはフィードバック過程で使用された合成データを生成したとも主張している。
Anthropicはこれまで、LibGenやPiLiMiの書籍を商用製品の学習に直接使用したことを否定してきた。The Decoderによれば、出版社側の主張は、その否定はAnthropicの「学習」の定義に依存する可能性があり、派生データや合成データの使用には対応していないかもしれない、というものだ。
現時点で最も確かな事実は、出版社が訴訟を提起し、Anthropicとその幹部が被告として名指しされ、Anthropicが主張を退けていることだ。トレント、データセット、モデル開発の経路、経営陣の指示に関する詳細な主張は、TechCrunchとThe Decoderが報じた原告の訴状に由来する。これらは依然として争われている。
The Decoderは、訴状が侵害された各作品につき最大15万ドル、また通知や識別メタデータなど著作権管理情報の削除に関する各違反につき最大2万5000ドルを求めていると報じた。最終的な負担額は、どの請求が生き残るか、対象と認定される作品数、そして裁判所が出版社の責任論を受け入れるかどうかに左右される。
この事件はまた、AI企業にとって難しい証拠上の問題を提起する。学習前データセット、合成データのパイプライン、評価システム、強化学習プロセスを経る際、それはどの時点で保護コンテンツの使用とみなされるのか。企業は元ファイルと後のモデルを区別できる一方、権利者は各段階が当初の無許可取得または複製を反映していると主張する可能性がある。
The Decoderが引用した2025年11月のミュンヘン地方裁判所の判決は、国際的な比較材料を加える。この裁判所は、保護された歌詞はモデルパラメータ内で複製とみなされ得ること、生成された歌詞出力は違法な公衆開示に当たり得ることを認めた。この判断は米国の事件ではないが、裁判所がモデル内部と生成コンテンツの両方を検討していることを示している。
モデル開発者にとって、この訴訟は、データの出所を単なるデータセット名以上の詳細で文書化する圧力を高める。チームは、ファイルの出所、どのライセンスが適用されたか、利用規約がどう解釈されたか、制限付き素材が合成データや強化学習のパイプラインに入ったかどうかを示す記録が必要になるかもしれない。
企業の購入者にとっては、この争いがベンダー審査にさらなる層を加える。モデルの著作権方針に関する質問は、歌詞や書籍を再現するかどうかだけでなく、提供者が学習データの合法的取得と管理を証明できるかどうかにも及ぶ。契約上の補償、監査権、モデルのバージョン管理、高リスク出力の制限は、調達でより重要になる可能性がある。
この事件はAI学習の経済性にも影響を及ぼし得る。裁判所が海賊版の取得を別個の責任原因として扱うなら、企業は学習実行にデータが入る前に、ライセンス済みコーパス、フィルタリング、出所管理システム、法的レビューにより多くの費用をかけなければならなくなるかもしれない。これはすべての著作権問題を解決するわけではないが、基盤モデル提供者間でのデータ調達をより目に見える競争要因にする可能性がある。
最初の手がかりは、Anthropicの正式な反論と、訴状に異議を唱える各種申し立てから得られるだろう。証拠開示では、問題のファイルがClaudeの商用学習パイプラインに入ったのか、合成データを通じて間接的に使われたのか、あるいは別の開発目的で保持されていたのかが明らかになるはずだ。
開発者は、経営陣の責任、トレントを独立した侵害として扱うかどうか、出版社が特定の作品を特定のモデルや学習段階に結び付けられるかどうかについての裁判所判断に注目すべきだ。AI企業と音楽権利者とのライセンス契約も、この訴訟が市場を交渉によるアクセスへ押し動かしているかどうかを示すだろう。
この事件とBartz v. Anthropicの関係は特に重要だ。前回の判断が取得方法に関する責任の基盤になるなら、データセットに争点素材を含む他の権利者も、同様の請求をモデル開発者に対して追求する可能性がある。
この訴訟は、AIモデルが何を出力するかというおなじみの問いから、その学習データを組み立てる目に見えにくいシステムへと焦点を移している。Anthropicにとって、法的リスクはClaudeのプロンプト応答だけでなく、調達、スクレイピング管理、内部データの来歴にも左右される可能性がある。
市場全体にとっての実務的な教訓はより限定的だが重要だ。「直接学習していない」というだけでは、裁判所が中間モデル、合成データ、フィードバックパイプラインを調べるなら十分なコンプライアンス回答にならないかもしれない。データの出所を証明でき、権利関係が不明確だったときにどう対応したかを示せるAI企業は、著作権訴訟がモデル開発のインフラへと深く入り込む中で、より有利な立場に立てるだろう。