Anthropic訴訟、15億ドル和解までの経緯と4つのポイント:安野貴博氏の解説

YouTubeで開く ↗
概要

AI企業Anthropicが著作権侵害で訴えられた集団訴訟に、一つの決着がついた。この動画で安野貴博氏は、訴訟の原因、裁判所の判断、和解の内容、今後の影響の4点を順に整理している。安野氏はこの結果を今後の類似事例で参照される重要な事例だと見ており、特に「データの入手」と「データの利用」が分けて判断された点と、和解金から算出される1作品あたりの金額に注目している。なお、動画は2025年10月時点で収録されたものである。

7分で読めます

訴訟の発端:海賊版サイトからの約700万点のダウンロード

安野氏はAnthropicを、OpenAIやGoogleに次ぐ、世界で3本の指に入るAI企業だと紹介する。そのAnthropicに対し、2024年8月、サスペンス小説作家のアンドレア・バーツ氏、チャールズ・グレイバー氏、カーク・ウォレス・ジョンソン氏の3人が代表原告となって集団訴訟を起こした。

原告の主張は、AnthropicがAIモデル「Claude」を訓練するため、海賊版の電子書籍サイトから約700万点の著作物を無断でダウンロードして使用したというものだ。内訳は、Library Genesis(LibGen)から約500万冊、Pirate Library Mirrorから約200万冊とされている。原告は、海賊版サイトから入手したデータで訓練したことが著作権者の複製権を侵害すると訴えた。

LibGenの成り立ち

安野氏が調べる中で興味を持ったのが、500万冊もの書籍を抱えるLibGenの成り立ちだという。安野氏の説明によれば、ルーツはソビエト連邦時代の「サミズダート」と呼ばれるアンダーグラウンドな出版物にある。当時は西側の情報が取り締まりの対象で、検閲を回避するために密かに印刷された出版物が出回っていた。この文化がやがてウェブに移り、2008年頃にサミズダートの著作物を閲覧できるサイトとしてLibGenが生まれた。それが、書籍約750万点、論文約8,100万本を抱える海賊版ライブラリーに育っていったという。

Pirate Library MirrorはLibGenのミラーサイトとして作られたものだとされる。これらのサイトには、本来は有料で配信されている著作物も無許諾で集められている。こうした海賊版サイトから取得したデータでClaudeを学習させた点が、訴えの焦点である。

裁判所の判断:学習はフェアユース、海賊版の入手は範囲外

裁判所の判断には、原告の訴えが認められなかった部分と認められた部分の両方があった。

認められなかったのは、無許諾の文章をAIモデルが学習すること自体についてである。これはフェアユースの範疇だと判断された。安野氏は、フェアユースを、アメリカの法律で、引用や教育目的などの条件に合致すれば他人の著作物を使っても著作権侵害にならないとする考え方だと説明する。無許諾の文書を学習させたこと、社内で購入した書籍を裁断してスキャンし、デジタルライブラリーを構築したことは、いずれもフェアユースの範囲内とされ、訴えは退けられた。

一方で、学習データを海賊版サイトから入手した行為はフェアユースの範囲外だとされた。当初は約700万冊が対象とされていたが、最終的に約50万点について、フェアユースとは言えないという判断が出た。

700万点が50万点に絞られた理由について、安野氏は調べた結果として3つの条件を挙げている。ISBNやASINといった書籍の識別番号が付いているか、出版後5年程度のうちに米国著作権局に登録されているか、Anthropicがダウンロードする前に米国著作権局に登録されているか、の3点である。

安野氏がこの判断で大きなポイントだと見ているのは、データを「どう入手したか」と「どう利用したか」が分けて判断された点だ。AIの学習そのものはフェアユースとして合法だが、元のデータが海賊版であれば違法になる。アメリカの裁判所はそういう見方をした、と安野氏はまとめている。

理論上の最大賠償額は約10兆円

この中間的な判断を受け、Anthropicは事業を続けられるかどうかに関わるほど厳しい状況に置かれていた、と安野氏は言う。

アメリカの著作権法では、意図的な侵害の場合、1作品あたり最大15万ドルの賠償金が科されうる。50万点すべてにこの額が認められたとすると、理論上の最大賠償額は750億ドル、安野氏の換算で約10兆円に達する。大量の資金を調達しているAI企業であっても、10兆円の賠償となれば事業は継続できず潰れてしまう規模だった、というのが安野氏の見立てである。

和解の内容:総額15億ドル、1作品あたり約3,000ドル

その後、Anthropicと原告は2025年9月5日、総額15億ドル(安野氏の換算で約2,000億円)の和解金を支払うことで合意した。和解には、不正に入手したデータセットを完全に破棄することも含まれている。9月25日には和解の予備承認も出ており、この方向で進みそうだという。

安野氏の計算では、15億ドルを約50万点で割ると1作品あたり約3,000ドル、日本円で約45万円になる。これは法律上の最大額よりかなり少なく、Anthropicは理論上の最大賠償額の約2%を払うことでリスクを回避したと言える、と安野氏は評価する。

さらに安野氏は、この金額が今後の重要なベンチマークになりうると考えている。似たような事例が起きたときに、1作品あたり約45万円という水準がアメリカの一つの事例で示されたことは参照点になる。その意味は大きい、というのが安野氏の見方だ。

今後の影響:3つの判断と日本のガイドライン

安野氏は今回の訴訟から読み取れる点を3つに整理している。1つ目は、元の入力がそのまま出力されるようなものでなければ、無許諾のデータで学習すること自体は裁判所も問題ないと判断したこと。2つ目は、書籍を購入していれば、裁断・スキャンして学習させることも認められたこと。3つ目は、海賊版データでの学習は明らかにフェアユースの範囲外であり、賠償が必要だという結果が出たことである。

日本国内ではどうか。安野氏は、今回の判断は日本国内のガイドラインとも整合していると述べる。根拠として挙げるのが、2024年3月に文化庁が出した「AIと著作権に関する考え方について」という資料だ。法律ではないため法的拘束力はないが、AIと著作権についての政府の重要な見解を示した資料だと安野氏は位置づける。

安野氏の紹介によれば、この資料は次のような考え方を示している。AI開発事業者にとって、すべてのデータについて海賊版かどうかを判断するのは難しい。しかし、海賊版サイトだと知りながらデータを収集する行為は慎むべきである。海賊版サイトからデータを収集し、著作権侵害を回避する措置を講じなかった場合は注意義務を怠ったことになり、侵害の責任を問われる可能性が高い。つまり日本でもアメリカと大きくは変わらず、海賊版だと知った上で学習させるような悪意がある場合は罰せられる可能性が高い、と安野氏は説明する。

これからのあり方:noteの対価還元プログラム

では今後どういう形が望ましいのか。安野氏はさまざまな議論がある難しい問題だとしたうえで、一つのあり方として、著者とAI開発企業が双方の合意のもとで学習利用のライセンス契約を結ぶ枠組みを挙げる。実際にAI開発企業と多くのメディアの間で、データ利用のライセンス契約が結ばれ始めているという。

日本の取り組みとして安野氏が紹介するのが、noteの「対価還元プログラム」である。2025年8月1日に始まったプログラムで、note上で公開している記事をAIの学習に使ってよいか、学習への対価を受け取るかを、ユーザーが選べる。学習を許可された記事はnoteが取りまとめてAI開発企業に提供し、その対価を記事を書いたクリエイターが分配して受け取る仕組みだ。安野氏によれば、トライアルには合計1,200人が参加し、還元総額は約500万円、1人のクリエイターに支払われた最高額は約40万円だったという。

結論

安野氏は最後に、Anthropicが海賊版サイトから入手したデータで学習させたことで訴えられ、学習自体はフェアユースとされた一方で海賊版からの入手はアウトと判断され、総額15億ドル、1点あたり約3,000ドル(約45万円)で和解したという流れを振り返った。この金額は今後の参考になる数値かもしれない、と安野氏は言う。そのうえで、クリエイターとAI企業の間に良い関係が結べることが望ましいとし、noteのような対価還元の取り組みが広がっていくかどうかを注視していく必要があると述べて締めくくっている。