Anthropic訴訟、15億ドル和解までの経緯と4つのポイント:安野貴博氏の解説
安野貴博の自由研究AI企業Anthropicが著作権侵害で訴えられた集団訴訟に、一つの決着がついた。この動画で安野貴博氏は、訴訟の原因、裁判所の判断、和解の内容、今後の影響の4点を順に整理している。安野氏はこの結果を今後の類似事例で参照される重要な事例だと見ており、特に「データの入手」と「データの利用」が分けて判断された点と、和解金から算出される1作品あたりの金額に注目している。なお、動画は2025年10月時点で収録されたものである。
訴訟の発端:海賊版サイトからの約700万点のダウンロード
安野氏はAnthropicを、OpenAIやGoogleに次ぐ、世界で3本の指に入るAI企業だと紹介する。そのAnthropicに対し、2024年8月、サスペンス小説作家のアンドレア・バーツ氏、チャールズ・グレイバー氏、カーク・ウォレス・ジョンソン氏の3人が代表原告となって集団訴訟を起こした。
原告の主張は、AnthropicがAIモデル「Claude」を訓練するため、海賊版の電子書籍サイトから約700万点の著作物を無断でダウンロードして使用したというものだ。内訳は、Library Genesis(LibGen)から約500万冊、Pirate Library Mirrorから約200万冊とされている。原告は、海賊版サイトから入手したデータで訓練したことが著作権者の複製権を侵害すると訴えた。
LibGenの成り立ち
安野氏が調べる中で興味を持ったのが、500万冊もの書籍を抱えるLibGenの成り立ちだという。安野氏の説明によれば、ルーツはソビエト連邦時代の「サミズダート」と呼ばれるアンダーグラウンドな出版物にある。当時は西側の情報が取り締まりの対象で、検閲を回避するために密かに印刷された出版物が出回っていた。この文化がやがてウェブに移り、2008年頃にサミズダートの著作物を閲覧できるサイトとしてLibGenが生まれた。それが、書籍約750万点、論文約8,100万本を抱える海賊版ライブラリーに育っていったという。
Pirate Library MirrorはLibGenのミラーサイトとして作られたものだとされる。これらのサイトには、本来は有料で配信されている著作物も無許諾で集められている。こうした海賊版サイトから取得したデータでClaudeを学習させた点が、訴えの焦点である。
裁判所の判断:学習はフェアユース、海賊版の入手は範囲外
裁判所の判断には、原告の訴えが認められなかった部分と認められた部分の両方があった。
認められなかったのは、無許諾の文章をAIモデルが学習すること自体についてである。これはフェアユースの範疇だと判断された。安野氏は、フェアユースを、アメリカの法律で、引用や教育目的などの条件に合致すれば他人の著作物を使っても著作権侵害にならないとする考え方だと説明する。無許諾の文書を学習させたこと、社内で購入した書籍を裁断してスキャンし、デジタルライブラリーを構築したことは、いずれもフェアユースの範囲内とされ、訴えは退けられた。
一方で、学習データを海賊版サイトから入手した行為はフェアユースの範囲外だとされた。当初は約700万冊が対象とされていたが、最終的に約50万点について、フェアユースとは言えないという判断が出た。
700万点が50万点に絞られた理由について、安野氏は調べた結果として3つの条件を挙げている。ISBNやASINといった書籍の識別番号が付いているか、出版後5年程度のうちに米国著作権局に登録されているか、Anthropicがダウンロードする前に米国著作権局に登録されているか、の3点である。
安野氏がこの判断で大きなポイントだと見ているのは、データを「どう入手したか」と「どう利用したか」が分けて判断された点だ。AIの学習そのものはフェアユースとして合法だが、元のデータが海賊版であれば違法になる。アメリカの裁判所はそういう見方をした、と安野氏はまとめている。
理論上の最大賠償額は約10兆円
この中間的な判断を受け、Anthropicは事業を続けられるかどうかに関わるほど厳しい状況に置かれていた、と安野氏は言う。
アメリカの著作権法では、意図的な侵害の場合、1作品あたり最大15万ドルの賠償金が科されうる。50万点すべてにこの額が認められたとすると、理論上の最大賠償額は750億ドル、安野氏の換算で約10兆円に達する。大量の資金を調達しているAI企業であっても、10兆円の賠償となれば事業は継続できず潰れてしまう規模だった、というのが安野氏の見立てである。
和解の内容:総額15億ドル、1作品あたり約3,000ドル
その後、Anthropicと原告は2025年9月5日、総額15億ドル(安野氏の換算で約2,000億円)の和解金を支払うことで合意した。和解には、不正に入手したデータセットを完全に破棄することも含まれている。9月25日には和解の予備承認も出ており、この方向で進みそうだという。
安野氏の計算では、15億ドルを約50万点で割ると1作品あたり約3,000ドル、日本円で約45万円になる。これは法律上の最大額よりかなり少なく、Anthropicは理論上の最大賠償額の約2%を払うことでリスクを回避したと言える、と安野氏は評価する。
さらに安野氏は、この金額が今後の重要なベンチマークになりうると考えている。似たような事例が起きたときに、1作品あたり約45万円という水準がアメリカの一つの事例で示されたことは参照点になる。その意味は大きい、というのが安野氏の見方だ。
今後の影響:3つの判断と日本のガイドライン
安野氏は今回の訴訟から読み取れる点を3つに整理している。1つ目は、元の入力がそのまま出力されるようなものでなければ、無許諾のデータで学習すること自体は裁判所も問題ないと判断したこと。2つ目は、書籍を購入していれば、裁断・スキャンして学習させることも認められたこと。3つ目は、海賊版データでの学習は明らかにフェアユースの範囲外であり、賠償が必要だという結果が出たことである。
日本国内ではどうか。安野氏は、今回の判断は日本国内のガイドラインとも整合していると述べる。根拠として挙げるのが、2024年3月に文化庁が出した「AIと著作権に関する考え方について」という資料だ。法律ではないため法的拘束力はないが、AIと著作権についての政府の重要な見解を示した資料だと安野氏は位置づける。
安野氏の紹介によれば、この資料は次のような考え方を示している。AI開発事業者にとって、すべてのデータについて海賊版かどうかを判断するのは難しい。しかし、海賊版サイトだと知りながらデータを収集する行為は慎むべきである。海賊版サイトからデータを収集し、著作権侵害を回避する措置を講じなかった場合は注意義務を怠ったことになり、侵害の責任を問われる可能性が高い。つまり日本でもアメリカと大きくは変わらず、海賊版だと知った上で学習させるような悪意がある場合は罰せられる可能性が高い、と安野氏は説明する。
これからのあり方:noteの対価還元プログラム
では今後どういう形が望ましいのか。安野氏はさまざまな議論がある難しい問題だとしたうえで、一つのあり方として、著者とAI開発企業が双方の合意のもとで学習利用のライセンス契約を結ぶ枠組みを挙げる。実際にAI開発企業と多くのメディアの間で、データ利用のライセンス契約が結ばれ始めているという。
日本の取り組みとして安野氏が紹介するのが、noteの「対価還元プログラム」である。2025年8月1日に始まったプログラムで、note上で公開している記事をAIの学習に使ってよいか、学習への対価を受け取るかを、ユーザーが選べる。学習を許可された記事はnoteが取りまとめてAI開発企業に提供し、その対価を記事を書いたクリエイターが分配して受け取る仕組みだ。安野氏によれば、トライアルには合計1,200人が参加し、還元総額は約500万円、1人のクリエイターに支払われた最高額は約40万円だったという。
結論
安野氏は最後に、Anthropicが海賊版サイトから入手したデータで学習させたことで訴えられ、学習自体はフェアユースとされた一方で海賊版からの入手はアウトと判断され、総額15億ドル、1点あたり約3,000ドル(約45万円)で和解したという流れを振り返った。この金額は今後の参考になる数値かもしれない、と安野氏は言う。そのうえで、クリエイターとAI企業の間に良い関係が結べることが望ましいとし、noteのような対価還元の取り組みが広がっていくかどうかを注視していく必要があると述べて締めくくっている。
どうもこんにちは。安野貴博です。今日はアンソロピック社の訴訟についてお話しします。アンソロピック社というのはですね、いわゆる世界でトップ3、3本の指に入るAIの会社でございまして、OpenAIやGoogleに次ぐですね、強いAIを作っているような会社なんですけれども、実はですね、このアンソロピック社が訴訟を受けております。著作権侵害をしているんじゃないかという訴訟を受けていまして、その結果がいよいよ出たということで、これが非常に注目すべきポイントになるなと思っておりますので、今日はそちらの解説をしたいと思います。
今回の動画ではまず第1になんで訴訟が起きたんですかという話で、2つ目に裁判所はどう判断したんですかという話、3つ目にその和解、4つ目に今後の影響、この4つの点についてお話ししたいなと思います。
まず第1のポイントはなんで訴訟が起きたのかということです。まず背景を説明すると、2024年の8月、これ撮ってるのが2025年の10月なので1年ほど前に、サスペンス小説作家のアンドレア・バーツさん、チャールズ・グレイバーさん、カーク・ウォーレス・ジョンソンさんの3人の小説家、作家が代表の原告となって、アンソロピックを相手に集団訴訟をやりました。
訴えの内容としては、アンソロピックのAIモデル、Claudeを訓練するために海賊版の電子書籍サイトから約700万の著作物を無断でダウンロードして使用したと、そういう訴えを出しております。700万ってすごい数ですけど、内訳はですね、ライブラリー・ジェネシスって呼ばれるところから500万冊、パイレーツ・ライブラリー・ミラーから200万とされています。この原告はですね、この700万の海賊版の電子書籍サイトから訓練をさせたのは著作権者の複製権を侵害するものだとして訴えを起こしました。
このLibGen、そもそもこの500万あるのって何なのっていうのがまず私、調べていて興味が湧いたポイントなんですけど、実はこれ歴史がなかなか古くてですね、ソビエト連邦時代にサミズダートっていうアンダーグラウンドな出版物があったらしいです。このサミズダートっていうのはですね、検閲を回避するために密かに印刷されたものなんですけれども、その西側の情報って当時は取り締まりを受けているわけですよね。すごい反体制的な内容であると言われていたんですけど、その検閲を回避するためにアンダーグラウンドで出回っていたサミズダートっていう文化がいつしかウェブになって、2008年頃にそういったサミズダートの著作物を閲覧できるようにしたLibGenというサイトがあって、そこに書籍が750万、論文が8100万本など本当に多数の著作物が貯蔵されている海賊版ライブラリーに育っていったということです。まずね、これがすげえ話だなと思います。
200万冊分のパイレーツ・ライブラリー・ミラーっていうのはLibGenのミラーサイトとして作られたものになっているらしいです。これらのサイト上の著作物っていうのは本来有料で配信されているものも無許諾で収集がされている状況です。こうした海賊版サイトからダウンロードしたデータを使ってこのAI、Claudeを学習させたというところにこの訴えの焦点が当たってます。
じゃあ2つ目のポイントとして、この訴えを起こした上で裁判所がどんな判断をしたのかということを紹介します。結論ですね、訴えが認められなかった部分と認められた部分、両方あります。まず認められなかった部分に関してですが、この無許諾の文章をAIモデルが学習するということ自体は、これはフェアユースの範疇であるという判決の結果が出ました。
フェアユースっていう単語があんまり聞き馴染みがない方もいらっしゃると思うんですけれども、アメリカの法律の中でどういう使い方であれば著作権違反にならずに他の人の著作を使えるのか。例えば引用であるとか、あるいは教育目的、報道目的とかですね、色々条件があったりするんですけれども、その条件に合致してればフェアユースとして著作権侵害ではないと言われます。
今回のこの無許諾の文書を学習させたこと、またあるいは社内で購入した書籍をスキャンして裁断した後にデジタルライブラリーを構築していたこと、これらはフェアユースの範囲内とされて訴えとしては退けられました。ただ一方で、学習データを海賊版のサイトから入手した行為、これはフェアユースの範囲外だろうという結論が下りました。
これ当初700万冊が訴えの対象とされてたんですが、色々な理由、条件で対象は絞られていて、700万冊の中から最終的に50万点、50万冊については、これはフェアユースとは言えない、違反であるという判決が出ました。これなんで700万冊が50万冊になったのかなと思って調べてみたんですが、色々条件がついて、ISBNとかASINっていう書籍に振られる番号がちゃんとついてるよねというものかどうか。出版後5年ぐらいに米国著作権局に登録がされているかどうか。3つ目がアンソロピック社によるダウンロード前に米国著作権局に登録されているかどうか。この3つで判断されて700万点から絞られていったところ、50万点になったということらしいです。
ここで1つ重要なのは、その入手をどうするのかっていう話と利用をどうするのかっていう話が分かれて判断されたっていうのが結構大きなポイントなのかなという風に見てます。ある意味そのAIの学習自体はフェアユースで合法なんですけれども、その元となるデータが海賊版ということであればこれは違法であるという、そういった見方をアメリカの裁判所はしたということでございます。
次にですね、第3のポイントとして、この判決が下った後の和解の内容です。この和解なんですけれども、この中間の判決というものを受けてアンソロピックって実はね、相当やばいことになってました。事業継続が、そのビジネスを続けられるかどうかっていうところに関わるくらいですね、この50万点の著作権侵害って非常に大きな話だったんですよね。
アメリカの著作権法では意図的な侵害の場合、1作品あたり最大ですね、15万ドルの賠償金が課せられうるという法律になってます。これ1作品あたり最大15万ドルなので、50万点についてこの額が認められるとすると、理論上の賠償金の最大額っていうのは750億ドルになる。750億ドルって10兆円くらいなわけですよね。これはね、いくら大量にお金を集めて調達しているイケイケどんどんのAIの会社であるアンソロピックであっても、さすがに10兆円賠償金が出ると事業継続できない、潰れますということだったんですが、これ色々あった上でアンソロピック社と原告はですね、2025年の9月5日に総額15億ドル、2000億円くらいですかね、15億ドルで和解金を支払うことで合意がなされました。
この和解には、もちろん不正に入手したデータセットの完全な破棄、捨てるということも含まれています。9月25日にはこの和解が予備承認もされているということで、こんな感じで進みそうな気配になっています。
この約15億ドルだとすると、50万点あるので1作品あたり3000ドルくらいの規模感になるんですよね。3000ドルなので45万円くらいなんですけれども、これは著作に基づいたものよりかは少なくなっていると。つまりアンソロピック社は理論上の最大賠償額の約2%くらいを払うということでリスクを回避したと言えると思います。この価格っていうのが結構今後重要なベンチマークというか、今後似たようなことがあった時に参照される1つのポイントになりうると思ってまして、1作品あたり45万円くらいっていうのがこのアメリカの1つの判決で示されたっていうのは、この意味は結構大きいなと私は見ていて思いました。
はい、4つ目にですね、今後の影響どうなんだという話をします。これ今回の訴訟、結構いろんなポイントがありますが、ポイント1つ目としては、こういった無許諾でも、元々の入力がそのまま出るようなそういったものでなければ、この学習をするということ自体は裁判所も問題ないという、そういう判断を下したと。2つ目が、書籍を購入していれば、裁断してスキャンして学習させるというのもこれも認められました。3つ目に、海賊版データで学習するっていうのはこれはもう明らかにフェアユースの範囲外であろうということで、ここについては賠償しなくてはならないという、そういった結果が出たわけです。
これ、日本国内ではじゃあどうなんですかと言われると、結構ですね、この判断は日本国内のガイドラインとも整合はしています。例えば日本国内での海賊版データの学習については、2024年3月に文化庁から出されている「AIと著作権に関する考え方について」という資料、この資料でしっかり解説されてます。法律ではないのでこれ法的な拘束力はないんですけれども、AIと著作権についての政府の重要な見解を示している1つの資料になります。
この資料によると、AIを開発する事業者側にとって全てのデータが海賊版かどうかを判断するのはこれは難しいだろう。海賊版サイトであると知りながらデータ収集する行為はこれは慎むべきであり、海賊版サイトからデータを収集して著作権侵害の回避措置を講じなかった場合は、これは注意義務を怠ったよねということで、侵害の責任を問われる可能性が非常に高いであろうって言われてます。なのでこれ日本においてもアメリカとあんまり変わらずですね、海賊版データと知った上で学習するみたいな悪意がある場合には、これは罰せられる可能性が高いという風に書いてあります。
今後ね、じゃあどういうあり方があるべきなんだろうかってのは、これ結構いろんな議論があって、すごく難しい話なんですけれども、AI開発企業とあるいは多くのメディアがデータ利用のライセンス契約っていうのを結び始めておりまして、この著者との間で双方合意のもと学習利用のライセンス契約ができるような枠組っていうのが1つのあり方として考えられます。
そうした取り組みって日本にあるんですかと言うと実はあってですね、noteっていうサービスがあるんですが、noteの対価還元プログラムというのがあります。これですね、2025年の8月1日から始まったプログラムで、公開されている記事、noteというプラットフォーム上で公開されている記事をAIが学習してオッケーか、そして学習への対価を受け取りますかっていうことをユーザーが選べるような、そういうプログラムになっています。学習許可された記事っていうのはnoteが取りまとめた上でAI開発企業に提供していて、その対価をそのnoteを書いたクリエイターたちが分配して受け取ることができるというものになってまして、トライアルもこれやられたらしいんですけど、合計1200名が参加して総還元額が500万円くらい、1人のクリエイターに支払われた最高金額は40万円だったということで、こういった取り組みが広がっていくかどうかというのは注視して見ていかなければならないと思っております。
はい、ということで今回のポイントをまとめると、まずアンソロピックが訴えられました。訴えられた理由は海賊版サイトからダウンロードしたデータを使って学習させていたからです。この判断としては、無許諾で学習をさせること自体はフェアユースの判定が出て合法でしたが、海賊版サイトから持ってきたものはアウトだという判断が下されました。結果として総額15億ドルの和解金で合意をして、それって1点あたり大体3000ドル、45万円くらいの相場感です。これは1つ今後の参考になる数値になるかもしれません。
4つ目として、じゃあ将来的にどうなるといいんだろうねっていうところで、クリエイターと学習をするAIの会社の中でいい関係が結べるといいよねと。対価還元プログラムみたいなものをnote社などもやってたりするので、こういったものが広がっていくかどうか、これは注目して見ていかなければならないよね、ということでございます。ということで、今回の動画面白いなと思った方いたら是非チャンネル登録と高評価をよろしくお願いいたします。では、では。
[音楽]
記事公開
