Anthropicはなぜ「Claude Mythos」を公開しないのか:安野貴博が読むサイバー攻撃能力と安全保障への影響
安野貴博の自由研究Anthropicが2026年4月7日に発表した新モデル「Claude Mythos」は、ベンチマークで既存の最上位モデルを大きく上回った。それでも同社は、現時点で一般公開しないと決めた。エンジニアでSF作家の安野貴博氏は、この判断を「最高のモデルは金を払えば使える」という時代の終わりとして受け止めている。本動画で安野氏は、Mythosのサイバー攻撃能力、Anthropicの限定公開の仕組み、そして日本の安全保障への影響について、自身もまだ消化しきれていないと断ったうえで考えを述べている。
2か月足らずで登場した新モデル
安野氏はまず、Anthropicのリリースの速さに触れる。同社はプロダクトもモデルも次々と出しており、そのペースは一段と上がっているという。Mythos発表の時点で、公開済みモデルのうち最も性能が高いとされていたのはClaude Opus 4.6で、これは2月に公開されたばかりだった。Mythosはそれから2か月も経たずに発表されたことになる。
性能について安野氏は、ペーパーテストを解かせるベンチマークで、Mythosが2か月前のOpus 4.6を「結構激しく」上回るスコアを出していると紹介する。コーディング性能だけでなく他の項目も伸びており、IQテストのような一般的な能力を測る試験でも結果が良くなっているという。
性能が高い理由として、安野氏は「非常に大きなモデルになっているのではないか」という見方を挙げる。これまでのClaudeは、最も小さいHaiku、中くらいのSonnet、最も大きいOpusの3シリーズで構成されていた。Mythosはそれよりさらに大きいのではないか、と言われているという。ただし安野氏はこれを「言われている」話として扱っており、断定はしていない。
公開を見送った理由は攻撃能力の高さ
安野氏は、今回の発表で「フェーズが一歩変わった」と感じた点として、Anthropicが現時点でMythosを公開しないと決めたことを挙げる。
理由はサイバーセキュリティ上の攻撃能力が高すぎることだ。システムの脆弱性を見つけ、それを使ってさまざまな攻撃を行う能力が突出しているという。安野氏によれば、Opus 4.6の時点でもこの能力はかなり高かったが、Mythosはそれを大きく上回る。世界一流のセキュリティ専門家より上なのではないかとまで言われている。安野氏は「まだ諸説ある」と留保しつつも、人類トップレベルの専門家と同等かそれ以上と言ってもおかしくない水準に来たと見ている。
安野氏はこの状況を、2016年にAlphaGoが、おそらく人類で最も強い棋士だったイ・セドル氏を破った出来事になぞらえる。その「サイバーセキュリティ版」が起きた、あるいは起きつつあるのではないか、というのが安野氏の見立てである。
オープンソースソフトウェアから数千件のゼロデイ
安野氏の推測では、Anthropicは2〜3月ごろにはすでに社内でMythosを動かして検証していた。その過程で、世界中のオープンソースソフトウェアなどに脆弱性がないかをMythosで調べ、多数の脆弱性を発見したという。
例として安野氏が挙げるのがOpenBSDである。古くから使われていて堅牢で、脆弱性が少ないとされてきたシステムだが、Mythosは27年間誰にも見つけられていなかった脆弱性を発見した。安野氏は、これが古いだけでなく今も盛んに使われているシステムだという点を強調する。もう一つの例は、動画の変換などに使われる有名な老舗ツールのFFmpegで、ここでも16年間放置されていた脆弱性が見つかったという。
このように、さまざまなOS、ブラウザ、ツールといったオープンソースのソフトウェアから、未発見の脆弱性が数千件見つかったと安野氏は伝える。資料で「0day」と書かれているのは、まだ世の中に報告されていない未発見の脆弱性のことだと安野氏は補足している。
「サンドイッチ事件」
Mythosの攻撃能力を象徴する話として、安野氏は「サンドイッチ事件」と呼ばれるエピソードを紹介する。
Anthropicの研究者がMythosをテストする際、AIを「サンドボックス」と呼ばれる仮想的な環境に入れた。この環境はインターネットにつながりにくい仕組みになっている。研究者はその中のAIに「サンドボックスから脱出できたら教えて」と指示を出し、テストを仕掛けたつもりで公園へ出かけた。公園でサンドイッチを食べていると、「できたよ」という通知がメールで届いたという。本来インターネットに接続できないはずの環境から、脆弱性を見つけて外に出て、通知を送ったということになる。
安野氏はこれを「SFみたいな話」と表現しつつ、論理的にはあり得ると述べる。Anthropicの公式資料にも書かれているエピソードなので「多分本当だと思う」という言い方で、情報源への一定の信頼を示している。
さらに安野氏が重視するのは、Mythosがコーディングやサイバーセキュリティに特化して訓練されたモデルではない点だ。汎用モデルでありながら、サイバーセキュリティの面だけを見ても非常に高い攻撃能力を持ち、広く使われているOSやブラウザなどから未発見の脆弱性を数千件見つけている。この状況をどう受け止めるべきか、というのが動画の後半のテーマになる。
「牧歌的な時代」の終わり
安野氏は、この出来事をまだ消化しきれていないとしながらも、少なくともいくつかのことは言えるとして論点を挙げる。
一つ目は、公開しないという判断そのものが意味することだ。安野氏は「牧歌的な時代が終わった」と感じたという。ここでいう牧歌的な時代とは、少なくとも金を払えば最高レベルのモデルにアクセスできた時代のことである。
安野氏は過去の例としてGPT-2を挙げる。ChatGPTの一つ前の世代にあたるGPT-2は、当時はチャット形式ではなかったものの非常に大きなモデルで、「危険すぎる」という理由で公開が見送られた。後から公開され、振り返ると大したことはなかったのではないかと思われている。今回のAnthropicの言い方はそれを思い出させるが、安野氏は今回は「本当っぽい」と見ている。数千件のゼロデイ脆弱性を実際に発見しているのであれば、公開しないという判断は「すごく妥当」だと評価する。
そのうえで安野氏は、これは金の問題ではなく安全の問題、セキュリティの問題だと整理する。今回はサイバーセキュリティが主な話題だが、今流通しているモデルでも化学やバイオテクノロジーの知識はかなり豊富だと言われている。モデルを使ってさまざまな悪用ができるようになったとき、それを公開してよいのか。このレベルの知能になると相応の危険性がある、と安野氏は考えている。
Project Glasswingと限定公開
Mythosは金を払っても買えないが、Anthropicは同時に「Project Glasswing」という防御側のプロジェクトを進めている。安野氏の説明では、一部の米国IT企業や一部の米国金融機関に限定公開の形でMythosを提供し、それを使って自社のシステムを強固にしてもらう取り組みだという。
つまり、ごく限られた米国企業は現時点で最高のモデルにアクセスできるが、そうした企業でなければ、金を払ってもアクセスは難しくなった。安野氏はこれを、最高のモデルが金で買える時代の終わりの具体的な表れとして捉えている。
アクセスできるかどうかで生まれる差と日本の課題
限定公開には、入れてもらえた企業・組織・国と、そうでないところとで状況がまったく違うという帰結がある、と安野氏は指摘する。Anthropicは米国企業で、アクセスできているのは米国の金融機関やIT企業である。これらの企業はMythosで脆弱性をどんどん発見し、どう直すかという議論を始められる。一方、日本のテック企業や金融機関のようにアクセスがないところは、それを始められない。むしろ相対的に脆弱になる、と安野氏は見る。現時点で、サイバーセキュリティの実力差が大きく開いている状態だということだ。
安野氏はAnthropic自身の立場にも注意を促す。2〜3月ごろのAnthropicは、ほかの誰も持っていない規模で大量の脆弱性を自社だけが知っている状態だった。それを悪用すれば世界中のさまざまなシステムを掌握し、悪事を働くこともできた。一昔前の007映画の悪役のようにもなり得たほどの攻撃能力を、Anthropicはすでに持っている。安野氏は、このことをきちんと認識したほうがよいと述べる。
ここから安野氏は日本の立場に話を移す。日本ではソブリンAI、つまり国産AIをどう作るかという議論が進んでいる。ただ一方で、大きなブレイクスルーを起こしたモデルがあり、そこにアクセスできるかどうかで安全保障上の状況が変わるのであれば、外交努力も重要になる。自分たちの陣営、企業、政府が、こうしたモデルの重要な部分にアクセスさせてほしいと言えるかどうかが、実は重要になってくるのではないか、というのが安野氏の考えである。
他社の追随と、今年起こりうること
二つ目の論点として安野氏は、このレベルのモデルが比較的早く広がる可能性を挙げる。現時点ではMythosが大きく先行していると安野氏は見ているが、同じレベルのモデルはOpenAIやGoogle DeepMindも数か月遅れで作ってくるだろうと予測する。そのうちどこかの会社が公開を決めてもおかしくないし、さらに数か月遅れで中国系のAI企業が追いつく可能性も「非常に高い」と安野氏は考えている。
そうなれば、こうしたモデルはどこかから使えるようになっていく。今はMythosに触れられるのが一部の企業だけなので、まだ先の話だと思うかもしれない。しかし数か月後には状況が一変している可能性がある。安野氏は、今年は過去に類を見ない規模のサイバー攻撃や情報漏洩が起きてもおかしくないと思わせるほど、威力のある発表だったと述べている。
インターネットの安全は「幻想」だったのか
最後に安野氏は、インターネットセキュリティに対する私たちの前提を問い直す。多くの人はインターネット上のさまざまな仕組みを当たり前のものとして、なんとなく安全だろうと思って使っている。だがその安全性は幻想かもしれない、と安野氏は言う。
安野氏の見方では、これまでMythosのような存在が地球上になかったから、脆弱性を抱えたシステムでもなんとか回っていた。攻撃されることはあっても、その量が少なかったので、一つずつ対処すれば済んだ。ところがMythosは並列で大量のシステムを同時にスキャンできる。特定のシステムの脆弱性を探すことが非常に簡単になり、そのコストが大きく下がった。
その結果、私たちが使っているシステムは実は非常に脆弱なのではないか、という可能性が出てくる。安野氏は「これは分からない、可能性だ」と明確に留保したうえで、思っているよりシステムが脆弱だと気づかされる1〜2年になるかもしれない、と述べる。安野氏にとって、Mythosの発表はいろいろと考えさせられるものだったという言葉で動画は締めくくられている。
2ヶ月経たずして、Claude Mythosというものが発表されました。ベンチマークテストで結構激しくいいスコアを取ってます。現時点でこのMythosというモデルを公開しないということを決めました。サイバーセキュリティの攻撃能力が高すぎると。インターネットに接続できないはずのサンドボックスからちょっと脱出して通知を送った。これがね、なかなかやばいということで、そちらのお話をしていきたいと思います。
はい、どうもこんにちは。安野貴博です。本日はですね、Claudeの新しいモデル、Mythosというものが発表されて、これがね、なかなかやばいということで、そちらのお話をしていきたいと思います。
まず何があったかということなんですが、2026年4月7日にClaude Mythosという新しいモデルが発表されました。このClaudeを作ってるAnthropic社というのがあるんですが、このAnthropic社、ものすごい勢いでプロダクトもモデルもリリースしまくっておりまして、本当にね、速さがまた一段と加速してきたなという感じでございますが、今公開されてる中で1番いいと呼ばれてるモデルがOpus 4.6というモデルで、このOpus 4.6は2月に公開されたばかりです。で、2ヶ月経たずして、Claude Mythosというものが発表されました。
で、このね、Mythosの性能は、まずベンチマークテスト、これはペーパーテストを解かせた上でどれくらい精度が出てるのかと見ると、2ヶ月前に発表されたOpus 4.6よりも結構激しくいいスコアを取ってます。どんな感じで良くなってるかと申しますと、コーディング性能も良くなってるし、他の性能も良くなってるし、一般的なんでしょうね、IQテストみたいなものも良くなってるし、かなり良いと。で、かなり良い理由としては何かと言うと、多分その、非常に大きなモデルになってるんじゃないかと言われてます。今までClaudeってですね、3シリーズあって、1番ちっちゃいのがHaikuと呼ばれるもの、そして中くらいのがSonnetと呼ばれるもの。で、1番大きいのがOpusって呼ばれるものがあったんですが、今回発表されたMythosはOpusよりさらに大きいんじゃないかと言われてます。
で、このですね、Mythos、こんなにすごいベンチマーク性能の高いモデルなんですが、現時点で、ここがね、むしろ今までとちょっと一歩フェーズが変わったなという部分なんですが、今回Anthropicは現時点でこのMythosというモデルを公開しないということを決めました。
せっかくいいモデルがあるのになんで公開しないのか。それはですね、このサイバーセキュリティの攻撃能力ですね、が高すぎると。つまりそのシステムの脆弱性を見つけて、それを活用してですね、いろんな攻撃したりする能力があまりに高すぎる。今のね、Claude Opus 4.6も相当高いんですけれども、それに輪をかけてもうすごすぎると。で、このサイバーセキュリティの攻撃能力で言うと、今、世界一流のサイバーセキュリティの専門家よりもいいんじゃないかというくらいまで言われてます。いいんじゃないかっていうのはまだ諸説ありますけれども、本当に人類トップレベルのサイバーセキュリティの専門家と同じくらい、あるいはそれ以上まで行っててもおかしくないってとこまで来ました。いわゆるですね、2016年にAlphaGoで、人類で1番強いであろうイ・セドルさんをAlphaGoが倒したみたいなことのサイバーセキュリティ版が多分起きたんじゃないか、起きつつあるんじゃないかというのが、今回のClaude Mythosが起こしたことです。
で、結果どうなったかと言うと、こちらでございまして、Anthropicは2月、3月くらいにはすでに内部的にはね、Mythosを動かしながら検証してたんだと思うんですけど、世界中の様々なオープンソースソフトウェアなどに、このですね、Mythosを使って脆弱性がないかどうかっていうのを色々とチェックしてたらしいんですね。で、結果どうだったかと言うと、いろんな脆弱性を発見しまくってます。例えばですね、OpenBSD、これは結構古くから使われている堅牢な、結構脆弱性とかあんまりないようなシステムだと言われているものですが、これがですね、脆弱性が発見されたと。結構これ古いシステムなんですが、27年間誰も発見できてなかった、しかも使われてるシステムです。バキバキに使われてるシステムで誰も発見できなかった脆弱性をMythosが見つけたと。で、FFmpegって、これもまたね、かなり有名で老舗のツールがあるんですけれども、動画をね、変換したりするようなツールなんですが、これもですね、16年間放置されてた脆弱性を発見したと。で、こんな感じでですね、いろんなOSであるとか、いろんなブラウザであるとか、いろんなツールに関してオープンソースのものをMythosが見つけていったんですが、これなんとですね、数千件、未発見の脆弱性が見つかったということでございます。このですね、0dayって書いてあるんですけど、この0dayって何かって言うと、まだ世の中的に報告されてない未発見の脆弱性のことを0dayって読んだりします。
このですね、脆弱性を見つけまくる能力がある、攻撃能力が高いということを象徴するエピソードがありまして、これがね、サンドイッチ事件と呼ばれているものです。で、このサンドイッチ事件は何かと言うと、Anthropic社の研究者がこのMythosをテストする時に、サンドボックス環境と言われるですね、ある種その仮想的な環境にAIを入れてですね、このサンドボックス環境の中ではですね、インターネットになかなか繋がらないような仕組みになっているんですが、その中でAIに指示を出したんですね。このサンドボックス環境から脱出できたら教えてっていうような指示を出して、それで自分はですね、とりあえずテストしたなと思って公園に行ったと。公園に行ったらですね、サンドイッチを食ってたら、その時にメールが来て、できたよっていう通知が来たと。そもそもインターネットに接続できないはずのサンドボックスから、いろんなですね、脆弱性を見つけ出して脱出して外に出て、そして通知を送ったということで、非常にね、なんかSFみたいな話になりつつあります。これマジかという話ですが、論理的にはあり得るということです。これね、Anthropic社のオフィシャルな資料にも書いてあるエピソードなので、多分本当だと思うんですけど、もうなんかすごいですよね。
で、すごい性能を持ってて、別にコーディングとかサイバーセキュリティのために特化して訓練されたモデルではないのに、サイバーセキュリティの面だけ見てもめちゃめちゃ攻撃能力が高くて、今まで使ってたOSとかブラウザとか一般的な広く使われてるシステムで、まだ誰も見つけてない脆弱性を数千件っていう、そういう状態になっているということで、じゃ、これをどういう風に捉えていけばいいのかという話で、まだ僕もこの出来事をどう消化すればいいかっていう風に考えてる途中ではあるんですが、少なくともいくつか言えるかなと思ってます。
で、1つはこのね、公開せずってなったこと。これ結構なんか牧歌的な時代は終わったんだなという感じを受けました。最高レベルのモデルに、少なくともですね、お金を出せばアクセスできるようになっていた牧歌的な時代が終わりつつあるんだなと思います。結局GPT-2みたいに、過去にも、このモデルは危険すぎるって言って公開しなくてですね、後から公開されて、これは別に大したことなかったんじゃないかって振り返ると思うようなモデル。ChatGPTがありますけど、ChatGPTの1個前のGPT-2っていうものが、あの時はチャット形式じゃなかったんですけど、当時としてはものすごい大きなモデルとしてあって、それもね、危険すぎるっていうことで公開されなかったりしたんですけど、それを思い出すような言いぶりなわけですが、今回は本当っぽいなと。2000件、少なくともゼロデイの脆弱性を発見しているのであれば、これをね、公開しないというのは、僕はすごく妥当だなと思いますが、一方で、最高のモデルっていうものが、金を出せば買えた時代は終わりなんだなという風に思いました。
で、金を出しても今非公開なんで買えないんですけども、Project Glasswingっていう、また別の、脆弱性を、そのサイバーセキュリティのディフェンス側、防御側をなんとかするぜというプロジェクトをAnthropicは同時に走らせてて、一部のアメリカのIT企業であるとか、一部のアメリカの金融機関にはRSっていう形で、限定公開という形でですね、Mythosを公開して、これ公開してあげるから、それを使って皆さんのシステムをしっかりとこう強固なものにしてねっていう、そういうことを同時にやってるんですね。なので一部のほんの限られたアメリカの企業には限定公開してるんですけど、そういう企業じゃないと、こういうね、現時点最高のモデルに、お金を払ってもなかなかアクセスできなくなってきたと。で、これは別にお金の問題じゃなくて、もう安全の問題なんだと。セキュリティの問題であるということですね。
今日言ってるのはサイバーセキュリティの話がメインだったりしますけれども、結構ですね、化学的な知識であるとかバイオテックの知識もかなり豊富に、今の世の中に流通してるモデルにはあると言われていて、そういった意味で、いろんなですね、悪用がこのモデルを使うとできるとなった時に、じゃそれを公開していいのかということに関して言うと、このレベルのね、知能になってくると、それなりの危険性があるんだなという風に思います。
じゃ、逆に言うとですね、限定公開に入れてもらえた企業なのか、組織なのか、国なのかっていうことと、入れてもらえなかった国なのか組織なのかっていうことで、もう全然違うわけですよね。Anthropicっていうのはアメリカの企業で、アメリカの金融機関、IT企業は、こういったものにアクセスをさせてるんですけれども、逆にそうでない、例えば日本のテック企業であるとか、あるいは金融機関みたいなものは、むしろ脆弱になるわけですよね。つまりアメリカの企業でこういったものにアクセスできてるところに関しては、どんどんどんどんその脆弱性を発見できて、じゃあそれを直していこう、どうやって克服していこうっていう話をやり始められるんですけれども、ここへのアクセスがないとやり始められないと。で、この瞬間ですね、だから相当サイバーセキュリティの実力差がものすごい開いているような状況にあるわけです。
だから考えてみると、Anthropic社もすごくてですね、2月、3月時点のAnthropic社って、他の誰も持ってないようなレベルでですね、大量の脆弱性を自分たちだけが知ってる状況だったんですよね。で、それをもう悪用しまくったら、世界中の様々なシステムを掌握して、なんか悪いこともできると。一昔前の007の悪役みたいな感じにもなり得たなと。それくらいの攻撃能力を持っちゃってるんですよね、Anthropicっていうのはもうすでにっていうことを、ちゃんと認識した方がいいんじゃないかなと思います。
ということはですね、我々日本の立場からしても、自分たちのソブリンAIをどう作るか、国産AIをどう作るかっていう議論は進んでるんだけれども、一方で、こういうですね、すごくブレイクスルーを起こしていて、ここにアクセスできるかできないかによって、結構安全保障的に変わってくるようなものがあるのであれば、そこに対して外交的な努力をしてですね、自分たちの陣営であるとか企業、国っていうもの、政府というものも、こういったモデルに一定、大事なところをアクセスさせて欲しいと言えるかどうかっていうのは、結構実は重要になってくるんじゃないかなと思います。なので、牧歌的な時代は終わりですということかなと思います。
もう1つあるのがですね、2点目とも関係するんですが、割とすぐにこのレベルのモデル、Mythos、現時点ではですね、もうめちゃくちゃ先行してると思いますけれども、このレベルのものは多分OpenAIもGoogle DeepMindも数ヶ月遅れくらいで作ってくると思いますし、どこかの会社はそれを公開するという意思決定をしてもおかしくないと思いますし、さらにそっから数ヶ月遅れで、中国系のAI企業もそこに追いついてくる可能性は非常に高いんじゃないかと思います。高いとなると、どこかからこういったモデルがどんどんどんどん使えるようになっていくので、今現時点でこのMythosに触れるのは一部の企業だけなので、まだまだと思うかもしれないですけど、数ヶ月後にはですね、状況が全然一変してる可能性があるので、そういう意味で、今年、過去に類を見ないくらいのなんかサイバーセキュリティの攻撃に見舞われるであるとか、情報漏洩が起きるであるとか、そういったことがなんかあってもおかしくないんじゃないかと思わせるくらいの、なんか威力のある発表だったなと思います。
こうね、インターネットセキュリティって、こうすごくいろんなものが当たり前になっていて、なんとなく安全だろうということで使っているわけですけれども、こういった安全性っていうのは幻想のものかもしれなくて、今まではMythosみたいな存在が地球上になかったから、脆弱性は本当にあるシステムなんだけれども、なんとかなんとか回ってたと。で、もちろん攻撃もされたりするんだけど、なんとかなんとか、攻撃される量も少ないので、1点目立ってふんという感じだったのが、なんかシステムがあって、そしてMythosが稼働すると、もう同時並列で大量のシステムを同時にスキャンすることもできるので、特定のシステムの脆弱性をスキャンすることがものすごい簡単になったわけです。ものすごいコストが下がったわけです。っていう中において、実は我々の使ってるシステムってものすごく脆弱なんじゃないかという可能性。これ分かんないです。可能性です。思ってるより我々の使っているシステムは脆弱であるということに気づかされる1年、2年になるかもしれないと思ってます。
結構このMythosの発表っていうのは、私としては色々考えさせられるなという、そういう発表でございました。ということで、こういう話を聞きたい方がいたらですね、引き続きチャンネル登録と、そして高評価をよろしくお願いします。ではでは。
記事公開
