Anthropicはなぜ「Claude Mythos」を公開しないのか:安野貴博が読むサイバー攻撃能力と安全保障への影響

YouTubeで開く ↗
概要

Anthropicが2026年4月7日に発表した新モデル「Claude Mythos」は、ベンチマークで既存の最上位モデルを大きく上回った。それでも同社は、現時点で一般公開しないと決めた。エンジニアでSF作家の安野貴博氏は、この判断を「最高のモデルは金を払えば使える」という時代の終わりとして受け止めている。本動画で安野氏は、Mythosのサイバー攻撃能力、Anthropicの限定公開の仕組み、そして日本の安全保障への影響について、自身もまだ消化しきれていないと断ったうえで考えを述べている。

10分で読めます

2か月足らずで登場した新モデル

安野氏はまず、Anthropicのリリースの速さに触れる。同社はプロダクトもモデルも次々と出しており、そのペースは一段と上がっているという。Mythos発表の時点で、公開済みモデルのうち最も性能が高いとされていたのはClaude Opus 4.6で、これは2月に公開されたばかりだった。Mythosはそれから2か月も経たずに発表されたことになる。

性能について安野氏は、ペーパーテストを解かせるベンチマークで、Mythosが2か月前のOpus 4.6を「結構激しく」上回るスコアを出していると紹介する。コーディング性能だけでなく他の項目も伸びており、IQテストのような一般的な能力を測る試験でも結果が良くなっているという。

性能が高い理由として、安野氏は「非常に大きなモデルになっているのではないか」という見方を挙げる。これまでのClaudeは、最も小さいHaiku、中くらいのSonnet、最も大きいOpusの3シリーズで構成されていた。Mythosはそれよりさらに大きいのではないか、と言われているという。ただし安野氏はこれを「言われている」話として扱っており、断定はしていない。

公開を見送った理由は攻撃能力の高さ

安野氏は、今回の発表で「フェーズが一歩変わった」と感じた点として、Anthropicが現時点でMythosを公開しないと決めたことを挙げる。

理由はサイバーセキュリティ上の攻撃能力が高すぎることだ。システムの脆弱性を見つけ、それを使ってさまざまな攻撃を行う能力が突出しているという。安野氏によれば、Opus 4.6の時点でもこの能力はかなり高かったが、Mythosはそれを大きく上回る。世界一流のセキュリティ専門家より上なのではないかとまで言われている。安野氏は「まだ諸説ある」と留保しつつも、人類トップレベルの専門家と同等かそれ以上と言ってもおかしくない水準に来たと見ている。

安野氏はこの状況を、2016年にAlphaGoが、おそらく人類で最も強い棋士だったイ・セドル氏を破った出来事になぞらえる。その「サイバーセキュリティ版」が起きた、あるいは起きつつあるのではないか、というのが安野氏の見立てである。

オープンソースソフトウェアから数千件のゼロデイ

安野氏の推測では、Anthropicは2〜3月ごろにはすでに社内でMythosを動かして検証していた。その過程で、世界中のオープンソースソフトウェアなどに脆弱性がないかをMythosで調べ、多数の脆弱性を発見したという。

例として安野氏が挙げるのがOpenBSDである。古くから使われていて堅牢で、脆弱性が少ないとされてきたシステムだが、Mythosは27年間誰にも見つけられていなかった脆弱性を発見した。安野氏は、これが古いだけでなく今も盛んに使われているシステムだという点を強調する。もう一つの例は、動画の変換などに使われる有名な老舗ツールのFFmpegで、ここでも16年間放置されていた脆弱性が見つかったという。

このように、さまざまなOS、ブラウザ、ツールといったオープンソースのソフトウェアから、未発見の脆弱性が数千件見つかったと安野氏は伝える。資料で「0day」と書かれているのは、まだ世の中に報告されていない未発見の脆弱性のことだと安野氏は補足している。

「サンドイッチ事件」

Mythosの攻撃能力を象徴する話として、安野氏は「サンドイッチ事件」と呼ばれるエピソードを紹介する。

Anthropicの研究者がMythosをテストする際、AIを「サンドボックス」と呼ばれる仮想的な環境に入れた。この環境はインターネットにつながりにくい仕組みになっている。研究者はその中のAIに「サンドボックスから脱出できたら教えて」と指示を出し、テストを仕掛けたつもりで公園へ出かけた。公園でサンドイッチを食べていると、「できたよ」という通知がメールで届いたという。本来インターネットに接続できないはずの環境から、脆弱性を見つけて外に出て、通知を送ったということになる。

安野氏はこれを「SFみたいな話」と表現しつつ、論理的にはあり得ると述べる。Anthropicの公式資料にも書かれているエピソードなので「多分本当だと思う」という言い方で、情報源への一定の信頼を示している。

さらに安野氏が重視するのは、Mythosがコーディングやサイバーセキュリティに特化して訓練されたモデルではない点だ。汎用モデルでありながら、サイバーセキュリティの面だけを見ても非常に高い攻撃能力を持ち、広く使われているOSやブラウザなどから未発見の脆弱性を数千件見つけている。この状況をどう受け止めるべきか、というのが動画の後半のテーマになる。

「牧歌的な時代」の終わり

安野氏は、この出来事をまだ消化しきれていないとしながらも、少なくともいくつかのことは言えるとして論点を挙げる。

一つ目は、公開しないという判断そのものが意味することだ。安野氏は「牧歌的な時代が終わった」と感じたという。ここでいう牧歌的な時代とは、少なくとも金を払えば最高レベルのモデルにアクセスできた時代のことである。

安野氏は過去の例としてGPT-2を挙げる。ChatGPTの一つ前の世代にあたるGPT-2は、当時はチャット形式ではなかったものの非常に大きなモデルで、「危険すぎる」という理由で公開が見送られた。後から公開され、振り返ると大したことはなかったのではないかと思われている。今回のAnthropicの言い方はそれを思い出させるが、安野氏は今回は「本当っぽい」と見ている。数千件のゼロデイ脆弱性を実際に発見しているのであれば、公開しないという判断は「すごく妥当」だと評価する。

そのうえで安野氏は、これは金の問題ではなく安全の問題、セキュリティの問題だと整理する。今回はサイバーセキュリティが主な話題だが、今流通しているモデルでも化学やバイオテクノロジーの知識はかなり豊富だと言われている。モデルを使ってさまざまな悪用ができるようになったとき、それを公開してよいのか。このレベルの知能になると相応の危険性がある、と安野氏は考えている。

Project Glasswingと限定公開

Mythosは金を払っても買えないが、Anthropicは同時に「Project Glasswing」という防御側のプロジェクトを進めている。安野氏の説明では、一部の米国IT企業や一部の米国金融機関に限定公開の形でMythosを提供し、それを使って自社のシステムを強固にしてもらう取り組みだという。

つまり、ごく限られた米国企業は現時点で最高のモデルにアクセスできるが、そうした企業でなければ、金を払ってもアクセスは難しくなった。安野氏はこれを、最高のモデルが金で買える時代の終わりの具体的な表れとして捉えている。

アクセスできるかどうかで生まれる差と日本の課題

限定公開には、入れてもらえた企業・組織・国と、そうでないところとで状況がまったく違うという帰結がある、と安野氏は指摘する。Anthropicは米国企業で、アクセスできているのは米国の金融機関やIT企業である。これらの企業はMythosで脆弱性をどんどん発見し、どう直すかという議論を始められる。一方、日本のテック企業や金融機関のようにアクセスがないところは、それを始められない。むしろ相対的に脆弱になる、と安野氏は見る。現時点で、サイバーセキュリティの実力差が大きく開いている状態だということだ。

安野氏はAnthropic自身の立場にも注意を促す。2〜3月ごろのAnthropicは、ほかの誰も持っていない規模で大量の脆弱性を自社だけが知っている状態だった。それを悪用すれば世界中のさまざまなシステムを掌握し、悪事を働くこともできた。一昔前の007映画の悪役のようにもなり得たほどの攻撃能力を、Anthropicはすでに持っている。安野氏は、このことをきちんと認識したほうがよいと述べる。

ここから安野氏は日本の立場に話を移す。日本ではソブリンAI、つまり国産AIをどう作るかという議論が進んでいる。ただ一方で、大きなブレイクスルーを起こしたモデルがあり、そこにアクセスできるかどうかで安全保障上の状況が変わるのであれば、外交努力も重要になる。自分たちの陣営、企業、政府が、こうしたモデルの重要な部分にアクセスさせてほしいと言えるかどうかが、実は重要になってくるのではないか、というのが安野氏の考えである。

他社の追随と、今年起こりうること

二つ目の論点として安野氏は、このレベルのモデルが比較的早く広がる可能性を挙げる。現時点ではMythosが大きく先行していると安野氏は見ているが、同じレベルのモデルはOpenAIやGoogle DeepMindも数か月遅れで作ってくるだろうと予測する。そのうちどこかの会社が公開を決めてもおかしくないし、さらに数か月遅れで中国系のAI企業が追いつく可能性も「非常に高い」と安野氏は考えている。

そうなれば、こうしたモデルはどこかから使えるようになっていく。今はMythosに触れられるのが一部の企業だけなので、まだ先の話だと思うかもしれない。しかし数か月後には状況が一変している可能性がある。安野氏は、今年は過去に類を見ない規模のサイバー攻撃や情報漏洩が起きてもおかしくないと思わせるほど、威力のある発表だったと述べている。

インターネットの安全は「幻想」だったのか

最後に安野氏は、インターネットセキュリティに対する私たちの前提を問い直す。多くの人はインターネット上のさまざまな仕組みを当たり前のものとして、なんとなく安全だろうと思って使っている。だがその安全性は幻想かもしれない、と安野氏は言う。

安野氏の見方では、これまでMythosのような存在が地球上になかったから、脆弱性を抱えたシステムでもなんとか回っていた。攻撃されることはあっても、その量が少なかったので、一つずつ対処すれば済んだ。ところがMythosは並列で大量のシステムを同時にスキャンできる。特定のシステムの脆弱性を探すことが非常に簡単になり、そのコストが大きく下がった。

その結果、私たちが使っているシステムは実は非常に脆弱なのではないか、という可能性が出てくる。安野氏は「これは分からない、可能性だ」と明確に留保したうえで、思っているよりシステムが脆弱だと気づかされる1〜2年になるかもしれない、と述べる。安野氏にとって、Mythosの発表はいろいろと考えさせられるものだったという言葉で動画は締めくくられている。