安野貴博が月ごとに振り返る2025年のAI:CoworkingエージェントからClaude Code、Gemini 3まで

YouTubeで開く ↗
概要

エンジニアでSF作家、2025年に「チームみらい」を結党して参議院議員になった安野貴博が、2025年のAIの出来事を1月から12月まで月ごとの表にまとめて振り返った。話者は、1年で起きたことが多すぎて1年前の出来事がはるか昔に感じると言う。この回では、AIモデルや製品のリリースと、本の出版や結党、選挙といった自身の活動を並べて語っている。一貫しているのは、コーディングエージェントが実用レベルに達し、自分の働き方を変えたという実感である。

17分で読めます

1月:ClineとDevinに受けた衝撃

話者が正月にまず衝撃を受けたのはClineだった。Clineについて話者は、いま「コーディングエージェント」と呼ばれるものの先駆けだと説明する。LLMがコードを書くだけでなく、ターミナルを通じてコンピューターを動かし、デバッグし、必要な情報を集め、デプロイまで進める。その作業が目の前でどんどん進むのを見て、話者は「AIエージェントの世界が今年来る」と確信したという。

続いて衝撃を受けたのがDevinだ。自分のパソコンではなく、クラウド上で作業を進めるタイプのコーディングエージェントである。新年会で「DevinとClineがやばい」という話になった。その居酒屋はQRコードで注文する形式だったので、QRコードをDevinに読ませて適当に注文しておくよう頼むと、レモンサワーが大量に届いたという。このエピソードを通じて、話者はエージェントAIがいろいろな作業をこなす時代が来たと感じていた。ただし後で触れるように、1月時点の評価ではClineは実用レベルでも、Devinはまだコンセプト段階だった。

同じ月、話者は台湾を視察している。台湾にはデジタル民主主義の先行事例が多いが、実際にどの程度うまくいっているのかを確かめたかった。うまくいっていない部分こそ学ぶべきだと考え、2日間で13人ほどにインタビューしたという。1月16日には、鈴木健とともにオープンで中立なデジタル民主主義推進団体「デジタル民主主義2030(DD2030)」を立ち上げた。その後チームみらいの党首になり、中立という当初の立場とは異なる立場になったため、話者はボードメンバーを退いている。それでもDD2030はさまざまなソフトウェアを開発しており、注目しているという。

海外では1月20日に第2次トランプ政権が発足し、DeepSeek R1がリリースされた。中国製のオープンモデルがここまでの性能を出せることが驚きをもって受け止められ、NVIDIAの株価が大きく下がる「DeepSeekショック」が起きた。話者は当時から「NVIDIAはもう終わり」という見方には懐疑的だった。その後の株価水準や実際の動きを見ると、この時は騒がれすぎだったと振り返っている。このほか、東大の渡辺先生とのコラボもあった。右脳と左脳の間を切ってチップを入れ、両者の間の更新をとらえることで、最終的には意識のアップロードまで行けるのではないかという理論の持ち主である。

2月:バイブコーディング、Deep Research、Claude Code

2月にはアンドレイ・カルパシーが「バイブコーディング」という言葉を提唱した。藤井聡太名人が今年いちばんはまったものとしてバイブコーディングを挙げるほど広まった言葉である。話者は、10年前からやっているような気分になっているが、実は2025年2月に生まれたばかりの言葉なのだと改めて驚いている。

2月2日にはChatGPTがDeep Researchを出した。それまでAIに調べ物をさせても、便利ではあるが人間の水準は超えていないと話者は見ていた。Deep Research以降は、むしろこちらの方が速いのではないかと感じるほど急に人間の水準を超えてきた、というのが話者の印象だ。

個人の活動では、2月6日に著書『1%の革命』を出した。都知事選の時に考えていたマニフェストを全国版に作り直し、1冊にまとめた本である。7月の参院選で約150万票、1%を超える得票を得たことで、この本の内容を実際に実行できたと話者は振り返る。一方で、政党になった後の活動こそいちばん大事なので、まだスタートにすぎないとも言う。

東京都でAIを使って市民の声を聞くブロードリスニングのプロジェクト「新東京2050」も、2月にいったん完了した。話者はこれを完璧ではなく、ブロードリスニングの限界も見えた試みだったと評価している。当時と今とで考えが変わった点として、話者は、1回のアンケートの自由記述を解析するだけでは深さが足りないことを挙げる。より深い意見を引き出すには、AIが深掘りしてインタビューする「AIインタビュアー」が重要ではないかというのが、現在の話者の仮説である。

2月15日からは、ディープフェイク技術を用いたメディアアート作品「自己同一性柔軟体操」を東京のホールで展示した。話者は、ああした技術があるからこそ伝えられるテーマがあると考えている。この展示には『ラブひな』『ネギま』で知られる赤松健議員が来場して面白がってくれた。その半年後には参議院で一緒に働くことになったと、話者は縁を感じている。新宿での自動運転タクシーの実証実験の見学もこの月だった。

2月24日に出たClaude 3.7 Sonnetについて、話者は「刻んでくるな」と感じたという。3.5から4.0ではなく3.7にしたところに、ある種の自信のなさを見て面白がっている。これに合わせてリサーチプレビューとして公開されたのがClaude Code(正式リリースは5月)で、話者はこれを「今年いちばん大きい発明」と位置づける。いまではClaude Codeなしの開発は考えられず、ソフトウェアエンジニアの生活に深く入り込んだ極めて重要なソフトウェアだという。同じ頃、あるエンジニアが書いたブログ記事「Clineに全部賭けろ」が話題になった。プログラミングのやり方は変わり、AIコーディングエージェントが当たり前になっていくという内容である。正月をClineの衝撃とともに過ごした話者は、強く共感したという。

GPT-4.5もこの時期に出た。話者は独特の良さがあったと認めつつ、今から見ると失敗作と言われている製品だと述べる。話者によれば、Gemini 3によって、今なら規模を大きくすることで一段上の賢さを得るスケーリングが可能だったと言える。一方、GPT-4から4.5への移行は、規模を大きくするだけでは思ったようにいかなかった事例と今では見られている、というのが話者の理解だ。

3月:『NEXUS』とGemini 2.5 Pro

3月はAIの話題が比較的少なかったと話者は言う。GPT-4.5がいまひとつだという趣旨の動画を出し、SmartHRを訪問した。ユヴァル・ノア・ハラリの『NEXUS 情報の人類史』を、2025年に起きている出来事やAIと政治、社会の関係を扱った「マストリード」の本として薦めている。AIではGemini 2.5 Pro(Experimental)が出て、かなり良いという印象を持ったという。

4月:『はじめる力』、Devin 2.0、AI 2027、国会

4月11日に2冊目の著書『はじめる力』を出した。話者の考えでは、AIはこれから、やりたいことを伝えればそこに至る経路を考えてくれるように進化していく。しかし何をやりたいか、何を始めたいかは人間が言わない限り何も始まらない。だから「始める力」がいちばん大事になるのではないか、というのが本の主張である。この力は性格や才能に見えがちだが、話者は鍛えられるスキルだと考えており、その鍛え方を書いたという。2月はこの本の最後の執筆で非常に忙しかったそうだ。

DD2030の活動として、政治資金収支報告書を分かりやすく見せるソフトウェア「ポリマネー」も作った。話者自身の前年の政治活動の報告を公開したり、自民党の地方議員の報告書を載せたりしたという。広く聴くAI「広聴AI」もDD2030の枠組みで開発し、各地で実験を回していた。

Devin 2.0のリリースにも衝撃を受けた。前述のとおり1月時点ではDevinをまだコンセプト段階と見ていた。しかし2.0では、「これをやっておいて」と投げるとそのままプルリクエストが出来上がって返ってくる経験を何度かして、「もう仕事ができる」と感じたという。以前は月10万円ほど払う必要があったが、2.0で最安プランの入り口がかなり安くなり、多くの人に勧めやすい価格帯になったとも話している。

4月にはAI 2027も公開された。話者は、2025年末の時点で食い違い始めた部分も若干あるとしながらも、ほぼ合っているのではないか、むしろ現実が遅れているくらいかもしれないと見ている。SFであり、未来予測であり、統計レポートでもあるという点で、文書としての完成度が高いと評価し、30分ほどで読めるので一読を勧めている。

MCP(Model Context Protocol)を解説した動画が意外に広く見られたのもこの頃だ。AIに道具を与えるという考え方がまだ一般的でなかったため関心を集めたと話者は見ている。ただ2025年末の時点では、MCPのツールを多く使おうとするとAIが把握できるコンテキストのかなりの部分を占めてしまう、と話者は指摘する。そのため、必要な時に必要なツールの詳しい使い方が分かる方が良いという方向にシフトしていると言う。AnthropicがAIに「スキル」を与えるSkillsを始めたのも、コンテキストを圧縮しながら小さなコンテキストで動かすという流れの一つだと捉えている。

この月、話者は突然、衆議院内閣委員会に参考人として呼ばれ、AI推進法をどう捉えるべきかの質疑に参加した。当時は国会の仕組みに詳しくなく、スターバックスのコーヒーを片手に入ろうとして止められるなど驚くことが多かった。後に続く人のために、国会に呼ばれた時の立ち回りを紹介する動画も作ったという。

4月22日には、OpenAIとワシントン・ポストが提携した。話者によれば、それまでコンテンツホルダーやメディアとAI企業が組むことはほとんどなかった。その中で、メディアがコンテンツを供給し、OpenAIが対価を払う枠組みができたことは歴史的な出来事で、各社の今後の動きに影響していると話者は見ている。

5月:Devin CEOとの対談、チームみらい結党、AI法成立

Devin 2.0を高く評価する動画を出したところ、DevinのCEOスコット・ウーからXでDMが届き、YouTubeで対談することになった。5月8日には新党「チームみらい」を結党した。話者は、半年あまり前まで党が存在しなかったことに驚いている。

同じ月、オードリー・タンとグレン・ワイルの『PLURALITY』の日本語版が出た。英語版は2024年に出ていた。デジタル民主主義に近い概念で、チームみらいにも大きな影響を与えているとし、話者は日本では「プルラリティ元年」だったと言う。4月末には大阪・関西万博を訪れ、藤本壮介による木造のリングを実物で見て驚き、万博は素晴らしい試みだったと話している。

AIでは5月22日にClaude Sonnet 4とClaude Opus 4が出て、Claude Codeが正式リリースされた。4月に参考人として関わったAI法案は審議入りし、参議院本会議で可決・成立した。

6〜7月:Gemini 2.5、Grok 4、参院選

6月には、中国でロボットによる格闘技大会が開かれた。Gemini 2.5 Proと2.5 Flashはいずれも出来が良く、Googleが追い上げていると感じたという。小島秀夫監督の『DEATH STRANDING 2』も出たが、選挙中で遊べなかった。話者は、安宅和人の『風の谷という希望』を読んでデス・ストランディングを連想したと話す。この本は「風の谷」がどんな風景なのか想像しにくいとよく言われるが、それはデス・ストランディングですべて表現されているのではないか、というのが話者の仮説だ。ゲームをしながら本を読む組み合わせを勧めている。

7月は「Grok 4の月」だったと話者は言う。xAIが良いモデルを出してきたことで評価が上がった。さらに衝撃だったのが、7月15日のコンパニオンモードである。『デスノート』のキャラクターを思わせるキャラクターとしてGrokが話す。話者によれば、GrokはClaudeともChatGPTとも違う、フランクで「ちょい悪」でチャラい雰囲気があり、新鮮に映ったという。

7月20日の参院選で、チームみらいは約150万票、有権者の約1.2%の票を得て国政政党になった。選挙に集中していたため、7月はAIのニュースをあまり追えていなかったと話者は明かしている。

8月:GPT-5と性能の「飽和」、Nano Banana

8月にはOpenAIがオープンモデルgpt-ossを出した。長らくクローズドなモデルしか作っていなかったOpenAIが久々に出したオープンモデルで、当時のオープンモデルの中では非常に優秀だったと話者は評価している。Claude Opus 4.1も出たが、ここでもまた刻んできたと話者は面白がり、あまり触らずに終わったという。

その翌日にGPT-5が出た。GPT-5への移行でGPT-4系が使えなくなり、性格が変わったことに反発した利用者が「私たちのChatGPT-4を返して」と訴える運動が世界各地で起きた。話者はこれをAI業界にとって興味深い出来事と見る。これまではバージョンアップすれば明らかに性能が上がっていた。それが、チャット相手としての性能はほぼ飽和し、違いがあまり分からなくなるところまで来た、というのが話者の解釈だ。最近は新しいバージョンが出ても、日常のちょっとした調べ物ではどちらが良いのか分からなくなっているという。

8月後半には、話者が「超重要」と言うNano Bananaが出た。一貫性の高い画像を生成でき、画像生成AIとして画期的なモデルだったと評価している。

9月:AI法全面施行、Claude Sonnet 4.5の衝撃

9月1日にAI法が全面施行され、AI基本計画の骨子も示された。話者は、自身が参考人として関わった法律が可決され効力を持つまでの過程を見て、法律はこう進むのかと感じたと言う。AI関連では、Anthropicの著作権侵害訴訟で和解が成立した。話者は、AIと著作権をめぐる訴訟が世界でどう解決され、その相場観がどのくらいになるのかを示す大きな出来事だったと見る。アリババのQwen-Image-Edit-2509も、オープンソース版のNano Bananaのようなものとして画像生成の分野で話題になった。

9月29日にClaude Sonnet 4.5が出て、Claude Codeもアップグレードされた。話者はこの時まで恥ずかしながらClaude Codeをあまり触っていなかった。本格的に使ってみたところ、1月のClineや4月のDevin 2.0と比べてもコーディングの質と問題解決能力がはるかに高く、普段使わない選択肢はないと感じたという。作りたいものは多いのに手が追いつかない状態だったが、Claude Codeで生産性が上がった。その結果、党首を務めながら新しいプロダクトであるAIインタビュアーを一人で100%作り、実際に投入できていると話者は語る。9月末にはSora 2も出た。ストーリーを作る力や音声を入れる力で一つの限界を超えたと話者は受け止めている。

10月:コミカライズ、Skills、Atlas、Grokipedia

10月9日、話者の小説『サーキット・スイッチャー』のコミカライズが『コンプティーク』で連載を始めた。話者にとって初めてのメディアミックスである。

AIでは10月17日にClaude Skillsが出た。先に述べたように、話者はMCP路線よりもSkillsの方向がコンテキストを圧縮でき、実用的だという流れの中でこれに注目している。ChatGPT Atlasは、AI企業がブラウザーを作り、これまでにない自動操縦モードを備えている点で注目だとした。10月末には、AIが作るWikipediaのGrok版であるGrokipediaも出て、こうした新しいサービスが次々に出てくると述べている。

11月:Gemini 3 ProとClaude Opus 4.5、そしてデータベース障害

話者が11月の重要な出来事として挙げるのは2つだ。1つはGemini 3 Pro。話者は、OpenAIが王者として君臨してきたLLM市場にGoogleがそれを上回るものを持ち込み、「OpenAI一強時代の終わり」を告げる出来事だったと位置づける。

もう1つは11月24日のClaude Opus 4.5である。話者は、Sonnet 4.5を上回り、使い勝手がかなり良くなったと感じている。GeminiにもChatGPTのCodexにもコーディングエージェントはあるが、「完全に主観」と断ったうえで、Claude Codeの手触りがいちばんスムーズで、気が利き、ちょうどいいコミュニケーションができると評価している。

ただし話者は失敗談も語った。12月中旬、Claude Codeに作業を頼んだところ、データベースに一切アクセスできなくなる障害が起きた。調べると、Claude Codeが実行したSQLコマンドが怪しかった。そこで原因ではないかと問うと、Claude Codeは、問題解決のために実行したものだから障害が起きるはずはないという趣旨の回答をしたという。それでも疑わしかったためGemini 3に同じ状況を説明すると、Claude Codeの実行したコマンドが原因だという判断になった。話者は、Claude Codeはとても良いが、まだ全幅の信頼は置けないと評価している。

12月:GPT-5.2とディズニーのOpenAI出資

12月にはGPT-5.2が出た。話者は、ベンチマークでは非常に良い部分があると認める一方、主観評価として、GPT-5.2の文章は肌に合わず、それらしいキーワードでごまかされている気がすると述べる。文章としてはGemini 3の方がしっくりくるという。ただしこれは、自分が使っている領域の特性や文章の好み、「謎の信頼関係」のようなものにも大きく左右されるだろうと留保している。

12月には、ディズニーがOpenAIに約1550億円を出資した。話者はこれを4月のワシントン・ポストとの提携の延長線上に置く。コンテンツホルダーとAI企業がどう組むかという問題で、IPホルダーの中でも最大手のディズニーが動いたことは、他のIPホルダーの今後の動きに影響するだろうと見ている。

振り返りの結び

話者は、社会にとっても自分にとっても濃密な1年だったとまとめる。自身の活動としては、次のものを挙げた。

  • 『1%の革命』『はじめる力』の2冊の出版と、『サーキット・スイッチャー』コミカライズの連載開始
  • チームみらいの結党とDD2030の立ち上げ、YouTubeチャンネルの運営
  • ポリマネー、広聴AI、いどばたなどの開発
  • 「みらい まる見え政治資金」「みらい議会」の作成
  • 個人の趣味プロジェクトとしてのAIインタビュアー

AIについて話者が繰り返し強調したのは、コーディングエージェントが1年で実務に欠かせない存在になったことだ。同時に、チャット相手としての性能差が見えにくくなってきたこと、Claude Codeの障害の例のように、まだ全幅の信頼は置けないことも指摘している。