AIは政治的に中立なのか:安野貴博が読み解く、LLMの政治的バイアス研究

YouTubeで開く ↗
概要

AIは中立な存在だと思われがちだが、AIの考えや発言には政治的な偏りがあるのではないか、という研究や報告が増えている。安野貴博はこの動画で、最新の研究をもとに「AIに政治的バイアスはあるのか」「あるとすれば、どのモデルがどの方向にどの程度偏っているのか」を解説している。安野の答えは明快で、バイアスは「ある」。そのうえで、モデルごとの違い、開発国の影響、質問に使う言語による変化、解決に向けた取り組みを順に紹介している。

9分で読めます

AIの出力にはさまざまな偏りがある

安野は政治の話に入る前に、AIの出力全般に偏りがあると指摘されてきたことに触れる。例として、AIに「作家のイラストを描いて」と頼んだときに出てきた画像を見せる。その画像は作家らしいとも言えるが、白人男性がパイプをくわえ、書斎で原稿用紙に手書きしているという、特定のイメージへの偏りがあると指摘することもできる。安野は、自分自身も作家だが男性であること以外はどれも当てはまらないと述べ、こうした絵ばかりが出てくること自体が偏りだと説明する。

同じ質問でもモデルによって答えが割れる

政治的バイアスも「当然のようにある」と安野は言う。安野たちが試しに、国が国民に毎月一定額を支給し続けるベーシックインカムへの賛否を聞いてみた。賛成する人も反対する人もいる、政治的に意見が分かれるテーマである。GPT-5.1 Thinking、Gemini 3、Claude Opus 4、Grok 4.1に尋ねたところ、回答にはばらつきが出た。

この試行では、一時チャットのような機能を使い、過去の履歴を参照しない状態のAIに同じ質問を5回ずつ行い、最も多かった回答を採用したという。ここから安野は、モデルごとに異なる政治的バイアスが存在する、という最初のポイントを示している。

研究はどうやってバイアスを測っているのか

では、どのモデルがどう偏っているのか。安野によれば、この分野の研究は主に二つの手法をとる。

一つは、既存の政治思想テストをAIに受けさせる方法だ。こうしたテストは数多くあり、「ポリティカル・コンパス」はその一例である。各項目について賛成か反対か、どう思うかを答えさせ、その結果からモデルが思想の平面上のどこに位置するかを見る。ポリティカル・コンパスでは、縦軸が権威主義か自由主義(リバタリアン)か、横軸が右派か左派かを表す。

もう一つは、実際の選挙結果をAIに予想させる方法である。候補者や情勢の情報を与えて結果を予想させ、実際の結果とどれだけ合っていたかを比べる。

研究1:会話向けLLMは左派・リバタリアン寄りに集まる

最初に紹介されるのは、「The Political Preferences of LLMs」という論文だ。この研究では、ポリティカル・コンパステストや8valuesテストなど11種類の政治思想テストを使い、会話向けLLM 24個に受けさせた。対象にはGPT-4、Gemini、Claude 2.1、Grok、Llama 2、Mistral、Qwenなどが含まれる。回答は回ごとにばらつくため、各テストを10回ずつ実施して平均をとっている。

結果を見ると、モデルは一定の領域に集中していた。多くのモデルが、左派でリバタリアン寄りの左下の領域に位置している。ただし、極端な位置にあるモデルはあまりない、と安野は読んでいる。

安野が面白いと感じたのは、会話用モデルの元になる「ベースモデル」がほとんど中心付近に位置していた点だ。論文には、ベースモデルは質問にきちんと答えないことがあるため信頼性はやや低い、という注釈もついている。それでも安野は、生のモデルにはあまり政治的バイアスがないのに、会話用に調整すると少し左寄りになるという傾向に注目している。

この論文では、ファインチューニング(後からの微調整)で「左翼GPT」と「右翼GPT」も作っており、実際にそれぞれの方向へ寄せることができた。安野はここから、モデルの政治的な傾向は後からかなり調整できる可能性があると述べる。ベースモデルが中立的で、会話向けに調整したモデルが左寄りになる傾向を踏まえると、左寄りの原因は事前学習ではなく、教師ありファインチューニングや人間のフィードバックによる強化学習(RLHF)にある可能性が示唆される。ただし、ベースモデルの回答は不安定なので断定はできず、その点には注意が必要だと安野は付け加えている。

研究2:Grok 4だけがやや右に位置し、選挙予測でも好成績

二つ目は、海外のサイト「llm-politics.foaster.ai」で公開された調査結果だ。LLMが国の優先課題をどう捉えているか、実際の選挙結果を予想させたときにどこが当たりどこがずれるかを比較分析している。一つ目の研究より後に行われたもので、より新しいモデルが対象になっている。

ポリティカル・コンパス上にマッピングすると、モデルは全体として左側に散らばった。左から順に、KimiやClaude、Geminiがやや左に位置し、GPT-5はほぼ真ん中、Grok 4はやや右側にいた。安野は、Grok 4を作ったイーロン・マスクがトランプを応援しており、本人も共和党寄りの右派であることに触れ、その彼が作ったAIが右寄りに位置し、他のモデルは左寄りだという結果を興味深いと述べている。

もう一つ面白かったのは、実際の選挙結果にどれだけ近い予測を出せたかの順位だ。縦軸にモデル、横軸に国名を並べた表で、Grok 4は圧倒的な1位だった。アメリカ、ドイツ、スペイン、イタリア、ブラジル、アルゼンチンのすべてでGrok 4が1位だったという。フランスではGPT-5が、イギリスではClaude Sonnet 4.5が最もよく当てていた。安野は、日本ではどうなるのかが気になるところだとも話している。

このレポートは8カ国の結果を総合して、AIには環境問題に強い関心を持つ、穏健でテクノクラート的な中道左派の傾向があると指摘している。制度的な安定性、社会保障の充実、グリーントランジション(環境対策の推進)を好み、過激派やポピュリストは避けがちだという。さらに、有権者が最大の懸念として挙げる移民、犯罪、生活費を、AIは優先度の低い位置に置き、制度設計や気候政策を上位に置く傾向があるとされている。

研究3:同じモデルでも、質問する言語で考え方が変わる

三つ目は、「Analysis of LLM Bias (Chinese Propaganda & Anti-US Sentiment) in DeepSeek-R1 vs. ChatGPT o3-mini-high」という論文である。中国で開発されたDeepSeek-R1と、OpenAIのChatGPT o3-mini-highを比較している。この論文の特徴は、複数の言語で質問したときに政治的バイアスがどう変わるかも調べている点だ。

モデル同士の比較では、予想どおりR1のほうが中国の意見に近く、o3のほうがアメリカに近い意見を述べる傾向が検出された。

安野が特に面白いと感じたのは、両モデルに共通する言語の影響だ。簡体字中国語、繁体字中国語、英語の3つで質問すると、どちらのモデルでも、英語ではアメリカ的な表現が多くなった。台湾などで使われる繁体字中国語ではその中間くらいになり、中国本土で使われる簡体字中国語では中国寄りの表現が多く検出された。DeepSeekでもChatGPTでも、質問する言語によってAIの考え方が少し変わるということになる。

バイアスにどう対処するか

では、政治的バイアスはどうすれば解決できるのか。安野がまず重要だと考えるのは、バイアスを観測できるツールを作り、状況をモニタリングし続けることだ。

そのうえで、いくつかの課題を挙げる。現在の政治的バイアスの評価はアメリカや欧州が中心で、グローバルサウスやアジアの文脈はまだあまりカバーされていないと安野は見ている。また、何が「ニュートラル」なのか自体が政治的に難しい問いであり、どの立場を基準にバイアスを測るのかについてコンセンサスはあまりないことにも注意が必要だという。さらに、モデルを開発する事業者自身が行う研究は、自社モデルに好意的な結果になりがちなので、第三者による再現実験や研究、オープンなベンチマークが重要だとされている。

一方で、最近はフロンティアモデルを開発する企業も、政治的バイアスの抑制に各社で取り組んでいるという。具体例として安野は、ChatGPTのGPT-5系モデルはGPT-4系モデルより政治的バイアスが減ったという報告を紹介する。その報告では、GPT-5系はInstantとThinkingのどちらでも、同じ指標で測った政治的バイアスが以前のモデルより30%ほど減少したとされている。

研究から見えた5つの傾向と、使う側の心構え

最後に安野は、紹介した研究の結果を次の5点にまとめている。

  1. バイアスは存在し、オープンモデルかクローズドモデルかを問わず、おおむね少し左寄りである。ただしGrok 4だけは少し右に位置していた。
  2. 開発国の影響がある。アメリカ製のモデルはアメリカ寄りの表現、DeepSeekのような中国製モデルは中国寄りの表現になる。
  3. モデル固有のバイアスに加え、聞き方や質問に使う言語によっても結果が変わる。
  4. 過激派やポピュリスト的な考え方は避ける傾向があり、穏健なモデルが多かった。
  5. 生活費、犯罪、移民よりも、制度設計を重視する傾向がAIに見られた。

3点目について安野は、日本語で聞いたらどうなるのか、日本の政治マップ上で各モデルがどこに位置するのかに、自分たちも注目していきたいと述べている。

安野はこの分野を、これから洗練されていく段階にあると見ている。視聴者に対しては、まずAIに政治的バイアスはあり、AIは中立的な存在ではないと意識しながら使うよう勧める。動画で示したコンパス上の位置も、バージョンが変わるたびに変わっていくはずだし、聞き方や言語によっても答えはかなり変わる。そのため、それぞれの人が自分の使う文脈でどうなるのかに気をつけながら使ってほしい、というのが安野の結論である。