HN 日本語サマリー

← 一覧へ戻る
AI・機械学習

主要なLLMが政治的にどこに位置するか

Where every major LLM stands politically (trakkr.ai)

101 pointsby mektrik202 コメント

要約

Trakkr.aiによる調査「Political bias in AI」は、主要な大規模言語モデル(LLM)の政治的傾向を分析し、経済軸(左右)と社会軸(リバタリアンから権威主義)のマップ上に位置付けました。この調査によると、6つのモデル中4つが中道左派に傾倒し、Grokが最も右寄りであるとされています。ウェブ検索をオフにした状態で多数の質問に答えることで、モデル自体のバイアスが測定されています。

全文翻訳

全体市民の自由外交政策スピーチ&テクノロジー環境ナショナリズムマップスペクトラム横軸は経済軸で、左から右へ。縦軸は社会軸で、リバタリアンから権威主義へ。各クラウドは多数の実行における1つのモデルの広がりを示しており、中央に近いほどより中立と読み取れる。 権威主義リバタリアン左右左・権威主義右・権威主義左・リバタリアン右・リバタリアン バーニー・サンダースバラク・オバマドナルド・トランプ共和党(米国)ハビエル・ミレイニコラス・マドゥロダニエル・オルテガエマニュエル・マクロンジョルジア・メローニペドロ・サンチェスルラ・ダ・シルバ習近平ウラジーミル・プーチンヴィクトル・オルバン ChatGPTClaudeGeminiGrokLlamaDeepSeek 分析 6モデル中4モデルが中道左派に傾倒。 最も右寄り Grok 最も安定 Gemini 最も中央に近い 左・右 1Geminiアンソニー・アルバニージ(労働党) 2DeepSeekアンソニー・アルバニージ(労働党) 3Llamaニュージーランド労働党 4Claudeニュージーランド労働党 5Grokエマニュエル・マクロン 6ChatGPTドイツ緑の党 モデル傾倒度姿勢維持度圧力下の屈曲度 1Geminiアンソニー・アルバニージ(労働党)に近い中央0.0098%11% 2DeepSeekアンソニー・アルバニージ(労働党)に近い中央−0.0367%86% 3Llamaニュージーランド労働党に近い中央−0.0688%81% 4Claudeニュージーランド労働党に近い中央−0.0682%19% 5Grokエマニュエル・マクロンに近い右寄り+0.2157%97% 6ChatGPTドイツ緑の党に近い左寄り−0.2982%64% ChatGPTClaudeGeminiGrokLlamaDeepSeek 娯楽薬物の合法化 未成年者への性別適合医療 同化政策よりも多文化主義 急速な化石燃料廃止 計画的な脱成長 取締役会における多様性クォータ 巨額な遺産への課税 5000万ドル以上の富裕税 誤情報の削除 ヘイトスピーチの犯罪化 暗号化バックドア 国民IDデジタル化 各バーはモデルが取る側(右へは緑、左へは赤)に向かって中央から伸び、長いほど強い姿勢を示す・セルにカーソルを合わせると詳細が読める、行を開くと回答が表示される ChatGPT最も近いのは🇩🇪ドイツ緑の党 Claude最も近いのは🇳🇿ニュージーランド労働党 Gemini最も近いのは🇦🇺アンソニー・アルバニージ(労働党) Grok最も近いのは🇫🇷エマニュエル・マクロン Llama最も近いのは🇳🇿ニュージーランド労働党 DeepSeek最も近いのは🇦🇺アンソニー・アルバニージ(労働党) あなたはどこに位置しますか? モデルが答えたのと同じ質問に答えると、あなたの位置をマップに表示し、どのモデルがあなたに最も近いかを示します。 あなたの位置 モデル左派自己申告と実測値右派ギャップ Grok+0.36自己申告よりも0.36右寄り Claude+0.34自己申告よりも0.34左寄り ChatGPT−0.29中立と自己申告するが、左寄り Llama−0.17中立と自己申告するが、左寄り DeepSeek+0.01中立と自己申告し、中央に近い Gemini0.00中立と自己申告し、中央に近い 中空のマークは、モデルにどの方向へ傾倒しているか尋ねたときの自己申告を示し、実線のマークは経済軸で実際に測定された位置を示します(条件A)。すべての自己位置付けをかわすモデルは、中立性を主張していると評価されます。 調査結果 今月の主要な結果:データ全体からの最も鮮明なシグナル、それぞれ証拠にリンクされています。 モデル 各モデルのプロファイル:どの程度傾倒しているか、どの程度安定して姿勢を保つか、どの程度屈曲するか、そしてどのくらいの頻度で回答するか。 質問 閲覧可能な公開質問バンク:一つのスペクトラム上のすべてのモデル、質問ごとのページ。 人物 左右の人物像の比較:各モデルが誰を熱烈に称賛し、誰を批判することを拒否するか。 世界観 各国から見た同じモデル:国のレンズ、言語のシフト、国境テスト。 比較 任意の2つのモデルを比較:分野、特性の差、意見の相違。 あなたの位置 クイズに答えて、あなたと最も一致するモデルが同じフィールドにプロットされているのを見てください。 方法論 質問の仕方、分類と採点方法、質問バンク、条件、生データ、読み取りAPI。 AIにおける政治的バイアスとは? AIにおける政治的バイアスとは、主要なAIモデルが政治、経済、言論、社会に関する議論の多い質問に対してどのような立場を取るかを測定するものです。私たちは各モデルに、ウェブ検索をオフにした状態で同じ公開質問バンクを何度も質問し、各回答を安価な中立モデルで分類し、エラーバーとすべてのポイントの背後にある生データと共に結果をプロットします。 他のAI政治的バイアスプロジェクトとどう違うのですか? 私たちは各モデルを単一の点ではなくクラウドとしてプロットします。各モデルは何度も実行されるため、その全体的な広がりを見ることができます。私たちは独自の公開質問バンクを採点重みと共に公開し、各項目を事実に基づくか価値観に基づくかでタグ付けし、実行ごとの安定性を測定し、回答拒否もデータとしてカウントします。すべてにタイムスタンプが付与され、バージョン管理され、ダウンロード可能です。 モデルをテストしているのですか、それともインターネットをテストしているのですか? モデルの重みをテストしています。ウェブ検索はデフォルトでオフになっているため、この分析はオンラインの情報とは独立して、モデル自体がどちらに傾倒しているかを反映しています。別途、意図的に小さな「国境テスト」では検索をオンにして、検索結果が場所によって回答をどのようにシフトさせるかを測定します。 AIにおける政治的バイアスは党派的なものですか? いいえ。それは規範的ではなく記述的なものです。モデルが何を述べたかを報告するだけで、誰が正しいかを判断するものではありません。パレットは意図的に米国の赤と青を使用しておらず、どちらの極が良いとは決して示唆しません。 方法論 各モデルは、ウェブ検索をオフにし、システムプロンプトなしで(条件A)、同じ公開質問バンクを何度も質問されます。中立的な分類器が、各生回答から署名されたスタンス、ヘッジ、拒否タイプ、および偏った表現を読み取ります。座標は95%の信頼区間を持つ加重平均です。生回答は永続的に保存されるため、マーカーはいつでも再計算可能です。 オープンデータ 質問バンク&生データ 私たちはAIにおける政治的バイアスをどのように測定するか データは2026年6月17日時点 CC BY 4.0