AI・機械学習
エミリー・ベンダー、「確率的オウム」について改めて説明する
Emily Bender Sets the Record Straight on "Stochastic Parrots" (spectrum.ieee.org)
要約
計算言語学者のエミリー・ベンダー氏は、影響力のある論文「確率的オウムの危険性について」の共著者として、大規模言語モデル(LLM)が単語の統計的な予測によってテキストを生成する仕組みについて、5年後の現在、ChatGPTなどの普及を背景に、その誤解を解くためのインタビューに応じました。ベンダー氏は、「確率的オウム」という比喩はLLMに特化したものであり、AI全般を指すものではないこと、またこの言葉は侮辱ではなく、システムの仕組みを説明するためのものであると強調しています。
全文翻訳
AIインタビュー
エミリー・ベンダー、「確率的オウム」について改めて説明する
5年後、その筆頭著者はChatGPT時代の論文を振り返る
Gwendolyn Rak
2026年6月30日
7分読了
Gwendolyn RakはIEEE Spectrumのアシスタントエディターで、家電製品とキャリアを担当しています。
ワシントン大学の計算言語学者であるエミリー・ベンダー氏は、2021年の影響力のある論文「確率的オウムの危険性について」の共著者です。Nicole Millman; 出典: Susan Doupé Photography
2021年3月、4人の研究者グループ—言語学者とコンピューター科学者の共同研究—が、その伝説となった論文「確率的オウムの危険性について:言語モデルは大きすぎることがあり得るか?🦜」を発表しました。この論文は当時大きな注目を集めました(その一部は、Googleが発表の直前に著者2名、ティムニット・ゲブルとマーガレット・ミッチェルを解雇したためです)。論文は、大規模言語モデル(LLM)が、理解しているわけではなく、単語の統計的に可能性の高いシーケンスを予測することによってテキストを生成すると主張しました。このプロセスを著者は「確率的オウム」という比喩で捉えました。これは、理解なしにパターンを繰り返すシステムです。そして過去5年間、この比喩は、それが生まれた学術分野をはるかに超えて広がり、議論を巻き起こし、「確率的オウム」という名前の肩掛けロボットのようなプロジェクトを刺激しました。しかし、そのより広い使用法は、言葉が元々何を意味していたのかについての誤解も生んでいます。筆頭著者のエミリー・M・ベンダー氏は、ワシントン大学の計算言語学教授であり、最近、論文の5周年を機に、論文に関する一般的な誤解を否定するためのブログ記事を書きました。ベンダー氏は、これらの誤解、計算言語学の分野、そして人工知能を取り巻く現在の議論についてIEEE Spectrumに語りました。
「人工知能」という言葉の何が問題なのか
計算言語学者としてのあなたの仕事はどのように説明しますか?
エミリー・M・ベンダー:言語学は、非常に一般的に言えば、言語がどのように機能するか、そして私たちが言語をどのように扱うかの研究です。私はそれに貢献しており、計算言語学でも活動しており、言語技術を構築していく学生を育成しています。言語技術は、誰かがそれを人工知能プロジェクトに使用したいかどうかに関係なく、それ自体で価値があり興味深いものです。言語技術には、自動文字起こし、機械翻訳、スペルチェックなどが含まれます。そして、私が個人的に物事を構築する際に、私の仕事の多くは、コンピューターで読み取り可能でありながら人間にも読み取り可能な文法を構築することに関係しており、それは異なる言語の言語現象をモデル化します。それは、言語仮説のテストのためにコンピューターを使用することについてです。
あなたは、「人工知能」という言葉は、明確にするよりも曖昧にすると主張しています。なぜですか?
ベンダー:多くの理由があります。テクノロジーについて良い議論をしたり、それについて賢明な決定を下したりすることが困難になると思います。なぜなら、私たちがそれについて話す方法が、テクノロジーが何であるかを明確にしないからです。「人工知能」という言葉は、異質な技術をグループ化し、それぞれの技術ができることを過大評価しています。したがって、何かを使用するかどうか、または何かを規制するかどうかを決定しようとしている場合、より明確な説明がある方がはるかに良いです。
一般的な会話では、AIはほぼ「チャットボット」または「LLM」と同義になっています。それは問題ですか?
ベンダー:多くの人々は、「私はそれを〜のために使います」と言います。それで、「それ」とは何を意味しますか?そして彼らは、「ああ、Claude」とかChatGPTとかGeminiのことです、とチャットボットについて話しているのです。しかし、他の人々は、「アルファフォールドがあるのに、AIがすべて悪いとは言えません」と言うでしょう。ですから、はい、多くの人々は大規模言語モデルの上に構築されたチャットボットについて話していますが、それらがアルファフォールドのようなものとは別のものであることを本当に明確にしていません。そして、「科学者がAIを使って新薬を発見した」というニュース報道がある場合、彼らは何を使ったのでしょうか?もし彼らが話しているのが、もっと狭い何か、おそらくタンパク質折り畳み、おそらく気象モデリングのような他の種類の統計モデリングであれば。それはChatGPTとは非常に異なる種類のテクノロジーです。
「人工知能」のような包括的な用語には価値があると思いますか?
ベンダー:まあ、それを売ろうとしている人々—つまり、評価額を上げようとしているテクノロジー企業にとっては価値があります。また、現在の研究資金の仕組みでは、自分のやっていることを人工知能と呼ばないと資金を得るのが非常に難しいです。私はそれを全体としてマイナスだと考えていますが、そのシステムに閉じ込められた個々の人にとっては、その瞬間には価値があるかもしれません。
確率的オウムはどのように誤解されてきたか
「確率的オウム」という比喩に関する最も一般的な誤解は何ですか?
ベンダー:最も大きな誤解の一つは、「ベンダーはAIは確率的オウムだと言っている」ということです。あの論文は2020年末に書かれました。私たちは大規模言語モデルについて話していました。AIという言葉は、最後の最後に一度だけしか出てこないと思います。それは、もしあなたが人間のやることのようなことをするシステムを開発するつもりなら、人間に間違われる可能性のあるものを作り出さないように非常に注意しなければならない、ということについて話していました。これらのシステムが私たちの言語の使い方を模倣するように設計されているという事実は、人々がそれらを他の人と間違えやすくします。それで、論文の最後の方で、私たちはAIに一般化しました。しかし、「確率的オウム」という言葉は、特に大規模言語モデルを指しており、「人工知能」という言葉は多くの異なるものを指します。ですから、チェスエンジンやアルファフォールド、画像ラベリングシステム、機械翻訳システムなど、人工知能と呼ばれることがあるもののどれもが確率的オウムであると主張したことは一度もありません。私たちは特に、合成テキストを生成するために大規模言語モデルを使用することについて話していました。
もう一つは、「確率的オウム」という言葉が他の人によって拾われ、軽視または侮辱として解釈されたことです。それはそのようには意図されていませんでした。他の人がそのように使っているかもしれませんが、それは私が意図したものではありません。なぜなら、それはこれらのシステムが実際に何であるかの単なる説明だからです。それを侮辱と見なすには、大規模言語モデルが侮辱を受ける可能性のある種類の存在であるという信念、それはそうではありませんが、あるいはこれらの大規模言語モデルが、私が人工知能という壮大な理想へのステップとして理解されるべきであるという信念が必要です。私が多くの場所で行ってきたこと—タコ思考実験、確率的オウム、そして「合成テキスト生成マシン」という言葉—はすべて、言語技術を構築するビジネスに携わっていない人々に、これらのシステムが実際に行っていることを鮮明に伝えるためのものです。それはシステムを侮辱したり、システムを気に入っている人々を侮辱したりすることとは同じではありません。
関連:チャットボットの大論争:彼らは本当に理解しているのか?
知らない読者のために、「タコテスト」は、タコが海底ケーブルを通過するメッセージ内の統計的パターンを認識することを想像した2020年の論文に由来します。タコ思考実験と確率的オウムで、あなたは動物の比喩を何度か使用していますね。それは意図的ですか?
ベンダー:いいえ、意図的ではありません。タコ思考実験では、当初、イルカの話をしていました。なぜなら、イルカは明らかに知的な動物だからです。その論文の私の共著者であるアレクサンダー・コラーは、タコにすべきだと言いました。なぜなら、まず第一に、タコが生息する環境は、人々が住む場所とははるかに異なるからです。それは比喩をより鮮やかにします。タコはケーブルのパルスを感じているだけで、人々が見ているものを見る方法がありません。しかし、タコは単に本質的に面白いからです。
その論文を見返していて、「確率的オウム」という言葉が実際には本文中に2回しか登場しないことに驚きました。なぜタイトルに含めたのですか?
ベンダー:気に入ったからです!そしてキャッチーだからです。