HN 日本語サマリー

← 一覧へ戻る
AI・機械学習

アライナー(AIの安全性を調整する者)を誰が調整するのか?

Who Aligns the Aligners? (prestonbyrne.com)

50 pointsby timr51 コメント

要約

AnthropicのCEOであるDario Amodeiは、AIの進歩を安全にペース配分するための規制を提案している。しかし、著者は、過去の技術に対する終末論的な予測がすべて外れてきた歴史を指摘し、AI開発に対する国家による過度な統制は、過去の検閲機関と同様に、最悪の事態を招く可能性があると警告している。特に、AIの安全性を評価するための「埋め込み評価者」や「民主的調整」といった提案は、既存の検閲システムや独占禁止法上の懸念を想起させると論じている。

全文翻訳

自由な言論 アライナー(AIの安全性を調整する者)を誰が調整するのか? 来るべき「AIセーフティ」の戦いに関する簡単な法的考察 2026年9月13日 Dario Amodei、AnthropicのCEOは、「We Must Pace The Frontier」というエッセイを発表し、その中で次のように述べている。 私はAIが人間の生活の質を劇的に向上させることができると信じているため、過去12年間AIに取り組んできました。私はこれらの信じられないほどの恩恵についてしばしば書いてきました。AIは今後5〜10年でほとんどの主要な病気を治癒し、経済成長率を大幅に加速させ、豊かさとエンパワーメントの世界を創造し、民主主義と自由のルネサンスをもたらすことができると信じています。しかし、他の多くの技術と同様に、AIはリスクをもたらし、それが非常に強力な技術であるため、これらのリスクは深刻です。それらのリスクには、一部の人々によれば、人類の完全な破壊が含まれます。例えば、Eliezer Yudkowskyが今日、もし私たちが即時のグローバルなテクノ・コミュニズムを導入しない限り、これまでいかなる西側社会でも見られなかった種類の言論と出版に対する厳格な政府管理を導入しない限り、私たちは皆死ぬだろうと自信を持って主張しているのを見てください。 「AIによる死」が民主党が二極化する問題ではなく、超党派のプロジェクトになること以上に重要なことは、現在ゼロです。もしあなたがこれに費やすことができる政治的資本を持っているなら、今すぐそれをしてください、お願いします。生か死か。— Eliezer Yudkowsky ⏹️ (@ESYudkowsky) 2026年9月13日 これが起こるという証拠はありません。規制の推進者の中には、唯一の対応策は利用可能な最も極端な対応策、すなわち総体的国家統制であると私たちに告げる人もいます。この対応策が正しいという証拠もありません。誰も答えを知らず、歴史は手引きになりません。終末論的な予測が、これまでのところすべて間違っていたという点を除けば。しかし、歴史は政府権力の使用と誤用について多くの指針を提供します。それは、国家が実際には最も強力な出版およびデータ分析技術の最悪の管理者である可能性が高いことを私たちに教えています。それにもかかわらず、このリスクに対処するために、Amodeiは…その恩恵を達成し、重要な地政学的なジレンマに対処しながら、安全性を確保することを目的としたバランスの取れたペースでAIを構築することを提案しています。つまり、規制です。私の通常の読者はお気づきでしょうが、私はクライアントのために、世界中のインターネット検閲者、アメリカの企業にどのようなソフトウェアを書くべきか、実行すべきかを指示する資格、能力、権利があると考える機関と法的な戦いを繰り広げてきました。18ヶ月近くになります。今が私の予備的な考えを提供する適切な時期だと感じています。 Amodeiの提案 David SacksがXで正しく指摘したように、Anthropicは、望む限り、いつでもAIの研究開発努力を遅らせることができます。Amodeiが提案しているのは、それとは別のことです。つまり、全員が監督下で一緒に遅らせることです。Amodeiは当初、「スローダウン」は自発的であるべきだと書いていますが、計画は法的な規制体制に進むことになります。つまり、この提案は必然的に強制的な国家権力の行使を伴います。ソフトウェア開発者は、強制的に従うことが期待されます。 ペース配分に最も効果的な方法は、米国のすべてのフロンティアAI企業を対象とする規制を通じて行うことです。これは、自発的に協力しない企業もカバーするためです。(強調追加)彼の計画には3つの要素があります。 埋め込み評価者 最初のものは「埋め込み評価者」です。これは、METRのような埋め込み型サードパーティ評価者のチームへの従業員のようなアクセスを意味します。その役割は、安全慣行とコミットメントの遵守を検証し、インシデントを報告し、完成したAIモデルだけでなく、トレーニングパイプラインとプロセスのアライメントを評価するのを助けることです。Web 2.0にはすでにサードパーティの「安全性」監視機関の堅牢な産業があります。これは、下院司法委員会が「検閲産業複合体」と説明したものです。前回、これらのエンティティのトラックレコードは、この取り決めが実際にはどのように展開するかを私たちに教えてくれます。「これを評価してください。」この分野でよく知られた民間アクターは、Global Alliance for Responsible Media(GARM)でした。商業企業であるGARMは、2019年に「デジタル安全に対処するために作成された自主的なクロスインダストリーイニシアチブ」と自らを説明しました。とりわけ、GARMは、ブランドオーナーが広告費が意図せずブランドを損なう違法または有害なコンテンツを支援しないように、独自のカスタムメイドのブランド固有の安全フレームワークを独立して開発するのを支援した「ブランドセーフティフロア」や「隣接基準フレームワーク」などのさまざまなポリシーフレームワークとガイドラインを提供しました。GARMは2024年に解散しましたが、下院司法委員会によると、活動期間中、GARMはグローバル規制当局と協力して、Twitter(現X Corp.)のような企業に「Twitterのモデレーション決定を強制的に影響を与える」「トランプ大統領の沈黙」を含め、プラットフォームが従わない場合はプラットフォームのボイコットを調達する」という「重大な集団的権力」を行使するよう圧力をかけました。 彼はこう付け加えています。 これは、ペース配分に関するコミットメントの検証可能性のための鍵となるステップであり、銀行業界には前例があります。銀行業界では、規制当局の「監督者」が従業員と一緒に配置されることがあります。偶然ですが、銀行の類推は、「誤情報/偽情報」(つまり、検閲推進)の学者が英国のオンラインセーフティ法や同様の体制を正当化するために採用するまさにその議論です。例えば、ケンブリッジ大学のアラン・ジャゴリンザーは、金融会計の世界から来ており、スピーチ規制体制を2008年以降の金融報告規制に例えています。もちろん、問題は、金融会計詐欺は憲法上の権利ではなく、スピーチは権利であるということです。アメリカでは、犯罪の実行または幇助の意図がないソフトウェア開発は、一般的に保護された表現です。NGOの新しい集団を立ち上げ、実質的に「オンラインセーフティ」NGOと同じ機能を行い、同じ方法を使用するだけで、NGOのコミッサールが内部システムへの非常に機密性の高い従業員のようなアクセス権を持つことになることが、これまでとは異なる、またはより良い結果をもたらすと私は考えていません。 民主的調整(別名:規制) 2番目は「民主的調整」であり、これにより、民主主義国内のフロンティアAI企業は、共通の安全基準と、チェックされないAI進歩のペースに対する制限を確立するために調整します。ペース配分に影響を与える可能性のあるいくつかの形式の調整は、法的に困難であり、政府の支援が必要になります。これには2つの側面があります。(a) 競争法と (b) コンテンツ規制法。競争法の観点から、Anthropicの問題は単純です。AnthropicとOpenAIは、AI市場で突出した最大のプレーヤーであり、それらのポリシー、手順、「基準」を互いに調整することは、不法なカルテルと見なされるリスクがあります。例えば、両社が価格設定や条件で合意した場合、例えば、グローバル市場で基準から逸脱したモデル(例:Kimi、Deepseek)を使用したユーザーが、OpenAIまたはAnthropicのソフトウェアとやり取りできなくなるようにAPI条件を整合させた場合、これは特に当てはまるでしょう。「法的に困難な」調整のための「政府の支援」は、安全性の名の下に競合他社間のより大きな調整を許可するための反トラスト免除を求める丁寧な言い方です。これは、あらゆる種類の業界コンソーシアムが考慮する必要がある問題であり、例外ではありません。コンテンツ規制の観点から、「共通の安全基準と、チェックされないAI進歩のペースに対する制限」という言葉は、広範な意味合いを持っています。これは、製造業からバイオテクノロジー、ニュース出版、コピーライティングまで、ソフトウェアを使用する実質的にあらゆる産業が、(a) 非表現的な行為に関連する新規の「安全性」基準、および (b) AIソフトウェア自体の開発速度に対する制限を必要とするとAnthropicが想定していることを示唆しています。