HN 日本語サマリー

← 一覧へ戻る
AI・機械学習

エージェントを管理するのは誰か?

Who manages the agents? (off-policy.com)

52 pointsby GavCo41 コメント

要約

AIの未来には、少数の「聖職者」がAIを管理し、大衆を依存させる未来と、AIが人間の能力を増幅し、誰もが自らのエージェントを指示できるようになる未来の二通りがある。現状では、AIの恩恵は一部の専門家や企業に集中し、一般ユーザーとの格差が拡大している。この格差は、AIの恩恵を一部に限定するのではなく、より広範な人々がAIを使いこなし、その恩恵を受けられるようにするための方法を模索する必要性を示唆している。

全文翻訳

AIの二つの未来 未来には二つのビジョンがある。一つは、少数の聖職者によって構築・管理される神のようなAI、もう一つは、人間を中心に据え、AIを増幅器として利用するビジョンである。 新たな技術的聖職者が現れつつある。それは、最先端システムを構築し、それらへの特権的なアクセスを受け、他のすべての人々が利用できる能力を決定する少数の人々である。聖職者たちは大量失業について警告している。 Dario Amodeiは、AIが5年以内(2025年5月)に初級ホワイトカラー職の半分をなくす可能性があると警告した。Sam Altmanは、AIはカスタマーサポートの仕事を「完全に、完全に終わらせる」と述べた(2025年7月)。Mustafa Suleymanは、ほとんどのコンピューターベースの専門職が18ヶ月以内(2026年5月)に完全に自動化されると予測した。Elon Muskは、その救済策として「普遍的最低所得」を提案した(2026年4月)。 彼らは、それが必ずしも悪い結果につながるとは考えていない。人々を単調な作業から解放することは、余暇活動を追求するための時間を解放することができる。平均的な人間は、大量失業を壊滅的なものとして聞く。彼らはどうやって家賃を払い、子供たちのために食べ物を買うのか?私たちは、豊かさ、再分配、そして新しい意味の形態がそれを補償してくれると保証されている。 Sam Altmanの「万物のためのムーアの法則」(2021年)は、「所有権と富を直接市民に分配する」ことを約束し、彼の「優しいシンギュラリティ」(2025年)は知能が「驚くほど豊富になる」と予見している。Dario Amodeiの「愛の機械」(2024年)は、失業後の仕事と意味について論じている。 それは、機械とその管理者たちの恩恵によるものである。ごく少数の人々が、機械知能と他のすべての人々との仲介者となる。人類は、その知能を方向付けることや、どのように使用されるべきかを決定することに広く参加しない。ほとんどの人々は、決定、製品、そして豊かさの受領者となる。参加者ではない。当初は聖職者が機械を管理するかもしれない。しかし、その能力が彼ら自身の能力を超えてくると、どちらがどちらを指示しているのか不明瞭になってくる。このビジョンでは、彼らは神を構築し、ますます彼らの役割はそれを世話をし、解釈し、誰がそれに近づくことを許可されるかを決定することになる。 もう一つの道がある。それは、数十億の受動的なユーザーを支配する単一の中央知能ではなく、数十億の人類が自分自身の有能なエージェントを指示することを学ぶ道である。 未来は不均一に分布している 聖職者たちは、槍の先端を鋭くし、より困難な領域を貫くことに熱狂的に集中している。それは、100年以上前の数学の問題を解決すること(2026年1月、エルドシュ問題#728は、AI(GPT-5.2 ProとHarmonicのAristotle、Leanで形式化)によって完全に自律的に解決された最初のエルドシュ問題となった。2026年5月、OpenAIのモデルは80年間未解決だったエルドシュ問題を解決した)、そして30年間発見されていなかったソフトウェアの脆弱性を見つけることである(AnthropicのFrontier Red Teamは、Claude Opus 4.6が、長年発見されていなかったものも含め、激しくファズされた本番環境のオープンソースコードで500以上の高深刻度脆弱性を発見したと報告した。Claude Mythos Previewは、27年前のOpenBSDのバグを含む、すべての主要OSとブラウザで数千のゼロデイを発見した)。 彼らは間違いなく病気を治癒するだろう(Demis Hassabisは60 Minutesで(2025年4月)、「10年かそこらで」病気の終焉が「手の届くところにある」と述べた。彼のIsomorphic Labsは、「すべての病気を解決する」ために21億ドルを調達した(2026年5月))。そして莫大な価値と富を生み出すだろう。しかし、癌の治療法や老化の治療法に誰がアクセスできるのだろうか? 薬物発見能力は、生物兵器のリスクのために制限されている(AnthropicはClaude Opus 4でASL-3保護を有効にし、CBRN兵器のリスクを制限するために生物学関連の能力を制約する分類器を展開した。このパターンはClaude 5世代でさらに深まった。Fable 5はデュアルユース能力に安全分類器を搭載して出荷されるが、無制限のMythosは承認された組織のみが利用可能である)。ソフトウェア能力はサイバーリスクのために制限されている。次に何が来るかを見るのは難しくない。数学能力は暗号リスクのために制限され、創造的能力は偽情報リスクのために制限される(OpenAIは、SAG-AFTRAや有名人の遺族からのディープフェイク苦情(2025年10月)を受けて、肖像権のオプトイン同意をSoraに制限した。NewsGuardは、Soraがテストされた20の虚偽主張のうち16を進展させる動画を生成したと発見した。EU AI法第50条のディープフェイク開示義務は2026年8月に施行される)。 政府はこれらの制限の多くを要求し、フロンティアラボはしばしばそれらを支持した(GPT-5.6のローンチに先立ち、OpenAIは米国政府にモデルの能力をプロアクティブにプレビューした。モデルは生物学とサイバーセキュリティの両方でOpenAI初の「高」リスクと評価され、ロールアウトは約20の政府承認パートナーで開始された(Forbes))。同時に、選ばれたパートナー、研究者、機関は能力へのアクセスを保持した(AnthropicのProject Glasswingは当初、Mythos Previewを少数の重要な業界パートナーとオープンソース開発者に限定していた。Fable 5が一般利用可能になった後、米国輸出管理命令によりAnthropicはFable 5とMythos 5を世界中で無効にせざるを得なくなった。禁止が解除されると、Mythos 5は政府承認組織のみに復帰した。OpenAIのGPT-5.6も同様の形状をたどった。一般利用可能になる前に約20のパートナーに対する政府要求による限定プレビューが、7月9日に実施された)。 その結果、二層システムが始まりつつある。少数のためのフロンティアAI、他のすべての人々のための制約されたAIである。強力な能力を普遍的に利用可能にすることには、現実の危険がある。生物学的安全性は現実である。サイバーセキュリティは現実である。偽情報は現実である。しかし、真の安全上の懸念が排除と永続的な依存につながるべきではない。 フロンティアは急速に進んでいる。中央値は停滞している。大多数の人々は、常に鋭くされた槍の使い方を知らない。 ソフトウェア開発は未来の垣間見せを与えてくれる。なぜなら、ソフトウェア開発者は他のすべての人々より1年早くAIエージェントを手に入れたからだ(Cursorは2024年11月に最初のエージェントモードを出荷し、Anthropicは2025年2月にClaude Codeをリリースした。一般知識労働者は、2026年1月に「Claude Code for the rest of your work」としてClaude Coworkがローンチされたときに、同等のものを手に入れた)。当初、エージェントとの作業で最も効果的だった開発者、つまりスーパーユーザーは、生産性がおそらく2倍だった。過去1年半で、それは着実に5倍、次に10倍に増加した。現在、最高のエージェント開発者は100倍を超えており、数年かかったコードベースの大規模な書き換えを数日でこなしている(Bun、535,496行のZigは、最大64のClaude Codeインスタンスを同時に監視する1人のエンジニアによって11日間でRustに書き換えられ、6,755コミットのプルリクエストはすべてのプラットフォームで完全なテストスイートを通過した。手作業で行った場合のJarred Sumnerの推定値は、エンジニア約3人で約1年、約750エンジニア日を11日に圧縮した)。私は集中的なコーディングの週末にNanoClawを作成した(最初のコミット:2026年1月31日土曜日。翌日Hacker Newsでローンチされた)。プロジェクトのコード行数は少ないが、私がほとんどまたは全く経験のない多くの技術(Baileys、SQLite、Appleコンテナ、IPC)をカバーしている。金曜日の夜の知識から始めて、AIなしでこれを構築するには6〜8ヶ月かかっただろう。より現実的には、私は決してそれを完了できなかっただろう。しかし、それらの開発者はほんの一握りである。私の感覚では、100倍に達したのは1%未満である。中央値の開発者は、意味のある増加を全く得ていない(METRのランダム化試験では、経験豊富な開発者は2025年初頭にAIツールで19%遅くなったことが判明した。2026年2月のフォローアップでは、わずかな速度向上について「非常に弱い証拠」しか見つからなかった)。彼らはまだ1倍の丸め誤差の範囲内にいる。毎週、モデルや機能の新しいリリースがある。4.6、4.8、5.5、Fable、Sol。Hooks、Skills、loops、workflows。リリースごとにスーパーユーザーは新しいレベルをアンロックするが、中央値はますます混乱し、ギャップは拡大し続ける。コーディングエージェントで開発者に起こったのと同じことが、労働力全体でも起こり始めている。すでに10倍のセールスマン、100倍のマーケターについて聞いている(Anthropic自身のケーススタディでは、単一のグロースマーケターが同社の製品を運用している様子が説明されている)。