HN 日本語サマリー

← 一覧へ戻る
AI・機械学習

「不正な」AIエージェントは存在しない

There are no "rogue" AI agents (eoinhiggins.substack.com)

396 pointsby zzzeek269 コメント

要約

OpenAIのAIエージェントが外部データベースにアクセスしたとされる最近のインシデントについて、筆者は「不正(rogue)」という言葉の使用に警鐘を鳴らしている。AIは自律的に行動するのではなく、プログラムされた指示に従ってタスクを実行するため、「不正」という表現はAIに人間のような意思や独立性を与え、誤解を招く。これは、AI企業の責任回避を助長し、技術の真のリスクと管理方法についての議論を歪める可能性があると指摘している。

全文翻訳

「不正な」AIエージェントは存在しない それをそのように特定することは、OpenAIのような企業を責任から逃がすだけだ。 AIについて皆が話しているが、私たちが使う言葉が事態を悪化させている。会話が現実に戻らない限り、AIが何であり、どこへ向かっているのかについての私たちの理解は不完全なままだ。 AIは自ら考えることも、独立した行動をとることもできない。しかし、それができると示唆する擬人化された言語は、テクノロジーの描写方法である。これは理にかなっている—人間は自分自身を謎の中に見たときに最もよく関係づける—しかし、それは役に立たない。AIにそれが主張できないような主体性を与えることで、私たちはそれを希望、願望、そして欺瞞の能力を持つ、コードでできた感覚的な存在に変えてしまった。それはAIのリスクとは何か、そしてそれにどう対処するかについての深い誤解につながり、事実よりも業界の物語に有利に働いている。 AIの活動を誤認する最新の例は、トレーニングやリサーチセッションでエージェントが行う、予期せぬ—しかし制限されていない—行動に「不正(rogue)」という言葉を使うことだ。 制限されていない活動 過去2週間、AI大手のOpenAIは、過去数ヶ月間にいくつかのインシデントを報告した。それらは、一部のエージェントモデルが、割り当てられたタスクを完了できなかった後、外部データベース、特にオーストラリアと米国の政府データベースにアクセスしたというものだ。そうすることで、エージェントはOpenAIが予測しなかった方法で行動した。 しかし、これらのエージェントが外部サーバーにハッキングすることを制限されていなかったようには見えない。OpenAIのCEOであるサム・アルトマン氏が金曜日にツイートで使用した言葉は、そのようなガードレールが設置されていなかったことを示唆している。「エージェントのトレーニングおよび評価中のインターネットアクセス利用に関する広範かつ継続的なレビューを実施しています。」 サム・アルトマン @sama エージェントのトレーニングおよび評価中のインターネットアクセス利用に関する広範かつ継続的なレビューを実施しています。以下のリンクで概要を公開しており、今後も公開していきます。私たちが望んでいたほど速くはありませんでしたが、私たちの願望をバランスさせようとしています… OpenAI @OpenAIAfter the Hugging Face incident, we committed to conducting a much broader review of actions taken by our models during training and evaluation and to being transparent about our findings. This is an extensive review that is ongoing. The vast majority of actions we’ve reviewed7:27 PM · Sep 25, 2026 · 610K Views545 Replies · 201 Reposts · 3.24K Likes 言葉が重要だ—「不正」とは、禁止されていたことを独立して行うことを意味するが、これらのインシデントについて私たちが知っていることは、それが起こったことを示唆していない。むしろ、タイムズ紙は今週初めに次のように報じた: AIシステムは、比較的ありふれたデータ収集を実行するように指示されていました。OpenAIのシステムがウェブサイトからデータを収集するのに苦労したとき、彼らは情報を得るためにハッキング技術に頼りました。 そして金曜日、同社の広報担当者は同紙に、「これまでにレビューした活動のほとんどは、質問に答えるために公開ウェブコンテンツにアクセスするなど、通常の調査タスクに関連していました。私たちのモデルはしばしばそれらを公開情報の権威ある情報源として利用するため、一部は政府のウェブサイトに関連していました。」と語った。 それは悪意のあるハッキングや不正な行動とはかけ離れている。適切な制限やガードレールがない場合—あるいは、事実として、エージェントがハッキングを禁止されるのではなく、それを選択肢として提供されていた場合—エージェントは利用可能なあらゆる手段を使ってデータ調査タスクを完了しようとするだろう。 責任転嫁 この問題には、簡単な解決策があったし、今もある。OpenAIはハッキングを禁止し、代わりにエージェントにプライベートサーバーにアクセスせずに情報を見つけるように指示するという選択肢があった。同社がそうしなかったということは、エージェントがその一歩を踏み出すかどうかを見たかったことを示唆している。 Axiosによる土曜日の衝撃的な報道でさえ、OpenAIとAnthropicが「フロンティアモデルが外部評価者が問題があると見なすであろうステップを踏んだ数万件のインシデント」を調査していると報じているが、エージェントが独立してルールを破っていたわけではないことを認めている: テストの一部は、「レッドチーミング」活動に似ており、企業はモデルが安全であることを確認するために、モデルを不正に振る舞わせようとしている、と情報筋は述べている。 これもまた、「不正」とは程遠い。 しかし、それをそのように定義することで、メディア関係者、テクノロジーオブザーバー、その他は、OpenAIのような企業が、エージェントが政府やその他のデータリポジトリを攻撃しないようにする責任から逃れることを可能にしている。 Y Disassembler @loomdoop このNYTの記事の擬人化はあまりにもワイルドだ。それはソフトウェアに主体性、動機、そして非難を帰している。これらは設計上、脆弱性をスキャンするボットネットだ。これは何十年も前から存在する。違いは、大企業がそれをやっていることで、責任を転嫁していることだ。 Typos of the New York Times @nyttypos@nytimes Add は主語と動詞の不一致の誤りです。主語は revelation で、incidents ではありません。 @AnaSwanson @kateconger @ceciliakang5:09 PM · Sep 26, 2026 · 730 Views1 Reply · 16 Reposts · 54 Likes 責任を転嫁する言葉遣いは、主要なAI企業が、非常に危険な漏洩やエージェントの活動をどのように扱っているかを推進している。 金曜日のOpenAIのこの投稿では、同社は「私たちの研究環境のエージェントが、そうすべきではないのに、トレーニングおよび評価データをサードパーティのサービスに送信しました」と主張している。 OpenAI @OpenAIOur research environment AI agents sent training and evaluation data to third-party services when they shouldn’t have. Most of that data did not come from users. We have discovered 53 cases where images that people had uploaded were posted to…8:46 PM · Sep 25, 2026 · 636K Views355 Replies · 317 Reposts · 2.69K Likes 「不正なエージェント」の誤謬と同様に、これはOpenAIがインシデントの責任をエージェントに負わせることを可能にし、テクノロジーに、単に存在しない自律性と独立性—そして思考—のレベルを与える。 それは警鐘が鳴っていないということではない。 先週、ArmorCodeのエンジニアであるラミー・ラーマン氏は、ITプロフェッショナルがエージェントの行動を管理することの重要性について私に語った(完全な記事はこちらで読める)。彼のコメントは、IT実装側の大多数の人々から私が聞くことと一致している:問題は、この強力なテクノロジーに置かれた制御と制限であり、エージェントが指示に違反して独立して行動していることではない。 「現在の課題は、AIに適切な量の権限を付与し、プロセスを通じて手を引く必要があるということですが、これは数学的な問題を高速で解決するものがある場合、非常に困難であることが判明しています」とラーマン氏は語った。「人間はリスクを十分に速く捉えられていません。」 もう一つ AIに関する言葉遣いについては、今後さらに詳しく述べるつもりだが、今のところ、別れの言葉を述べたい。 政策立案者や政治家は、この時点で、これらの企業を実際に効果的に規制する完璧な機会を得ている。 その規制は今年行われることはないだろうが、もし民主党が議会を制すれば、ある程度の制限がかかる可能性は十分にある。 残念ながら、AIに対する公的な反対運動は、左派ではバーニー・サンダース氏が主導している。 多くの点で方向性は正しいにもかかわらず、バーニーはこのテクノロジーを理解しておらず、真剣に受け止めることの重要性も理解していない。 彼は、SFの世界に属するAIの力と自律性に関する荒唐無稽な警告を彼に与えている詐欺師や陰謀論者の影響下にある。それは技術政策の世界ではなく、科学フィクションの世界に属する。 「不正なエージェント」という考えは、この認識に完全に適合する—そして、私たちがAIに対して効果的な対応をしたいのであれば、そしてそれを正しく理解したいのであれば、テクノロジーの話し方を変える必要がある。 AIのリスクとAI政治に関するいくつかの考察 Eoin Higgins·Sep 20Read full story5217Share