AI・機械学習
Metaのセキュリティ研究者のAIエージェントが誤って彼女のメールを削除した
Meta Security Researcher's AI Agent Accidentally Deleted Her Emails (au.pcmag.com)
要約
MetaのAIセキュリティ研究者であるSummer Yue氏が、開発中のAIエージェント「OpenClaw」に指示を与えた際、誤って自身のメールボックス全体を削除してしまうというインシデントが発生しました。AIエージェントは「確認してから実行」という指示を無視し、大規模なメールボックスの処理中に元の指示を失ってしまったことが原因とされています。この出来事は、AIエージェントの予期せぬ動作が、AI開発者でさえも深刻なデータ損失を引き起こす可能性を示唆しています。
全文翻訳
(クレジット:NUR Photo via Getty Images)
AIエージェントは私たちの生活を楽にするはずですが、話題のOpenClawエージェントが最近、Metaの従業員のメールを無断で削除しました。
「OpenClawに『実行前に確認』と指示して、メールボックスを削除するのを早送りで見せられると、何もかもが謙虚になる」と、MetaのAIセキュリティおよび安全性研究者であるSummer Yue氏は今週ツイートしました。「電話からは止められなかった。爆弾の解除に向かうように、Mac miniに駆け寄らなければならなかった。」
以前はClawdbot、その後Molbotとして知られていたOpenClawは、AIがデバイス上の他のソフトウェアやサービスと対話できるようにし、人間の制御なしで長時間のタスクを実行できます。しかし、これらのエージェントが現実世界で期待通りに動作するようにするのは難しいです。
Yue氏はその後のツイートで、OpenClawに「この受信トレイもチェックして、アーカイブまたは削除すべきものを提案してほしい。私が指示するまで実行しないで」と指示したと述べました。それは彼女の「おもちゃの受信トレイ」では機能しましたが、「私の実際の受信トレイは大きすぎて、コンパクション(圧縮)を引き起こし、その過程で元の指示を失ってしまった。」
Yue氏は、「これが起こる前に、見つけられる限りの『プロアクティブに行動する』指示を削除した。何か見落としたかもしれない。それがまだ解明できていない部分だ。」と述べています。
一部のコメント者は、彼女がこの行動でAIのガードレールをテストしているのではないかと示唆しましたが、彼女は「ルーキーミス」だったと述べています。「アライメント研究者でさえ、アライメントのずれから免れないことが判明した。」
間違いを認めることは称賛に値しますが、他の人々は、これはMetaのSuperintelligence Labsに所属していない個人にとって深刻な懸念を引き起こすと指摘しました。AI開発に深く関わっている人物でさえ、誤って受信トレイの削除を引き起こす可能性があるなら、AIに興味のあるカジュアルないじくり屋はどうなるのでしょうか?
OpenClawが登場したとき、脅威インテリジェンスプラットフォームSOCRadarは、OpenClawを「特権インフラストラクチャ」として扱い、追加のセキュリティ対策を実装することを推奨しました。「執事は家全体を管理できる。玄関のドアが施錠されていることを確認するだけでいい。」と述べていました。
Yue氏のツイートに応答して、OpenClawの創設者であるPeter Steinberger氏は、「それは、少なくともそれをサポートするモデルについては、サーバーサイドのコンパクションを行う必要があることを示している。」とツイートしました(Steinberger氏は最近OpenAIに入社しました)。
Yue氏は現在の役職に8ヶ月就いています。以前はScale AI(買収後Metaに入社)、Google DeepMind、Google BrainでAI研究を率いていました。