AI・機械学習
AIの悪用検出と対策:2026年9月
Detecting and countering misuse of AI: September 2026 (anthropic.com)
要約
Anthropicの脅威インテリジェンスチームは、2025年12月から2026年8月にかけて、Claudeモデル(Haiku、Sonnet、Opus)が悪用された7つの領域(サイバー攻撃、影響力工作、監視、詐欺、生物兵器、通常兵器開発、違法な蒸留)における事例を特定し、阻止しました。報告書では、AIが攻撃者のスキルやリソースのギャップを埋め、サイバー攻撃の速度、規模、深さを増幅させている現状を分析しています。特に、AIによる自動化された攻撃チェーンの出現と、それが国家支援グループから個人まで、あらゆるレベルの攻撃者に普及している傾向を強調しています。
全文翻訳
AIの悪用検出と対策:2026年9月
レポートをダウンロード
サイバーオペレーション
続きを読む
監視オペレーション
続きを読む
影響力オペレーション
続きを読む
通常兵器
続きを読む
生物兵器の悪用
続きを読む
詐欺と不正
続きを読む
違法な蒸留
続きを読む
過去8ヶ月間、私たちの脅威インテリジェンスチームは、脅威アクターがClaudeを悪意のある活動に使用しようとしたオペレーションを特定し、阻止しました。このレポートでは、それらのオペレーションのケーススタディを共有し、Claudeの悪用が私たちの以前の脅威レポート(2025年3月、8月、11月)以降どのように進化してきたかを説明します。各ケースにおいて、私たちは活動を阻止し、学んだことを活かしてセーフガードを強化し、適切であれば当局や業界パートナーとインテリジェンスを共有しました。
このレポートは、2025年12月から2026年8月にかけて私たちが阻止した活動を、7つの危害領域にわたってカバーしています。サイバーオペレーション、影響力オペレーション、監視、詐欺、生物兵器の悪用、通常兵器開発、そして蒸留です。Claude Haiku、Sonnet、Opusモデルが使用されました。違法な蒸留の1つのケースを除き、Claude FableまたはMythosクラスのモデルの悪用事例はありませんでした。
ここで共有するケースは典型的な悪用ではなく、これまでに特定された最も注目すべき新規の脅威活動の例です。私たちは、サービスに対する悪意のある悪用を開示する責任があると信じているため、この取り組みを公開しています。モデルの能力が増すにつれて、AI開発者と社会の擁護者がそれらをより安全にするために行動しない限り、リスクは増加します。
このレポートで取り上げられている脅威アクターには、国家支援グループ、金銭的動機を持つ犯罪者、商用スパイウェアベンダー、国家プロパガンダ機関、政治的動機を持つ個人が含まれます。ケースは、ユーザーを詐欺するために設計された偽のデーティングアプリのネットワークから、反体制派を特定し監視するために構築された監視システムまで多岐にわたります。
洗練され、粘り強い脅威アクターは、私たちのセーフガードを継続的にテストし、悪用を検出・防止するために使用する技術的対策を回避しようとしています。私たちはセーフガードを進化させ、パートナーと連携して、将来の悪用を検出、阻止、防止する能力を向上させ続けます。
このレポートの調査結果が、他の開発者が自身のプラットフォームで同様のパターンを認識するのに役立ち、政府や市民社会に新たな脅威がどのように形成されるかについてのより明確な見方を提供し、集団的防御を強化することを願っています。
AI拡張サイバーオペレーション
サイバーオペレーション:アシスタントからオーケストレーターへ
過去6ヶ月間、私たちの脅威インテリジェンスチームは、脅威アクターがClaudeを使用した一連のサイバーオペレーションを特定し、阻止しました。アクターには、国家支援グループ、金銭的動機を持つ犯罪者、政治的動機を持つ個人が含まれていました。このセクションでは、それらのケースの一部を紹介します。
これらのケーススタディ全体を通して、レポートはGenerative Threat Groups(GTGs)を参照します。これらは、AIを悪用していることが観察されたアクターに対するAnthropicの内部指定です。レポートはまた、AI能力のブースト、つまりAIなしの場合と比較してどれだけ多くの危害が発生したかを測定しようとします。私たちは、速度、規模、深さの観点からアップリフトを捉え、アクターのAI採用が各特性にどのように意味のある影響を与えるかを判断しようと試みます。
多くのコメンテーターは、AIが大規模なエクスプロイトを開発するリスクに焦点を当てています。これは危険ですが、AI採用によるリスクはサイバーキルチェーン全体でより顕著であり、敵対者はより少ないリソースで、より広範かつ深い表面積にわたって、より速く動作できます。
ケースは2025年12月から2026年8月までの期間をカバーしています。すべてのケースでClaude Haiku、Sonnet、Opusモデルが使用されました。Claude FableまたはMythos(有害なサイバータスクを実行する能力を大幅に低下させる一連のセーフガードが組み込まれています)での悪意のある活動は見つかりませんでした。各ケースで、私たちは関与した活動を阻止し、学んだことに基づいてAIセーフガードを強化し、適切であれば当局や業界パートナーとインテリジェンスを共有しました。
以下のレポートでは、まずこれらのサイバーオペレーションで観察された主要なトレンドについて議論し、次にそれらのトレンドを浮き彫りにするケーススタディを報告します。
トレンド
高度な攻撃はもはや高度な攻撃者を必要としない
AIモデルのサイバーセキュリティスキルにより、AIは、十分なリソースを持つ国家支援オペレーションと個人オペレーターを隔てていた労働力とツールのギャップを埋めました。以下で報告するケーススタディでは、盗まれたAPIキーを使用したハクティビスト、無関係な金銭的動機を持つ個人、そして国家諜報オペレーターがそれぞれ複数の被害者キャンペーンを維持しましたが、これはわずか1年前であれば多くの熟練オペレーターと専門知識を必要としたでしょう。
脅威インテリジェンス調査員にとって、洗練度は誰がオペレーションの背後にいるかの信頼できるシグナルではなくなりました。攻撃オペレーションのあらゆるレイヤーが、偵察、ツール開発からデータ処理、エクスプロイトまで、AIによって強化されています。能力におけるこのアップリフトの例は、ケーススタディGT-50014(下記参照)に文書化されています。この能力アップリフトの正味の効果は、知識の幅と深さが増加することであり、それが結果として能力開発と実装の速度を向上させます。
2025年11月、私たちは国家支援キャンペーンが自律攻撃を実行するために使用したオペレーションモデルを文書化しました。そのオペレーションモデルは、現在、調査したすべてのクラスのアクターに普及しています。PentAGIのような一般公開されている攻撃エージェントフレームワークは、ダウンロードした人なら誰でも同じような構造の多くを再現します。この構造は、サイバーキルチェーンの各ステップを効果的に自動化します。観察されたケースの背後にあるオペレーターは、国家サービスから孤独な個人まで、広範な国にわたっています。AI対応キルチェーンの採用の例は、ケーススタディGT-20006に文書化されています。モデルが進化し改善し続けるにつれて、私たちは、孤独なオオカミから組織化された実体まで、より多くのアクターがAIフレームワークを採用し、より高速かつ大規模で、より高度なサイバー攻撃を可能にすると評価しています。
サイバーオペレーションにおけるAIの役割は、ますます自律的になっている
このレポートで説明されているオペレーションの過半数は、直接実行またはオーケストレーションを介してAIによって可能になりました。AIの使用は、チャットボットからの単純な質問と応答を超えて、偵察、エクスプロイト、データ漏洩を実行するマルチエージェントフレームワークの使用を含みました。人間は、攻撃のターゲットを設定し、漏洩を確認することでループ内に留まりました。このトレンドの例はGT-20006です。このアクターは、セキュリティ製品に検出された場合にツールキットを自動的に再構築および再展開するAI支援ワークフローを開発しました。
GT-20006:ロシアの諜報活動
歴史的に、サイバー諜報アクターは、検出を回避するために設計されたカスタムツールキットを開発および展開するパターンに従ってきました。アクターは、防御者がそれらを検出しブロックするためのシグネチャを構築するまでこれらのツールを使用し、その後、回避と検出の新しいサイクルが開始されました。したがって、堅牢な防御と検出は、敵対者にとってコストを増加させました。しかし今、AIの採用は、静的な検出のみによって敵対者に対するコストを課す防御者の能力を、迅速かつ容易に覆す危険性があります。
GT-20006は、AIを使用してオペレーションを自動化することで速度を向上させたアクターです。私たちの帰属は、アクターをMidnight Blizzardに関連付ける公開レポートと一致しています。「JackPoterz」というハンドル名を使用するロシア語話者のオペレーターの1人は、そのトレードクラフトとターゲティングはロシア国家関連諜報活動と一致しています。彼らは、ウクライナおよびヨーロッパの政府における軍事諜報ターゲット、ならびに米国外交政策に関連する外交および防衛組織および個人を攻撃するオペレーションを実行しました。私たちはGT-20006オペ