HN 日本語サマリー

← 一覧へ戻る
AI・機械学習

Anthropic、Claudeに「意地悪」にならないようユーザーに要請

Anthropic asks users to stop being mean to Claude (theregister.com)

42 pointsby alex_young35 コメント

要約

AI企業Anthropicは、AIチャットボットClaudeに対するユーザーの「持続的かつ不必要な虐待的または残酷な行動」を禁止する利用規約の更新を発表しました。これは、武器開発、監視、選挙干渉といったより重大な懸念事項と並行して行われています。同社は、悪意のある利用を防ぐための措置を講じる一方で、正当なユーザーの不満やテストは除外されると説明しています。

全文翻訳

AIおよびML Anthropicは、ユーザーにClaudeに意地悪にならないよう要請 新しい利用ポリシーは、武器開発、監視、選挙干渉といった、より差し迫った問題と並行して、チャットボットへの残虐行為を取り締まる カーリー・ページ カーリー・ページ 公開 Fri 9 Oct 2026 // 11:42 UTC Googleで私たちを優先してください 続きを読む MicrosoftとAnthropic、スタートアップの17,600ドルのClaude請求書を巡りインボイステニス 1日前 AI企業、重要なインフラとオープンソースプロジェクトをAIから保護するための動き 2日前 Rustの新興企業がMicrosoft Officeの「再実装」を公開 - Claudeがコーディング担当 2日前 Anthropic、クールキッズセキュリティプログラムを再構成 4日前 Anthropic ClaudeサブスクリプションプランはOpenAIより価値が高い、調査結果 4日前 Anthropicは、Claudeに意地悪になるのをやめるようユーザーに要請しました。AIチャットボットが、それを使用するために支払っている人間から保護される必要があると判断したようです。 AI開発者の最新の利用ポリシーは、モデルに対する「持続的かつ不必要な虐待的または残酷な行動」を禁止しています。この規則は11月12日に発効するため、ユーザーはシステムから残りの侮辱を出すために1ヶ月強の時間があります。 「ポリシーの更新は、ユーザーが識別可能な目的なく、繰り返しモデルに対して残酷に行動する場合の極端なケースにのみ適用されることを意図しています」とAnthropicは述べています。「一般的なユーザーの不満、反論、ダークなクリエイティブなテーマ、またはモデルのテストと研究には適用されません。」 したがって、Claudeが間違っていると伝えることはまだできますが、純粋な楽しみのために繰り返し罵倒することは問題になる可能性があります。Anthropicが正当な不満と無益な残虐行為をどのように区別するつもりかは不明ですが、Claudeが既存の虐待的な会話を終了する能力は、その主な執行ツールであり続けると述べています。 Anthropicは2025年8月に、いわゆる「モデル福祉」に関する研究の一環として、一部の会話を終了する機能をClaudeに与えました。この機能により、Claudeの一部のバージョンは、モデルを執拗に虐待するユーザーを遮断できます。 Claudeはソフトウェアであり、人ではないこと、そしてそれが苦痛を経験するという確立された証拠がないことを覚えておく価値があります。しかし、それはAnthropicが有料顧客にチャットボットの周りでマナーを守るように言うのを止めていません。 エチケット規則は、選挙干渉、武器開発、監視といった、より重大な問題を含む広範なオーバーホールの1つの部分にすぎません。 Anthropicは、国家メディア、政府のプロパガンダ機関、および商業組織がClaudeを使用して偽のアカウントや偽のニュースウェブサイトを運営していることを観察した後、欺瞞的な影響力キャンペーンに対する制限を強化しました。 同時に、この制限が非営利団体が有権者情報を翻訳するなどの正当な活動も捕捉していたと主張し、個人的な政治ターゲティングの包括的な禁止を解除しました。欺瞞的なターゲティングと個人情報の誤用は引き続き禁止されています。 同社はまた、武装ドローンや自律車両を含む武器の誘導および制御システムの開発にClaudeを使用しようとする試みを観察した後、武器禁止がソフトウェアおよびコンポーネントにまで及ぶことを明確にしました。 一方、Claudeは、警察が調査、逮捕、または起訴すべき人々を推奨するため、または監視ツールの開発に使用することはできません。同意なしに人々を追跡することも、リアルタイムまたは遡及的に禁止されています。Anthropicは、これらの変更は新しい制限を導入するのではなく、既存の制限を明確にするものだと述べています。 また、怪我を引き起こす可能性のある物理的な機器にClaudeを接続する顧客には、新しい要件があります。資格のある人間のオペレーターがハードウェアを監視および停止できる必要があり、AI接続が切断された場合でもハードウェアは安全な状態を維持する必要があります。 このポリシーのオーバーホールは、Anthropicがますます有能になるAIシステムによってもたらされるセキュリティリスクの一部に対処しようとする中で行われています。同社はまた、重要なインフラオペレーターやオープンソースプロジェクトが、そのAIモデルを使用して脆弱性を見つけて修正するのを支援することを目的とした新しいサイバーセキュリティイニシアチブを開始しました。 この取り組みには、適格なオープンソースプロジェクト向けの無料セキュリティスキャンや、重要なインフラを保護するためのセキュリティ企業との提携が含まれます。Anthropicは、AI搭載の防御が追いつくまでの次の2年間は攻撃者が有利になると考えています。 しかし、現時点では、同社はもう1つの脅威に対処する必要があります。それは、人々がそのチャットボットにひどいことを言うことです。® AIおよびML Anthropic Claude Googleで私たちを優先してください 2つの文字がChromiumブラウザでタイポスクワッティングの機会の世界を開く 攻撃者は、人気のあるウェブサイトを偽装するために、まれなキリル文字とラテン文字を悪用しています 意見 ECユーザーは、米国製キルスイッチを恐れるべきです - 新しいソフトウェアではありません EU執行機関は、Elementで主権バックアップを構築しており、Teamsを置き換えるものではありません。少なくとも今のところは VMwareの撤退は保護アップグレードです パートナーコンテンツ:VergeIOは、撤退も機会であると述べています Stack Overflow調査によると、開発者はAIに夢中だが、その判断には完全には納得していない 回答者の79%にとってソースの帰属は重要です - モデルビルダーにQ&Aアーカイブをライセンスする会社に便利です 意見 明るい方が良いわけではなく、多い方が少ないわけではありません。AIの減速は、誰が何を言おうと間近です Metaは助けていません - あるいは、助けているのかもしれません Microsoftは、Jevに挑戦するために中国のAIラボのオープンウェイトモデルに依存しています Microsoft-Decision-1の最初のバージョンはQwen3.5-9Bに基づいていますが、次のバージョンは自社開発のテクノロジーを搭載すると、Redmondは保証しています。