HN 日本語サマリー

← 一覧へ戻る
AI・機械学習

Microsoft幹部:AIによるスクレイピングは「人類史上最大の労働の略奪」

Microsoft director: AI scraping 'the largest theft of labor in human history' (tomshardware.com)

83 pointsby jonbaer23 コメント

要約

ニューヨーク・タイムズがOpenAIとMicrosoftを著作権侵害で訴えた訴訟の法廷文書によると、Microsoftの幹部はAIによるデータスクレイピングを「人類史上最大の労働の略奪」と呼び、出版社にとって「存亡の危機」であると認めています。これらのAIモデルは、コンテンツ制作者への補償なしに、彼らの労働成果を大規模に利用しており、その結果、出版社へのトラフィックを大幅に減少させていることが明らかになっています。

全文翻訳

(画像クレジット: Getty / Cheng Xin) コピーリンク Facebook X Whatsapp Reddit Pinterest Flipboard Email この記事を共有する 2 コメントに参加する Googleで私たちをフォローする Googleで私たちを優先ソースとして追加する ニュースレター購読 毎週、最新ニュースをお届けします。 2023年末、ニューヨーク・タイムズはOpenAIとMicrosoftを著作権侵害で訴えましたが、その訴訟は3年近く経った今も継続しているようです。現在、同紙の法務チームは、被告からの発言や文書に基づいた、暴露的な法的申立書を提出した後、裁判所に要約判決を求めています。404 Mediaによると、これらの文書は両社からの要請により、未公開または編集されたままですが、AIスクレイピングが人類史上最大の労働の略奪であるという主張や、出版社にとっての存亡の危機といった、両社の幹部からの潜在的に損害を与える可能性のある発言が示されています。 TH Premiumでさらに深く掘り下げる: AIとデータセンター (画像クレジット: Microsoft) データセンターの冷却状況 カスタムAI ASICの状況 アメリカのAIチップ規制は変化し続けており、世界の他の国々がその代償を払っている GTC 2026: Ian BuckプレスQ&Aトランスクリプト — HyperscaleおよびHPC担当VPがCPXの棚上げとLPUデコードの今年出荷について語る データセンターCPUの需要が急増しており、AIエージェントがその原因である 申立書は、Microsoftの応用科学ディレクターであるブレント・ヘクト氏による2023年1月の内部メモを引用しており、その中で同氏は「何百万人もの人々が、自分たちのすべての仕事を大規模モデルが『吸い上げる』ことを、前例のない規模の驚くべき略奪と見なすようになるだろう」と述べ、それを「人類史上最大の労働の略奪」と呼んだとされています。別のMicrosoftの文書では、「ほとんど誰も、自分が作成したコンテンツがこのように使用されることを意図しておらず、その使用に対して補償も受けていない」と述べられていると引用されています。 2023年を通じてChatGPTの人気が急上昇する中、同ソフトウェア大手の独自のデータは、Copilotがニューヨーク・タイムズのクリック率をBing検索と比較して最大93%低下させたことを明らかにしました。応用科学ディレクターによる別のメモは、それを「破滅のループ」と呼び、それは「私たちのモデルのパフォーマンスとウェブ全体を同時に損なうだろう」と述べています。NYTの申立書は、ヘクト氏がその文書の中で「エンドプロダクトがその不可欠なサプライヤーの経済的基盤を脅かすというのは非常に珍しいことですが、それがLLMビジネスにおいて、その『コンテンツサプライチェーン』に関して私たちが作り出した状況です」と述べていると引用しています。 Tom's Hardwareからの最新動画 この動画をフルで視聴する: OpenAIのChatGPT責任者であるニック・ターリー氏は、内部通信で、AIチャットボットは出版社にとって「存亡の危機」であると述べ、それらは「大部分が代替可能」であり、「より良くなるにつれてますます代替可能になる」と述べています。また、別のOpenAIエンジニアは、「リンクをどれほど目立つように表示しても、ユーザーはクリックしない」と証言しました。別のOpenAI研究者であるニック・ライダー氏は、同社社長のグレッグ・ブロックマン氏に「nytimesのペイウォールを回避するハック」について伝え、彼は「ああ、いいね」と返信しました。 AI企業は、モデルにデータを供給するためにインターネットをスクレイピングすることは「フェアユース」であると主張しており、ある裁判所はAnthropicが公開資料を使用したことがこのカテゴリに該当すると同意しました。法律では、これを「批評、コメント、ニュース報道、教育(教室での複数コピーの使用を含む)、学術研究、または調査」と定義しています。「フェアユース」に該当するかどうかを判断する要因には、「(1)使用の目的と性質、商業的な性質を持つか、非営利の教育目的であるかを含む、(2)著作権で保護された作品の性質、(3)著作権で保護された作品全体と比較して使用された部分の量と実質、(4)著作権で保護された作品の潜在的な市場または価値に対する使用の影響」が含まれます。 しかし、NYTの申立書にあるこれらの暴露は、両社の経営陣がAIスクレイピングの潜在的な市場への影響を認識していることを示しているため、OpenAIのフェアユースの主張を複雑にする可能性があります。MicrosoftのCEOであるサティア・ナデラ氏は、今年の初めに行われた証言で、「ペイウォールになっているものはすべて、使用したい人がライセンスを取得する必要がある…グラウンディングまたはトレーニングのために」と述べ、もし「OpenAIがペイウォールになっている情報をスクレイピングしてトレーニングしたことを知らされていたら」、同社はOpenAIに「モデルを再トレーニングする」よう要求しただろうと述べています。 GoogleニュースでTom's Hardwareをフォローするか、優先ソースとして追加して、最新のニュース、分析、レビューをフィードで入手してください。 最先端を維持する: Tom's Hardwareニュースレターを購読する Tom's Hardwareの最高のニュースと詳細なレビューを、直接受信トレイに届けます。 信頼できるパートナーまたはスポンサーに代わって、私たちからメールを受け取る 連絡先 トピック すべてのコメントを表示 (2) Jowi Morales 寄稿ライター Jowi Moralesは、業界で長年の経験を持つテクノロジー愛好家です。2021年から複数のテクノロジー出版物で執筆しており、テクノロジーハードウェアと家電製品に興味を持っています。 2 コメント フォーラムからのコメント これはまだ続いています。私はちょうどイギリスの新聞(The Guardian)の記事を読んでいて、その記事で議論されていたいくつかの主要な概念についてGoogle検索をしました。GoogleのAIオーバービューがすぐに提供したのは、その記事の一部を単語ごとにコピーしたものでした。返信 ttquantia が言いました: これはまだ続いています。私はちょうどイギリスの新聞(The Guardian)の記事を読んでいて、その記事で議論されていたいくつかの主要な概念についてGoogle検索をしました。GoogleのAIオーバービューがすぐに提供したのは、その記事の一部を単語ごとにコピーしたものでした。 検索AIは、表示される説明をコンテキストに入れるべきであり、モデルに組み込むべきではありません。それが侵害であるなら、ウェブ検索も侵害です。返信 すべてのコメントを表示 (2)