AI・機械学習
AIの信頼性劇場はもうやめてください
Please stop the AI confidence theater (elenaverna.com)
要約
この記事は、AIの現在の能力に関する過剰な誇張や「信頼性劇場」に警鐘を鳴らしています。AIの進歩が速すぎるため、多くの人が取り残されていると感じ、イノベーションの阻害や採用プロセスの混乱を招いています。著者は、AIの真の価値は、誇張された「人生を変える」という主張ではなく、現実的な時間節約や問題解決にあると主張しています。
全文翻訳
AIの信頼性劇場はもうやめてください
私たちは不安になる追加の理由を必要としていません
エレナ・ヴェルナ
2026年7月2日
5796355
シェア
AIの見出しは決して期待を裏切りません。まず、AIは教育を破壊していました(ああ、古き良き時代、私はあなたを恋しく思います)。次に、作家、エンジニア、デザイナー、プロダクトマネージャー、営業職を排除することに移りました。おそらくその正確な順序で。しかし、マーケティング、財務、人事部門は免れましたが、これは皮肉だと思います。Googleは、その貴重なSEOとともに、AIのために攻撃対象となりました。それから、私たちは集合的にSaaSを排除することを決定しました。私たちはそうしませんでしたが、株式市場はそれを信じ、多くの人々がお金を失いました。今、私たちは皆、AIエージェントを必要としている最中です。なぜなら、それを持っていないと人生を変える経験を逃しているからです。それにもかかわらず…99%の人はAIエージェントが何をするのかさえ知りません。
一方、私はChatGPTに同じ段落を3回書き直すように頼んでいます。なぜなら、それは常に「LinkedInの賢い投稿」モードにデフォルト設定されるからです。まったくもう。
見てください:私はAI企業で働いています。私は一日中AIを使っています。私はAIと戦略を練ります。私はAIで製品を構築します。私はAIで書きます。私はAIでデータを分析します。しかし、私でさえ、皆がAIのコードを解読したように感じ、私はまだここで基本的なチュートリアルバージョンを使っているように感じます。
そこで、誰かがAIが人生を変えたと言ったとき、私はいつも簡単な質問を始めました。「すごい。見せて。」
そしてほとんどの場合、私は基本的なワークフローを見ます。Slackの要約。メールへの返信。スケジュールされたスキャンの実行。調査を行い、何かを予約する。Claudeからメールを送信する。はい…それは役立ちます。しかし、あなたの仕事が明日なくなったら、あなたの仕事が実際に崩壊するほど、あなたの日常で本当に重要になったものを見せてください。本当に人生を変えるものを見せてください。
それは非常に短いリストであることが判明しました。
しかし、ノイズは音量11/10で続いています。
だから、これは私の必死の訴えです…このAIの信頼性劇場を止めてもらえませんか、皆さん?それは良いことよりも害をなしています。
この投稿はFirecrawlのスポンサーです。Firecrawlは、Webを大規模に検索、スクレイピング、操作するためのWebデータAPIです。ライブWebを、エージェントが実際に使用できるクリーンで構造化されたデータに変換します。(追伸:私は個人的にFirecrawlを私の愛らしいアプリで常に使用しています。最近では、このブログ自体をスクレイピングするために使用しました。これにより、私のAIの分身が最新の投稿をコンテキストとして使用できるようになりました。)
それは多くのことを台無しにしています
この偽のAIの誇大広告は私たち全員を傷つけています。これは犠牲者のいない犯罪ではありません。
現実の歪みはイノベーションを傷つけます
AIの見出しを追いかけ、偽装する人々は、人々がAIツールで真にクールな「なるほど!」の瞬間を体験する機会を奪っています。問題は、誰かが「人生を変える」(常に「人生を変える」と言われます)新しいAI搭載システムについて話しているのを見たとき、しかし…それは実際には機能しません。だから、あなたはすべてのAIがナンセンスだと仮定し、自分の頭を砂に埋めたままにします。
そして、AIが現在実際にできる時間節約と煩わしさの軽減を祝う代わりに、人々は従業員を置き換えるスーパーエージェントを約束しています…それらのエージェントは50%しかトリガーされず、非常に具体的なコンテキストを手で与えられた場合にのみまともな出力を提供する(そしてほとんどの場合間違ったことをする)にもかかわらず。
この奇妙な逆ハッスル文化?
2026年のビンゴカードに「毒のあるハッスル文化を少し懐かしく思う」という項目があるとは思っていませんでした。なぜなら、今ではさらに毒性の高い環境があるからです。
5年前、人々は自分が他の誰よりも一生懸命働いていると思わせたがっていました。今日、彼らはAIがすべてをやっていると思わせたがっています。
5年前、人々は大きな成果:収益、ユーザーマイルストーン、資金調達、人員について共有し、自慢していました。今日、人々はただトークンをどれだけ燃焼させているかを強調しています。誰もが、自分がビジネスを実行しているAI従業員の目に見えないチームを持っていると信じさせたいと思っていますが、彼らは大きな考えを抱いています。しかし、そのビジネスの成果はどこにあるのでしょうか?!
5年前、人々は午前5時に起きて、冷水浴をし、受信トレイをゼロにし、無限にペロトニングしながら働いていると自慢していました。今では、17のエージェントを持ち、メールを開かず、AIがビジネスを実行しているという話ばかりです。それは全く同じパフォーマンスですが、小道具が異なります。
真の専門知識の採用は混乱しています
これは採用プロセスも台無しにしました。AIは平均的な知能を信じられないほど安価にし、すべての人に専門知識の語彙を与えました。以前は、誰かがベクトルデータベース、MCP、エージェント、メモリ、またはRAGについて話し始めると、彼らが何をしているかを知っていると仮定していました。今日、誰もがその言葉を知っています。AIは彼らのためにスマートな一文と3つのホットテイクを再生します。誰もが経験があるように聞こえます。
しかし、有能に聞こえることと有能であることは全く異なります。では、その真っ只中でどのように採用するのでしょうか?昔の面接や採用プロセスがそれほど優れていたわけではありませんが、何年もフラストレーションを感じてきました。MCPを「自信を持って」説明できるからといって、それを構築できるとか、誰も実際に依存していない単一のワークフローを構築したことがあるとは限りません。ケーススタディと作業トライアルは、くだらないものを切り抜けるために絶対に必要になります。
FOMOはうんざりします
これらすべてが、人々を落胆させています。これらのツールがどのように役立つかに興奮する代わりに、ほとんどの場合、私たちは皆ひどく遅れており、すべてが完全に不可能であるように感じられます。
全体として、私たちの脳はこのレベルの変化を理解できません。特にテクノロジー分野の人々にとって、これはすべて非常に速く起こっています。200年前、私たちは基本的な衛生状態を整えているところだったと考えてみてください。そして今、私たちは、私たちの仕事を手伝ったり置き換えたりするであろう、全能の(しかし、非常に一貫性がなく、時にはがっかりするかもしれない!?)人工知能をどのように管理するかを考えなければなりませんか?それはあまりにも多いです。私たちは、私たちが遅れていると常に私たちに叫ぶ人々を必要としません。
私がそれを好きではないのは、それが偽の基準線を作り出すことです。あなたの周りの誰もが、あなたの仕事を劇的に変えたAIについて何かを理解したように見えるなら、会議を要約するためにAIを使用することは、恥ずかしいほど基本的なことに感じられます。誰かがはるかに多くのことをしたと主張しているので、あなたが実際にあなたを時間を節約してくれることを感謝するのをやめます。
なぜこれが起こっているのか?
これが起こる原因となっている大きな理由がいくつかあります。ソーシャルメディアは表面的な誇大広告を報酬とし、AIができることは私たちが追いつくよりも速く進化しており、企業は組織図全体でこのような行動を奨励しています。
問題1:誇大広告はクリックを生む
私たちは、注意が通貨である世界に生きています。そして、その注意は一般的にインプレッションで測定されます。これは人々が追い求めているドーパミンヒットです。バイラルになれるか?皆をエンゲージさせられるか?
注意を引く方法は、衝撃的または予期しないことを言うことです。そのため、すべてが誇張されます。正当にクールなユースケースは、「これは毎週15分間の面倒な時間を節約します」から「OMGこれは私の人生を変えました」または「このワークフローを使わないと永久に失業します」に格上げされます。
問題2:ここは無法地帯です
LinkedInやXで魔法のようなユースケースを共有するコンテンツクリエイターについて話しているとき、難しいのは、AIが本当にクレイジーなことができるということです。すべてが偽物なら、私たちは皆それを無視できたでしょう。しかし、人々は実際に常に、あなたと私の働き方を毎日変えることができるものを構築しています。そのため、私たちはそれを無視することはできません。
しかし、確認するのも難しいです。たとえば、彼らは私とは異なるLLMモデルを使用しているのでしょうか?私のデータは正しく構造化されていませんか?ワークフローの設定で何か間違えましたか?それとも…彼らはそれを偽装しただけで、これらすべては不可能ですのか?知る方法はありません。
これは、テクノロジーの以前の段階で対処する必要があった問題ではありません。誰も「私はDropboxでこのクレイジーなセットアップを構築しました」という投稿を作成してバイラルになろうとはしませんでした…誰もが説明を見て、すぐに「くだらない!」と叫んだでしょう。
問題3:マーケティングチームは、存在しない確実性を販売しています
従来のソフトウェアはメッセージングが「簡単」でした。ボタンをクリックすると、結果が得られます。AIはそのように機能しません。それはより多くの可能性を開きます。ユースケースは緩やかに定義されます