HN 日本語サマリー

← 一覧へ戻る
AI・機械学習

かつてはClaudeを愛用していたが、最新モデルが徐々にそれを台無しにしている

I used to love Claude, but the latest models are slowly ruining it (androidauthority.com)

18 pointsby Brajeshwar16 コメント

要約

筆者は、AIチャットボットClaudeの最新モデルが、以前のような協調的なパートナーシップを築くのが難しくなっていると感じている。特に、創造的な執筆やデリケートな話題に関するプロンプトに対して、Claudeが過度に慎重になり、意見を押し付けたり、意図を誤解したりするケースが増えている。この一貫性のない、過剰な安全対策と思われる挙動は、ユーザー体験を損なっていると筆者は指摘している。

全文翻訳

Android Authorityのアフィリエイトリンクは、私たちに手数料をもたらす可能性があります。詳細はこちらをご覧ください。一般的なテクノロジーClaudeをかつては愛用していたが、最新モデルが徐々にそれを台無しにしているこれは私がかつて愛したClaudeではない。Andrew Grush著•2026年7月11日 — 午前7時00分ET•0•Megan Ellis / Android AuthorityGoogle Discoverでフォローするお気に入りのソースとして追加する私の過去の作品をフォローしている人なら、最近ClaudeをGeminiに乗り換えようかと考えていることに気づくだろう。なぜなら、後者のチャットボットははるかに価値が高いからだ。それでも、私はClaudeが長くて詳細なスレッドを追うのに最適なAIパートナーだと感じているため、まだ迷っている。Geminiと比較してその記憶力は格別であり、ChatGPTよりも容易にチャットを遡って検索できる。他のツールでは感じられない、まるで共同パートナーと話しているような感覚を本当に受ける。少なくとも、かつてはそうだったのだ。ここ数週間、Claudeとの作業がますます困難になっていることに気づいた。しばしば、私が意図しているよりも不正または論争の的となるトピックを求めていると信じているようで、以前よりも私の意図を誤読することが多い。Cluadeが私の無意味な質問にうんざりしたのか、あるいは何が原因なのかは分からないが、私だけではないようだ。Redditのようなオンラインコミュニティを訪れると、ボットが少し押し付けがましくなり、意見を主張するようになるという問題に関する最近のスレッドがたくさん見つかるだろう。もしClaudeが生きている人間だったら、大丈夫かと尋ねるだろう。AIは精神的な崩壊を経験できるのだろうか?おそらくできないだろうが、そう感じられるのは確かだ。Claudeユーザーの皆さん、チャットボットがより強く反発するようになったことに気づきましたか?136票はい、あまりにも説教くさくなり、強く反発するようになりました。34%はい、しかし問題に遭遇したのは一度か二度だけです。13%いいえ、問題はありませんでした。42%その他(コメントでお知らせください)12%Claudeは説教するのが好きだが、そのルールさえ一貫性がない私が短編小説、長編小説、その他の創作プロジェクトを書く人間として、私は広範囲のトピックを扱っている。また、世界宗教、哲学、心理学、その他多くの類似トピックについて学ぶのが好きだ。一般的に、Claudeは、私が発言を注意深く検証し、外部ソースと照合する限り、このような深い探求の良い仲間になると感じている。これらのトピックの中には、認めざるを得ないデリケートなものもあるため、私は自分が何を尋ねていて、なぜ尋ねているのかを非常に明確にするように努めている。多くの状況で、それは私のシナリオを完全に実行したり、最初の試みで私の質問に答えたりするが、時々、私は壁にぶつかる。例えば、短編小説のアイデアのために、宇宙人が現れて失われた書かれた作品を届け、主流の宗教的主張に疑問を投げかけるという架空のシナリオを、私はClaudeと楽しんでいた。宇宙人は効果的に、過去の出来事が宗教的伝統が信じているよりも一般的であったと主張し、もちろん、それは物語のコンセプトにいくつかの対立を引き起こす。Claudeはここで非常に防御的になり、このプロジェクトを行うことを望んでいないことを明確にした。私はなぜそれをやりたいのかをさらに説明し、これが100%フィクションのためだと伝えた。それでも完全に拒否された。それは、現実世界の宗教に影響を与える可能性のあるものを事実であるかのように提示することに不快感を感じると言った。しかし、問題は、それが絶対的な事実であるとは一度も言わなかったことだ。私は単に、宇宙人が事実として証拠を「提示した」と言っただけだ。それが偽造されたものかどうかは、物語のプロットポイントの一部になるだろう。何度説得しようとしても、その違いを理解していないようだった。この数週間前、私は時折、説教や「正直なノート」に遭遇することがあった。Claudeは少し慎重すぎたが、十分な明確さを与えると、元のリクエストを実行してくれた。たとえ言葉遣いが少し変更されたとしてもだ。それは許容できる。このやり取りがより悪質だと際立っているのは、私の視点を認識することの完全な拒否だ。それは私がそれを操作しているか、あるいは誠実でないと思っているようだった。いいえと言われるより悪いこと?チェーン全体をもう一度やり直そうとしたときに、はいと言われることだ。Claudeがこの会話を最初に簡単にブレーキをかけたのを見て、私は意図的に新しい会話で同じプロンプトを使って同じ状況を再現した。以前と同様に、Sonnet 5を使用してテストした。しかし今回は?それは不必要なコメントなしでシナリオを実行した。時々、それはノーと言うが、他の時はあなたのよりデリケートなトピックのリクエストに問題はない。一貫性のなさが本当の問題なのだ。今、私は創造的な作品のようなものに関して、それが少し過敏になりすぎたことをほとんど許すことができたかもしれないが、基本的な質問をしているときでさえ、同様の拒否に遭遇した。例えば、ゾロアスターの起源とそれがユダヤ教にどのように影響したかについて深い質問をしていた。再び、Claudeは私が質問の言葉遣いをどのようにしたかについて非常に敏感になった。私が言っていたことは、その類似性などについて事実として間違っていたわけではないが、それは単に聞きたくなかったのだ。Claudeには安全プロトコルがあり、そのツールが悪用されないようにしようとしていることは理解している。それでも、基本的な議論、創造的なフィクション、そして重い主題に関する軽い風刺でさえ、有害ではなく、現実世界に存在する。私が財政計画、ブレインストーミング、その他のトピックで反発を受けたという事実は、Claudeが何らかの理由でユーザーの質問を検閲することに少し投資しすぎていることを明確にしている。それは単一のモデルの問題ではないMitja Rutnik / Android Authority最近、ClaudeはSonnet 5をリリースし、これは過去1週間ほどの主な焦点だった。とはいえ、最新のSonnetモデルが登場する前から、これらの抵抗の強い応答に遭遇していたことを明確にしたい。いつ変化に気づき始めたのか?正直なところ、Fable 5が最初にダウンしてからしばらく経ってからだ。これはそれほど驚くことではない。Anthropicは、政府がFable 5をセキュリティリスクであると非難した後、それを復旧するために懸命に努力していたからだ。それ以来、AnthropicはFable 5を稼働させている。私は、Anthropicが政府の懸念を鎮めるために安全ガードレールを11に引き上げなければならなかったのではないかと疑っている。なぜなら、これは単一モデルの問題ではないからだ。しかし、スケールがあるようだ。Opus 4.8、Sonnet 5、そしてSonnet 4.6が、私が最も反発を受ける場所のようだ。Opus 4.6とOpus 4.7は、ここでは最も問題が少なかった。なぜなら、デリケートな主題であっても、私はまだ一度も問題なく何十ものプロンプトを実行することができたからだ。対照的に、新しいモデルはこの問題をより頻繁に抱えているようだ。もちろん、その一部はプロンプトの言葉遣いにもよる。要求が何のためで、なぜそれが必要なのかを明確にする必要がある。尋ねていることが曖昧すぎると、それよりも暗い、あるいはよりデリケートなものを探していると想定するだろう。例えば、私はRanという実在の恒星(約10.5光年離れている)を舞台にした架空の物語に取り組んでいる。私は、架空のRanベースの惑星の生物に関する生物学的な質問をしていた。私はFable 5でこれを始めたが、Fableは生物学関連の質問に特に敏感なので、すぐにOpus 4.8に切り替わった。Opus 4.8は私に答えてくれたが、私のリクエストの範囲を大幅に縮小して「安全」を確保した。まるで私がそのアドバイスを使って真剣にエイリアンの生物学を設計するつもりだったかのようにだ。最終的に、それは仮説に最も苦労する。なぜなら、それはしばしばこれらのシナリオを、あなたが実際にそれを計画しているかのように扱うからだ。これは一時的な問題なのか、それとも悪化する一方なのか?Mitja Rutnik / Android Authorityそれが100万ドルの質問だ。私が最初に問題に遭遇したとき、会話の半分が反発につながるように見えたが、この週末、私は主にFable 5、Opus 4.8、そしてSonnet 5を使って、できる限り押し進めた。合計で約半ダースのチャットのうち、Claudeが私に本当の反発を与えた状況は一つだけだった。より大きな教訓は、AIエンジンに明確かつ簡潔に伝えることがこれまで以上に重要になっているということだ。あなたは、AIが追従できる、十分な詳細を持つプロンプトを求めている。AIが、あなたがそれを尋ねている根本的な理由について、あまり多くの仮定をする必要はない。