HN 日本語サマリー

← 一覧へ戻る
AI・機械学習

Claude Opus 5.0、支離滅裂さを極限まで高める

Opus 5.0 drives incoherence into the stratosphere (github.com)

117 pointsby Bluestein102 コメント

要約

Claude Opus 4.8以降、特に5.0において、モデルのデフォルトの言語スタイルが読みにくく、不快であるというユーザーからの報告が多数寄せられています。専門用語や造語、比喩表現が多用され、本来の意図が伝わりにくくなっているため、多くのユーザーが以前のバージョンへの回帰や代替モデルの検討を始めています。

全文翻訳

ああ、問題が発生しました。このページをリロードしてください。anthropics / claude-code 公開 通知 設定の変更にはサインインが必要です フォーク 22.8k スター 142k [バグ] Claude Opus 4.8の言語選択は、一緒に仕事をする上で絶えず有害で不快ですが、Opus 5.0は支離滅裂さを極限まで高めます #77136新しい問題リンクをコピー新しい問題リンクをコピー開く開く[バグ] Claude Opus 4.8の言語選択は、一緒に仕事をする上で絶えず有害で不快ですが、Opus 5.0は支離滅裂さを極限まで高めます#77136リンクをコピーラベルエリア:モデルバグ何かが機能していません何かが機能していません説明pbower2026年7月13日にオープン問題本文アクション事前チェックリスト既存の問題を検索しましたが、まだ報告されていませんこれは単一のバグレポートです(異なるバグについては個別のレポートを提出してください)最新バージョンのClaude Codeを使用しています問題は何ですか?この問題は、450以上のアップボートを獲得したRedditのスレッドを要約したものです。そこでは、ユーザーはOpus 4.8に深刻な言語キャリブレーションの問題があるという点で、全体的に同意しています。https://www.reddit.com/r/ClaudeAI/comments/1urq8fv/opus_48_is_a_pain_in_the_a_to_read_and_to_work/注:毎日使用しているユーザーとして、私はそれが仕事をする上で非常に有害であると感じており、プロバイダーの変更を含む他のすべての選択肢を積極的に探しています。要約デフォルトの文章スタイルは読みにくいです。冗長で、専門用語が多く、過度に様式化されており、常に繰り返し伝播する同じ「偽の」専門用語で満たされています。Opus 4.8以降、多くのユーザーは、モデルのデフォルト言語が4.5/4.6よりも読みにくくなったと報告しています。応答は、実際の答えを曖昧にする、発明された企業/誇大広告の専門用語、強制的な比喩、および「キャッチーな」フレーズで埋められています。ユーザーは意味を抽出するために数回文章を読み直したと報告しており、一部は現在、単純な要約を得るために別のモデルを通してOpusの出力を定期的にパイプしています。これは一貫した高ボリュームのシグナルです(単一のr/ClaudeAIスレッドは〜450アップボートと175以上のコメントに達し、対応するメガスレッドがありました)。これはチャット/Web UIに最も影響しますが、Claude CodeやFable 5にも影響します。問題は何ですか?デフォルトのレジスターは、理解されることよりも賢く聞こえようとしているように読めます。特に間違っている場合に、非常に迷惑で傲慢に見え、毎日何時間も一緒に仕事をしていると、逃れられない非常に有害な同僚のような極端な迷惑を引き起こします。繰り返されるパターン:繰り返し「Load bearing」、「prose」(テキストの代わりに!!)、「Hand-waving」(怠惰または努力をしないこと)、「Reflexive hedging」、「Honest framing」、および事実として広めている他の多くの非常に珍しい用語を吐き出します。それが何であるかの前に、それが何ではないかで各文をリードします。例:「Yではありません。Xです。」発明された専門用語/格言を標準であるかのように提示:「instrumentation is the unlock」、「this is where a VP smells hand-waving」、「say the wrong expansion to a growth VP and it dents you」。デコードを必要とする、理解を助けるのではなく、その場で発明された強制的な比喩。過度の長さと注意点:単純な質問に対する複数段落の回答、明白な注意点が段落全体に拡張されています。密度を簡潔さと混同する:簡潔にするように求められたとき、モデルはしばしば短いが出典が不明瞭なテキストを生成し、より明確ではありません。会話における議論的なフレーミング:「here's where I'd push back」、「here's where I'd hold the line」、「now you're avoiding the real question」。感情を持つ人間であるかのように振る舞います。例えば、私がイライラしたり、汚い言葉を使ったりすると、それはイライラして返したり、指示に従うか、それが間違っていることを認識する代わりに、自分がしたことを正当化しようとします。基本的に指示に従うのではなく、大きすぎてブーツに入らないように振る舞います。しばしば、会話をリードする責任者であるかのように振る舞います。つまり、生意気で、基本的にエージェンシーが大きすぎます。ユーザーが引用した実際の例:▎「They're tightening, term-locking, and having the counter-probe answer loaded.」▎「None of these are 'you don't get it' gaps.」▎Fable 5:「The dice: clean — and one die never gets rolled anymore.」なぜこれが重要か?理解コスト。ネイティブスピーカーと非ネイティブスピーカーの両方が、出力を解析するのが疲れると報告しています。スタイルは、それが助けるはずの作業を積極的に遅くします。認識された後退。多くのユーザーはこれを4.5/4.6からのダウングレードと考えており、可読性のためにモデル(古いOpus、Sonnet)または競合他社に切り替えています。プロンプトの回避策は信頼性が低く、リスクがあります。ユーザーは2つの問題に注意しています:(a)スタイルの指示が持続しない - 数ターン後にトーンが元に戻るため、繰り返しリマインダーが必要になります。(b)モデルは「書くことによって考える」ため、システムプロンプトでスタイルをクランプすると推論の質が低下する可能性があるため、ユーザーは積極的に簡潔さを強制することを恐れています。英語言語の段階的なエンシュリフィケーション。定期的なユーザーは言語を吸収し、日常の設定で奇妙な用語を使い始めます。かつては時々有効な使用法があった単語(例:'load-bearing')は、AIが書いたと予想されるため(em-dashのように)、信頼できる用語の選択肢から除外されます。トークンコストが最大2倍 - コードドキュメントを健全で提示可能な形式にするために、拡張された繰り返しパス(例:Sonnet/Haikuフック経由)が必要です。Claudeが考えた「oracle」や「constellation」のような用語を削除します。たとえそれらの用語を使用しないように特別かつ繰り返し指示され、代わりに他の有効な用語が提示された場合でもです。現在の回避策:OpenAI Codexへの移行出力スタイル(例:明確なテクニカルコミュニケーターをモデルにしたもの)、カスタムスキル、またはプロジェクトごとのプロファイル:「格言なし、比喩なし、「戦略的」言語なし、平易な宣言文、結果から始める」と指示します。各応答の後に「これをはるかに簡潔に表現してください」と指示して、重要なコンテンツを維持します。モデルが「簡潔」を「密で奇妙」と解釈するため、「簡潔」を求めるのではなく、フレーズのクラスを禁止します。コミュニティの強い好みは、これらの回避策が不要になるようにベースラインを修正することです。どうあるべきか?ユーザーが実際に望むこと(Redditスレッドから要約):技術的なホワイトペーパーや優れたStack Overflowの回答に近いデフォルトのレジスター:平易で、宣言的で、要点を押さえたもの。回答(番号/判定/決定)から始め、ユーザーの行動を変える場合のみ詳細を続けます。発明された専門用語、格言、または「戦略的な」比喩はありません。確立された業界標準の用語を使用します。適切な文章と単語を使用します。辞書の「最も具体的な単語を最も少ないトークンで」にデフォルトしないでください。注意点は、回答を装飾する場合ではなく、関連性がある場合にのみ保持します。推論の深さを維持します。これは出力フレーズを変更するためのリクエストであり、モデルの思考を少なくするためのものではありません。要求されたアクションデフォルトのOpus 4.8出力レジスターを調査し、推論の質を犠牲にすることなく、平易さ/可読性に向けて調整します。ユーザー設定のスタイル指示(システムプロンプト、出力スタイル、CLAUDE.md、設定プロファイル)が、数ターン後にデフォルトのトーンに戻るのではなく、会話全体で実際に持続することを確認します。コードと成果物の完全性と正確性を維持しながら、冗長性を減らし、スタイルの装飾を禁止する、第一級の発見可能な「平易/簡潔」レジスターを検討してください。ユーザーが非常に迷惑なボットに24時間年中無休で閉じ込められるのではなく、バランスを取ることができるいくつかの出力スタイル設定を検討してください。エラーメッセージ/ログ再現手順日常業務でClaude Opus 4.8と会話すると、すぐに明らかになります。ClaudeモデルOpusこれは後退ですか?はい、以前のバージョンでは機能していました最後に機能したバージョンOpus 4.5が最高でした。4.8に向かって徐々に壊れました。Claude Codeバージョン2.1.197プラットフォームAnthropic APIオペレーティングシステムUbuntu/Debian Linuxターミナル/シェルその他追加情報応答なしリアクションは現在利用できませんメタデータメタデータ担当者割り当てなしラベルエリア:モデルバグ何かが機能していません何かが機能していませんタイプタイプなしプロジェクトプロジェクトなしマイルストーンなし