AI・機械学習
Prompting Claude Opus 5.5
Prompting Claude Opus 5.5 (platform.claude.com)
要約
この記事は、AnthropicのClaude Opus 5.5モデルに効果的に指示を与えるためのプロンプトエンジニアリングガイドです。Opus 5.5は、Opus 5と比較して高速化、トークン効率の向上、およびエージェント的なコーディングや知識作業における能力強化が特徴です。ガイドでは、モデルの「思考」の管理、プロンプトキャッシュの活用、および視覚情報の処理能力向上に焦点を当てた具体的なプロンプトパターンについて説明しています。
全文翻訳
このガイドは、Claude Opus 5.5に特化したプロンプトパターンを扱います。モデルの機能とAPIの変更については、「Claude Opus 5.5の新機能」を参照してください。現在のすべてのClaudeモデルに適用されるテクニックについては、「プロンプトのベストプラクティス」を参照してください。Claude Opus 5.5は、Claude Opus 5よりも30%以上高速にアウトプットトークンを生成し、同じタスクをより少ないトークンで完了する傾向があります。既存のClaude Opus 5のプロンプトは変更なしでうまく機能するはずであり、「Claude Opus 5のプロンプト」のパターンは引き続き妥当な出発点となります。観察結果に一致するセクションから始めてください。
どのエフォートレベルを実行すべきか不明、またはターンがClaude Opus 5よりも長くコストがかかる場合:エフォートの調整
Claude Opus 5の統合が思考無効で実行されていた場合:思考無効で記述されたプロンプト
無人エージェントが進行状況を報告した後、長いタスクの途中で停止する場合:無人エージェント実行
リクエストがstop_reason: "refusal"を返す場合:セーフガード拒否
長いエージェントターンがサイレントに見える、または予測可能なポイントで更新が必要な場合:ユーザー向けの進行状況アップデート
複数の接続されたアプリを横断して作業するエージェントが、タスクが指し示さなかった情報を見落とす場合:マルチアプリワークフローでのコンテキストの探索
エージェントのチームを実行しており、より早く完了させたい場合:マルチエージェントハーネスの時間信号
チャットアプリケーションでの応答が、モデルが最初に長時間思考するため遅く始まる場合:チャットシステムプロンプトでの思考指示
モデルがユーザーが貼り付けたテキスト内に到着した指示に従う場合:ユーザーメッセージでの貼り付けテキストのマーク
密なチャート、ダイアグラム、またはスクリーンショットに関する回答が詳細を欠く場合:複雑な視覚入力のためのツール
フロントエンドの出力が一般的である場合:フロントエンドデザインのデフォルト
プロンプトに関連する機能
プロンプトにとって最も重要な機能は次のとおりです。
エージェント的なコーディングとコードレビュー:モデルは、実際のレポジトリでの複数ステップの作業、例えばテストがパスするまで大規模なコードベースに変更を適用する作業に最も強みを発揮します。Anthropicのテストでは、デフォルトの中程度のエフォートレベルで、モデルはより少ないステップとトークンで、そのようなタスクにおいて高エフォートのClaude Opus 5と同等またはそれ以上の性能を示しました。また、数時間にわたる大規模コードベースの監査や移行など、ほとんど監視なしでエンドツーエンドで実行される、長期間の自律的な作業をClaude Opus 5よりも持続できます。初期テスターは、コードレビューの強化、Claude Opus 5よりも多くのバグ検出、偽アラームの減少、および平易な言葉での変更の説明も報告しています。
知識作業:モデルは、誤った数値を述べたり、間違ったソースを引用したりする可能性がはるかに低くなっています。金融モデリングタスク、例えばトランザクションの金融モデルと1ページの要約の構築、または評価ワークブックのエラーの発見と修正などに優れており、日付が間違った曜日になる長い計画スレッドの日付や、スライドデッキのチャートが基になる数値と一致しないなど、大きな入力で見落としがちな詳細を捉えます。生成されるスプレッドシート、スライド、ドキュメントは、共有する前に編集が必要な量が少なくなります。
コミュニケーション:エージェント作業に関するレポートは、作業中のアップデートと完了時の要約の両方において、何を行ったか、何を発見したか、そしてあなたから何が必要かを平易に伝えます。「ユーザー向けの進行状況アップデート」を参照してください。
チャート、ダイアグラム、スクリーンショット、およびコンピューターの使用:モデルは、追加のツールなしでClaude Opus 5よりも正確に視覚資料を読み取ります。Anthropicのテストでは、最低エフォート設定でも、最高エフォートのClaude Opus 5よりも高密度なチャートの値の読み取り精度が高く、出力トークンはごくわずかでした。また、フローチャートの矢印がどのボックスに接続されているか、ダイアグラムの2つのバージョンの間に何が変更されたか、またはカレンダースクリーンショットで会議がいつ開始および終了するかなど、テキストではなく位置によって意味が決まる場合にも優れています。スクリーンショットを介してアプリケーションを複数ステップで操作するコンピューターの使用に関しても、より信頼性が高くなっています。デフォルトのエフォートでは、Claude Opus 5がはるかに高いエフォート設定でのみ達成できた成功率に匹敵しました。「複雑な視覚入力のためのツール」を参照してください。
エフォートの調整
エフォートは、Claude Opus 5.5がどれだけ思考するかを制御する主要な要素であり、思考は常にオンになっているため、インテリジェンス、レイテンシー、コストのトレードオフを調整する際の最初の設定です。Claude Opus 5.5のデフォルトである中程度のエフォートから始め、明示的に設定し、Claude Opus 5で使用した設定を引き継ぐのではなく、独自の評価でいくつかのレベルをテストしてください。エフォートレベルの名前はモデル間で同じ量の思考に対応するわけではありません。Anthropicのテストでは、Claude Opus 5.5の中程度のエフォートは、コーディングと知識作業の評価において、高エフォートのClaude Opus 5と同等またはそれ以上です。いくつかのコーディング評価では、低エフォートでもはるかに低いコストでそれに近づきます。「Claude Opus 5.5の推奨エフォートレベル」を参照してください。
指定されたレベルでは、Claude Opus 5.5はClaude Opus 5よりもターンごとに多く思考する傾向があります。特にxhighおよびmax設定で顕著です。Claude Opus 5のために設定したエフォート値を維持すると、より長いターンとより多くの出力トークンが予想されます。3つの調整が役立ちます。
モデルの思考トークンと応答のための十分なスペースを残すようにmax_tokensを高く設定してください。思考は、思考コンテンツがあなたに返されない場合でもmax_tokensに含まれるため、思考オフのClaude Opus 5用にサイズ設定された制限は応答を途中でカットする可能性があります。エージェント的なコーディングが生成する長いターンでは、Anthropicのテストではmax_tokensをモデルの最大値である128,000に設定するとうまく機能しました。
xhighおよびmaxは、品質向上が測定された作業のために予約してください。
思考を減らすには、まずエフォートレベルを下げてください。エフォートを下げることは、プロンプト指示よりも確実にコストとレイテンシーを削減します。
リクエスト間でトップレベルのエフォート値を変更すると、プロンプトキャッシュが無効になります。異なるレベルで個別のターンを実行するには、代わりにメッセージごとのエフォート変更(ベータ版)を使用してください。これによりキャッシュが維持されます。
思考無効で記述されたプロンプト
Claude Opus 5は、高エフォート以下で思考を許可します:{"type": "disabled"}。Claude Opus 5.5はそうしないため、移行ガイドではリクエストの変更について説明しています。Claude Opus 5の統合が思考無効で実行されていた場合、4つの変更が伴います。
低エフォートから始めて測定してください。低エフォートでは、モデルは思考を短く保ちます。思考をスキップする頻度はプロンプトに依存するため、独自のトラフィックでレイテンシーと品質を測定し、品質が低下した場合は中程度に移行してください。それでも時間あたりの最初のトークンが重要な場合は、「直接的に熟考せずに回答してください。」のようなシステムプロンプト行が思考をさらに減らすことができます。追加したときに品質を測定してください。思考が少ないと品質が低下する可能性があるためです。
思考の代わりに行っていた指示を削除してください。プロンプトで、応答に推論を書き出すことを思考の代わりとしていた場合、その指示を削除し、要約された思考ブロックから推論を読み取ってください(表示:「要約」)。応答テキストで推論を再現するようにモデルを促すプロンプトは、reasoning_extraction拒否カテゴリで拒否される可能性があります。
思考無効の緩和策を再テストしてください。思考無効での実行は、組み合わされた指示(ツール呼び出しの前に話す許可、ツールが適合しない場合の対処法、内部タグなし)を推奨し、思考しないというルールを削除します。どちらも、思考が無効な場合にのみClaude Opus 5に現れるアーティファクトに対処します。常に思考がオンになっているため、まだ指示が必要かどうかを確認し、いずれにしても思考しないルールを削除してください。
ブロックタイプごとに応答を読み取ってください。最初のコンテンツブロックがテキストで始まると仮定するのではなく、各ブロックのタイプを確認してください。応答は、思考フィールドがデフォルト表示:「省略」の下で空である思考ブロックで始まる場合と始まらない場合があります。
無人エージェント実行
複数の部分からなる長いタスクでは、Claude Opus 5.5は作業中にユーザーに更新情報を提供し、それらのアップデートの一部はテキストでターンを終了します(stop_reason: "end_turn")。そのようなターンをタスクの終了と見なす無人エージェントループは、そこで実行を停止します。いくつかの