AI・機械学習
AnthropicのサブスクリプションはOpenAIより5倍以上の価値を提供する
Anthropic Subscriptions Offer 5x+ More Value Than OpenAI (newsletter.semianalysis.com)
要約
SemiAnalysisの分析によると、Anthropicのサブスクリプションプランは、OpenAIと比較して、特にエージェント的な利用において5倍以上の価値を提供することが示されています。これは、サブスクリプションプランがAIラボの収益と利益率に大きな影響を与えるため、その制限を理解することが重要であることを示唆しています。
全文翻訳
AnthropicのサブスクリプションはOpenAIより5倍以上の価値を提供する
Anthropic、OpenAI、Meta、SpaceXAI、MiniMax、Moonshot、Z.ai、Cursor、Cognitionの全AIサブスクリプションプランのテスト
Andrew Megalaa、Max Kan、Dylan Patel
2026年10月5日∙有料12712シェア
サブスクリプションプランは、消費者や中小企業がAIに支払う主な方法であり続けています。これらのプランは、以前説明したように、大幅に補助金が出ていますが、強力な顧客獲得およびマーケティングツールとして経済的に意味をなす可能性があります。例えば、OpenAIの寛大なリセットによって生み出された好意は、Codexの採用の最近の急増に部分的に責任があり、世論の非難を避けるためにAnthropicに計画されたサブスクリプションの弱体化を繰り返し撤回させることになりました。
さらに、サブスクリプションプランは非常に補助金が出ているため、総収益のごく一部に過ぎないにもかかわらず、マージンとMWあたりの収益に大きな影響を与える可能性があります。Anthropicの以下の概算数値を見てみましょう。
出典: SemiAnalysisトークノミクスモデル
全体収益のわずか10%に過ぎないにもかかわらず、サブスクリプションは推論コンピューティングの40%以上を占め、MWあたりの平均収益を約3600万ドル低下させます。サブスクリプションはOpenAIにとってさらに重要であり、総収益のより大きな割合を占めています。具体的な数値については、当社のトークノミクスモデルを参照してください。
つまり、AIラボの財務を正確にモデル化したいのであれば、サブスクリプションの制限を理解する必要があります。
では、制限は実際にどのように機能するのでしょうか?サブスクリプションを考える方法は、月々の支払いが一定数の「クレジット」を付与するというものです。各(モデル、トークンタイプ)の組み合わせは、異なる量のクレジットを消費します。クレジットコスト比率はAPI価格比率と劇的に異なる場合があるため、同じプランの「価値」は、実行しているモデルとワークロードによって異なります。言い換えれば、プランが単独でXドルの価値があると言うのは意味がありません。完全な(プラン、モデル、ワークロード)タプルを考慮する必要があります。
同じ月額200ドルのClaudeプランのAPI相当の価値が、モデルとワークロードによってどのように変化するかを示します。
出典: SemiAnalysisトークノミクスモデル
静的な単一のスナップショットでも十分ではありません。ラボは、プロモーションや新しいモデルのリリースとともに、制限を常に公開で変更しています。また、クレジットコストを調整することで、いつでも静かに制限を変更できます。理想的には、リアルタイムで変更を表面化できるように、毎日各(プラン、モデル、トークンタイプ)のコストを再確認する必要があります。
これはまさに、SemiAnalysisがトークノミクスモデルの加入者のみが利用できる新しいサブスクリプションダッシュボードで行ったことです。OpenAIとAnthropicのすべてのサブスクリプションに加えて、Meta、SpaceXAI、Cursor、Cognition、Z.ai、MiniMax、Moonshotも追跡しています。
利用可能なデータのサブセットを示すダッシュボードのスクリーンショット。出典: SemiAnalysisトークノミクスモデル
新しいプロバイダー、プラン、モデルは、リリースされ次第追加されます。この記事の残りの部分では、現在のすべての制限の概要を説明します。特に指定がない限り、以下のすべてのトークンおよびドル金額はエージェント的な使用を想定しています。
方法論
トークンは一般的に、以下のタイプごとにMTok(100万トークン)あたりで価格設定されています。
入力: LLMのコンテキストウィンドウに追加される新しいトークンで、キャッシュされないもの。
キャッシュ書き込み: 会話の複数ターンでキャッシュされる入力トークン。通常、通常の入力トークンよりもわずかに高価です。
キャッシュ読み取り: 会話に既にキャッシュされている以前のターンからのトークン。通常、キャッシュされていないトークンと比較して非常に安価です。
出力: モデルによって生成されるトークン。最も高価なトークンタイプです。
さらに、一部のモデルは、特定のコンテキストウィンドウを超えたトークンに対して追加料金を課します。これらのモデルは通常、その高価なコンテキストウィンドウに達する前に圧縮されるため、測定値もその下に保ちます。
出典: OpenAI
サブスクリプションプランは、このような細かい価格設定を公開していません。代わりに、5時間および7日間のウィンドウ全体での0〜100%の使用率メーター、およびモデルによってはFableのようなモデル用の個別のメーターを提供します。サブスクリプションティアは、プロバイダーの他のプランに対する使用率の倍率のみによって区別されます。例えば、OpenAIは、20ドルのPlusプランで「Codexの使用率が拡大」、100ドルのProプランで「Plusの5倍の使用率」、200ドルのProプランで「20倍の使用率」を宣伝していましたが、その後200ドルのプランの使用率を半分にし、価格ページからすべての相対使用率を削除しました。
Claudeコードメーターのスクリーンショット。出典: Claude Code CLI
セットアップ
各(プラン、モデル、トークンタイプ)のトリプルについて、1つのトークンタイプのみを分離し、モデルプロバイダーのメーターがどれだけ動くかを監視する実験を実行することで、サブスクリプションレートを計算します。実験とは、特定のプロンプトを使用して1つのトークンタイプを最大化し、他のすべてを最小化する一連の繰り返し呼び出しです。
出典: SemiAnalysisトークノミクスモデル
入力、キャッシュ書き込み、キャッシュ読み取りは同じプロンプトテンプレートを共有します。一部のモデルは大量のランダムな文字列を与えられると応答を拒否するため、War and Peaceの一部を使用します。入力トークン実験では、何もキャッシュされないようにするために、各呼び出しにランダムなタグを使用します。キャッシュ書き込み実験は同じように実行されますが、プロンプトはキャッシュ用にマークされているため、各新しいタグは新しいキャッシュエントリを強制します。キャッシュ読み取り実験では固定タグを使用するため、最初の呼び出しでキャッシュが書き込まれ、それ以降の繰り返しでキャッシュが読み取られます。
出力トークン実験では、モデルが「SemiAnalysisを10万回繰り返す」のような機械的なプロンプトを拒否するため、長い出力を強制するために技術的なエッセイを使用しました。
結果の計算
各呼び出しについて、プロバイダーが請求したトークンの種類と、使用率メーターの読み取り値の2つを記録します。これらを価格に変換するには3つのステップがあります。
1. 各トークンタイプのレートを測定する
プロバイダーは一般的に、固定量で動くメーターで利用状況を報告します。これは、パーセントポイント全体、クレジット、セントなどです。単一のリクエストではメーターが全く動かないことが多いため、1つのリクエストのコストを直接測定することはできません。
代わりに、ステップで測定します。リクエストを実行するにつれて、使用されたトークンの累積合計を保持します。メーターが上がるたびに、その合計を保存します。2つのメーターの移動の間のトークンが1ステップを構成し、メーターを1単位動かすコストとなります。
2つの不完全なステップを削除します。実行が開始されると、メーターは既に次の移動の一部を通過しているため、最初の移動前のトークンは完全なステップよりも少なく、レートが高く見えるようになります。最後の移動後のトークンはステップを完了しないため、それらも削除します。
レートを得るには、完了したステップでメーターがどれだけ動いたかを合計し、それらのステップで使用されたトークンで割ります。プロバイダーは入力、出力、キャッシュされたトークンに対して異なる料金を課すため、各タイプごとに個別のレートを計算します。
出典: SemiAnalysisトークノミクスモデル
注意点:
リクエストごとにメーターを1回しか見られないため、単一のステップは最大1つのリクエストでずれる可能性があります。これらのエラーは、より多くの連続したステップでは積み重ならないため、単一の数値ではなく範囲を追跡し、ステップ数を増やすほど範囲は狭まります。範囲が±5%以内になるまでステップを追加し続け、それらのすべてのレートを報告します。
リクエストには単一のトークンタイプのみが含まれることはありません。例えば、一部のプランでは、すべてのリクエストに一連の指示が必要です。他のタイプについて測定した価格を使用して、その追加量を差し引きます。
キャッシュからの読み取りは、一部のプランではほとんどコストがかからず、メーターが全く動かない場合があります。5億キャッシュ読み取りトークン後もメーターが動かない場合、キャッシュ読み取りは無料であると仮定します。
2. レートをウィンドウあたりおよび月あたりのトークンに変換する
プランが表示するすべてのメーターを、リクエストごとに読み取ります。これは5時間制限、週次制限、Fableのようなモデルの場合は独自の週次制限になる可能性があります。したがって、各トークンタイプは各メーターで価格設定されます。これは、100万トークンがその制限のどれだけを使用するかということです。各価格から、例えば100万トークンが制限の5%を使用する場合、全体の制限は2000万トークンを保持できると計算します。
出典: SemiAnalysisトークノミクスモデル
5時間制限は週に何度もリセットされるため、月は週次制限によって上限が定められます。
3. P