AI・機械学習
予算別最適なLLM、毎日更新
Best LLM for every budget, updated daily (bestmodelforyourbudget.terrydjony.com)
要約
この記事は、大規模言語モデル(LLM)の性能と価格を比較し、予算に応じた最適なモデルを見つけるためのウェブサイトを紹介しています。日々の更新により、最新のモデル情報や価格対性能のフロンティアを確認でき、コストパフォーマンスに優れたモデルを特定できます。
全文翻訳
インテリジェンス コーディング 数学 最小スコア 30 モデルごとの1行 メーカー すべて フロンティアのみ すべての点をラベル付け 知能指数に対する性能対価格。100万トークンあたりのブレンドコスト(入力:出力 3:1、対数スケール)。詳細を表示するには、ポイントにカーソルを合わせるかタブで移動します。
値のフロンティアにおいて、より安価なモデルがそれを上回るか同等である場合、そのモデルは支配的です。値のフロンティアは、予算に最適なモデルを示します。
フロンティアはルックアップテーブルとして機能します。予算が該当する行を見つけてください。その価格で最も高いスコアのモデルが選択肢となり、次点はそれに次ぐ性能を持つモデルです。
予算あたりの100万トークンあたりの価格、スコア、価格、次点。
生の能力は、コストを完全に無視した場合の性能です。
変更点:日々の連続した取得間の差分:新しいモデル、削除されたモデル、再スコアリングまたは再価格設定されたモデル。
すべての数値:列ヘッダーをクリックして並べ替えます。名前はモデルの人工分析ページへのリンクです。
モデル メーカー インテリジェンス コーディング 数学 ブレンド $/1M 入力 $/1M 出力 $/1M トークン/秒 TTFT 秒
読み方:値のフロンティア。価格の昇順で並べ替え、より安価なすべてのモデルよりも高いスコアを持つすべてのモデルを保持します。価格のタイはより高いスコアが優先され、スコアのタイはより安価なモデルが優先されます。100万トークンあたりのブレンド価格は、人工分析による100万トークンあたりの3:1の入力:出力のブレンドです。キャッシュ入力割引、バッチ価格設定、高速モードは含まれていません。
「モデルごとの1行」は、各モデル名の最も高いスコアの試行または推論バリアントを保持します(タイはより安価な方が優先されます)。これをオフにすると、低、中、高、超高、最大などのすべてのバリアントのAAベンチマークを個別に表示できます。
「最小スコア」は、そのインデックスを下回るモデルをチャートとフロンティア計算の両方から非表示にします。そのため、非常に安価な古い小さなモデルが線形を固定することはありません。
スコアは変動します。AAはバージョン間でインデックスを再基準化するため、古いスナップショットと比較するのではなく、このページでのみ比較してください。
ソース:人工分析無料データAPI、GitHub Actionsのcronによって毎日取得されます。コードとデータ:github.com/terryds/bestvaluemodel。