HN 日本語サマリー

← 一覧へ戻る
AI・機械学習

GPT-5.6 Sol Ultrafast を Cerebras で高速化

Accelerating GPT-5.6 Sol Ultrafast (cerebras.ai)

670 pointsby pr337h4m262 コメント

要約

CerebrasとOpenAIは、Cerebrasの技術を搭載した新しいサービスティア「Ultrafast Mode」を発表しました。このモードは、GPT-5.6 Solモデルを毎秒最大750トークンという驚異的な速度で実行可能にし、品質を損なうことなく、時間的制約の厳しいミッションクリティカルなワークフローを加速させます。特に、Humanity's Last Examのような高度なベンチマークでは、従来のモデルと比較して大幅な速度向上と高い精度を示しました。

全文翻訳

2026年8月13日 GPT-5.6 Sol Ultrafast を Cerebras で高速化 Joyce Er 本日、CerebrasとOpenAIは、Cerebrasによって提供される新しいサービスティア「Ultrafast Mode」の初期プレビューを共有します。Ultrafastは、まずOpenAI APIで提供が開始され、当初は一部の選ばれた顧客に提供されますが、アクセスは時間とともに拡大されます。Cerebrasは、UltrafastモードでGPT-5.6 Solを駆動し、毎秒最大750の出力トークンを品質の妥協なしに提供することで、Sol Ultrafastが最も時間的制約のある、ミッションクリティカルな作業を加速できるようにします。 前例のない速度でのフロンティアインテリジェンス AIビルダーは常に、速度とインテリジェンスのどちらかを選択する必要がありました。モデルがサイズとインテリジェンスをスケールアップするにつれて、計算コストとデータ移動コストが増加し、応答時間が遅くなります。ユーザーは、高品質な結果を待つか、短い時間枠内で劣った結果を受け入れる必要がありました。 GPT-5.6 Sol Ultrafast はこのトレードオフを解決し、毎秒が重要な製品やワークフローにフロンティアインテリジェンスをもたらします。人工知能分析が報告した出力速度と比較して、UltrafastモードのGPT-5.6 Solは、Fable 5よりも11倍速く、Opus 4.8のFastモードよりも5倍速く実行されます。 Cerebrasでは、Humanity's Last ExamでUltrafastを人気モデルと直接対決させてテストしました。HLEは、化学、経済学、文学などの分野で博士号を持つ者だけが通常回答できる、2,500の質問からなる困難なモデルベンチマークです。 私たちの評価では、UltrafastモードのGPT-5.6 Solは、11時間11分でHLEの全2,500問に回答しました。Claude Fable 5は、同じ結論に達するために78時間27分、つまり3日以上の連続したコンピューティング時間を必要としました。言い換えれば、Ultrafastは、ほぼ7倍速い同等の精度を達成しながら、単一の稼働日で人間の知識のフロンティアを処理しました。 Humanity's Last Exam ベンチマーク ベンチマークは、2026年7月10日にGPT 5.6 Sol UltrafastとCodex on xhigh reasoning、および2026年7月13日から15日にClaude Fable 5とClaude Code on xhigh reasoningを使用してCerebrasによって実行されました。 モデルの機能が進歩し続けるにつれて、高速推論のアプリケーション範囲は拡大します。GPT-5.6 Solは、法律文書、金融モデル、エンジニアリングレポートにおいて、OpenAIのこれまでの最良のモデルです。経済的に価値のある知識作業タスクのベンチマークであるGDP-Valでは、Ultrafastは品質低下なしに5.6倍のエンドツーエンド速度向上を実現し、高速推論がいかに経済的に価値のある作業を加速できるかを示しました。 ベンチマークは、2026年7月31日にCerebrasによってGPT 5.6 SolとGPT 5.6 Sol Ultrafast on medium reasoning within Codexを使用して実行されました。 高速インテリジェンスがハイステークスの作業を推進 より高速なインテリジェンスは、個人や組織にとって可能なことを変えます。Ultrafastを使用すると、毎秒が重要な問題のクリティカルパスにエージェントを配置できるようになり、顧客の信頼を維持し、収益損失を防ぎ、SLAに対するダウンタイムを節約できます。また、敵対的でハイステークスのサイバー攻撃においては、Ultrafastは、壊滅的な損失を封じ込めるために悪意のあるアクターを迅速に検出し対応する必要があるセキュリティチームにとって、貴重なツールとなります。 より広範には、Ultrafastはエージェントとのまったく新しい作業モードを可能にし、リアルタイムの洞察と更新を提供するため、エージェントを最大限に活用するために複数の並列セッション間でコンテキストを切り替える必要がなくなります。 「以前はタスクが完了するのを数分待つ必要がありましたが、今ではコンテキストを切り替える機会さえ与えられる前に完了します。これにより、私ははるかに生産的になります。」 Jeffrey Wang, OpenAI Researcher Ultrafastを使用すると、研究者やエンジニアは、最も重要な特定の問題に深く取り組むために注意を予約しながら、コモディティタスクの並列化には標準処理を使い続けることができます。Cerebrasは、AIイノベーションの次の波を推進し、応答性の高いAIで個人や組織が達成できることの天井を引き上げることに興奮しています。 驚異的な速度は画期的なイノベーションによって可能になる UltrafastモードのGPT-5.6 Solは、フロンティアAIワークロードのために特別に構築されたCerebrasの革新的なWafer-Scale Engineアーキテクチャによって駆動されています。高速フロンティア推論はデータ移動の問題です。GPUでは、大規模モデルの推論はメモリ帯域幅によってボトルネックになります。モデルの重みをオンチップメモリとオフチップストレージ間で繰り返し転送して、モデル応答内の連続したトークンを生成する必要があるためです。 Cerebrasはこの非効率的なデータ移動を排除するために逆張り的なアプローチを取っています。各ウェーハサイズのチップに44GBのSRAMを搭載しています。重みはチップ上に留まり、トークンはウェーハ全体にパイプライン化されたモデルレイヤーを中断なく流れます。この技術的アプローチは、モデルサイズとともにスムーズにスケールし、将来のフロンティアモデルでの継続的な速度優位性の道を開きます。 Ultrafast: 限定プレビュー中 UltrafastモードのGPT-5.6 Solは、本日より一部の選ばれた顧客に限定プレビューで提供されます。容量が増えるにつれてアクセスは拡大します。アップデートにサインアップしてください。