HN 日本語サマリー

← 一覧へ戻る
科学・技術

Cerebras CS4

Cerebras CS4 (cerebras.ai)

409 pointsby sunils34248 コメント

要約

Cerebras CS-4は、AI推論を最大30倍高速化する新しいラック規模のソリューションです。GPUシステムと比較して大幅に高速な推論性能、経済性の向上、およびハイパースケール容量の展開パスを提供します。WSE-3 Turboチップを搭載し、モジュラー設計と革新的な電力・冷却・I/Oシステムにより、製造、展開、保守、アップグレードを簡素化し、フロンティアAIのためのアーキテクチャとなっています。

全文翻訳

最速のAIがさらに速くなりました。 まったく新しいCerebras CS-4をご紹介します。これは、GPUと比較して最大30倍高速な推論、経済性の向上、およびハイパースケール容量を展開するためのシンプルなパスを提供する、革新的なラック規模のソリューションです。これはフロンティアAIのためのアーキテクチャです。 システムあたり3つのWSE-3 Turbo 各ウェーハは、前世代の最大2倍の速度を提供します。 ウェーハあたりのパフォーマンス向上 まったく新しい電力、冷却、I/Oが、ウェーハあたりのパフォーマンスをさらに解き放ちます。 Nexusラック規模プラットフォーム ハイパースケールデータセンターでの迅速な展開を可能にします。 GPUより最大30倍高速 WSE-Turboを搭載したCS-4は、GPUシステムと比較して最大30倍高速な推論を提供し、本番環境で利用可能な最速の推論の新記録を樹立します。 より高い超高速スループット CS-4ソリューションは、推論のパレートフロンティアをシフトさせ、CS-3と比較してワットあたりのスループットを最大10倍向上させ、本番GPUシステムよりも最大30倍高速にトークンを生成します。その結果、スループットとインタラクティビティの両方を提供するように設計されたシステムが実現しました。 フロンティア対応アーキテクチャ ウェーハ間相互接続レイテンシを2マイクロ秒に削減することで、CS-4は10兆パラメータを超えるモデルで毎秒1,000トークン以上のパフォーマンスを提供し、前例のない規模でのインタラクティブなデコードパフォーマンスを維持します。 ハイパースケールのために構築 CS-4は、新しいCerebras Nexusプラットフォームアーキテクチャの最初のイテレーションです。これは、コンピューティング、電力、I/Oの3つの基盤要素からなるモジュラーコンセプトを中心に構築されており、それぞれが製造、展開、保守、アップグレードを簡素化するための重要なイノベーションを備えています。 モジュラーコンピューティングバックパックデザイン Cerebrasはサーバーを根本的に再考しました。各ウェーハスケールバックパックは、ウェーハ、電力変換、直接液体冷却、高速I/O、および制御電子機器をコンパクトな3Dパッケージに折りたたむ自己完結型アセンブリであり、コンポーネント数は50%削減されています。この設計は製造を簡素化し、展開時間を数日から数時間に短縮します。 高密度電力供給 従来のGPUボードの約50mmと比較して約0.5mmと、プロセッサから非常に近い位置に電力供給があるため、CS-4はボードレベルの電力損失をほぼ排除します。これにより、WSE-3Tに従来の2倍の電力を供給でき、より高い動作周波数と高速なトークン生成が可能になります。 次世代ウェーハI/Oインターフェース CS-4は、I/O帯域幅を倍増させ、レイテンシを削減する新しいプログラマブルI/Oサブシステムを導入しており、集約型および分散型のソリューションの両方にメリットがあります。ウェーハI/Oモジュールは、スイッチなしでラック内およびラック間でウェーハをリンクすることも可能にし、ウェーハ間レイテンシはわずか2マイクロ秒となり、数十兆パラメータを持つモデルのインタラクティビティの鍵となります。 インフラストラクチャを展開してからコンピューティングを展開 CS-4は、安定した電力、冷却、ネットワークレイヤーをモジュラーウェーハスケールコンピューティングから分離します。Cerebras PowerRackは、コンピューティングが到着する前に設置および施設認定を受けることができます。コンピューティングバックパックはスライドインして電力、冷却、データに接続され、展開を数日から数時間に短縮すると同時に、ハイパースケールでのサービスと将来のアップグレードを簡素化します。 CS-4の数字 最初のCS-4出荷はこの四半期に開始されます。 最速のAIをデータセンターに導入しましょう。 開始する データシート FAQ Cerebras CS-4とは何ですか? CS4はCS-3とどう違いますか? CS-4はどれくらい速いですか? CS-4はどれくらいのスループットを提供しますか? なぜCS-4はエージェント型AIに適しているのですか? ウェーハスケールバックパックとは何ですか? Nexusプラットフォームアーキテクチャはハイパースケール展開をどのように簡素化しますか? CS-4はどのモデルと推論アーキテクチャをサポートしていますか?