
News Observation Lab for Future
Cerebras CS‑4 ソリューションがもたらす超高速AI推論と省電力設計

超高速スループットの実現
CS‑4 ソリューションは推論性能のフロンティアをシフトし、CS‑3 と比較してワット当たり最大 10 倍のスループットを達成します。さらに、実稼働 GPU システムに比べて最大 30 倍高速にトークンを生成でき、スループットと対話性の両立を実現したシステムが誕生しました。
モジュラーコンピューティングバックパック設計
Cerebras はサーバー構造を根本的に再考し、各ウェーハスケール バックパックをウェーハ、電力変換、直接液体冷却、高速 I/O、制御電子機器を 50% 少ないコンポーネントでコンパクトな 3 次元パッケージに折りたたむ自己完結型アセンブリとして設計しました。この設計により製造工程が簡素化され、導入期間が数日から数時間へと短縮されます。
高密度電力供給による効率向上
CS‑4 はプロセッサからわずか 0.5 ミリメートル離れた位置で電力供給を行い、従来の GPU ボード(約 50 mm)に比べて約 100 倍近い距離での供給となります。これによりボードレベルの電力損失がほぼ排除され、WSE‑3T に対して 2 倍の電力を供給できるようになり、動作周波数の向上とトークン生成速度の高速化が実現します。
次世代ウェーハ I/O インターフェイス
CS‑4 は I/O 帯域幅を 2 倍に拡張し、遅延を短縮する新しいプログラマブル I/O サブシステムを採用しています。ウェーハ I/O モジュールを利用すればスイッチを介さずにウェーハ同士をラック内およびラック間で直接リンクでき、ウェーハ間レイテンシはわずか 2 マイクロ秒に抑えられます。これにより、数十兆パラメータ規模のモデルでも対話性が確保されます。
世界最高クラスの AI プロセッサ
CS‑4 は世界最大かつ最速の AI プロセッサである WSE‑3 Turbo 上で動作します。4 兆個のトランジスタと 900,000 個の AI コアを搭載し、250 PFLOP の演算性能と 1 秒あたり 43.2 ペタバイトのメモリ帯域幅を提供します。計算能力と帯域幅が 2 倍になり、遅延は半分以下になることで、AI の速度とスループットが大幅に向上しました。