Cerebras、最速AIアクセラレータCS-4発表

원제: Cerebras CS-4

왜 중요한가

GPU依存の推論インフラに対し、ウェーハスケール設計で30倍の速度優位性を示す製品の量産出荷は、大規模AI推論市場の競争構図に直接影響する。

Cerebrasは2025年、新型AIアクセラレータ「CS-4」を発表した。GPU比最大30倍の推論速度と、CS-3比最大10倍のワットあたりスループットを実現するラックスケールシステムで、今四半期より初回出荷を開始する。

Cerebrasが発表した「CS-4」は、同社の新プラットフォーム「Nexus Platform Architecture」の第一弾となるラックスケールAIアクセラレータだ。1システムに3基のWSE-3 Turbo(WSE-3T)ウェーハを搭載し、GPU比最大30倍の推論速度、CS-3比最大10倍のワットあたりスループットを達成するとしている。

ウェーハ間インターコネクトのレイテンシを2マイクロ秒まで低減することで、パラメータ数10兆超の大規模モデルでも毎秒1,000トークン以上の生成速度を維持し、インタラクティブな応答性を確保する。

ハードウェア設計では「Wafer-Scale Backpack」と呼ぶモジュール式コンピュートユニットを採用。ウェーハ、電力変換、液冷システム、高速I/O、制御エレクトロニクスを1つのコンパクトな3Dパッケージに集約し、部品点数を従来比50%削減した。電力供給経路をプロセッサから0.5ミリメートルの距離に設計することで、従来のGPUボード(約50ミリメートル)と比べ基板レベルの電力損失をほぼゼロに抑え、WSE-3Tへの供給電力を2倍に増加している。

また、電力・冷却・ネットワーク層をコンピュートモジュールから分離する「Cerebras PowerRack」構造により、インフラ設置後にコンピュートバックパックを追加するだけで展開できる。これによりデータセンターへの導入期間を従来の数日から数時間へ短縮する。今四半期中に初回出荷を開始する予定。

출처

cerebras.ai — 원문 읽기 →