Cerebras CS-4とは?毎秒4,400トークンの「ラックまるごとAI」が推論市場に突きつける論点
Cerebrasが新型AIアクセラレータ「CS-4」を発表しました。チップは前世代と同じ5nmのWSE-3のまま、電力と冷却を増やしてクロックを引き上げ、1ラックあたりのウェハを2枚から3枚に増やすことでCS-3の2倍の性能を実現。ユーザーあたり最大4,400トークン/秒を出し、同社はNvidia GPU構成比で最大30倍速いと主張します。
Cerebrasが新型AIアクセラレータ「CS-4」を発表しました。チップは前世代と同じ5nmのWSE-3のまま、電力と冷却を増やしてクロックを引き上げ、1ラックあたりのウェハを2枚から3枚に増やすことでCS-3の2倍の性能を実現。ユーザーあたり最大4,400トークン/秒を出し、同社はNvidia GPU構成比で最大30倍速いと主張します。
Cerebrasの最初のラウンドを共同リードしたAdit Singh氏が、木曜、運用資産30億ドルのMayfieldにインフラ担当パートナーとして参画しました。移籍理由として本人が挙げたのは「シード段階のインフラ案件の金額が膨らみ、小規模ファンドが締め出されている」という市場構造の変化です。
OpenAIが、フラッグシップモデルGPT-5.6 Solで最大毎秒750出力トークンを実現する新モード「Ultrafast」のプレビューを開始しました。推論の高速化には、年内に100億ドル規模の提携を結んだCerebrasの技術が使われ、当初はOpenAI APIの一部顧客に限定して提供されます。
OpenAIがフラッグシップ「GPT-5.6 Sol」を限定公開で投入し、Terminal-Bench 2.1で88.8%(Sol Ultraは91.9%)を記録してAnthropicのClaude Mythos 5(88%)を僅差で上回りました。一方、米政府の指示で当面はパートナー向けAPIとCodexに限定された配布形態となり、OpenAIはこの仕組みを「長期的な標準にすべきでない」と公に批判しています。
米国で先月のテック業界の人員削減は約4万人と2年ぶりの規模に達し、AIが3カ月連続で最多の理由に挙げられました。一方でCerebrasやSpaceXのIPOで新たな億万長者が大量に生まれ、AIを口実とした構造的な格差拡大への懐疑が広がっています。