
Cerebras Unveils CS-4, a Rack Built for Trillion-Parameter Inference
Cerebras says its new CS-4 rack, built from three WSE-3 Turbo wafers, delivers 750 PFLOPS and up to 30x GPU per-user token speed. Shipments start this quarter.
Seung Jung·
3m
Cerebras says its new CS-4 rack, built from three WSE-3 Turbo wafers, delivers 750 PFLOPS and up to 30x GPU per-user token speed. Shipments start this quarter.

OpenAI's new Ultrafast tier runs GPT-5.6 Sol at up to 750 tokens per second, 14x standard speed, powered by Cerebras wafer-scale chips in limited preview.