Cerebras WSE-3
Single-wafer accelerators delivering the fastest published open-model token rates.
Full Cerebras WSE-3 record →Head to head
Cerebras WSE-3 (Cerebras) and SambaNova SN40L (SambaNova) both sit in Chips & Compute. SambaNova SN40L is the cheaper entry point at Free tier available, followed by Pay-as-you-go developer tier.. Cerebras WSE-3 shipped more tracked changes in the last 30 days (10 vs 6). Every value below comes from the latest crawl of the vendors' own pages.
| Attribute | Cerebras WSE-3 Cerebras | SambaNova SN40L SambaNova |
|---|---|---|
| Segment | Chips & Compute | Chips & Compute |
| Version | WSE-3 | SN40L |
| Entry cost | Free tier · from $10/unit | Free tier available, followed by Pay-as-you-go developer tier. |
| Pricing tiers | Free Trial free · Developer $10 · Enterprise free | Free free · Developer Pay as you go free |
| Model stack | Codex-Spark · Gemma · Gemma-4-31B · GLM-4.7 · GPT 5.6 Sol · GPT-5.6-Sol-Ultrafast · Kimi K2.6 · Llama · Llama / Qwen / GPT-OSS · Qwen · WSE-3 | DeepSeek-V3.1 · gpt-oss-120b · Llama / DeepSeek open weights · Llama 3.1 · Llama 3.1 (8B, 70B, 405B) · Llama 3.1 405B · Llama 3.1 70B · Llama 3.1 8B · MiniMax M2.7 · RDU dataflow · SambaRack SN40-16 · SN40L RDU |
| Context window | — | — |
| Public API | ||
| Routes models | ||
| Changes / 30d | 10 | 6 |
| Origin | Global | Global |
| Capabilities | wafer-scale engine, record token/s on open models, CS-3 systems, training clusters, Wafer-scale AI inference, Cerebras PyTorch, ModelZoo, Low-level SDK | three-tier memory, many models per node, fast open-model serving, Reconfigurable Dataflow Unit (RDU), Three-tier memory architecture, Dataflow processing, Low power inference, Multi-model concurrency |
Single-wafer accelerators delivering the fastest published open-model token rates.
Full Cerebras WSE-3 record →Reconfigurable dataflow units with three-tier memory for serving many models per node.
Full SambaNova SN40L record →