SambaNova SN40L
Reconfigurable dataflow units with three-tier memory for serving many models per node.
Full SambaNova SN40L record →Head to head
SambaNova SN40L (SambaNova) and Cerebras WSE-3 (Cerebras) both sit in Chips & Compute. Cerebras WSE-3 shipped more tracked changes in the last 30 days (9 vs 5). Every value below comes from the latest crawl of the vendors' own pages.
| Attribute | SambaNova SN40L SambaNova | Cerebras WSE-3 Cerebras |
|---|---|---|
| Segment | Chips & Compute | Chips & Compute |
| Version | SN40L | WSE-3 |
| Entry cost | Free tier available. Paid plans include Developer (Pay-as-you-go) and Enterprise (Subscription-based). | Free tier / developer tier pricing available (contact/partner integrations) |
| Pricing tiers | Free free · Developer (Pay-as-you-go) free | Developer Tier free |
| Model stack | DeepSeek-V3.1 · gpt-oss-120b · Llama / DeepSeek open weights · Llama 3.1 · Llama 3.1 (8B, 70B, 405B) · Llama 3.1 405B · Llama 3.1 70B · Llama 3.1 8B · MiniMax M2.7 · RDU dataflow · SambaRack SN40-16 · SN40L RDU | Codex-Spark · Gemma · Gemma-4-31B · GLM-4.7 · GPT 5.6 Sol · GPT-5.6-Sol-Ultrafast · Kimi K2.6 · Llama · Llama / Qwen / GPT-OSS · Qwen · WSE-3 |
| Context window | — | — |
| Public API | ||
| Routes models | ||
| Changes / 30d | 5 | 9 |
| Origin | Global | Global |
| Capabilities | three-tier memory, many models per node, fast open-model serving, Reconfigurable Dataflow Unit (RDU), Three-tier memory architecture, Dataflow processing, Low power inference, Multi-model concurrency | wafer-scale engine, record token/s on open models, CS-3 systems, training clusters, Wafer-scale AI inference, Cerebras PyTorch, ModelZoo, Low-level SDK |
Reconfigurable dataflow units with three-tier memory for serving many models per node.
Full SambaNova SN40L record →Single-wafer accelerators delivering the fastest published open-model token rates.
Full Cerebras WSE-3 record →