Appearance
Cerebras
Cerebras 是一家 AI 计算基础设施公司,以 Wafer Scale Engine(WSE) 晶圆级处理器著称。通过将整张晶圆制成单一芯片,Cerebras 突破了传统 GPU 多芯片互联的瓶颈,在 AI 训练和推理领域实现了行业领先的性能。由 Andrew Feldman 团队于 2015 年创立,总部位于加州 Sunnyvale。
Overview
Cerebras 的核心理念是:芯片间互联是 AI 计算的瓶颈。传统 GPU 将晶圆切割成多个小芯片,再通过互联技术拼接,这引入了巨大的通信开销。Cerebras 反其道而行,将整张 300mm 晶圆制成一个处理器,从根本上消除了芯片间互联问题。
核心产品
Wafer Scale Engine (WSE)
Cerebras 的晶圆级芯片经历了三代演进:
| 代际 | 时间 | 晶体管 | AI 核心 | 片上 SRAM | 内存带宽 |
|---|---|---|---|---|---|
| WSE-1 | 2019 | 1.2 万亿 | 40 万 | 18 GB | 9 PB/s |
| WSE-2 | 2021 | 2.6 万亿 | 85 万 | 40 GB | 20 PB/s |
| WSE-3 | 2024 | 4 万亿 | 90 万 | 44 GB | 21 PB/s |
注:WSE-3 的 44GB SRAM 是单个芯片的容量,远超任何单 GPU 的 HBM 容量
CS-3 系统
- 单机柜晶圆级计算系统,支持液冷
- 可扩展至数十个机柜
- 专为超大规模 AI 工作负载设计
Condor Galaxy 超算网络
与阿联酋 G42 合作建设的全球 AI 超算网络:
- CG-1:4 exaFLOPs FP16,5400 万核心
- 持续扩展中,目标构建全球最快 AI 超算网络
- 用于医学研究、气候建模、科学计算等领域
云服务
Cerebras Cloud
- 按需付费的云上推理与训练服务
- 支持 Llama、DeepSeek 等主流模型的高速推理
Cerebras on AWS
2026 年 3 月宣布登陆 AWS 云,标志着晶圆级计算从专用设施向主流云平台扩展:
- 通过 AWS Marketplace 访问
- 与 AWS 生态集成
关键里程碑
| 时间 | 事件 |
|---|---|
| 2015 | 公司成立 |
| 2019 | WSE-1 / CS-1 发布,首次证明晶圆级计算可行性 |
| 2021 | WSE-2 / CS-2 发布,性能翻倍 |
| 2022 | 获 Gordon Bell 特别奖(COVID-19 蛋白质折叠研究) |
| 2023 | Condor Galaxy 超算网络 unveiled |
| 2024 | WSE-3 / CS-3 发布,4 万亿晶体管 |
| 2026.3 | 登陆 AWS 云,进入主流云计算生态 |
技术特点
晶圆级优势
- 消除互联瓶颈:芯片内通信速度比芯片间快 1000 倍以上
- 海量片上内存:44GB SRAM 提供 PB/s 级带宽
- 稀疏性加速:原生支持结构化稀疏计算
- 确定性性能:无缓存未命中等不可预测因素
与 GPU 的对比
| 维度 | Cerebras WSE-3 | NVIDIA H100 |
|---|---|---|
| 芯片面积 | 整晶圆 (~46,000 mm²) | 814 mm² |
| 片上内存 | 44 GB SRAM | 50 MB L2 Cache |
| 内存带宽 | 21 PB/s | 3.35 TB/s |
| AI 核心数 | 90 万 | 约 1.7 万 CUDA 核心 |
| 适用场景 | 超大规模模型 | 通用训练/推理 |
| 部署形态 | 专用系统 | 通用服务器 |
生态定位
训练+推理双优
不同于 Groq 专注推理,Cerebras 兼顾两端:
- 训练:超大模型的预训练和微调
- 推理:高吞吐量的模型服务
超大规模模型
Cerebras 特别适合 1T+ 参数模型的训练与部署:
- 模型参数可完全驻留在片上内存
- 无需频繁的片外内存访问
- 线性扩展性优异
研究机构与企业
主要客户领域:
- 医学研究(蛋白质折叠、药物发现)
- 密码学与网络安全
- 能源与气候建模
- Agentic AI 基础设施
局限性与挑战
- 部署门槛:需要专用设施和液冷系统
- 软件生态:CUDA 生态的成熟度仍领先
- 成本:初期投入远高于 GPU 集群
- 通用性:针对特定工作负载优化,通用计算效率不如 GPU
Synthesis
Cerebras 代表了 AI 芯片设计的极端专业化路线——用物理层面的创新(整晶圆芯片)解决系统层面的问题(互联瓶颈)。虽然部署门槛高,但在超大规模模型训练和特定科学计算场景中具有不可替代的优势。登陆 AWS 是其从"实验室技术"走向"主流基础设施"的关键一步。
Related Pages
- Groq — LPU 推理芯片对比
- SambaNova — 数据流架构 AI 芯片
- NVIDIA — GPU 计算平台
- Scaling Laws — 大模型训练的理论基础
- Model Inference & Deployment — 模型推理与部署
- AI 基础设施与算力市场趋势 — AI 基础设施与算力市场趋势
Sources
- raw/articles/cerebras-company-overview-2026-07-01.md
- Cerebras 官方技术白皮书
- Cerebras 博客
- AWS 合作公告 (2026-03)