Skip to content

Cerebras

Cerebras 是一家 AI 计算基础设施公司,以 Wafer Scale Engine(WSE) 晶圆级处理器著称。通过将整张晶圆制成单一芯片,Cerebras 突破了传统 GPU 多芯片互联的瓶颈,在 AI 训练和推理领域实现了行业领先的性能。由 Andrew Feldman 团队于 2015 年创立,总部位于加州 Sunnyvale。

Overview

Cerebras 的核心理念是:芯片间互联是 AI 计算的瓶颈。传统 GPU 将晶圆切割成多个小芯片,再通过互联技术拼接,这引入了巨大的通信开销。Cerebras 反其道而行,将整张 300mm 晶圆制成一个处理器,从根本上消除了芯片间互联问题。

核心产品

Wafer Scale Engine (WSE)

Cerebras 的晶圆级芯片经历了三代演进:

代际时间晶体管AI 核心片上 SRAM内存带宽
WSE-120191.2 万亿40 万18 GB9 PB/s
WSE-220212.6 万亿85 万40 GB20 PB/s
WSE-320244 万亿90 万44 GB21 PB/s

注:WSE-3 的 44GB SRAM 是单个芯片的容量,远超任何单 GPU 的 HBM 容量

CS-3 系统

  • 单机柜晶圆级计算系统,支持液冷
  • 可扩展至数十个机柜
  • 专为超大规模 AI 工作负载设计

Condor Galaxy 超算网络

与阿联酋 G42 合作建设的全球 AI 超算网络:

  • CG-1:4 exaFLOPs FP16,5400 万核心
  • 持续扩展中,目标构建全球最快 AI 超算网络
  • 用于医学研究、气候建模、科学计算等领域

云服务

Cerebras Cloud

  • 按需付费的云上推理与训练服务
  • 支持 Llama、DeepSeek 等主流模型的高速推理

Cerebras on AWS

2026 年 3 月宣布登陆 AWS 云,标志着晶圆级计算从专用设施向主流云平台扩展:

  • 通过 AWS Marketplace 访问
  • 与 AWS 生态集成

关键里程碑

时间事件
2015公司成立
2019WSE-1 / CS-1 发布,首次证明晶圆级计算可行性
2021WSE-2 / CS-2 发布,性能翻倍
2022获 Gordon Bell 特别奖(COVID-19 蛋白质折叠研究)
2023Condor Galaxy 超算网络 unveiled
2024WSE-3 / CS-3 发布,4 万亿晶体管
2026.3登陆 AWS 云,进入主流云计算生态

技术特点

晶圆级优势

  1. 消除互联瓶颈:芯片内通信速度比芯片间快 1000 倍以上
  2. 海量片上内存:44GB SRAM 提供 PB/s 级带宽
  3. 稀疏性加速:原生支持结构化稀疏计算
  4. 确定性性能:无缓存未命中等不可预测因素

与 GPU 的对比

维度Cerebras WSE-3NVIDIA H100
芯片面积整晶圆 (~46,000 mm²)814 mm²
片上内存44 GB SRAM50 MB L2 Cache
内存带宽21 PB/s3.35 TB/s
AI 核心数90 万约 1.7 万 CUDA 核心
适用场景超大规模模型通用训练/推理
部署形态专用系统通用服务器

生态定位

训练+推理双优

不同于 Groq 专注推理,Cerebras 兼顾两端:

  • 训练:超大模型的预训练和微调
  • 推理:高吞吐量的模型服务

超大规模模型

Cerebras 特别适合 1T+ 参数模型的训练与部署:

  • 模型参数可完全驻留在片上内存
  • 无需频繁的片外内存访问
  • 线性扩展性优异

研究机构与企业

主要客户领域:

  • 医学研究(蛋白质折叠、药物发现)
  • 密码学与网络安全
  • 能源与气候建模
  • Agentic AI 基础设施

局限性与挑战

  • 部署门槛:需要专用设施和液冷系统
  • 软件生态:CUDA 生态的成熟度仍领先
  • 成本:初期投入远高于 GPU 集群
  • 通用性:针对特定工作负载优化,通用计算效率不如 GPU

Synthesis

Cerebras 代表了 AI 芯片设计的极端专业化路线——用物理层面的创新(整晶圆芯片)解决系统层面的问题(互联瓶颈)。虽然部署门槛高,但在超大规模模型训练和特定科学计算场景中具有不可替代的优势。登陆 AWS 是其从"实验室技术"走向"主流基础设施"的关键一步。

Sources

  • raw/articles/cerebras-company-overview-2026-07-01.md
  • Cerebras 官方技术白皮书
  • Cerebras 博客
  • AWS 合作公告 (2026-03)

AI Knowledge Base — 持续积累