https://www.youtube.com/watch?v=l5K_icg5JQA
一句话先总括
有一帮工程师,不想跟着英伟达用“一堆小芯片拼大网”的老路子,而是赌了一把“把整张晶圆做成一整块巨型 AI 芯片”,熬了十年,从差点倒闭到上市,靠“快”在 AI 推理时代翻了身。
1. 起点:百度先发现了“大力出奇迹”
2014 年前后,吴恩达在百度带团队搞 AI,Greg 等人发现:
- 模型越大、数据越多、算力越猛,效果就线性变好——这就是后来大名鼎鼎的 Scaling Law(规模定律)。
- 但问题来了:按这个定律往下推,以后的模型需要的算力,当时的 GPU 集群根本供不起。
- 百度的人心想:得换一种新硬件,不然路就走到头了。
2. 五个 AMD 老兵拍板:造“整张盘子那么大”的芯片
2015 年,5 个原来在 SeaMicro(后被 AMD 收购)干过的工程师离职,在一块白板上写心愿:
“以后计算机博物馆里得有我们的名字。”
他们给公司起名 Cerebras,核心想法很疯:
- 别再把晶圆切成几百个小芯片了;
- 把整张晶圆(直径 300mm 那块硅圆片)直接做成一颗 AI 处理器;
- 计算单元、内存、连线全在同一片硅上,数据不用跑来跑去。
普通 GPU 像“好多小作坊拼起来的工业区”;
Cerebras 的 WSE 像“把整个工业区盖成一栋巨楼,所有车间走路就能到”。
面积最大是当时 GPU 的 58 倍,内存带宽能做到 GPU 的几千倍——因为它绕开了 HBM(高带宽内存)外挂那一套。
当时 Transformer 都没出生,他们就押这个,属于“在雾里赌物理”。
3. 投资人怎么敢信?——把“疯话”拆成小题做尽调
百度系投资人周楠接到任务:找英伟达以外的算力方案。
她花了 4 周把 Cerebras 的“疯”拆成 5 个能验证的小问题:
- 晶圆那么大,有瑕疵怎么办?整片废了?
- 第一次流片(试生产)能成功吗?
- 坏掉的区域能绕开吗?
- 真实 AI 模型能跑上去吗?
- 用户用 PyTorch 那些框架要不要重写代码?
Greg 去办公室一看:CEO 拿实验本讲集成思路,工程师搬出大金属散热器,最后掏出一整片晶圆样品——
“哦,你们不是做更好用的 GPU,你们是真在造更大的芯片。”
周楠在模拟器上把百度 3 亿参数模型接进去跑,结论:架构可行。百度领投了 C 轮。
4. 良率怎么破?——“把核心做蚂蚁大 + 备胎绕路”
整张晶圆按 5nm 算,差不多有 46 个缺陷点。传统大核心(如 H100 一个核 6mm²)碰上一个缺陷就废 6mm²;
Cerebras 把单个核心缩到 0.05mm²(百分之一),碰上缺陷只废芝麻大一点。
再留 1%~1.5% 备用核心,出厂测试时发现坏区,就用片上网络自动绕开。
从软件看,整片晶圆还是“一块完美芯片”。
这招内存厂用过大半辈子,Cerebras 的狠劲是把这套逻辑放大到“整张桌子大小”的尺度。
5. 隐身三年,每月烧 800 万美元
2016–2019 年,外面没人知道这家公司。
- 晶圆级芯片功耗 25 千瓦,餐盘大小面积上发热像个小电炉;
- 散热、供电、机架接口全得重做;
- 每六周董事会,Andrew 只能说“还没好”。 三年烧掉近 3 亿美金。
2019 年夏,WSE-1 真跑起来了:
- 4.5 万 mm²,40 万个核心,18GB 片上 SRAM(英伟达同期只有几十 MB);
- 整机叫 CS-1,冰箱大小直接插机房。 同一年融 E 轮成独角兽,但商业客户不买账——只卖了十几台,第二代三百台,第三代才上万台。
真正帮忙背书的是美国国安系实验室:
阿贡拿它分析新冠毒株(后来拿戈登贝尔奖)、劳伦斯利弗莫尔跑核聚变、国家能源实验室测出比自家超算快 500 倍。
6. 阿联酋 G42 救了营收,也挡了第一次上市
2023 年,阿布扎比 G42 找 Cerebras 建“Condor Galaxy”超算(4 exaflops,合同 10 亿+美元),想做阿拉伯语 ChatGPT。
结果:
- 2023 年营收 7870 万,G42 占 83%;
- 2024 上半年 G42 占 87%。 2024 年 9 月交 S-1 准备上市,CFIUS(美国外资审查)以“阿联酋客户占比太高”卡住,撤表。 拖到 2025 年 3 月 CFIUS 放行,期间靠 G 轮(81 亿估值)、H 轮(230 亿估值)续命。
7. 转机:AI 从“练模型”变成“用模型”,Cerebras 的“快”值钱了
训练模型是“一次性大批量并行算”,GPU 很擅长;
推理(你问 AI、AI 一个字一个字蹦答案)是串行的,每蹦一个字都要把权重从内存搬进计算单元——这时候内存带宽决定快慢。
Cerebras 的整片晶圆内存就在旁边,带宽几千倍于 GPU,
实测推理速度比 GPU 快约 15 倍,能跑到 2000+ token/秒(普通方案 200–300)。
2025 年平安夜,两件大事:
- 英伟达拉 Groq(做 LPU 的对手)签 200 亿;
- OpenAI 反手给 Cerebras 签 200 亿+ 推理合同(750MW,2030 可到 2GW),几周内就接进 Codex,出“Code、Spark”模型。
同时 Cerebras 把服务包成 OpenAI 兼容 API,开发者换 key 就能用;
2026 年 3 月再拉 AWS 入伙:AWS 芯片做“读题(prefill)”,Cerebras 做“答题(decode)”,除了英伟达,超大规模云全合作。
8. 2026 年 5 月上市,千亿市值但马上被毛利率拷问
发行价区间 120–160 美元,开盘狂飙到 311 美元收盘,盘中市值近千亿。
但 6 月首份财报:
- 收入超预期;
- 指引毛利率从 47% 掉到 36–38%(因为倒租设备保客户、建数据中心贵);
- 股价跌 15%,破发过。
Andrew 解释:这是“按计划前面跑,但倒租设备压毛利”的阶段性代价。
长期风险仨:
- 台积电 5nm 独供(但幸好不用抢 HBM、CoWoS、3nm 这些最卷的产能);
- 英伟达+Groq、TPU、Trainium、Broadcom 定制 ASIC 围攻;
- OpenAI 自己也在跟 Broadcom 搞推理芯片 Jalapeño,未来可能分流。
用个比喻收尾
- 英伟达是“用一万辆卡车组车队运货”,成熟、通用、生态无敌;
- Cerebras 是“把仓库和工厂盖成同一栋楼,货物不用出门”,单点极快,但楼只能台积电盖、楼里布线自己搞、楼太热得特制空调;
- 十年前这楼被笑“盖不起来”;
- 现在 AI 进入“大家天天找 AI 对话、Agent 实时干活”的阶段,“出货快不快”比“能练多大”更急,这栋楼突然成了香饽饽。
所以 Cerebras 不是“英伟达挑战者爽文”,而是一个“物理赌局+工程死磕+赶上了推理时代”的硬科技样本。
要不要我把上面这版再压成 5 条 bullet 发给你,方便直接转述?
Top comments (0)