Groq(未上市)
一句话定位
LPU(语言处理单元)推理芯片,推理芯片 SRAM 阵营另一极:靠 230MB 片上 SRAM + 确定性数据流(编译期固定每个操作的顺序与时序)把 decode 延迟压到极短。2025/12 被 NVIDIA 以约 $200亿 非独家授权 + 挖走创始人。
投资论点 (Bull)
- 确定性数据流 = 极低延迟:执行期无调度浪费,token 生成延迟极短,实时响应最强。
- 被 NVIDIA 认证:延迟优化技术强到 NVIDIA 宁可 $20亿 许可收编、并整合进自家推理栈——挑战者技术越锋利,越成为许可/收购目标而非正面竞争对象。
熊方论证 (Bear)
- SRAM 只 230MB(Cerebras 的 1/190):跑大模型必须把很多芯片串成系统,系统设计复杂。
- 已被 NVIDIA 收编:核心人才(创始人 Jonathan Ross)已去 NVIDIA,Groq 独立运营 GroqCloud 但延迟优化已成 NVIDIA 推理栈内部元件——独立性存疑。NVIDIA Groq LPX 若量产将直接吃 Groq 空间。
关键数据
- NVIDIA 非独家授权约 $200亿(2025/12),非收购;Groq 仍独立,新 CEO Simon Edwards,续营 GroqCloud。
在产业链中的位置
- 推理芯片 SRAM 阵营(vs Cerebras 晶圆级:Groq 小 SRAM+多芯片串联,Cerebras 单晶圆装大模型)
- 案例意义:示范 NVIDIA「许可+挖人」吸收差异化对手的打法(78-推理芯片架构图)
- 呼应 87-韩国半导体专家:NVIDIA 收 Groq = 客户找替代推理架构、减少对 GPU+HBM 依赖的信号之一