研53:NVIDIA 内存分层革命,SSD 当内存,NAND 控制器重估

核心论点

AI 内存瓶颈下,业界把便宜大容量的 SSD 拉进内存阶层当 DRAM 延伸(存 KV Cache)。这让过去被商品化、“够用就好”的 NAND Flash 控制器从成本项重估为差异化项。独立控制器双雄群联/慧荣 + ODM”民主联军”迎来黄金时代。是 内存周期 的存储层视角,与 Damnang 内存税 的绕道赛道呼应(HBF/预测分层/模块创新)。

关键论证与数据

  • Prefill/Decode + KV Cache:Decode 每字回翻 KV Cache,塞爆 HBM(几千字对话 >1GB × 长上下文 × 并发)。每 GB HBM 耗 ~3x DDR5 晶圆 → 抽干标准 DRAM。
  • NVIDIA CMX(Context Memory Storage):DRAM 与存储间造 G3.5「脉络记忆体层」= 高速 NVMe SSD。四角色:Dynamo+NIXL(软件预判)、BlueField-4 DPU(第三颗大脑,RDMA 绕 CPU + 语义翻译 4K→512B + 硬件加密)、Grove、Spectrum-X。AMD 2026-06 收 MEXT(预测分层)。
  • 控制器新要求:IOPS 6M→100M(~20x)、颗粒度 4K→512B、QoS、与 DPU 主动协作。
  • 两阵营:垂直整合 NAND 巨头(三星/SK hynix Solidigm/Micron/Kioxia/SanDisk)vs 独立控制器”民主联军”(Phison 群联 8299.TW / SIMO 慧荣 SIMO + 广达/纬颖/Supermicro)。MRVL Marvell 高阶定制、FADU 韩国原生。
  • NVIDIA 两种态度:HBM 封闭深绑、SSD 开放(CMX 开放标准)→ 压低 SSD 成本、利润留 GPU。
  • 反直觉:SSD 当内存不减 DRAM 需求(Jevon’s Paradox,DRAM 被释放去做低延迟任务)。
  • 现状小(仅高阶机柜),规模供货 2026 H2,NVIDIA Rubin H2 2026 部署。

两家对比

  • Phison 群联:混合全栈(Pascari 自有 SSD + aiDAPTIV+ 软件),受益平价/边缘 AI;风险=渠道冲突 + NAND 价格波动。
  • SIMO 慧荣:纯控制器”卖铲子”(MonTitan 平台,H2 2026 起贡献),轻资产;风险=被 NAND 巨头内制夹击。

涉及标的与主题

内存周期 · 内存分层与SSD · 内存税 · HBM · CXL · Phison SIMO MRVL Micron;三星/SK hynix/Kioxia/SanDisk/FADU/AMD MEXT