资讯

消息称美光正探索开发近GPU NAND闪存以运行更大的LLM

36氪快讯·2026/9/3 06:43:56🔗 原文

📋总体概括

据报道,美光正探索开发「近GPU NAND」高耐久性闪存模块,让NAND更靠近GPU,服务不需要HBM或常规DRAM那样高带宽、低延迟的工作负载。该方案密度虽低于传统TLC/QLC NAND,但重点提升I/O速度、带宽与读取速度,让GPU能直接访问数百GB存储池,从而缓解LLM推理的内存容量瓶颈。这一动向反映了AI浪潮下存储厂商绕开HBM成本困局、向计算架构深处渗透的新竞争方向。

关键信息

  • 美光正在探索「近GPU NAND」架构,将NAND闪存靠近GPU部署
  • 目标负载为不需要HBM或常规DRAM级延迟与带宽的场景
  • 该方案密度低于传统TLC/QLC NAND,但强调I/O速度、带宽和读取速度
  • 新架构可让GPU直接访问数百GB的存储池,缓解LLM的内存限制

🔥犀利点评

这本质上是HBM供不应求、价格高企逼出来的穷人版方案——用NAND的密度和耐久性去补内存墙的缺口。听起来美好,但NAND的延迟和带宽与DRAM差着数量级,所谓「不需要高带宽的负载」在LLM推理里恰恰是最需要带宽的权重读取,能不能落地要看架构怎么绕。不过方向对了:存储开始主动贴近计算,而不是等内存池扩容,美光这是在赌一个架构级换道的机会。

本文由本站自动聚合,以下为原始来源:前往 36氪快讯 阅读全文