资讯

消息称美光正探索开发近GPU NAND闪存以运行更大的LLM

36氪快讯·2026/9/3 06:43:56🔗 原文

📋总体概括

据新浪财经报道,美光正探索开发「近GPU NAND」架构,将高耐久性NAND闪存模块部署在靠近GPU的位置,面向不需要HBM或常规DRAM那样高带宽、低延迟的LLM工作负载。该方案牺牲一定存储密度(低于传统TLC/QLC NAND),换取更高的I/O速度、带宽和读取速度,目标是让GPU直接访问数百GB的存储池,缓解大模型推理的内存容量瓶颈。若落地,将成为HBM之外的另一条内存扩展路线,也凸显存储大厂在AI算力时代争夺新生态位。

关键信息

  • 美光探索「近GPU NAND」架构,将NAND闪存更靠近GPU部署
  • 面向不需HBM/DRAM级带宽与延迟的工作负载,主打密度与耐久性兼顾
  • 存储密度低于传统TLC或QLC NAND,但I/O速度、带宽和读取速度提升
  • 目标是让GPU直接访问数百GB存储池,解除LLM内存容量限制

🔥犀利点评

说穿了,这就是被HBM逼出来的穷人方案——HBM又贵又缺,DRAM容量又顶不到头,美光干脆把NAND往前挪一步,用耐久性和读取速度换一条中间路线。想法不新,CXL时代的存储分层早有铺垫,真正的问题是延迟鸿沟:NAND再快也快不过DRAM,LLM推理对延迟极其敏感,几百GB存储池听着美好,实际吞吐能不能喂饱GPU才是生死线。美光这是在下注AI推理成本战会逼厂商接受妥协,赌对了就是新增长曲线。

本文由本站自动聚合,以下为原始来源:前往 36氪快讯 阅读全文