资讯

中科曙光发布词元加速技术体系:IBGDA十万卡级集群完成验证

驱动之家·2026/9/11 08:39:00🔗 原文

📋总体概括

中科曙光发布scaleFabric词元加速技术体系,在国内率先实现IBGDA(InfiniBand GPU直连异步技术)规模化应用,并宣称已在十万卡级大规模集群完成验证。该体系构建算力、存储、传输三级紧耦合的词元加速通道,减少CPU参与关键通信路径,覆盖大模型训练、推理到存储复用全链路。此前IBGDA规模化落地主要由国际厂商主导,国产案例罕见,此举填补了国产RDMA网卡与GPU直通在大规模部署上的空白,为MoE等主流架构提供国产高速互连选择。

关键信息

  • 中科曙光发布scaleFabric Token加速技术体系,率先在国内实现IBGDA技术规模化应用
  • 自研IBGDA已在十万卡级大规模集群中完成验证,此前该领域国产落地案例极为罕见
  • 技术通过构建算存传三级紧耦合词元加速通道,实现训练、推理到存储复用全链路高速流转
  • IBGDA减少CPU参与关键通信路径,在MoE混合专家模型通信中显著提升并行效率

🔥犀利点评

十万卡级验证听着唬人,但关键问题一个没答:性能数据呢?和国际厂商方案的差距有多少?验证是跑通了还是有真实业务负载?国产替代叙事讲得漂亮,缺的是可横向对比的基准。不过方向没错——MoE时代通信就是瓶颈,谁绕开CPU谁占先手,曙光至少抢了个国产身位,剩下的得拿实测说话。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文