资讯
中科曙光发布词元加速技术体系:IBGDA十万卡级集群完成验证
📋总体概括
中科曙光发布scaleFabric词元加速技术体系,在国内率先实现IBGDA(InfiniBand GPU直连异步技术)规模化应用,并宣称已在十万卡级大规模集群完成验证。该体系构建算力、存储、传输三级紧耦合的词元加速通道,减少CPU参与关键通信路径,覆盖大模型训练、推理到存储复用全链路。此前IBGDA规模化落地主要由国际厂商主导,国产案例罕见,此举填补了国产RDMA网卡与GPU直通在大规模部署上的空白,为MoE等主流架构提供国产高速互连选择。
⚡关键信息
- ▸中科曙光发布scaleFabric Token加速技术体系,率先在国内实现IBGDA技术规模化应用
- ▸自研IBGDA已在十万卡级大规模集群中完成验证,此前该领域国产落地案例极为罕见
- ▸技术通过构建算存传三级紧耦合词元加速通道,实现训练、推理到存储复用全链路高速流转
- ▸IBGDA减少CPU参与关键通信路径,在MoE混合专家模型通信中显著提升并行效率
🔥犀利点评
十万卡级验证听着唬人,但关键问题一个没答:性能数据呢?和国际厂商方案的差距有多少?验证是跑通了还是有真实业务负载?国产替代叙事讲得漂亮,缺的是可横向对比的基准。不过方向没错——MoE时代通信就是瓶颈,谁绕开CPU谁占先手,曙光至少抢了个国产身位,剩下的得拿实测说话。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →