资讯🔥7.0
中科曙光发布词元加速技术体系:IBGDA十万卡级集群完成验证
📋总体概括
中科曙光9月11日发布scaleFabric Token词元加速技术体系,在国内率先实现IBGDA(InfiniBand GPU直连异步技术)规模化应用。该体系构建算存传三级紧耦合的词元加速通道,覆盖大模型训练、推理到存储复用全链路。针对MoE架构通信瓶颈,IBGDA减少CPU参与关键通信路径以提升并行效率。自研IBGDA已在十万卡级集群完成验证,此前该技术规模化落地基本由国际厂商主导,国产RDMA网卡与GPU直通案例罕见,此举填补国产高速互连关键空白。
⚡关键信息
- ▸中科曙光发布scaleFabric Token体系,率先在国内实现IBGDA技术规模化应用
- ▸构建算存传三级紧耦合词元加速通道,实现词元在训练、推理、存储复用全链路高速流转
- ▸IBGDA通过减少CPU参与关键通信路径,提升MoE模型并行通信效率
- ▸自研IBGDA已在十万卡级大规模集群完成验证,此前国产RDMA与GPU直通落地案例极为罕见
🔥犀利点评
表面是网络技术创新,实质是国产算力在互连层面对英伟达体系的一次卡位战。大模型竞争到今天,瓶颈早已不在单卡算力而在互连与通信效率,MoE专家间频繁的all-to-all通信恰是NVLink和InfiniBand的护城河。曙光啃下IBGDA这块硬骨头值得肯定,但十万卡验证距大规模商用稳定性仍有距离,且生态兼容性与客户迁移成本才是真正的胜负手。别急着庆祝补位,先看有没有客户真金白银买单。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →