资讯🔥7.0

中科曙光发布词元加速技术体系:IBGDA十万卡级集群完成验证

驱动之家·2026/9/11 08:39:00🔗 原文

📋总体概括

中科曙光9月11日发布scaleFabric Token词元加速技术体系,在国内率先实现IBGDA(InfiniBand GPU直连异步技术)规模化应用。该体系构建算存传三级紧耦合的词元加速通道,覆盖大模型训练、推理到存储复用全链路。针对MoE架构通信瓶颈,IBGDA减少CPU参与关键通信路径以提升并行效率。自研IBGDA已在十万卡级集群完成验证,此前该技术规模化落地基本由国际厂商主导,国产RDMA网卡与GPU直通案例罕见,此举填补国产高速互连关键空白。

关键信息

  • 中科曙光发布scaleFabric Token体系,率先在国内实现IBGDA技术规模化应用
  • 构建算存传三级紧耦合词元加速通道,实现词元在训练、推理、存储复用全链路高速流转
  • IBGDA通过减少CPU参与关键通信路径,提升MoE模型并行通信效率
  • 自研IBGDA已在十万卡级大规模集群完成验证,此前国产RDMA与GPU直通落地案例极为罕见

🔥犀利点评

表面是网络技术创新,实质是国产算力在互连层面对英伟达体系的一次卡位战。大模型竞争到今天,瓶颈早已不在单卡算力而在互连与通信效率,MoE专家间频繁的all-to-all通信恰是NVLink和InfiniBand的护城河。曙光啃下IBGDA这块硬骨头值得肯定,但十万卡验证距大规模商用稳定性仍有距离,且生态兼容性与客户迁移成本才是真正的胜负手。别急着庆祝补位,先看有没有客户真金白银买单。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文