国产GPU直通国产RDMA网卡实测:吞吐量飙升、延迟砍半
2026/07/19 19:50阅读量 4
奇异摩尔与壁仞科技在WAIC 2026上展示了国产GPU直通国产RDMA网卡的IBGDA解决方案。测试表明,与传统IBRC方案相比,IBGDA在小包、高频、强同步场景下吞吐量大幅提升,All-to-All通信延迟接近翻倍缩短,彻底消除“小包惩罚”。该方案基于开放以太网生态,为国产算力集群提供了高性能、自主可控的Scale-Out网络选择。
事件概述
在2026世界人工智能大会(WAIC 2026)上,AI网络全栈互联产品及解决方案提供商奇异摩尔,携手壁仞科技,联合展示了国产GPU与国产RDMA网卡直连的IBGDA(InfiniBand GPU Direct Async)解决方案。这是国产GPU直通国产RDMA网卡的首个公开实测,旨在对标英伟达的IBGDA方案,提升国产AI集群的通信效率。
核心信息
- IBGDA技术价值:在MoE模型训练或推理中,专家并行通信涉及大量小粒度数据交换。传统跨节点通信需要CPU中转指令,产生额外延迟。IBGDA绕过CPU,由GPU直接发起通信,显著降低延迟,释放GPU线程吞吐优势。
- 实测结果:测试平台对标英伟达IBGDA数据,实测达到同等水平。IBGDA相较传统IBRC(InfiniBand Reliable Connected)在小包、高频、强同步场景下呈现代际优势:单次小消息带宽显著跃升,All-to-All通信延迟接近翻倍缩短,传统方案的“小包惩罚”被彻底消除。
- 方案特点:基于开放以太网生态构建,继承以太网部署灵活、成本可控的优势,为国产算力集群提供高性能与自主性的Scale-Out网络选择。
其他重要发布
- 奇异摩尔首次完整亮相国产化超节点互联全栈解决方案,覆盖Scale-Out网间互联、Scale-Up超节点XPU间互联到下一代光互联的全栈产品。
- 联合发布《共封装光学(CPO)技术白皮书》,系统梳理CPO技术路径、产业挑战与未来方向。
- 启动“国产超节点生态共建倡议行动”,由上海市算力网络协会、上海人工智能实验室、中国信通院华东分院发起,中兴通讯、壁仞科技、沐曦、天数智芯、燧原科技、商汤科技、曙光信息、奇异摩尔等参与,旨在制定开放兼容的超节点互联标准,打破技术孤岛。
