5.8
深览指数
科技微博·量子位··AI 生成
不靠英伟达网卡,国产GPU直通方案实测出炉:吞吐飙升、延迟砍半
本文报道了奇异摩尔在WAIC 2026上展示的国产GPU与国产RDMA网卡直连通信方案IBGDA,实测在All-to-All通信场景中吞吐量大幅提升、延迟接近减半,并消除了传统小包通信的延迟惩罚。文章核心论点是:国产算力当前困境是“单点强,系统弱”的结构性失衡,而非单芯片性能落后,互联技术是破局关键。文中还介绍了国产超节点全栈互联方案、CPO技术白皮书发布及生态共建倡议。适合关注国产AI算力基础设施、GPU互联技术及自主可控进展的产业与投资人士阅读。原文 ↗
核心观点
- ▍当前国产算力核心困境是“单点强、系统弱”的结构性失衡,而非单芯片性能落后,互联技术是打破算力孤岛、实现系统级协同的关键命脉。
- ▍国产GPU与国产RDMA网卡直连的IBGDA方案(基于开放以太网生态)在小包、高频、强同步的MoE通信场景中,可代际性地超越传统IBRC方案,实测吞吐量显著提升,All-to-All通信延迟削减近半。
- 01奇异摩尔与壁仞科技联合展示的IBGDA Demo,对标英伟达IBGDA测试,实测结果达到相应水平,且消除了传统方案的小消息时延“小包惩罚”。
- 02奇异摩尔推出的单通道400G RDMA ASIC引擎,基于Kiwi SNIC 800G平台,已兼容对标DeepEP的集合通信库,并原生支持IBGDA(GPU直接通信)。
- 03奇异摩尔发布了国产化超节点互联全栈方案,覆盖Scale-Out网间互联、Scale-Up超节点XPU间互联到下一代光互联,并以机柜形式呈现。
- 04论坛上发布了《共封装光学(CPO)技术白皮书》,由港科大(广州)发起,奇异摩尔、曦望、壁仞、图灵量子等参与编写。
- 05上海市算力网络协会、上海AI实验室、信通院华东分院等联合发起“国产超节点生态共建倡议行动”,中兴、壁仞、沐曦、天数智芯、燧原、商汤、曙光、奇异摩尔等参与。
- 06奇异摩尔已前瞻布局OSU(Optical Scale-Up)IO芯粒产品,并与图灵量子、奇点光子合作探索NPO/CPO技术。
反方 / 局限
- — 文章承认国产GPU对IBGDA的支持目前主要停留在与英伟达网卡的适配,国产GPU直通国产RDMA网卡的规模化落地案例仍相对罕见,这是制约国产集群通信效率的短板。
- — 文章指出国内多家厂商虽有各自的超节点方案,但整体格局存在碎片化挑战,在体系架构定义、互联协议、软硬协同、集群RAS等方面仍面临“卡脖子”风险。
- — 文章隐含地依赖“超节点成为下一代智算基础设施主流形态”这一判断,但未讨论该判断演绎失败或遭遇其他技术路线(如更高效的铜缆互联、近存计算等)挑战的可能性。
10 分钟 · 4 卡片 · 9 资料
读原文 →