在算力基建向万卡集群演进的背景下,节点间通信延迟已成为制约大模型训练效率的核心瓶颈。8月30日,国内一家专注网络基础设施的企业正式发布专为AI集群设计的高速互联解决方案。该方案采用自研的无损以太网交换芯片与硅光共封装技术,使单机柜内部互联带宽突破每秒一点六太字节,端到端通信延迟压缩至亚微秒级别。实测在千卡并行训练场景下,线性加速比达到百分之九十二以上,彻底解决了以往因通信拥堵导致的算力闲置问题。该产品的量产将显著降低国内智算中心的组网复杂度与采购成本,加速国产算力集群的规模化部署。
关键要点
- 自研无损以太网交换芯片与硅光共封装技术突破通信瓶颈
- 单机柜互联带宽突破每秒一点六太字节延迟压至亚微秒级
- 千卡并行训练线性加速比达百分之九十二消除算力闲置浪费
- 组网复杂度与采购成本大幅下降加速国产集群规模化部署
- 网络基础设施升级成为解锁下一代大模型训练效能的关键钥匙