当地时间3月18日,英伟达在GTC 2025大会上正式发布全新一代Spectrum-6以太网交换系统,专为面向下一代超大规模AI工厂设计。作为英伟达自研交换芯片家族的最新成员,Spectrum-6在带宽、端口密度、功耗比等关键指标上实现跨越式提升,旨在满足AI训练和推理工作负载对低延迟、高吞吐网络基础设施的极致需求。

性能跃升:800万兆接入能力

据英伟达官方介绍,Spectrum-6交换芯片采用先进制程工艺,单片带宽高达51.2Tbps,相较上一代Spectrum-4的25.6Tbps翻番。该芯片可支持64个800GbE端口或128个400GbE端口,能够实现单台交换机800万兆(8Tbps)的总接入带宽,为AI工厂中数以万计的GPU节点提供无阻塞通信通道。

在延迟方面,Spectrum-6通过创新的SerDes技术与自适应路由算法,将单跳端口间转发延迟控制在亚微秒级别,相比常规以太网方案降低50%以上。英伟达表示,对于动辄需要数万GPU并行训练的大语言模型,这样的延迟优化可将整体训练时间缩短15%至20%。

AI工厂的网络革命

随着AI模型参数从千亿级迈向万亿级,传统数据中心网络架构面临严重瓶颈——GPU计算速度远超网络传输速度,“计算等待数据”成为制约训练效率的核心痛点。英伟达网络业务副总裁Gilad Shainer在发布会上指出:“我们正在为AI工厂打造一种全新的网络范式,它不再只是连接设备,而是成为分布式计算引擎的神经系统。”

Spectrum-6正是这一理念的落地产品。除传统以太网功能外,该交换系统深度集成英伟达DPU及GPU的协同加速能力,支持远程直接数据放置(RDDP)与GPU-Direct RDMA技术,使数据流从CPU卸载至GPU与网络之间直接传递,大幅降低CPU干预开销。同时,Spectrum-6内置的SHARP(可扩展分层聚合和缩减协议)引擎可在网络层面实现梯度聚合,减少通信阶段的整体数据量,这对分布式训练中的AllReduce操作至关重要。

生态整合与市场定位

值得关注的是,Spectrum-6并非孤立的产品迭代,而是英伟达“AI工厂”全栈生态的重要一环。该系统与英伟达Quantum InfiniBand交换平台形成高低搭配:InfiniBand主打超低延迟和确定性网络,适用于HPC及最苛刻的AI训练场景;而Spectrum系列以太网则依托开放标准与成熟运营生态,瞄准超大规模数据中心及混合云AI部署。

英伟达强调,Spectrum-6已通过ODM合作伙伴(包括广达、纬颖、超微等)适配,预计2025年下半年开始向客户送样。首批应用场景将集中在云服务商的AI训练集群,以及大型互联网公司的推荐系统、搜索排序等生产级推理场景。

产业意义:以太网重新定义AI网络边界

此次发布的另一重意义在于,英伟达首次将51.2Tbps的交换带宽引入基于以太网标准的AI网络中。此前,业内普遍认为更高等级的AI网络必须仰赖InfiniBand或私有协议,而Spectrum-6以事实表明,当以太网与端到端加速技术充分结合时,同样能逼近InfiniBand的性能表现,同时保留部署灵活性与成本优势。

市场研究机构IDC网络基础设施副总裁Vijay Bhagavath分析认为:“Spectrum-6标志着AI网络进入‘超以太网’时代,它将传统以太网的开放生态与高性能计算专用网络的效率融为一体,这可能会改变大型AI项目的基础设施选型逻辑。”

结语

在AI计算加速迈入“千卡万亿参数”的关键节点,网络瓶颈正在成为决定系统效能的木桶短板。英伟达Spectrum-6以太网交换系统的发布,不仅是一次硬件规格的跃升,更是对“AI工厂”网络架构设计理念的一次重构。随着该产品于明年进入量产交付,我们有理由期待,全球超大规模AI工厂的通信基础设施将迎来一波从带宽到拓扑、从协议到功耗的全面升级。而在幕后,英伟达正通过GPU+DPU+Switch的“三驾马车”,悄无声息地定义着下一代AI基础设施的标准。