英伟达近日正式推出面向十亿瓦级AI工厂的新一代以太网交换机Spectrum-6,将网络带宽较上一代翻倍,容量达102.4T。该产品专为英伟达Vera Rubin平台打造,构成新一代Spectrum-X以太网平台的核心,并已获得CoreWeave、微软、Nebius、SpaceXAI(原xAI) 和特斯拉等头部AI基础设施建设者的率先采用。
随着全球AI工厂规模扩张至数十万GPU并发运算,英伟达将网络定位为影响整体算力产出的关键变量,而非仅仅是连接层组件。大规模AI训练与推理要求数千个加速器频繁进行数据交换,传统以太网最初为承载南北向企业流量而设计,难以应对AI工作负载的同步密集型通信模式。Spectrum-X平台正是为弥合这一差距而设计:据英伟达介绍,与通用以太网相比,Spectrum-X可提供高达1.6倍的AI网络性能,在超过10万个GPU的部署规模下保持高达95%的网络效率。硬件加速的Spectrum-X多平面拓扑可使数据中心所需交换机数量减少40%,叠加硅光技术带来的能效提升5倍和平均无故障间隔时间提升10倍,进一步降低运营成本。
CoreWeave、微软和Nebius将成为首批基于Spectrum-6部署Vera Rubin基础设施的云服务提供商,向开发者、初创公司及企业用户提供平台访问服务。Nebius全球合作伙伴关系副总裁Laurelle Roseman表示,在十亿瓦级系统上,协同决定总体性能,让每个GPU时刻保持同步,避免因为一个慢环节拖累整个工作,这正是英伟达Spectrum-6追求的目标。CoreWeave网络产品总监Min Jun则指出,将Spectrum-6和液冷Spectrum-X以太网基础设施引入AI工厂,能够提供更高的带宽、可靠性和效率,从而更好地为客户提供模型训练服务,并更快地部署推理服务。
对于云服务提供商而言,Spectrum-6带来的核心价值在于将更多GPU统一为可调度的高性能资源池,直接影响模型训练周期和推理服务响应速度。对于自建基础设施的AI企业如SpaceXAI和特斯拉,则意味着在集合操作密集型任务中实现更高系统利用率,并提升长周期训练任务的稳定性——两者最终都指向更快完成作业和更低的单位Token成本。
Spectrum-6并非独立产品,而是英伟达Vera Rubin整体计算平台的网络层组成部分。该平台整合了Vera CPU、Rubin GPU、NVLink 6交换机、ConnectX-9 SuperNIC、BlueField-4 DPU与Spectrum-6以太网交换机,构成端到端协同设计的完整系统。在形态与散热设计上,Spectrum-6支持可插拔和光电一体化封装两种规格,并支持液冷方案,可接入AI工厂的端到端液冷部署,提升整体能效表现。英伟达将这一设计方法定义为“垂直集成、横向开放”:在整个计算平台层面协同设计芯片、系统与软件,同时兼容标准以太网、开放网络操作系统及开放协议,支持云服务提供商、系统制造商和基础设施合作伙伴的广泛生态系统。