NVIDIA Vera Rubin 正式登场正迈向十亿瓦级规模部署。Vera Rubin NVL72 的量产正全面加速CoreWeave、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 等合作伙伴的机架已投入运行。Vera Rubin 的供应链覆盖 30 个国家的 350 多家工厂拥有迄今为止规模最大、最成熟的机架级供应链旨在全面满足客户的算力需求。Vera Rubin 平台从芯片到电网进行了全栈协同设计旨在提供最高的每瓦性能和最低的 Token 成本。CoreWeave 针对 DeepSeek-R1 的首次基准测试结果充分证明了这一点其每兆瓦吞吐量比 Grace Blackwell NVL72 提升了 10 倍——这直接切中了电力受限的 AI 工厂最关心的核心指标。通过极致协同设计提升性能取得这一突破的关键在于七款芯片和五种机架托盘之间的极致协同设计。五种机架系统包括 Vera Rubin NVL72、Vera CPU 机架、Groq 3 LPX、Spectrum-6 SPX 和 Vera BlueField-4 STX。它们被作为一个完整的系统进行工程研发而非由通用产品简单拼凑而成。NVIDIA Vera CPU 正是其核心所在。它重新定义了“AI 工厂 CPU”应有的形态。专为智能体时代设计其定制 Olympus 核心相较竞品的芯粒 (chiplet) 方案单线程性能提升 2 倍、核间带宽提升 3 倍、内存延迟降低 40%使其成为面向最关键智能体负载时最高效的单线程 CPU。以专属定制网络加速 AI 工厂建设在网络方面该平台的第六代 NVLink 纵向扩展技术在处理复杂工作负载时相比通用以太网吞吐量提升超过 2 倍、延迟降低 1/3、数据包处理速率提升 10 倍。在横向扩展方面Spectrum-X 以太网集成 102.4T 的 Spectrum-6 交换机系统、1.6T 的 ConnectX-9 SuperNIC、自适应路由、高级拥塞控制、遥测技术以及开放的操作系统支持使其 RDMA 带宽比通用以太网高出 1.6 倍。包括 CoreWeave、微软、SpaceXAI 和 Tesla 在内的全球领先的 AI 基础设施建设者率先采用 Spectrum-6 交换机以加速其 AI 工厂的建设。此外采用 NVIDIA 光电一体化封装 (CPO) 技术用于横向扩展这是全球首款实现量产的同类型交换机与传统可插拔收发器相比其能效提升了 5 倍平均无故障间隔时间 (MTBI) 提升了 10 倍。CoreWeave、Lambda 和 OCI 率先采用该技术。Spectrum-XGS 以太网跨站点吞吐量提升 1.9 倍实现跨站点性能增强。满足十亿瓦级 AI 工厂的建设不再局限于单一建筑的需求。同时NVLink Fusion 向第三方 XPU 开放了 NVIDIA 基础设施平台为合作伙伴能够借助成熟的 NVLink 纵向扩展堆栈和生态系统实现产品的快速上市。节省部署时间节约水资源经过三代机架级协同设计的迭代NVIDIA 打造出的 Vera Rubin NVL72 系统实现了托盘内无电缆、无风扇、无液冷软管的极简设计将计算托盘的组装时间从过去的数小时大幅缩短至仅需 1 分钟。45 摄氏度的液冷进水温度设计使得系统无需冷水机组仅靠干式冷却器即可运行。对于新建的 AI 工厂而言这种高温干式冷却结合闭环液冷系统每兆瓦每年可节省数百万加仑的水资源。