首页 > 人工智能 > 正文

NVIDIA Vera Rubin 提升每瓦性能,为全球合作伙伴实现最低 Token 成本

2026-07-27 10:24:24  来源:CIO时代

摘要:Vera Rubin 正加速在全球范围内扩大部署。
关键词: NVIDIA
NVIDIA Vera Rubin 正式登场,正迈向十亿瓦级规模部署。
 
Vera Rubin NVL72 的量产正全面加速,CoreWeave、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 等合作伙伴的机架已投入运行。Vera Rubin 的供应链覆盖 30 个国家的 350 多家工厂,拥有迄今为止规模最大、最成熟的机架级供应链,旨在全面满足客户的算力需求。
 
Vera Rubin 平台从芯片到电网进行了全栈协同设计,旨在提供最高的每瓦性能和最低的 Token 成本。CoreWeave 针对 DeepSeek-R1 的首次基准测试结果充分证明了这一点:其每兆瓦吞吐量比 Grace Blackwell NVL72 提升了 10 倍——这直接切中了电力受限的 AI 工厂最关心的核心指标。
 
通过极致协同设计提升性能
取得这一突破的关键在于七款芯片和五种机架托盘之间的极致协同设计。五种机架系统包括 Vera Rubin NVL72、Vera CPU 机架、Groq 3 LPX、Spectrum-6 SPX 和 Vera BlueField-4 STX。它们被作为一个完整的系统进行工程研发,而非由通用产品简单拼凑而成。
 
NVIDIA Vera CPU 正是其核心所在。它重新定义了“AI 工厂 CPU”应有的形态。专为智能体时代设计,其定制 Olympus 核心相较竞品的芯粒 (chiplet) 方案,单线程性能提升 2 倍、核间带宽提升 3 倍、内存延迟降低 40%,使其成为面向最关键智能体负载时最高效的单线程 CPU。
 
以专属定制网络,加速 AI 工厂建设
在网络方面,该平台的第六代 NVLink 纵向扩展技术在处理复杂工作负载时,相比通用以太网,吞吐量提升超过 2 倍、延迟降低 1/3、数据包处理速率提升 10 倍。在横向扩展方面,Spectrum-X 以太网集成 102.4T 的 Spectrum-6 交换机系统、1.6T 的 ConnectX-9 SuperNIC、自适应路由、高级拥塞控制、遥测技术以及开放的操作系统支持,使其 RDMA 带宽比通用以太网高出 1.6 倍。
 
包括 CoreWeave、微软、SpaceXAI 和 Tesla 在内的全球领先的 AI 基础设施建设者率先采用 Spectrum-6 交换机,以加速其 AI 工厂的建设。此外,采用 NVIDIA 光电一体化封装 (CPO) 技术用于横向扩展,这是全球首款实现量产的同类型交换机,与传统可插拔收发器相比,其能效提升了 5 倍,平均无故障间隔时间 (MTBI) 提升了 10 倍。CoreWeave、Lambda 和 OCI 率先采用该技术。
 
Spectrum-XGS 以太网跨站点吞吐量提升 1.9 倍,实现跨站点性能增强。满足十亿瓦级 AI 工厂的建设不再局限于单一建筑的需求。
 
同时,NVLink Fusion 向第三方 XPU 开放了 NVIDIA 基础设施平台,为合作伙伴能够借助成熟的 NVLink 纵向扩展堆栈和生态系统,实现产品的快速上市。
 
节省部署时间,节约水资源
经过三代机架级协同设计的迭代,NVIDIA 打造出的 Vera Rubin NVL72 系统实现了托盘内无电缆、无风扇、无液冷软管的极简设计,将计算托盘的组装时间从过去的数小时大幅缩短至仅需 1 分钟。
 
45 摄氏度的液冷进水温度设计,使得系统无需冷水机组,仅靠干式冷却器即可运行。对于新建的 AI 工厂而言,这种高温干式冷却结合闭环液冷系统,每兆瓦每年可节省数百万加仑的水资源。
 

第四十二届CIO班招生
国际CIO认证培训
首席数据官(CDO)认证培训
责编:lijj

免责声明:本网站(http://www.ciotimes.com/)内容主要来自原创、合作媒体供稿和第三方投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。
本网站刊载的所有内容(包括但不仅限文字、图片、LOGO、音频、视频、软件、程序等)版权归原作者所有。任何单位或个人认为本网站中的内容可能涉嫌侵犯其知识产权或存在不实内容时,请及时通知本站,予以删除。