7月22日,据财闻海外资讯,英伟达(NVDA.US)近日宣布,已向客户交付全新 AI 整机平台 Vera Rubin。英伟达表示,Vera Rubin 现已进入规模化量产阶段,部署至客户服务器投入运行,公司上月1日已对外公布该平台量产消息,采购客户涵盖谷歌、微软(MSFT.US)、甲骨文(ORCL.US)、CoreWeave(CRWV.US) 等企业。

Vera Rubin 是机架式一体化 AI 基础设施,整机采用协同一体化设计,集成32颗英伟达 Vera 自研 CPU、72颗 Rubin GPU、NVLink 6互联方案及配套存储。整机内部无线缆、风扇、散热管路等零散配件,设备组装耗时从数小时大幅缩短至1分钟。

Rubin CPU 是英伟达首款自研服务器处理器,搭载88个基于英伟达自有架构的 Olympus 核心。英伟达称,搭载 Olympus 核心的这款 CPU 性能是英特尔(INTC.US)、AMD 主流 x86架构处理器的1.8倍;核心间互联带宽提升3倍,内存延迟降低40%。

对比前代产品,Vera Rubin 进一步降低功耗与单 Token 处理成本。根据 CoreWeave 实测数据,其每兆瓦算力吞吐量达到英伟达 Blackwell 平台的10倍。英伟达表示:“每兆瓦可处理 Token 数量是 AI 基础设施核心衡量指标,该数值越高,同等电力预算下能够承载更多算力任务、能耗成本更低。”

设备冷却水进水温度最高可支持45摄氏度,无需冷水机组即可实现干式冷却方案。英伟达补充,这套方案每年每兆瓦算力可节省数百万加仑水资源。