关于ZAKER Skills 合作
全天候科技 20分钟前

Vera Rubin 实测性能首度披露,性能大幅提升!英伟达在 AMD 大会之前“砸场子”

英伟达在劲敌 AMD 年度产品发布会召开前夕,打出一记重拳,密集披露新一代 Vera Rubin 平台的实测性能数据,并正式公开自研 CPU 芯片 Vera 的完整规格。

周二,英伟达披露,Vera CPU 在代理式 AI 任务上的性能较 x86 芯片高出近一倍,延迟改善幅度达六倍。与此同时,云计算合作伙伴 CoreWeave 的早期生产测试显示,Vera Rubin NVL72 平台在运行 DeepSeek R1 模型时,每兆瓦算力产生的 token 吞吐量较上一代基于 Blackwell 架构的 GB200 NVL72 系统提升 10 倍。

上述数据的发布时机颇具深意。AMD 将于本周四在旧金山举行年度产品发布会 "Advancing AI",英伟达此时集中释放性能数据,被外界普遍解读为一次有意为之的市场造势。对于正在评估下一代 AI 基础设施投资的云厂商和企业客户而言,这批数据将直接影响其采购决策。

与此同时,英伟达亦正式公布 Vera CPU 已于 6 月完成首批交付,客户涵盖 OpenAI、Anthropic 和 SpaceX。这标志着英伟达正式将触角延伸至 CPU 市场,对 AMD 和英特尔的传统地盘发起直接冲击。

Vera CPU 亮相:英伟达正式进军服务器 CPU 市场

英伟达周二公布了数据中心 CPU 产品 Vera 的完整规格、基准测试结果及架构信息,这是潜在客户全面评估该芯片所必需的关键数据。该公司表示,Vera 芯片已于 6 月向 OpenAI、Anthropic 和 SpaceX 等客户完成交付。

Vera 是英伟达首颗从核心层面自主设计的服务器 CPU,采用代号为 "Olympus core" 的定制微架构,而非沿用 Arm 提供的现成设计方案。

英伟达 Vera 产品市场负责人 Hannah Coutand 介绍,该芯片的设计重心在于单核速度、高内存带宽和低延迟,目标是 " 使代理能够尽快返回 GPU,并保持 GPU 始终处于高度利用状态 "。在硬件规格层面,Vera 功耗在 250 瓦至 450 瓦之间,每颗芯片最高支持 1.5TB 低功耗内存。

在最新公布的基准测试中,英伟达展示了 Vera 相较于 x86 芯片在代理式 AI 任务上实现 1.9 倍性能提升,延迟降低 6 倍。英伟达还表示,Vera 在部分行业标准基准测试中超越 AMD 旗舰 EPYC Turin CPU 近 100%。此前,英伟达亦称 Vera 在 AI 代理任务的整体性能上较 x86 芯片高出 50%。

Vera 的推出是英伟达垂直整合战略的最新一步。Wolfe Research 估算,Vera 芯片单颗均价约为 5000 美元,预计今年出货量约达 130 万颗。英伟达超大规模计算副总裁 Ian Buck 表示,代理式 AI 使 CPU 变得 " 更加不可或缺 ",并预测服务器 CPU 整体市场规模最终可能达到 2000 亿美元。

Vera Rubin 实测:10 倍能效跃升

CoreWeave 于今年 6 月初完成了业界首次 Vera Rubin NVL72 的部署与验证,涵盖电力、冷却、网络和计算的全栈确认。此次披露的数据,是 Vera Rubin NVL72 硅片性能的首次公开实测结果。

测试以 DeepSeek R1 模型为基准,在相同交互响应目标下,Vera Rubin NVL72 每兆瓦每秒生成的 token 数量达到 GB200 NVL72 的 10 倍。CoreWeave 同时指出,针对 Vera Rubin 所做的优化也可回溯应用于 GB200 NVL72 系统,使后者在三个月内每兆瓦吞吐量提升逾四倍。英伟达表示,上述成果经过超过 25 万种独立配置、逾 140 万 GPU 小时的测试验证。

从架构层面看,Vera Rubin NVL72 机架集成 72 颗 Rubin GPU 与 36 颗 Vera CPU,通过 260 TB/s 全互联 NVLink 6 架构连接,并原生支持 NVFP4 精度。CoreWeave 表示,这一效率提升意味着客户可在相同功耗预算内处理更多推理流量,或以更少电力运行相同负载,从而降低每 token 成本。

CoreWeave 还披露了具体应用场景:一家全球网络安全公司预计以 10 倍的每瓦性能运行威胁检测推理;一家自主编程代理公司预计以大幅降低的 token 成本扩展代理任务;一家 AI 原生搜索引擎则预计在不突破响应时间限制的前提下向更多用户扩展实时搜索服务。

基础设施协同优化:软硬件一体化释放更大效能

英伟达强调,上述性能提升并非单纯依赖芯片本身,而是硬件与软件协同设计策略的综合成果。通过对完整基础设施和能源栈的动态优化,英伟达表示可在相同功耗范围内部署多 40% 的 GPU。

在冷却方面,英伟达采用 45 ° C 闭环液冷系统,与标准冷却方式相比,每兆瓦每年可节约约 400 万加仑水。在网络层面,第六代 NVLink 6 互联架构在大型语言模型模拟解码吞吐量上较以太网架构高出 2.3 倍;Spectrum-X 平台则实现了 1.6 倍更快的远程直接内存访问带宽,同时减少 1.7 倍的交换机数量,光功率效率提升五倍,可靠性提升十倍。

英伟达最新一代 Spectrum-6 平台已开始向 CoreWeave、微软、Nebius B.V.、SpaceXAI Corp. 和特斯拉等 AI 工厂客户交付。目前,英伟达正加速向谷歌云、微软 Azure、Meta、Oracle 云基础设施、戴尔科技、OpenAI 和 CoreWeave 等客户和合作伙伴发货。

英伟达仍是 CPU 领域挑战者

尽管 Vera 的性能数据引人注目,英伟达在 CPU 市场仍面临显著的市场份额挑战。Gartner 分析师 Kevin Knox 表示,AMD 目前是企业级 AI 服务器 CPU 领域的主要竞争对手。据报道,英特尔在服务器 CPU 市场占有约 66.8% 的份额,AMD 约为 33%,且 AMD 正持续抢占市场份额,并与超大规模云服务商建立了深厚合作关系。

受代理式 AI 兴起带动的 CPU 需求预期提振,AMD 和英特尔今年以来股价涨幅分别达到 128% 和 149%,远超英伟达同期约 8% 的涨幅,成为 2026 年表现最亮眼的芯片股。

就现阶段而言,英伟达的主要云服务商合作伙伴名单中仅列出了 Oracle,尚未涵盖其他主流云厂商。Hannah Coutand 承认,Vera 目前仍处于 " 早期采用阶段 ",不过 OpenAI 计划最早本季度开始大规模部署 Vera 芯片。

Cambrian AI Research 创始人 Karl Freund 将英伟达的战略意图概括为:" 他们的目的是让客户摆脱对英特尔或 AMD CPU 的依赖,而他们对这部分收入志在必得。他们选择专注于打造一款目前市场上其他任何人都尚未提供的独特 CPU。"

全天候科技

全天候科技

提供专业快速完整的科技商业资讯

订阅

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容