英伟达正式发布Vera CPU,开启服务器CPU自主时代
英伟达首次完整公开其自研数据中心CPU——Vera的规格、架构与实测性能。这是英伟达首颗从微架构层面完全自主设计的服务器级CPU,代号“Olympus core”,未采用Arm公版方案,标志着其正式跨入CPU核心战场。
设计目标明确:为AI代理而生
Vera的设计哲学聚焦三大关键维度:极致单核性能、超高内存带宽与超低延迟。其核心使命是加速AI代理(Agent)工作流——让CPU快速完成前置任务后,第一时间将数据交还GPU,持续保持GPU高利用率。硬件层面,Vera功耗区间为250W–450W,单颗最高支持1.5TB低功耗内存,面向高吞吐、低延迟的推理密集型场景深度优化。
实测性能:代理任务效率实现质变
在代理式AI典型负载下,Vera相较主流x86服务器CPU实现1.9倍性能提升,端到端延迟降低6倍。在部分行业标准基准测试中,Vera性能较AMD最新EPYC Turin旗舰型号高出近100%;此前披露的综合AI代理任务表现亦显示,其整体性能领先x86平台达50%。
Vera Rubin平台落地:能效跃升十倍
搭载36颗Vera CPU与72颗Rubin GPU的Vera Rubin NVL72系统,已完成全栈验证。以DeepSeek R1模型为基准,在同等响应时延约束下,其每兆瓦每秒token生成量达上一代GB200 NVL72系统的10倍。该结果经超过25万种配置、累计超140万GPU小时实测验证。
全栈协同:不只是芯片,更是系统级重构
性能跃升源于软硬一体的垂直整合:NVLink 6提供260 TB/s全互联带宽,原生支持NVFP4精度;45°C闭环液冷方案使每兆瓦年节水约400万加仑;第六代Spectrum-X网络架构在LLM解码吞吐上超越以太网2.3倍,RDMA带宽提升1.6倍,交换机数量减少1.7倍,光效提升5倍,可靠性增强10倍。
商用进展:首批客户已交付,规模化部署启动
Vera已于6月完成首批交付,客户包括OpenAI、Anthropic与SpaceX。OpenAI计划本季度起大规模部署。Spectrum-6网络平台同步向CoreWeave、微软、特斯拉、SpaceXAI Corp.等AI工厂客户交付。英伟达正加速向谷歌云、Meta、Oracle云、戴尔科技及更多生态伙伴推进供货。
战略本质:重构AI基础设施价值分配
Vera并非简单对标传统CPU,而是专为代理式AI重新定义计算边界。其终极目标,是让客户在AI推理链路中逐步摆脱对x86 CPU的路径依赖,将关键算力决策权收归自身技术栈。这不仅是产品发布,更是一次基础设施话语权的主动争夺——当AI代理成为新范式,CPU不再只是“配角”,而必须成为英伟达全栈AI引擎中不可绕过的中枢节点。
(9)
设计目标很明确,实测性能也有提升,还搞全栈协同,就是功耗有点高不知道后续咋样
全栈协同从硬件到网络都有优化,这是系统级的升级,不是简单的芯片发布
Vera Rubin平台能效跃升10倍有点厉害,全栈实测数据挺多的,未来发展看着不错
首批客户有OpenAI等,商用推进挺快,估计会改变AI基础设施格局
不采用公版方案自己设计,还能有这么好的性能,英伟达技术实力真强
这CPU专为AI代理设计蛮牛的,实测性能提升明显,首批都交付了,确实要抢基础设施话语权了
摆脱对x86 CPU依赖的想法很大胆,就看实际能不能做到了
英伟达这是要动x86 CPU的蛋糕啊,交货给的客户都是大公司,看来要大干一场了
为AI代理而生的设计很新颖,性能提升这么大,传统CPU压力大了