风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

英伟达Vera CPU正式发布:自研服务器芯片落地,直击代理式AI核心瓶颈

摘要

英伟达正式发布Vera CPU,开启服务器CPU自主时代 英伟达首次完整公开其自研数据中心CPU——Vera的规格、架构与实测性能。这是英伟达首颗从微架构层面完全自主设计的服务器级CPU,代号“Olympus core”,未采用Arm公版方...

英伟达Vera CPU正式发布:自研服务器芯片落地,直击代理式AI核心瓶颈

英伟达正式发布Vera CPU,开启服务器CPU自主时代

英伟达首次完整公开其自研数据中心CPU——Vera的规格、架构与实测性能。这是英伟达首颗从微架构层面完全自主设计的服务器级CPU,代号“Olympus core”,未采用Arm公版方案,标志着其正式跨入CPU核心战场。

设计目标明确:为AI代理而生

Vera的设计哲学聚焦三大关键维度:极致单核性能、超高内存带宽与超低延迟。其核心使命是加速AI代理(Agent)工作流——让CPU快速完成前置任务后,第一时间将数据交还GPU,持续保持GPU高利用率。硬件层面,Vera功耗区间为250W–450W,单颗最高支持1.5TB低功耗内存,面向高吞吐、低延迟的推理密集型场景深度优化。

实测性能:代理任务效率实现质变

在代理式AI典型负载下,Vera相较主流x86服务器CPU实现1.9倍性能提升,端到端延迟降低6倍。在部分行业标准基准测试中,Vera性能较AMD最新EPYC Turin旗舰型号高出近100%;此前披露的综合AI代理任务表现亦显示,其整体性能领先x86平台达50%。

Vera Rubin平台落地:能效跃升十倍

搭载36颗Vera CPU与72颗Rubin GPU的Vera Rubin NVL72系统,已完成全栈验证。以DeepSeek R1模型为基准,在同等响应时延约束下,其每兆瓦每秒token生成量达上一代GB200 NVL72系统的10倍。该结果经超过25万种配置、累计超140万GPU小时实测验证。

全栈协同:不只是芯片,更是系统级重构

性能跃升源于软硬一体的垂直整合:NVLink 6提供260 TB/s全互联带宽,原生支持NVFP4精度;45°C闭环液冷方案使每兆瓦年节水约400万加仑;第六代Spectrum-X网络架构在LLM解码吞吐上超越以太网2.3倍,RDMA带宽提升1.6倍,交换机数量减少1.7倍,光效提升5倍,可靠性增强10倍。

商用进展:首批客户已交付,规模化部署启动

Vera已于6月完成首批交付,客户包括OpenAI、Anthropic与SpaceX。OpenAI计划本季度起大规模部署。Spectrum-6网络平台同步向CoreWeave、微软、特斯拉、SpaceXAI Corp.等AI工厂客户交付。英伟达正加速向谷歌云、Meta、Oracle云、戴尔科技及更多生态伙伴推进供货。

战略本质:重构AI基础设施价值分配

Vera并非简单对标传统CPU,而是专为代理式AI重新定义计算边界。其终极目标,是让客户在AI推理链路中逐步摆脱对x86 CPU的路径依赖,将关键算力决策权收归自身技术栈。这不仅是产品发布,更是一次基础设施话语权的主动争夺——当AI代理成为新范式,CPU不再只是“配角”,而必须成为英伟达全栈AI引擎中不可绕过的中枢节点。

评论 (9)

登录 后即可发表评论
KK不是认证用户

设计目标很明确,实测性能也有提升,还搞全栈协同,就是功耗有点高不知道后续咋样

0 回复
嗨阳仔
嗨阳仔 1周前

全栈协同从硬件到网络都有优化,这是系统级的升级,不是简单的芯片发布

0 回复
@桃李成蹊、知人则哲

Vera Rubin平台能效跃升10倍有点厉害,全栈实测数据挺多的,未来发展看着不错

0 回复
君林
君林 1周前

首批客户有OpenAI等,商用推进挺快,估计会改变AI基础设施格局

0 回复
文强
文强 1周前

不采用公版方案自己设计,还能有这么好的性能,英伟达技术实力真强

0 回复
更多