075582814553
英伟达首次公开Vera CPU完整架构:88核Olympus核心专为AI智能体打造

香港天翔電子有限公司 / 07-22 18:46

英伟达通过技术博文首次完整披露了自研数据中心CPU——Vera的架构全貌。

美东时间7月21日,英伟达通过技术博文首次完整披露了自研数据中心CPU——Vera的架构全貌。这是英伟达首颗从核心层面自主设计的服务器CPU,采用代号“Olympus”的定制微架构(基于Armv9.2),标志着英伟达正式从GPU向CPU腹地发起全面进攻。

Vera搭载88个Olympus核心、176个SMT线程,配备164MB统一L3缓存和最高1.2TB/s的LPDDR5X聚合内存带宽,单核带宽达14GB/s,TDP 250W至450W。

微架构层面,Olympus核心集成10宽解码引擎,其“单芯片(monolithic)”设计避开了Chiplet架构固有的跨芯片延迟,确保满负载下延迟和吞吐量可预测。英伟达超大规模计算副总裁Ian Buck解释:“智能体AI将大量关键执行路径转移到了CPU上——如果CPU跟不上,GPU就无法被喂饱。”

图1:英伟达首次公开Vera CPU完整架构 图片来源:英伟达官网

CoreWeave验证10倍能效跃升,OpenAI计划Q3大规模部署

与架构公布同步,英伟达亮出了实测性能数据。CoreWeave使用Vera Rubin NVL72运行DeepSeek R1模型时,相比上一代GB200 NVL72,每兆瓦Token吞吐量提升10倍——该数据经CoreWeave基于DeepSeek R1模型测试验证。

在AI智能体基准测试中,Vera在持续单核性能上达x86的1.8倍,延迟最高降低约6倍。Perplexity测试显示,Vera在真实编码工作流中速度提升约1.5倍,并发沙箱启动速度提升达1.9倍。

交付方面,Ian Buck亲自将首批系统交付Anthropic、OpenAI、甲骨文云和SpaceX AI。据彭博社报道,OpenAI计划2026年Q3大规模部署,谷歌云已推出基于Vera Rubin NVL72的A5X实例。目前供应链已覆盖全球350多个工厂节点、超300家合作伙伴。

英伟达正式叫板x86双雄,服务器CPU格局生变

Vera的发布时机暗藏锋芒——AMD将于7月23日在旧金山举行年度产品发布会“Advancing AI”,英伟达此时集中释放性能数据,竞争火药味不言自明。

据Wolfe Research估算,Vera单颗均价约5000美元,今年出货量约130万颗。Ian Buck预判代理式AI将使服务器CPU总可寻址市场(TAM)达2000亿美元。Cambrian AI Research创始人Karl Freund指出:“英伟达的目的是让客户摆脱对英特尔或AMD CPU的依赖。”目前,英特尔在服务器CPU市场占约66.8%,AMD约33%。Vera的登场试图证明:未来的AI芯片之争,不再仅是GPU的暴力计算,更是对系统协调能力和单位Token成本的全面考验。

Vera Rubin NVL72集成72颗Rubin GPU、36颗Vera CPU,通过260TB/s NVLink 6全互联,原生支持NVFP4精度。

产业链共振:AI基础设施代际更迭提速

Vera Rubin全面投产引发全产业链共振。7月21日费城半导体指数收涨5.21%,30只成分股全线上涨;7月22日亚太早盘,韩国KOSPI指数一度涨超5%触发Sidecar熔断,SK海力士涨超9%、三星电子涨超6%。

三星电子会长李在镕、SK集团会长崔泰源和Naver会长李海珍计划7月24日在硅谷与黄仁勋举行圆桌会议,讨论AI基础设施合作,印证了Vera Rubin对全球半导体供应链的深远影响。

从Blackwell到Vera Rubin,英伟达正完成从芯片供应商到“AI工厂”全栈平台商的角色跃迁。当每兆瓦Token吞吐量提升10倍成为现实,AI推理边际成本将迎来“断崖式下降”——谁能配套最精密的光模块和散热方案,才是市场尚未充分定价的未来。


Processed in 0.099722 Second , 37 querys.