在AMD即将召开“Advancing AI 2026大会”的前夕,英伟达选择抢先一步,正式揭开了其数据中心CPU产品——Vera的神秘面纱。这不仅标志着英伟达继Grace之后在CPU领域的又一重磅布局,更是其从单纯的“显卡供应商”向“AI工厂”全栈解决方案提供商转型的关键一步。Vera被定义为全球首款专为代理式AI量身定制的处理器,其核心逻辑在于应对智能体AI工作负载中日益复杂的控制流与数据交互需求,试图打破传统CPU在AI时代的性能瓶颈。

Vera的核心竞争力源于其全新的Olympus架构,该架构针对智能体AI的运行特性进行了深度优化。面对智能体在沙箱中运行代码、调用工具及检索上下文时产生的复杂分支预测挑战,Olympus核心引入了“神经分支预测器”这一关键技术,配合10-wide解码引擎,显著提升了处理效率。单颗Vera集成了88个核心,支持176个线程,且成为首款在CPU核心中支持FP8精度的处理器,有效打通了与GPU之间的数值计算壁垒,确保在满载条件下依然能提供强劲的单线程性能。

除算力架构的革新外,Vera在内存带宽上的突破同样令人瞩目。为了解决智能体并发执行时的“内存墙”问题,Vera采用了创新的SOCAMM2 LPDDR5X内存方案,实现了高达1.2TB/s的带宽,是传统DDR5服务器的两倍,而功耗却不到后者的一半。基准测试显示,Vera在满载情况下的单核性能可达传统x86 CPU的1.8倍,AI智能体任务综合性能提升约50%,并能支持多达1.6倍的并发智能体运行,极大提升了AI工厂的数据供给效率。

这一产品的推出,清晰地折射出英伟达正在构建GPU之外的新增长曲线。随着AI集群规模向十万卡级别迈进,英伟达正通过自研CPU与高速互联技术,系统性地摆脱对单一GPU销售的依赖。网络互联业务已展现出强劲的增长势头,而自研CPU业务则让英伟达正式杀入由英特尔与AMD长期把持的服务器CPU腹地。黄仁勋直言,Vera打开了一个全新的市场,旨在消除智能体等待造成的GPU闲置,从而提升整体算力利用率。

根据英伟达的规划,Vera Rubin NVL72平台已进入量产爬坡阶段,供应链覆盖全球30个国家的350多个工厂。公司高管预计,到2027财年,英伟达的CPU总收入有望接近200亿美元,这预示着英伟达正试图通过垂直整合策略,在AI基础设施领域建立起难以逾越的系统级竞争壁垒,重新定义数据中心的算力格局。

本篇内容整理自网络,同步发布在 AEX新讯社中文网、希鸥网、斯贝瑞品牌资讯、RCEO创新网、AI联播网、创新日报 等媒体平台。如需删改或发布内容,请联系微信:meisceo29