来源:市场资讯
(来源:格隆汇小编 格隆汇APP)
在AMD “Advancing AI 2026大会”前夕,英伟达抢先公布了数据中心CPU产品Vera的更多技术细节。
这不仅是英伟达继Grace之后在CPU领域的又一重磅落子,更是其从“卖显卡”向“卖AI工厂”垂直整合战略的彻底摊牌——
Vera是全球首款从核心层面专为代理式AI(Agentic AI)量身定制的处理器。
英伟达还透露,Vera Rubin NVL72已进入量产爬坡阶段,该平台的供应链覆盖了全球350多个工厂、30个国家,超过300家合作伙伴参与其中。
Olympus架构细节全公开
当地时间7月21日,英伟达发布博文,从技术角度详细介绍了Vera CPU。
文中指出,智能体AI(Agentic AI)将更多关键执行路径转移到了CPU上。
智能体(Agents)在沙箱中运行代码、调用工具、检索上下文、与数据库交互并分析结果,然后再将信息返回给模型。
这一过程意味着,CPU不再只是“辅助加速器”,而是成为了AI工厂中控制密集型循环的核心执行者。
智能体AI工作负载主要依赖于:
即使插槽满载,单线程性能依然强劲;
每个核心拥有足够的内存带宽,以保证多个活跃执行上下文的数据;
并发下延迟可预测,以便智能体能够稳定完成预定步骤;
高效处理不规则控制流、长依赖链和指针密集的数据结构。
英伟达强调,Vera CPU围绕智能体AI负载设计,重点提升满负载条件下的单线程表现,设计核心是Olympus核心。
为了应对智能体复杂的分支预测挑战,Olympus核心引入了一个关键的黑科技:神经分支预测器(Neural Branch Predictor)。
配合10-wide的解码引擎,它能高效处理智能体运行时的复杂逻辑。
单颗Vera集成了88个这样的核心,支持176个线程,但设计重心明显偏向“宽发射、深流水线”。
此外,Vera也是首款在CPU核心中支持FP8精度的处理器,进一步打通了与GPU之间的数值计算壁垒。
除了算力,内存带宽往往是智能体并发执行的隐形杀手。
Vera采用了创新的SOCAMM2 LPDDR5X内存方案,实现了1.2TB/s的惊人带宽。
这是传统DDR5服务器的两倍,而功耗却不到后者的一半。
在测试中,Vera能维持90%的峰值带宽,确保了即便在数千个智能体并发时,数据供给也不会掉队。
根据英伟达公布的基准测试,Vera针对智能体负载的优化效果显著:
单线程性能:在满载情况下,Vera的单核性能可达传统x86 CPU的1.8倍
任务效率:AI智能体任务综合性能提升约50%,沙箱环境运行速度提升显著。
并发能力:支持多达1.6倍的并发智能体运行,编排速度提升高达2.2倍。
编译速度:单颗Vera编译Linux内核仅需约20秒,每核编译效率约为128核顶级x86服务器的2倍。
英伟达新的增长曲线
长期以来,英伟达被市场牢牢贴上“GPU巨头”的标签,但翻开最新的财报与产品路线图,另一个新的信号已经释放——
它正在系统性地摆脱对单一GPU销售的依赖,围绕AI基础设施的全栈化布局,打开了多条GPU之外的新收入曲线。
其中,网络互联业务是增长最迅猛的一条曲线。
2027财年第一季度,英伟达数据中心网络收入创下148亿美元的纪录,同比暴增199%。
随着AI集群从千卡迈向十万卡规模,NVLink、InfiniBand与Spectrum-X已成为构建“AI工厂”的刚需。
网络业务占数据中心总收入的比重已攀升至约20%,这标志着英伟达已不仅仅是卖算力的公司,更是卖“连接”的公司,用物理层面的互联壁垒锁死了系统级竞争力。
紧随其后的是自研CPU业务。随着专为智能体AI设计的Vera CPU于2026年6月交付OpenAI、Anthropic等头部客户,英伟达正式杀入了由英特尔与AMD长期统治的服务器CPU腹地。
黄仁勋曾表示:“Vera打开了一个全新的市场,CPU让智能体等待的每一刻,都是整栋建筑里最昂贵的东西GPU处于闲置状态的一刻。”
英伟达从零开始打造了一颗全新的、面向智能体的CPU。
这是一个新市场,智能体CPU要求超快响应,未来会有数十亿个智能体,它们需要为自己而打造的CPU。
英伟达副总裁兼CFO科莱特·克雷斯曾透露,预计英伟达2027财年CPU总收入有望接近200亿美元,这使英伟达有机会成为全球领先的CPU供应商。
在未来的增长叙事中,Vera CPU与Rubin GPU的放量是最主要的增长动力。
热门跟贴