英伟达Vera CPU开始规模出货,AWS收到首台服务器与Vera Rubin GPU
英伟达副总裁Ian Buck在AWS西雅图总部交付首台Vera CPU服务器和Vera Rubin GPU;此前已将系统送往Oracle Cloud Infrastructure、Anthropic、OpenAI与SpaceXAI。
AI解读:英伟达Vera CPU开始规模出货,这是它针对智能体AI推出的首款自研CPU。智能体AI不只是跑GPU,每一步工具调用、编排、长上下文检索都在消耗CPU,传统CPU以核心数量为核心,并不擅长这类并发、实时任务。Vera从这种工作负载倒推设计,采用 88 个自研Olympus核心,1.2TB/s内存带宽,单核性能在智能体工作负载上比传统设计快最多 1.8 倍。对AWS、Oracle这类云厂商,拿到实物意味着它们可以开始测试和部署基于Vera的实例;Oracle已计划 2026 年起部署数十万颗Vera CPU,成为首家超大规模部署该芯片的云厂商。对普通用户,短期内不会有直接变化,但如果你所在公司依赖智能体处理编译、数据分析这类任务,Vera这类芯片可能降低单位token成本、缩短响应时间。实际效果还取决于各家云平台何时开放实例,以及英伟达能否兑现能效翻倍的承诺。
英伟达副总裁Ian Buck将Vera CPU系统亲手交付给多家AI生态伙伴,Vera已开始规模出货。8 月 27 日,Buck在西雅图AWS总部将AWS首台Vera CPU服务器和Vera Rubin GPU交给AWS副总裁Willem Visser与硬件工程副总裁Supreeth Sheshadri。
AWS与英伟达扩展合作
AWS与英伟达 8 月 26 日宣布扩展双方长达 16 年的合作,计划新增 200 万颗英伟达GPU,并推动基于Vera CPU的基础设施落地AWS。
Vera CPU服务器此前已交付Oracle Cloud Infrastructure(OCI)和三家AI实验室:Anthropic、OpenAI、SpaceXAI。
Vera专为智能体AI设计
英伟达表示,智能体AI给基础设施带来的压力远超传统模式,因为它不仅依赖GPU,还涉及大量的CPU工作——每个智能体沙盒、每次工具调用、每个编排层、每次长上下文检索都是CPU任务。
Vera配备 88 个英伟达自研Olympus核心,内存带宽达 1.2TB/s,在智能体AI工作负载下每核性能最高提升 1.8 倍。英伟达称,在持续负载下,Vera能加快任务完成速度,从而提高整个AI工厂的效率,并为用户带来更快的响应。
英伟达副总裁Buck解释称,当AI模型被提问时,答案往往不是预先准备好的,模型需要生成Python代码来得出正确答案,这正是Vera CPU擅长的任务,也是CPU需求飙升的原因。
Oracle Cloud计划大规模部署
在Oracle AI客户体验中心,OCI团队(包括产品管理负责人Karan Batta和首席客户与合作伙伴成功官Gary Miller)参观了开箱后的Vera CPU系统。
Batta表示,OCI计划从 2026 年开始部署数十万颗英伟达Vera CPU,因为智能体AI需要大规模持续性能。他称Vera的架构专为高吞吐推理工作负载设计,提供OCI所需的效率、密度和足迹。
英伟达称OCI是首家超大规模部署Vera的云提供商,这让企业客户能够获得生产级智能体AI基础设施。
AI实验室接收Vera系统
5 月,英伟达团队向SpaceXAI位于帕洛阿尔托的办公室交付了Vera系统。Elon Musk询问了核心、内存布局和散热等问题。SpaceXAI正在评估Vera是否适用于强化学习工作负载以及驱动其训练堆栈的基于智能体的仿真流程。
在OpenAI的Mission Bay总部,OpenAI计算基础设施负责人Sachin Katti接收了服务器。Buck展示了Vera的功能,并拆开盖子展示系统内部。
5 月的首次交付在Anthropic旧金山办公室进行,Anthropic计算负责人James Bradbury接收了系统。Bradbury表示:“扩展计算是模型增长的重要加速器,我们很高兴看到Vera成为解决智能体工作负载时生态中有前景的一部分。”