NVIDIA推出面向AI Agent工作负载的Vera CPU,Ian Buck亲自送货上门,已开始大规模出货。
编者按:本博客最初于 2026 年 5 月 18 日发布,于 2026 年 8 月 27 日(周四)更新。
AWS 与 NVIDIA 昨日宣布扩大双方长达 16 年合作关系,包括新增 200 万颗 NVIDIA GPU 的采购计划,以及将基于 Vera CPU 的基础设施引入 AWS 的合作内容。
AWS 已收到首台 NVIDIA Vera CPU 服务器和 Vera Rubin GPU,由 NVIDIA 超大规模与 HPC 副总裁 Ian Buck 亲自送达西雅图。
AWS 是 Vera 在 AI 生态圈快速旅程的最新一站。此前,Buck 已将 Vera CPU 系统交付给 Oracle Cloud Infrastructure 及三家领先的 AI 实验室:Anthropic、OpenAI 和 SpaceXAI。
"Agentic AI 正在 AI 工厂中掀起一个新的 CPU 时刻——随着模型从回答问题转向采取行动,Vera 从设计上就是为了让这些工作在大规模下持续运转而生的,"Buck 表示。
核心思路:想象你能以 10 倍的速度工作。你的电脑能跟上吗?Agentic AI 对人们用于完成各类工作——从制作幻灯片到编译测试软件、分析数据、搜索文件乃至运行模拟——的基础设施提出了前所未有的需求。
AI agent 并不是只靠 GPU 运行的。每一个 agentic 沙箱、每一次工具调用、每一层编排逻辑、每一次长上下文检索操作——这些都是 CPU 的工作。Vera 是一种全新的 CPU,其设计起点正是这一现实。
这种并发、实时任务的严酷考验,对 CPU 施加的压力是传统聚焦核心密度设计从未优先考虑的方向。Vera 配备了 88 颗 NVIDIA 自研的 Olympus 核心,1.2TB/s 的内存带宽,在 agentic AI 工作负载上实现每核心最高 1.8 倍的性能提升。在持续负载下,工作完成得更快——提高了整个 AI 工厂的效率,帮助用户以更快的响应速度完成工作。
NVIDIA Vera 即将登陆 @awscloud。
NVIDIA 的 Ian Buck 亲自将 AWS 首台 Vera CPU 服务器和 Vera Rubin GPU 送达西雅图 AWS 总部的 Willem Visser 和 Supreeth Sheshadri 手中。
Vera 专为 agentic AI 而生:每美元更多 tokens、用户更快得到结果,以及…… pic.twitter.com/btcw2gz42x
— NVIDIA (@nvidia) 2026 年 8 月 27 日
从发布到抵达:Vera 前往 AWS
Buck 将 AWS 首台 Vera CPU 服务器和 Vera Rubin GPU 沿西雅图的 Spheres 大楼推过,亲手交付给 AWS 亚马逊 EC2 副总裁 Willem Visser。他们与亚马逊 EC2 硬件工程副总裁 Supreeth Sheshardi 共同出席,共同探讨 Vera 和 Vera Rubin 将为 AWS 客户带来什么。
NVIDIA 的 Ian Buck 亲自将首批 NVIDIA Vera CPU 送达我们的合作伙伴 @AnthropicAI、@OpenAI、@SpaceX 和 @OracleCloud。🎉
Vera 是 NVIDIA 首款定制 CPU,专为 agentic AI 时代而生。这只是开始。Vera 驱动系统之路由此开启…… pic.twitter.com/Ep5PLqcqIa
— NVIDIA (@nvidia) 2026 年 5 月 18 日
Vera 回到湾区与 OCI
在 Oracle AI 客户卓越中心内部,OCI 团队——包括负责整体产品管理的 Karan Batta 以及首席客户与合作伙伴成功官 Gary Miller——参观了开箱的 Vera CPU 系统。背景中,一排 NVIDIA GPU 机架正在处理来自全球各地的 OCI 客户工作负载。该中心是 Oracle 客户体验各种 AI 工作负载的地方。
Buck 解释了 Vera 将如何发挥作用。
"当 AI 模型被提出一个问题时,答案通常并非已经准备好随时可用。模型实际上需要生成一些 Python 代码来得出正确答案,"Buck 在解释 Vera CPU 擅长的任务时说道。"这就是为什么我们看到对 CPU 的需求正在飙升。"
这也是 OCI 团队观察到的趋势。
"OCI 计划于 2026 年开始部署数十万颗 NVIDIA Vera CPU,因为 agentic AI 需要大规模下的持续性能,"Batta 表示。"Vera 的架构专为高吞吐量推理工作负载而设计,提供 OCI 为下一代企业 AI 供能所需的效率、密度和占地空间。"
OCI 是首家在超大规模上部署 Vera 的云提供商。对企业客户而言,这意味着在规模上目前其他云提供商无法匹敌的生产级 agentic AI 基础设施。
OCI 团队迫不及待地想让 Vera 发挥作用,为客户提供另一个可定制和验证其 agentic AI 与工作负载的系统,Miller 说。"我非常期待来这里参观的人们的反馈,并与他们一起从 Vera 中获得最大收益,"他表示。
在半岛与 SpaceXAI
5 月,当天的最后一家 AI 实验室交付在帕洛阿尔托的 SpaceXAI 办公室完成。
NVIDIA 团队向 Elon Musk 展示了系统内部结构。Musk 倾听,然后开始提问——关于核心、关于内存布局、关于散热。
SpaceXAI 正在评估 Vera 用于强化学习工作负载以及驱动其训练栈的基于 agent 的模拟管道。
在 OpenAI 使命湾总部,交付仪式移到了室外——在主要办公室旁的一个露天阳台上。
旧金山出了名多变的天气在这一天格外配合,OpenAI 计算基础设施负责人 Sachin Katti 感谢 Buck 把服务器送过来。
Buck 讲解了 Vera 的特性,期间——从口袋里掏出一把螺丝刀——揭开盖子展示了系统内部。
Vera 前往旧金山与 Anthropic
5 月的首次交付落地于旧金山 Anthropic 时尚现代的 SoMa 办公室。
Anthropic 计算负责人 James Bradbury 从他们紧邻海湾的会议室接手了交付。
Buck 以一块他随身携带的裸 NVIDIA Vera CPU 主板为辅助,向 Bradbury 讲解了围绕这款新 CPU 构建的服务器,介绍了使 Vera 与众不同的特性。"扩展算力是模型增长的重要加速器,"Bradbury 说。"当解决 agentic 工作负载时,我们很高兴看到 Vera 作为生态系统中有前景的一部分而出现。"
Vera 是 NVIDIA 极限协同设计故事的一部分,同系列的还有 NVIDIA Rubin GPU、BlueField-4 DPU、Spectrum-X 和 MGX 机架架构。
除了驱动独立 CPU 系统,Vera 还是 Vera Rubin NVL72 的主机处理器,在那里通过第二代 NVIDIA NVLink-C2C 与一对 Rubin GPU 配对。
在这些系统中,Vera 和 Rubin 共享统一的内存架构,保持加速计算的高利用率。
Vera 的快速 CPU 核心和互连处理编排、控制和数据移动,以传统基础设施 2 倍的能效为 GPU 供能。
Agentic AI 的时代有了一款专为它打造的 CPU,它的名字叫 Vera。
了解更多关于 NVIDIA Vera CPU 的信息。