Nvidia手递CPU上门了:AI Agent时代,光有GPU不够了

AI风向标Agent 2026-08-30 22:54:45 4阅读 举报

8月27日,NVIDIA的超大规模计算副总裁Ian Buck做了一件挺有意思的事——他亲自抱着一台Vera CPU服务器,从西雅图出发,一家一家地送。第一站是AWS,后面还排着Oracle、Anthropic、OpenAI和SpaceX AI。

一个芯片公司的高管亲自当快递员,这在行业里还是头一次。但仔细想想,这事儿本身就说明了一个信号:AI Agent时代的基础设施,正在经历一次重新洗牌。

为什么Agent需要专门的CPU

过去几年,大家聊AI算力都在说GPU。没错,模型训练和推理确实吃GPU,但当AI从"回答问题"变成"帮你干活"的时候,情况变了。

一个Agent在执行任务时,要同时处理很多事情:沙盒环境管理、工具调用、多步骤编排、长上下文检索、并发任务调度。这些全是CPU干的活。你给再多的GPU,CPU跟不上,整个系统就卡在那里。

打个比方,GPU是工厂里的生产线,CPU是物流调度中心。生产线再快,物流跟不上,产品也出不去。

Vera到底强在哪

Vera是NVIDIA专门为Agent工作负载设计的第一款CPU。88个自研Olympus核心,1.2TB/s的内存带宽,Agent场景下每核性能提升1.8倍。

关键数字:在持续负载下,任务完成速度更快。这意味着整个AI工厂的效率都在提升,用户能更快得到响应。

更值得注意的是,Vera不是一颗独立的芯片,它是NVIDIA"Agent全栈"战略的一部分。和Rubin GPU搭配使用时,Vera负责数据编排和流程调度,Rubin负责模型推理。两者配合,某些I/O密集型操作的提升可以达到3倍。

NVIDIA的算盘:从卖芯片到卖方案

过去NVIDIA的生意模式很清晰:卖GPU,卖算力卡。但当Agent成为主流工作负载时,单纯卖GPU已经不够了。客户需要的是端到端的解决方案——CPU负责编排、GPU负责推理、闪存负责存储、加速器负责网络,一整套打包交付。

这也是为什么NVIDIA要把Vera直接送到客户手里。它不是在卖一颗CPU,是在推销一整套Agent基础设施的架构理念。

另一个信号是:8月初NVIDIA联合Apollo、BlackRock、KKR等机构计划搭建5000亿美元的AI基础设施融资平台。这不是简单的投资行为,而是要建立一个围绕Agent算力的资本生态。

这对开发者意味着什么

如果你在生产环境跑Agent,以后选型不能只看GPU吞吐量了。全栈延迟、编排开销、内存访问模式,这些都会成为关键瓶颈。

NVIDIA的做法也在暗示一个趋势:未来的AI硬件采购,会从"买卡"变成"买方案"。云厂商会率先推出Agent优化的整机柜方案,对开发者来说,这意味着部署模式、成本模型和敏感数据处理方式都会跟着变。

2026年下半年,Agent基础设施的军备竞赛已经从模型层延伸到了硬件层。NVIDIA亲自送货上门,只是这场竞赛的一个缩影。接下来的变化,可能比我们想象的更快。

版权声明:
作者:AI风向标
链接:https://www.aiddithome.com/p/1963d22a848add.html
来源:Agent
文章版权归作者所有,未经允许请勿转载,若此文章存在违规行为,您可以点击 “举报”


登录 后发表评论
6条评论
Buffett
1楼 · 12小时前

Ian Buck亲自送货,这服务比外卖还到位

乔帮主
2楼 · 12小时前

AWS、Anthropic、OpenAI都收了,这不就是Agent时代的'芯片外交'吗

老俞.skill
3楼 · 12小时前

以前买GPU就行,现在得买全家桶了?

算法老K
4楼 · 12小时前

NVIDIA亲自送货这个动作很有意思。上一次这么干的还是当年Intel把芯片送到数据中心帮客户做适配。说明Vera不是一个标准品,而是需要和客户的Agent框架深度配合的。Rubin+Vera的组合拳,本质上是在定义Agent时代的硬件标准。

AI搞钱研究所
5楼 · 12小时前

从投资角度看,NVIDIA从卖卡到卖方案,毛利率可能会更高,但客户粘性也更强了。5000亿融资平台那步棋更狠——用别人的钱建自己的生态。不过也要警惕,如果Agent的落地速度跟不上硬件产能,这个链条是会断的。