木鱼的AI大厂情报
26-06-02 14:17

黄仁勋在 COMPUTEX 上讲了将近两个小时,GPU、AI 工厂、机器人、自动驾驶,什么都讲了。但有一段让我特别意外,他花了整整一大段时间,认认真真地讲了一颗 CPU。

一个靠 GPU 起家的公司,一个把「GPU 就是新的计算引擎」喊了十年的人,突然开始跟你安利 CPU。

不觉得这事儿挺反常的吗?

这颗 CPU 叫 Vera,英伟达自己从头设计的,88 个自研 Olympus 核心,单片架构,不搞 chiplet 拼接,内存带宽 1.2 TB 每秒。黄仁勋给出的数据是,跟 x86 CPU 比,部分场景延迟降了 40%,Agent sandbox 性能 1.8 倍,SQL 性能 3 倍,实时流处理 6 倍。

但更让我在意的,是他给出的那个判断。

他说,Agent 越多,CPU 越容易成为瓶颈。

乍一听有点反直觉对吧。我们这两年聊 AI 算力,脑子里想的全是 GPU,谁的显卡更强,谁的 FLOPS 更高,谁抢到了更多的 H100。CPU?那不是上个时代的事儿了吗?

但你仔细想想 Agent 到底是怎么干活的,就能理解他为什么这么说了。

传统的 AI 推理,简单讲就是「进去一个 prompt,出来一段文字」。这个过程主要靠 GPU 算,算完就完了。但 Agent 不一样。Agent 是一个持续运转的系统,它接到任务之后,要理解你的意图,要拆解步骤,要去调用各种工具。

调一下浏览器,查一下数据库,跑一段代码,把结果存到记忆里,再根据新信息重新规划下一步。

这些「调用工具、读写数据、来回调度」的活儿,全都落在 CPU 头上。

我跟你打个比方。你花大价钱雇了一个天才员工,脑子转得飞快,给他一个问题三秒钟就能想出答案。但他每次想完之后,需要去隔壁楼拿资料、需要去打印室打印文件、需要去找其他部门签字。而这些跑腿的事儿,全卡在一部老旧的电梯上。

电梯一次只能装三个人,还经常停在错的楼层。

结果就是,你的天才员工一天有一半时间在等电梯。

GPU 就是那个天才员工。CPU 就是那部电梯。

过去跑传统推理的时候,这个问题不明显,天才员工一次只需要坐一趟电梯就够了。但 Agent 时代完全不一样,天才员工每完成一个小步骤就要坐一趟,一个任务下来可能坐十几趟。电梯不升级,整个系统就被拖死了。

这就是黄仁勋反复强调的,GPU 是 AI 工厂里最贵的资产,但 CPU 的延迟会直接影响 GPU 利用率。你买了一堆最顶级的 GPU,结果因为 CPU 跟不上,GPU 大部分时间在空转等数据。

想想就觉得肉疼。

坦率的讲,英伟达做 CPU 这件事,我觉得既是进攻也是防守。

防守的逻辑很好理解。英伟达的 AI 系统越来越复杂,GPU、网络、存储、安全、调度,全都要协同。如果 CPU 还是用别人家的,那这个「别人」就永远卡在你的关键链路上。Intel 和 AMD 的 x86 CPU 是为传统云计算设计的,按核心出租、按时间计费,响应速度按秒算。但 Agent 的节奏是毫秒级的,频繁调用、频繁中断、频繁切换上下文。它需要的 CPU 跟传统云计算需要的 CPU,根本不是同一个东西。

与其等别人来适配你,不如自己造一个。

进攻的逻辑更有意思。你看这次发布会,从个人电脑的 RTX Spark,到数据中心的 Vera Rubin,到 AI 工厂的 DSX 蓝图,到企业软件的 Nemotron 和 OpenShelf,到自动驾驶,到人形机器人。英伟达现在的野心,已经不是做一个芯片供应商了,它想定义的是一整套计算体系。

在这套体系里,如果 CPU 还是别人的,那你就永远只是「体系的一部分」,而不是「体系的定义者」。

说真的,这让我想到苹果当年做 Apple Silicon。苹果为什么要自己做芯片?不是因为 Intel 的芯片不够好,而是因为苹果想要完全控制从硬件到软件到体验的整条链路。当你的芯片、操作系统、开发工具、应用生态全都是自己的,你就拥有了一种别人没法复制的系统性优势。

英伟达现在干的事情,跟这个逻辑一模一样。只不过苹果控制的是消费电子的体验链路,英伟达想控制的是 AI 计算的基础设施链路。

回到对我们普通人的影响这块。

如果你是开发者,有一个趋势我觉得还挺重要的。过去选技术栈,你想的是「用哪个模型 API」。但如果英伟达这套从芯片到软件到工具链的全栈生态真的建起来了,未来你绑定的可能不只是一个 API,而是一整套计算平台。CUDA 生态已经是这样了,用了 CUDA 就很难换到别的 GPU。未来如果 Vera CPU + Rubin GPU + NVLink + OpenShelf 全都绑在一起,这个锁定效应只会更强。

这对开发者来说是好事还是坏事?我自己也还在想。

一方面,全栈整合确实带来更好的性能、更低的调试成本。另一方面,你把自己交给了一个供应商,如果哪天它涨价了、改方向了、或者你想迁移到别的平台,成本会非常高。

这种感觉,用过苹果全家桶的朋友应该都懂。爽是真的爽,被锁住也是真的被锁住了。

其实回过头来看,这场发布会最让我感慨的,不是某个具体产品有多强,而是英伟达对于「下一个时代的计算应该长什么样」这件事,已经有了一个非常完整的想象。从 GPU 到系统,从系统到工厂,从工厂到整个计算范式。

我一直觉得,真正厉害的公司不是在已有的赛道上跑得最快,而是重新画一条赛道,然后告诉所有人,来,在这上面跑。英伟达现在干的就是这件事。Agent 需要什么样的计算?它来定义。Agent 需要什么样的 CPU?它自己造。Agent 需要什么样的基础设施?它画蓝图。

至于这个蓝图最终能不能落地。。。说实话我也不确定。毕竟从 PPT 到量产,中间隔着无数个工程难题。

但有一点我是真的觉得,黄仁勋看到的那个趋势没有错。Agent 不是一个简单的推理任务,它是一个持续运转、频繁调度、需要整个系统协同的工作负载。

谁能把这个系统做得最好,谁就拿到了下一个时代的门票。

发布于 上海