小卖部的科技涵论
25-11-29 19:31 微博认证:时尚博主

AI芯片市场暗流涌动。

巨头之一谷歌正加快自研AI芯片TPU的商业化步伐,有报道称谷歌正与Meta等科技大厂谈外采合作。在外界看来,如果合作落地,TPU将进入谷歌体系之外的超大规模数据中心,或对英伟达GPU主导的算力市场带来冲击。

相关消息一出,英伟达股价随即震荡。周二美股早盘,英伟达股价一度下滑7%,最终收跌约2.6%。而自10月29日以来,英伟达市值从5.03万亿美元跌至11月25日收盘的4.32万亿美元,不到一个月时间市值缩水已超过7000亿美元(约合人民币5万亿元)。

11月26日凌晨,英伟达在社交平台上正面回应谷歌的竞争:“我们对谷歌的成功感到高兴——他们在人工智能领域取得了重大进展,而我们仍将继续向谷歌供货。英伟达领先行业整整一代,是唯一能够运行所有AI模型,并可在所有计算场景中部署的平台。”

作为全球GPU市场的主导者,英伟达用“领先一代”与“全场景优势”回应这场自研芯片带来的挑战。而即便谷歌TPU得以进入Meta等巨头的数据中心,也并不意味着GPU会在短期内被替代。事实上,谷歌也表示,自家定制的TPU和英伟达GPU的需求都在加速增长。

更多业内观点认为,随着AI训练与推理的负载增长和高度多元化,未来更可能呈现ASIC、GPU异构部署,而不是哪一种架构一统天下。


谷歌加速TPU商用

谷歌对TPU的研发已久,始于2013年,并且和谷歌云服务紧密结合。

过去,TPU主要用于谷歌内部AI工作负载和Google Cloud服务。然而,日前多家媒体报道称,谷歌正在推动其自研芯片走向外部客户,Meta正考虑从2027年开始在其数据中心部署谷歌的TPU,并可能最早于明年通过Google Cloud租用TPU容量,潜在合同金额或达数十亿美元。

目前,英伟达占据AI芯片市场超过90%的份额,而以谷歌为代表的厂商,正在夺取更多份额。谷歌此举并非突然,一方面是其长期“软硬一体化”战略的自然延伸。另一方面,在大模型训练成本成几何级上升的背景下,自研芯片成为巨头降低能耗、控制成本的关键路径。

今年4月,谷歌推出了最新一代TPU——TPU v7(Ironwood),最近又迭代出了Gemini 3,谷歌正在通过模型和硬件耦合的方式,强化自身在大模型时代的技术闭环。据悉,Gemini 3已大量使用TPU完成训练和推理,为谷歌推动TPU的商业化提供了更强的验证场景。

作为AI老将,谷歌从云端、终端、芯片、大模型、平台工具等等,进行了全覆盖。而GPU王者英伟达,也在构建AI基础设施的全套体系,包括CUDA、NVLink、高速互联等壁垒。

面对外界对霸主地位动摇的讨论,英伟达迅速发声,采取主动回应。一方面,它强调与谷歌的合作稳定且持续;另一方面,其关键论点非常鲜明,GPU的通用性与兼容性仍然是当前AI创新不可替代的基础设施。

相比之下,TPU、Gaudi、Trainium等ASIC芯片往往根据特定框架或任务场景,在特定负载上取得极高效率。谷歌依然采购英伟达GPU,但未来厂商在AI训练与推理时,会采用算力供应多元策略。

发布于 浙江