Kimi K3发布2天之后就把新用户订阅给停了,说明算力依然是AI经济的硬通货,卖铲子的生意望不到尽头。
其实因为不是那种打穿地心的便宜,Kimi K3在OpenRouter的日调用量并没有涨得特别夸张,昨天排在第8,差不多是150B的单日消耗。
才到这个量级就崩掉了,以致于要拆东墙补西墙、把C端算力挪给B端,而且吞吐效率和端到端延迟都在明显变差,意味着什么呢?
1、2.8T的尺寸,能耗实在太高了;
2、Kimi能用的GPU储备完全不够;
3、阿里云不给力吧。
好吧第3条是开玩笑的,阿里云已经很尽力了,小道消息说Kimi经常挤占Qwen在阿里云的计算资源,人收钱是真办事啊⋯⋯
把视野放远一点,在美国,除了AWS、Google Cloud这种大户,几乎所有的AI云厂商都已经用光了GPU库存,像是Databricks、CoreWeave、Nebius已经开始只签3年以上的订单了,不再接待小客户。
以这几年来那么激进囤卡的力度,也都还是跟不上买方需求的增速,你们就能想象AI市场有多烫手了吧。
可能很多人要说国产化的万卡集群,这方面的进展肯定很快,但有个绕不过去的问题在于,我前几天也隐晦提过的:
无论是GLM-5.2还是Kimi K3这样的次SOTA模型,本质上都是出口贸易,靠的是发达国家程序员的刷卡买单,这种几百上千美金的单月ARPPU,是内需市场根本望尘莫及的。
所以这些模型厂商的上岸第一剑,必然都是先斩订阅者,从调价背刺,到干脆停售,一切以保供洋人为优先级。
但是开源策略,其实不利于塑造算力-模型的一体化,为了扩大影响力,开源的国产模型必然支持海外的云平台部署托管,,而这些云平台是不可能部署昇腾服务器的,到头来还是会被英伟达吃掉增量,最多谷歌的TPU再来分点汤喝。
长远来看,谁能锁定可出口的算力,谁就拥有最高的主动权,而一切的源头,都是要把现金弹药尽可能打到3-5年不被算力卡脖子。
发布于 湖北
