光年构想合集
20小时前来自 科技看点

小米MiMo-V2.5的10.5万亿Token调用量意味着什么?

一、数据背景:10.5万亿Token的行业坐标

1. 排名与规模

小米MiMo-V2.5上周(7月20日至26日)在OpenRouter平台上的周调用量达到10.5万亿Token,环比增长12%,成为当周全球唯一一款调用量突破10万亿的模型。同期,全球AI大模型总调用量为58万亿Token,中国模型贡献了33万亿,美国模型仅2.34万亿,中国周调用量是美国的14.1倍,且已连续十三周稳居全球首位。

2. 榜单格局演变

全球调用量前五名全部为中国模型:小米MiMo-V2.5、DeepSeek V4 Flash(6.37万亿)、腾讯Hy3收费版(3.94万亿)、智谱GLM-5.2(3.17万亿)、DeepSeek V4 Pro(3.17万亿)。

近28天中国模型全球市场份额达63.5%,美国模型仅为35.5%。

Claude近一年来首次全线落榜,美国仅英伟达一款模型勉强留在榜上。

3. 增长轨迹

从4月发布到7月底,MiMo-V2.5的单周调用量从1.46万亿Token持续攀升至10.46万亿,两个月内增长约616%。4月3日,雷军曾宣布MiMo单日调用量突破1万亿Token,被称为“新里程碑”;约三个月后,这一数字已演变为单周10.5万亿。

二、驱动因素:为何是MiMo-V2.5率先跑出

1. 极致性价比策略

MiMo-V2.5定价极为激进:输入1元/百万Token,输出2元/百万Token,缓存命中仅2分钱。

综合价格约为美国同类闭源模型的1/5到1/10。在美国闭源主力定价6–9美元/百万Token时,国产模型均价仅0.4–0.7美元。

开发者对API定价极度敏感,高性价比成为开发者从其他模型迁移的核心驱动力。

2. 多模态与Agent能力

MiMo-V2.5面向Agent场景设计,支持1M上下文,具备文本、图像、视频、音频等多模态理解能力。

在代码工程、长程推理、长上下文等核心维度已达到全球一线水平,Agent和Coding场景成为主要调用来源。

模型能力在Text Arena盲测中进入全球前五,实验室综合实力排名全球第四。

3. “人车家全生态”的内部场景支撑

小米拥有手机、澎湃OS、汽车(SU7)、智能家居等庞大设备矩阵,AI已嵌入系统底层。

用户一声“小爱同学”即可触发车机导航、空调调节、窗帘控制等一系列动作,这些场景背后均有MiMo的Token消耗。

集团内部持续且多样化的调用需求,为模型提供了“养得起”的环境和数据反馈闭环。

三、行业意义:从“参数竞赛”到“真实使用”的拐点

1. 开发者用Token投票

10.5万亿Token是开发者在OpenRouter平台上使用付费或免费API的实际消耗量,反映的是真实需求而非刷榜数据。

有观点指出,MiMo的增长并非依赖免费试用期刷量,而是在DeepSeek降价后跟进价格、参与真正竞争后实现的增长,含金量更高。

2. 中国模型的集团军优势

前五名分别来自手机厂商(小米)、开源先锋(DeepSeek)、互联网巨头(腾讯)、AI初创(MiniMax、智谱),覆盖了不同类型的玩家。

这表明中国AI产业的整体崛起不是某一家公司的单点突破,而是一个“技术雨林”生态的形成:不同模型在不同细分方向(编程、办公、多模态、学术)各自占据优势生态位。

3. 全球AI市场格局的重塑

中国已连续十三周在OpenRouter调用量上超过美国,且差距持续拉大。

美国模型调用量环比下滑67.86%,反映出高昂定价策略导致的长尾开发者流失,恰为中国模型出海提供了窗口期。

有评论指出,这组数据最重要的信号不是“中国AI很强”——这已无需证明,而是“持续13周+前五来自五家公司+Claude消失”三个信号同时出现,说明全球开发者市场的格局正在发生结构性变动。

四、未来展望:从调用量领跑到生态主导

1. 进一步整合“人车家全生态”

MiMo-V2.5的价值不仅在于API调用量,更在于它正成为小米手机、汽车、智能家居背后统一的系统级Agent模型,实现从“被调用的API”到“无处不在的AI基础设施”的跃迁。

2. 下一代模型竞赛

市场高度期待MiMo-V3和DeepSeek V4的正面交锋。

随着全球开发者对中国模型的接纳度持续提升,调用量领先的优势将反哺模型迭代——更多真实使用反馈、更多场景数据,形成正循环。

3. 从流量指标到心智占位

调用量全球第一是重要里程碑,但真正决定长期竞争力的,是模型能否成为用户每日主动打开、主动依赖的不可替代入口。目前,MiMo已证明了在开发者市场中的“性价比+能力”双优势,下一步需要在用户心智和场景黏性上持续深耕。