
小米MiMo-V2.5的10.5万亿Token调用量意味着什么?
一、数据背景:10.5万亿Token的行业坐标
1. 排名与规模
小米MiMo-V2.5上周(7月20日至26日)在OpenRouter平台上的周调用量达到10.5万亿Token,环比增长12%,成为当周全球唯一一款调用量突破10万亿的模型。同期,全球AI大模型总调用量为58万亿Token,中国模型贡献了33万亿,美国模型仅2.34万亿,中国周调用量是美国的14.1倍,且已连续十三周稳居全球首位。
2. 榜单格局演变
全球调用量前五名全部为中国模型:小米MiMo-V2.5、DeepSeek V4 Flash(6.37万亿)、腾讯Hy3收费版(3.94万亿)、智谱GLM-5.2(3.17万亿)、DeepSeek V4 Pro(3.17万亿)。
近28天中国模型全球市场份额达63.5%,美国模型仅为35.5%。
Claude近一年来首次全线落榜,美国仅英伟达一款模型勉强留在榜上。

3. 增长轨迹
从4月发布到7月底,MiMo-V2.5的单周调用量从1.46万亿Token持续攀升至10.46万亿,两个月内增长约616%。4月3日,雷军曾宣布MiMo单日调用量突破1万亿Token,被称为“新里程碑”;约三个月后,这一数字已演变为单周10.5万亿。
二、驱动因素:为何是MiMo-V2.5率先跑出
1. 极致性价比策略
MiMo-V2.5定价极为激进:输入1元/百万Token,输出2元/百万Token,缓存命中仅2分钱。
综合价格约为美国同类闭源模型的1/5到1/10。在美国闭源主力定价6–9美元/百万Token时,国产模型均价仅0.4–0.7美元。
开发者对API定价极度敏感,高性价比成为开发者从其他模型迁移的核心驱动力。
2. 多模态与Agent能力
MiMo-V2.5面向Agent场景设计,支持1M上下文,具备文本、图像、视频、音频等多模态理解能力。
在代码工程、长程推理、长上下文等核心维度已达到全球一线水平,Agent和Coding场景成为主要调用来源。
模型能力在Text Arena盲测中进入全球前五,实验室综合实力排名全球第四。
3. “人车家全生态”的内部场景支撑
小米拥有手机、澎湃OS、汽车(SU7)、智能家居等庞大设备矩阵,AI已嵌入系统底层。
用户一声“小爱同学”即可触发车机导航、空调调节、窗帘控制等一系列动作,这些场景背后均有MiMo的Token消耗。
集团内部持续且多样化的调用需求,为模型提供了“养得起”的环境和数据反馈闭环。
三、行业意义:从“参数竞赛”到“真实使用”的拐点
1. 开发者用Token投票
10.5万亿Token是开发者在OpenRouter平台上使用付费或免费API的实际消耗量,反映的是真实需求而非刷榜数据。
有观点指出,MiMo的增长并非依赖免费试用期刷量,而是在DeepSeek降价后跟进价格、参与真正竞争后实现的增长,含金量更高。
2. 中国模型的集团军优势
前五名分别来自手机厂商(小米)、开源先锋(DeepSeek)、互联网巨头(腾讯)、AI初创(MiniMax、智谱),覆盖了不同类型的玩家。
这表明中国AI产业的整体崛起不是某一家公司的单点突破,而是一个“技术雨林”生态的形成:不同模型在不同细分方向(编程、办公、多模态、学术)各自占据优势生态位。
3. 全球AI市场格局的重塑
中国已连续十三周在OpenRouter调用量上超过美国,且差距持续拉大。
美国模型调用量环比下滑67.86%,反映出高昂定价策略导致的长尾开发者流失,恰为中国模型出海提供了窗口期。
有评论指出,这组数据最重要的信号不是“中国AI很强”——这已无需证明,而是“持续13周+前五来自五家公司+Claude消失”三个信号同时出现,说明全球开发者市场的格局正在发生结构性变动。
四、未来展望:从调用量领跑到生态主导
1. 进一步整合“人车家全生态”
MiMo-V2.5的价值不仅在于API调用量,更在于它正成为小米手机、汽车、智能家居背后统一的系统级Agent模型,实现从“被调用的API”到“无处不在的AI基础设施”的跃迁。

2. 下一代模型竞赛
市场高度期待MiMo-V3和DeepSeek V4的正面交锋。
随着全球开发者对中国模型的接纳度持续提升,调用量领先的优势将反哺模型迭代——更多真实使用反馈、更多场景数据,形成正循环。
3. 从流量指标到心智占位
调用量全球第一是重要里程碑,但真正决定长期竞争力的,是模型能否成为用户每日主动打开、主动依赖的不可替代入口。目前,MiMo已证明了在开发者市场中的“性价比+能力”双优势,下一步需要在用户心智和场景黏性上持续深耕。