
小米大模型降价最高99%对开发者有何影响?
小米在5月底官宣MiMo-V2.5系列API永久降价最高99%,这波操作直接把大模型的调用成本打到了"厘"级,对开发者尤其是中小团队来说,意味着AI工具从一个"预算项目"真正变成了"日常水电"。
一、降价力度:从"分钱"到"厘钱"的跨越
价格数据:2026年5月27日,小米宣布MiMo-V2.5系列API永久降价,最高降幅达99%。降价后,Pro版缓存命中输入价格低至0.025元/百万tokens,输出6元/百万tokens;标准版缓存命中输入仅0.02元/百万tokens,输出2元/百万tokens。
计费简化:取消传统按上下文窗口长度区分定价的做法,不再分长短对话计费。Token Plan同步优化,同等价格下用户可用Token额度提升至原来的5-8倍。
定价对标:调整后的价格直接对标以性价比著称的DeepSeek-V4-Pro,两家高性能模型在缓存命中输入、缓存未命中输入、输出三条定价上完全一致。


二、降价底气:技术优化而非烧钱补贴
底层算法:小米MiMo-V2.5采用MoE专家混合架构,万亿参数仅激活42B,推理效率大幅提升。核心突破包括KVCache双池、SWA-aware前缀树等,把万亿参数推理成本压到极致,缓存存储缩减近7倍。
生态投入:同步推出百万亿Token激励计划,超54万人申请,累计发放100万亿免费Token,折合价值超6500万元。
技术自信:小米工程师曾公开表示,降价后的API仍能维持收支平衡,靠的是五大核心技术突破大幅降低推理成本,而非短期烧钱换市场。
三、对开发者的实际影响:降低门槛与激活创新
成本剧降:此前中小企业接入大模型要考虑成本高、试错贵、调用量不敢放开三件事;如今调用成本降至原来的几十分之一甚至百分之一,客服自动回复、合同初审、代码辅助、内容批量生产等场景开始具备商业可行性。
开发者用脚投票:OpenRouter最新一周全球大模型调用量榜单显示,小米MiMo-V2.5登顶第一,两个月调用量从1.5万亿涨至10.5万亿。前五名全部由中国企业研发,中国模型在OpenRouter上的Token调用量占比达63.5%。
生态扩展:降价叠加全系列开源策略,开发者可深度接入小米"人车家"全场景生态,将AI能力嵌入手机、汽车及智能家居硬件。