马弘运
26-09-22 17:04 微博认证:数码测评师 资深摄影师 青年作家 科技博主

#小米MiMo为何登顶开源第一#

小米大模型这波冲得确实有点快。

MiMo-V2.6-Pro 在 Artificial Analysis 最新榜单拿到 46 分,目前排开放权重模型第一,而且不是只刷一个单项:文本、图片、音频、视频都能吃,支持 1M tokens 上下文。

但我觉得真正值得看的,不是这个“第一”,而是小米这次把训练路线改得很激进。

官方披露,V2.6 很大一部分提升来自大规模强化学习。不是单纯继续堆预训练数据,而是把大量算力扔进可验证的复杂任务和真实环境里,让模型不断试错、拿反馈、再继续学。小米称这轮 Live RL 跑了 6 天,但背后其实已经做了半年基础研究和工程试错。(MiMo)

这可能也是现在大模型竞争一个挺明显的变化:

模型底座做到一定程度以后,大家真正拉开差距的地方,正在从“谁参数更多”,变成“谁能让模型在真实任务里练得更多”。

而且 MiMo-V2.6-Pro 是 1T 总参数、推理时只激活 42B 的 MoE 架构,性能往上冲的同时,没有完全放弃推理效率。Artificial Analysis 实测输出速度大约 125 tokens/s,价格也压得比较低。

所以小米这次最让我意外的其实不是“做出了一个强模型”。

而是它已经明显开始按照第一梯队大模型公司的打法在投入了。

当然,46 分是 Artificial Analysis 这一套评测体系下的开放权重第一,不等于“所有能力全球第一”;小米自己也承认,目前和最强闭源模型仍然存在差距。(MiMo)

但从 MiMo 前几代到现在这个速度看,小米 AI 已经不能再当成手机业务旁边顺手做的项目了。

雷军这次,算力是真的往里砸了。#ai##大模型#

发布于 辽宁