
国产大模型排名依据的调用量数据可靠吗?
近期OpenRouter数据显示,中国国产大模型(如小米MiMo-V2.5)在调用量上登顶全球榜单,前五名全为中国模型,份额达63.5%,但这些排名所依据的调用量数据在统计口径和覆盖范围上存在一定局限性,需要理性解读。
一、数据来源与基本事实
1. 核心数据平台
当前广为流传的“国产大模型周调用量是美国14倍”“全球前五全是中国模型”等说法,主要源自全球大模型聚合路由平台OpenRouter发布的公开数据。 该平台聚合了300多个第三方模型API,面向全球开发者提供统一的调用入口,其统计方式为:记录通过OpenRouter网关发出的每笔Token消耗量。
2. 最新榜单情况
截至2026年7月26日的数据显示:
全球周调用量前五名全部为中国模型:小米MiMo-V2.5(10.5万亿Token)、DeepSeek V4 Flash(6.37万亿)、腾讯HY3(3.94万亿)、智谱GLM-5.2(3.17万亿)、DeepSeek V4 Pro(3.17万亿)。
中国模型近28天全球份额约为63.5%,美国模型为35.5%。
中国大模型周调用量达到33万亿Token,同期美国为2.34万亿Token,比值约14.1倍。
二、数据可靠性的关键考量
1. 统计口径的明确边界
OpenRouter的数据统计范围存在清晰的边界:
只覆盖通过该平台路由的开发者API调用,不包含ChatGPT、Gemini、Claude等闭源模型在各自官方渠道的直接调用量。
不包含企业私有化部署、手机端预装、内部平台调用等非公开场景。
不包含百度文心一言、阿里通义千问等国内大模型在自有生态内的调用量。
2. 价格因素对调用量的显著影响
国产模型的价格优势是推高调用量的重要原因之一:
国产模型API定价通常仅为美国同类产品的四分之一到十分之一。
DeepSeek等模型每百万Token输出收费约0.28美元,而美国同类产品约25美元,价差接近100倍。
开发者对API定价高度敏感,低价策略自然吸引更多测试性调用和批量任务。
3. 免费策略与试用转化效应
部分国产模型通过限时免费策略快速拉高调用量:
腾讯Hy3免费版曾在OpenRouter连续两周位居第一,下架后收费版调用量环比增长超过999%。
这种“免费引流→付费转化”的运营手段会短期推高数据,但长期留存才是真实能力的体现。
三、数据背后的真实趋势
1. 持续领先并非偶然
尽管存在统计口径差异,但中国模型已连续十三周在OpenRouter平台保持调用量领先,且趋势持续扩大。 “不是一家赢,是一批在赢”——前五名来自小米、DeepSeek、腾讯、MiniMax、智谱等不同背景的厂商,说明整体生态已形成竞争力。
2. 技术能力与性价比的双重支撑
国产模型在混合专家架构(MoE)、稀疏注意力机制等方面持续创新,将训练成本压至美国同类三分之二,推理成本降至十分之一。
Kimi K3以2.8万亿参数刷新全球开源规模纪录,并在代码竞技场超越Claude Fable。
全球开源模型下载量中,中国模型占比已达41%至60%,反映开发者社区的广泛认可。
3. 与主流认知的对照
有分析指出,OpenRouter数据可能漏掉大量企业级和消费级场景,但恰恰说明了中国模型在“开发者API市场”这一细分领域的统治力。 从用户主动使用的角度看,国内“豆包”等产品的日活数据也能从侧面印证调用量增长的可靠性。
四、如何理性看待排名
1. 作为趋势信号而非绝对标尺
OpenRouter榜单更适合观察“开发者用脚投票”的趋势,而非全球大模型市场的全貌。它不反映ChatGPT、Gemini等闭源巨头的自有渠道调用量,这些模型的真实总调用量可能远高于榜单显示。
2. 多维指标综合判断
调用量只是评价维度之一,还需结合如下指标:
用户主动使用频率与留存率
模型在基准测试(如代码评测、全模态榜单)中的表现
企业级落地案例与行业渗透率
开源生态贡献度与开发者社区活跃度
3. 数据本身的透明度
OpenRouter作为第三方聚合平台,其统计规则相对透明,但未公开详细的去重、反作弊机制。媒体在报道时需注明数据来源及统计口径,避免夸大解读。
五、结论:可靠但不完美,趋势可信
国产大模型在调用量上的领先地位是一个真实且持续的现象,OpenRouter数据虽然不能代表全球全部调用场景,但作为公开、可查的开发者API数据源,其反映的趋势具有参考价值。在性价比、开源开放、快速迭代的共同作用下,中国模型已经赢得了全球开发者的真金白银选择。未来,随着更多模型接入官方统计渠道,以及企业私有部署数据的补充,我们对“调用量”的理解将更全面。当前阶段,我们应理性看待榜单数据,既不盲目追捧,也不轻易否定——它揭示了一个正在发生的结构性变化:中国AI已经从“追赶者”转变为全球开发者市场上的重要供给方。