
Kimi K3编程在哪些编程榜单上登顶全球第一?
2026年7月16日,月之暗面发布2.8万亿参数开源模型Kimi K3,在Frontend Code Arena(前端编程竞技场)以1679分登顶全球第一,超越了Claude Fable 5(1631分)与GPT-5.6 Sol(1618分),这是中国大模型首次在该权威代码盲测榜单上夺冠。
一、登顶的编程榜单与具体成绩
1. Frontend Code Arena(前端编程竞技场)
Kuno K3以1679分超越Claude Fable 5(1631分)和GPT-5.6 Sol(1618分),登顶全球第一。
该榜单采用ElO对战积分机制,由真实开发者匿名盲测代码质量,屏蔽品牌光环,含金量极高。
Kimi K3在7个细分领域拿下6个第一。

2. Program Bench(软件逆向工程评测)
Kimi K3得分77.8,高于GPT-5.6 Sol的77.6,位列全球第一。

3. FrontierSWE(高难软件工程评测)
Kimi K3得分81.2,超过GPT-5.6 Sol的71.3,仅次于Claude Fable 5。
4. SWE Marathon(长程编程评测)
Kimi K3以42.0分排名全球第一。
5. Automation Bench(办公自动化评测)
Kimi K3以30.8分排名全球第一。
6. Terminal Bench(终端编程评测)
Kimi K3得分88.3,距GPT-5.6 Sol仅差0.5分。
二、核心技术支撑
1. 参数规模与架构
总参数2.8万亿,为全球最大开源模型。
采用MoE(混合专家)架构,896个专家中仅激活16个,单次推理计算量可控。
自研KDA混合线性注意力机制,100万token上下文下解码吞吐量最高提升6倍,KV缓存使用量减少75%。
2. 训练与效率
采用Moon Clip二阶优化器,使20T训练数据达到40T训练效果,同等性能下训练成本减半。
整体训练效率较上代K2提升约2.5倍。
三、开源与商业影响
1. 开源策略
完整模型权重将于2026年7月27日前开放,全球开发者可自由下载、部署、二次开发。
2. 微软评估与成本优势
微软正在内部测试Kimi K3,并评估将部分Copilot推理请求从OpenAI、Anthropic模型迁移至K3,每年最高可节省约6亿美元云基础设施成本。
据第三方机构Artificial Analysis测算,Kimi K3单任务成本约0.94美元,与GPT-5.6 Sol(1.04美元)接近,约为Claude Opus 4.8(1.80美元)的一半。
Kimi K3的API定价为输入20元/百万token、输出100元/百万token;而Claude Fable 5输出定价约360元/百万token,GPT-5.6 Sol约216元/百万token。