GLM Kimi Deepseek文本能力对比雷达图
Arena发布了关于国内 3 个模型文本能力的测试:GLM vs Kimi vs Deepseek
这三款顶级模型在能力上呈现出明显的差异化与互补性。
DeepSeek-V4 Pro 明显侧重于硬核理科与高门槛任务,在“医疗与健康”、“生命/物理/社会科学”、“数学”、“专家级能力”以及“高难度提示词”等维度上拉满了外圈表现,这些方向得分较高;
Kimi-K2.6 则展现出极强的文本与语境优势,其在“中文能力”、“创意写作”和“长查询”指标上的表现处于绝对领先地位;
而GLM-5.1 的能力分布最为均衡紧凑,不仅在“指令遵循”和“多轮对话”上表现出极高的控制力,在“娱乐、体育与媒体”以及“写作、文学与语言”等应用领域也占据优势。
整体而言,三者分别在复杂数理推理、中文长文本创作以及系统级指令控制与通用领域应用上各自占据了主导地位。
#glm##deepseek##kimi##文本能力#
发布于 四川
