#Grok4比DeepSeek强吗#
应该还是各有优势,难以简单判定谁更强。
Grok 4 在综合推理和多模态等方面表现突出,而 DeepSeek 在中文处理和部分技术任务上颇具亮点。Grok 4 在推理方面表现卓越。在涵盖上百个学科的 HLE 超高难度基准测试中,Grok 4 无工具版本能解决 25.4% 的问题,使用工具后提升至 38.6%,Grok 4 Heavy 更是取得了 44.4% 的成绩。同时,Grok 4 Heavy 在 GPQA 测试中得分 88-89,在 AIME25 数学竞赛题中几乎取得满分。DeepSeek 在数学推理上也有不错表现,如 DeepSeek V3 在 MATH 500 上达到 90.2。但整体来看,Grok 4 在复杂推理任务上的成绩更为亮眼。DeepSeek 在中文理解和生成方面具有显著优势,处理中文医学文献等专业领域文本时,能精准提取关键信息。其文言文翻译准确率达 91%,中文语音识别错误率为 2.1%,方言支持度达 7 种。Grok 4 的语言生成能力极为出色,尤其擅长创意写作,能生成引人入胜的故事等,在处理长文本时能保持较高的连贯性和逻辑性,但在特定领域专业术语理解上可能不如 DeepSeek 准确。
另外,就训练成本与价格而言,DeepSeek 训练成本较低,如 DeepSeek V3 训练成本仅为 600 万美元,且 API 价格也较为亲民,输入为 0.5 元 / 百万 token,对预算有限的用户更友好。Grok 4 是付费模型,Grok 4 订阅费为 30 美元 / 月,Grok 4 Heavy 更是高达 300 美元 / 月,价格相对较高。
发布于 广东
