光电万象笺
昨天 15:36来自 科技看点

DeepSeek-V4-Flash的推理速度和其他模型相比如何?

DeepSeek V4 Flash正式版跑分出炉了,综合智能指数飙到50分,只差GPT-5.6 Luna 1分,推理速度更是碾压级——实测一套Agent任务只用40秒,而GPT-5.6 Sol跑了1分47秒。

一、实战任务速度:V4 Flash比GPT快2.6倍

同任务实测:AI开发者张泽将V4 Flash正式版接入Hermes使用,在给到相同任务和提示词的情况下,V4 Flash正式版组合耗时约40秒,而GPT-5.6 Sol加Codex耗时1分47秒,V4 Flash速度快了约2.6倍

输出质量:开发者承认Codex的输出内容质量确实更高,但V4 Flash的交付也达到了可用水平,在及格线之上

Agent能力提升:这种速度优势主要归功于后训练对Agent能力的全面增强,模型在工具调用、任务规划等环节的决策效率大幅提升

二、基准测评:成本仅为GPT-5.6 Luna的40%

智能指数对比:在Artificial Analysis智能指数评测中,V4 Flash正式版以50分位居162个模型中第2,与Gemini 3.6 Flash持平,仅比GPT-5.6 Luna的51分低1分

单任务成本:即使OpenAI已宣布GPT-5.6 Luna降价80%,V4 Flash的单任务成本仍比Luna低约60%

价格明细:V4 Flash输出价格为2元/百万Token,输入缓存命中仅0.02元/百万Token;而GPT-5.6 Luna即使降价后,输出价约合1.2美元,仍是Flash的4倍多

三、技术路线:纯后训练榨干架构潜力

零架构改动:模型保持284B总参数、13B激活参数的MoE架构不变,完全通过重新后训练实现能力跃升

Agent专项突破:9项Agent基准测试全部超越自家V4 Pro预览版,其中DeepSWE从7.3分暴增至54.4分,涨幅超6倍

生态兼容:原生支持Responses API格式并针对Codex完成适配,开发者切换到正式版只需修改API配置中的模型名