新品实测拆解
18小时前来自 科技看点

DeepSeek-V4-Flash正式版有哪些技术突破?

就在马斯克悄然关注DeepSeek X账号的同一天,DeepSeek-V4-Flash正式版API上线公测,凭借纯靠后训练“榨”出的脱胎换骨式Agent能力,以及让海外巨头连夜降价的极致性价比,瞬间引爆全球AI圈。

一、Agent能力:模型架构未动,后训练“榨”出翻倍表现

此次Flash正式版(版本号V4-Flash-0731)模型结构与预览版完全一致,总参数2840亿、激活参数130亿,架构没变,性能跃升全部来自后训练优化。- 基准测试全面反超V4-Pro预览版:在9项Agent测试中全部胜出自家Pro预览版,其中Terminal Bench 2.1从61.8分飙升至82.7分,DeepSWE代码修复任务从7.3分暴涨至54.4分,DSBench-FullStack全栈开发从37.0分升至68.7分。- 逼近顶级闭源模型:Agent终极测试得分25.2分,接近Opus-4.8的25.7分。这意味着它已具备独立规划、调用工具、反馈纠错的长链条自主执行能力。

二、后训练奇迹:同样的“骨架”,换一套“脑子”

DeepSeek官方明确,本次升级没有修改模型尺寸或MoE架构,仅重新进行了后训练(Post-Training)。- 技术路径的颠覆:过去行业默认模型性能靠堆参数和算力,而Flash正式版证明了“精调”的杠杆效应远超预期,训练方法和数据质量的权重正在上升。- 实际体感验证:有开发者将此前V4-Pro预览版反复修改仍无法解决的三维问题交给Flash正式版,结果一次改对;还有用户接入Codex后,10分钟解决了GPT-5.6 Sol折腾一小时未果的苹果小程序支付bug,账单仅8元多。

三、生态接入与极致性价比:拉低AI使用门槛

原生适配Codex:正式版原生支持OpenAI Responses API格式,针对性适配Codex CLI、VS Code插件等生态,开发者不改Base URL即可一键接入,官方还提供了Mac/Windows一键配置脚本。

价格是“斩杀线”级别:API价格维持输入1元/百万token、输出2元,缓存命中价更低。Artificial Analysis评测显示,同等任务下DeepSeek V4 Flash的完成成本仅为GPT-5.6 Luna的约三分之一甚至更低。

实际调用成本震撼:有AI产品负责人反馈,同样的长任务此前用Kimi K3花了200多元,用V4 Flash只花了3.67元。这种“中上性能+白菜价”的模式被业界称为“智能平权”——让低预算团队也能大规模落地AI智能体。