
DeepSeek V4-Flash逆袭:小模型反超Pro,价格仅0.28美元
DeepSeek在7月31日放出了今年最有分量的一次更新——V4‑Flash正式版(0731)API公测,模型架构和参数规模没变,但纯靠后训练让代码与智能体能力实现“突变式”跨越,多项评测反超自家体量更大的Pro预览版。

一、更新核心:轻量版Flash逆袭,Agent能力质变
后训练驱动:V4‑Flash正式版总参数和激活参数与4月的预览版完全一致(MoE架构,2840亿总参数/130亿激活参数),仅通过大幅优化后训练流程,重点强化了工具调用、多步骤任务执行等Agent方向。
基准全面超越:在TerminalBench、Cybergym、Toolathlon等九项Agent与代码评测中,V4‑Flash正式版全部超越自家1.6万亿参数的V4‑Pro预览版;其中在DeepSWE基准上分差高达41.6分,在ALE基准上距离顶尖闭源模型Claude Opus 4.8仅差半分。
“小模型”的逆袭:用Pro预览版六分之一的总参数和不到四分之一的激活参数,实现了对Pro预览版的大幅反超,打破业内“堆参数才能提性能”的固有认知。
二、技术亮点:开发原生适配与极致性价比
原生支持Responses API:首次适配Codex生态,开发者只需一次配置即可在Codex CLI、ChatGPT桌面端和VSCode Codex插件中直接调用V4‑Flash,极大降低了Agent和AI编程场景的集成门槛。
Pro版本将随后接入:当前Responses API仅对V4‑Flash开放,V4‑Pro预计8月初完成接入;App和Web端暂未变化,非开发者用户体验不变。
定价依旧“屠夫”:V4‑Flash每百万输出Token平时仅0.28美元,高峰期0.56美元,缓存命中时输入费用低至0.0028美元,远低于海外头部模型(如Fable5高达50美元)。
三、行业破局:从“算力竞赛”转向“效率竞争”
颠覆规模法则惯性:2026年以来,阿里Qwen 3.8‑Max、Kimi K3等模型纷纷冲上万亿参数,DeepSeek却用参数不变的Flash版本证明,后训练优化和工程创新同样能带来能力跃升。
Agent能力普惠化:V4‑Flash将前沿Agent能力以极低成本开放给中小开发者和创作者,意味着AI竞争正从“谁的参数多”转向“谁在真实场景中又好又便宜地干活”。
Pro正式版蓄势待发:官方表示V4‑Pro正式版(GA)将尽快上线,届时可能引入全新峰谷计费机制,与Flash形成高低搭配的完整产品矩阵。