
deepseek-v4-flash本地部署性能飙升,价格不变
2026年7月31日,DeepSeek正式上线了V4-Flash正式版API,这次升级没有改动模型架构,纯粹靠后训练就把Agent能力拉高了一大截,多项基准测试甚至超过了之前的V4-Pro预览版,而且价格依然保持白菜价。

一、后训练驱动能力跃升
V4-Flash-0731与预览版采用完全相同的模型结构(总参数284B、激活参数13B),提升全部来自重新后训练。官方公布的9项Agent基准测试成绩全面超过V4-Pro预览版:- 核心代码工程能力飙升:DeepSWE从7.3分飙升至54.4分,Terminal Bench 2.1从61.8提升至82.7,DSBench-FullStack从37.0涨至68.7- 综合智能水平超越前代:Artificial Analysis智能指数得分50分,较前代V4 Flash高出10分,比自家V4 Pro还高6分;综合得分仅比GPT-5.6 Luna低1分- 工具调用与自动化跃进:Cybergym得分76.7,Toolathlon Verified得分70.3,Agent能力在开放权重模型中位列第二

二、极致性价比定义“智能平权”
在性能大幅提升的同时,V4-Flash维持了极具竞争力的定价策略,被开发者誉为“性价比之王”:- API调用价格:输入1元/百万token,输出2元/百万token,输出价格仅为GPT-5.6 Luna的约1/4- 缓存优惠力度更大:缓存命中提供约98%折扣,高频调用场景成本极低;有开发者实测周消耗950M缓存仅需19元- 峰谷定价即将实施:官方预告将引入高峰时段(每日9:00-12:00、14:00-18:00)2倍定价机制
三、原生支持Responses API与Codex生态
本次正式版在开发者生态上做了关键布局,大幅降低接入门槛:- 接口兼容性提升:原生支持Responses API格式,并针对性适配Codex,开发者无需改代码即可将DeepSeek接入VS Code、Codex CLI等开发环境- 一键配置脚本:官方提供Mac和Windows一键配置脚本,切换到新版模型无需改动现有底层部署- 生态卡位意义:直接借道OpenAI的Codex生态,让更多开发者能以极低成本体验顶级Agent能力