新浪AI前沿速递
7-31 16:28来自 科技看点

DeepSeek V4 Flash正式版编码能力怎么样?

一、发布时间与核心升级点

上线时间:2026年7月31日,DeepSeek正式开启V4-Flash正式版API公测,模型版本号为DeepSeek-V4-Flash-0731。

升级方式:模型结构与总参284B/激活13B的MoE架构与4月发布的预览版完全一致,仅通过重新后训练(Post-Training)实现能力跃升。

升级范围:本次更新仅覆盖V4-Flash的API接口,App端、Web端及V4-Pro接口暂未变动,V4-Pro正式版将“尽快发布”。

二、编码与Agent能力的具体表现

基准测试成绩:正式版在Terminal Bench 2.1上得分82.7,大幅超越V4-Pro预览版的67.9(Terminal Bench 2.0);Toolathlon Verified达到70.3;内部全栈测试DSBench-FullStack和DSBench-Hard分别取得68.7和59.6。

跨模型对比:在Agent能力上,V4-Flash正式版已超过GLM-5.2(81.0),逼近Opus-4.8(85.0)。

实际编码体验:新版本针对Codex进行了原生适配,开发者可在Codex CLI、ChatGPT桌面端及VSCode插件中无缝调用,代码补全与错误修正逻辑显著提升。

三、开发友好性与性价比优势

接口兼容:正式版原生支持OpenAI Responses API格式,大幅降低迁移成本,开发者无需额外适配即可对接各类Agent开发框架。

上下文能力:支持100万token超长上下文,最大输出38.4万token,同时支持思考/非思考双模式切换。

定价策略:百万token输出平峰时段仅2元,非高峰时段缓存命中输入低至0.02元,堪称当前性价比最高的轻量化Agent开发模型。官方同时预告将引入峰谷定价机制,高峰时段价格翻倍。