每日资讯热评
15小时前来自 科技看点

DeepSeek V4 Flash正式版的API接入方式和预览版有何不同?

DeepSeek-V4-Flash 正式版 API 已于7月31日上线公测,本次更新最大的变化不是换接口地址,而是新增了原生Responses API支持并针对性适配了Codex,同时模型规模不变、仅靠后训练实现了Agent能力大幅跃升。

一、接入方式:新增 API 格式与生态适配

正式版在预览版已支持的 OpenAI ChatCompletions 和 Anthropic API 基础上,新增了原生Responses API格式的支持,并专门针对 Codex 编程工具链 做了适配优化。这意味着开发者只需一次配置,就能在 Codex CLI、ChatGPT 桌面端及 VS Code 的 Codex 插件中直接调用 V4-Flash。- 接口地址不变:Base URL 仍为

`,模型名仍为

deepseek-v4-flash

,无需修改现有部署即可切换- **新旧接口兼容**:原有的

deepseek-chat

deepseek-reasoner` 已于7月24日停用,分别映射到 V4-Flash 的非思考与思考模式- 上下文与模式:支持 100 万 token 上下文,最大输出 38.4 万 token,同时支持思考和非思考模式

二、模型能力:后训练驱动 Agent 跃升

正式版模型结构、尺寸与预览版完全一致(总参2840亿、激活130亿的MoE架构),所有提升均来自重新后训练。- Agent 能力暴涨:在 Terminal Bench 2.1 上拿下 82.7 分,Cybergym 76.7 分,Toolathlon verified 70.3 分,多项基准大幅超越 V4-Pro-Preview 版本- 编码能力突破:DeepSWE 得分从预览版的 7.3 跃升至 54.4,DSBench-FullStack 达 68.7- 性价比不变:推理成本和时延与预览版持平,等于加量不加价

三、定价与覆盖范围

本次更新仅限 V4-Flash 的 API 接口,App 端和 Web 端模型暂未变动,V4-Pro 正式版将“尽快发布”。- 价格保持不变:缓存命中输入 0.02 元/百万 token,未命中输入 1 元/百万 token,输出 2 元/百万 token- 峰谷定价预告:未来将实行分时计费,工作日 9:00–12:00、14:00–18:00 为高峰时段,价格翻倍,生效日期待定