
DeepSeek-V4-Flash正式版定价真的只要1元/百万token吗?
一、性能飙升:轻量模型展现“狂暴”后训练潜力
Agent能力飞跃:在保持284B总参/13B激活的MoE架构不变的前提下,仅通过重新后训优化,V4-Flash正式版的Agent能力实现“狂暴”提升。 在Agent智能体终极测试中得分25.2,逼近Opus-4.8的25.7分,远超自身V4 Pro预览版的15.8分。
核心跑分抢眼:Terminal Bench 2.1得分82.7,超越智谱GLM-5.2;代表软件工程能力的DeepSWE得分从预览版的7.3暴涨至54.4,提升超7倍。 在AII智能指数中获得50分,仅比GPT-5.6 Luna低1分。
前端代码表现出色:在Frontend Code Arena中获得1586分,与GLM-5.2 Max(1587分)几乎打平,跻身开放类别排名第3。

二、极致性价比:1元/百万token输入定价实锤
定价全面确认:V4-Flash正式版API定价确为输入1元/百万token、输出2元/百万token(人民币)。 缓存命中价格更是低至0.02元/百万token。
成本碾压竞品:与降价后的GPT-5.6 Luna相比,V4-Flash的单任务成本仍低约60%。 有开发者实测,执行51万token的复杂任务(含本地文件阅读与全网信息检索),消耗仅0.53元。
全球市场份额验证:OpenRouter最新数据表明,中国AI大模型周调用量领跑全球,中国模型市场份额已达63.5%,DeepSeek的极致定价策略是核心驱动力之一。

三、战略转向:从“卷参数”到“卷Agent与生态”
聚焦Agent实际效能:模型不再仅追求聊天能力,而是通过专项优化,强化终端操作、工具调用、代码自动化等“实际干活”能力,让AI从“能聊天”转向“能完成一个任务”。
开发者生态深度绑定:原生支持Responses API格式,并针对Codex进行完美适配,降低了开发者的迁移和接入门槛。
未来竞争指向Harness:DeepSeek Harness即将公布,这是让模型在复杂场景中稳定执行长程任务的“基础设施”,也是下一阶段AI竞争的制高点。