
DeepSeek-V4-Flash正式版API的定价是多少?
一、定价明细:极致性价比的API价格体系
DeepSeek-V4-Flash正式版API于2026年7月31日上线公测,其定价延续了DeepSeek一贯的低价策略,具体价格如下:- 输入(缓存命中):0.02元/百万tokens,为所有场景中最低价格,适合高频重复调用任务- 输入(缓存未命中):1元/百万tokens,适用于普通推理请求- 输出:2元/百万tokens,仅为Pro版价格的三分之一左右- 对比海外竞品:GPT-5.6 Sol每百万tokens输入、缓存输入和输出分别为5美元、0.5美元和30美元,V4-Flash正式版在同等任务下成本低约数十倍到上百倍- 实测案例:有开发者使用V4-Flash执行本地文件阅读和全网信息检索任务,共消耗51万tokens,仅花费0.53元


二、性能对标:用极低成本追赶顶级模型
V4-Flash正式版在性能上实现了质的飞跃,其核心变化在于“更便宜还变强了”:- Agent能力暴涨:通过后训练优化,Agent智能体测试得分大幅提升,Terminal Bench 2.1达82.7分,逼近Opus-4.8的85.0分- 智能指数:在Artificial Analysis的AII智能指数测试中获50分,仅比GPT-5.6 Luna低1分,单任务成本却低约60%- 任务速度优势:相同任务下,V4-Flash+Hermes用时40秒,而GPT-5.6 Sol+Codex需1分47秒,速度优势明显- 差异化定位:综合实力介于GLM-5.2和Kimi K3之间,在终端操作、代码修复等高频落地场景优势突出
三、成本参考:开发者实际使用需关注的要点
尽管定价极具竞争力,但开发者在使用中需注意以下几点:- 峰谷定价机制:高峰时段(每日9:00-12:00和14:00-18:00)价格翻倍,V4-Flash高峰时段输出价为4元/百万tokens,缓存未命中输入价为2元/百万tokens- 缓存命中是关键:DeepSeek自有API提供约98%的缓存命中折扣,这是低成本的核心来源,但实际命中率取决于prompt前缀复用率,Agent多轮调用场景易吃满,一对一开放式对话则效果较差- 仅限API公测:本次升级仅针对API接口,网页端和App端暂未更新,普通C端用户无法直接体验新能力