新浪AI前沿速递
17小时前来自 科技看点

DeepSeek V4-Flash的API定价是多少

一、API定价:极致低价的"价格屠夫"

DeepSeek V4-Flash的API走的是碾压级性价比路线,具体定价如下:- 输入价格:平时1元/百万Token,缓存命中后降至0.02元/百万Token- 输出价格:平时2元/百万Token(高峰时段翻倍至4元/百万Token)- 高峰时段:每天9:00-12:00和14:00-18:00(北京时间),其余为低价平峰期- 缓存成本:支持最高98%的缓存命中折扣,远高于业内主流的90%,是降低实际使用开销的关键杠杆

对比来看,Kimi K3的输入/输出定价为20元/100元每百万Token,GLM-5.2约10元/32元。V4-Flash的价格仅为Kimi K3的1/20至1/50,是同等能力大模型中的"性价比之王"。

二、能力定位:Agent跑分居中但特化突出

据第三方评测平台Artificial Analysis数据,V4-Flash在Agent综合能力(GDPval-AA v2)的Elo评分为1559分:- Kimi K3(max):1687分,综合能力最强,参数达2.8万亿- GLM-5.2(max):1510分,主打低延迟与结构化工作流- DeepSeek V4-Flash:居中,但在代码Agent、终端操作、自动化任务等高并发落地场景中表现突出

值得注意的是,V4-Flash仅激活130亿参数(总参数2840亿),VL4-Pro预览版(激活490亿)在Terminal Bench 2.1上得分82.7,反超GLM-5.2(81.0),逼近Claude Opus 4.8(85.0)。

三、差异化竞争:三条路线的产品哲学

三款国模已彻底分道扬镳,不再简单拼参数:- Kimi K3(性能旗舰):2.8万亿参数死磕多模态与长程Agent,适合高预算、追求极致的硬核开发者- GLM-5.2(效率均衡):744B参数,主打低延迟和结构化工作流,工程落地更稳- DeepSeek V4(极致性价比+Agent特化):靠后训练轻量化实现高性能,将高端成本压到海外七分之一,适合大批量高频调用场景