硬件演进簿
16小时前来自 科技看点

DeepSeek-V4-Flash的API定价具体是多少?

DeepSeek-V4-Flash正式版API于7月31日上线公测,其定价延续极致性价比路线——输入1元/输出2元每百万Token,缓存命中时更是低至0.02元/百万Token,且配合约98%的缓存命中折扣,综合调用成本比降价80%后的GPT-5.6 Luna还要低约60%。

一、API核心定价与缓存折扣细节

基础价格(缓存未命中):输入1元/百万Token,输出2元/百万Token,该价格与此前预览版保持一致,未因性能提升而涨价。

缓存命中价格:当请求命中缓存时,输入费用骤降至0.02元/百万Token,输出仍为2元/百万Token,实际输入成本可忽略不计。

折扣力度:DeepSeek自有API提供约98%的缓存命中折扣,远高于行业常见的90%折扣水平,这是其成本优势的核心来源。

美元计价参考:对应海外标准,每百万Token输入约0.14美元、输出约0.28美元,在同类高性能模型中处于最低档位。

二、峰谷定价机制与生效说明

定价策略:官方已预告将引入峰谷定价,高峰时段(每日9:00-12:00、14:00-18:00北京时间)价格翻倍。以Flash为例,缓存命中输入高峰0.04元/百万Token,缓存未命中输入高峰2元/百万Token,输出高峰4元/百万Token。

当前状态:峰谷定价尚未正式生效,实际调整前24小时会通过邮件通知用户,目前仍按统一价格计费。

适用对象:该定价策略同时适用于V4 Flash与V4 Pro,Pro版本平峰输出为6元/百万Token,高峰则升至12元/百万Token。

三、性价比对比:降维打击海外旗舰

与GPT-5.6 Luna对比:即使OpenAI已将Luna价格下调80%,DeepSeek V4 Flash的单任务成本仍比Luna低约60%,这主要得益于极高的缓存命中折扣。

与Claude Opus 4.8对比:输出价约为Opus 4.8的1/90,性能却已逼近该旗舰模型(Terminal Bench 2.1得分82.7 vs Opus 4.8的85.0),性价比极为突出。

与国内竞品对比:在Agent能力介于GLM-5.2与Kimi K3之间的定位下,定价却远低于后两者,为开发者提供了“够用且便宜”的最优解。