DeepSeek API调价方案公布:V4-Pro高峰输出27元/百万Token、缓存命中涨12倍,开发者还值得用吗?
DeepSeek API调价方案落地:8月17日零时起,V4-Pro高峰输出涨至27元/百万Token,较原价6元上涨350%,缓存命中输入为原价12倍,开发者需重算成本。
8月13日,深度求索通过官方公告发布DeepSeek API调价方案,同步上线deepseek-v4-pro正式版。[1]新价格采用峰谷分时计费:高峰时段为北京时间9:00-12:00、14:00-18:00,其余为空闲时段,闲时价格为高峰时段价格的一半。[2]本次调价影响的是API开发者,普通App、网页端对话用户暂不受直接影响。
据科创板日报报道,DeepSeek发布的API调价公告显示,deepseek-v4-pro高峰时段百万Token输出最高价格达27元;科技媒体爱范儿则指出,本次调价最高涨幅为12倍,出现在deepseek-v4-pro高峰时段的“输入(缓存命中)”。[2]
DeepSeek调价方案公布:API实际涨了多少?
结论:V4-Pro和V4-Flash全线上涨。要理解涨幅,先记住旧价格:deepseek-v4-pro缓存命中输入0.025元/百万Token、缓存未命中输入3元/百万Token、输出6元/百万Token;deepseek-v4-flash缓存命中输入0.02元/百万Token、缓存未命中输入1元/百万Token、输出2元/百万Token。上述基准自2026年5月23日调价后维持至今。[1]
| 模型 | 时段 | 输入(缓存命中) | 输入(缓存未命中) | 输出 | 相对原价倍率 |
|---|---|---|---|---|---|
| deepseek-v4-pro | 高峰 | 0.30元(12倍) | 9元(3倍) | 27元(4.5倍) | 缓存命中输入涨幅最大 |
| deepseek-v4-pro | 空闲 | 0.15元(6倍) | 4.5元(1.5倍) | 13.5元(2.25倍) | 闲时仍高于原价 |
| deepseek-v4-flash | 高峰 | 0.10元(5倍) | 3元(3倍) | 9元(4.5倍) | 输出涨幅350% |
| deepseek-v4-flash | 空闲 | 0.05元(2.5倍) | 1.5元(1.5倍) | 4.5元(2.25倍) | 整体仍高于原价 |
从价格配置看,新方案相当于把原价整体抬升后,再叠加峰谷系数。V4-Pro高峰输出27元/百万Token是原价4.5倍,闲时13.5元也是原价2.25倍;V4-Flash高峰输出9元/百万Token是原价4.5倍,闲时4.5元是原价2.25倍。也就是说,即使完全错峰,成本也回不到调价前。
性能、缓存与场景:这轮涨价主要影响哪类调用?
结论:模型能力没有变,缓存命中价格大幅上涨,受影响最大的是Agent类、高缓存命中率和白天高峰调用的场景。
如果把大模型API比作数码产品,模型能力相当于处理器,上下文长度相当于屏幕尺寸,缓存机制相当于续航和快充方案。这次调价没有改变处理器和屏幕,但把“续航包”和“快充包”重新定价了。
据公开信息,deepseek-v4-pro和deepseek-v4-flash均支持百万级超长上下文,也兼容OpenAI、Anthropic两种调用格式。[2]所谓缓存命中,指相同前缀、系统提示词或工具定义被重复调用时直接读取缓存,不重新计算。缓存命中输入一直是很便宜的部分,这次涨幅反而最大:V4-Pro从0.025元涨到高峰0.30元,为原价12倍;V4-Flash从0.02元涨到高峰0.10元,为原价5倍。
实际成本增加可以用三个场景观察:
- 轻量级开发者:每月调用500万Token输出,全部使用V4-Flash且避开高峰,月成本从约300元增至约450元,涨幅50%;若无法错峰,成本可能超过600元/月。
- 重度开发者:每月调用5000万Token输出,V4-Flash日常成本约3000元/月,调价后闲时约4500元,高峰时可达9000元以上,每月新增支出最高约6000元。
- 高负载Agent场景:按典型的“98%缓存命中+1%普通输入+1%输出”调用结构测算,100单位Token总成本从0.0496元升至0.109元,上涨约119.8%。
需要说明的是,上述第三个场景是有开发者基于V4-Flash闲时价格测算的,并非官方数据;不同应用的缓存命中率和输入输出占比差异很大,实际涨幅需按自身用量重新估算。
这轮调价有什么优缺点?Pro和Flash分别适合谁?
结论:优点是计费规则更清晰、闲时半价;缺点是绝对涨幅大,缓存命中输入价格涨幅过高。
产品对比表
| 产品/型号 | 价格/定位 | 核心配置 | 优势 | 短板 | 适合谁 | 注意点 |
|---|---|---|---|---|---|---|
| deepseek-v4-pro | 旗舰模型;高峰输出27元/百万Token,闲时13.5元 | 百万级超长上下文;兼容OpenAI、Anthropic格式;8月13日上线正式版 | 推理能力强,适合复杂任务;官方主推的新一代旗舰 | 缓存命中输入为原价12倍;高峰输出为原价4.5倍;重度使用成本高 | 预算充足、对模型能力要求高的企业和专业开发者 | 尽量把批量任务放到闲时;关注缓存命中计费 |
| deepseek-v4-flash | 轻量/高频模型;高峰输出9元/百万Token,闲时4.5元 | 百万级超长上下文;兼容OpenAI、Anthropic格式;面向高频调用 | 绝对单价比Pro低;适合批量处理、普通对话、信息抽取 | 高峰输出为原价4.5倍;大规模调用总成本增加明显 | 个人开发者、中小团队、非实时任务 | 错峰调用;设计好缓存前缀以提升命中率 |
从“适合谁”的角度看,V4-Pro更像“旗舰手机”,性能强但价格高;V4-Flash更像“实用中端机”,性价比更高,但高峰时段使用仍需谨慎。如果你的应用以实时交互为主、无法容忍延迟,那么错峰方案有限,成本压力会更直接。
为什么DeepSeek突然大幅涨价?
结论:官方给出的原因是需求爆发与算力成本承压;行业层面则是从价格战转向商业化变现。
据群众新闻网报道,DeepSeek在回应涨价原因时表示,AI应用尤其是智能体爆发,单任务Token消耗是传统对话AI的百倍以上;国内日均Token调用量已达140万亿,较2024年初增长超千倍。高端AI芯片产能受限、供应紧张,供应链成本上涨,算力资源跟不上Token需求。[3]
官方回应:需求爆炸式增长,供给与成本承压,行业竞争回归理性。
此前DeepSeek长期执行低价策略,帮助其快速积累开发者生态并登顶全球调用量第一;融资后公司进入商业化阶段,需要改善盈利模型。从行业看,DeepSeek不是第一家涨价的大模型厂商。据市场观点,智谱、月之暗面、阿里、百度今年都调整过价格;腾讯云2026年不到一个月内连续两次涨价。[3]这被普遍视为国产大模型告别“烧钱换市场”、转向“价值变现”的信号。
舆论场也有分歧。科创板日报第一时间披露价格表;爱范儿用“大涨价”形容;有开发者认为“靠爱发电的时代已经结束”;也有网友直言“大量调用的话真用不起了”。截至发稿(2026年8月14日),DeepSeek官方尚未公布后续是否会推出套餐、订阅制或开发者补贴,相关内容需以官方实时信息为准。
API涨价后,开发者应该怎么应对?
结论:先算账,再错峰,善用缓存和混合部署。
建议采取五步操作:
- 成本重估:在8月17日零时前,从DeepSeek开放平台导出近期账单,把高峰时段和空闲时段用量拆开,按新价格重新估算月度成本。
- 错峰调度:将批量任务、数据分析、离线推理放到18:00至次日9:00执行,闲时价格为高峰一半。
- 缓存优化:固定系统提示词、常用前缀和工具定义,尽量提升缓存命中率;但要注意,缓存命中输入价格本次涨幅最高,不能只看绝对单价低。
- 模型分级:简单任务用V4-Flash或开源模型,复杂任务才调用V4-Pro。
- 混合部署:对成本敏感、数据合规要求高的场景,可考虑本地部署/开源模型,配合商用API兜底。
从购买角度看,V4-Pro更适合预算充足、对输出质量有高要求的专业团队;V4-Flash更适合个人开发者和中小团队,但需要尽量错峰。不要把“闲时半价”误以为“回到原价”——闲时价格仍然高于调价前,只是比高峰低。最终费用以DeepSeek开放平台实时计费为准。
QA:关于DeepSeek调价方案,你可能还想问
Q1:DeepSeek调价后API使用成本增加了多少?
以V4-Pro为例,高峰输出从6元涨至27元/百万Token,涨幅350%;缓存命中输入从0.025元涨至0.30元,为原价12倍。V4-Flash高峰输出从2元涨至9元,涨幅350%。若全部错峰使用Flash,500万Token输出月成本约从300元增至450元,涨幅50%;高缓存命中Agent场景综合成本约翻倍。
Q2:DeepSeek调价方案什么时候生效?高峰时段是几点?
新价格于2026年8月17日00:00(北京时间)生效。高峰时段为每天9:00-12:00和14:00-18:00,其余为空闲时段,闲时价格为高峰价格的一半。
Q3:DeepSeek涨价后,普通用户用App会受影响吗?
直接受影响的是API开发者,普通App/网页端对话用户暂时没有面临涨价。开发者可通过闲时调用、提高缓存命中率、混合部署等方式降低成本。具体价格以DeepSeek开放平台实时页面为准。
#DeepSeek调价方案# #DeepSeek涨价# #API定价# #大模型商业化# #V4-Pro#