
DeepSeek的API价格现在是多少?
DeepSeek不仅把Token价格打下来了,而且直接打到了全球地板价——其V4系列旗舰模型API的缓存命中输入价格低至0.025元/百万Token,相当于处理百万字的成本只要2分5厘,远低于任何国际竞品。
一、当前DeepSeek API价格一览
截至2026年8月3日,DeepSeek V4系列API定价分为两档,同时引入了峰谷计费机制:
V4-Pro(旗舰级)- 输入(缓存命中):平时0.025元/百万Token,高峰0.05元- 输入(缓存未命中):平时3元/百万Token,高峰6元- 输出:平时6元/百万Token,高峰12元
V4-Flash(性价比型)- 输入(缓存命中):平时0.02元/百万Token,高峰0.04元- 输入(缓存未命中):平时1元/百万Token,高峰2元- 输出:平时2元/百万Token,高峰4元
高峰时段为工作日9:00-12:00和14:00-18:00
二、DeepSeek如何把价格打下来的
DeepSeek的低价并非补贴,而是技术创新的结果:
极致工程优化:采用混合注意力机制和Multi-Token预测,长对话缓存命中率可达到90%以上
国产芯片适配:DeepSeek V4已与华为昇腾等国产AI芯片深度适配,不再依赖英伟达GPU,推理成本进一步压缩
架构降本:V4在架构上显著转向推理优化,如1M超长上下文、KV Cache优化、FP4精度支持,单位Token推理成本大幅降低
即使OpenAI紧急将GPT-5.6 Luna降价80%,DeepSeek V4 Flash自有的单任务成本仍比Luna低约60%。在OpenRouter平台上,DeepSeek V4 Flash已连续多周登顶调用量榜首。


三、价格战的可持续性
永久降价而非促销:DeepSeek已将原定限时2.5折优惠转为永久定价,V4-Pro输出价从原24元/百万Token降至6元
峰谷定价引导算力分配:高峰时段价格翻倍,缓存命中价格极低,通过价格信号引导非紧急任务错峰运行
行业影响:DeepSeek的低价策略已倒逼OpenAI等巨头跟进降价,全球AI定价体系正在被重塑