DeepSeek为何要引入峰谷定价机制?
一、峰谷定价的核心规则与落地时间
时段划分:每日北京时间9:00-12:00、14:00-18:00为高峰时段,其余均为空闲时段,闲时价格仅为高峰的一半。
生效节点:新方案于2026年8月17日0时正式执行,覆盖V4-Pro与V4-Flash两款主力模型。
周末优化:8月23日起,周末全天不再区分峰谷,统一按低谷价计费。
价格对比:V4-Pro高峰输出27元/百万tokens,谷时13.5元;缓存命中输入价差最高达上百倍,引导开发者优化调用模式。
二、DeepSeek为何引入峰谷定价
算力潮汐错配:AI算力与电力相似,日间企业办公时段调用集中,GPU集群负载拉满,夜间与周末大量高端算力闲置空转,资源利用率偏低。
削峰填谷:通过市场化价格信号,引导非实时、可错峰任务分流至闲时,系统性提升算力整体利用效率,缓解高峰期的响应延迟与限流卡顿。
商业化修复:此前长期低价补贴难以为继,算力硬件、电力、运维成本居高不下,行业陷入“有量无利”困境,峰谷定价是告别低价内卷、走向“按价值定价”的关键转折。
三、涨价背后的真实压力与行业信号
需求激增:OpenCode等渠道反映DeepSeek V4-Flash日Token使用量两周内从3万亿暴涨至18万亿,平台算力承压明显。
成本攀升:高端GPU供不应求、交付周期拉长,推理算力紧缺推动硬件与电力成本持续上涨。
行业共振:智谱AI年内三次上调API价格,腾讯云连续两次调价,阿里云、百度智能云也相继跟进——大模型行业正集体从“低价换市场”转向“价值定价”。
四、峰谷定价对用户与产业的影响
开发者成本:实时业务难以错峰,高峰调用成本直接上升;离线批量任务挪至夜间可省一半费用,错峰调用成为新技能。
普通用户:App端日常使用基本不受影响,但依赖API的第三方AI工具可能提价。
产业趋势:算力精细化运营料成常态,分时计费有望在更多国产大模型厂商中普及,AI基础设施正走向“水电煤”式的规范化经营。