代码浪潮记
2026-08-14 04:42来自 科技看点

DeepSeek涨价为什么缓存命中涨幅最大?

  DeepSeek刚官宣了8月17日生效的新API调价方案,其中缓存命中价格的涨幅最为惊人——Pro版本高峰期直接暴涨12倍,这背后是极低的原始定价、AI Agent场景对缓存的高度依赖以及引导用户错峰使用算力的三重逻辑在同时起作用。

  一、价格基数垫高倍数:原来实在太便宜

  绝对涨幅有限,相对倍数夸张:此前DeepSeek V4 Pro的缓存命中输入价格仅为0.025元/百万Tokens,Flash版本更是低至0.02元。新方案中,即使闲时价格也分别涨至0.15元和0.05元,涨幅分别达500%和150%。然而,这两个绝对值在当前行业中依然属于极低价位。

  海内外模型价格对标:涨价后的DeepSeek V4 Pro缓存命中价格(高峰0.30元,闲时0.15元),相比Anthropic的Claude Fable 5(输入10美元/百万Tokens,约72元)等海外旗舰模型,依然便宜一到两个数量级。其涨价节奏更多是对自身此前“地板价”的修正,而非对标海外高价。

  

  二、用户结构锚定涨幅:Agent场景高度依赖缓存

  高频应用以Agent为核心:当前DeepSeek V4 Flash的主要调用方是各类编程助手、任务机器人和业务流程Agent,这些场景典型特征是“高频重复、长上下文复用”。

  缓存命中率极高,直接决定成本敏感度:有开发者分享,Agent场景下缓存命中比例可高达90%甚至98%,输入和输出仅占很小部分。这意味着,缓存命中价格的小幅上调,会被这类高缓存命中率的应用成倍放大。例如,原本综合成本约0.05元/百万Tokens的Agent任务,新价格下成本飙升至约0.11元,翻了一倍多。

  三、算力引导转向多元化:让真正稀缺的资源回归合理价格

  挤压“伪需求”,释放算力给高价值调用:将原本极低的缓存命中价格大幅上调,可以有效减少那些“为省几毛钱无限刷缓存”的低价值调用,将算力释放给对实时性、准确性要求更高的无缓存推理任务。

  峰谷定价强调错峰使用:新方案还引入“闲时/高峰”峰谷定价,高峰时段价格是闲时的2倍。这让对成本极其敏感的Agent开发者有动力将批量任务调度至深夜或周末,从而主动释放白天的算力压力,实现资源供需的自我平衡。