新浪AI前沿速递
2026-08-24 18:07来自 科技看点

国产大模型行业集体涨价的背后原因是什么?

  DeepSeek于8月17日落地国内大模型首个“峰谷分时计费”,旗舰模型V4-Pro高峰时段输出价从6元涨至27元/百万tokens、涨幅达350%,缓存命中输入价涨幅高达1100%,一周后又将周末全天统一按低谷价计费——这轮被业内视为“告别价格战”的调整,并非孤例:智谱年内三次提价、腾讯云连续两次涨价,国产大模型正集体走出“烧钱换规模”的阶段。

  一、算力供需失衡是涨价的直接推手

  调用量爆发式增长:DeepSeek V4-Flash上线两周内,OpenCode平台日token消耗从3万亿飙升至18万亿,占DeepSeek总调用量30%–50%,单日缺口近10T tokens,约需1000张B300 GPU承载,算力扩容速度远跟不上需求增速。

  硬件成本刚性上升:高端GPU与HBM采购价格持续飙升,电力与数据中心租赁费用居高不下;训练下一代模型与服务C端、B端用户争夺算力,“卡不够”成为普遍困境。

  供需潮汐错配:工作日白天办公时段调用集中,GPU集群负载拉满,夜间及周末大量算力闲置,资源利用率偏低,行业头部机房夜间闲置率普遍超40%。

  二、行业从“低价内卷”转向“价值定价”

  价格战难以为继:2024年以来各家靠融资补贴压低Token单价,部分轻量模型“近乎免费”,企业长期亏损运营,“有量无利”困境凸显;DeepSeek此前“卖得越多亏得越多”的矛盾全面激化。

  商业化进入正循环:峰谷定价以价差引导非实时任务错峰运行,提升GPU整体利用率,摊薄单Token硬件成本;厂商获得合理营收后,才有资金持续投入模型迭代与国产算力适配研发。

  竞争重心转移:行业不再单纯比拼单价,转向模型推理实力、智能体表现、服务稳定性、企业定制方案等综合维度,涨价后DeepSeek高峰价仍仅为GPT-5.6 Luna的约17%。

  三、DeepSeek峰谷调价方案与快速微调

  调价方案:8月17日0时起,工作日9:00–12:00、14:00–18:00划为高峰时段,其余为空闲时段且价格为高峰一半;V4-Pro高峰时段缓存命中输入、缓存未命中输入、输出价分别为0.3元、9元、27元/百万tokens,V4-Flash对应涨400%、200%、350%。

  快速微调:8月23日0时起,周末(周六、周日)全天不再区分峰谷,统一按低谷价计费,让开发者周末灵活安排业务,被市场解读为在涨价与生态黏性之间寻求平衡。

  普通用户不受影响:此次调价仅针对面向企业与开发者的API接口,网页端、App端日常对话保持免费,官方目前也没有面向个人用户的付费会员计划。