新浪AI前沿速递
2026-08-24 17:36来自 科技看点

用户如何利用周末低谷价节省费用?

  DeepSeek自2026年8月23日零时起,在周末全天统一按低谷时段价格计费,不再区分峰谷,开发者趁周末跑批量任务,最高可省一半的API调用成本。

  一、周末调价的核心规则与价格对比

  计费机制:工作日(周一至周五)仍维持原有峰谷两档定价,高峰时段为北京时间9:00-12:00、14:00-18:00,空闲时段价格为高峰的一半;周末(周六、周日)全天统一按低谷时段价格收取,不再分峰谷。

  价格实例:以旗舰模型DeepSeek-V4-Pro为例,高峰时段每百万tokens输出27元、低谷时段13.5元,意味着周末全天调用输出价格直接砍半;输入(缓存未命中)亦从高峰9元降至低谷4.5元,缓存命中输入低至0.15元。

  生效时间:新规自2026年8月23日(周日)00:00起生效,此前产生的费用仍按原规则结算,系统自动按新标准计费,无需手动操作。

  二、用户如何利用周末低谷价节省费用

  批量任务集中投放:将数据清洗、离线评测、批量总结、模型微调等非实时任务全部挪到周末执行,直接享受最低价档,成本最高可降50%。

  优化缓存命中率:把高频重复的System Prompt、工具定义固定下来,缓存命中输入仅0.02元/百万Tokens(V4-Flash),比未命中(1元)便宜50倍,结合周末低价可再大幅压降成本。

  按任务分级选模型:简单任务(如分类、信息抽取)用V4-Flash,复杂推理(如数学、逻辑分析)用V4-Pro,避免一刀切调用旗舰模型造成算力浪费。

  错峰开发调试:开发者可在周末进行Agent调试、数据集处理等重负载开发工作,工作日则专注于实时交互业务,实现成本与效率的最优配比。

  三、调价背后的逻辑与行业信号

  平衡算力负载:官方明确表示,此举旨在让用户在周末更灵活安排业务、不用担心高峰成本,同时有助于平衡全网算力负载、提升服务稳定性。此前V4-Flash因访问量过大一度出现容量不足,单日Token消耗量高达8万亿。

  行业集体转向:从2025年底到2026年,阿里云、腾讯云、百度智能云、智谱AI等头部厂商已集体调价,腾讯云连续两次涨价,智谱AI年内三次上调API价格,行业正从“低价换市场”转向“价值定价”。

  算力成本传导:高端AI芯片产能受限、供应链成本持续上涨,算力成本占总成本比例已从2024年的35%升至2026年的62%,涨价是厂商向市场传导真实成本压力的必然步骤。摩根士丹利研报显示,2026年Q2中国大模型平均API输入价格已升至4.9元/百万Token,较2025年Q1上涨约48%。