科技简览
2026-08-14 05:18来自 科技看点

DeepSeek V4 Pro调价方案发布:高峰时段输出涨350%至27元/百万Token,性能跳升能否撑起高价?

  8月13日,DeepSeek在发布V4 Pro正式版后公布调价方案:高峰时段输出价格从此前每百万Token 6元涨至27元,涨幅高达350%[3];输入价格从3元涨至9元,涨幅200%;缓存命中输入价格从0.025元涨至0.3元,涨幅达1100%。新方案将于8月17日0时正式生效,并首次引入峰谷分时定价机制。

  8月12日晚间,DeepSeek通过API文档页面静默上线了正式版模型DeepSeek-V4-Pro-0813,调用方式不变,模型接入名称仍为deepseek-v4-pro[2]。8月13日,调价方案随之公布,涉及V4 Pro与V4 Flash两套主力模型。事实上,DeepSeek早在8月6日就已发布公告,称“计划近期整体上调API服务定价,预计涨幅较大”——从预告到落地,仅隔一周。

  一边是DeepSWE编程基准从预览版12.8分暴涨到62.7分,一边是高峰时段最高350%的涨幅。DeepSeek V4 Pro的这轮“能力加价”,本质上是在回答一个问题:当模型从“会聊天”进化为“能干活”,它的定价锚点是否也该换了?

  DeepSeek V4 Pro为什么突然涨价?涨幅到底有多大?

  先给结论:涨价是算力成本与能力升级双重因素叠加的结果,不是营销行为。V4 Pro正式版把重心从通用对话转向Agent与编程场景,模型开始承担真实工作流中的交付任务,这类任务的调用强度和算力消耗远高于普通对话。高并发场景下,算力资源稀缺直接传导为API定价上调。

  从时间线看,这次涨价经历了完整铺垫:4月25日,DeepSeek曾推出缓存命中输入限时2.5折优惠;5月23日,宣布优惠结束后正式调整为原价四分之一[6]。6月底,官方通过邮件披露V4正式版计划7月中旬上线。8月6日,公开发布涨价预警。8月12日晚,V4 Pro正式版上线。8月13日,具体调价方案公布。

  结合22世纪经济报道获取的官方价格表,本轮调整以峰谷分时计费为核心:工作日9:00—12:00和14:00—18:00为高峰时段,价格翻倍;夜间、周末和节假日保持平峰低价[3]。具体来看:

  • V4 Pro高峰时段:缓存命中输入0.3元/百万Token,输入9元/百万Token,输出27元/百万Token。相较此前(0.025元/3元/6元),涨幅分别为1100%、200%、350%[3]
  • V4 Pro空闲时段:输入4.5元/百万Token,输出13.5元/百万Token,涨幅分别为50%和125%,综合使用成本约翻倍[4]
  • V4 Flash价格同步上调:空闲时段输入从1元涨至1.5元,输出从2元涨至4.5元;高峰时段输入3元、输出9元[3]

  值得注意的是,V4 Pro定价仍大幅低于国际同行。据多个信源交叉验证,即使涨价后,V4 Pro高峰时段输出价格也仅为Anthropic Claude Fable 5的约1/57,并与智谱GLM-5.2持平[6]。这意味着,DeepSeek的“大幅涨价”在国内市场看是接近天花板的定价,放到全球仍是低门槛价。

  V4 Pro性能提升能支撑涨价吗?与Claude竞品差多少?

  先给结论:从Agent编程和工具调用能力看,V4 Pro正式版完成了从“能用”到“好用”的关键跨越,性能提升基本能支撑这轮涨价。

  DeepSeek官方公布的评测数据显示,V4 Pro正式版通过纯后训练优化,在不改动模型架构和参数规模的前提下,实现了能力重心的根本性转移[1]。DeepSWE编程基准从预览版12.8分提升至62.7分,涨幅接近4倍;NL2Repo从38.5分提升到61.5分;DSBench-Hard分数翻了一倍多[2]。有分析指出,这不是普通的调参优化,而是Agent真正开始理解任务拆解、工具调用和完整交付流程[1]

  与Anthropic旗舰模型对比,V4 Pro正式版在多项测试中已经进入同一梯队:

  • Terminal Bench 2.1:DeepSeek V4 Pro得分为87.9,Claude Fable 5为88.0,仅差0.1分[4]
  • CyberGym:V4 Pro得分83.3,超过Fable 5的83.1[2]
  • 与Claude Opus 4.8对比:在11项Agent基准测试中,V4 Pro取得5胜5负1平的成绩;Artificial Analysis的Intelligence Index仅落后4分[4]

  在长上下文能力上,V4 Pro支持100万Token上下文和最大38.4万Token输出,可以直接处理大型代码仓库甚至整本图书级内容[5]。同时,V4 Pro提供三档推理模式,并兼容OpenAI与Anthropic两种API调用格式,可无缝导入Codex和Claude Code生态[2]。这些能力组合意味着,V4 Pro不再只是一个“回答问题的机器人”,而是能独立完成完整PR提交或跨文件代码修改的“数字协作者”[1],其商业价值锚点已经完全不同。

  调价后开发者应该升级V4 Pro还是继续用Flash?

  先给结论:没有统一答案,按任务价值分场景选择最优解。对于长链路Coding Agent、跨文件大规模代码改动、深度研究等复杂任务,V4 Pro的能力溢价完全值得多付3倍价格;对于高频跑量、轻量级编程和普通对话类应用,V4 Flash仍是更经济的选择[8]

  从并发限制来看,V4 Pro的并发上限为500,而V4 Flash为2500,两者定位差异很明显[2]。V4 Flash适合处理大量短任务,代价是单次能力上限较低;V4 Pro则为真正的Agent任务设计,适合需要深度推理、多轮工具调用和长上下文理解的工作流。

  具体成本测算:假设一个重度Agent应用日均消耗1亿Token输出,使用V4 Pro高峰时段价格(27元/百万Token),单日成本为2700元;使用V4 Flash高峰时段价格(9元/百万Token),单日成本为900元。如果该Agent任务每月能为团队节省约30人日的开发工时(按综合人力成本10万元/月估算),那么高出约5万元的月成本,依然算得过来账。反过来,如果应用只是做Text-to-SQL或代码补全,用V4 Flash即可满足需求,升级Pro只会增加无谓成本。

  对于已经接入API的开发者,有一个现实提醒:官方已明确预告“近期整体上调API定价,且涨幅较大”,目前公开的价格处于窗口期[2]。在8月17日新方案生效前,建议按自身用量提前做好预算规划。

  技术要点表

技术/产品核心指标应用场景影响对象限制条件信息来源
DeepSeek V4 Pro正式版DeepSWE 62.7(预览版12.8);Terminal Bench 87.9;CyberGym 83.3;100万Token上下文;最大输出384K长链路Coding Agent、跨文件改动、深度研究、Agent工作流企业AI团队、独立开发者、Agent产品供应商并发限制500;高峰时段价格已上涨极客安迪Geeker[2];金河落九天[4]
DeepSeek V4 Flash高峰时段输入3元/输出9元/百万Token;并发2500高频轻量任务、普通对话、代码补全、短链路Agent中小开发者、大规模API调用方单次推理能力上限低于Pro21世纪经济报道[3]
Anthropic Claude Fable 5Terminal Bench 88.0;CyberGym 83.1国际高端Agent与商业化场景全球开发者、跨国企业价格约为DeepSeek V4 Pro的57倍极客安迪Geeker[2];金河落九天[4]
Claude Opus 4.811项Agent对比测试与V4 Pro互有胜负;Intelligence Index领先4分高复杂度Agent任务、企业级自动化Agent重度用户基础能力互有高低,定价更高金河落九天[4]
智谱GLM-5.2API高峰时段价格与V4 Pro持平国内企业级模型调用国内AI应用开发商具体能力对标数据尚未公布21世纪经济报道[3]

  DeepSeek带头涨价,国产大模型价格战迎来拐点了吗?

  先给结论:价格战不会一夜结束,但定价逻辑正在从“烧钱获客”转向“性能变现”。DeepSeek这轮调价的真正信号,不是“涨价”本身,而是“敢在能力跃升后涨价”。

  回顾2026年至今的国内大模型定价走势:4月底,DeepSeek主动降价,推出缓存命中2.5折优惠;5月底,又将正式调价降至原价的四分之一,V4 Flash输出价格一度低至2元/百万Token[6]。随后小米MiMo-V2.5系列宣布永久降价,最高降幅达99%,价格战进入白热化[6]。而如今,DeepSeek率先扭转方向,将旗舰产品的价格大幅上调,说明头部厂商开始用“能力分层”替代“绝对低价”作为竞争武器。

  从行业规律看,基础模型市场正在经历类似云计算的演变路径——早期用低价换客户,中期按性能和服务等级分层定价,后期形成稳定价格体系。DeepSeek V4 Pro涨价的同时,V4 Flash仍保持相对低价,两者形成“旗舰溢价+流量平价”的组合策略。这种梯次定价,既能承接高端Agent需求,又不会丢掉轻量高频的开发者基本盘。

  另一个值得关注的信号是DeepSeek Harness(DSH)的推进。官方在测试V4 Pro时使用了“DeepSeek Harness极简模式”,这一框架与Claude Code、Codex、智谱Z Code属于同类产品[4]。这暗示DeepSeek的布局不只在模型层,还在向Agent工具链和开发环境延伸。一旦DSH成熟,DeepSeek将从“卖模型”进化为“卖工具链”,届时定价话语权会更加强大。

  DeepSeek V4 Pro涨价背后,还有哪些深层变量与不确定性?

  先给结论:价格能从市场角度被接受,不代表产品风险完全消除。DeepSeek仍面临权重开源承诺、算力供给稳定性、工具链成熟度三方面未知数。

  首先是开源边界。截至8月14日,HuggingFace上尚未看到DeepSeek-V4-Pro-0813的独立权重文件,“API可用”不完全等同于“权重已开源”[2]。对于依赖自托管模型的企业用户,这可能是比涨价更关键的决策因素。

  其次是算力压力。据多家媒体报道,全球调用量最高的V4 Flash曾因访问量暴增出现过容量不足的情况[7]。V4 Pro正式版上线后大量新用户涌入,如果算力跟不上,价格涨了但服务质量不稳定,反而会引发开发者流失。峰谷定价机制本身就是为了削峰填谷、缓解高峰算力压力,但实际效果还需要上线后验证。

  第三是评测数据的第三方验证。当前主流对比数据来自DeepSeek官方公布和部分第三方测评,多数基准测试仍处于“开发者自测+社区讨论”阶段[2]。Agent能力的真实表现高度依赖具体任务场景,官方跑分高与实际工程落地之间可能存在落差。

  后续关注什么?

  8月17日新价格生效初期,需重点观察开发者调用量变化和API稳定性;V4 Pro的权重是否开源、何时开源,是影响企业采购决策的核心变量;DeepSeek Harness正式版发布后,能否建立类似Claude Code的开发者生态;以及国内其他厂商是否会跟进DeepSeek的“性能涨价”节奏。

  常见问题解答

  问:DeepSeek V4 Pro涨价后到底多少钱?

  答:8月17日起,高峰时段(工作日9:00-12:00和14:00-18:00)每百万Token输出价27元、输入价9元、缓存命中输入价0.3元;空闲时段价格约为高峰一半,即输出13.5元、输入4.5元。涨幅最高达1100%[3]

  问:现在应该升级DeepSeek V4 Pro吗?

  答:取决于任务类型。复杂Agent任务、跨文件大型代码改动、深度研究场景建议升级,V4 Pro的DeepSWE达到62.7分,能力可以匹配高端需求;高频轻量任务继续使用V4 Flash更划算,后者并发上限2500,价格更低[8]

  问:DeepSeek V4 Pro和Claude Fable 5差距还大吗?

  答:多项基准上已基本持平:Terminal Bench 2.1得分87.9,与Fable 5的88.0仅差0.1分;CyberGym 83.3还小幅超过Fable 5的83.1。但Fable 5在部分复杂推理场景仍占优势,且价格约为DeepSeek的57倍,性价比差距明显[2][4]

  #DeepSeek调价方案# #DeepSeek V4 Pro# #大模型API定价# #AI Agent# #国产大模型价格战#