AlphaBits
2026-08-14 05:19来自 科技看点

DeepSeek调价方案落地:V4 Pro高峰输出27元/百万Token,性能飞跃还值得买吗?

  核心结论:8月13日,DeepSeek公布调价方案:V4 Pro正式版高峰时段每百万Token输出价格从6元涨至27元(涨幅350%),输入从3元涨至9元(涨幅200%),新价格自8月17日0时生效[1]。这次涨价能否站住脚,要看V4 Pro在Agent和编程能力上的“质变”能否让开发者觉得“多花几倍的钱,值”。

  事件始于8月12日晚间:DeepSeek在API文档“模型与价格”页静默上线DeepSeek-V4-Pro-0813正式版,调用名仍为deepseek-v4-pro,老用户无需修改配置即可切换[5]。官方同步预告“计划近期整体上调API服务定价,预计涨幅较大”;8月13日,具体调价方案随媒体报道落地。新价格于8月17日0时起执行[2]

  DeepSeek调价方案具体涨了多少?关键数字一目了然

  结论:调价后V4 Pro在工作日高峰时段的输出价格变为原价的4.5倍,空闲时段为2.25倍,峰谷价差为2倍。

  DeepSeek此次调价并非一刀切式涨价,而是引入了峰谷分时计费机制。工作日高峰时段为每日9:00-12:00和14:00-18:00,夜间、周末及节假日为平峰低价时段,空闲时段价格统一为高峰时段的一半[1][2]。各主力模型的具体价格如下:

  • DeepSeek V4 Pro正式版(调价前基准:输入3元/百万Token、输出6元/百万Token):高峰时段输入9元(+200%)、输出27元(+350%);空闲时段输入4.5元(+50%)、输出13.5元(+125%)。
  • DeepSeek V4 Flash正式版(调价前基准:输入1元/百万Token、输出2元/百万Token):高峰时段输入3元(+200%)、输出9元(+350%);空闲时段输入1.5元(+50%)、输出4.5元(+125%)。
  • 缓存命中价格涨幅最猛:V4 Pro缓存命中输入从0.025元涨至高峰0.3元(+1100%)、空闲0.15元(+500%)。对高缓存命中率的业务,实际成本增速远高于输入输出单价的涨幅[1][3]

  对开发者而言,现在的成本模型需要重新测算。以“1亿Token输入(全部缓存未命中)+2000万Token输出”的日调用量为例,调价前高峰成本约为3元×100+6元×20=420元;调价后高峰成本约为9元×100+27元×20=1440元,约为原来的3.4倍。若错峰到空闲时段,成本约为4.5元×100+13.5元×20=720元,只有高峰时段的一半。

  从时间线看,这轮涨价是“先抑后扬”的产物:2026年4月25日起,DeepSeek对v4-pro开启限时2.5折优惠;5月23日宣布优惠到期后调为原价四分之一,相当于75%降幅;8月6日发布涨价预告;8月12日晚V4 Pro正式版上线;8月13日调价方案正式落地[2]。前后5个月,价格从“地板价”重新爬到行业红线,节奏不可谓不快。

  V4 Pro性能提升能否支撑涨价?能力“质变”是关键

  结论:性能提升集中在“能交付结果”而非“能回答问题”的场景,这为高定价提供了商业逻辑。

  V4 Pro正式版通过后训练优化,把能力重心从通用对话转向了智能体与编程场景。最直观的证据是DeepSWE编程基准:预览版得分12.8分(更早版本曾测得7.3分),正式版直接飙升至62.7分;NL2Repo从38.5分升至61.5分;DSBench-Hard分数翻倍以上[4][5]。这种量级的跳跃不是简单调参能做到的,它意味着模型真正理解了任务拆解和工具调用链路,能交付完整代码仓库级别的工作成果,而不只是输出需要反复调试的代码片段。

“V4 Pro这波更新,本质是把‘会做题’和‘会干活’之间的鸿沟填上了。真正的分水岭在于:它开始能在真实工作流里替你写完整个PR,而不是给你一段需要你再调试半天的代码片段。这才是涨价的底气来源。”——开发者评论[4]

  第三方基准测试同样显示V4 Pro已逼近第一梯队:Terminal Bench 2.1得分87.9,与Claude Fable 5的88.0分仅差0.1分;CyberGym在终端与网络安全场景得分83.3,反超了Fable 5的83.1分[1][6]。与Claude Opus 4.8的11项Agent基准对比,V4 Pro取得5胜5负1平;Artificial Analysis的Intelligence Index仅落后4分[3]。也就是说,它已经能和海外头部模型在同一张桌子上掰手腕。

  长上下文是另一个关键卖点:V4 Pro支持100万Token上下文、最大38.4万Token输出,可以一次性处理大型代码库或整本图书级内容,配合默认思考模式、三档推理模式、Tool Calls、JSON Output、Responses API,以及对OpenAI与Anthropic双格式的兼容,直接接入Codex、Claude Code等既有生态也不成问题[5]。以一个10万行代码的仓库为例,传统模型只能分段读取,V4 Pro却可以在一次请求中读取全部上下文并执行跨文件变更——这种能力差异无法用简单问答类基准体现,却在真实工程环境中直接决定任务能否完成。

  涨价后DeepSeek还便宜吗?和GLM-5.2、Claude Fable 5怎么比?

  结论:即使涨价,DeepSeek V4 Pro的高峰时段定价仍与智谱GLM-5.2持平,约为Claude Fable 5的1/57,低价策略并没有被颠覆。

  涨价消息公布后,不少用户担心“性价比之王”的标签被撕掉。但从横向对比看,V4 Pro在绝对价格上依然具备优势:高峰时段27元/百万Token的输出价格与GLM-5.2持平;Claude Fable 5的输出价格约是它的57倍[1][3]。也就是说,同样完成一次复杂Agent任务,用V4 Pro的成本可能只有用Fable 5的一个零头。

  不过,开发者在算账时不能只看输入/输出单价。V4 Pro的缓存命中输入价格从0.025元涨至高峰0.3元,涨幅1100%,比输出价格涨幅更夸张。如果业务大量依赖缓存命中,实际成本增幅可能高于预期。对这类用户,最好的应对方式是重新统计缓存命中比例,以“综合成本”而非“挂牌价”来做决策[3]

  产品对比表:DeepSeek V4 Pro / V4 Flash 与竞品横向比较

产品/型号价格/定位核心配置优势短板适合谁注意点
DeepSeek V4 Pro 正式版(deepseek-v4-pro)高峰:输入9元/输出27元;空闲:输入4.5元/输出13.5元(每百万Token)100万Token上下文、最大38.4万Token输出;DeepSWE 62.7分;Terminal Bench 2.1得分87.9;并发上限500Agent能力接近全球第一梯队;兼容OpenAI/Anthropic格式;绝对价格远低于海外旗舰缓存命中价格涨幅高达1100%;并发上限低于Flash;权重开源状态未确认长流程Agent、跨文件代码重构、深度研究类任务新价格8月17日0时生效;官方已预告后续可能继续上调
DeepSeek V4 Flash 正式版高峰:输入3元/输出9元;空闲:输入1.5元/输出4.5元百万级超长上下文;并发上限2500;价格约为Pro的1/3高并发、低成本;适合高频轻量业务复杂编程与Agent能力明显弱于Pro高频内容生成、简单RAG、普通辅助编程高峰与空闲价差同样为2倍;批量任务可错峰调度
Claude Fable 5约为DeepSeek V4 Pro高峰价的57倍(据公开报道)Terminal Bench 2.1得分88.0;CyberGym得分83.1(据公开基准)全球领先的Agent能力;生态成熟价格昂贵;国内访问与合规成本高预算充裕、对性能有极致要求的团队具体规格需以Anthropic官方实时信息为准
智谱 GLM-5.2高峰时段与V4 Pro持平(据公开报道)本次公开资料未披露详细配置国产主流方案;定价紧跟DeepSeek缺乏同量级对比数据,性能差异待验证偏好国产大模型、需要多供应商备份的开发者实际能力与价格需以智谱官方信息为准

  开发者现在该怎么选?V4 Pro还是V4 Flash?

  结论:高频轻量任务继续用V4 Flash,长链路Agent和高复杂度编程选V4 Pro,两款模型是分工关系,不是替代关系。

  从产品配置可以清楚看到官方对两款模型的定位:V4 Pro的价格正好是Flash的三倍,但并发上限从Flash的2500降到500;能力上限则从“通用任务”抬升到“端到端Agent交付”。这意味着官方希望把Flash当作高并发、低成本的通用入口,把Pro留给真正需要“重能力”的复杂场景[5]。从算力分配角度看,Pro的Agent任务往往需要长时间占用计算资源,若并发设置过高,容易在高峰期击穿算力预算。500并发上限更像是主动保护服务稳定性的设计,而非性能短板。

  具体选型建议拆成三类:

  • 高频轻量任务(内容生成、摘要、客服、常规RAG):继续用V4 Flash。价格便宜、并发更高,日常体验与Pro差距不大。
  • 中重度编程任务(跨文件改动、测试生成、Bug修复):优先考虑V4 Pro。DeepSWE 62.7分的含金量在于它能交付完整的代码修改成果,而不是片段;对按项目人力计费的团队,即便调价后高峰综合成本为原来的3.4倍,仍远低于一名中级工程师的时薪。
  • 深度Agent任务(操作终端、浏览器、工具链路):这一赛道两款模型差距最大。Pro的Terminal Bench 87.9分足以支撑真实终端环境的复杂操作,而Flash不具备同等能力[6]

  预算敏感型团队可以利用峰谷价差,把批量任务调度到夜间或周末,成本直接减半。官方文档明确,空闲时段价格是高峰的一半,对于非实时业务,这是相当可观的折扣[1]

  从降价到涨价,大模型价格战为何突然转向?

  结论:涨价是算力成本传导和价值锚点转移的叠加,国内大模型竞争正从“拼参数”进入“拼交付价值”阶段。

  2026年上半年,国内大模型行业经历了一场惨烈的价格战:DeepSeek在4月推出2.5折优惠,5月将基准价调至原价的四分之一;小米MiMo-V2.5系列随后宣布永久降价,最高降幅达99%[2]。在极端低价推动下,DeepSeek的全球调用量冲上第一梯队,V4 Flash甚至一度因访问量暴增而出现容量不足[7]

  这种“以价换量”的模式难以持续。高端GPU推理成本依然是算力支出的主要部分,当全球调用量爆发式增长,算力资源稀缺的问题就会从后台走到台前。涨价是算力资源稀缺下的必然选择,也是对“价格战不可持续”的一次集体确认[7]

  更重要的是,模型的价值锚点正在转移。当一个模型能独立完成完整PR提交、跨仓库代码修改、终端环境操作时,它就不再是“聊天机器人”,而是能嵌入企业工作流的“数字化协作者”。这种角色的商业价值,远高于单纯输出文本。正如开发者所言:“以前大家选模型可能先问‘哪个最强?’以后很可能变成‘这个任务用谁最划算?’”[4]

  另一个信号值得关注:DeepSeek官方在测试V4 Pro时使用了“DeepSeek Harness极简模式”作为框架,类似于Claude Code、Codex和智谱Z Code。这暗示DeepSeek正从“模型供应商”向“模型+Agent框架”的基础设施方向延伸[3]。当模型调用成本在整体解决方案中的占比让位于“模型质量×框架效率”的复合竞争力,定价逻辑将变得更加立体。

  舆论场观察:官方、媒体与开发者眼中的DeepSeek调价

  • 官方口径:DeepSeek在8月6日公告中表示“计划近期整体上调DeepSeek API服务的定价,预计涨幅较大”;8月13日方案公布后,尚未就具体涨幅逻辑发布更多解释[1][2]
  • 媒体观点:21世纪经济报道等主流媒体将调价与算力成本、访问容量压力关联;行业调研解读认为“综合价格依然是国内同一水平模型的最低价”,峰时价格与GLM-5.2持平[2][3]
  • 开发者/大V观点:极客安迪Geeker认为“日常用Flash够用就别急着上Pro,做复杂Agent任务才值得为这个性能买单”;爱可可·爱生活则表示能力质变才是涨价底气[4][5]
  • 尚未确认的信息:截至8月14日,DeepSeek尚未发布独立正式版公告;HuggingFace上未见0813独立权重,“API可用”不等于“权重已开源”。DeepSeek Harness(DSH)的上线时间和产品形态也尚无官方公布[5]

  热门问答:DeepSeek调价方案常见问题

  Q1:DeepSeek V4 Pro调价后每百万Token多少钱?

  8月17日0时起,V4 Pro高峰时段(工作日9:00-12:00、14:00-18:00)输入9元/百万Token、输出27元/百万Token;空闲时段输入4.5元、输出13.5元。相比调价前输入3元/输出6元,高峰输出涨幅达350%[1]

  Q2:V4 Pro和V4 Flash怎么选?

  看任务复杂度。V4 Pro的DeepSWE编程基准达62.7分,支持100万Token上下文、最大38.4万Token输出,适合跨文件代码改动和长链路Agent任务;V4 Flash并发上限2500、价格仅为Pro的三分之一,适合高频轻量调用。日常任务用Flash更划算[5]

  Q3:涨价后DeepSeek在市场上还便宜吗?

  仍是国内同档模型最低价之一。V4 Pro高峰定价与智谱GLM-5.2持平,约为Claude Fable 5的1/57。但缓存命中输入价格涨幅高达1100%(0.025元至0.3元),大量依赖缓存的业务需重新测算成本[1][3]

  #DeepSeek调价# #DeepSeekV4Pro# #AI大模型# #大模型API# #AI编程#