DeepSeek V4 Pro正式版API定价3元/百万Token,为何仅为海外竞品几十分之一?
8月12日深夜,DeepSeek V4 Pro正式版(DeepSeek-V4-Pro-0813)悄然上线,API输入定价3元/百万Token、输出6元/百万Token,多项Agent测试逼近Claude Fable 5,价格却仅为海外同级模型的几十分之一——这正是DeepSeek最新版本藏了一个大招的直观体现。[2]
所谓“大招”,不只是性能数字上涨,而是价格和性能形成罕见的错位打击。距离V4 Flash正式版发布不到两周,DeepSeek在没有发布正式更新日志的情况下,将API端的deepseek-v4-pro切换为DeepSeek-V4-Pro-0813。[9]该版本支持1M上下文与最高384K输出,默认思考模式,并兼容OpenAI、Anthropic两套API格式。[4]更关键的是,DeepSeek官网同步预告“近期整体上调API定价,预计涨幅较大”,给当前低价窗口蒙上了一层紧迫感。[8]
从时间点看,这次发布几乎与马斯克旗下SpaceXAI的Grok 4.6同步,海外前沿模型与国产高性价比模型的竞争再度升温。[10]对于普通开发者、创业者和企业用户来说,最大的现实问题是:DeepSeek V4 Pro到底值不值得现在上车?它和Flash怎么选?涨价之后还划算吗?本文将结合公开信息和实际成本模型,逐一拆解。
为什么DeepSeek V4 Pro能卖这么便宜?
答案不是烧钱补贴,而是技术路线带来的低成本结构,加上一套精心设计的商业调度策略。
首先,DeepSeek V4 Pro采用混合专家(MoE)架构,总参数达到1.6万亿,但每次推理只激活490亿参数,计算资源消耗被大幅压低。[1]其次,它搭载压缩稀疏注意力(CSA)与重度压缩注意力(HCA)结合的混合注意力机制,在1M Token上下文场景下,单个Token推理计算量仅为前代V3.2的27%,KVCache占用降至10%。[1]这意味着同样硬件能并发服务更多请求,单位成本被摊薄。这就像把同一台服务器的“拼车”效率提高了接近4倍,每单成本自然下降。
后训练优化也贡献了“加量不加价”。正式版通过领域专家独立培养加统一蒸馏,Agent能力大幅提升——DeepSWE得分从12.8跃升至62.7,NL2Repo从38.5升至61.5,DSBench-Hard翻倍——但推理成本没有同步增加。[2]换句话说,性能变强了,成本却没有线性上涨,这是DeepSeek敢定低价的核心底气。
在生态层面,V4 Pro采用MIT协议开源,本地部署、二次开发和商用都没有授权费;原生适配华为昇腾950等国产芯片,降低了对海外高价GPU的依赖。[1]API接口同时兼容OpenAI和Anthropic,开发者的迁移成本极低。[4]再加上峰谷分时计费机制,工作日高峰时段价格翻倍,鼓励非实时任务错峰调用,这本质上是在用价格杠杆优化算力利用率。[6][7]因此,低价并不是简单的价格战,而是从模型设计、芯片适配到生态战略的体系化结果。
DeepSeek V4 Pro性能真能比肩Claude Fable 5吗?
从已公开的评测数据看,它在多项智能体基准上已经接近甚至局部反超Claude Fable 5,但整体还不能说全面胜出,更准确的定位是“逼近第一梯队”。
据每日经济新闻等媒体援引DeepSeek官方群流传的对比表,V4 Pro在Terminal Bench上得分87.9,逼近Fable 5的88.0;CyberGym上以83.3反超Fable 5的83.1。[2]相比预览版,正式版的Agent能力提升明显,DeepSWE从12.8飙升至62.7,NL2Repo从38.5升至61.5,DSBench-Hard得分翻了一倍多。[2]在长文档、代码仓库和Agent流程场景,1M上下文+384K输出提供了很大的工作空间,单次调用就能塞进一整本长篇小说或大型仓库的多个关键文件。[4]
不过,Claude Fable 5作为Anthropic前沿模型,在复杂推理、多模态和综合指令跟随上仍有积累优势,目前不能说完全被超越。此外,这些性能数据来自官方群流传的评测表,尚未看到独立机构的大规模复测,读者需要理性看待。与此同时,Grok 4.6的同步发布也提醒我们,高端AI竞争已经从“跑分竞赛”转向“真实任务中谁能更低成本地完成工作”。[10]
DeepSeek V4 Pro和V4 Flash怎么选?价格配置对比
简单说,高频低延迟、成本敏感选Flash;复杂Agent任务、长上下文和代码仓库选Pro。
目前DeepSeek官方执行的定价为:V4 Pro每百万Token缓存命中输入0.025元、缓存未命中输入3元、输出6元;V4 Flash分别为0.02元、1元和2元。[3]Pro并发限制500,Flash并发限制2500。[2][4]Pro价格是Flash的3倍,但性能上限高得多。
| 产品/型号 | 价格/定位 | 核心配置 | 优势 | 短板 | 适合谁 | 注意点 |
|---|---|---|---|---|---|---|
| DeepSeek V4 Pro | 输入3元/百万Token、输出6元/百万Token(缓存命中输入0.025元);高端生产力 | 1.6T总参数/490B激活,1M上下文,384K最大输出,500并发,MoE+CSA/HCA | Agent能力逼近Claude Fable 5,DeepSWE 62.7;超长上下文;国产算力适配;MIT开源 | 价格是Flash的3倍;高峰时段还会翻倍;并发上限低于Flash;综合能力仍不及顶级闭源 | 开发者做复杂Agent、大型代码库、深度处理长文档、企业级应用 | 官网已预告将整体上调API定价;注意峰谷计费 |
| DeepSeek V4 Flash | 输入1元/百万Token、输出2元/百万Token(缓存命中输入0.02元);高性价比 | 1M上下文,2500并发,MoE | 价格极低,并发高,适合大规模调用;同样兼容OpenAI/Anthropic接口 | Agent能力弱于Pro;复杂推理和长上下文能力不足 | 高频/海量token消耗、客服、简单文档处理、预算敏感的个人开发者 | 涨价和峰谷计费同样适用;需要高并发吞吐优先选Flash |
| Claude Fable 5(海外竞品) | 约10美元/百万Token输入(据公开报道),价格是V4 Pro数倍到数十倍 | 前沿闭源模型,Agent基准领先 | 综合能力第一梯队,生态成熟 | 成本极高,国内访问/支付不便,不开放权重 | 对绝对性能要求极高、预算充足的团队 | 价格需以Anthropic官方实时信息为准;数据合规需自行评估 |
从选购角度看,如果只是做聊天机器人、文本分类这类“体力活”,Flash已经足够,没必要多花三倍钱;如果要跑多步工具调用、完整代码仓分析,Pro的能力提升值回差价。更值得注意的是缓存命中价格:Pro只有0.025元/百万Token,Flash为0.02元/百万Token,两者在缓存场景下差距不大,但都对长对话和多次连续调用非常友好。[3]
现在入手DeepSeek V4 Pro划算吗?API涨价影响多大?
对重度开发者而言,当前是值得上车的窗口期,但必须为涨价和峰谷计费预留成本空间。
DeepSeek官网已明确公告“计划近期整体上调API服务的定价,预计涨幅较大”。[8]同时,官方引入了峰谷分时计费,工作日高峰时段(9:00-12:00、14:00-18:00)价格翻倍,夜间、周末和节假日维持平峰低价。[6][7]这意味着即使现在便宜,未来实际成本还要看调用时段。
我们简单算一笔账:假设每天调用100万Token输出,使用V4 Pro平峰价为6元,高峰时段翻倍为12元,一个月约180—360元;而如果使用同等性能的Claude Fable 5,按海外约10美元/百万Token输入、输出数十美元计算,同样量级的花费可能是数百甚至上千美元。即便DeepSeek涨价一倍,仍远低于海外头部模型。[5]
如果你的任务是实时交互、白天工作流密集,建议尽快测试V4 Pro质量,并锁定预算;如果是可错峰的大批量任务,可以好好利用平峰时段。另外,可以设计prompt复用缓存,把“缓存命中输入”的0.025元/百万Token用起来,这能大幅降低边际成本。[3]
舆论场怎么看DeepSeek这次“大招”?
媒体普遍将其解读为“AI价格战”的延续:澎湃新闻援引OpenRouter数据指出,GPT-5.5 Pro输入价格高达30美元/百万Token,输出180美元/百万Token,与调价后的DeepSeek V4 Pro相差超过700倍。[5]贝壳财经则关注国产化适配意义,认为“模型-芯片-云”闭环开始跑通。[5][8]新浪科技等媒体也跟进报道了官方涨价预告和版本切换。这种价格断层确实容易触动市场情绪。
网民与开发者则明显分为两派:乐观派认为“老百姓用得起的AI”正在到来,能让更多普通人享受大模型红利;谨慎派则担心这是低价引流再涨价的商业策略,指出官方已经预告涨价,窗口期不会太长。[1][2]也有开发者反馈,实际使用中Flash的性价比已经很高,Pro更适合“拿来干活”,而不是“拿来聊天”。
需要强调的是,大部分性能数据来自官方群流传的评测表,尚未看到独立完整测评报告;官方也没有发布正式更新日志。[9]对于快速迭代的AI产品,真实效果还是建议自己在业务场景里跑一跑再下结论。
常见问题解答
Q1:DeepSeek V4 Pro API价格到底是多少?
官方现价:缓存命中输入0.025元/百万Token,缓存未命中输入3元/百万Token,输出6元/百万Token;Flash对应价格为0.02元、1元、2元。[3][4]Pro并发限制500,Flash为2500。[2][4]
Q2:DeepSeek V4 Pro和Claude Fable 5谁更强?
在Terminal Bench等智能体测试中,V4 Pro已逼近甚至小幅反超Fable 5,但综合能力、多模态和复杂推理仍有差距。[2]整体属于同一梯队边缘,尚不能说完全对标。
Q3:现在买DeepSeek V4 Pro要等涨价吗?
官方已预告将整体上调API定价,预计涨幅较大,具体方案未出。[8]当前是低价窗口,重度用户可先测试绑定;同时要关注峰谷计价,错峰调用更省钱。[6]最终以官网正式通知为准。
#DeepSeek V4 Pro# #AI API定价# #大模型价格战# #Agent智能体# #国产大模型#