一周之内,大模型行业走出了三个完全相反的方向:豆包开始收费,阿里云腾讯云集体涨价,DeepSeek宣布永久降价75%。
不是做活动,不是限时优惠。原定5月31日到期的V4-Pro七五折优惠,5月22日通知直接转为永久挂牌价。输出价格从每百万Token 24元降到6元,缓存命中输入降到2分5厘。
6块钱一亿个汉字是什么概念?GPT-5.5输出每百万Token约216元,比DeepSeek贵了大约35倍。Claude Opus 4.7约108元,贵了17倍。价格差异不是百分比,是数量级。
为什么DeepSeek敢在行业集体涨价的时候反向下注?核心原因有两条。
第一,V4-Pro本身是一个1.6万亿参数的MoE模型。虽然官方没有公布推理成本的具体数字,但从降价幅度和永久化的决策来看,其推理效率相比上一代应该有显著提升,使得降价后仍能保持健康的毛利。这与过去AI公司烧钱补贴用户的模式有本质区别——降价建立在真实的技术降本之上,不是营销。
第二,缓存定价的战略意图。缓存命中降到每百万Token 2分5厘,这个价格在2026年所有前沿模型里是最低的。这意味着什么?意味着AI应用里那些固定重复加载的部分——系统提示词、工具定义、少样本示例——成本趋近于零。DeepSeek在传递一个清晰的信号:不要用我的聊天页面,用我的API构建你的产品。
对整个行业的冲击可以从三个维度看。
首先,全球前沿模型的定价点被动摇了。输出价格差35倍,这个数字摆在那里。即使能力上有差距,这种量级的价格差会让任何一个有成本意识的开发者和企业重新做数学。不是说一定用DeepSeek,而是说你的决策框架被改变了。
其次,中国市场的定价参照系被锁死了。智谱一年涨了三次,腾讯云涨了5%,这些不是在真空中发生的。当DeepSeek用6块/百万Token的价格提供服务,其他玩家的定价逻辑必须找到一个更扎实的支撑点——要么能力真的有质的差距,要么成本真的下不来。两者都不容易。
最后,开发者生态成本下移会加速应用爆发。一个Agent每天5000万输出Token的负载下,用DeepSeek的账单和用GPT-5.5的账单差一个数量级。应用开发者有很强的动力去尝试双模型架构——高频推理跑DeepSeek,最难的case用更贵的模型兜底。这种事一旦规模化,吃到的就是整个AI应用层的推理流量。
价格战能把价格打下来不稀奇。稀奇的是这次用技术效率而非资本补贴打价格战。
#大模型价格战##AI应用爆发##DeepSeek降价#
发布于 广东
