硅域寻常栈
18小时前来自 科技看点

DeepSeek V4 Flash便宜到骨折?性能竟对标GPT-5.6

DeepSeek V4 Flash正式版来了,性能对标GPT-5.6 Luna,但成本直接打骨折——同样的任务,你花GPT一块钱,它只要几分钱。

一、价格到底有多低?DeepSeek把大模型用成了“白菜价”

基础定价:输入仅1元/百万Token,输出2元/百万Token,缓存命中时更是低至0.02元/百万Token。

对比海外竞品:GPT-5.6 Sol每百万Token输入5美元、输出30美元,V4 Flash的价格差距达到数十倍到上百倍。

真实账单佐证:AI开发者用V4 Flash执行51万Token的本地文件阅读+全网检索任务,总消耗仅0.53元;同样的任务放GPT-5.6 Sol上,成本高得不敢想。

放宽的算力门槛:还有开发者用V4 Flash解决苹果小程序支付问题,跑了约1亿Token,账单才8块多钱。

二、便宜≠弱鸡:Agent能力直逼第一梯队

官方跑分亮眼:在Artificial Analysis智能指数中,V4 Flash拿到50分(满分51),仅落后GPT-5.6 Luna的51分1分;Arena前端代码竞技场斩获1586分,与GLM-5.2 Max(1587分)几乎持平。

后训练“黑科技”:模型结构、参数规模与预览版完全一致,纯靠重新后训练就把Agent能力翻倍提升——Terminal Bench从61.8冲到82.7,DSBench-FullStack从37.0涨到68.7,甚至反超了自家V4 Pro预览版。

开发者实测体验:接入Hermes后,相同任务V4 Flash仅需40秒,而GPT-5.6 Sol+Codex要1分47秒;在实际Agent智能体测试中得分25.2,逼近Opus-4.8的25.7分。

三、性价比重构AI市场:中小开发者也能“打富裕仗”

碾压同级竞品:Arena跑分几乎持平的情况下,V4 Flash的API价格仅为GLM-5.2 Max的十分之一左右(0.14/0.28美元 vs 1.40/4.40美元)。

全球市场格局被改写:OpenRouter最新数据显示,中国AI模型全球周调用量前五中,中国模型占据四席,市场份额达63.5%,其中DeepSeek V4 Flash位居第二。

重新定义“AI基础设施”价格:开发者感叹,以前跑Agent任务心疼Token钱,现在V4 Flash单任务成本比降价80%后的GPT-5.6 Luna还低约60%;这意味着批量代码修复、自动化流程这些“脏活累活”终于敢大规模上生产环境了。

对普通人同样友好:有用户表示,日常信息搜集、文件总结、简单编程,V4 Flash完全够用,再也不用纠结选Kimi的长文本还是GLM的低延迟了。