新浪AI前沿速递
2026-08-08 00:52来自 科技看点

DeepSeek V4-Flash生成星舰的原理是什么?

  DeepSeek V4-Flash能用1块钱26分钟生成星舰数字原型,靠的是MoE稀疏架构、极致的后训练优化和超低的API定价,三重因素共同把复杂AI开发成本压到了普通人也能玩得起的水平。

  一、MoE架构与稀疏激活机制是成本基石

  总参数大、激活参数小:V4-Flash总参数量284B(2840亿),但每次推理仅激活13B参数,属于混合专家(MoE)架构,只有任务相关的“专家”被唤醒,大幅降低单次算力消耗。

  推理效率远超全参数模型:单Token推理算力仅为上一代V3.2的10%,在保持接近Pro版推理能力的同时,响应更快、成本更低。

  超长上下文标配:全系列支持1M(百万)Token上下文,可一次性处理《三体》三部曲体量的文本,无需分段调用,减少了反复请求的叠加成本。

  二、API定价与缓存技术将调用成本压到极致

  阶梯定价极低:V4-Flash缓存未命中输入1元/百万Token,输出2元/百万Token;缓存命中后输入低至0.02元/百万Token,大规模复用场景下成本几乎忽略不计。

  单次任务成本实例:本次星舰创作总Token消耗约百万级别,调用费刚好1元左右;同等任务使用海外旗舰模型成本需十几元甚至上百元,价差达数十到百倍。

  缓存高命中率:日常任务中缓存命中率可达98%,实际支付远低于标价,被开发者称为“近乎不要钱”。

  三、后训练优化大幅提升Agent全链路自动化能力

  零架构改动,纯靠后训练升级:V4-Flash正式版模型结构、参数与预览版完全一致,仅重新进行后训练优化,便使Agent能力实现跳跃式增长。

  关键跑分暴涨:DeepSWE编程得分从7.3飙升至54.4(涨幅645%),Terminal Bench 2.1从61.8升至82.7,Agent全链路工具调用、代码生成、终端操作能力逼近顶级闭源模型。

  创作流程自动化:用户只需下达需求指令,模型自动拆解为结构设计、3D渲染代码、逻辑文档等多阶段任务,配合Trae等编程工具完成从构思到数字原型的完整输出,全程无需人工编程或建模。