实验式Lab
26-04-24 11:39

DeepSeek V4 终于开源了,有4个版本
DeepSeek V4 家族正式开源并上线, 性能直接顶到了 Opus 4.6 的水位 .

核心工程账本与量化指标拆解:
▪️ 4 款模型全系 1M 窗口:
DeepSeek-V4-Pro 旗舰 V4-Pro (总参数 1.8T/激活 49B)
DeepSeek-V4-Flash 竞速款 V4-Flash(总参数 284B/激活 13B)
DeepSeek-V4-Pro-Base 用于前沿规模后训练和研究的预训练 1.6T 基础模型
DeepSeek-V4-Flash-Base 用于高效领域自适应的预训练 284B 基础模型
▪️ 显存大手术: 给非底层开发解释下, 跑长文本最怕 KV Cache (上下文缓存) 把显存撑爆. V4-Pro 相比上代把 KV Cache 缩小了 9.5 倍, V4-Flash 更是暴降 13.7 倍.
▪️ 动态算力伸缩: 引入了 Non-think, Think High 和 Think Max 三种按需推理模式. 满血 Think Max 状态下, SWE Verified 和 LiveCodeBench 等纯工程跑分基本咬死 Claude-Opus-4.6-Max.

站在每天抠 GPU 显存的一线开发者角度... 怎么说呢, 单看跑分震撼不至于, 但近十倍的 KV Cache 压缩配合动态推理模式真的很赞. 以前 1M 窗口纯属 PPT 概念根本部署不起, 现在不仅试错成本砸下来了, 简单任务还能切 Non-think 省算力.
huggingface
http://t.cn/AXx0T7dg

发布于 四川