穿透AI
26-06-29 18:31

#DeepSeek新发布的DSpark有多强#
DSpark 强在让大模型"吐字"更快、服务更扛并发,不是模型变聪明了。
它本质是挂在 DeepSeek-V4 旁边的推理加速模块不是 V5 新模型,输出质量不变。
用户体感提速约六到八成线上实测里,V4-Flash 单用户生成速度提升 60%–85%,V4-Pro 提升 57%–78%,以前等 10 秒,现在可能就 5–6 秒。
高并发下优势最猛,在严格速度要求(120 token/s)时,系统吞吐量最高提升 661%—意思是服务器不容易卡,很多人同时问也不容易崩,
比现有方案更能"猜中并保住质量,Qwen3 系列测试里,DSpark 平均接受长度比 Eagle3 高 26.7%–30.9%,比 DFlash 高 16.3%–18.4%,说白了就是草稿更少被大模型打回重做。
它厉害的点在于做了两件事:「先并行快速写草稿,再用轻量模块补上下文连贯性」,加上「按置信度和 GPU 负载决定验几个词」——算力不瞎花,留给最值得验证的词。

发布于 广东