来了来了,DeepSeek 联合北大开源全新大模型推理加速框架 DSpark,并且成功替换此前生产服务系统中的 MTP-1 方案。
来看几个关键数据:
1、DeepSeek-V4-Flash 和 DeepSeek-V4-Pro 模型的推理生成速度分别大幅提升了 60%~85% 和 57%~78%。
2、常规并发服务目标下,系统总吞吐提升 51%~52%,严苛高并发服务目标下,名义吞吐优势可达 406%~661%。
简直夯爆了,真不愧是 DeepSeek!
#DeepSeek发布DSpark##HOW I AI#
发布于 北京
