#DeepSeekV4Flash# 7月31日,DeepSeek V4-Flash 正式版 API 低调上线,没有发布会,但开发者圈子已经炸了。
核心看点:
· 架构完全没变(284B总参数、13B激活),仅靠后训练就把 Agent 能力拉爆——DeepSWE 从7.3飙到54.4,涨幅超7倍,部分指标反超自家 Pro 预览版
· 价格依然离谱:输入1元/百万Token、输出2元,缓存命中低至0.02元,比降价后的 GPT-5.6 Luna 还低约60%
· 原生支持 OpenAI Responses API 和 Codex,开发者几乎零成本迁移
· MIT 开源权重 投机解码模块,消费级显卡也能本地跑
更狠的是,它证明了「模型能力提升不一定靠堆参数」。同样的结构,换个练法,13B激活就能干到第一梯队门口。
不过目前只有 API 端更新,App 和网页端还是旧版。V4-Pro 正式版据说也在路上了,到时候才是真正的旗舰对决。
你会把 DeepSeek 接进自己的开发工具链吗?
#AI大模型##DeepSeek##微博AI创作季#
发布于 广东
