DeepSeek刚刚在Hugging Face正式上线了DeepSeek-V4-Flash-Vision-Exp!
这是他们V4系列的首个实验性多模态模型。
其实就是在之前很强的V4-Flash文本模型基础上,加了视觉模块,继续加强训练了一波后,让它真的可以完成识图了!
多模态Agent能力有大幅提升,很多视觉相关任务已经接近甚至局部超过Opus-4.8 的水平,最关键的是:它采用MIT License 开源!
模型大小大概 305B 参数,之前这个模型只在API 上线,现在终于开放权重,可以自己下载部署啦!
#DeepSeekV4多模态模型正式开源#
发布于 广东
