#DeepSeekV4视觉模型上线#
DeepSeek这次上V4-Flash-Vision-Exp,我觉得真正值得关注的不是“终于能看图了”,而是AI看图这件事正在变得越来越像“看懂”。
以前让AI看张图片,基本就是告诉你“图里有什么”。
但真正有用的场景其实是另一种:给它一张表格,让它找规律;丢一张复杂截图,让它判断问题;拍一张现场照片,让它结合文字一起分析。
也就是说,AI不只是多了一双眼睛,而是开始尝试把“看到的东西”和“后面的任务”连起来。
这次还是实验性质的Vision版本,纯文本能力与V4-Flash正式版持平,重点明显放在视觉理解和多模态Agent上。
如果后面这套能力继续往前走,AI和真实世界之间的距离又会缩短一截。
发布于 上海
