这很盒里吧
26-04-02 16:15 微博认证:AI博主

#DeepSeekV4或将在4月发布# DeepSeek V4 今天再次灰度测试了一轮,估计已经无限接近上线。

刚看到『晚点LatePost』也发了篇特稿,里面也提到 V4 的发布时间是 4 月份,不知道是不是在提前预热。

- 特稿里提到:DeepSeek 的多数员工会在下午 6 点~7 点左右离开公司,他们早上也不打卡。因为梁文锋认为,一个人一天能高质量输出的时间很难超过 6~8 小时。加班疲劳下的昏庸判断反而会浪费宝贵的算力资源,得不偿失。

- 在 V3 和 R1 之前,DeepSeek 是以大厂约 1/10 的人数,约 1/2 的人均工作时间,以极高的专注和聚焦,跻身全球大模型第一梯队。

- DeepSeek 没有二把手,尤其在研究团队,只有梁文锋和其他研究员两个层级。梁文锋的生活非常简单,好多天穿同一件衣服,长期住酒店,爱好徒步等户外运动。不参与季度团建活动,很少和成员聚餐,年底大团建也只在讲话时露面,不参与全程。

- 2023 年梁文锋小范围见过一些投资人,但希望投资方接受一个回报上限 —— 结果就是没有投资机构愿意投。等待 2025 年 DeepSeek 爆火后,他已经不愿意再见任何投资人。

- DeepSeek 没怎么投入多模态生成,因为梁文锋认为多模态生成不是智能的主线。

- 梁文锋认为有两个很重要的工作:一是基于国产生态来做大模型,比如投入对国产 GPU 的适配,以解决高性能 GPU 供给受限的现实。二是做一些大厂或其它创业公司不会去试,不愿去试的方向。比如25 年的 OCR,以及内部在继续做的持续学习和仿生人脑的探索。

- DeepSeek 相对小的团队和成立以来的透明、扁平的氛围,让成员之间依然可以自然分工:有时开始一个新方向,就是因为有三五个人都觉得一个 idea 不错,然后就一起做了。晚点引用了一句话:“DeepSeek 是一个真心想做研究的人,在国内,甚至是全球能找到的最好的地方。”

- DeepSeek 的绝对薪资不低,但外面给的更高。一些猎头说竞争对手愿意给 DeepSeek 的员工开 2 到 3 倍的薪酬,甚至 8 位数(算股票或期权)总包。但 DeepSeek 整体的离职率不算高。

发布于 上海