
大家好我是老札,全球头部AI团队都在疯狂内卷,OpenAI、字节跳动等中美大厂的核心AI员工,每周工作70到80小时是常态,而DeepSeek的多数员工下午六七点就下班了。

创始人梁文峰说,一个人一天能好好工作的时间,很难超过6到8个小时,要是加班加得累得不行,这时候做的糊涂决定,反倒会把宝贵的算力资源给浪费了,实在是不划算。
在这样的节奏下,从当初震撼全球的R1,到刚发布的新一代V4模型,外界等了15个月,这期间有人期待王者归来,有人质疑神话破灭,但DeepSeek从创始人到员工始终保持沉默,异常神秘。

V4发布前,我们访谈了多位接近DeepSeek的人士,获取内幕消息,这期咱们就来揭秘:DeepSeek内部遇到了什么压力与问题?

人才被高价挖走,不融资的公司开始融资
DeepSeek遇到最直接的压力就是人才流失,除了早前已入职小米的罗弗利,DeepSeek第一代大模型核心作者王炳轩被腾讯挖走,R1核心作者郭达雅去了字节。

从幻方时期就跟着梁文峰创业的阮冲,去了一家自动驾驶创业公司,DeepSeek的绝对薪资不低,但巨头有更强的“超能力”。
一级猎头告诉晚点,竞争对手开出了难以拒绝的数字——翻两倍到三倍问题不大,还有的开出八位数总包。

之前DeepSeek因为不缺钱,从来都没融过资,可公司又没有个明确的估值,这就使得好多拿着期权的人,根本不知道自己手里的期权到底值多少钱。
与此同时别人纸面上的财富已开始兑现,MiniMax和智谱上市后股价暴涨,批量诞生了一批千万富翁。

压力之下,原本拒绝外部投资、不想受资本影响的梁文峰,现在也开始融资,根据最新报道,DeepSeek估值或达3000亿元,介于MiniMax和智谱之间。

外界期待错位,内部有自己的节奏
人才压力之外,DeepSeek还要面对错位的预期,梁文峰认为,DeepSeek有自己的使命,除了追求大模型的智能上限,还有两项很重要的工作:

一是适配国产芯片来做大模型,这次V4刚发布,华为昇腾就立刻同步支持;二是原始创新,做一些大厂或其他创业公司不会去碰、不愿去碰的方向。
这与外界的部分期待并不匹配,一些人希望DeepSeek每次出手都像R1那样石破天惊,这有些强人所难,也不符合技术规律。
一年前DeepSeek用开源模型亲手引爆了新一轮大模型之战,也让自己面临更激烈的竞争,但外界越喧嚣,内部越安静。

有个跟DeepSeek关系挺近的人跟《晚点》说,DeepSeek这地方真心是那些想搞研究的人,在国内甚至全世界能找到的最好去处。

全球最不卷的AI公司,内部只有两个层级
为什么这么说?DeepSeek是全球最不卷的AI公司:不打卡、不加班,没有明确绩效考核,没有强deadline。

公司内部没有二把手,组织极其扁平,100多人的研究团队里,只有梁文峰和研究员两个层级,团队像一个大型实验室,研究员可以自由组队,也可以独自研究长期问题。
梁文峰的角色更像导师,组织研发、协调资源,也做具体研究,在共同成果上署名为通讯作者,这种组织方式和梁文峰个人的气质紧密相关,他神秘且低调。

2022年有个叫“一只平凡的小猪”的员工,以个人的名义给慈善机构捐了1.38亿元,好多人都猜这“一只平凡的小猪”就是梁文峰,不过幻方的工作人员回应说,员工捐款都是匿名的,谁都不知道这“小猪”到底是谁。
见过梁文峰的不少人提到,他没有CEO或所谓天才的气场,更像一个研究员。

MiniMax创始人严俊杰第一次约梁文峰吃饭时到早了,看到一位穿T恤的小哥以为是助理,交流了半小时技术问题后问“梁总什么时候来”,对方说“我就是梁文峰”。

安静聚焦,一种珍贵的可能
梁文峰几乎把所有时间投入到他认为应该聚焦的少数事上,做得细致、做到极致,接触过他的人评价,他是一个特别抗噪音的人,安静聚焦。

在中国这个崇尚竞争和结果说话的环境里,梁文峰和DeepSeek的存在,本身就是个令人惊喜的小概率事件,它未必代表一条必胜的路径,但至少证明了一种珍贵的可能。
就像有个业内人说的:那些一门心思干事儿的人,不一定能在这浮躁的市场大潮里笑到最后,不过呢,只有冒出更多像DeepSeek这样的公司,咱中国科技才有可能从只会复制别人变成走在前面引领大家。
联丰优配提示:文章来自网络,不代表本站观点。