梁文锋上一次引爆舆论,还是去年年初DeepSeek R1发布。
这次是因为DeepSeek内部近四个小时录音公布。录音有3万多字,内容非常丰富,涉及梁文锋对技术、组织、商业和DeepSeek之后位置的思考。
对外界而言,难得有机会直接获取梁文锋的一手信息。梁文锋的表达时常秉持着第一性原理,富有洞见。
比如他说,AI智能的发展呈现阶梯上升的趋势,去年是COT(思维链),今年是Agent,下一步要解决的问题是AI的长时间持续学习能力,自我迭代能力,最后是真正实现AGI,实现人类能做的所有事。
他还说,无论C端用户还是B端用户,都是AGI路上的副产品,它们并不是优先级,DeepSeek的初衷还是AGI。
如果用简单的话概括那四小时录音,那就是梁文锋既表达了对AGI路线的坚定态度,也阐释了行业未来发展的趋势。人们欣喜于找到一扇观察梁文锋思维方式的窗口,很多过去难以理解的选择,也因此有了更清晰的答案。
可以说,公众对梁文锋的想象,通过这次交流会内容彻底得到释放。
值得玩味的是,这场交流会发生在今年5月20日,正值DeepSeek融资的关键阶段,却直到当前DeepSeek V4正式版延期发布之际,被释放出来。
要知道,当下国内模型圈的焦点原本集中在Kimi K3,以及智谱接下来几个月将如何追赶K3。但随着这份录音流出,行业的目光又重新回到了DeepSeek和梁文锋身上。
很难不怀疑这是模型激烈竞争的结果。
甚至出现了一些梳理出来的内容,存在明显将梁文锋个人神话化的倾向。而这很可能偏离了梁文锋的本意,也与他低调的行事风格不符,以至于会给他带来不必要的麻烦。
梁文锋不是神,也不想当神。他只是作为一个平凡的创业者,克制地输出观点,谨慎地回应一些问题。
01
克制与张力
梁文锋很少公开发表讲话,他在媒体报道里,也大多呈现出低调神秘的一面。这场交流会因为是私下交流,也展现出他最为真实的一面。
看完4小时的交流实录,最大的感受除了震惊于信息量密度外,就是梁文锋的张力。
他的表达里没有“遥遥领先”式的营销话术,也没有煽动性的口号,只是从底层技术到产业落地,勾勒出了一幅清晰且务实的DeepSeek发展蓝图。
他的表达里频繁流露出DeepSeek在商业边界上的克制,比如会一直开源,追求API定价成本的下降,只想赚到合理的利润,不会把B端收入当作优先级。
但是在回应投资人时,他也提到DeepSeek依然顺带完成了C端和B端的商业化。
2025年DeepSeek走红后,某种程度上重新证明了AI应用增长的另一种路径,不依赖大规模商业投放,凭借模型能力实现用户自传播。DeepSeek凭借模型出圈,仅用一个月时间,C端用户规模便增长数倍,达到1.3亿,成为仅次于豆包的第二大AI应用。
即便到了2026年3月,在没有像大厂一样持续投入市场推广的情况下,DeepSeek月活用户依然维持在亿级规模,排名国内第三。
B端收入上,梁文锋称,今年如果DeepSeek的需求继续扩大,能买到更多的显卡,它的ARR可能有数亿美金。而一旦达到十亿美金,DeepSeek的现金流可能会回正。
这一速度在基模公司的御三家里,无疑是最亮眼的。梁文锋态度很明确,DeepSeek不是不要商业化,真正商业化的时候还没到来,现在去做商业化,完全是捡了芝麻丢了西瓜。
在商业化路径上,他的表达既带有明显的儒家式克制,也透露出一种不易察觉的张力。一方面,DeepSeek并不希望将用户、流量、场景和生态全部纳入自身体系,不想成为下一个超级App。
相反,它更倾向于站在模型和智能能力的核心位置,将应用层和商业机会开放给合作伙伴、开发者以及各行业参与者,共同分享AI时代的增长红利。
另一方面他也会提到,没有哪家创业公司,像DeepSeek一样追求模型的计算效率,因为这有些违背商业常识,模型效率一高,可能会带来收入的下降。
但DeepSeek能做到API价格降低的底气,是他们的API 定价能做到十个月回本。“到市场上买一批设备回来,十个月收回成本,V3.2 Flash 跟其他的模型,都是十个月收回设备的成本。”梁文锋说,这一点会给竞争对手带来直接的压力。
梁文锋的这种张力,与其说是对竞争边界的感知,不如说是一种对终极目标的清醒。他在传达DeepSeek不是没有商业化能力,如果想要商业化,DeepSeek随时可以做的更好。
对于核心问题,梁文锋也十分果决地表明态度。DeepSeek虽然在商业化上追求克制,但只在一个问题上绝不退让,那就是团队的稳定性。
曾长期坚持不融资,让DeepSeek在人才争夺战中处于相对被动的位置。此前已有多位研究人员离开,最近一次引发关注的是,字节跳动以高额薪酬吸引了深度参与DeepSeek代码、推理等全链路研发的研究员郭达雅加盟。
毕竟在这场大模型竞赛中,失去一个投资方,还有其他投资方,但失去了人才,很可能会失去一切。
02
梁文锋需要回答的
当下DeepSeek的处境,并不容易。
如果说DeepSeek V3的出现,是一次对行业共识的冲击,V4的迟迟未至,则暴露出一家依靠效率和技术路线突围的公司,正进入一个更复杂的竞争阶段。
过去一年,DeepSeek最成功的叙事,是“用更少的资源,做出接近顶级水平的模型”。从R1到V3,都证明了这件事。
它让行业意识到,在大模型的赛道上,算法效率、工程能力、训练方法,同样可以改变竞争格局。但现在DeepSeek V4需要回答的问题是,当所有玩家都瞄准下一代模型竞争,DeepSeek如何继续保持领先?
外界既是在等待一个新模型,也是在等待DeepSeek下一阶段路线的验证。
从时间线来看,DeepSeek在过去几个月经历了一系列变化。
最初,行业普遍期待DeepSeek V4能够延续V3的突破,在推理、多模态、Agent能力等方向再次制造惊喜。
去年12月左右,DeepSeek V4计划在春节前后发布,到了大年三十,智谱的GLM-5和Kimi-k2.5接连发布,V4仍未被端上桌。
有接近DeepSeek 的人士告诉我们,临到发布当天,DeepSeek 团队内部对模型效果仍不满意,于是临时改变了发布计划,V4发布推迟。
4月,DeepSeek V4终于发布了,但端上来的仍是preview版,1.6T的抢先版没有带来类似R1发布时的震撼效果。本来要在7月中旬推出的DeepSeek V4正式版,同样再次临时跳票。
短短半年,DeepSeek V4已经两次跳票。
同时,竞争对手比半年前更为快速地追赶DeepSeek。半年前,国产模型厂商的每一次模型发布,都会在测评横比时着重强调和DeepSeek R1、V3系列模型的对比分数,半年后,Coding成为生产力的第一大场景,模型厂商的对照组变成了GPT-5.6-sol,Fable 5。
近几个月,智谱glm系列在海外引发震动,公司市值一度超万亿。kimi k3发布后迅速成为当红炸子鸡,获得马斯克点赞,更是将国产模型的参数推到了2.8万亿的量级。
海淀区御三家,唯独DeepSeek V4依旧难产。
因此,很难说这次DeepSeek内部交流录音外泄,不是资方故意向外释放信息,以提振士气。毕竟,谁会甘愿自己投资的大模型落后别人呢。
如果是这样,梁文锋的处境似乎有些被动。
DeepSeek最大的资产,是一群相信长期技术探索的研究者。在梁文锋的表述里,这群人平凡,但是一起做出了不平凡的事,高专注力的团队也帮助DeepSeek摆脱了商业化的压力,在模型能力上实现快速突破。
如今融资刚刚落地,模型稍稍延期发布,就要受到资方的强行干预。这也意味着资方比梁文锋更焦虑。
大模型行业过去已经证明,延期并不一定意味着失败。真正的问题是,DeepSeek能否再次创造一个改变行业认知的技术突破?
所有人都在等梁文锋用V4进行一场公开答辩。