DeepSeek不做「更赚钱」的公司 梁文峰四小时投资人会议讲了甚么?
近期,DeepSeek完成了公司首次外部股权融资,募资总额约510亿元。在融资期间,DeepSeek创始人梁文锋和投资人进行了一场近4小时的交流会。
在4小时的交流中,梁文锋围绕公司初心与愿景、开源战略、API 定价逻辑、AGI 技术路线图、组织管理、算力差距、国产算力替代、行业终局展望八大主题,系统阐述了 DeepSeek 的底层思考与战略判断。
愿景驱动而非利益驱动
综合《第一财经》、自媒体《财通社》、《腾讯科技》、《IT之家》等梳理,梁文锋表示,公司成立的初衷并非为了赚钱或上市,最初的几十个人如果抱着这样的想法就不会加入。他认为,公司是怀着对世界的善意来做这件事,觉得这是对人类有用的、金钱以外的事情。
梁文锋引用杰克·韦尔奇(Jack Welch,美国通用电气(GE)前董事长兼CEO,被誉为“全球第一CEO”)的观点指出,管理大公司靠的不是规章制度而是愿景。DeepSeek是“愿景驱动”的,甚至没有成文的愿景,愿景体现在做事的方法和对待世界的态度里。他强调,公司并非按照商业利益最大化的方式来运作。在他看来,DeepSeek是一群平凡的人在做不平凡的事情——公司两年前成立时既没有很多钱、没有很多卡,也没有知名度和号召力。
开源最强模型,只赚合理利润
梁文锋明确表示,DeepSeek最强的模型也会开源,因为看不到闭源的好处。他认为在AI领域,开源与商业化没有冲突,AI市场足够大,可能占人类GDP的10%,不可能独占。“你越克制,越有可能做成这件事”。
关于API定价,梁文锋披露了“十个月收回成本”的定价逻辑——按十个月收回设备成本来定价,相当于六倍利润。他强调这不是利润最大化的定价,因为如果价格再翻一倍,token消耗量不会有明显变化。此前公司曾将DDCP模型价格降至四分之一,团队群里很多人欢呼。梁文锋表示,API定价仍有降价空间。
不求成为下一个字节腾讯,不会要求员工长期加班
其中谈到对于成为下一代超级应用的可能性,梁文锋表示,DeepSeek并不希望成为“下一个字节”或“下一个腾讯”。他认为,当前争夺C端流量或To B收入并不是公司最关注的问题,内部重点仍是AGI技术路线和突破。
梁文锋还提到,DeepSeek在2025年春节期间受到广泛关注并不在公司原本规划中,公司此前并没有以市场爆发作为主要目标。
在组织管理方面,梁文锋表示,保持团队稳定性是DeepSeek当前最重要的事情之一。他认为,稳定的研发团队是实现长期目标的基础。他介绍,DeepSeek的组织方式结合自上而下的任务安排和自下而上的探索机制。员工部分时间用于完成公司重点方向,另一部分时间可以自主研究感兴趣的技术问题。
梁文锋表示,DeepSeek通常不会要求员工长期加班,因为AI研究需要相对宽松的环境,同时公司也保持高度聚焦,不会试图快速补齐所有产品功能。
持续学习是下一个瓶颈
梁文锋阐述了AGI的技术演进路径:去年的阶梯是CoT(思维链),今年的阶梯是Agent。他认为站在Agent这个位置,下一个要解决的瓶颈是持续学习,让模型能像人一样持续学习,而不需要每次都给出完整上下文。
持续学习之后,模型将能够自己开发自己的下一个版本,进入自我迭代的“奇点”——但这不是突变,而是一个渐进过程。奇点之后才是具身智能,届时模型可以自己设计下一代机械人。梁文锋强调,多模态是组件而非主线,Scaling方面他相信规模越大效果越好,阻止Scaling的只是算力。
团队稳定是唯一核心利
益梁文锋表示,团队稳定性是公司最大的核心利益,甚至是唯一的核心利益。只要团队不走,就一定能做成AGI,只是早晚问题。他认为钱和资源都不是问题,其他最多导致晚半年或一年,但不会做不出来。
梁文锋指出,随着近期融资完成,团队稳定性风险得到了较大缓解,员工拿到的期权较多、金额较大。DeepSeek的人才流动在同行中一直较少。
中国AI落后美国12-18个月 差距在资源不在人
梁文锋认为,中美AI的差距主要在资源(算力)上,人上面差距不大。国内人才不缺,而且基数大,每年都有大量人才补充。人才的差距本质上也是因为算力差距——算力少,能做的实验就少。
他透露DeepSeek目前约有两万张H100等效算力,大部分是最近一两个月刚到。公司正在非常激进地扩充算力,在合理价格范围内能买多少卡就买多少卡。梁文锋表示,中国落后美国约12到18个月,但只用了美国二十分之一的算力做出了现在的成果。
与TileLang与华为合作
梁文锋对国产算力持乐观态度。他认为英伟达CUDA的护城河正在快速瓦解,原因有三:AI可以写代码来构建生态;DeepSeek的TileLang高级语言可以快速重写CUDA生态;AI计算市场已超过游戏卡市场,专用芯片趋势不可逆。
梁文锋透露,V3训练时虽用英伟达卡,但已不用英伟达生态,而是基于TileLang完成所有工作。他认为一年之内,国产芯片生态没有问题这一认知将被事实扭转。
关于华为芯片,梁文锋表示华为给DeepSeek约一万六千张卡的产能。华为950超节点在性能和价格上可平替英伟达GB200、GB300,四张华为950顶一张英伟达GB300,落后约两年。他认为国产芯片的问题主要在产能,而非生态或硬件。
终局差距在成本和时间
梁文锋认为,大模型竞争的终局差距体现在三个方面:成本、时间、用户体验,其中成本排第一。他不认为Anthropic超越OpenAI是长期现象,未来大概率会是交替上升。
关于行业格局,梁文锋表示中国做基模的公司太多了,一定会收敛到三四家。他认为大模型公司不可能拿走大部分利润,成本控制得好就多赚一点,仅此而已。
梁文锋强调,在现阶段聚焦AGI研究比做更多产品线、考虑更多商业化路径更划算。他认为过去三年任何时刻花很多时间做商业化考虑都是浪费时间,因为变化太快。但他也明确表示DeepSeek本质上是一个公司,需要考虑如何活下去,B端业务是重要的。
此前,根据工商变更资料,DeepSeek首轮外部集资已于近期正式落地,此次集资总额超过500亿元人民币,投后估值约520亿美元(约合人民币3500亿元),创下国产大模型公司的集资纪录。
7月15日,彭博社和《金融时报》同时曝出,DeepSeek已经启动第二轮融资,投前估值710亿美元(约4800亿人民币),比上一轮涨了37%。与此同时,公司已在筹备IPO,最快今年底递交申请,2027年挂牌上市。
因此,国内亦有舆论认为,该内部讲话的迅速传播,或与资本方为DeepSeek第二轮融资的造势有关。