过去一个月,围绕梁文锋和 DeepSeek,外界最关注的始终是那场传说中的“四小时投资人会议”。随着更多谈话内容流出,人们看到的已经不只是融资细节,而是一套关于 AI 行业未来的完整思考。
从国产算力、模型研发,到开源策略、商业化路径,再到 AGI 的发展方向,梁文锋几乎回应了当前行业最核心的每一个问题。他反复谈到成本、效率、数据、工程能力,以及组织如何围绕长期目标运转。在他看来,大模型竞争最终会回归几个最基础的维度:谁能够把成本压得更低,谁能够更快完成迭代,谁能够持续提升用户体验。价格、算力、模型、商业模式,这些看似分散的话题,都围绕着同一套逻辑展开。
这些观点中,有不少与行业流行的叙事存在差异。他相信开源能够成为竞争优势,相信合理利润足以支撑一家顶尖 AI 公司持续发展,也相信国产算力将在未来几年逐步建立起完整生态;他将 Coding Agent 视为现阶段最重要的突破方向,希望模型首先能够帮助团队提升研发效率,再不断推动下一代模型演进。
把这些零散的回答连在一起,会发现 DeepSeek 对自己的定位十分清晰。它希望建立的是一套能够持续降低成本、持续提升智能、持续加快研发速度的工程体系。对于梁文锋来说,AI 的竞争远没有结束,真正决定行业格局的,也许不是某一次模型发布、某一个榜单成绩,而是谁能长期保持更高的工程效率,把技术优势不断转化为产品优势和商业优势。以下,enjoy:
DeepSeek近日完成成立以来的首轮外部融资。本轮募资总额超500亿元人民币(约合74亿美元),投前估值约3675亿元(约543亿美元)。
在此之前,梁文锋曾提出“不融资、不上市、不商业化”的原则。此次大规模融资标志着DeepSeek正式走向资本市场,也引发了业界对其商业化路径与技术愿景的广泛关注。
在近期的一场投资者交流会上,梁文锋详细阐述了DeepSeek的组织文化、开源逻辑、技术路线图以及对行业竞争格局的看法。
以下为腾讯科技获得的近4小时的交流会中梁文锋发言实录整理,按主题分类,共计118条,文本尽可能保留原意,仅略作编辑。
01
愿景与克制
1.我们一开始来做这个公司,初衷没有想到说我最后要赚多少钱,要到资本市场上去,要上市,要怎么样的。最开始的几十个人完全没有这么想过,如果他这么想,他就不会来。
2.我们是怀着一个对这个世界非常大的善意来做这个事情,我们觉得这是对人类有用的,这是一个金钱以外的事情。我们出发的初衷、我们的愿景,以及我们保持到现在的这个愿景,不是按照一个商业利益最大化的方式来做的。
3.管理一个大公司,靠的不是你的规章制度,靠的是愿景。愿景不是挂在墙上的标语,愿景是你怎么做,不是怎么说,就是你怎么实际运行。
4.我们是没有组织的,就是愿景驱动的,靠一个愿景来组织。我们并不是以一个“我要实现什么KPI、没有考核”的方式来做,只有愿景。
5.这个愿景甚至也不是成文的,并不是写出来的,没有写出来过任何东西。这个愿景是在我们做事情的方法、我们对待这个世界的态度里。
6.我们并没有非常多的其他优势,我们没有什么本事,我们并没有比别人有钱,也没有说我们人员比其他公司更好,其实没有的。我们两年前成立这个公司的时候,我们又没有很多钱,又没有很多卡,又没有什么知名度,又没有什么号召力,我们就是一群非常平凡的人。
7.你越克制,可能就越容易做成,或者说至少到目前为止是印证的,到目前为止是能解释得通的。否则没有办法能够解释为什么我们能够做成:我们并没有什么武器,起点又非常低,资源又非常少,我们的人其实也就是随机的一群平凡的人。
8.AI这个事情太大了,利益太大了。我们非常克制,只要能够做成,最后利益都会非常大。你随便分一点,利益就非常大,所以现在根本不用考虑拿这里面的哪一部分利益、怎么拿,我觉得根本不用考虑这件事情,因为这个利益足够大了。
9.我们去年春节用户突然很多,但是我们并没有去追求我要留这些用户,或者说拿这些用户来变现,或者说我要去抢这些商业利益,在用户上面兑现。我们没有去抢用户,没有去赚钱,但我们很努力想办法把用户服务好。
10.我们并不会有这样的想法,说我要做成下一个超级App,然后我要去跟谁竞争,我要做成下一个字节、做成下一个腾讯,完全没有这样的想法。我觉得后面的AGI机会应该是非常大的,后面的AGI机会永远是非常大的。
11.克制是一种战略。就在于有时候你可以舍弃一些,来换更多其他的东西。不开源这个事,其实也是一样的,也可以认为是我们的压力,也可以认为是我们的让利。
12.这种克制,我理解是这种克制从长远上来讲,能够增加我们做成AGI的概率。在考虑一件事的时候,我是毫不怀疑AGI会有非常大的商业价值。那么在这个基础上,我优先考虑的不是我怎么多加一点份额,我怎么多拿一些份额,我优先考虑的是我怎么增加我能够做成的概率。
13.我们一直非常克制,不愿意跟任何一家互联网大厂或者小厂成为对手。我希望我能够给他赋能,或者希望我能够协助大家去做这个事情,希望能够帮助大家做这个事情。
14.我觉得我们之前秉持这种态度,其实我们并没有因此而少拿到任何东西,并没有因为我开源,并没有因为我们的善意或者说我对其他人提供帮助,而导致我们少拿了任何东西。反而可能还有加分。这个看起来违反直觉,但它确实是这样的。
15. 我们是以AGI为目标,但是我们一直在做商业化,所以我们才有C端的用户,才有B端的收入。从历史经验来看,这个策略是成功的。
02
AGI路线图
16.如果说你能够把一个问题描述得很清楚,给它完整的上下文和指令,它已经超过人类了。但这里有个定义,有个前提是:你给它完整的上下文,给它完整的指令。
17.AI并不能够替代你的员工。但如果说AI具有持续学习的能力,它跟你的员工一样,到公司学习两个月,那么就可以替代天下的人了,所以我们离下一步还差一个持续学习。
18.AI的发展,我们可以理解成它是一个阶梯。去年走的阶梯是思维链。因为我们发现,通过思维链的方式,可以让智能达到一个更高的水平。
19.今年的阶梯就是Agent,因为我们发现,用Agent的方式,即便多些事情也可以做,它的能力范围会更大,它的智能上限会更高。Agent要用到CoT,然后CoT也要用到前面的阶梯,前面的阶梯就是语言模型,所以它并没有一步是白走的。
20.在Agent之后,我们觉得应该要解决的问题是持续学习,就是怎么让模型可以持续地学习,而不是说你要给它一个很强的训练,它应该能够像人一样做一个比较长时间的持续学习。
21.持续学习之后,可能我们就会来到一个奇点。这个奇点就是,当这个模型能够持续学习之后,它已经能够做人类能做的所有事情了。它就能够自己开发自己的版本,能够自己再研究,然后开发自己的下一个版本,开发更靠前的人工智能模型。
22.这个奇点,它并不是一个奇点,它也是一个渐进的过程。这个过程可能也是一个比较长的渐变,它不是个突变。但是习惯性地,我们都认为它可能是个奇点。
23.这是我们的推测,这是我们觉得这个时间表应该是:先解决学习去学习,然后再到那个智能的奇点,能自我迭代的奇点,然后才是具身智能。到具身智能之后,它就走进现实世界,可以给你做家务,可以给你养老。
24.如果说我们先解决持续学习,再解决那个自我迭代的奇点,再解决具身智能,这个路上就很轻松。因为到后面之后,你可以用前面的技术来帮助开发后面的技术。
25.我们只做AGI的主线。AI领域很广泛,有很多东西我们觉得它不在这个主线上面,比如说3D、视频生成,我觉得可能跟智能的主线没有太大的关系,我们不会去做。
26.视频生成一开始出来的时候就很火,好像这是必须要做的,如果你不做,你就不是一个AI公司一样。所以我就很奇怪,这个其实你只要仔细去想一下,它跟智能的路线图是没有什么关系的。
27.在商业上,它是个好生意。但是这跟智能没有什么关系。我们不会因为它是一个好商业而去做它,我们只会因为它是智能路线图上的东西,才会去做。
28.从我们的判断,世界模型和智能还不是现在这个阶段最重要的事情。最重要的才是AI训练,以及AI训练之后怎么解决持续学习。这是我们公司的判断,当然每个公司它的判断是不一样的。
29.我们现在比较相信一个叙事是,AI可以加速AI的研究。就是说,它不是线性的,因为你可以用AI来加速你自己的研究,所以它到后面可能是非线性的。
30.我觉得具身肯定还是要进入。因为对一个正常人来讲,他的需求并不是电脑,对不对?因为正常的人,他吃喝玩乐、衣食住行,他不需要电脑。他需要的是,所以他还是需要具身智能来解决具体人力的需求。
31.我们希望AGI能做什么呢?它能帮我迭代下一版模型。如果有了具身之后,我们希望它做的也是,让它来迭代下一版的具身,它来做下一版机器人。
32.下一代模型的核心能力,必须要有持续学习的能力,它才能叫下一代模型。在那之前,我们能做的就是成本,然后效果做得更好,速度做得更快。但是要有大突破,它应该是具备持续学习的。
33.现在的Agent的能力受限,是因为它不能持续学习,它不能有效地持续学习。如果说能够先把持续学习做完,那AI的能力是非常强的,它能够非常大地提升我们自己研究的效率。
34.持续学习先做出来,通用智能可能就很容易了,用它来做就很容易。所以我说这是一个我们比较希望看到的结果,我们比较省力,我们就轻松。否则现在你要去人工做通用智能,它是一个比较累、比较苦的事情,是一个数据密集、人力密集的事情,性价比也不高。
03
团队与人才
35.我们前面的经历给我的启示是,AGI这个愿景是很强大的。这个人才优势不是说我的人比他更聪明,而是这些人才我怎么组织起来,怎么激励他,然后怎么合作。
36.你把聪明的人聚在一起,并不是说他自然而然就能够合作,自然而然就能够非常有激情地去奔一个目标、去完成的,所以你需要一个愿景。
37.我们最大的核心利益是要保持团队的稳定性。这是我们最大的核心利益,甚至可以认为是唯一的核心利益。只要我能够保持团队的稳定性,我一定能做成,一定能做成AGI,就这么简单。
38.钱肯定不是问题,资源不是问题,其他要素都是容易获得的。对我们来讲,只有一个核心利益,只有一个没法退让的:我们必须要保持团队的稳定性。
39.这也是我们面临的一个非常大的挑战,或者说,我觉得是最大的风险。当然,这个风险随着我们近期的这一次融资,得到了比较大的解除。因为大家拿到的期权都还是比较多的,金额还是比较大的。
40.从团队稳定性来讲,只要最重要的一些员工、最老的员工能够稳定,那么其他人是不太会走的。其他人哪怕期权少一点、收入少一点,他也不会走。因为他不是全奔着钱来的,大家都希望在一个能够做成AGI的环境里面去做这个事情。
41.其他都是时间问题,其他最多导致我们晚半年、晚一年,但是不会说做不出来。肯定是不缺钱,肯定是不缺资源,其实这些都是不缺的。
42.我们跟美国的差距主要在资源上面,然后人上面差距不是很大的。人上面几乎没有差距,因为就是同一批人,可能是中国人。中国人出去的时候,有一些人留在国内,有些人留在国外,有些人去国外,他并没有说是聪明的人去国外,没有的。
43.人才不是瓶颈,资源是最大的瓶颈。资源首先影响到人才培养,因为算力少,我们能做的实验机会比较少,所以我们的人才整体上比美国有差距。人才的差距,本质上也是因为算力的差距。
44.AI人才的短缺也是阶段性的,并且我们已经看到,大幅度被缓解了。因为AI人真的不缺,每个公司很快会把人培养出来,培养人是很快的。
45.国内现在做模型的公司有点太多了,还是太多了。美国可能就三家,中国做基模的东西太多了。最终一定是不需要那么多人去做基模的,一定会收敛。
46.我们公司的管理其实是两条线:一条线是从上到下,一条是从下到上。从下而上,就是每个人自己想做什么,自己做,没有人管他,没有KPI。
47.一般我们希望员工还有一半的时间,是不被安排的,他想做什么就做什么。这是一个研究的范围,让他可以自己去探索,按照他觉得什么重要,他去探索什么,没有前置的要求。
48.我们一般也不太加班。加班有两个原因。第一个是,做研究是需要一个比较松弛的环境。你如果逼得很紧,就没法做研究。因为既然就是要你自己有这个兴趣,你自己平时要去想这些问题,所以得是在一个比较松弛的环境里,才有可能能够探索。
49.第二个是,我们非常聚焦。我们非常聚焦,就意味着我们要做的事情很少。那我就没那么多事情要做,我就不需要加班。这个跟前面的克制是一脉相承的。
50.我们公司整体上是建立在共识的基础上的,我并不是说我一个人决定所有事情,而是我要寻求共识。我在公司内的权威以及在公司内的影响力,是建立在共识的基础上的。
51.这个决策机制其实是一种寻求共识的机制,这并不是说我能够推动一个什么事情,它一定是共识,我才能够推得下去,然后我才会去推。
52.随着人员的增加,我们会做这个调整。应该是我们马上就得做这个调整,因为我已经在做这个调整。不做这个调整的话,很多事情是没法推进下去的。确实有很多部门,是应该有组织架构的。
04
算力与资源
53.我们需要多少卡?现在肯定是越多越好。在我们能够承受的范围内,肯定是卡越多越好,这是毫无疑问的。所以我们现在策略是,在合理的价格里面,能买到多少卡就买多少卡。
54.实际上,要把这么多钱花完非常不容易,买不到那么多卡,很难买,而且价格也很高,也不能说花非常高的价格去买,还得确保这个价格是合理的。
如果今年能够花掉两百亿,那么就属于我们的采购部门业绩超级好了。
55.我们跟美国之间最大的差距是在资源上面。算力资源一方面是国内本身卡就买不到,另外一方面是我们的资本投入比美国要少。我们在资本投入层面上少了很多,基于人才的工资在这里面占的比重是很低的。你看他们开的薪水一个亿美金这种,但算起来,人才的薪水还是占比很少,大头还是算力。
56.我们看到的所有区别,包括人才的区别、模型能力的区别、应用的区别,可以认为都是因为算力资源上的区别。
57.我们跟美国的差距可能是落后美国12个月,落后美国可能12到18个月,或者说6到12个月。反正简单说,就是落后美国两年,然后只用美国二十分之一的算力把这个事情做出来。
58.这个叙事就是落后一到两年,但是只用它二十分之一的算力。那么未来我们要把这个叙事改写,就是我们用它几分之一的算力,但是把这个时间缩得更短,缩到6个月、3个月,我觉得这是一个目标。
59.Scaling,我们是信Scaling,肯定是规模越大,效果越好,能够解锁更多的功能。阻止我们Scaling的其实就是算力,并不是我们不想Scaling,是我们没有那么多的算力去做这个Scaling。
60.我们训练这么大的模型,并不是因为我觉得这么大的模型就够了,而是我刚好有这么多资源。我是按照我的资源来算,我能够接受、能够训练的模型是多大,是这样算出来的,并不是这个模型就够了。
61.硅谷在说Scaling到头的时候,那是对硅谷来说;对中国人来讲,我们离那个还很远,我们根本就没有Scaling到那个程度。这个Scaling包括数据的Scaling、模型规模的Scaling,然后训练成本。
05
国产芯片与生态
62.英伟达CUDA的护城河在快速地被瓦解。一方面是现在有了AI,然后有了AI之后,我要建立起这个生态比以前容易很多了,因为AI可以写代码。
63.现在计算卡的市场已经比游戏卡更大了,就没有理由这两个还需要耦合起来。现在的趋势是,以后就不再耦合了。那么专用芯片,不管是华为还是英伟达自己,以后都是专用芯片,都不是之前的这些东西了。