8月第一周,谷歌灵魂人物Jeff Dean宣布离职,带着其它几位高管出走成立Discovery Loop公司,致力于加速生命科学及其他行业的研究进程。


在硅谷,这标志着,AI for Science这个赛道,开始爆发。


就在众多数学家、物理学家、生物学家加入OpenAI和Anthropic等顶尖AI实验室之际,AI正在改变人类研发科学的范式。OpenAI宣布模型Astra推导出了10道人类长期悬而未决的数学难题,Anthropic未发布科研版Claude将黎曼猜想的相关零点下界从41.6%推进至67.2%,同时,AI在生物制药、材料、物理等领域都在迅速将科学前沿快速推进。


对话前DeepMind曹原:AI for Science爆发,一个新时代到来了


而AI自进化,形成研发闭环,是科研加速的核心。但这中间,人的角色,稍显尴尬。


这篇文章,我们和谷歌DeepMind前资深研究科学家曹原,一起聊聊AI for Science。 我们从AI科学自进化的方法论,聊到AI数学和AI物理的应用,最后甚至还聊到了一些哲学问题和人类的意义。以下,就是我们和曹原的对话。


对话前DeepMind曹原:AI for Science爆发,一个新时代到来了


陈茜曹原,非常欢迎你来做客硅谷101,跟我们的观众介绍一下你自己吧。


曹原:大家好,我叫曹原,之前是Google DeepMind的科学家。我也是AI初创公司Unreasonable Labs的联合创始人。我们的公司主要研究AI for Knowledge Creation(知识创造)、AI for Science,以及R&D(研究与试验发展)。


对话前DeepMind曹原:AI for Science爆发,一个新时代到来了


陈茜我们今天录制的时间很巧,就在昨天(2026年8月6日),谷歌的Jeff Dean宣布将带领一批科技高管创办一家新公司Discovery Loop,他们也希望做AI for Science(AI4S)相关的事情。我看到很多评论都很唏嘘,说这是一个时代的结束,也是另一个时代的开始。我的理解是,结束的是谷歌的一个时代,开启的可能是一个新的AI4S科学研究时代,可以这样理解吗?


曹原:我认为这件事可以从几个方面解读。


第一,谷歌和DeepMind内部一直有很多优秀人才和团队。过去每个团队都有各自关注的课题,相互之间干涉不多。但从三四年前Gemini项目启动之后,因为它是公司最重要的项目之一,需要集中力量办大事。从那时候起,这对组织、人事和项目管理都带来了很大挑战,内部出现一些冲突也很难避免。


第二,过去半年左右Gemini的表现相对不尽如人意。比如今年年初,Gemini 3.1 Pro在排行榜上还算是比较好的语言模型,但过去三四个月,无论Anthropic、OpenAI,还是中国的一些开源公司,模型能力都在快速提升。相比之下,Gemini 3.5 Flash和最新的3.6 Flash表现相对平平,大家期待的3.x Pro目前也还没有正式发布。总体来看,Gemini的进度相对落后。在这种情况下,谷歌如果要在商业模式上追赶Anthropic以coding agent(编程智能体)为核心的新能力,把商业模式转向这个方向,也会面临很大困难。


第三,Jeff Dean, Oriol, Sanjay和Quoc创办Discovery Loop这件事,本质上是让AI自主进行知识开发、知识发现和自动科研,这与我们的创业公司想做的方向非常一致。在逻辑上,这也是AI能力发展的自然延伸。过去两三年,行业最关注的能力主要集中在数学和编程,比如自动写代码、解决奥林匹克数学问题等等。等这些能力逐渐成熟之后,下一个可能让AI智能进一步爆发、产生巨大效益,并帮助人类解决更大问题的方向,很自然就是把数学和代码能力推广到更广泛的科学知识发现上。所以从今年开始,围绕Knowledge Discovery(知识发现)、AI4S和Recursive Self-Improvement(递归式自我改进)的初创公司明显增多。像Jeff, Oriol, Sanjay和Quoc这样的明星团队出来做一个创业公司,他们一定会想要在这个领域树立新的标杆,成为一种新的NeoLab(新型AI实验室)。


但如果因此就说“一个新时代开启了,谷歌可能转向了”,我认为有些言过其实。因为哪怕领导层出现了变动,谷歌仍然拥有做好语言模型、做好AI所需的完整全栈能力,从底层芯片、基础设施、数据中心、工具链,到模型、人才、数据,再到上层产品和覆盖非常广泛消费者产品的分发渠道,谷歌全部都有,完全不依赖外部生态。问题不是谷歌做不好,而是优先级和资源投入需要调整,我相信谷歌以后仍然会把这些能力补上来。


陈茜我还是很好奇,你刚才提到,谷歌内部本来就有AI4S研究团队,这也是前CEO Demis Hassabis一直非常看重的方向,甚至还独立主导了Isomorphic Labs这家公司。为什么谷歌留不住包括你和Jeff在内的这批科学家,让他们继续在谷歌内部做AI4S呢?


曹原:首先,硅谷几家前沿科技公司之间的人员流动一直都很频繁,不只是谷歌。对我个人来说,我之所以决定出来做这件事,是因为之前一直在做Gemini的模型迭代和后训练,但我一直在思考一些更深层的问题,比如怎样让模型真正变得更智能。如果要实现AGI,目前的模型虽然已经能很好地做数学和写代码,但仍然缺少一些关键能力。比如要真正解决科学问题,它需要提出新假设、验证新假设,并不断自我更新,但现在这些能力离“帮助人类实现科学知识指数增长”还很远。为什么会缺失这些能力?怎样进一步改进模型,使得它能帮人类做更好的事?这是我非常感兴趣的问题,也是我决定选择出来创业的动机之一。


陈茜那Jeff Dean为什么要带人离开?能不能猜测一下?


曹原:Jeff Dean在谷歌乃至整个业界都是传奇式人物。从整个谷歌早期一直到现在,大量英特网级别的基础设施都是从他的一些工作开始的,从MapReduce、Spanner、BigTable,到后来创立Google Brain,再到最早的深度学习框架之一TensorFlow、Google TPU(谷歌张量处理器),再到最后的Gemini。跟他一起出来的Oriol和Quoc都是早期Google Brain团队成员,他们已经共事了很长的时间。


对话前DeepMind曹原:AI for Science爆发,一个新时代到来了


Sanjay也是谷歌元老,几乎与Jeff Dean同期加入,也是长期合作的伙伴。所以,他们相互之间都非常了解。我以前在办公室里经常看到Jeff Dean和Sanjay做pair coding(结对编程),两个人一起写代码,他们每周是有一天是必须写代码的,Jeff一直也是非常亲力亲为。所以如果他们决定一起出来做自己的事情,这是一个很顺理成章的组合,他们彼此了解,也都有很强的技术背景。


陈茜目前不仅Jeff Dean离开了,更早之前,AlphaFold联合创始人、诺贝尔奖得主John Jumper也加入了Anthropic。过去我一直认为谷歌是最重视AI4S路线的公司之一,Demis Hassabis也长期主导这条路线。所以最近接二连三有核心人物离开,还是让我很惊讶的,为什么谷歌留不住这批科学家呢?


对话前DeepMind曹原:AI for Science爆发,一个新时代到来了


曹原:因为谷歌现在内部的最高优先级,肯定是把Gemini做到SOTA(业界最佳水平),至少与Anthropic和OpenAI齐平或者更好。所以短期内很多工作的优先级都必须向Gemini转移,包括Jumper以及原来一些做AI4S的人,他们的工作重心也会随之变化。一个团队这么大,又有一个极高优先级的项目,不可能让每个人都完全满意。所以怎样让这么多人才,每个人的能力和诉求都得到充分体现和合理安排,本身就是非常有挑战的问题。我认为谷歌已经在这方面做了很多优化和调整,能够让他们每个人能够发挥自己的最大的潜力,管理团队、科学家和工程师也都在不断迭代这个过程。在管理上的挑战仍然很多,但我认为状况是在变好的。


陈茜你怎么判断它在变好?


曹原:现在做大模型,不能再沿用过去大公司的管理方式,因为它需要非常快的迭代和持续更新。谷歌要做的是“革自己的命”,把Gemini团队尽可能做得像一家初创公司,尽快把能力先补上去这意味着管理团队必须在人事安排、每个人承担的工作以及整个项目的安排上做出调整,需要有自我革新的勇气。我相信谷歌已经意识到这一点,也会继续做这件事。


陈茜所以是不是接下来如果有新的血液加入,也可能带来新的变化。比如Meta在Alex Wang加入之后,最近已经出现了一些改善迹象,包括Muse Spark以及最新的编程模型,外界反馈都不错。


对话前DeepMind曹原:AI for Science爆发,一个新时代到来了


曹原:对,肯定会有变化。做一个模型有几个关键要素,包括人才、数据、算力,以及大家容易忽略的项目管理。整个软的设置,每一项都需要一些改进,并且持续迭代更新。对Meta来说,MSL(Meta Superintelligence Labs,Meta超级智能实验室)在不到一年的时间里做到现在这个水平,已经很不容易。但是接下来,怎么从这个水平进一步做到SOTA(业界最佳水平)会越来越难。从0分做到80分,可以在一定时间里快速追赶,但从80分做到100分,甚至超过100分,挑战会大得多。谷歌原本就在较高水平上,但接下来怎么能进一步往上,做到最好的位置?这会需要花很多功夫,需协调很多资源,也需要大家都能非常有效地安排各项工作,来快速迭代模型才能做到。


陈茜那AI for Discovery(AI发现)和AI4S,仍然会是谷歌重点押注的方向吗?


曹原:会是的。前两天Sundar发的邮件里也提到,Demis虽然从DeepMind CEO的位置退下来,但仍然主管AGI和科学相关部门。谷歌在所有AI科技公司里,可以说是布局科学最早、最广也最深的公司之一,整个生态体系也做得最好。怎样用AI自动驱动科学和技术发展,是太重要的课题,不只是对一家公司重要,对社会乃至国家都非常重要。人类社会的发展最终还是由科学和技术推动,现在已经有了这么强大的AI工具,就一定要继续把这项能力往上推。所以谷歌不会放弃AI4S,只是短期内会有优先级调整。而且我相信,虽然Demis现在转为做Chairman(董事长),但是他一定会在AI4S上还继续做很多努力。


陈茜可不可以理解为,Demis现在退后一步,是因为他不太想管商业化和产品,而希望把更多精力专注在AI4S上?


曹原:我认为这是原因之一。Demis一直更看重长远的发展,特别在技术方面。他个人的气质也更像科学家,而不是负责产品和商业的CEO。DeepMind和Google Brain当时合并,很大程度上就是为了更快推进Gemini、能够赶超GPT。但在合并之前,DeepMind在伦敦,当时是长期投入了大量精力在Alpha系列等科学研究上。后来很多商业产品的落地和产生的效益,其实也是建立在这些先驱性研究成果之上。


比如现在AI for RSI(递归自我改进),以及AlphaEvolve可以推动算法自动更新,AlphaFold更不用说,已经获得诺贝尔奖,并进一步商业化为Isomorphic Labs。现在,Demis更像是做一个咨询类的顾问。长远来看,我认为谷歌既有能力,也有责任继续推动长期科技和研究发展,而Demis非常适合这个角色。


对话前DeepMind曹原:AI for Science爆发,一个新时代到来了


对话前DeepMind曹原:AI for Science爆发,一个新时代到来了


陈茜同时我们看到OpenAI和Anthropic也都在把AI for Discovery和RSI纳入重点布局。在具体聊这三家公司之前,我们先把几个概念梳理一下:AI4S、AI for AI(AI4AI),以及RSI(Recursive Self-Improvement,递归式自我改进),这三个概念分别是什么意思?


曹原:其实很简单。AI4S和AI4AI,都是把AI模型当成研究员本身,让它去研究科学问题,或者研究AI自身的问题。以AI4AI为例,如果模型已经很聪明,怎样利用它的聪明才智进一步改善模型本身的问题?比如给它一个任务:在限定的预算下,用最少的资源、GPU,怎么把模型训练到最好。人当然可以做,但如果让AI自己做,它可以更快尝试大量新想法和实验。比如它看了当前模型的代码库,发现某个参数可能需要调高,于是提出一个方案,生成一个建议,可以试一下先把这个参数调高。


AI agent的能力现在已经很强了,它也可以自动写代码来实现自己的提议,在沙盒里运行实验,再观测模型的训练结果,读取数据之后再做反馈、提出下一步。如果发现把某个参数调高之后,模型效果变好了,它就沿着这个方向继续尝试。根据不同的反馈,进一步生成下一步的建议。这样一轮轮迭代,模型性能不断提升,这就是一个自我不断回归的过程,也是一个典型的AI4AI应用。


现在也有一些AI4AI公司在探索能否找到不同于Transformer的新架构,这可能需要很多的搜索或者新的想法。也有公司在探索,AI4AI能否找到不依赖Backpropagation(反向传播)的新优化算法。这类研究问题用AI去做都是更高效的,因为需要搜索大量可能性,而AI可以更高效地完成整个闭环。AI4S只是把研究对象换成科学问题,方法本质上类似。


对话前DeepMind曹原:AI for Science爆发,一个新时代到来了


RSI不是一个任务,而是一种方法:通过Recursive Self-Improvement(递归式自我改进),让系统通过不断自我迭代的方式更新任务、方案,从而自己把任务越做越好。


陈茜也就是说,AI4S和AI4AI类似,只是目标不同,而RSI是一种方法,可以同时用于AI4AI和AI4S。那为什么偏偏在2026年8月这个时间点,AI4S开始爆发?它当然不是一夜之间就爆发的,前面已经有AlphaFold、RoseTTAFold等一系列模型的进展。此时此刻,有哪些技术的成熟,才让AI4S在这个时间点爆发了?


曹原:过去两年AI的发展,主要是在代码和推理能力上,最能体现这两个能力的就是编程和数学问题。等AI能够比较可靠地写代码,同时智能体的Harness(挽具/驾驭系统)也成熟之后,就可以开始让AI去做更复杂的科学问题。比如做一个生物实验,第一步,模型要提出假设,决定下一步做什么实验,这需要推理能力;第二步,实验得到数据之后,模型要自己写代码分析数据,看结果是否符合预期,这需要很强的代码能力;第三步,如果数据异常,它还要分析原因,判断前一个方案哪里有问题,不断地自我迭代。


所以真正需要的是一整套能力:推理、数据分析、数学、代码,以及整个agent loop(智能体循环)和长期记忆管理。每次实验之后,系统都要把之前观测的结果放到记忆管理的容器中。等这些能力都到位,才能更好地处理科学问题,因为科学问题的范围更广、复杂度也更高,比单纯的编程和数学更具挑战。


陈茜所以现在可以说是“天时地利人和”,到了我们在AI4S能力上去发展的阶段。AI4S下面还有很多细分方向,目前讨论最多的、最聚焦的还是材料、生物制药,以及AI for Semiconductor(AI半导体),也就是用AI设计芯片这几类,为什么这些领域最先受到关注?


曹原:一个科学领域对AI4S有没有吸引力,主要由几个因素决定:市场的潜力与规模、是否适合用AI做、研发的迫切性,以及AI目前能不能做得好。传统上,生物学、生物科技、生命科学和药物