所在位置:

首页

>

正文

孙茂松 欧洲科学院外籍院士、清华大学计算机科学与技术系教授、人工智能研究院常务副院长

2026年07月03日

来源:中国国际贸易促进委员会北京市分会

各位领导、各位嘉宾,大家下午好!

实际上京津冀三地合作我想咱们各级政府已经有了非常好的部署,都非常到位。刚才还有一系列的签约活动,说明我们三地都按照政府的部署在紧锣密鼓往前推进。

这块其实太实的东西我们作为学者讲不太出来了,感觉人工智能+那个+离应用越深其实离学术界越远,所以我们多少有点爱莫能助了。所以务实的东西讲不太出来,我只能讲虚一点,务虚的角度讲一点。

我今天讲的题目是生成式人工智能与知识生产创新。大概的背景是希望和面向未来的人工智能创新生态相结合。

大家知道欧洲的工业革命,其实大家感觉这个是一场技术的革命,正如诺贝尔经济学奖指出的,其实工业革命的起点不一定就是某一项单一的技术发明,而是从16世纪到18世纪欧洲所经历的一场文化的转型。这里面17世纪最有名的一句话我们都很熟悉就是培根的知识就是力量。培根有一个叫做培根计划,在欧洲工业革命酝酿欧洲工业革命过程中发挥着非常重要的作用,所以我就想讲讲和知识相关的,看看我们人工智能特别是生成式人工智能带来知识的这种创新可能为我们未来的人工智能整个创新生态带来什么影响。

人工智能知识生产我认为至少和两个关键因素密切相关的,一个叫做知识的产生,一个叫做知识的传播,在传播过程中包括知识的学习。这两者相辅相成,一般认为好的知识是好的传播的动力源,好的传播可以通过知识的教化作用在人们利用所学来解决各类问题,包括生产和生活实践中催生更好的、更多的好的知识。这两者是相辅相成的,有一句古话来讲叫做还复转运,终是无端,《易经》中的一句话。

那么我们回顾历史,从历史的角度来看知识的产生在漫漫历史长河中由少数智者主导的,在中国子曰,他是孔子产生的知识,少数智者。那么随着时代向前发展智者群会逐渐扩大,但是总的来讲还是少数人来决定了知识的产生。但是进入到互联网时代发生极具的变化,普罗大众都可以参与进来,最著名的例子就是维基百科。维基百科是老百姓做的一个,它比专家精心编撰的现在看来它的影响大得多,包括对大模型训练的影响,维基百科发挥重大作用。所以这个是一个重大的变化,在知识的产生。

那知识的传播这个变化就更加令人振奋,我们想大概几个阶段,一个是以语音为载体的口口相传,这个时候还没有语言,是语音口口相传,比如说孔子教给他的弟子,那个时候当然不对了,应该再早。比如说我们在三皇五帝时代,那个时候口口相传以语音这种知识传播。

我把这种传播叫做一对一的传播方式,往往智者把知识传播给某一个值得信赖的人,比如说嫡传弟子,这种传播的话范围是极其有限的,而且隔代传播非常非常困难,差一代知识可能断线了。再就是文字出来,以泥板、莎草纸、甲骨、竹简、绢帛为载体的这种文本手抄。这个大概比较著名的就是像我们中国就是甲骨文,当然最早是大概6500年前,就是在两河流域发明的楔形文字,这种我叫做一对一加,流传的人数会多,但是本质上是一对一加,隔代传播好一些,但是还是比较脆弱。

第三个阶段是以纸张为载体的图书印刷,纸出现了。这块叫做一对多的大规模传播模式,多是指很多。其实这个东西直接引起欧洲的文艺复兴运动等等,和印刷机关系非常密切。到最近一百来年的话以广播电视、电影为载体的模拟及数字内容生产,我这个叫做1+对多传播,这个不是一个智者,往往是一个团队做一个作品向多,向大众传播。到最近的三十年是以互联网和社交网络为载体的跨模态数字内容生产,这个叫做多对多大规模传播模式。这个时候老百姓参与进来了,所以多对多。

这个是知识传播的范式。这里想强调一句,无论是文字、纸张、印刷术,还是模拟和数字通信互联网等等,无一不是当时的重大科技发明。这块我们有时候会有误解,比如说文字好像会是一个文化的产物,其实我个人认为不是,是重大的技术发明,是了不起的技术发明。我们现在大模型之所以语言大模型能够取得这么大的成功,实际上是和我们人类发明了文字是密切相关的。我们在没有文字的地方其实大模型的发展会非常困难,比如说具身智能,当然现实世界比语言文字简单,但是实际上没有文字缺乏这种高度形式化的手段,具身智能走到现实世界是比语言大模型取得和语言大模型一样的成功难得多得多,这一点要有充分的认识。这个是一个叫做无一不是。

第二个无一不是,就是无一不是科技的一次次重大进步导致了知识生产的一次次范式创新,这个很显然。甚至人工智能又引发了知识生产的又一次范式创新。这里面有一个最重要的过程,我们之前所有生产这里无论是什么生产,人是其中唯一的一个主体,现在变了,现在增加另外一个全新的主体是机器,所以现在影响是人和机器共同作用,既可以是人也可以是机器,人和机器可以混到一起,这种情况是之前从来没有过的。

另外的话我们现在语言大模型这几年发展具有强大的语言生成能力,同时具有比较好的开放式语言理解能力,这个的话我用一句话来强调一下实际上从盘古开天地以来从未有过的局面。大家不要小看这一点,盘古开天地三皇五帝到如今从来没有过的局面,几千年未有之大变局。取得这样一个进步有很多技术上的创新,包括我们知道的像向量表征、自注意力机制、强化学习、思维链等等都是基于架构的,加之我们所谓的Scaling Law,大参数、大数据、大模型以及复杂系统出现的、涌现的这种机理,很多因素奇妙的作用才产生了这些要素的风云际会,才造就了这一人间奇迹。真的是人间奇迹。

特别是我们把它这个东西做出来了,但是为什么会产生这种这么好的性能?对它的机理我们搞不清楚。我们制造了它但是搞不清楚它的机理。所以人间简史三部曲作者讲了一句话叫做人类文化基于语言,而人工智能已经破解了语言,现在可以开始创造文化。现在人工智能可以创造文化,这个是在我刚才讲文明史上从来没有过的。语言模型这么厉害,同时我们要看到它并非完美。大家知道今年火起来的OPENCLAW,大家到处养龙虾,这里面最核心的可以认为是操作系统就是语言大模型,没有语言大模型OPENCLAW是没有用的,就是语言大模型,所以语言大模型非常强大。但是语言大模型本质上是概率模型,在语言理解上不能保证如人类一般精准可靠,在语言生成上会出现与生俱来的幻觉现象。什么叫做幻觉呢?就是会出错。OPENCLAW如果用它解决比如说人工智能+这些问题的时候,有一些问题是根本不适合做的,就不会做。有一些会做的不一定就可以做的特别好,它会天然存在安全隐患。

另外的话语言大模型因为用人类所有文本训练的,人类世界存在各种偏见与谬见,都有可能反映到语言大模型里面去,所以一定会存在偏见与谬见。但是在这种情况下,最近有一个国外有一家企业有一个调研,当然他的规模不大,调研结果是到了2026年3月份互联网上由人工智能生成的文本数量和人类撰写的文本数量基本相当了。我们现在读的,互联网上读的很多文章很有可能是机器写的,但是你浑然不觉,你会在不知不觉的时候受他的影响,受他的影响其实就在开始影响文化、创造文化了。

所以的话生成式人工智能在进行知识生产时从真实性、可靠性、安全性等诸多角度对我们提出非常严峻的挑战。我讲语言大模型不是完美的,但是确实是不错,那么再往前走语言大模型往多模态大模型再走到现在具身大模型,具身大模型刚刚起步,还差得远呢,具身大模型我们语言大模型大家可能用过比如说像豆包这类的,开放式的问题都会答的差不多,当然有错不一定都对,但是基本上开放性的问题。如果设想一个机器人随便走到一个环境下就可以决定它应该做什么,这一天还早着呢。因为具身大模型这个是还是非常初级的,我们只能对具身智能,只能在有限的应用条件下做具身大模型,才有可能做的比较好。

通用意义的具身大模型,现在还是可望不可及的。因为大家也在讲我们要做世界模型,但是世界模型现在做不出来,这部分知识我们还没有,换句话说这部分知识我们还不掌握。生成式人工智能在知识生产中导致了一系列深刻的问题,比如说语言大模型汇总融通了所有人的知识,性能顶尖的大模型渴望得到最广泛人群的青睐和使用,这种情况在中国现在,世界上已经发生了。语言大模型就仿佛成为了唯一的智者,我们刚才讲我们现在好不容易走到多对多的传播方式,现在语言大模型,将来老百姓都去问它,它有可能成为了唯一的智者,因为它好像无所不知无所不晓,这块值得我们警惕,多对多的极大规模的传播模式有可能回退到一对多的极大规模的传播模式,1变成了机器,这种情况是有可能的。

但是一旦到了那个局面,其实对我们并不一定是我们人类所期待的。有研究表明生成式人工智能可以提升个体的创造力,我们用这个生成式人工智能对我个体的创造力会有帮助,比如说对我在职场中提高竞争地位会有帮助,但是会降低新颖内容的集体多样性,对于一个群体反而把这个拉下来了,创造力拉下来了。因为生成式人工智能是概率式模型,会倾向于生成比较中庸的表述,不会生成长尾比较有点离经叛道,往往离经叛道可能有创新性的内容,它不会往那里偏,会偏中性。这块其实对我们人类的创新也未必有好处。这里面有很多深刻的问题。

在知识生产和传播的过程中,我想想大概有几个问题需要我们去关注的,一个就是如何处理好人和机器的关系?生成式人工智能应该成为人类的好助手、好伙伴,但是绝不能反客为主,人应该是当然的主体和核心,我们必须制定各种办法,保持人在这里面的核心作用。在人机共存基本条件下如何更积极发挥人在知识生产中的主观能动性?现在这个问题也非常的严峻。如何有效重构知识生产的新范式使其与时与事俱进,如何更好调动和挖掘大众知识生产能力与专家知识生产形成互补,等等这些问题摆在眼前。

这个都是开放式的问题,最后时间也到了,呼应一下前面就是实际上像第三位是去年的诺贝尔经济学奖获得者,他们因为什么获奖呢?因为强调技术进步对可持续发展的作用,强调有一个词很有意思叫做创造性破坏,实际上是新的技术出现会对基于旧的技术框架冲的稀巴烂,会产生一种全新的格局,叫做创造性破坏,这里面其实强调了技术的作用,那么这里面技术背后其实就是知识,回到我们知识。生成式人工智能会带来知识创新的一种新的范式其实这块我说这个问题虽然好像比较务虚的,实际上比如说放在京津冀,京津冀完全有能力一个叫做胸怀中国,放眼世界,面向未来。在京津冀格局下讨论这样所谓务虚、宏大的问题,实际上是可能的,而且也是必要的。

我最后总结两句,语言大模型乃至生成式多模态大模型的快速发展给知识生产创新带来前所未有的机遇和挑战,面对技术迭代引发的深刻变革,我们要始终高扬人的主体性,在人与机器协同中探索知识生产的创新之路,让生成式人工智能真正成为人类文明进步的加速器。我就讲到这里,不对之处请大家批评指正,谢谢大家!

主办:北京市贸促会     建设运维:北京市贸促会综合事务中心

京ICP证12017809号-5|京公网安备110102000689-5号