上海人工智能实验室主任、首席科学家周伯文在2026数博会上作主旨演讲

民风民俗 5 0

8月28日上午,2026中国国际大数据产业博览会在贵阳开幕,上海人工智能实验室主任、首席科学家,清华大学讲席教授周伯文在2026数博会上作主旨演讲。

周伯文说,近几年智能能力飞速发展,人工智能正从“会做题”走向“会办事”,从下围棋这类完美的信息闭环场景到有标准答案的知识问答,到能够快速验证闭环链路的代码模型能力越来越强,词元完成的任务就越复杂。

在谈及AI产业落地趋势时,周伯文表示,过去一两年,代码编程正因为正成为AI落地最实、商业价值最高的领域之一,其原因不仅在于数据规模大,更在于编程自带天然闭环。写出来跑一下,有错误再修改,继续跑,拿结果。循环快,反馈直接,AI学的快,不仅因为它数据规模大,还因为它自带闭环,循环快、反馈直接,AI学得快。在闭环的环境里面,错误不是失败,错误本身就是极其宝贵的数据。代码面对的是快速可验证的环境,其实真正难的是那些不能迅速被证实和证伪的开创性、开放性任务,像科技创新、产业创新战略选择,这些都是开放环境的发起task,词元要进一步扩大这个价值,必须要解决这个问题。

与此同时,周伯文还提出科技创新是下一个编程,科技创新不是解题,是探索未知,目标更开放、路径更长,失败样本更丰富、验证更严格,产业价值更大。

他强调,一方面人工智能将为科技创新范式和产业创新范式带来颠覆性变革,已成为全球的共识。但另一方面,科研能力提供高治理密度的训练信号和可信的验证机制,把模型放进真实的科研场景中训练和检验,能够推理更完善,泛化性更强、交互更多元,并在一此次任务推进中形成人工智能的自我迭代进化。

基于人工智能发展的全新特征,周伯文提出现在数据的发展到了一个新的阶段,以前的模型依赖静态数据,数据采集更像挖矿,把文字、图片、多模态收集整理、分类堆叠,但真正珍贵的不仅仅是矿石,而是冶炼过程,哪一步温度高了,哪一步加错了料,最后怎么调兑,所有这些产生的数据,就从过去模型仅仅从看过什么,而是到了做过什么,怎么做,如何做对,错了怎么改,这种新形态统称为环境即数据。所谓环境即数据指的是要搭建真实可交付的环境,让模型在环境中尝试迭代、犯错、修正,环境记录全过程,提供反馈与评价,对关键步骤进行验证。为了让这个闭环真正跑起来,上海人工之实验室打造了书生端砚平台,一个专门为科技创新和产业创新融合发展打造的融合平台,它把算力、模型、词元、创新科研任务产业场景,连成一条自己能够能越转越快的飞轮。

他指出,在底层方面,通过上海人工智能实验室的Deep Link等跨越互联技术,汇聚包括贵州在内的算力资源;在中层方面,通过Token Plan和书生大模型底座转化为可调用的词元服务;在上层方面,进入真实的科研和产业创新任务,帮助创新者以数十倍的速度和数倍的成功率加快创新,将成功、失败、专家判断全部融入为新的更高价值的数据,在环境里聚集,释放更多更高的数据价值,这样算力、词元、环境、数据,让环境可执行、过程可验证、轨迹可学习,在端砚上转起来,它就是一个新的飞轮。这与我们国家关于数据要素市场化配置,发展新质生产力的战略方向高度一致。 这个飞轮已经不仅仅是理念,已经在上面长出很多的新成果。在科研端,清华大学张数一教授团队基于端砚,改造基因调控蛋白,以数十倍的速度创造了比Nature报道最新结果提升77%新的科研发现,相关成果也将落地转化;在产业端,在芯片设计领域,把老师傅的经验体系化转化为可计算、可复用的知识模式,从专家反复试错的芯片设计变成“专家经验+数据加模型+自动实验”的协同迭代。

他说,在这个背景下,词元不只是纸面计数,更是在实验室里长出的新发现,在工厂里省下的新成本。

记者 周钰爽/文 徐其飞/图