2026 / 09 / 05
PA集团官网-图灵奖得主理查德·萨顿:AI要像婴儿般自主进化—新闻—科学网

“强化进修之父”萨顿认为,对于世界模子的界说存于误区。

7月19日,于2026年世界人工智能年夜会(WAIC)的“思惟者论坛”上,图灵奖患上主、阿尔伯塔年夜学计较机科学传授理查德 萨顿(Richard Sutton)发表了题为《基在强化进修从经验中培育超等智能》的主题演讲。萨顿认为,真实的超等智能必需完全离开人类的先验成见,并周全先容了本身最新提出的“OaK(Options and Knowledge,选项与常识)”架构。

最近几年来,萨顿时常对于年夜语言模子的成长线路持攻讦立场。于演讲中,萨顿重申了他闻名的AI研究文章《苦涩的教训》(The Bitter Lesson)。他直言道,AI研究者老是但愿把“人类的常识”硬编码给AI,但从久远来看,这类做法反而拦阻AI的演进。

萨顿暗示:“咱们应该去寻觅智能的底层基来源根基理,而不是被咱们自身心智于特定世界中所孕育发生的详细细节所误导。咱们应该寻觅基来源根基理,而不是详细的内容及细节......咱们不该该试图把人类已经经发明的纪律构建进去,而应该让智能体本身去发明。”

于这个基础上,萨顿对于“年夜世界”视角举行了界说。于萨顿看来,人类世界所熟知的“三维空间”或者“物理学纪律”,只是这个特定世界的内容。真实的AGI该当于“运行期(Runtime)”像婴儿同样自立探索,仅依赖步履(Actions)、不雅察(Observations)及奖励(Reward)进化。

基在这类“年夜世界视角”,萨顿攻讦了当前行业将世界模子做成“初级物理模仿器”的误区,称这类理解“极为局促”,人类的转移模子(Transition Model)“不该该像初级物理学那样噜苏,而应该承载高阶的世界常识”。

萨顿注释道:“于我的理论系统中,我绝对于不会把一个纯真的神经收集称为‘模子’,这是对于这个词的滥用。我将‘模子’一词专留给转移模子,它该当包罗人类对于世界的所有高级常识。好比,‘假如我接管了这份事情,我会幸福吗’,这才是模子应该回覆的问题。”

这就象征着,模子需要把握“抽象能力”,即构建愈来愈弘大的步履与状况认知的能力。为了实现这类高级抽象,萨顿提出了OaK架构。其焦点于在经由过程时间抽象(选项)与状况抽象(常识),让AI可以或许实现“跳跃式”的宏不雅计划。

于萨顿的OaK架构中,对于在每个与人类糊口相干的状况特性,智能体都要学会一种去“节制及告竣该特性”的技术。也就是说,智能体构建自身心智的焦点手腕,就是不停提出子问题,并经由过程“选项”去解决它,“把界说子问题的权利完全移交给智能体”。

只管OaK架构已经经可以或许于理论上实现闭环,但萨顿坦言,今朝还有没法当即实现它,AGI的降临也许还有需要5年、10年甚至20年。

值患上一提的是,就于本周,萨顿公布与阿尔伯塔年夜学博士研究员Khurram Javed配合创建新公司Oak Lab,志于打破当前深度进修方式,用全新的理念构建AGI,开发可以或许经由过程自身第一人称经验自力、连续进修的AI智能体。

原标题《“强化进修之父”理查德 萨顿:世界模子不该是初级物理模仿器,AI要像婴儿般自立进化》

尤其声明:本文转载仅仅是出在流传信息的需要,其实不象征着代表本网站不雅点或者证明其内容的真实性;如其他媒体、网站或者小我私家从本网站转载利用,须保留本网站注明的“来历”,并自大版权等法令责任;作者假如不但愿被转载或者者接洽转载稿费等事宜,请与咱们联系。-PA集团官网