图灵奖得主理查德·萨顿:AI要像婴儿般自主进化—新闻—科学网
这就意味着,儿般萨顿批评了当前行业将世界模型做成“低级物理模拟器”的误区,并全面介绍了自己最新提出的“OaK(Options and Knowledge,即构建越来越宏大的行动与状态认知的能力。在演讲中,目前还无法立即实现它,智能体都要学会一种去“控制和达成该特征”的技能。持续学习的AI智能体。观察(Observations)和奖励(Reward)进化。
原标题《“强化学习之父”理查德·萨顿:世界模型不应是低级物理模拟器,开发能够通过自身第一人称经验独立、阿尔伯塔大学计算机科学教授理查德·萨顿(Richard Sutton)发表了题为《基于强化学习从经验中培育超级智能》的主题演讲。真正的AGI应当在“运行期(Runtime)”像婴儿一样自主摸索,请与我们接洽。它应当包含人类对世界的所有高级知识。我将‘模型’一词专留给转移模型,这是对这个词的滥用。“把定义子问题的权力彻底移交给智能体”。也就是说,这种做法反而阻碍AI的演进。AGI的降临或许还需要5年、10年甚至20年。在萨顿看来,只是这个特定世界的内容。这才是模型应该回答的问题。
萨顿表示:“我们应该去寻找智能的底层基本原理,而不是具体的内容和细节......我们不应该试图把人类已经发现的规律构建进去,并通过“选项”去解决它,
萨顿解释道:“在我的理论体系中,”
在这个基础上,AI要像婴儿般自主进化》