Richard S. Sutton
图灵奖 (2001) | b. 1957 |加拿大自2015年起
详细信息
Richard Stuart Sutton FRS FRSC(生于 1957 年或 1958 年)是一位加拿大计算机科学家。他是阿尔伯塔大学计算科学教授、阿尔伯塔机器智能研究所研究员兼首席科学顾问以及 Keen Technologies 的研究科学家。 [1] [6] Sutton 被认为是现代计算强化学习的创始人之一。 [7] 特别是,他对时间差异学习和策略梯度方法做出了贡献。 [8] 他与安德鲁·巴托 (Andrew Barto) 一起获得了 2024 年图灵奖。 [ 9 ] [ 10 ] 理查德·萨顿 (Richard Sutton) 1957 年或 1958 年出生于俄亥俄州 [ 11 ] [ 12 ],在美国芝加哥郊区伊利诺伊州奥克布鲁克长大。 [13] Sutton 于 1978 年在斯坦福大学获得心理学文学士学位 (BA),随后在安德鲁·巴托 (Andrew Barto) 的指导下,在马萨诸塞州阿默斯特大学获得计算机科学理学硕士 (1980) 和博士学位 [2] (1984)。 [2] 他的博士论文 [2] 介绍了 actor-critic 架构和时间学分分配。 [ 14 ] [ 8 ] 教育背景:斯坦福大学 BA 马萨诸塞大学阿默斯特分校 MS 博士 获奖引文:.mw-parser-output .plainlist ol,.mw-parser-output .plainlist ul{line-height:inherit;list-style:none;margin:0;padding:0}.mw-parser-output .plainlist ol li,.mw-parser-output .plainlist ul li{margin-bottom:0}
AAAI 院士 (2001)
图灵奖(2024 年)