2018/12/9·Lex Fridman 播客AI安全人工智能控制问题
斯图尔特·罗素:AI安全的核心是目标的不确定性
在Lex Fridman的访谈中,斯图尔特·罗素教授从他早期的国际象棋AI项目切入,阐述了“元推理”的核心作用。他指出当前AI安全的关键在于“控制问题”——即如何确保机器的目标与人类真实意图对齐。罗素提出,解决方案是让AI系统对其目标保持不确定性,并能够通过人类反馈不断学习和调整,这是构建有益AI的基石。
S斯图尔特·罗素加州大学伯克利分校计算机科学教授、《人工智能:一种现代方法》合著者