
" 用技术手段复现智能,是人类最具野心的科学命题之一,而从自然心智中提炼底层原理,正是 AI 走向真正智能的关键。" 在 7 月 24 日举办的上海创智学院 2026 强化学习暑期学校结业仪式上,图灵奖得主、强化学习领域奠基人理查德 · 萨顿提出,心理学应是当下 AI 研究的 " 秘密武器 "。
人和动物是研究智能最好的参照
究竟什么是人工智能?
萨顿先引用了 " 人工智能 " 概念提出者约翰 · 麦卡锡的定义,即,人工智能是展示人类智能行为的计算机系统,具备为了完成某个目标进行计算、推理、决策的能力。
不过,萨顿认为,智能所包含的 " 实现目标的计算能力 ",并不是智能的本质。他解释道,人类的智能与真正的 AI 都是 " 经验 ",而不是预先设定目标再进行计算。所谓经验,是智能体与真实世界的持续交互,即通过行动感知结果,在循环反馈中完成对世界的预测与控制,这也正是 " 心智 " 的意义。而大语言模型之所以被很多学者认为与真正意义上的 " 心智 " 相去甚远,正是因为大语言模型仅能模仿复刻人类的语言表达,却缺乏内生的目标与环境交互。
真正的智能需扎根真实的物理世界。萨顿谈到,这就必须依托奖励信号迭代决策,为 AI 系统赋予目标,构建 AI 与物理世界交互的感知与行动接口。而且智能也并非非黑即白。他提出,智能是一个与应用场景、观察者视角紧密相关的概念,判断标准取决于观察者的目的,而非系统本身的属性。
至于人工智能强化学习,其正是来源于过去百余年间,心理学家对动物学习、人类认知研究所积淀下的大量底层规律。萨顿直言:" 心理学正是我从事强化学习研究的秘密武器。" 在他看来,自然心智是智能系统最成熟的范本,人和动物是研究智能最好的参照。
萨顿提到,不止自己从心理学研究中汲取养分,深度学习奠基人、诺贝尔物理学奖和图灵奖得主杰弗里 · 辛顿同样拥有心理学学术背景。他们都从自然智能的研究视角,切入人工智能领域。当多数 AI 研究者缺乏心理学背景时,他们从百年心理学成果中挖掘学习机制的底层规律,形成了独特的学术优势。

培养兼具抱负与谦逊的青年人才
在当下发展速度一日千里的人工智能研究中,年轻人该如何找到自己的一席之地?萨顿想说的是—— " 保持玩心,也保持深思 "。
他解释道,人工智能研究同样需要深耕基础研究,并且在科研中需平衡远大的抱负与谦逊的心态。理解人类心智的运作规律、并用技术手段复现智能,是人类最具野心的科学命题之一,但越是宏大的目标,越需要谦卑的姿态。" 只有保持谦卑,才能清晰地看到局限与方向;也才能理解,哪怕微小的进展,也同样意义重大。"
而且,抱负远大与保持谦逊并非对立,平衡二者的关键是持续的学术探索。" 大胆畅想不同的可能性,坦然接受观点可能出错的现实,永远不要对根本性问题失去好奇心。" 萨顿说," 我始终相信人类最终可以理解一切,哪怕是‘何为生命’‘何为目标’这样深刻的哲学问题,我们都能一步步取得进展。"
连日来,由上海创智学院、上海交通大学人工智能学院与 Openmind 研究院联合主办的 2026 强化学习暑期学校,吸引了来自清华大学、北京大学、复旦大学、香港科技大学、新加坡国立大学等海内外多所高校与科研机构的青年学子参与。这也是萨顿教授首次在中国开设完整的系统性强化学习课程。上海创智学院此次聚焦强化学习基础理论与智能本质探索,推动人工智能前沿人才培养,争取为国内人工智能领域输送新生力量。


登录后才可以发布评论哦
打开小程序可以发布评论哦