高飞
26-07-16 11:58 微博认证:至顶科技创始人 AI博主

#模型时代# Richard Sutton的MIT CSAIL Dertouzos杰出讲座中,这张图值得拿出来单说。

1、人工智能、心理学神经科学、控制论运筹学、经济与哲学等不同学科,在智能决策者的内部运行底层逻辑上存在高度共识,只是各领域使用专属术语,掩盖了彼此相通的核心思想。也因此,AI问题,也就等于对人类世界的理解问题。正所谓,不能建造,便不能理解。

2、所有自主决策的智能主体都遵循同一套底层运行逻辑:主体接收来自外部环境的观测信息完成感知,生成对环境的主观状态表征;基于主观状态分出三条处理路径,一是依靠反应策略快速输出对外动作,二是借助环境转移模型开展前瞻性规划推演,三是依靠价值函数接收外部奖励信号持续学习优化,三者相互联动,形成感知、即时行动、远期规划、持续学习一体的完整决策闭环。

3、不同学科只是对这套统一框架里的基础概念使用了不同叫法:强化学习领域直接使用这套框架的通用表述;心理学将主体称作有机体、观测称为刺激、动作称为反应;控制理论把主体叫做控制器、外部环境是被控对象、动作是控制量;经济学与哲学将决策主体指代人或企业、动作称作选择、价值对应效用体系。图表最后提炼出一套跨学科通用的共识术语,统一命名框架内全部核心要素。

4、另外,将智能主体拆分为感知、反应策略、转移模型、价值函数四大模块,是为适配现实中算力受限的客观约束,包括快速响应需求、模型参数规模有限、单步计算资源不足等,但这套分模块设计背后完整的计算逻辑依据,目前学界尚未形成完整清晰的阐释。

发布于 中国香港