AI资讯 / 产业

产业 / 媒体

强化学习先驱 Rich Sutton 创立 Oak Lab,押注可自主学习的 AI 智能体

The Decoder

2024 年图灵奖得主、现代强化学习奠基人之一 Richard Sutton 近日在多伦多创立创业公司 Oak Lab,联合创始人为 Khurram Javed,二人此前均在 John Carmack 旗下 Keen Technologies 共事。Sutton 公开批评现有深度学习路径"薄弱且低效",认为生成式 AI 擅长模仿却无法评估自身输出,难以实现真正的科学发现。Oak Lab 延续了 Keen 的强化学习路线,主张 AI 应在运行过程中持续从经验中学习,而非仅依赖静态数据集一次性训练。其长期目标是打造拥有万亿级参数、能实时学习与规划、功耗仅 20 瓦的智能体。

2024 年图灵奖得主 Richard Sutton 近日在多伦多正式推出新创业公司 Oak Lab,联合创始人 Khurram Javed 曾与他一同在 John Carmack 创办的 Keen Technologies 从事 AI 研究。公司名称延续了 Sutton 对符号化、持续学习的偏好,目标直指能自主从环境中学习的智能体。

Sutton 在公开表态中直言,当前主流深度学习方法"薄弱且低效",需要的是根本性的新思路与彻底重构,而非在小修小补上继续堆叠参数。今年 6 月他曾撰文指出,生成式 AI 虽擅长模仿人类文本,却无法对自身输出做出有效评估,因此难以构成真正意义上的发现能力。

围绕这一判断,Oak Lab 将研究方向锚定在三个维度:让智能体在运行阶段持续与环境交互学习,自主构建内部世界模型,并独立完成对变化、评估与选择的处理。这与依赖固定数据集一次性训练的主流范式形成鲜明对比。

公司在技术路线上承袭了 Keen Technologies 的强化学习传统,强调"从经验中学"而非"从数据中学"。Sutton 长期坚信,智能体应在部署后持续进化,把训练与推理的边界逐步消融。

Oak Lab 给出了颇具野心的长期目标:构建一个拥有万亿级参数、能在实时环境中学习并规划、且功耗控制在 20 瓦左右的智能体。这一指标同时指向规模、能效与在线学习三道难题,也意味着团队需要在算法与硬件协同层面寻求突破。

Sutton 的再度创业也被视为对当下大模型路线的一次公开挑战。当业界普遍通过更大数据、更多算力来推动生成式 AI 进步时,Oak Lab 选择押注持续学习与强化学习,试图为通用人工智能寻找一条不同的入口。

要点

  • 2024 年图灵奖得主 Richard Sutton 与 Khurram Javed 在多伦多创立 Oak Lab,延续强化学习路线。
  • Sutton 批评现有深度学习方法"薄弱且低效",认为需要底层重构而非参数堆叠。
  • 公司主张 AI 在运行中持续从环境学习,自主构建世界模型并完成评估与决策。
  • 长期目标为万亿参数、能实时学习与规划、功耗 20 瓦的智能体。
  • 该创业项目被视为对当前生成式 AI 主流路线的公开挑战。
查看原始来源

原始标题:Turing Award winner Rich Sutton founds Oak Lab to build AI agents that learn on their own

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。