老金出海AI · GO GLOBAL
技术思想家Richard Sutton × Dwarkesh Patel · 2025年9月26日 · 1:07:09

Richard Sutton:强化学习之父认为 LLM 是死胡同

提示:播放器右下角「字幕」可开启 / 切换字幕语言;如视频提供中文字幕,可直接切换。

中文导读

2024 年图灵奖得主、《The Bitter Lesson》作者、强化学习之父 Richard Sutton,在 Dwarkesh Patel 的访谈里对 LLM 路线图发出最猛烈的质疑:「LLM 不满足 Bitter Lesson 的条件——它们靠的是人类精心整理的数据,不是靠自己的经验学习。」他解释了为什么「持续学习、在线交互」才是 AI 的正路,以及 AGI 之后人工智能研究者将「像算力一样指数增长」。

关键观点

  • 「LLM 不满足 Bitter Lesson」——真正的智能必须从自身经验中学习,不能只靠人类喂数据。
  • The Bitter Lesson 的核心:算力碾压手工知识——历史上每次我们试图把人类知识硬编码进 AI,都被更大的算力 + 更简单的算法打败。
  • 「Era of Experience」:下一个范式是让 AI 像人一样「生活、犯错、学习」——持续学习、在线交互。
  • AGI 之后:AI 研究者将像算力一样指数级增长——数百万个 AI 科学家同时做研究。
  • 文化进化是下一个前沿:多个 AI 互相教学、互相竞争,产生的知识增长速度将远超单一大模型。

原视频信息

讲者
Richard Sutton × Dwarkesh Patel
频道
Dwarkesh Patel
场合
Dwarkesh Patel 播客
日期 · 时长
2025年9月26日 · 1:07:09

Richard Sutton – Father of RL thinks LLMs are a dead end

在 YouTube 观看原片