技术思想家Richard Sutton × Dwarkesh Patel · 2025年9月26日 · 1:07:09
Richard Sutton:强化学习之父认为 LLM 是死胡同
提示:播放器右下角「字幕」可开启 / 切换字幕语言;如视频提供中文字幕,可直接切换。
中文导读
2024 年图灵奖得主、《The Bitter Lesson》作者、强化学习之父 Richard Sutton,在 Dwarkesh Patel 的访谈里对 LLM 路线图发出最猛烈的质疑:「LLM 不满足 Bitter Lesson 的条件——它们靠的是人类精心整理的数据,不是靠自己的经验学习。」他解释了为什么「持续学习、在线交互」才是 AI 的正路,以及 AGI 之后人工智能研究者将「像算力一样指数增长」。
关键观点
- 「LLM 不满足 Bitter Lesson」——真正的智能必须从自身经验中学习,不能只靠人类喂数据。
- The Bitter Lesson 的核心:算力碾压手工知识——历史上每次我们试图把人类知识硬编码进 AI,都被更大的算力 + 更简单的算法打败。
- 「Era of Experience」:下一个范式是让 AI 像人一样「生活、犯错、学习」——持续学习、在线交互。
- AGI 之后:AI 研究者将像算力一样指数级增长——数百万个 AI 科学家同时做研究。
- 文化进化是下一个前沿:多个 AI 互相教学、互相竞争,产生的知识增长速度将远超单一大模型。
原视频信息
- 讲者
- Richard Sutton × Dwarkesh Patel
- 频道
- Dwarkesh Patel
- 场合
- Dwarkesh Patel 播客
- 日期 · 时长
- 2025年9月26日 · 1:07:09
Richard Sutton – Father of RL thinks LLMs are a dead end
在 YouTube 观看原片