技术思想家Richard Sutton × Dwarkesh Patel · 2025年9月26日 · 1:07:09
Richard Sutton:强化学习之父认为 LLM 是死胡同
提示:播放器右下角「字幕」可开启 / 切换字幕语言;如视频提供中文字幕,可直接切换。
| 项目 | 详情 |
|---|---|
| 嘉宾 | Richard Sutton × Dwarkesh Patel |
| 频道 | Dwarkesh Patel |
| 日期 | 2025年9月26日 |
| 时长 | 1:07:09 |
| 格式 | 视频 |
| 主题 | #reinforcement · #reasoning |
中文导读
2024 年图灵奖得主、《The Bitter Lesson》作者、强化学习之父 Richard Sutton,在 Dwarkesh Patel 的访谈里对 LLM 路线图发出最猛烈的质疑:「LLM 不满足 Bitter Lesson 的条件——它们靠的是人类精心整理的数据,不是靠自己的经验学习。」他解释了为什么「持续学习、在线交互」才是 AI 的正路,以及 AGI 之后人工智能研究者将「像算力一样指数增长」。
关键观点
- 「LLM 不满足 Bitter Lesson」——真正的智能必须从自身经验中学习,不能只靠人类喂数据。
- The Bitter Lesson 的核心:算力碾压手工知识——历史上每次我们试图把人类知识硬编码进 AI,都被更大的算力 + 更简单的算法打败。
- 「Era of Experience」:下一个范式是让 AI 像人一样「生活、犯错、学习」——持续学习、在线交互。
- AGI 之后:AI 研究者将像算力一样指数级增长——数百万个 AI 科学家同时做研究。
- 文化进化是下一个前沿:多个 AI 互相教学、互相竞争,产生的知识增长速度将远超单一大模型。
原视频信息
- 讲者
- Richard Sutton × Dwarkesh Patel
- 频道
- Dwarkesh Patel
- 场合
- Dwarkesh Patel 播客
- 日期 · 时长
- 2025年9月26日 · 1:07:09
Richard Sutton – Father of RL thinks LLMs are a dead end
在 YouTube 观看原片📚 来源与延伸
本页内容基于以下权威来源整理,可验证、可引用。
引用规范:请注明来源为老金出海(laojinchuhai.com)并保留原文链接。
老金出品 · 用 AI 提效
365SkillAgent Skills 实验仓库:13 个 365 原创技能
365Skill 是我们探索 Agent 技能的公开仓库:SKILL.md 标准格式、deny-by-default 发布策略、evals 验证体系。365 原创技能共 13 个——11 个已公开,2 个内部使用中。Apache-2.0 开源,欢迎 star、安装、提 issue。
更多老金产品:Sellenca · 365AIOrg · AllModelsAPI · 365Loopa · 365 Ops
相关内容
按主题 / 人物 / 专区自动互通