老金出海AI · GO GLOBAL
技术思想家Richard Sutton × Dwarkesh Patel · 2025年9月26日 · 1:07:09

Richard Sutton:强化学习之父认为 LLM 是死胡同

提示:播放器右下角「字幕」可开启 / 切换字幕语言;如视频提供中文字幕,可直接切换。

项目详情
嘉宾Richard Sutton × Dwarkesh Patel
频道Dwarkesh Patel
日期2025年9月26日
时长1:07:09
格式视频
主题#reinforcement · #reasoning

中文导读

2024 年图灵奖得主、《The Bitter Lesson》作者、强化学习之父 Richard Sutton,在 Dwarkesh Patel 的访谈里对 LLM 路线图发出最猛烈的质疑:「LLM 不满足 Bitter Lesson 的条件——它们靠的是人类精心整理的数据,不是靠自己的经验学习。」他解释了为什么「持续学习、在线交互」才是 AI 的正路,以及 AGI 之后人工智能研究者将「像算力一样指数增长」。

关键观点

  • 「LLM 不满足 Bitter Lesson」——真正的智能必须从自身经验中学习,不能只靠人类喂数据。
  • The Bitter Lesson 的核心:算力碾压手工知识——历史上每次我们试图把人类知识硬编码进 AI,都被更大的算力 + 更简单的算法打败。
  • 「Era of Experience」:下一个范式是让 AI 像人一样「生活、犯错、学习」——持续学习、在线交互。
  • AGI 之后:AI 研究者将像算力一样指数级增长——数百万个 AI 科学家同时做研究。
  • 文化进化是下一个前沿:多个 AI 互相教学、互相竞争,产生的知识增长速度将远超单一大模型。

原视频信息

讲者
Richard Sutton × Dwarkesh Patel
频道
Dwarkesh Patel
场合
Dwarkesh Patel 播客
日期 · 时长
2025年9月26日 · 1:07:09

Richard Sutton – Father of RL thinks LLMs are a dead end

在 YouTube 观看原片

📚 来源与延伸

本页内容基于以下权威来源整理,可验证、可引用。

引用规范:请注明来源为老金出海(laojinchuhai.com)并保留原文链接。

老金出品 · 用 AI 提效

365SkillAgent Skills 实验仓库:13 个 365 原创技能

365Skill 是我们探索 Agent 技能的公开仓库:SKILL.md 标准格式、deny-by-default 发布策略、evals 验证体系。365 原创技能共 13 个——11 个已公开,2 个内部使用中。Apache-2.0 开源,欢迎 star、安装、提 issue。

更多老金产品:Sellenca · 365AIOrg · AllModelsAPI · 365Loopa · 365 Ops

相关内容

按主题 / 人物 / 专区自动互通