老金出海
AI · GO GLOBAL
365 产品
AI 落地服务
AI 资讯
经典回放
经典教程
老金精选
中
简体中文
EN
English
浏览产品
主题合集
强化学习
RL、奖励模型与自我博弈
跨栏目聚合:经典回放 1 · 经典教程 0 · 老金精选 0
大语言模型
Agent 智能体
开源
基础设施
推理能力
AI 安全
计算机视觉
多模态
强化学习
工程实践
创始人访谈
中国 AI
基础认知
硬件芯片
OpenAI
🎬 经典回放
2025-09-26 · Richard Sutton × Dwarkesh Patel
Richard Sutton:强化学习之父认为 LLM 是死胡同