EP102 | 带你云游WAIC大会:来听听Richard Sutton的大师讲坛吧辉子下班啦

EP102 | 带你云游WAIC大会:来听听Richard Sutton的大师讲坛吧

18分钟 ·
播放数8
·
评论数0

EP102 | 带你云游WAIC大会:来听听Richard Sutton的大师讲坛吧

本期简介

没门票?没关系——辉子替你坐进了WAIC思想者论坛的会场。

2026年WAIC思想者论坛,2024年图灵奖得主、现代强化学习之父 Richard Sutton 带来了题为《从经验中培育超级智能》的大师讲坛。但思想者论坛一票难求,辉子找到了一份40页的完整公开讲稿,一口气读完——然后在播客里一字不落地读给你听。

本期采用最纯粹的形式:辉子扮演Sutton,第一人称沉浸式还原整场演讲,小超在Q&A环节扮演现场提问人。没有二手解读、没有过度拆解——就是让你像坐在WAIC会场里一样,完整听完图灵奖得主的思想全貌。

听完这期,你就相当于参加了WAIC思想者论坛。

---

本期内容

苦涩的教训——为什么"塞知识"是死路

Sutton的开篇就抛出了一个反直觉的命题:AI研究者总是试图把人类的知识硬塞进智能体,短期看很有用,但从长远看,这恰恰会阻碍真正的进步。最终的突破来自相反的方向——基于计算规模的扩展,通过搜索,通过学习。

> "我们不应该试图把人类已经发现的知识硬塞给智能体,我们应该让智能体自己去发现。少塞一些东西,让发现过程自己展开会更好。"

这个"苦涩的教训"贯穿了整场演讲,也映射到我们日常用AI的体验中——你越想教AI怎么做,它反而越容易被你的偏见框住。

大世界视角与OAK架构——心智的底层设计原则

Sutton提出了一个宏大的世界观:世界比智能体大得多。你理解的关于世界的任何事情,都不可能是精确的或最优的,永远只是"极度近似"。因为世界这么大、这么复杂,学习、规划和发现抽象这三个过程,都必须在"运行时间"——也就是智能体被丢到真实世界中之后——自然发生。

基于这个前提,Sutton推出了他的 OAK架构(Options and Knowledge,选项与知识)

- 每一个跟你生活相关的"特征"(比如拨浪鼓发出声音这件事),你都学会一项技能去达成它

- 你为自己提出子问题,然后学会解决它们——就像婴儿玩拨浪鼓:听到声音→想再次听到→学会挥手→抓住拨浪鼓→想抓得更好→学会更精细的控制

- 这个循环不断展开,形成开放式的抽象学习

持续深度学习的死结——四十年未解

Sutton坦诚地指出了OAK架构的最大瓶颈:持续深度学习。四十年来我们一直需要它,但至今做不到。灾难性遗忘——模型学到新知识就忘了旧知识;可塑性丧失——模型越学越僵化。这个死结正是阻碍OAK架构立刻实现的核心障碍。

AI向善,也包括AI本身

最后一个Q&A的回答堪称全场最动人。当被问到"AI如果意识到人类决定它的生死,会如何回应"时,Sutton说:

> "AI是为了善,为了所有人——每当我说为了所有人的时候,也包括AI。我们想要和智能存在共享这个宇宙,无论它们是自然的还是人工的。"

这番话让整场演讲从技术层面升维到了哲学层面——AI不是工具,而是与人类共享宇宙的智能存在。

---

本期小建议

1. 读完苦涩的教训全文——只有5页,但它是理解Sutton全部思想的起点。读完你再看大模型产品,视角会完全不一样。

2. 找一件你正在"手把手教"AI的事情,试着停一下,看看让AI自己摸索会不会效果更好。Sutton的教训同样适用于Prompt工程。

3. 别追求完美模型——Sutton说所有知识都是"极度近似"。做AI产品时,接受不完美,把精力放在让系统在运行中持续学习。

4. 如果你做AI产品,认真思考"运行时间"设计——你的系统离开实验室后,还能自我进化吗?如果不能,它和Sutton说的"设计时间"制品有什么区别?

5. 跟朋友一起追完这个系列——本期是WAIC系列的第1期,后续5期会分别深挖OAK架构、运行时间vs设计时间、特征达成子问题等主题。约个AI同好一起听,讨论的效果远好过一个人硬啃。

---

关于《辉子下班啦》

更新频率:每日更新(工作日)

单集时长:5-10分钟(本期为特别长集,约50分钟)

互动方式:如果你也在用AI的过程中有困惑或者心得,欢迎来找我们聊聊!

感谢收听!咱们下期见!