AI的下半程:一期听懂「世界模型」4条路线+40年历史Orpheus微见

AI的下半程:一期听懂「世界模型」4条路线+40年历史

87分钟 ·
播放数5699
·
评论数45

大语言模型就是死路一条?

至少两位图灵奖得主Richard Sutton和Yann LeCun都这么认为。

我认为这类争议的真正核心,并不是「大语言模型到底行不行」,而是关于我们自己,到底是怎么去理解和接触这个世界的。

所以它最终还是会去到一个哲学问题:如果只需要语言,就能获得真正的智能,就能通向未来,那我们这副肉体和四肢还必要吗?

而那些美味触觉

每一次温热的拥抱和接吻又有什么意义?

这,可能才是世界模型真正开始的地方。

社交媒体:公众号 / 小红书 / Bilibili / 微博

世界不止语言,世界模型也一样

▶ TIMELINE

00:00 一 / 世界不只有语言

  • 如果你成为造物主,你会如何重建一个世界?

  • 世界模型的核心工作:模拟、学习、预测、评估

  • 今天的世界模型,是一种愿景而非单一的技术

  • 4岁小孩的经历,就能超越所有训练文本

11:02 二 / 人、动物、AI如何理解世界

  • 人工智能是一门仿生学?

  • 强化学习与奖惩机制

  • 为什么大于43℃人就觉得烫

  • 卷积神经网络等仿生设计

  • AI自行进化出「人脑模式」

  • 世界本身就存在某些关于智能的最优解

  • 持续上亿年的具身互动带来生物智能

22:45 三 / 表象世界

  • 从预测像素到评估行动

  • 不是所有视频模型都是世界模型

  • 视频模型作为世界模型的优势和局限

33:26 四 / 空间世界

  • 李飞飞的「三个一致性」

  • 让AI理解空间关系、移动与物体恒常性

  • 已经商业化的「世界模型」

42:14 五 / 状态世界

  • 为什么一个十几岁的孩子,20个小时就能学会开车,但几百万小时的自动驾驶数据,还是没产生质变?

  • 提炼当前状态,预测下一个状态,而非画面或文字

  • 什么是状态?什么是好的表征?

56:24 六 / 行动世界

  • 为什么GPT爆发让自动驾驶和机器人也更强了?

  • 快系统、慢系统

  • 行动是世界模型的最终目的

  • *其他类似世界模型的项目:斯坦福小镇、大气建模、蛋白质与AI的价值观

01:13:17 七 / 神话和技术

  • 从史前开始,人类就一直在思考如何再造一个更好的世界

  • 从脑电波到元宇宙,人的归宿是虚拟?

  • 世界模型不是让人进去,而是让机器智能出来,不是让人向AI对齐,而是让AI向人对齐

  • 如果你真的想要一个更好的世界,就去世界中做你认为好的事情

01:20:55 结尾 / 关于我的工作和职业、对技术传播的思考

▶ 提及的部分专有名词

Richard Sutton / Yann LeCun / 维特根斯坦 / Sora / DeepMind / Genie / Runway / Seedance / 可灵 / 李飞飞 / World Labs / JEPA Joint Embedding Predictive Architecture / NVIDIA / Cosmos / Scaling Law / 汉斯·莫拉维克 / The Bitter Lesson / UCL / Edvard Moser / Gemini Omni / Jim Fan 范麟熙 / VLA / DreamDojo / LingBot-World / 智元机器人 / GE-sim 2.0 / Marble / 腾讯混元世界 / 埃拉托色尼 / 表征 / AMI Advanced Machine Intelligence / LeWorldModel / RT-2 / FSD V12 / DYNA / Optimus / Wayve / GAIA / Physical Intelligence / Pi-0.7 / Microsoft Aurora / Demis Hassabis /《The Man Who Awoke》/《黑客帝国》/《黑镜》/ Jürgen Schmidhuber

▶ 参考资料及延展阅读

▶ 音乐

  • You Can Prove Me Wrong - Arabs in Aspic

  • Computer World Pt.2 - Kraftwerk

  • Past and Language - Toe

▶ 一起见微知著

展开Show Notes
Snoopy0618
Snoopy0618
2026.6.14
这期节目的分享太棒了,我觉得咱们这期节目肯定能上小宇宙的编辑精选
秦旷
:
谢谢,我就当你是编辑
庄明浩:这是个ai 他在所有播客都留这个言
3条回复
wenqi_
wenqi_
2026.6.17
11:54 我奶奶是个没上过学的人,如果她听到这里会说人教人学不会,事教人一次就会了。有点像知识和智慧的区别。
秦旷
:
奶奶的智慧
wenqi_:谢谢
依然_dcHm
依然_dcHm
2026.6.15
把普通人搞不懂的科技模型翻译成大白话,这项工作很有意义
Lolla
Lolla
2026.6.22
这期封神了,我将反复收听。
秦旷
:
谢谢!这期有点硬核导致打开并不多
熊小灵
熊小灵
2026.6.16
太棒了!听完对世界模型有了新的理解,之前还觉得世界模型有点异想天开,但是那个电子小鼠实验的结论真的太震撼了。杨立昆不愧是大佬我,他说的方法非常关键,正如我们平时也不会注意所有的环境细节一样,我们感知世界的方式其实也是捕捉关键变量。听完想起了模拟理论,假如我们(智人)是在模拟世界进化出来的智能体,那么gen AI的本质,就是我们试图拆解和创造智能本身。
秦旷
:
嗯,我是这么认为的,即使是人类智能也仅仅是一种表现形式,或者一部分交集,智能是一个范围非常非常宽的概念
秦旷
:
有点像开地图一样,开出更多版图。但我又不太相信有全知全能这一说,就像我们应该永远只能看到宇宙的极小一部分。
3条回复
reginacox
reginacox
2026.6.17
这期节目实在是太好了,对于智能的分析和讲解非常非常的详细,受益匪浅。
秦旷
:
谢谢支持!
记录一下所想:ai的运作依靠的是大语言模型,而各种bug揭露了ai的运作不可能仅靠语言,人的成长需要感知和经验,那ai是否在这个时代是有瓶颈的,它似乎并不能脱离生物学等等方面单独存在,打造一个ai的前提是“解剖”无数个人类。ai的完善不单单是资源的疯狂加注,而是多方面多维度的发展。当其他领域因为ai而停滞,ai又该如何学习。
宁静_GEkO
宁静_GEkO
2026.6.24
这期节目于我而言又是新知识,我将反复听[拳头][拳头]感谢主播的输出[玫瑰][玫瑰]
wenqi_
wenqi_
2026.6.17
2026世界模型元年
Nixon_Hu
Nixon_Hu
2026.6.15
11:31 这段涉及奖励机制的类比不错
秦旷
:
🤝
一如既往地值得反复听,我听完此期不仅写了篇文章还发了期播客《AI 越进步,我越想好好珍惜做人的机会》,但竟然忘记留言了,啧啧啧。你可不可以拿一期拆解下你的工作流,面对如此庞杂的内容,你不仅调研,还能把他讲清楚,哇哦,我兴奋得语无伦次,你却安静坐在那里娓娓道来。好吧,我边跳边唱给你伴奏~~
秦旷
:
谢谢!我听了!😁🤝🤝
派少与阿奇:完了,今晚要激动入睡了😆😆
泷牙Ariel
泷牙Ariel
2026.6.16
06:52 四类世界模型已经深深抓住好奇心
中年布衣
中年布衣
2026.7.16
这应该算宏观世界运动模型,一般假设物体是刚体,忽略了很多客观因素,可用于大部分自动驾驶和人形机器人场合。做的好算离人类智能近了一步,但离人类智能还有很远。人类可以描述细观世界,微观世界,分子原子层级,通过测量极少数关键变量,分析归纳规律,在这些世界获得数据是越来越难的,代价越来越高。
stra
stra
2026.7.08
1:26:06 Toe!
来啦来啦
秦旷
:
欢迎👏🏻
付胜昔
付胜昔
2026.6.14
晚上可以好好睡觉了😁
秦旷
:
👏🏻👏🏻👏🏻
00:00
秦旷
:
欢迎👏🏻
新期五
新期五
2026.6.14
沙发来了
秦旷
:
欢迎👏🏻
Snoopy0618
Snoopy0618
2026.6.14
Orpheus微见一更新,昏昏沉沉的我立马神清气爽
秦旷
:
早点睡觉吧还是
Snoopy0618:好的呀,我会早点睡觉的,你也早点睡觉吧
独步91
独步91
2026.6.15
小板凳坐好了!