[人人能懂AI前沿] 效率的代价、思维的几何与价值观的简化

[人人能懂AI前沿] 效率的代价、思维的几何与价值观的简化

27分钟 ·
播放数121
·
评论数0

你有没有想过,我们每天都在用的AI,在那些看不见的地方,正在发生什么?本期我们将通过几篇最新论文,一起去看看AI华丽大厦地基下的“裂缝”,潜入它用于思考的“秘密厨房”。我们还会探讨如何为它装上一个检测内心矛盾的“逻辑测谎仪”,并警惕我们是怎样在不经意间,把复杂的“人类价值观”简化成了一道危险的选择题。

00:00:30 AI大模型,那些藏在基座里的“裂缝”

00:05:30 你的AI在说谎吗?我们迎来了一个“逻辑测谎仪”

00:11:39 AI的“心口不一”,它在哪以及为什么在那思考?

00:16:43 AI的价值观,正在被简化成一道选择题

00:21:45 让机器人拥有“故事感”的记忆

本期介绍的几篇论文:

[CL] Cracks in the Foundation: Seemingly Minor Architectural Choices Impact Long Context Extension

[Ai2 & CMU]

arxiv.org

---

[AI] How to Verify Consistency of Probabilistic Claims

[EPFL & Université de Montréal]

arxiv.org

---

[CL] Off-Axis, On Purpose: Where a Transformer Computes Concepts and Why it Does So

[University of Washington]

arxiv.org

---

[AI] Toward a Theory of Value in AI Alignment

[Google Research & UCLA & Google DeepMind]

arxiv.org

---

[CV] GESTO: Human-Centric Spatio-Temporal Memory for Reasoning in Dynamic Scenes

[KTH Royal Institute of Technology & University of Stuttgart]

arxiv.org