你有没有想过,我们每天都在用的AI,在那些看不见的地方,正在发生什么?本期我们将通过几篇最新论文,一起去看看AI华丽大厦地基下的“裂缝”,潜入它用于思考的“秘密厨房”。我们还会探讨如何为它装上一个检测内心矛盾的“逻辑测谎仪”,并警惕我们是怎样在不经意间,把复杂的“人类价值观”简化成了一道危险的选择题。
AI大模型,那些藏在基座里的“裂缝”
你的AI在说谎吗?我们迎来了一个“逻辑测谎仪”
AI的“心口不一”,它在哪以及为什么在那思考?
AI的价值观,正在被简化成一道选择题
让机器人拥有“故事感”的记忆
本期介绍的几篇论文:
[CL] Cracks in the Foundation: Seemingly Minor Architectural Choices Impact Long Context Extension
[Ai2 & CMU]
---
[AI] How to Verify Consistency of Probabilistic Claims
[EPFL & Université de Montréal]
---
[CL] Off-Axis, On Purpose: Where a Transformer Computes Concepts and Why it Does So
[University of Washington]
---
[AI] Toward a Theory of Value in AI Alignment
[Google Research & UCLA & Google DeepMind]
---
[CV] GESTO: Human-Centric Spatio-Temporal Memory for Reasoning in Dynamic Scenes
[KTH Royal Institute of Technology & University of Stuttgart]
![[人人能懂AI前沿] 效率的代价、思维的几何与价值观的简化](https://image.xyzcdn.net/FqWpK8fpivLboaqBbRHUe_BCOvxu.png@small)