[人人能懂AI前沿] 从“上锁的剑”到“行动草图”:重塑AI的思考与行动

[人人能懂AI前沿] 从“上锁的剑”到“行动草图”:重塑AI的思考与行动

29分钟 ·
播放数123
·
评论数0

你有没有想过,我们该如何驾驭一个越来越聪明的AI?本期我们将从几篇最新的论文出发,探讨一些极其巧妙的思路:我们不删除AI的危险知识,而是给它一把上了锁的“双刃剑”;我们不直接塞给AI答案,而是像“好私教”一样让它反思自己的功劳;我们甚至用古老的“学徒制”让普通模型超越名师,用一张“行动草图”就能指挥机器人干活;最后,我们会发现,解决最复杂的排序问题,有时只需换个更聪明的“提问方式”。准备好了吗?让我们一起看看这些闪耀着智慧之光的AI新思想。

00:00:40 给AI一把上了锁的“双刃剑”

00:05:00 如何给AI请一个“好私教”?

00:10:01 AI世界的“学徒制”,如何把一个普通模型,训练成超级学霸?

00:15:52 给机器人画一张“行动草图”

00:21:22 给机器排座次,换个聪明的问法

本期介绍的几篇论文:

[LG] Mark, Don't Erase: Token Inoculation for Dual-Use Knowledge in LLMs

[NAVER AI Lab]

arxiv.org

---

[LG] Off-Context GRPO: Learning to Reason on Hard Problems using Privileged Information

[Meta AI]

arxiv.org

---

[CL] Search-on-Graph-R1: Training Large Language Models to Search Knowledge Graphs with Reinforcement Learning

[Université de Montréal & McGill University]

arxiv.org

---

[CV] Masked Visual Actions for Unified World Modeling

[Stanford University]

arxiv.org

---

[LG] Exposure-Based Reinforcement Learning to Rank

[Google DeepMind & University of Amsterdam]

arxiv.org