你有没有想过,我们该如何驾驭一个越来越聪明的AI?本期我们将从几篇最新的论文出发,探讨一些极其巧妙的思路:我们不删除AI的危险知识,而是给它一把上了锁的“双刃剑”;我们不直接塞给AI答案,而是像“好私教”一样让它反思自己的功劳;我们甚至用古老的“学徒制”让普通模型超越名师,用一张“行动草图”就能指挥机器人干活;最后,我们会发现,解决最复杂的排序问题,有时只需换个更聪明的“提问方式”。准备好了吗?让我们一起看看这些闪耀着智慧之光的AI新思想。
给AI一把上了锁的“双刃剑”
如何给AI请一个“好私教”?
AI世界的“学徒制”,如何把一个普通模型,训练成超级学霸?
给机器人画一张“行动草图”
给机器排座次,换个聪明的问法
本期介绍的几篇论文:
[LG] Mark, Don't Erase: Token Inoculation for Dual-Use Knowledge in LLMs
[NAVER AI Lab]
---
[LG] Off-Context GRPO: Learning to Reason on Hard Problems using Privileged Information
[Meta AI]
---
[CL] Search-on-Graph-R1: Training Large Language Models to Search Knowledge Graphs with Reinforcement Learning
[Université de Montréal & McGill University]
---
[CV] Masked Visual Actions for Unified World Modeling
[Stanford University]
---
[LG] Exposure-Based Reinforcement Learning to Rank
[Google DeepMind & University of Amsterdam]
![[人人能懂AI前沿] 从“上锁的剑”到“行动草图”:重塑AI的思考与行动](https://image.xyzcdn.net/FqWpK8fpivLboaqBbRHUe_BCOvxu.png@small)