[人人能懂AI前沿] 如何让AI不犯错、合作快、还学得会?

[人人能懂AI前沿] 如何让AI不犯错、合作快、还学得会?

24分钟 ·
播放数132
·
评论数0

你是否想过,如何给总爱“胡说八道”的AI配个从不说谎的“裁判”,让它成为绝对可靠的实干家?又该怎么让两个AI跳过聊天,直接“开个小会”高效同步想法?本期节目,我们将一起探索几篇最新论文带来的奇妙思路:看AI如何一边深度思考,一边给自己“抢答”来提升速度;看机器人如何通过专属“陪练”从失败中自我开窍;最后,我们还会发现,通往最优解的道路,有时竟是一条返璞归真的捷径。

00:00:34 让AI从“夸夸其谈者”变成“实干家”的秘密

00:05:54 当AI学会了开小会

00:10:23 让AI一边思考,一边抢答

00:14:53 给机器人请个“陪练”,让它自己开窍

00:19:03 优化世界的返璞归真之道

本期介绍的几篇论文:

[AI] AI with Authority, from Application to Silicon

[J Hickey]

arxiv.org

---

[LG] Dual-Cache Latent Space Communication between Heterogeneous Language Models

[J Liu, Q Zhang, Y Jia, Z Kan… — Amazon Web Services (AWS)]

arxiv.org

---

[CL] Self-Speculation for Faster Reasoning Models

[R Valluri, T Nguyen, A Grover — University of California, Los Angeles]

arxiv.org

---

[RO] Beyond Imitation: Self-Improving Robot Policies via Off-Policy Q-Planning

[V Giridhar, A Khandelwal, J A. Collins, I Georgiev… — Georgia Institute of Technology]

arxiv.org

---

[LG] Primal Acceleration of Newton's Method

[N Doikov — Cornell University]

arxiv.org