[人人能懂AI前沿] 从模拟实践、耦合定律到裁判分片

[人人能懂AI前沿] 从模拟实践、耦合定律到裁判分片

28分钟 ·
播放数90
·
评论数0

今天我们来聊聊如何把聪明的AI,变成一个真正可靠的专家。我们会看到,AI要像医生一样去“实习”才能成长,而训练它需要一张全新的“地图”。我们还将揭开手机AI突然“变笨”的秘密,并告诉你一个简单方法,让AI裁判不再“偷懒”。这几篇最新论文,将刷新你对AI如何学习和工作的认知。

00:00:27 AI医生实习记,高手是怎么炼成的?

00:05:15 大模型训练,高手手里的那张新地图

00:11:00 你的手机AI,为什么会突然变笨?

00:17:12 AI裁判也会“偷懒”?一个简单的办法让它更靠谱

00:22:18 大模型瘦身指南,你以为的“闲职”,其实是“关键先生”

本期介绍的几篇论文:

[AI] ResidencyRL: Reinforcement Learning in Simulated Clinical Environments

[Google DeepMind]

arxiv.org

---

[CL] Skaling: Chinchilla's Exponents Meet Kaplan's Coupling

[FAIR at Meta]

arxiv.org

---

[LG] Quantization Damage Is Multiplicative, Not Additive

[Holistic AI]

arxiv.org

---

[LG] Sharding Prevents LLM Oversight Failures and Adversarial Exploitation

[CMU]

arxiv.org

---

[LG] The Sparsity Whisperer

[MIT]

arxiv.org