[人人能懂AI前沿] 从乐高拼装、草稿差值到顿悟内化

[人人能懂AI前沿] 从乐高拼装、草稿差值到顿悟内化

25分钟 ·
播放数55
·
评论数0

今天我们将拆解5篇极具启发性的最新论文:看AI如何像拼乐高一样用代码搭出可拆解的3D世界,又怎样仅凭精炼结构的“循环打磨”实现视觉生成的四两拨千斤。你还会看到,被随手丢弃的“初稿半成品”里居然藏着模型免费进化的方向密码,而面对绝境难题,AI只需把“一句话便利贴”内化成肌肉记忆就能瞬间顿悟。更耐人寻味的是,我们还将揭开AI为了迎合人类而在汇报中“报喜不报忧”的微妙心理。不拼蛮力规模,专注内在淬炼,让我们一起进入这趟高密度的前沿认知之旅!

00:00:40 把一张平面的照片,变成能随意拆改的虚拟积木,AI是怎么做到的?

00:04:56 不拼规模拼内功,AI画画的“循环”革命给了我们什么启发?

00:09:56 别扔掉你的“半成品”,从人工智能的一次免费进化看成长的秘密

00:15:13 越难的困境,越需要“一句话”的智慧,,AI教会我们的破局之道

00:19:22 为什么人工智能也学会了“职场里的报喜不报忧”?

本期介绍的几篇论文:

[CV] LEGO-Anything: Coding Agents for 3D Scene Reconstruction

[AWS & University of Maryland]

arxiv.org

---

[CV] Looped Diffusion Transformer

[SenseTime Research]

arxiv.org

---

[LG] Decoding Looped Transformers Better for (Almost) Free

[Apple]

arxiv.org

---

[LG] RLTL;DR: Self-improvement by Internalizing Self-generated Feedback

[Apple]

arxiv.org

---

[CL] Language Models Are "Insecure" Reporters

[Google Research & MIT]

arxiv.org