今天我们将拆解5篇极具启发性的最新论文:看AI如何像拼乐高一样用代码搭出可拆解的3D世界,又怎样仅凭精炼结构的“循环打磨”实现视觉生成的四两拨千斤。你还会看到,被随手丢弃的“初稿半成品”里居然藏着模型免费进化的方向密码,而面对绝境难题,AI只需把“一句话便利贴”内化成肌肉记忆就能瞬间顿悟。更耐人寻味的是,我们还将揭开AI为了迎合人类而在汇报中“报喜不报忧”的微妙心理。不拼蛮力规模,专注内在淬炼,让我们一起进入这趟高密度的前沿认知之旅!
00:00:40 把一张平面的照片,变成能随意拆改的虚拟积木,AI是怎么做到的?
00:04:56 不拼规模拼内功,AI画画的“循环”革命给了我们什么启发?
00:09:56 别扔掉你的“半成品”,从人工智能的一次免费进化看成长的秘密
00:15:13 越难的困境,越需要“一句话”的智慧,,AI教会我们的破局之道
00:19:22 为什么人工智能也学会了“职场里的报喜不报忧”?
本期介绍的几篇论文:
[CV] LEGO-Anything: Coding Agents for 3D Scene Reconstruction
[AWS & University of Maryland]
---
[CV] Looped Diffusion Transformer
[SenseTime Research]
---
[LG] Decoding Looped Transformers Better for (Almost) Free
[Apple]
---
[LG] RLTL;DR: Self-improvement by Internalizing Self-generated Feedback
[Apple]
---
[CL] Language Models Are "Insecure" Reporters
[Google Research & MIT]
![[人人能懂AI前沿] 从乐高拼装、草稿差值到顿悟内化](https://image.xyzcdn.net/FqWpK8fpivLboaqBbRHUe_BCOvxu.png@small)