[人人能懂AI前沿] AI提速三倍、绘画更巧、还能逛电影?最新研究颠覆你的想象

[人人能懂AI前沿] AI提速三倍、绘画更巧、还能逛电影?最新研究颠覆你的想象

31分钟 ·
播放数93
·
评论数0

你有没有想过,AI的能力瓶颈,可能不是因为它“不够聪明”,而是我们“用错了方法”?本期节目,我们将一起探索几篇有趣的最新论文:看AI如何通过“任务分解”让文档阅读提速三倍,又是如何从“教会它新知识”转变为“唤醒它沉睡的潜能”。我们还会聊到,AI怎样才能从给你“看电影”升级到带你“逛电影”,以及我们该如何为AI精心准备一份“营养套餐”而不是一堆“垃圾食品”。让我们一起看看,这些思维的转变,将如何重塑我们与AI的未来。

00:00:38 换个姿势,让AI阅读提速三倍

00:05:25 AI绘画新思路,不是更大,而是更巧

00:11:42 AI造世界,从“看电影”到“逛电影”

00:18:09 AI的新能力,不是教会,而是唤醒

00:24:25 喂给AI的资料,怎样才算“好”?

本期介绍的几篇论文:

[CL] HPD-Parsing: Hierarchical Parallel Document Parsing

[paddleocr]

arxiv.org

---

[CV] Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing

[Microsoft Mage Team]

arxiv.org

---

[AI] AlayaWorld: Interactive Long-Horizon World Modeling -- Full Technical Report

[AlayaWorld Team, Alaya Lab]

arxiv.org

---

[CL] Transcription Policy as a Latent Variable: Activating Controllable Verbatim ASR with Word-Level Timing

[nyra labs]

arxiv.org

---

[CL] Beyond Relevance-Centric Retrieval: Rubric-Oriented Document Set Selection and Ranking

[University of Science and Technology of China & Yuanbao Team, Tencent]

arxiv.org