[人人能懂AI前沿] AI的认知陷阱、代码革命与科研总管

[人人能懂AI前沿] AI的认知陷阱、代码革命与科研总管

29分钟 ·
播放数98
·
评论数0

你有没有觉得,AI时而像个无所不能的天才,时而又像个会钻牛角尖的“笨小孩”?本期节目,我们将通过几篇最新论文,一探究竟:为何AI会固执地采纳错误答案,又为何会被最简单的“跟我读”骗术“催眠”?同时,我们也将看到AI如何化身“科研总管”,以及一份好的“设计图”为何在未来可能比代码本身更值钱。准备好,让我们一起揭开AI这些既矛盾又迷人的行为背后的秘密。

00:00:33 AI的“小固执”,为什么它信你,却不听你的?

00:07:48 未来,你的代码可能一文不值

00:13:33 为什么AI解难题,也会钻牛角尖?

00:18:37 为什么AI会被最简单的骗术“带偏”?

00:23:09 让AI当科研总管,是一种什么体验?

本期介绍的几篇论文:

[CL] Evidence Integration in Large Language Models

[MIT]

arxiv.org

---

[AI] Design Docs Are All You Need: An AI-native Machine-Learning Performance Tool

[Google DeepMind & MIT]

arxiv.org

---

[LG] Fractal basins trap latent reasoning

[The University of Texas at Austin]

arxiv.org

---

[AI] Repeat-After-Me: Black-Box Adaptive Visual Prompt Injection

[UC Berkeley & FAIR at Meta]

arxiv.org

---

[AI] La Agente Óptima: Towards Agentic Self-Driving Laboratories

[University of Toronto & 700 University Ave]

arxiv.org