你有没有觉得,AI时而像个无所不能的天才,时而又像个会钻牛角尖的“笨小孩”?本期节目,我们将通过几篇最新论文,一探究竟:为何AI会固执地采纳错误答案,又为何会被最简单的“跟我读”骗术“催眠”?同时,我们也将看到AI如何化身“科研总管”,以及一份好的“设计图”为何在未来可能比代码本身更值钱。准备好,让我们一起揭开AI这些既矛盾又迷人的行为背后的秘密。
AI的“小固执”,为什么它信你,却不听你的?
未来,你的代码可能一文不值
为什么AI解难题,也会钻牛角尖?
为什么AI会被最简单的骗术“带偏”?
让AI当科研总管,是一种什么体验?
本期介绍的几篇论文:
[CL] Evidence Integration in Large Language Models
[MIT]
---
[AI] Design Docs Are All You Need: An AI-native Machine-Learning Performance Tool
[Google DeepMind & MIT]
---
[LG] Fractal basins trap latent reasoning
[The University of Texas at Austin]
---
[AI] Repeat-After-Me: Black-Box Adaptive Visual Prompt Injection
[UC Berkeley & FAIR at Meta]
---
[AI] La Agente Óptima: Towards Agentic Self-Driving Laboratories
[University of Toronto & 700 University Ave]
![[人人能懂AI前沿] AI的认知陷阱、代码革命与科研总管](https://image.xyzcdn.net/FqWpK8fpivLboaqBbRHUe_BCOvxu.png@small)