我们总惊叹AI越来越聪明,但你有没有想过,一个能理解世间万物的“意义图书馆”和一个离完美交付总差一步的“95分陷阱”同时存在于AI身上?本期几篇最新论文将带我们一探究竟,看看如何为AI装上外部“工作室”和独立的“世界大脑”,甚至揭示出AI群体“不靠说话”的协作奥秘。准备好了吗?让我们一起看看AI如何从一个聪明的“答题者”,进化成一个可靠的“行动派”。
AI的“意义图书馆”是怎么建成的?
AI的大考,为什么「差不多」等于「差很多」
人工智能的“外挂”,到底有多厉害?
给AI游戏世界装上一个“大脑”
人多,到底是力量大,还是乱糟糟?
本期介绍的几篇论文:
[CV] WeMM-Embedding: WeChat Multi-Modal Embedding Technical Report
[WeChat Vision, Tencent Inc.]
---
[AI] FrontierChallenge: Evaluating Scientific Workflow Completion
[Apodex Team]
---
[AI] Prime Agent: A Self-Improving RLM Harness
[Princeton University & Prime Intellect]
---
[CV] Code World Model: Coding Agent as World Brain
[Westlake University & Nanyang Technological University]
---
[AI] SwarmWorld: Stigmergic technological evolution in societies of language-model agents
[MIT]
![[人人能懂AI前沿] 从外部装备、世界大脑到蜂群智慧](https://image.xyzcdn.net/FqWpK8fpivLboaqBbRHUe_BCOvxu.png@small)