【第688期】Skill-MAS:多智能体系统的元技能进化框架Seventy3

【第688期】Skill-MAS:多智能体系统的元技能进化框架

14分钟 ·
播放数8
·
评论数0

Seventy3 是一档借助 NotebookLM 解读前沿论文的播客——不是念摘要,也不是泛泛而谈,而是让 AI 帮你把论文掰开揉碎,说人话。我们蹲在人工智能、大模型、机器人算法、crypto 这几个领域,每期挑一篇值得关注的工作,用对话的方式聊给你听。你可以在通勤路上听,做实验的时候听,也可以当背景音放着,让新知识自然地长进脑子里。

如果你正在做有意思的研究,想让更多人看到——不管你是博士生、独立研究者还是实验室的博士后——把论文发给我们,我们帮你用 AI 做一期深度解读,让你的工作被更多同路人发现。

联系小助手微信:seventy3_podcast(加群/投稿论文)

今天的这篇的主题是:

Skill-MAS: Evolving Meta-Skill for Automatic Multi-Agent Systems

Summary

基于大语言模型(LLM)的自动多智能体系统(MAS)生成已成为解决复杂任务的重要前沿方向。然而,现有的方法在“模型能力”与“经验保留”之间面临着两难困境:推理阶段 MAS 利用了冻结的顶尖 LLM,但因无法从过去经验中学习而导致重复相同的搜索;相反,训练阶段 MAS 通过梯度更新内化经验,却受限于较小模型较低的能力上限,且难以扩展至大型顶尖 LLM。为弥合这一差距,我们提出了 Skill-MAS,这是一种全新的“第三条路径”——它将高层级编排能力概念化为一种可进化的元技能(Meta-Skill),从而将经验保留与参数更新解耦。Skill-MAS 通过闭环优化机制来提炼该架构知识:(1) 多轨迹采样(Multi-Trajectory Rollout):在当前元技能下,针对每个任务采样行为分布;(2) 选择性反思(Selective Reflection):自适应选择高优先级任务,并运用分层对比分析将系统性经验提炼为通用的策略级原则。在 4 个复杂基准测试和 4 个不同 LLM 上的广泛实验表明,Skill-MAS 不仅取得了显著的性能提升,还保持了极佳的性价比。进一步的分析表明,进化出的元技能具有极高的鲁棒性,并在未见过的任务及不同的 LLM 之间展现出强大的可迁移性。

原文链接:arxiv.org