【第699期】LLM智能体互操作性协议综述Seventy3

【第699期】LLM智能体互操作性协议综述

25分钟 ·
播放数0
·
评论数0

Seventy3 是一档借助 NotebookLM 解读前沿论文的播客——不是念摘要,也不是泛泛而谈,而是让 AI 帮你把论文掰开揉碎,说人话。我们蹲在人工智能、大模型、机器人算法、crypto 这几个领域,每期挑一篇值得关注的工作,用对话的方式聊给你听。你可以在通勤路上听,做实验的时候听,也可以当背景音放着,让新知识自然地长进脑子里。

如果你正在做有意思的研究,想让更多人看到——不管你是博士生、独立研究者还是实验室的博士后——把论文发给我们,我们帮你用 AI 做一期深度解读,让你的工作被更多同路人发现。

联系小助手微信:seventy3_podcast(加群/投稿论文)

今天的这篇的主题是:

A survey of agent interoperability protocols: Model Context Protocol (MCP), Agent Communication Protocol (ACP), Agent-to-Agent Protocol (A2A), and Agent Network Protocol (ANP)

Summary

基于大语言模型的自主 Agent(LLM-powered autonomous agents)需要强健、标准化的协议,以便在异构系统间集成工具、共享上下文数据并协调任务。点对点的特定集成(ad-hoc integrations)难以在大规模扩展、安全保障以及跨领域通用化方面取得突破。

本综述探讨了四种新兴的 Agent 通信协议:模型上下文协议(Model Context Protocol, MCP)、Agent 通信协议(Agent Communication Protocol, ACP)、Agent 到 Agent 协议(Agent-to-Agent Protocol, A2A)以及 Agent 网络协议(Agent Network Protocol, ANP),它们分别解决了不同部署场景下的互操作性问题:

  • MCP 提供了一个用于安全工具调用和类型化数据交换的 JSON-RPC 客户端-服务器接口。

  • ACP 定义了一种基于 RESTful HTTP 的通用通信协议,支持 MIME 类型的多部分消息(multipart messages)以及同步和异步交互。其轻量化且独立于运行时的设计实现了可扩展的 Agent 调用,同时具备会话管理、消息路由以及与基于角色的标识符和去中心化标识符(DIDs)集成等特性。

  • A2A 利用基于权能的“Agent 卡片”(Agent Cards)实现点对点(peer-to-peer)的任务委托,支持企业 Agent 工作流中安全且可扩展的协作。

  • ANP 利用 W3C 去中心化标识符(DIDs)和 JSON-LD 图谱,支持开放网络下的 Agent 发现与安全协作。

本文在交互模式、发现机制、通信模式和安全模型等多个维度上对这些协议进行了对比。基于对比分析,本文提出了一个分阶段的采纳路线图:

  1. 首先引入 MCP 用于工具接入;

  2. 随后引入 ACP,用于在基于 HTTP 的可扩展部署中实现结构化、多模态的消息传递、感知会话的交互,以及在线和离线的 Agent 发现;

  3. 接着引入 A2A 用于协同任务执行;

  4. 最终扩展至 ANP,以支持去中心化的 Agent 市场。

本研究为设计安全、可互操作且具扩展性的 LLM Agent 生态系统提供了全面的基础。

原文链接:arxiv.org