跳到正文
原文
arXiv cs.CR· Ryuichi Yamafuji Lun, Jingzhen Wang, Shreyas Kolte, Ruiteng Li·· 4 小时前精选AI 评分78

MIRROR 论文提出基于多路径多数派一致性的多智能体通信完整性方案

MIRROR: Multipath Quorum Integrity for LLM Multi-Agent Communication

AI 导读

该论文针对大语言模型多智能体系统(LLM-MAS)中存在的“代理在中间”(AiTM)攻击漏洞提出了 MIRROR 方案,这是一种通信层完整性原语。MIRROR 通过将单一规范化负载复制到 k 条逻辑路由上,仅当严格多数路由报告相同摘要时才接受消息,其安全性依赖于诚实路由占多数的假设,而非传统的密钥认证或语义验证。

实验数据显示,在 MMLU、HumanEval 和 MBPP 基准测试及 MetaGPT 生产 API 部署中,只要被攻陷路由比例 alpha 小于 0.5,MIRROR 能将攻击成功率(ASR)降至 0%,同时保持可用性不受影响。相比之下,同场景下使用 LLM-as-a-Judge 进行防御的成本高出 35 倍,且在拓扑扫描中阻断了高达 44.2% 的正常输出。该方案利用未加密哈希确保见证路由为常数大小,并依赖第二前像抵抗性绑定恢复的负载与多数派商定值。

事实层面,该方案在特定阈值下实现了零攻击成功率和低开销;推断层面,这表明在智能体协作架构中,引入冗余路由和统计一致性检查可能比昂贵的语义审查更具工程性价比;猜测层面,若路由间存在强相关性导致共享故障组超过半数,该机制的有效性将失效,需进一步评估实际网络环境中的路由独立性。

推荐理由

MIRROR 以无密钥哈希和多数派路由机制将多智能体中间人攻击成功率降至零,且成本仅为 LLM-as-a-Judge 的 1/35。

来源:arXiv cs.CR · arxiv.org