APEX 提出基于执行边界的 LLM Agent 间接提示注入防御框架
先了解这件事
2026 年 10 月 7 日,arXiv 发布论文《APEX:基于执行边界主动保护的 LLM 智能体防御框架》,针对间接提示注入(IPI)在 LLM 智能体中的传播问题提出新方案。该研究指出危害仅在智能体将内部状态转化为外部动作的“执行边界”处显现,因此防御应聚焦于此。APEX 依据预编译的授权合同验证拟议效果是否被授权及运行时信息是否获任务背书。其通过证据门控预防机制仅在合同允许时放行效果,并利用欺骗暴露机制在效果提交前揭示未获认可的使用行为。该方法不依赖特定模型架构或训练数据。
AI 根据报道生成 · 2 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
- arXiv cs.CR精选APEX:基于执行边界主动保护的LLM智能体防御框架
该论文针对间接提示注入(IPI)在LLM智能体中的传播问题,提出名为APEX的主动防御框架。其核心观点是无论攻击载体如何变化,危害仅在智能体将内部状态转化为外部动作或输出的“执行边界”处显现。因此,防御应聚焦于该边界,依据预编译的授权合同来验证两个条件:拟议效果是否被授权,以及运行时信息是否获得任务背书。 APEX通过两种机制实现保护:证据门控预防仅在合同允许时放行效果,欺骗暴露机制则在效果提交前揭示未获认可的使用行为。该方法不依赖特定攻击策略或污点追踪,而是基于任务许可进行统一防护。实验显示,在13个基线对比中,APEX在六个基准测试中有五个达到0%的攻击成功率,第六个为0.56%,且在三种能力单元类型下的自适应攻击中均保持0%成功率,对不同防御骨干模型也表现出有效性。 事实层面,该研究定义了基于执行边界的防御范式并提供了代码实现;推断层面,这种基于合同而非模式的思路可能改变Agent安全架构的设计方向,减少对特征匹配的依赖;猜测层面,其在复杂多模态场景下的性能表现及部署成本仍需进一步观察。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。