跳到正文
原文
arXiv cs.CR· Genliang Zhu, Chu Wang·· 12 小时前AI 评分72

论文提出授权继承协议以约束自我修改 AI Agent 群体的权限传递

Authorization for Self-Modifying AI Agent Populations: Conserving Authority across Replacement, Forking, and Rollback

AI 摘要

这篇 arXiv 论文针对可自我修改的 AI Agent 群体,提出一种“授权继承”机制,用于在 Agent 替换、分叉和回滚时保持权限总量不变。作者指出,如果只给每个后继者单独授权,兄弟进程可能复制配额、合并权限、在祖先权限被撤销后继续存活,或在升级期间与前任重叠运行。

论文把每一代绑定到 manifest、root、唯一父代、完整血统和新的群体序列,并用不同不变量分别限制 root 生命周期消耗与当前群体暴露。替换期间通过分阶段预留冻结前任残余权限,分叉时验证完整子家族,每次提交原子性地隔离前任并激活后继者;祖先权限被切断会使依赖它的后代失效,回滚不会恢复已消耗权限,新 root 需要独立授权。作者给出可执行评估:32 个注册决策经直接调用和 mailbox 映射重放 64/64 次,28 次允许、36 次拒绝;独立检查器接受全部 64 条原始轨迹,拒绝 28/28 个语义变体,并通过 12/12 个 profile 不变量、16/16 次崩溃切断和 32/32 个竞争调度。

事实层面,论文证明了在完整中介、认证记录、可靠效果抽象、持久单调状态和完整血统记账前提下的群体安全继承、分叉守恒、撤销闭包、原子交接、回滚不重铸权限和排除自我认证。推断上,这套方法把 Agent 安全从单实例授权扩展到群体生命周期治理。猜测是,它若进入真实 Agent 运行时,还需要与现有工具调用、沙箱和审计系统集成,原文未给出生产部署证据。

来源:arXiv cs.CR · arxiv.org