跳到正文
原文
arXiv cs.CR· Marcelo Fernandez·· 11 小时前精选AI 评分78

论文提出用 Accountability Proof Block 解决 LLM Agent 持续停机时的身份绑定治理问题

Identity-Bound Governance Under Execution Uncertainty: An Accountability Proof Block for LLM Agent Persistent Halts, with Cryptographic Implementation and Cross-Model Calibration

AI 导读

这篇 arXiv cs.CR 论文针对 LLM Agent 的一种治理死锁提出机制:当可观测性或漂移检测层持续失效时,系统既不能继续执行,也不能自动停机,作者称之为 identity-bound governance event,并用 Accountability Proof Block(APB)把证据块、人工决策块和 ed25519 签名绑定到注册主体。

论文给出的机制强调系统不能伪造签名,决策主体也不能在不被发现的情况下篡改证据;实现使用 RFC 8785 JSON canonicalization 和基于 UUID4 的重放谓词。作者报告在 3,812 个停机事件中治理完整性为零未解决,在 9 类对抗向量、1,800 次攻击中检测率为 100%,k-of-n 多主体版本在 2,000 次单密钥捕获尝试中为 0 次误接受。

对六个开放 LLM 的实验中,漂移阈值 T* 在同一模型内稳定(sigma/T* < 2%),但跨模型不同,且最大模型没有漂移,作者据此否定规模单调性。事实是论文提供了密码学绑定治理流程和实验结果;推断是 Agent 部署需要按环境单独测量漂移阈值;猜测是这类证据块可能成为 Agent 停机、恢复和审计的工程模板。

推荐理由

为 LLM Agent 在可观测性失效时的停机授权提供了可验证的密码学流程,可改变只靠模型阈值治理的设计判断。

来源:arXiv cs.CR · arxiv.org