跳到正文
原文
arXiv cs.CR· Danqing Wang, Songwen Zhao, Harsh Sharma, Jierui Wang, Andre Vicente Duarte, Ivan Bercovich, Lei Li·· 11 小时前AI 评分72

AuraForge 通过合成可执行安全测试训练更安全的编码 Agent

AuraForge: Scaling Security Supervision for Training Coding Agents

AI 摘要

AuraForge 提出一种合成并验证可执行安全测试的方法,用于训练编码 Agent 在实现功能时避免安全漏洞。作者用该方法构建了 AuraGym,一个覆盖 Python、JavaScript 和 TypeScript 的多语言训练环境,包含来自 344 个真实仓库的 679 个可执行功能实现任务,并覆盖 177 个 CWE 类别。

在有人工撰写安全测试的子集上,AuraForge 平均生成约 3 倍数量的测试用例,并将误报率降低 83.23%,使替代性的安全实现也能获得正确监督。用合成安全测试训练 Qwen3.5-4B 后,其在三种语言上的提升高于用人工安全测试训练的结果,平均 FuncPass 和 SecPass 分别为 19.7 和 6.2,而人工测试组为 14.9 和 4.4。

事实是论文提供了合成安全测试的数据集、训练环境和对比结果。推断是这种方法可能降低编码 Agent 安全训练对人工安全审计的依赖。猜测是若该方法能扩展到更多语言和更复杂任务,安全测试合成可能成为编码 Agent 训练流水线的一部分。

来源:arXiv cs.CR · arxiv.org