Anthropic 扩展 Cyber Verification Program 并公布 CyScenarioBench 拦截率数据
Expanding the Cyber Verification Program
Anthropic 正式推出升级版的网络验证计划(CVP),将原有的 Project Glasswing 和 CVP 整合为包含三个层级的统一访问体系:Defense Access、Red Team Access 和 Specialized Access,旨在向经过验证的安全专业人员提供降低拦截限制的 Claude Opus 5.5、Claude Sonnet 5.5 及 Claude Mythos 5.1 等模型能力。
该计划的核心变化在于基于工作性质划分权限,并通过 CyScenarioBench 基准测试公开了不同层级的拦截效果。数据显示,在无 CVP 访问时所有任务被拦截;Defense Access 层级在 50 次尝试中拦截了 46 次;而 Red Team Access 层级未发生任何拦截,成功完成 34 个任务,其成功率与无防护状态下的 67.6% 持平。这一结果证实了 Anthropic 能够在保留基础安全防线的前提下,显著释放模型在复杂多阶段网络操作中的实际效能。
此外,新计划明确了各层级的适用对象与合规要求,例如 Red Team Access 仅限组织申请且需进行业务验证,Specialized Access 则涉及与美国政府合作审查以测试关键基础设施。虽然目前数据保留是强制要求,但 Anthropic 预告将在今年秋季推出的 Enterprise Frontier Safeguards (EFS) 允许符合条件的组织使用零数据保留模式存储数据。这些调整标志着 Anthropic 从单纯限制转向分级赋能,试图解决通用模型在防御侧因过度保守而无法辅助实战的问题。
通过CyScenarioBench实测数据量化了防御与红队访问的拦截差异,为评估模型在真实攻防场景中的可用性提供了可验证依据。
来源:Anthropic News · anthropic.com