跳到正文
热点事件持续更新

LLM辅助二进制转源码恢复的SoK与实证评估

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

2026年10月9日,一篇发表于arXiv cs.CR的论文首次针对LLM辅助的二进制到源代码恢复建立了系统化知识体系(SoK)。该研究提供了包含七项关键指标和六个评估维度的系统性实证评估。测试样本总量达45,000个,覆盖了从标准架构到嵌入式IoT架构的四种标准及五种嵌入式架构、五种优化级别以及符号剥离场景。评估过程涵盖了四种成熟语言和两种遗留语言的同语言与跨语言恢复能力,旨在解决当前领域方法碎片化且缺乏统一评估标准的问题。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. arXiv cs.CR
    SoK: LLM在源代码恢复上的可靠性:分类体系与实证评估

    该论文首次针对LLM辅助的二进制到源代码恢复(binary-to-source recovery)建立了系统化的知识体系(SoK),并提供了包含七项关键指标和六个评估维度的系统性实证评估。研究覆盖了从标准架构到嵌入式IoT架构的四种标准及五种嵌入式架构、五种优化级别以及符号剥离场景,测试样本总量达45,000个,旨在解决当前领域方法碎片化且缺乏统一评估标准的问题。 评估过程不仅涵盖了四种成熟语言和两种遗留语言的同语言与跨语言恢复能力,还通过控制变量法消融了输入表示、上下文增强、模型规模、迭代次数及审查角色等设计选择对性能的具体影响。实验使用了三个现成模型配合内部构建的恢复流水线,重点考察了现有工作在嵌入式架构和非C/C++语言覆盖上的局限性,揭示了不同设计决策在特定硬件或编译配置下的表现差异。 事实层面,该研究确认了LLM正推动该领域从基于规则的启发式方法向概率性高保真语义恢复转变,但同时也暴露了跨架构和跨语言能力的显著不稳定性。推断层面,这意味着当前自动化工具尚不足以完全替代人工进行复杂的恶意代码分析或遗留系统维护,特别是在涉及嵌入式设备时。猜测层面,未来若要在工业级场景中大规模应用此类技术,可能需要针对特定架构定制上下文增强策略,而非依赖通用模型的泛化能力。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。