跳到正文
热点事件持续更新

MNIST与文本分类对抗样本攻击复现研究

1 篇报道1 个报道来源12 小时前更新

先了解这件事

报道摘要

该研究复现了图像与文本分类中的逃逸攻击,显示 MNIST 模型在 FGSM 攻击下准确率从 98.63% 降至 1.72%,而 DistilBERT 在特定扰动下仅产生微弱概率变化。实验表明对抗脆弱性具有强模态依赖性,且鲁棒性需通过实证测试而非依赖清洁准确率推断。

摘自 arXiv cs.CR

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. arXiv cs.CR
    对抗噪声如何绕过 ML 分类器:MNIST 与 DistilBERT 的逃逸攻击研究

    该研究复现了图像与文本分类中的逃逸攻击,显示 MNIST 模型在 FGSM 攻击下准确率从 98.63% 降至 1.72%,而 DistilBERT 在特定扰动下仅产生微弱概率变化。实验表明对抗脆弱性具有强模态依赖性,且鲁棒性需通过实证测试而非依赖清洁准确率推断。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。