论文翻译 - HotFlip: White-Box Adversarial Examples for Text Classification

本文提出 HotFlip 方法生成白盒对抗样本以欺骗字符级神经分类器。该方法基于原子级翻转操作,只需少量操作就能大幅降低分类准确性,还可用于对抗训练提升模型鲁棒性。实验表明,白盒敌手更具破坏性,且该方法生成的对抗样本对句子含义影响小,也能适配单词级模型。

论文链接:https://aclanthology.org/P18-2006.pdf
项目代码:https://github.com/AnyiRao/WordAdver

Abstract

我们提出了一种有效的方法来生成白盒的对抗样本去欺骗一个字符级的神经分类器。我们发现只需要很少的一些操作就能大大降低准确性。我们的方法依赖于一个原子级的翻转操作,也就是根据 one-hot 的输入向量的梯度,将一个token转换成另一个。由于我们方法的有效性,我们可以执行对抗训练,来使模型在测试时对攻击更加鲁棒。通过使用一些语义保持的约束,我们证明 HotFlip 也可以适用于对单词级的分类器的攻击。

1 Introduction

对抗样本是一个预测的ML模型的输入,这个模型被恶意设计来造成不好的性能(Goodfellow et al., 2015)。对抗性示例暴露了模型表现不佳的输入空间区域,这有助于理解和改进模型。通过使用这些示例作为训练数据,对抗训练学习到了更稳健的模型,甚至可能在非对抗样本上也表现得更好。人们对理解 NLP 系统漏洞的兴趣正在增长(Jia and Liang, 2017; Zhao et al., 2018;Belinkov and Bisk, 2018; Iyyer et al., 2018)。以前的工作侧重于在黑盒设置中创建对抗样本的启发式方法,而无需对模型参数进行任何明确的了解。在白盒设置中,我们使用模型的完整知识来开发最坏情况的攻击,这可以揭示更大的漏洞。

我们提出了一种针对可微的文本分类器的白盒敌手。我们发现只需要一些少量的操作就能大大增加误分类的错误。此外,快速生成对抗样本使得对抗训练变得可行,这有助于模型防御对抗样本攻击并提高在干净示例的准确性。我们方法的核心是一个原子级的翻转操作,它通过使用模型对 one-hot 输入向量的方向导数将一个token改成为另一个。

我们的贡献如下:

  1. 我们提出了一种高效的基于梯度的优化方法,来操纵离散的文本结构(在它的 one-hot 的表示上)。
  2. 我们研究了一个用对抗样本训练的分类器的鲁棒性,通过研究它对攻击的弹性以及它对干净测试数据的准确性。

2 Related Work

对抗样本是研究深度学习模型漏洞的强大工具 (Szegedy et al., 2014)。虽然这一研究方向最近在深度学习社区中受到了很多关注,但它其实在机器学习中有着悠久的历史,可以追溯到对线性垃圾邮件分类器的对抗性攻击(Dalvi et al., 2004;Lowd and Meek, 2005)。Hosseini et al. (2017) 表明,简单的修改——比如在字符之间添加空格或点——可以极大地改变谷歌的 perspective API 的毒性评分。Belinkov and Bisk (2018) 表明,字符级的机器翻译系统对随机的字符操作——比如键盘拼写错误——过于敏感。他们用合成或自然噪声来操纵句子中的每个词。然而,在我们所有的实验中,我们关心句子中的失真程度,并寻找更强大的对抗样本,它可以在有限的预算内增加损失。不再是随机地扰动文本,我们提出了一种有效的方法,可以用模型相对于输入的梯度来生成对抗性文本。

对抗性训练将训练与对抗样本的生成交织在一起(Goodfellow et al., 2015)。具体来说,在每一次训练迭代之后,对抗样本会被创建并添加到 mini-batches 中。Madry et al. (2018) 提出了一种基于梯度的投影方法来创建对抗样本,这已被证明是针对图像分类的对抗性攻击的最有效的防御机制之一。Miyato et al. (2017) 通过在词嵌入中添加噪声来创建对抗样本,而无需创建真实世界有语义的文本对抗样本。我们的工作是第一个产生真实世界的对抗样本的有效方法,它也可以被用于有效的对抗训练。

3 HotFlip

HotFlip 是一种使用字符替换(“flip”)来生成对抗样本的方法。HotFlip 还支持插入和删除操作,通过将它们表示为字符替换的序列。它使用关于 one-hot 输入的表示的梯度来有效地估计哪些个体变化具有最高估计损失,并使用束搜索来找到一组可以很好地协同工作来迷惑分类器的操作。

3.1 Definitions

我们用 J ( x , y ) J(\mathrm{x,y}) J(x,y) 来代表模型在输入 x \mathrm{x} x 上关于真实输出 y \mathrm{y} y 的损失。比如说,对于分类任务,损失就是在 softmax 单元的输出上的 log 损失。设 V V V 是字母表, x \mathrm{x} x 是一个长度为 L L L 个字符的文本,并且 x i j ∈ { 0 , 1 } ∣ V ∣ x_{ij}\in\{0,1\}^{|V|} xij{ 0,1}V 是一个代表了第 i i i 个单词的第 j j j 个字符的 one-hot 向量。字符的序列可以被表示为

x = [ ( x 11 , . . . , x 1 n ) ; . . . ; ( x m 1 , . . . , x m n ) ] \mathrm{x}=[(x_{11},...,x_{1n});...;(x_{m1},...,x_{mn})] x=[(x11,...,x1n);...;(xm1,...,xmn)]

其中分号表示单词之间的显式分割。单词的数量用 m m m 表示, n n n 是一个单词中含有的最大字符数。

3.2 Derivatives of Operations

我们将文本操作表示为输入空间中的向量,并通过对应于这些操作的方向导数来估计变化的损失。基于这些导数,敌手可以选择最佳的损失上升方向。我们的算法只需要一个函数评估(前向传递)和一个梯度计算(后向传递)来估计最好的可能的翻转。

在第 i i i 个单词的第 j j j 个字符的翻转(从字母表中第 a a a 个字符变成第 b b b 个字符)可以表示为这个向量:

v ⃗ i j b = ( 0 ⃗ , . . . ; ( 0 ⃗ , . . . ( 0 , . . . , − 1 , 0 , . . . 1 , 0 ) j , . . . , 0 ⃗ ) i ; 0 ⃗ , . . . ) \vec{v}_{ijb}=(\vec{0},...;(\vec{0},...(0,...,-1,0,...1,0)_{j},...,\vec{0})_{i};\vec{0},...) v ijb=(0 ,...;(0 ,...(0,...,1,0,...1,0)j,...,0 )i;0

内容概要:本文围绕“基于分布式模型预测控制的多个固定翼无人机一致性控制”展开,利用Matlab代码实现相关算法的仿真,旨在通过分布式控制策略实现多架固定翼无人机在复杂动态环境中的协同飞行与一致性控制。研究结合模型预测控制(MPC)方法,构建适用于多无人机系统的分布式优化框架,重点解决了通信受限、信息延迟及无中心化指挥条件下的协同稳定性问题。内容涵盖固定翼无人机的动力学建模、分布式MPC优化求解机制、一致性协议设计、通信拓扑结构分析以及仿真验证全过程,确保多机系统在保持队形一致的同时完成协同任务。; 适合人群:具备自动控制理论、无人机系统建模或多智能体协同控制基础,从事智能无人系统、集群控制、自动化与机器人等领域研究的研究生、科研人员及工程技术人员。; 使用场景及目标:①应用于多无人机协同编队飞行、集群侦察、分布式任务执行等实际工程场景;②为分布式MPC算法在多智能体系统中的一致性控制提供可复现的Matlab仿真案例,推动先进控制理论向工程实践转化;③服务于科研论文复现、算法验证、控制系统课程设计与毕业课题参考。; 阅读建议:建议读者结合文中提供的Matlab代码逐模块运行与调试,重点关注分布式MPC在不同通信拓扑下对一致性收敛性能的影响,并可通过调整预测时域、权重矩阵与噪声参数等方式深化对算法鲁棒性与适应性的理解。
内容概要:本文提出了一种基于变分模态分解(VMD)、麻雀搜索算法(SSA)优化与长短期记忆网络(LSTM)相结合的光伏功率预测模型(VMD-SSA-LSTM),旨在提升光伏发电预测的精度与鲁棒性。该方法首先利用VMD对原始非平稳光伏功率序列进行自适应分解,获得一系列具有更稳定特征的本征模态分量(IMFs),有效降低数据复杂性与噪声干扰;随后引入麻雀搜索算法(SSA)对LSTM网络的关键超参数(如学习率、隐层节点数等)进行全局寻优,克服传统试凑法效率低、易陷入局部最优的问题,显著提升模型收敛速度与泛化能力;最后,构建多个LSTM子模型分别预测各模态分量,并将结果重构得到最终的光伏功率预测值。该混合模型充分融合了VMD在信号预处理中的优异分解性能、SSA在参数优化中的高效搜索能力以及LSTM在捕捉时间序列长期依赖关系上的强大建模优势,实现了对复杂气象因素影响下光伏出力波动的高精度拟合与预测。; 适合人群:具备一定电力系统、新能源发电或时间序列预测基础知识,熟悉MATLAB编程环境,从事光伏功率预测、智能电网调度、可再生能源集成、负荷预测等领域研究的科研人员、工程技术人员及高校研究生。; 使用场景及目标:①应用于光伏电站的短期与超短期功率预测,为电网安全调度、电力市场交易、储能系统配置及需求侧响应提供精准数据支撑;②解决传统单一预测模型(如ARIMA、BPNN、单一LSTM)在处理非平稳、强波动性光伏数据时存在的精度不足、稳定性差等问题;③为风电、负荷等其他非平稳时序预测问题提供一种有效的“分解-优化-预测”混合建模范式与技术实现路径。; 阅读建议:建议读者结合文中提供的完整MATLAB代码,深入理解VMD信号分解、SSA优化算法流程及LSTM网络构建的每一个技术环节,通过实际历史数据进行模型复现与对比实验(如与VMD-LSTM、SSA-LSTM等模型比较),掌握参数调优技巧与模型性能评估方法,从而真正掌握该先进混合预测模型的核心思想与应用精髓。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值