半监督文本分类的对抗训练方法
摘要
本文提出了针对文本分类的对抗训练和虚拟对抗训练方法,通过在RNN中对词嵌入而非原始输入施加扰动来实现。该方法在半监督和监督文本分类基准上取得了最先进的结果,同时降低了过拟合。
暂无内容
查看缓存全文
缓存时间: 2026/04/20 14:45
# 半监督文本分类的对抗训练方法
来源: https://openai.com/index/adversarial-training-methods-for-semi-supervised-text-classification/
OpenAI## 摘要
对抗训练提供了一种正则化有监督学习算法的方法,而虚拟对抗训练能够将有监督学习算法扩展到半监督设置中。然而,这两种方法都需要对输入向量的众多条目进行微小扰动,这对于诸如 one-hot 词表示这样的稀疏高维输入来说是不合适的。我们通过对循环神经网络中的词嵌入应用扰动,而不是对原始输入本身应用扰动,将对抗训练和虚拟对抗训练扩展到文本领域。所提出的方法在多个基准半监督和纯有监督任务上取得了最先进的结果。我们提供了可视化和分析,展示了学习到的词嵌入质量的提高,以及在训练过程中模型不太容易过拟合。代码可在 https://github.com/tensorflow/models/tree/master/research/adversarial_text 获取。
相似文章
类别结构保持胜过多样性:不平衡文本分类的文本增强方法综合基准
本文在7个不平衡分类数据集上对11种文本增强方法进行了基准测试,包括经典扰动、嵌入空间检索和基于LLM的方法。研究发现,基于检索的过采样(EmbSMOTE)优于基于LLM的增强方法,并且保持类别条件结构比表面多样性更为重要。
大型语言模型的信息论对抗训练
本文介绍了 WARDEN,一种用于大型语言模型的分布鲁棒对抗训练框架。该框架利用 f-散度动态调整对抗样本的权重,在显著降低攻击成功率的同时保持了计算效率。
通道级语义扰动:面向多样训练范式的不可学习示例
本文系统研究了不同训练范式下的不可学习示例,揭示了预训练权重会削弱现有方法的效果,并提出浅层语义伪装(SSC)方法,通过在语义有效子空间中生成扰动来维持不可学习性。
TextCloak:以RL驱动的不可学习文本阻止未经授权的LLM利用
TextCloak是一个新的RL驱动框架,用于生成不可学习的文本示例,以保护数据免遭未经授权的LLM微调,在保持语义保真度的同时,降低模型在多个数据集和LLM上的效用。
半监督文本属性图蒸馏
提出了STAD,一种半监督框架,利用Wasserstein距离、双路径编码器和基于LLM的文本合成来蒸馏文本属性图,以实现性能与压缩之间的最先进权衡。