半监督文本分类的对抗训练方法
摘要
本文提出了针对文本分类的对抗训练和虚拟对抗训练方法,通过在RNN中对词嵌入而非原始输入施加扰动来实现。该方法在半监督和监督文本分类基准上取得了最先进的结果,同时降低了过拟合。
暂无内容
查看缓存全文
缓存时间: 2026/04/20 14:45
# 半监督文本分类的对抗训练方法
来源: https://openai.com/index/adversarial-training-methods-for-semi-supervised-text-classification/
OpenAI## 摘要
对抗训练提供了一种正则化有监督学习算法的方法,而虚拟对抗训练能够将有监督学习算法扩展到半监督设置中。然而,这两种方法都需要对输入向量的众多条目进行微小扰动,这对于诸如 one-hot 词表示这样的稀疏高维输入来说是不合适的。我们通过对循环神经网络中的词嵌入应用扰动,而不是对原始输入本身应用扰动,将对抗训练和虚拟对抗训练扩展到文本领域。所提出的方法在多个基准半监督和纯有监督任务上取得了最先进的结果。我们提供了可视化和分析,展示了学习到的词嵌入质量的提高,以及在训练过程中模型不太容易过拟合。代码可在 https://github.com/tensorflow/models/tree/master/research/adversarial_text 获取。
相似文章
大型语言模型的信息论对抗训练
本文介绍了 WARDEN,一种用于大型语言模型的分布鲁棒对抗训练框架。该框架利用 f-散度动态调整对抗样本的权重,在显著降低攻击成功率的同时保持了计算效率。
通道级语义扰动:面向多样训练范式的不可学习示例
本文系统研究了不同训练范式下的不可学习示例,揭示了预训练权重会削弱现有方法的效果,并提出浅层语义伪装(SSC)方法,通过在语义有效子空间中生成扰动来维持不可学习性。
TextCloak:以RL驱动的不可学习文本阻止未经授权的LLM利用
TextCloak是一个新的RL驱动框架,用于生成不可学习的文本示例,以保护数据免遭未经授权的LLM微调,在保持语义保真度的同时,降低模型在多个数据集和LLM上的效用。
聪明训练,事半功倍:基于切换信号引导的主动学习训练
本文提出HybridAL,一种主动学习方法,通过稳定信号动态切换重训练与微调,从而提升文本分类任务的效率与性能。
从上下文中学习:基于扰动公共文档的合成训练
本文介绍了一种合成训练管道,利用扰动公共文档生成上下文相关的训练数据,显著提升了大型语言模型在诸如CL-bench等上下文学习任务上的性能,且无需人工标注。