标签
本文提出了一种几何感知的对抗攻击框架,针对对比嵌入流形中的关系结构进行攻击,表明诸如 Markmatch 之类的验证系统会因扭曲成对相似度而非决策边界而严重退化。
本文研究了使用η-伪幺正算子动力学将预训练的GPT-2转换为时间推理模型,提供了数学基础以及在PT对称性破缺转变和可逆/不可逆序列方面的关键发现。
本文探究语言模型是否在其嵌入空间中编码了结构化的、人类可解读的意识谱,表明句子形成了从低到高状态的可导航流形,对模型引导与对齐具有启示意义。