word-embeddings

标签

Cards List
#word-embeddings

针对各向异性校准WEAT:ZCA白化作为嵌入关联测试的几何预处理步骤

arXiv cs.CL · 2026-08-10 缓存

本文提出将ZCA白化作为WEAT的几何预处理步骤,以解决嵌入各向异性问题,结果表明校准会改变超过30%结果的显著性状态,未经校准的偏差测量可能不可靠。

0 人收藏 0 人点赞
#word-embeddings

Sparse Mutual Information Graph Averaging for Improving Random Indexing Embeddings

arXiv cs.CL · 2026-08-07 缓存

This paper studies using sparse PPMI graph averaging to refine Random Indexing embeddings, showing it improves accuracy on a fairytales analogy benchmark but trails neural baselines on text8 and SimLex-999.

0 人收藏 0 人点赞
#word-embeddings

语言模型语义空间中的关系几何

arXiv cs.CL · 2026-07-30 缓存

本文探讨了语义关系如何编码在语言模型语义空间的几何结构中,发现非对称关系占据不同区域,且对于因果模型,词汇信息更为重要,而对于掩码和扩散模型,上下文信息更为重要。

0 人收藏 0 人点赞
#word-embeddings

标准词嵌入属性的实证研究

arXiv cs.CL · 2026-07-28 缓存

本文综述了词嵌入计算的各种机制,研究了流行的工具包和嵌入矩阵,并通过选定的实现进行实验以理解其特性。

0 人收藏 0 人点赞
#word-embeddings

共享语义空间中的心理构念

arXiv cs.CL · 2026-05-27 缓存

本文提出一个框架,利用监督语义微分法将心理构念表示为共享词嵌入空间中的方向,从而实现不同测量工具和研究传统之间的比较。

0 人收藏 0 人点赞
#word-embeddings

阴谋论的语义结构与演变测量

arXiv cs.CL · 2026-04-20 缓存

本论文使用来自 r/politics 的 169.9 百万条 Reddit 评论(2012-2022),测量了阴谋论的语义结构和演变,引入了由语义邻域界定的"语义对象"概念,以追踪阴谋论的含义如何随时间变化,超越了简单的关键词方法。

0 人收藏 0 人点赞
#word-embeddings

半监督文本分类的对抗训练方法

OpenAI Blog · 2016-05-25 缓存

本文提出了针对文本分类的对抗训练和虚拟对抗训练方法,通过在RNN中对词嵌入而非原始输入施加扰动来实现。该方法在半监督和监督文本分类基准上取得了最先进的结果,同时降低了过拟合。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈