semantic-similarity

标签

Cards List
#semantic-similarity

词汇变化如何误导:重新审视动态主题模型评估——传统度量与基于LLM的度量

arXiv cs.CL · 昨天 缓存

本文评估了动态主题模型的传统一致性度量和基于LLM的语义相似度,发现基于LLM的度量通过考虑词汇变化,更好地与人类判断对齐。它提倡使用传统度量和基于LLM的度量相结合的评估方法。

0 人收藏 0 人点赞
#semantic-similarity

十六个模型,不足两种声音:在无唯一正确答案时衡量集成离散度

arXiv cs.CL · 2026-08-04 缓存

这篇 arXiv 预印本研究形成集成的十六个语言模型的语义离散度,表明平均而言集成多样性较小,且模型身份仅部分解释了哪个模型的差异最大。作者提出了一种逐模型异议贡献度量,并发现离散度由临床内容而非解释开放性所组织。

0 人收藏 0 人点赞
#semantic-similarity

按语义相似度和时间切片划分的最新1100万篇论文地图 [P]

Reddit r/MachineLearning · 2026-06-30

利用语义相似度和时间切片对1100万篇学术论文进行大规模映射,从而分析研究趋势和关联。

0 人收藏 0 人点赞
#semantic-similarity

知识图谱中图到图语义相似性的测量:知识图谱嵌入的实证评估

arXiv cs.AI · 2026-06-30 缓存

本文介绍并实证评估了使用知识图谱嵌入测量知识图谱间语义相似性的方法,提出了EmbPairSim和AvgEmbSim评分函数,这些函数在WikiText-2和CC-News数据集上优于Sentence-BERT等基线方法。

0 人收藏 0 人点赞
#semantic-similarity

论词汇性在大语言模型中的持续影响

arXiv cs.CL · 2026-06-03 缓存

本文研究了词汇重叠(而非语义内容)如何影响跨层和跨架构的大语言模型表示,并证明即使在为语义相似性训练的模型中,这种词汇效应依然存在,导致下游任务性能下降。

0 人收藏 0 人点赞
#semantic-similarity

黑盒LLM蒸馏的有界行为不可区分性

arXiv cs.LG · 2026-06-01 缓存

本文提出有界行为不可区分性,一种超越语义相似性的黑盒LLM蒸馏评估形式化框架。在Qwen和Llama模型上的实验表明,蒸馏降低了但并未消除对抗性可区分性,凸显了类别感知评估的必要性。

0 人收藏 0 人点赞
#semantic-similarity

OmniOPD: 通过推测验证实现无Logit的同策略蒸馏

Hugging Face Daily Papers · 2026-05-31 缓存

OmniOPD 提出了一种无Logit的同策略蒸馏方法,利用块级语义相似性和推测验证,在黑盒教师指导下训练学生模型,在数学基准上相比标准OPD实现了高达+28.64%的提升。

0 人收藏 0 人点赞
#semantic-similarity

文档草垛中的语义针:LLM-as-a-Judge 相似度评分的敏感性测试

arXiv cs.CL · 2026-04-22 缓存

PNNL 与华盛顿大学的研究人员提出一套系统化框架,测试五种大语言模型在文档中捕捉细微语义变化的能力,揭示位置偏差、上下文连贯效应及模型特有的评分“指纹”。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈