pairwise-comparison

标签

Cards List
#pairwise-comparison

语义链接不确定性下的省略三段论补全两两逻辑选择

arXiv cs.AI · 2026-08-20 缓存

本文提出了一种用于省略三段论补全两两逻辑选择的神经符号管道,引入了PWAL方法,该方法使用逻辑阻力分数来提高准确性并在各种推理任务中减少平局。

0 人收藏 0 人点赞
#pairwise-comparison

Adaptive KappaSharp: Condition-Number Shaping for Preferential Bayesian Optimization

arXiv cs.LG · 2026-08-11 缓存

This paper introduces KappaSharp, a method for condition-number shaping in Preferential Bayesian Optimization that corrects the ill-conditioned Hessian from isolated pairwise comparisons, showing up to +10.9% improvement over the standard PairedGP/EUBO baseline on 11 benchmarks including plasma medicine controller tuning.

0 人收藏 0 人点赞
#pairwise-comparison

(迈向)使用大型语言模型的可扩展可靠自动化评估

arXiv cs.CL · 2026-07-31 缓存

本文提出了一种可扩展、领域无关的自动化 LLM 评估框架,该框架利用多个 LLM 的成对比较和 Elo 评分系统来近似专家判断,从而减少人工干预的需求。

0 人收藏 0 人点赞
#pairwise-comparison

用统计学方法找到最佳狗零食

Hacker News Top · 2026-06-22 缓存

通过成对比较实验,使用Bradley-Terry模型和Elo评分系统统计确定狗狗最喜欢的零食。

0 人收藏 0 人点赞
#pairwise-comparison

面向比较图的可靠LLM评估的提示扰动

arXiv cs.CL · 2026-06-17 缓存

提出了一种提示扰动框架,该框架生成扰动的提示变体,通过图级一致性检查过滤掉结构不一致的比较模式,然后应用标准排名方法产生更可靠的LLM排名。

0 人收藏 0 人点赞
#pairwise-comparison

在预测人们的偏好时,考虑“三的力量”大有裨益

MIT News — Artificial Intelligence · 2026-06-11 缓存

MIT研究人员在一篇论文中表明,使用三元比较而非两两比较,可以显著提高预测人类偏好的随机效用模型的准确性。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈