pairwise-comparison

标签

Cards List
#pairwise-comparison

Adaptive KappaSharp: Condition-Number Shaping for Preferential Bayesian Optimization

arXiv cs.LG · 2天前 缓存

This paper introduces KappaSharp, a method for condition-number shaping in Preferential Bayesian Optimization that corrects the ill-conditioned Hessian from isolated pairwise comparisons, showing up to +10.9% improvement over the standard PairedGP/EUBO baseline on 11 benchmarks including plasma medicine controller tuning.

0 人收藏 0 人点赞
#pairwise-comparison

(迈向)使用大型语言模型的可扩展可靠自动化评估

arXiv cs.CL · 2026-07-31 缓存

本文提出了一种可扩展、领域无关的自动化 LLM 评估框架,该框架利用多个 LLM 的成对比较和 Elo 评分系统来近似专家判断,从而减少人工干预的需求。

0 人收藏 0 人点赞
#pairwise-comparison

用统计学方法找到最佳狗零食

Hacker News Top · 2026-06-22 缓存

通过成对比较实验,使用Bradley-Terry模型和Elo评分系统统计确定狗狗最喜欢的零食。

0 人收藏 0 人点赞
#pairwise-comparison

面向比较图的可靠LLM评估的提示扰动

arXiv cs.CL · 2026-06-17 缓存

提出了一种提示扰动框架,该框架生成扰动的提示变体,通过图级一致性检查过滤掉结构不一致的比较模式,然后应用标准排名方法产生更可靠的LLM排名。

0 人收藏 0 人点赞
#pairwise-comparison

在预测人们的偏好时,考虑“三的力量”大有裨益

MIT News — Artificial Intelligence · 2026-06-11 缓存

MIT研究人员在一篇论文中表明,使用三元比较而非两两比较,可以显著提高预测人类偏好的随机效用模型的准确性。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈