robust-evaluation

标签

Cards List
#robust-evaluation

多利益相关方LLM对齐:将估计与聚合分解

arXiv cs.AI · 2026-05-27 缓存

本文识别了多利益相关方任务中LLM评估者的权重噪声,并提出了DecompR方法,该方法通过反事实校准的权重将效用估计从聚合中解耦。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈