recommendation-evaluation

标签

Cards List
#recommendation-evaluation

从提示到行为对齐:用于推荐评估的个性化LLM评判器

arXiv cs.AI · 21小时前 缓存

本文介绍了用于推荐评估的个性化LLM评判器的行为对齐框架,解决了双向合理化问题——即现成的LLM对同一项目既能论证用户参与的正向结果,也能论证负向结果。通过微调和偏好优化,该方法相比零样本基线在Macro-F1上提升了32.19%,并达到了生产环境中基于特征工程的基线水平。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈