multi-objective-alignment

标签

Cards List
#multi-objective-alignment

基于互信息的多目标探索与偏好优化

arXiv cs.CL · 2026-07-03 缓存

提出MI-EPO,一种基于信息理论的多目标对齐框架,用于大型语言模型,通过互信息增强探索,确保生成的响应可区分且与不同偏好向量对齐,在冲突目标间实现稳定权衡。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈