auditable-ml

标签

Cards List
#auditable-ml

FAER:面向语言模型后训练的可审计效用对齐轨迹重放

arXiv cs.LG ↗ · 昨天 缓存

本文提出 FAER,这是一个面向语言模型后训练的可审计全轨迹重放框架。该框架形式化了缓存级选择反馈与下游学习者效用之间的差距,并表明一个学习者感知的选择器(FAER-UTILITY)在 GSM8K 上配合 Qwen2.5-1.5B-Instruct 时,表现优于基于格式反馈和均匀采样的基线方法。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈