feedback-learning

标签

Cards List
#feedback-learning

并非所有语音都是意图:用于ASR后误唤醒的自适应自校正推理层

arXiv cs.CL · 20小时前 缓存

本文介绍了ASCIL,一个后ASR框架,它根据用户反馈和上下文信号进行调整,以纠正AI助手中的误唤醒激活,在低延迟下实现了显著的错误减少。

0 人收藏 0 人点赞
#feedback-learning

使用推理代理的大规模反例引导学习

arXiv cs.LG · 2026-06-11 缓存

本文提出将反例引导学习用于LLM执行正则表达式归纳,其中验证器提供反例以优化候选表达式。该方法显著提高了具有挑战性任务上的样本效率和成功率,表明LLM可以从结构化反馈中受益,而不仅仅是将其视为额外数据。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈