cognitive-behaviors

标签

Cards List
#cognitive-behaviors

潜在奖励引导:一种在推理大语言模型中隐式促进认知行为的自适应推理时框架

arXiv cs.AI · 2026-06-02 缓存

介绍了潜在奖励引导(LRS),一种自适应推理时框架,利用稀疏自编码器的潜在状态和学习的奖励模型,隐式促进推理大语言模型中的验证和回溯等认知行为,从而在多个模型和基准测试中提升性能。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈