BitTide
首页
最新
模型
工具
新闻
产品
论文
事件
今日日报
搜索
订阅
English
登录
cognitive-behaviors
标签
Cards
List
#cognitive-behaviors
潜在奖励引导:一种在推理大语言模型中隐式促进认知行为的自适应推理时框架
arXiv cs.AI
↗
· 2026-06-02
缓存
介绍了潜在奖励引导(LRS),一种自适应推理时框架,利用稀疏自编码器的潜在状态和学习的奖励模型,隐式促进推理大语言模型中的验证和回溯等认知行为,从而在多个模型和基准测试中提升性能。
0 人收藏
0 人点赞
← 返回首页
意见反馈
×
提交意见反馈
感谢您的反馈!
提交