introspective-learning

标签

Cards List
#introspective-learning

ThoughtFold: 通过内省偏好学习折叠推理链

arXiv cs.AI · 2026-06-03 缓存

ThoughtFold 提出了一种利用内省偏好学习的框架,旨在减少大型推理模型在思维链推理中的冗余探索,在 DeepSeek-R1-Distill-Qwen-7B 上实现了约 56% 的令牌减少,且准确率无损。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈