length-control

标签

Cards List
#length-control

When2Think:面向高效混合推理模型的难度感知长度控制学习

Hugging Face Daily Papers · 6天前 缓存

When2Think 是一个后训练框架,能根据问题难度在大型推理模型中动态分配计算资源,从而在数学基准测试中优化准确性与效率的权衡。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈