looped-language-models

标签

Cards List
#looped-language-models

循环语言模型中递归机制为何有效?

Hugging Face Daily Papers ↗ · 2天前 缓存

本文系统研究了循环语言模型(LoopLMs)中递归机制在何时能发挥作用,发现额外的递归可以提升超出训练时域范围的推理能力,但会削弱知识保持效果,并提出一种结合时间步条件化的通道级历史状态注入方案,作为在可变推理预算下更稳健的设计策略。

0 人收藏 0 人点赞
#looped-language-models

WaveFront Decoding:针对循环语言模型的并行化自推测解码

Hugging Face Daily Papers ↗ · 5天前 缓存

WaveFront Decoding 引入了一个无需训练的自推测解码框架,针对循环语言模型,通过并发批量处理草拟和验证来减少延迟,在 Huginn-3.5B 上实现了高达 4.81 倍的加速。

0 人收藏 0 人点赞
#looped-language-models

循环语言模型中循环计算的分配

arXiv cs.LG ↗ · 2026-08-20 缓存

本文介绍了MixerLoop,一种通过选择性循环语言模型中的混合器组件同时仅应用一次前馈网络来分配循环计算的方法,以在降低计算成本的同时提升性能。

0 人收藏 0 人点赞
#looped-language-models

循环语言模型提升组合式工具调用能力

arXiv cs.AI ↗ · 2026-08-20 缓存

本文探讨了循环语言模型如何利用迭代潜在计算提升代理系统中的组合式工具调用,展示了对多步骤API交互的益处。

0 人收藏 0 人点赞
#looped-language-models

Looped语言模型改进组合工具调用

Hugging Face Daily Papers ↗ · 2026-08-17 缓存

Looped语言模型通过利用循环计算来增强组合工具调用,在多步任务中提高准确性,同时自适应推理优化了性能和计算成本之间的平衡。研究表明,这些模型对于可靠的智能体系统很有前景。

0 人收藏 0 人点赞
#looped-language-models

循环语言模型中的操作原型自省:过程质量探针、可执行分支与读出控制边界

arXiv cs.LG ↗ · 2026-07-22 缓存

本文研究了一个冻结的循环变换器能否读取自身计算质量(预答案预测达到AUROC 0.797)以及外部干预能否改善结果,发现所有测试的冻结干预均未产生验证的能力增益,这一特性称为操作原型自省。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈