几何潜在推理促使LLM生成更短文本
摘要
几何潜在推理(GLR)为LLM中的潜在推理引入了一种几何路径近似方法,能够在数学推理基准上保持准确性的同时实现更短的生成。
查看缓存全文
缓存时间: 2026/06/02 15:36
论文页面 - 几何潜推理使大语言模型生成更短输出
来源:https://huggingface.co/papers/2606.02248
摘要
几何潜推理将潜推理形式化为预训练令牌嵌入空间中的几何路径逼近问题,从而实现了连续的中间推理状态,在保持准确性的同时缩短了生成长度。
大语言模型通过生成冗长的显式推理令牌链来解决复杂问题。这种方法虽然有效,但也使得推理成本高昂、对长度敏感,并且局限于(离散的)自然语言。而潜推理(https://huggingface.co/papers?q=latent%20reasoning)提供了一种连续的替代方案,但如何为中间潜状态确定有用的结构仍是一个开放挑战。在本文中,我们将潜推理(https://huggingface.co/papers?q=latent%20reasoning)形式化为模型预训练令牌嵌入空间(https://huggingface.co/papers?q=pretrained%20token-embedding%20space)内的几何路径逼近问题(https://huggingface.co/papers?q=geometric%20path-approximation%20problem)。我们引入了几何潜推理(https://huggingface.co/papers?q=Latent%20Reasoning)(GLR),它使用一个轻量级的过渡头(https://huggingface.co/papers?q=transition%20head)来预测嵌入空间中的迭代方向更新。利用文本化的思维链轨迹(https://huggingface.co/papers?q=chain-of-thought%20traces)作为锚点,GLR学习逼近离散推理轨迹(https://huggingface.co/papers?q=discrete%20reasoning%20trajectories),同时允许对精确令牌嵌入进行连续偏离(https://huggingface.co/papers?q=continuous%20deviations)。在使用Qwen3模型(https://huggingface.co/papers?q=Qwen3%20models)对数学推理基准(https://huggingface.co/papers?q=mathematical%20reasoning%20benchmarks)进行的评估中,揭示了一个涌现现象(https://huggingface.co/papers?q=emergent%20phenomenon):几何潜推理(https://huggingface.co/papers?q=latent%20reasoning)在无需显式长度目标的情况下,诱导出明显更短的生成结果。通过用连续的潜步骤替换早期的显式推理,模型通常能用更少的生成步骤得到正确答案。这些发现表明,连续的轨迹充当了紧凑的中间推理状态,揭示了潜计算预算(https://huggingface.co/papers?q=latent%20computation%20budget)、输出长度(https://huggingface.co/papers?q=output%20length)和准确性(https://huggingface.co/papers?q=accuracy)之间的一种新权衡。
查看arXiv页面(https://arxiv.org/abs/2606.02248)查看PDF(https://arxiv.org/pdf/2606.02248)添加到收藏(https://huggingface.co/login?next=%2Fpapers%2F2606.02248)
在你的agent中获取这篇论文:
hf papers read 2606\.02248
没有最新的CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash
引用此论文的模型0
没有模型链接到此论文
在模型README.md中引用arxiv.org/abs/2606.02248即可从此页面链接。
引用此论文的数据集0
没有数据集链接到此论文
在数据集README.md中引用arxiv.org/abs/2606.02248即可从此页面链接。
引用此论文的Space0
没有Space链接到此论文
在Space README.md中引用arxiv.org/abs/2606.02248即可从此页面链接。
包含此论文的收藏集0
没有收藏集包含此论文
将此论文添加到收藏集(https://huggingface.co/new-collection)即可从此页面链接。
相似文章
现成LLM作为过程评分器:数学推理中无需训练的PRM替代方案
提出块级引导生成(Chunk-Level Guided Generation),一种无需训练的方法,利用现成LLM作为过程评分器,在小模型生成过程中选择固定长度的候选块,相比多数投票和PRM引导搜索,显著提升数学推理准确性。
LGMT:基于逻辑的变形测试用于评估LLM推理可靠性
本文介绍了LGMT,这是一个利用一阶逻辑生成语义不变测试用例以评估LLM推理可靠性的框架。在六个LLM上的实验表明,LGMT暴露了静态基准遗漏的隐藏缺陷,提示评估应侧重于逻辑不变性下的鲁棒性。
强化学习能否教会大型语言模型进行长程推理?表达力是关键
本文介绍了 ScaleLogic 框架,该框架证明了强化学习的训练计算资源消耗遵循与大型语言模型推理深度相关的幂律分布。文章强调,逻辑表达力对于提升下游迁移能力和训练效率至关重要。
HyperGuide:大型语言模型中高效多步推理的双曲引导方法
本文提出HyperGuide方法,将推理进展提炼为双曲几何信号,以指导LLMs的逐步生成,从而无需显式树搜索即可提高多步推理效率。
SGR:一种基于外部子图生成的LLM逐步推理框架
介绍SGR,一种逐步推理框架,通过从外部知识库生成查询特定子图来增强LLM推理,提升准确性与事实可靠性。