@lateinteraction: 直觉:压缩是智能递归(RNNs),而递归(RLMs)是智能注意力。递归保持……
摘要
文章分享了一个直觉,即RNNs中的压缩代表智能递归,而RLMs中的递归代表智能注意力,比较了AI模型中不同的上下文处理方法。
直觉:压缩是智能递归(RNNs),而递归(RLMs)是智能注意力。
递归通过压缩过去的信息,在所有时刻保持一个恒定大小的状态。
注意力保持所有上下文完整表示,然后为每一步决定如何重新处理它。
查看缓存全文
缓存时间: 2026/08/15 19:50
直觉:压缩对应自主递归(RNN),而递归(RLM)则对应自主注意力。
递归通过压缩历史信息,在任何时刻都维持固定大小的状态。
注意力则完整保留所有上下文信息,并在每一步决定如何重新处理这些内容。
相似文章
@TDataScience:跟随@neural_avb的全方位深度解析,了解“递归语言模型(RLM)是什么、为何它们会在长上下文基准测试中持续胜出……”
一篇关于递归语言模型(RLM)的教育性深度文章,解释了RLM是什么、为何它们能在长上下文基准测试中胜出,以及它们与现有智能体框架(如ReAct或CodeAct)的不同之处,并通过一个简单的案例研究进行说明。
递归语言模型
本文介绍了递归语言模型(Recursive Language Models, RLMs),这是一种推理策略,使大型语言模型(LLMs)能够通过将任意长的提示视为外部环境,并在提示片段上递归调用自身来处理这些提示。RLMs可以处理超出上下文窗口两个数量级的输入,并且在长上下文任务上以可比的成本优于基础LLMs。
alexzhang13/rlm
递归语言模型(RLMs)引入了一种与任务无关的推理范式,使语言模型能够通过递归地在输入上调用自身来处理近乎无限的上下文,同时还提供了配套的开源推理引擎和训练环境。
RecMem:基于重复的记忆整合方法,用于高效且有效的长期运行LLM智能体
RecMem是一种基于重复的记忆整合方法,适用于长期运行的LLM智能体,通过仅在语义相似的交互重复出现时调用LLM,可减少高达87%的令牌消耗,同时提高准确性。
@cwolferesearch: 智能体强化学习需要新的算法改进。在GRPO中,用于训练的“群体”开始发生变化……
本线程讨论了针对智能体强化学习对GRPO的改进,重点介绍了不同层级的优势归一化(提示层级、任务层级、环境层级),以应对多任务、多轮次环境中的高奖励方差。