连续性层:智能为何需要一种架构来承载它所累积的认知
摘要
立场论文提出“连续性层”以保留模型随时间学到的内容,引入Decomposed Trace Convergence Memory与ATANT基准,在250篇故事语料上实现100%隔离、96%累积召回,且无需语言模型介入。
查看缓存全文
缓存时间: 2026/04/21 15:38
论文页面 - 连续性层:为何智能需要一种架构来承载它所积累的理解
来源:https://huggingface.co/papers/2604.17273
AI 最重要的架构问题不是模型有多大,而是没有任何一层能够把模型已经理解的内容持续地带到下一步。
本文提出:连续性层(Continuity Layer)是整个领域尚未建成的最关键基础设施。作者将“连续性”定义为一项系统属性,并给出 7 条必备特征;随后介绍一种存储原语——分解轨迹收敛记忆(Decomposed Trace Convergence Memory, DTCM),通过在写入时分解、读取时重构来实现该属性;最后勾勒出从外部 SDK 到硬件节点的四层演进路线。
连续性的正式评估框架为 ATANT 基准(arXiv:2604.06710,另文发布)。该基准在 250 篇故事语料上测试:100% 隔离性、96% 累积性,全程无语言模型参与打分。
相似文章
不忘记的艺术:一种用于持续学习的局部学习架构
本文介绍了CMP(认知记忆原语),一种持续学习架构,它使用稀疏关系编码和局部学习来减少灾难性遗忘,在字节级语言建模协议上展示了比使用EWC的Transformer更好的反向迁移。
长期运行的AI代理可能面临比记忆更大的连续性问题
反思了长期运行的AI代理所面临的连续性问题,认为需要确定性控制层来管理权威状态,并质疑现有的IAM、事务和溯源等基础设施是否足够。
2026年年中的持续学习:各方攻克路线图——记忆层、“梦境”智能体和在网络内部学习的后Transformer模型
2026年年中持续学习现状与未来展望的概述,涵盖记忆方法(包括外部记忆、状态内记忆和权重更新),并分析了TTT、Titans和Dragon Hatchling等各类模型。
为什么将残差流限制在层而非令牌?用于连续潜在推理的持久记忆
本文识别了CoCoNuT潜在推理范式中的'概念瓶颈',即隐藏状态在多次传递中被覆盖,并提出了AGCLR,该方法添加了门控持久记忆流以保留中间事实。在GSM8K、HotpotQA和ProsQA上使用GPT-2进行评估,结果显示一致性改进,尤其是在多跳任务上。
先验真相:一种用于智能体记忆的纵向评估工具,以及记忆架构排名中的任期交叉现象
本文提出了一种用于智能体记忆的纵向评估工具,通过在文本生成之前生成事实来避免标签错误和污染,并证明短期基准测试相比长期性能可能会错误地排序记忆架构。同时,它还发布了用于智能体记忆评估的开源库Veracium。