真正的持续学习模型(原型)
摘要
一位开发者声称使用LoRA构建了真正的持续学习模型原型,让Qwen4B无需重新训练即可获得即时、可泛化的记忆,并邀请独立研究人员验证该机制。
https://preview.redd.it/os5x6dlot6jh1.png?width=1247&format=png&auto=webp&s=0cb57a933b32e2bccea65464a168a72b5d70c260 我在LLMDevs里因为声称这一点而被彻底喷了,所以我上传了证据,欢迎大家来验证。 https://clm.compsmart.cloud/ https://compsmart-realclm.hf.space https://github.com/compsmart/compsmart-clm 这是一个早期原型,我昨天才发现这个机制,今天花了一整天证明它是真的……我预计事情会加速发展。我可能很快就会有一个能自我教学的模型……总之,欢迎大家试用,想要更多细节可以给我发消息。我需要一位可信的独立研究人员来验证它。注意:我使用了LoRA来让Qwen4B拥有记忆(它可以即时更新并在新事实上泛化,无需重新训练)。它可以用来构建全新的模型,但我认为把它嫁接到现有模型上会更有用……
相似文章
Macaron-V1:迈向具有自我改进与Mixture-of-LoRA的开放持续学习
本文介绍了Macaron-V1,一个开放的持续学习智能体-模型家族,使用Mixture-of-LoRA在冻结的基础模型上组合专家适配器,并具有递归自我改进和模型-框架协同设计。
不忘记的艺术:一种用于持续学习的局部学习架构
本文介绍了CMP(认知记忆原语),一种持续学习架构,它使用稀疏关系编码和局部学习来减少灾难性遗忘,在字节级语言建模协议上展示了比使用EWC的Transformer更好的反向迁移。
2026年年中的持续学习:各方攻克路线图——记忆层、“梦境”智能体和在网络内部学习的后Transformer模型
2026年年中持续学习现状与未来展望的概述,涵盖记忆方法(包括外部记忆、状态内记忆和权重更新),并分析了TTT、Titans和Dragon Hatchling等各类模型。
通过参数化记忆扩展自进化智能体
来自阿里巴巴/Qwen和北京大学的研究人员提出了TMEM——一种自进化参数化记忆框架。该框架利用在线LoRA权重更新,使LLM智能体能够在单个回合内真正从经验中学习,而非仅依赖提示空间中的记忆。TMEM在多个基准测试(包括LoCoMo、LongMemEval-S和CL-Bench)上均优于基于摘要和基于检索的基线方法。
小语言模型顺序个性化的持续学习:稳定性监测分析
本文针对小语言模型的顺序LoRA个性化展开研究,通过检查点级评估来监测任务性能和遗忘情况,并表明轻量级参考集诊断可以揭示不稳定性模式。