真正的持续学习模型(原型)

Reddit r/ArtificialInteligence 模型

摘要

一位开发者声称使用LoRA构建了真正的持续学习模型原型,让Qwen4B无需重新训练即可获得即时、可泛化的记忆,并邀请独立研究人员验证该机制。

https://preview.redd.it/os5x6dlot6jh1.png?width=1247&format=png&auto=webp&s=0cb57a933b32e2bccea65464a168a72b5d70c260 我在LLMDevs里因为声称这一点而被彻底喷了,所以我上传了证据,欢迎大家来验证。 https://clm.compsmart.cloud/ https://compsmart-realclm.hf.space https://github.com/compsmart/compsmart-clm 这是一个早期原型,我昨天才发现这个机制,今天花了一整天证明它是真的……我预计事情会加速发展。我可能很快就会有一个能自我教学的模型……总之,欢迎大家试用,想要更多细节可以给我发消息。我需要一位可信的独立研究人员来验证它。注意:我使用了LoRA来让Qwen4B拥有记忆(它可以即时更新并在新事实上泛化,无需重新训练)。它可以用来构建全新的模型,但我认为把它嫁接到现有模型上会更有用……
查看原文

相似文章

通过参数化记忆扩展自进化智能体

arXiv cs.AI

来自阿里巴巴/Qwen和北京大学的研究人员提出了TMEM——一种自进化参数化记忆框架。该框架利用在线LoRA权重更新,使LLM智能体能够在单个回合内真正从经验中学习,而非仅依赖提示空间中的记忆。TMEM在多个基准测试(包括LoCoMo、LongMemEval-S和CL-Bench)上均优于基于摘要和基于检索的基线方法。