Macaron-V1:迈向具有自我改进与Mixture-of-LoRA的开放持续学习

Hugging Face Daily Papers 论文

摘要

本文介绍了Macaron-V1,一个开放的持续学习智能体-模型家族,使用Mixture-of-LoRA在冻结的基础模型上组合专家适配器,并具有递归自我改进和模型-框架协同设计。

Macaron-V1是一个开放的智能体-模型家族,用于体验智能:在真实环境中从经验中学习,并在部署后持续学习。它围绕两个系统目标进行组织。适应性通过版本化的模型-框架对的递归改进来实现,其中来自一种配置的经验在外部契约下进行评估,并用于构建其后续配置。协作通过Mixture-of-LoRA (MoL)架构实现,该架构冻结基础模型,组合专家LoRA适配器,并在每个用户回合选择一个LoRA。旗舰型号Macaron-V1-Venti将744B GLM-5.2基础模型与四个LoRA(分别用于聊天、智能体、编程和GenUI)相结合;基于Qwen3.6的Macaron-V1-Tall (50B)采用相同设计用于本地部署。本报告将Macaron-V1呈现为一个跨越架构、算法和基础设施的协同设计系统。MoL架构通过可扩展的LoRA专家支持持续学习。该算法结合了模型-框架协同设计与递归自我改进循环,包括UI4A组件原生的GenUI框架、有状态的操作基座、版本化的HCP契约,以及智能体强化学习框架MindForge。支持性基础设施包括后训练平台MinT、长上下文强化学习方法LongStraw,以及用于稀疏MoE和DSA基础模型的稳定性技术。我们在Personal Intelligence、GenUI和通用能力基准上,与前沿基线对比评估了Macaron-V1。我们的结果验证了当前系统的有效性,而持续学习和集体智能的复合增益仍是开放问题。
查看原文
查看缓存全文

缓存时间: 2026/08/11 06:20

论文页面 - Macaron-V1:迈向具有自我改进与 Mixture-of-LoRA 的开放持续学习

来源:https://huggingface.co/papers/2608.09819
发布于 8 月 10 日

#2 今日论文(https://huggingface.co/papers/date/2026-08-11) 作者:

摘要

Macaron-V1 是一个面向体验式智能的开放智能体模型系列:在真实环境中从经验中学习,并在部署后继续学习。它围绕两个系统目标进行组织。自适应通过版本化模型-测试框架对的递归改进来实现,其中一个配置的经验在外部契约下进行评估,并用其构建后继配置。协作则通过 Mixture-of-LoRA(MoL)架构实现,该架构冻结基础模型,组合专家 LoRA 适配器,并在每个用户轮次选择一个 LoRA。旗舰版 Macaron-V1-Venti 将 744B GLM-5.2 基础模型与四个 LoRA 相结合,分别用于聊天、智能体、编码和 GenUI;基于 Qwen3.6 的 Macaron-V1-Tall(50B)采用相同设计用于本地部署。本报告将 Macaron-V1 呈现为一个涵盖架构、算法和基础设施的协同设计系统。MoL 架构通过可扩展的 LoRA 专家支持持续学习。该算法结合了模型-测试框架协同设计和递归自我改进循环,包括 UI4A 组件原生 GenUI 测试框架、有状态动作基座、版本化 HCP 契约,以及智能体强化学习框架 MindForge。支持性基础设施包括后训练平台 MinT、长上下文强化学习方法 LongStraw,以及针对稀疏 MoE 和 DSA 基础模型的稳定性技术。我们在 Personal Intelligence、GenUI 和通用能力基准上对 Macaron-V1 进行评估,并与前沿基线进行比较。我们的结果验证了当前系统,而持续学习和集体智能带来的复合增益仍是开放性问题。

查看 arXiv 页面(https://arxiv.org/abs/2608.09819)查看 PDF(https://arxiv.org/pdf/2608.09819)添加到收藏(https://huggingface.co/login?next=%2Fpapers%2F2608.09819)

引用此论文的模型0

没有模型链接此论文

在模型的 README.md 中引用 arxiv.org/abs/2608.09819,即可从此页面链接到该模型。

引用此论文的数据集0

没有数据集链接此论文

在数据集的 README.md 中引用 arxiv.org/abs/2608.09819,即可从此页面链接到该数据集。

引用此论文的 Spaces0

没有 Space 链接此论文

在 Space 的 README.md 中引用 arxiv.org/abs/2608.09819,即可从此页面链接到该 Space。

包含此论文的集合1

相似文章

Mind Lab 用 Macaron-V1 检验持续学习(11 分钟阅读)

TLDR AI

Mind Lab 声称其 Macaron-V1 模型在基准测试中超越 GLM-5.2。该模型通过将五个 LoRA 专家模块(每个约十亿参数)附加到 GLM-5.1 上构建而成,系统会根据任务动态切换到最适合的专家模型。模型使用过程中积累的数据可被提炼到专门的 LoRA 适配器中,随着模型的调用而持续更新。

Macaron-V1系列,基于Qwen3.6-35B-A3B构建

Reddit r/LocalLLaMA

MindLab Research发布了Macaron-V1-Tall,这是一个基于Qwen3.6-35B-A3B构建的Mixture of LoRA模型,配备了四个分别用于对话、代理、编码和GenUI任务的专家模块,上下文长度为262K。

Macaron-A2UI:面向个人智能体的生成式UI模型

Hugging Face Daily Papers

介绍了Macaron-A2UI,一种用于个人智能体的生成式UI模型,可综合动态界面与轻量级可执行操作,超越纯文本聊天。本文引入大规模语料库、A2UI-Bench基准,并使用LoRA微调和强化学习训练了高达754B参数的模型,取得了显著成果。

真正的持续学习模型(原型)

Reddit r/ArtificialInteligence

一位开发者声称使用LoRA构建了真正的持续学习模型原型,让Qwen4B无需重新训练即可获得即时、可泛化的记忆,并邀请独立研究人员验证该机制。