@AdinaYakup: @Macaron0fficial 的 Macaron V1 推出两个变体:Venti:748B 旗舰(744B 基础 + 4×1B LoRA 专家)。后续……
摘要
Macaron V1 发布两个变体:Venti(748B 旗舰,配备 4×1B LoRA 专家)和 Tall(50B 本地部署,配备 4×3.7B LoRA 专家),分别基于 GLM-5.2 和 Qwen 3.6 进行后训练。
查看缓存全文
缓存时间: 2026/07/27 15:56
来自 @Macaron0fficial 的 Macaron V1 推出两个变体:
Venti:748B 旗舰版(744B 基础模型 + 4×1B LoRA 专家),基于 GLM-5.2 后训练。
Tall:50B 本地部署版(35B 基础模型 + 4×3.7B LoRA 专家),基于 Qwen 3.6 后训练。
模型与框架协同设计,采用 MinT 与 MindForge(全部由 Mind Lab 内部自研!)
相似文章
Macaron-V1系列,基于Qwen3.6-35B-A3B构建
MindLab Research发布了Macaron-V1-Tall,这是一个基于Qwen3.6-35B-A3B构建的Mixture of LoRA模型,配备了四个分别用于对话、代理、编码和GenUI任务的专家模块,上下文长度为262K。
@AdinaYakup: Macaron-V1-Preview-749B 一种来自 MindLab 的 Mixture-of-LoRA 个人代理模型,基于 744B 基础模型和 5 个专业 LoRA,生成式 UI…
MindLab 发布了 Macaron-V1-Preview-749B,这是一种基于 744B 基础模型和 5 个专业 LoRA 的 Mixture-of-LoRA 个人代理模型,以生成式 UI 为核心技能,支持 202K 上下文,采用 MIT 许可证。
Mind Lab 用 Macaron-V1 检验持续学习(11 分钟阅读)
Mind Lab 声称其 Macaron-V1 模型在基准测试中超越 GLM-5.2。该模型通过将五个 LoRA 专家模块(每个约十亿参数)附加到 GLM-5.1 上构建而成,系统会根据任务动态切换到最适合的专家模型。模型使用过程中积累的数据可被提炼到专门的 LoRA 适配器中,随着模型的调用而持续更新。
mindlab-research/Macaron-V1-Venti • HuggingFace
MindLab Research 发布了 Macaron-V1-Venti,这是一个新的多模态 AI 模型,在 HuggingFace 上可用,可能用于文本到图像或图像生成任务。
mindlab-research/Macaron-V1-Preview-749B • Huggingface
mindlab-research 发布 Macaron-V1-Preview-749B,一个拥有7490亿参数的大语言模型,可在 Hugging Face 上获取。