@AdinaYakup: @Macaron0fficial 的 Macaron V1 推出两个变体:Venti:748B 旗舰(744B 基础 + 4×1B LoRA 专家)。后续……

X AI KOLs Following 模型

摘要

Macaron V1 发布两个变体:Venti(748B 旗舰,配备 4×1B LoRA 专家)和 Tall(50B 本地部署,配备 4×3.7B LoRA 专家),分别基于 GLM-5.2 和 Qwen 3.6 进行后训练。

来自 @Macaron0fficial 的 Macaron V1 推出两个变体: Venti:748B 旗舰(744B 基础 + 4×1B LoRA 专家)。基于 GLM-5.2 后训练 Tall:50B 本地部署(35B 基础 + 4×3.7B LoRA 专家),基于 Qwen 3.6 后训练 模型与框架协同设计,采用 MinT 和 MindForge(全部由 Mind Lab 内部构建!)
查看原文
查看缓存全文

缓存时间: 2026/07/27 15:56

来自 @Macaron0fficial 的 Macaron V1 推出两个变体:

Venti:748B 旗舰版(744B 基础模型 + 4×1B LoRA 专家),基于 GLM-5.2 后训练。

Tall:50B 本地部署版(35B 基础模型 + 4×3.7B LoRA 专家),基于 Qwen 3.6 后训练。

模型与框架协同设计,采用 MinT 与 MindForge(全部由 Mind Lab 内部自研!)

相似文章

Macaron-V1系列,基于Qwen3.6-35B-A3B构建

Reddit r/LocalLLaMA

MindLab Research发布了Macaron-V1-Tall,这是一个基于Qwen3.6-35B-A3B构建的Mixture of LoRA模型,配备了四个分别用于对话、代理、编码和GenUI任务的专家模块,上下文长度为262K。

Mind Lab 用 Macaron-V1 检验持续学习(11 分钟阅读)

TLDR AI

Mind Lab 声称其 Macaron-V1 模型在基准测试中超越 GLM-5.2。该模型通过将五个 LoRA 专家模块(每个约十亿参数)附加到 GLM-5.1 上构建而成,系统会根据任务动态切换到最适合的专家模型。模型使用过程中积累的数据可被提炼到专门的 LoRA 适配器中,随着模型的调用而持续更新。