标签
用户注意到 Laguna S 2.1 的 Q4_K_M 量化版本从 68GB 增加到了 96GB,可能是因为使用了更多的 FP16 层,并讨论了量化与上下文循环可能存在的问题。
探讨在Laguna S 2.1中使用低于Q8的量化是否会降低推理能力,导致其显得‘笨’。
详细对比了新开源权重混合专家模型 Laguna-S-2.1 与 Qwen 3.6-35B-A3B,突出了Laguna更大的活跃参数数量和长期关注焦点使其在扩展任务中表现更优,尽管速度较慢。
Poolside 发布了 Laguna S 2.1,这是一个 118B 参数的混合专家模型,每个 token 激活 8B 参数,拥有 1M 上下文窗口,声称可以击败体积是其三倍的模型,例如 DeepSeek v4 Pro、Gemini 3.6 Flash 和 Thinking Machines Inkling。