Laguna S 2.1 推理模式

Reddit r/LocalLLaMA 模型

摘要

报告了 Laguna S 2.1 中的一个 bug:当 preserve_thinking 被禁用时,推理阶段会失败,并建议对比 Qwen 27B 的聊天模板来修复此问题。

如果很多人已经注意到 Laguna S 2.1 中没有推理阶段。我注意到 Poolside 开发团队在过去 24 小时内两次更新了聊天模板。有一个 bug:当 preserve_thinking 被禁用时,推理根本不会启动。不过,我认为这不是根本原因。你能看一下 Qwen 27B 的聊天模板吗?在 llama.cpp 中使用 --chat-template-file 参数时,它能够正确为 Laguna S 2.1 模型启用推理。希望这些信息能帮助你追踪并修复模板问题。https://huggingface.co/poolside/Laguna-S-2.1/blob/main/chat_template.jinja https://huggingface.co/Qwen/Qwen3.6-27B/blob/main/chat_template.jinja
查看原文

相似文章

Laguna-S-2.1 "无限思考"循环似乎是量化伪影

Reddit r/LocalLLaMA

文章报告称,Laguna S 2.1 AI模型中的无限思考循环很可能是由量化伪影引起的。切换到MoE感知的APEX量化(例如Myric/Laguna-S-2.1-APEX-GGUF)并使用默认采样设置(温度0.7,top_p 0.95,top_k 20)解决了大多数情况下的循环问题。此外,将提示框定在工具调用周围可以防止过度思考。

Laguna S 2.1 给我留下了深刻印象

Reddit r/LocalLLaMA

Laguna S 2.1 是一款 120B 类模型,它通过使用长思考令牌解决了 Julia 中的一个复杂编码问题,给我留下了深刻印象。在一个内存受限的重排任务中,它的表现超过了 Qwen 模型。