laguna-s-2-1

标签

Cards List
#laguna-s-2-1

@TheAhmadOsman: Laguna S 2.1 118B-A8B 在 DGX Station 上使用 - NVFP4 - FP8 KV 缓存,可运行 10 个并行代理,每个拥有 256k 上下文…

X AI KOLs Timeline · 9小时前 缓存

Laguna S 2.1 118B-A8B 模型在 DGX Station 上使用 NVFP4 和 FP8 KV 缓存运行,对于 10 个并行代理(每个拥有 256k 上下文)达到约 1k tokens/秒 的速度。

0 人收藏 0 人点赞
#laguna-s-2-1

Laguna S 2.1 给我留下了深刻印象

Reddit r/LocalLLaMA · 14小时前

Laguna S 2.1 是一款 120B 类模型,它通过使用长思考令牌解决了 Julia 中的一个复杂编码问题,给我留下了深刻印象。在一个内存受限的重排任务中,它的表现超过了 Qwen 模型。

0 人收藏 0 人点赞
#laguna-s-2-1

Laguna-S-2.1 "无限思考"循环似乎是量化伪影

Reddit r/LocalLLaMA · 昨天

文章报告称,Laguna S 2.1 AI模型中的无限思考循环很可能是由量化伪影引起的。切换到MoE感知的APEX量化(例如Myric/Laguna-S-2.1-APEX-GGUF)并使用默认采样设置(温度0.7,top_p 0.95,top_k 20)解决了大多数情况下的循环问题。此外,将提示框定在工具调用周围可以防止过度思考。

0 人收藏 0 人点赞
#laguna-s-2-1

关于Laguna S-2.1的重要通知:使用更新后的聊天模板和GGUF文件

Reddit r/LocalLLaMA · 昨天

Laguna S-2.1模型已更新,修复了yarn_attn_factor(已修正为1.0),并改进了聊天模板,修复了损坏的思维过程、保留了思维链,并支持工具调用。建议用户使用官方仓库中更新的GGUF文件。

0 人收藏 0 人点赞
#laguna-s-2-1

Laguna S 2.1 循环修复即将到来

Reddit r/LocalLLaMA · 2天前 缓存

Poolside 发布了 Laguna S 2.1,这是他们最擅长处理长周期任务的模型,同时在 Hugging Face 上提供了多种量化变体(FP8、NVFP4、INT4、DFlash、GGUF)。

0 人收藏 0 人点赞
#laguna-s-2-1

今天Poolside发布Laguna S 2.1真是完美时机,因为我刚入手了这些!终于有还算不错的显存了。3块V620 = 96 GB。

Reddit r/LocalLLaMA · 3天前

Poolside发布了Laguna S 2.1,用户购入了3块AMD V620 GPU,总计96 GB显存。

0 人收藏 0 人点赞
#laguna-s-2-1

Unsloth 推出的 Laguna S 2.1 量化版本已发布

Reddit r/LocalLLaMA · 3天前 缓存

Unsloth 发布了 Laguna S 2.1 Mixture-of-Experts 模型的 GGUF 量化版本。该模型是一个拥有 118B 参数(8B 激活参数)的编码模型,具备 1M 上下文窗口和智能体能力。量化版本支持高效的本地部署。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈