标签
Laguna s2.1 发布时基准测试令人印象深刻,但存在循环和工具使用问题;最近的更新可能已修复这些问题,用户正在询问其是否现在稳定。
修改SGLang以在V100 GPU上支持Qwen和Laguna模型,使用自定义的FlashAttention和Marlin内核,在4xV100硬件上获得了不错的吞吐量。
比较了两个用于智能体工作负载的新AI模型:采用循环Transformer架构的紧凑型Nanbeige4.2-3B,以及大型混合专家模型Laguna S2.1,两者均在Hugging Face上发布。
Poolside AI联合创始人Eiso Kant讨论了他们的“模型工厂”方法,用于快速训练前沿模型,Laguna S 2.1的发布,以及AI模型开发的经济学。
该拉取请求为 llama.cpp 添加了对 Laguna XS.2 和 M.1 硬件的支持,扩展了兼容性。