全新LFM2.5 8b A1b模型!!
摘要
介绍LFM2.5 8b A1b,一款性能与Nemotron 3 Nano相当但速度更快的新AI模型。SmallCode正在增加对非标准工具调用的支持。
性能与Nemotron 3 Nano相当,速度甚至更快!我将为[SmallCode](https://github.com/Doorman11991/smallcode)添加对此模型的支持,因为它使用了非标准的工具调用。
相似文章
@liquidai:推出LFM2.5-230M:这是我们最小的模型,专为快速运行而设计,可在任何地方(CPU、NPU和GPU)上运行,以实现代理型任务…
Liquid AI发布了LFM2.5-230M,这是一个拥有230M参数的小型模型,针对CPU、NPU和GPU上的快速推理进行了优化,适用于手机和机器人等设备上的代理型任务。
@noctus91: 我最近从 Qwen 3.5 9B 切换到了 @liquidai 的 LFM2.5-8B-A1B,它迅速成为我在 H… 中的默认本地模型
一位用户分享了从 Qwen 3.5 9B 切换到 Liquid AI 新推出的 LFM2.5-8B-A1B 模型的积极体验,称赞其在代理任务上的速度和可靠性,同时指出编码仍然是其弱项。该模型是一个 8B MoE 架构,具有 1.5B 活跃参数和 128K 上下文,针对设备和服务器端使用进行了优化。
Liquid AI 发布 LFM2.5-8B-A1B
Liquid AI 发布了 LFM2.5-8B-A1B,这是一款边缘模型,拥有 128K 上下文窗口、38T 预训练 token 和大规模强化学习,支持工具调用和复杂任务,同时可运行于入门级笔记本电脑。
LiquidAI/LFM2.5-230M
Liquid AI发布了LFM2.5-230M,一款紧凑的230M参数混合模型,针对设备端部署进行了优化,边缘推理速度快(在Galaxy S25 Ultra上达到213 tok/s),并通过强化学习构建,适用于智能体任务。
在Fable-5编码轨迹上微调了LiquidAI的LFM2.5-230M模型——结果比预期的要好
在Fable-5编码轨迹上微调了LiquidAI的LFM2.5-230M模型,发现结果比预期的要好。