Ling 3.0 (在 Nous 上)
摘要
本文讨论了用户报告的来自 Nous 的 Ling 3.0 AI 模型的问题,重点关注文本输出和上下文长度限制的问题,可能与量化或速率限制有关。
Ling 3.0 有时表现很好。其他时候,它在输出文本时出现问题。它字面上告诉自己要“说 X”,但随后却没有。这似乎有时从 55k 上下文开始,这并不多。我不确定 Nous 是在使用完整模型还是 1.3 位量化模型。我不知道速率限制是否是部分原因。
相似文章
@NousResearch: Ling-3.0-flash,来自@AntLingAGI的新MoE模型,现已在Nous Portal上免费提供一周!拥有124B参数……
AntLingAGI发布Ling-3.0-flash,这是一款124B参数的MoE模型,其中5.1B参数为活跃参数,现已在Nous Portal上免费提供一周。它在许多基准测试中匹配甚至超越其1T旗舰模型,专为编码和工具使用等智能体工作负载而设计。
Ling-3.0-tiny 是个非常有趣的模型。它可以在 NVIDIA Orin Nano Super 8GB 上运行,支持 128K 上下文并采用 IQ4_NL 量化技术。
本文展示了在NVIDIA Orin Nano Super 8GB设备上运行Ling-3.0-tiny AI模型的实例,采用IQ4_NL量化方案,实现33 tok/s解码速度与完整128K上下文长度,体现了边缘AI的实际部署能力。
Ling 3.0 闪存/微型基础模型
InclusionAI 已开源 Ling-3.0 系列,该系列具有高效的语言模型,采用稀疏 MoE 架构和混合线性注意力,提供不同训练阶段的检查点,以支持研究和创新。
对于 Ling-2.6-1T,首先什么会让其规模显得合理:每个token的质量、本地服务的可行性,还是长上下文的稳定性?
文章质疑 Ling-2.6-1T 模型的规模是否在质量、本地服务可行性或长上下文稳定性方面合理,将其描述为一个开源 MoE 模型,总参数量达1T,原生上下文长度达1M。
Ling 3 tiny 是否因体积小巧而被低估?
一位用户讨论了 Ling 3 tiny 模型的基准测试,将其与 Qwen3.5 9b 进行比较,并质疑是否其他开源模型被忽视了。