标签
sudoingX 的一项独立基准测试显示,在澄清官方 INT4 量化确实可用之后,Ling-3.0-flash 模型在单台 DGX Spark 上的运行速度为 38.7 tok/s,比同硬件上的 DeepSeek V4 Flash 快 2.4 倍。
Ant Group 的 inclusionAI 发布了 Ling-3.0-flash,这是一个 124B 参数(5.1B 激活)的模型,采用纯 MIT 许可,没有收入上限或使用限制,并且可在 OpenRouter 上使用,还提供免费额度。
一场社区讨论,询问哪些 AI 模型和工具在发布一个月后仍然有用,作者分享了 Qwen3.6 27B 和 Ling-3.0-flash 作为长期保留的工具。
AntLingAGI发布Ling-3.0-flash,这是一款124B参数的MoE模型,其中5.1B参数为活跃参数,现已在Nous Portal上免费提供一周。它在许多基准测试中匹配甚至超越其1T旗舰模型,专为编码和工具使用等智能体工作负载而设计。