用 Ling 3.1 Flash 上手 12 小时
摘要
作者抢先体验了 Ling 3.1 Flash——一款拥有 560B 参数、25B 激活参数的 MoE 模型,即将发布。他用这款模型打造了一件复杂的乐器,并期待正式发布后大家会用它做出什么。
用 Ling 3.1 Flash 560B A25B(即将发布)打造了一件最难演奏的乐器。如今 'flash' 这个词居然出现在 500B 量级里,说起来还真有点疯狂,不过嘛,它确实能用。已经迫不及待想看到这个模型发布后,大家都会玩出什么花样了。
相似文章
Ling-3.1-flash:总参数约 560B,每个 token 仅激活约 25B,上下文最长可达 100 万 token——先提供 2 周免费试用,随后开源
Ling-3.1-flash 是一款约 560B 参数的 MoE 模型,每个 token 仅激活约 25B 参数,上下文最长可达 100 万 token,将先提供 2 周免费试用,之后开源。
@cline:Ling 3.1 Flash 现已登陆 Cline,10 月 13 日前免费使用。这款总参数达 560B 的 MoE 模型激活参数为 25B,…
Ling 3.1 Flash 是一款总参数 560B、激活参数 25B 的 MoE 模型,现已上线 Cline,并在 10 月 13 日前免费使用,据称其性能与 Kimi K3、DeepSeek V4 Pro 等其他前沿开源权重模型相当。
@NousResearch: Ling-3.0-flash,来自@AntLingAGI的新MoE模型,现已在Nous Portal上免费提供一周!拥有124B参数……
AntLingAGI发布Ling-3.0-flash,这是一款124B参数的MoE模型,其中5.1B参数为活跃参数,现已在Nous Portal上免费提供一周。它在许多基准测试中匹配甚至超越其1T旗舰模型,专为编码和工具使用等智能体工作负载而设计。
Ling-3.0-flash 是另一个在 qwen3.8 27b 之前值得测试的潜在模型
Ling-3.0-flash 是一个新模型,作者测试后发现它能修复 Qwen3.6-27b 无法修复的棘手软件错误,速度与 DeepSeek V4 flash 相近。其发布时间已推迟到 8 月 6 日。
@AntLingAGI:发布 Ling-2.6-flash,104B 总参、7.4B 激活的稀疏指令模型
Ling-2.6-flash 是 104B 总参/7.4B 激活的稀疏指令模型,专为 token 效率优化,可在智能体任务中降低成本、提升吞吐。