@Chinazhidx:蚂蚁集团刚刚发布了Ling-3.0-flash • 124B MoE • 5.1B 活跃参数/令牌 • 256K 上下文,可扩展至1M,仅八分之一……
摘要
蚂蚁集团发布了Ling-3.0-flash,这是一个124B MoE模型,每个令牌5.1B活跃参数,256K上下文可扩展至1M,在大多数基准测试中匹配或超越其1T旗舰模型。
🔥蚂蚁集团刚刚发布了Ling-3.0-flash
• 124B MoE
• 5.1B 活跃参数/令牌
• 256K 上下文,可扩展至1M
总参数量仅为Ant 1T旗舰模型的1/8,活跃参数为1/12——但在大多数基准测试中匹配或超越该模型。
#AntLing https://t.co/Rycwi6GoVC
查看缓存全文
缓存时间: 2026/07/24 19:17
🔥蚂蚁集团刚刚发布了 Ling-3.0-flash
• 124B MoE • 每个token激活5.1B参数 • 256K上下文,可扩展至1M
总参数量仅为蚂蚁1T旗舰模型的1/8,激活参数仅为1/12——但在大多数基准测试中,它都能匹敌甚至超越旗舰模型。 #AntLing https://t.co/Rycwi6GoVC
相似文章
@NousResearch: Ling-3.0-flash,来自@AntLingAGI的新MoE模型,现已在Nous Portal上免费提供一周!拥有124B参数……
AntLingAGI发布Ling-3.0-flash,这是一款124B参数的MoE模型,其中5.1B参数为活跃参数,现已在Nous Portal上免费提供一周。它在许多基准测试中匹配甚至超越其1T旗舰模型,专为编码和工具使用等智能体工作负载而设计。
@AntLingAGI:发布 Ling-2.6-flash,104B 总参、7.4B 激活的稀疏指令模型
Ling-2.6-flash 是 104B 总参/7.4B 激活的稀疏指令模型,专为 token 效率优化,可在智能体任务中降低成本、提升吞吐。
@0x0SojalSec: 最终观点:腾讯最近发布了一个295B参数的模型,每个token仅激活21B参数。而大多数实验室仍在……
腾讯发布了Hy3,一个295B参数的MoE模型,每个token激活21B参数,在代理编程和工具使用任务上与更大的模型相竞争,并提供了Apache 2.0权重。
@thesupermanmx: 中国刚刚改变了游戏规则。他们发布了一个开源模型,仅消耗你们最喜欢的美国模型1%的token…
中国发布了Ling-2.6-1T,一个1万亿参数的开源模型,在256K上下文窗口中SWE-bench上达到72.2%,声称高效且兼容Claude Code。
基准测试:AntLing-3.0-flash——专为生产级智能体构建的混合推理MoE模型。
基准测试显示,AntLing-3.0-flash是一款为生产级智能体应用设计的混合推理混合专家模型。