@AlmustyFX: 混合专家模型轻量级解决方案正日益成熟。Ling-3.0-tiny 总参数规模为7.9B…

X AI KOLs Timeline 模型

摘要

Ling-3.0-tiny 采用混合专家模型架构,总参数7.9B,但每次运行仅激活1.3B参数,从而降低计算开销,使Mac上的本地执行更加流畅。

混合专家模型轻量级解决方案正日益成熟。Ling-3.0-tiny 的总参数规模为7.9B,但实际运行时仅激活1.3B有效参数,通过128个路由专家中选择8个参与计算。这显著降低了计算开销,提供了在Mac上本地流畅运行更大容量模型的潜力,这绝对值得期待。
查看原文

相似文章

Inkling-Small(4分钟阅读)

TLDR AI

Thinking Machines发布了Inkling-Small,这是一个高效的开放权重混合专家模型,总参数量276B,激活参数12B。它的大小仅为更大版本Inkling的四分之一,但性能与之相当。该模型原生支持音频和图像推理,具备可变的思考深度,并拥有100万token的上下文窗口。

中型MoE大语言模型

Reddit r/LocalLLaMA

用户寻求中等规模的混合专家大语言模型(MoE)推荐(最高60B参数(float8)/110B参数(mxfp4)),列出了Qwen 3.5 35B、Gemma 4 A4B和Nemotron 3 Nano,并询问除此之外还有哪些小众选择。