Union stealth 模型?

Reddit r/LocalLLaMA 模型

摘要

一位用户在 OpenRouter 上分享了关于新型 'Union stealth' 模型的观察,将其性能与 Qwen 模型进行比较,并推测它可能是具有 256k 上下文和 2025 年底训练截止时间的 Qwen4 MoE 变体。

还有人试用了 OpenRouter 上的新 Union stealth 模型吗?作为一个免费模型,它相当不错。当然,我不得不运行分词器测试和训练截止时间测试,结果确定它 99% 的分词器与 Qwen3/3.5/4 相同(一些多语言样本运行更长,一些空格/格式使用更少的 token),具有 256k 上下文,训练截止时间大约在 2025 年 12 月到 2026 年 1 月之间。它绝对比 Qwen3.6 35B A3B 或基于它的 Nex n2.5 mini 模型更上一层楼,具有更新的训练截止时间,并且在我主观看来,它很容易与 Qwen3.8 27b 竞争。推理是隐藏的,这让我以为权重是封闭的,但它绝对是某种 Qwen 模型,我认为它很可能是新的小型 Qwen4 MoE。不过,我曾对 ox stealth 感到兴奋,以为它可能成为一个穷人模型,结果却是 glm5.3flash,所以也许我的感知有误。我需要更仔细地分析代理跟踪和它生成的代码,看看它是否达到 Qwen3.8 27b 的水平,或者它明显是一个更聪明的模型。在没有思维链可见的情况下更难判断,但你通常可以在代码中看到模型家族的特征。但是……如果这是 Qwen4 MoE 30-40b,我们很快就能像皇室一样享用盛宴了。迫不及待想将一个脑残的 iq2xs 量化与 128k q4_0 kv 缓存扔到我的 16gb M4 上,看着它以 25 tok/s 的速度狂飙!
查看原文

相似文章

新的隐蔽模型:Union Alpha

Reddit r/singularity

一个新的隐秘AI模型Union Alpha已在OpenRouter和OpenCode上免费发布,具有256K上下文的多模态能力,并声称具有前沿级别的通用性能,引发了关于其来源的猜测。

我们会迎来 Qwen 3.8 35-A3B 吗?

Reddit r/LocalLLaMA

围绕即将发布的 Qwen 3.8 的猜测,质疑它会是稠密 27B 模型还是类似此前 35B-A3B 的 MoE 变体,并讨论了对本地硬件性能的影响。