Union stealth 模型?
摘要
一位用户在 OpenRouter 上分享了关于新型 'Union stealth' 模型的观察,将其性能与 Qwen 模型进行比较,并推测它可能是具有 256k 上下文和 2025 年底训练截止时间的 Qwen4 MoE 变体。
还有人试用了 OpenRouter 上的新 Union stealth 模型吗?作为一个免费模型,它相当不错。当然,我不得不运行分词器测试和训练截止时间测试,结果确定它 99% 的分词器与 Qwen3/3.5/4 相同(一些多语言样本运行更长,一些空格/格式使用更少的 token),具有 256k 上下文,训练截止时间大约在 2025 年 12 月到 2026 年 1 月之间。它绝对比 Qwen3.6 35B A3B 或基于它的 Nex n2.5 mini 模型更上一层楼,具有更新的训练截止时间,并且在我主观看来,它很容易与 Qwen3.8 27b 竞争。推理是隐藏的,这让我以为权重是封闭的,但它绝对是某种 Qwen 模型,我认为它很可能是新的小型 Qwen4 MoE。不过,我曾对 ox stealth 感到兴奋,以为它可能成为一个穷人模型,结果却是 glm5.3flash,所以也许我的感知有误。我需要更仔细地分析代理跟踪和它生成的代码,看看它是否达到 Qwen3.8 27b 的水平,或者它明显是一个更聪明的模型。在没有思维链可见的情况下更难判断,但你通常可以在代码中看到模型家族的特征。但是……如果这是 Qwen4 MoE 30-40b,我们很快就能像皇室一样享用盛宴了。迫不及待想将一个脑残的 iq2xs 量化与 128k q4_0 kv 缓存扔到我的 16gb M4 上,看着它以 25 tok/s 的速度狂飙!
相似文章
新的隐蔽模型:Union Alpha
一个新的隐秘AI模型Union Alpha已在OpenRouter和OpenCode上免费发布,具有256K上下文的多模态能力,并声称具有前沿级别的通用性能,引发了关于其来源的猜测。
Qwen3.7 开源权重即将发布的首个证据。Qwen3.7-flash 已出现在 OpenRouter 上。他们曾将 Qwen3.6-35b-a3b 称为 Qwen3.6 flash,因此这很可能是一个小型 MoE。其价格远低于 3.6 flash,且原生支持 100 万上下文窗口。
Qwen3.7 开源权重即将发布的证据,其 flash 变体(很可能是小型 MoE)已出现在 OpenRouter 上,具有 100 万上下文窗口,且价格比 Qwen3.6 flash 更低。
@thegenioo: 为什么这隐身模型在前端方面这么厉害?
OpenRouter 发布了一款名为 Ox Alpha 的新型隐身 AI 模型,该模型针对高效编码和代理任务进行了优化,具备 1M 令牌上下文窗口,并支持文本、图像和视频输入。
有人在 OpenRouter 上试过 Qwen3.7 flash 吗?相比我们现有的 Qwen 3.6 27B 怎么样?
一位用户询问在 OpenRouter 上使用 Qwen3.7 flash 的体验,以及它与 Qwen 3.6 27B 相比如何,并暗示这可能是 Qwen 团队的下一个开源权重版本。
我们会迎来 Qwen 3.8 35-A3B 吗?
围绕即将发布的 Qwen 3.8 的猜测,质疑它会是稠密 27B 模型还是类似此前 35B-A3B 的 MoE 变体,并讨论了对本地硬件性能的影响。