阿里巴巴是否放弃了35B A3B?
摘要
文章质疑阿里巴巴是否放弃了其35B A3B MoE模型,指出在Qwen 3.8发布之际,没有新的小规模MoE模型公告。
基本上就是标题的意思。我们没有在Qwen 3.8中得到新的MoE模型,阿里巴巴在apsara上也没有宣布任何小规模MoE模型。我知道我们以后可能会有公告,但老实说我有点失去希望了。
相似文章
有没有关于Qwen 3.7 9B的消息?(同时也寻找Qwen 3.5的9B级别替代品)
讨论关于阿里巴巴潜在的开源权重发布Qwen 3.7 9B,以及寻找Qwen 3.5 9B的本地部署替代品。
我们会迎来 Qwen 3.8 35-A3B 吗?
围绕即将发布的 Qwen 3.8 的猜测,质疑它会是稠密 27B 模型还是类似此前 35B-A3B 的 MoE 变体,并讨论了对本地硬件性能的影响。
@rohanpaul_ai: 阿里巴巴发布了Qwen3.8-27B的权重,这是一个为本地部署构建的27B开放权重多模态模型。 - Apache …
阿里巴巴发布了Qwen3.8-27B,这是一个用于本地部署的27B开放权重多模态模型,在SWE-bench Pro和OSWorld等编程基准测试中表现出前沿级别的性能,超越了一些更大的模型。
Qwen 3.8
阿里巴巴发布Qwen3.8,这是一款拥有2.4万亿参数的模型,并计划很快进行开放权重发布。预览版Qwen3.8-Max-Preview现已在阿里巴巴的Token Plan平台、Qoder和QoderWork上可用。
@rohanpaul_ai: 阿里巴巴发布了Qwen3.8-Max,一个2.4万亿参数模型,每个token仅激活约950亿参数。一个……
阿里巴巴发布了Qwen3.8-Max,这是一个2.4万亿参数的稀疏MoE模型,每个token激活950亿参数,支持100万token的上下文,并具有强大的智能体能力和基准测试结果,包括自主编码数天、电路设计,以及在Terminal Bench和PaperBench上超越竞争对手。