@eliebakouch:所以...世界上最大的两个开源模型使用线性注意力?
摘要
一条推文强调,像Qwen3.8-Max这样的主要开源模型可能使用线性注意力,并引用了阿里巴巴宣布即将发布Qwen3.8-Max(2.4万亿参数)和Qwen3.8-27B开放权重版本的消息。
查看缓存全文
缓存时间: 2026/08/03 17:47
世界上最大的两个开源模型用线性注意力?👀 https://t.co/wQ6VW1fLuK
通义千问(@Alibaba_Qwen): 📢 认识 Qwen3.8-Max —— 我们迄今最强的模型。
下周,Qwen3.8-Max 的开源权重将发布,Qwen3.8-27B 也将开源,与大家见面!🎉
Qwen3.8-Max,2.4T 参数,树立编码与协作新标杆:
- 自主编码:10 天以上的
相似文章
@ChiragAsarpota: 兄弟,这对开放模型来说太巨大了 连Qwen终于也屈服了,正在开放Max模型的权重。他们从未开放过任何M…
Qwen宣布,拥有2.4万亿参数的Qwen3.8-Max将于下周以开放权重的方式发布,同时发布的还有Qwen3.8-27B,这标志着开源AI的一次重大推进,并可能使其与顶级专有模型一较高下。
@levie: 又是新的一天,又一个接近前沿的开源权重模型发布。如果你回到3-6个月前,让每个人都能……
Aaron Levie 对阿里巴巴发布的 Qwen3.8-Max 做出回应,这是一个 2.4T 参数的开源权重模型,并讨论了开源模型发布对整个行业的影响。
@cline:Qwen3.8-Max 是阿里巴巴迄今最大的模型,参数达 2.4T,在 Terminal-Bench 上的基准测试成绩比 Fable 5 高出 2%……
阿里巴巴发布了其最大的模型 Qwen3.8-Max,参数规模达 2.4T,在 Terminal-Bench 上的成绩比 Fable 5 高出 2%,开放权重将于下周发布。
@rohanpaul_ai: 阿里巴巴发布了Qwen3.8-Max,一个2.4万亿参数模型,每个token仅激活约950亿参数。一个……
阿里巴巴发布了Qwen3.8-Max,这是一个2.4万亿参数的稀疏MoE模型,每个token激活950亿参数,支持100万token的上下文,并具有强大的智能体能力和基准测试结果,包括自主编码数天、电路设计,以及在Terminal Bench和PaperBench上超越竞争对手。
Qwen 3.7 Max
Qwen 3.7 是一款来自中国实验室的新AI模型,令人印象深刻,讨论焦点在于其权重是否可供下载。