@modal: @Alibaba_Qwen 和 @alibaba_cloud 的 Qwen3.8-2.4T-A95B 现已登陆 Modal。配备自定义 DFlash 推测器…
摘要
阿里巴巴 Qwen 和阿里云的 Qwen3.8-2.4T-A95B 现已登陆 Modal,配备基于工具调用密集型数据训练的自定义 DFlash 推测器和完整的 1M 上下文窗口。
查看缓存全文
缓存时间: 2026/08/14 07:35
由 @Alibaba_Qwen 和 @alibaba_cloud 推出的 Qwen3.8-2.4T-A95B 现已可在 Modal 上使用。该模型配备了一个在工具调用密集型数据上训练的自定义 DFlash 推测器,并支持完整的 1M 上下文窗口。https://t.co/KAoS3tCmhU
相似文章
@rohanpaul_ai: 阿里巴巴发布了Qwen3.8-27B的权重,这是一个为本地部署构建的27B开放权重多模态模型。 - Apache …
阿里巴巴发布了Qwen3.8-27B,这是一个用于本地部署的27B开放权重多模态模型,在SWE-bench Pro和OSWorld等编程基准测试中表现出前沿级别的性能,超越了一些更大的模型。
Qwen 3.8
阿里巴巴发布Qwen3.8,这是一款拥有2.4万亿参数的模型,并计划很快进行开放权重发布。预览版Qwen3.8-Max-Preview现已在阿里巴巴的Token Plan平台、Qoder和QoderWork上可用。
@cline:Qwen3.8-Max 是阿里巴巴迄今最大的模型,参数达 2.4T,在 Terminal-Bench 上的基准测试成绩比 Fable 5 高出 2%……
阿里巴巴发布了其最大的模型 Qwen3.8-Max,参数规模达 2.4T,在 Terminal-Bench 上的成绩比 Fable 5 高出 2%,开放权重将于下周发布。
@rohanpaul_ai: 阿里巴巴发布了Qwen3.8-Max,一个2.4万亿参数模型,每个token仅激活约950亿参数。一个……
阿里巴巴发布了Qwen3.8-Max,这是一个2.4万亿参数的稀疏MoE模型,每个token激活950亿参数,支持100万token的上下文,并具有强大的智能体能力和基准测试结果,包括自主编码数天、电路设计,以及在Terminal Bench和PaperBench上超越竞争对手。
@cline: 祝贺@Alibaba_Qwen团队,新的Qwen-3.7 Plus是一款同类最佳的多模态模型,表现接近SOTA……
Qwen-3.7 Plus是阿里巴巴Qwen推出的新多模态模型,作为编码和通用代理的表现接近最先进水平;现在可以在Cline中免费试用。