@kimmonismus:天啊,中国再次出手:Qwen3.8-Max 据报自主运行16天,成本比 GPT-5.6 S… 低80%
摘要
阿里巴巴发布 Qwen3.8-Max,一个 2.4T 参数的 MoE 前沿模型,开放权重将于下周推出,声称自主运行16天,成本显著低于 GPT-5.6 Sol 和 Claude Fable 5。
查看缓存全文
缓存时间: 2026/08/03 09:38
天哪,中国又出手了:据报道,Qwen3.8-Max 自主运行了 16 天,输出成本比 GPT-5.6 Sol 便宜 80%,比 Claude Fable 5 便宜 88%。而且它还是开放权重的!
阿里这款 2.4T 参数的 MoE 模型,输入 $2/百万 token,输出 $6/百万 token。
GPT-5.6 Sol:5/30。 Claude Fable 5:10/50。
Qwen 表示,该模型自主运行了 16 天,通过 issue -> 代码 -> 测试 -> 修复 -> 合并 的循环,产出了 265 个 commit、127 个 PR 和 151 个 issue。
它并非在所有基准测试中领先,但在编程、专业工作和计算机使用方面都达到了前沿水平,而 PaperBench 则以非常优惠的价格将其排在了 Fable 5 和 GPT-5.6 Sol 之前。
开放权重将于下周发布。
一个能经济地运行十天的模型,可能比一个你只跑得起十分钟的更好模型更有用。
说实话,中国又一波逆天发布。
Qwen (@Alibaba_Qwen): 📢认识一下 Qwen3.8-Max——我们迄今为止最强大的模型。
下周,Qwen3.8-Max 的开放权重将发布,Qwen3.8-27B 也将开放权重与大家见面!🎉
Qwen3.8-Max,2.4T 参数,树立编程与协作新标杆:
- 自主编程:10+ 天的
相似文章
阿里Qwen3.7-Max在陌生硬件上自主运行35小时,持续自我优化
阿里Qwen3.7-Max模型在陌生T-Head PPU硬件上,无需人工引导,自主优化生产内核长达35小时,进行1158次工具调用,实现10倍速度提升,展示了持续的自主智能体行为。
@cline:Qwen3.8-Max 是阿里巴巴迄今最大的模型,参数达 2.4T,在 Terminal-Bench 上的基准测试成绩比 Fable 5 高出 2%……
阿里巴巴发布了其最大的模型 Qwen3.8-Max,参数规模达 2.4T,在 Terminal-Bench 上的成绩比 Fable 5 高出 2%,开放权重将于下周发布。
@rohanpaul_ai: 阿里巴巴发布了Qwen3.8-Max,一个2.4万亿参数模型,每个token仅激活约950亿参数。一个……
阿里巴巴发布了Qwen3.8-Max,这是一个2.4万亿参数的稀疏MoE模型,每个token激活950亿参数,支持100万token的上下文,并具有强大的智能体能力和基准测试结果,包括自主编码数天、电路设计,以及在Terminal Bench和PaperBench上超越竞争对手。
重磅消息:阿里巴巴@Alibaba_Qwen团队的Qwen3.8-Max-0902在Code Arena: WebDev中以1691分首次亮相即登顶总榜第一!其得分比Claude Opus 5 (Max)高3分,比Kimi K3 (Max)高17分,比前代Qwen3.8-Max高22分。定价为混合每百万令牌5美元,Qwen3.8-Max-0902还声称...
Qwen3.8-Max-0902,阿里巴巴Qwen团队的新型AI模型,在Code Arena: WebDev排行榜上以令人印象深刻的成绩和具有竞争力的定价首次亮相即登顶。
Qwen3.8 Max (0902) 在人工智能分析智能指数上获得45分,一个月内提升5分,重返中国排行榜榜首,以微弱优势超越GLM-5.3 (44.9分) 和Kimi K3 (43.8分)
Qwen3.8 Max 经过升级后,以45分的AI分析智能指数得分领跑中国AI排行榜,超越了GLM-5.3和Kimi K3,这是其2.4T MoE模型在30天内优化提升的结果。