@kimmonismus:天啊,中国再次出手:Qwen3.8-Max 据报自主运行16天,成本比 GPT-5.6 S… 低80%
摘要
阿里巴巴发布 Qwen3.8-Max,一个 2.4T 参数的 MoE 前沿模型,开放权重将于下周推出,声称自主运行16天,成本显著低于 GPT-5.6 Sol 和 Claude Fable 5。
查看缓存全文
缓存时间: 2026/08/03 09:38
天哪,中国又出手了:据报道,Qwen3.8-Max 自主运行了 16 天,输出成本比 GPT-5.6 Sol 便宜 80%,比 Claude Fable 5 便宜 88%。而且它还是开放权重的!
阿里这款 2.4T 参数的 MoE 模型,输入 $2/百万 token,输出 $6/百万 token。
GPT-5.6 Sol:5/30。 Claude Fable 5:10/50。
Qwen 表示,该模型自主运行了 16 天,通过 issue -> 代码 -> 测试 -> 修复 -> 合并 的循环,产出了 265 个 commit、127 个 PR 和 151 个 issue。
它并非在所有基准测试中领先,但在编程、专业工作和计算机使用方面都达到了前沿水平,而 PaperBench 则以非常优惠的价格将其排在了 Fable 5 和 GPT-5.6 Sol 之前。
开放权重将于下周发布。
一个能经济地运行十天的模型,可能比一个你只跑得起十分钟的更好模型更有用。
说实话,中国又一波逆天发布。
Qwen (@Alibaba_Qwen): 📢认识一下 Qwen3.8-Max——我们迄今为止最强大的模型。
下周,Qwen3.8-Max 的开放权重将发布,Qwen3.8-27B 也将开放权重与大家见面!🎉
Qwen3.8-Max,2.4T 参数,树立编程与协作新标杆:
- 自主编程:10+ 天的
相似文章
阿里Qwen3.7-Max在陌生硬件上自主运行35小时,持续自我优化
阿里Qwen3.7-Max模型在陌生T-Head PPU硬件上,无需人工引导,自主优化生产内核长达35小时,进行1158次工具调用,实现10倍速度提升,展示了持续的自主智能体行为。
@cline:Qwen3.8-Max 是阿里巴巴迄今最大的模型,参数达 2.4T,在 Terminal-Bench 上的基准测试成绩比 Fable 5 高出 2%……
阿里巴巴发布了其最大的模型 Qwen3.8-Max,参数规模达 2.4T,在 Terminal-Bench 上的成绩比 Fable 5 高出 2%,开放权重将于下周发布。
@rohanpaul_ai: 阿里巴巴发布了Qwen3.8-Max,一个2.4万亿参数模型,每个token仅激活约950亿参数。一个……
阿里巴巴发布了Qwen3.8-Max,这是一个2.4万亿参数的稀疏MoE模型,每个token激活950亿参数,支持100万token的上下文,并具有强大的智能体能力和基准测试结果,包括自主编码数天、电路设计,以及在Terminal Bench和PaperBench上超越竞争对手。
@WEB3_furture: COOL ! 有人拿 新发布Qwen 3.7-Max和Claude Opus 4.7、GPT-5.5 做 Agent 循环对比:让模型自己写俄罗斯方块机器人、自己测试、连续迭代 10 轮后直接 PK,结果: Qwen 3.7-Max:+$…
有人对Qwen 3.7-Max、Claude Opus 4.7和GPT-5.5进行Agent循环对比测试,让模型自己编写俄罗斯方块机器人并迭代10轮后PK,结果显示Qwen 3.7-Max在性能和成本上均领先。
GPT-5,一年前还是全球最佳模型,如今却不如Qwen3.6 27B及当今大多数低端模型
GPT-5一年前还是最佳模型,如今已被Qwen3.6 27B及其他当前低端模型超越,凸显了AI发展的迅猛速度。