@kimmonismus:天啊,中国再次出手:Qwen3.8-Max 据报自主运行16天,成本比 GPT-5.6 S… 低80%

X AI KOLs Timeline 模型

摘要

阿里巴巴发布 Qwen3.8-Max,一个 2.4T 参数的 MoE 前沿模型,开放权重将于下周推出,声称自主运行16天,成本显著低于 GPT-5.6 Sol 和 Claude Fable 5。

天啊,中国再次出手:Qwen3.8-Max 据报自主运行了16天,输出成本比 GPT-5.6 Sol 低80%,比 Claude Fable 5 低88%。而且权重还是开放的! 阿里巴巴的 2.4T 参数 MoE 模型,输入 token 价格 $2/M,输出 token 价格 $6/M。 GPT-5.6 Sol:$5/$30。 Claude Fable 5:$10/$50。 Qwen 表示,该模型自主运行了16天,通过“问题 -> 代码 -> 测试 -> 修复 -> 合并”的循环,产生了265次提交、127个拉取请求和151个问题。 它并非在所有基准测试中都领先。但它在编程、专业工作和计算机使用方面达到了前沿水平,而 PaperBench 认为它以非常好的价格超越了 Fable 5 和 GPT-5.6 Sol。 开放权重将于下周发布。 一个能经济地运行十天的模型,可能比一个你能承受只运行十分钟的更好的模型更有用。 说实话,这又是中国的一个疯狂发布。
查看原文
查看缓存全文

缓存时间: 2026/08/03 09:38

天哪,中国又出手了:据报道,Qwen3.8-Max 自主运行了 16 天,输出成本比 GPT-5.6 Sol 便宜 80%,比 Claude Fable 5 便宜 88%。而且它还是开放权重的!

阿里这款 2.4T 参数的 MoE 模型,输入 $2/百万 token,输出 $6/百万 token。

GPT-5.6 Sol:5/30。 Claude Fable 5:10/50。

Qwen 表示,该模型自主运行了 16 天,通过 issue -> 代码 -> 测试 -> 修复 -> 合并 的循环,产出了 265 个 commit、127 个 PR 和 151 个 issue。

它并非在所有基准测试中领先,但在编程、专业工作和计算机使用方面都达到了前沿水平,而 PaperBench 则以非常优惠的价格将其排在了 Fable 5 和 GPT-5.6 Sol 之前。

开放权重将于下周发布。

一个能经济地运行十天的模型,可能比一个你只跑得起十分钟的更好模型更有用。

说实话,中国又一波逆天发布。

Qwen (@Alibaba_Qwen): 📢认识一下 Qwen3.8-Max——我们迄今为止最强大的模型。

下周,Qwen3.8-Max 的开放权重将发布,Qwen3.8-27B 也将开放权重与大家见面!🎉

Qwen3.8-Max,2.4T 参数,树立编程与协作新标杆:

  • 自主编程:10+ 天的

相似文章