重磅消息:阿里巴巴@Alibaba_Qwen团队的Qwen3.8-Max-0902在Code Arena: WebDev中以1691分首次亮相即登顶总榜第一!其得分比Claude Opus 5 (Max)高3分,比Kimi K3 (Max)高17分,比前代Qwen3.8-Max高22分。定价为混合每百万令牌5美元,Qwen3.8-Max-0902还声称...

Reddit r/singularity 模型

摘要

Qwen3.8-Max-0902,阿里巴巴Qwen团队的新型AI模型,在Code Arena: WebDev排行榜上以令人印象深刻的成绩和具有竞争力的定价首次亮相即登顶。

...在帕累托前沿上得分最高的位置!敬请期待对其帕累托定位的深入了解,以及即将发布的代理竞技场分数。其优势在所有Code Arena: WebDev类别中得以体现:- 在数据与分析和消费者产品类别中排名第一 - 在品牌与营销、游戏和模拟类别中排名第二 - 在内容创作工具和基于参考的设计类别中排名第三 恭喜@Alibaba_Qwen团队完成此次重大更新!访问以下链接查看排行榜详情:https:// arena.ai/leaderboard/co de/webdev … — Arena.ai 来源:https://x.com/arena/status/2094974637704913198 🚀Qwen3.8-Max刚刚升级。认识Qwen3.8-Max-0902!2.4T参数。1M上下文令牌。专为现实世界复杂性而构建。在编码与协作方面进一步后训练后,Qwen3.8-Max-0902现在在复杂企业任务、科学研究等领域提供更强性能,以及 https://t.co/1dNQwl52zJ — Qwen 来源:https://x.com/Alibaba_Qwen/status/2094968708288680276
查看原文

相似文章

Qwen3.8-Max-0902 在编码领域超越 Claude Opus 5

Reddit r/singularity

Qwen3.8-Max-0902 在 Code Arena: WebDev 中以 1691 分首次亮相排名第一,超越 Claude Opus 5 3 分,并以每百万代币 5 美元的价格占据了 Pareto frontier 上的最高分位置。

Qwen 3.7 Preview

Hacker News Top

阿里巴巴在 Arena 上发布了 Qwen3.7-Max-Preview 和 Qwen3.7-Plus-Preview,在文本和视觉类别中均取得顶级排名。