重磅消息:阿里巴巴@Alibaba_Qwen团队的Qwen3.8-Max-0902在Code Arena: WebDev中以1691分首次亮相即登顶总榜第一!其得分比Claude Opus 5 (Max)高3分,比Kimi K3 (Max)高17分,比前代Qwen3.8-Max高22分。定价为混合每百万令牌5美元,Qwen3.8-Max-0902还声称...
摘要
Qwen3.8-Max-0902,阿里巴巴Qwen团队的新型AI模型,在Code Arena: WebDev排行榜上以令人印象深刻的成绩和具有竞争力的定价首次亮相即登顶。
...在帕累托前沿上得分最高的位置!敬请期待对其帕累托定位的深入了解,以及即将发布的代理竞技场分数。其优势在所有Code Arena: WebDev类别中得以体现:- 在数据与分析和消费者产品类别中排名第一 - 在品牌与营销、游戏和模拟类别中排名第二 - 在内容创作工具和基于参考的设计类别中排名第三 恭喜@Alibaba_Qwen团队完成此次重大更新!访问以下链接查看排行榜详情:https:// arena.ai/leaderboard/co de/webdev … — Arena.ai 来源:https://x.com/arena/status/2094974637704913198 🚀Qwen3.8-Max刚刚升级。认识Qwen3.8-Max-0902!2.4T参数。1M上下文令牌。专为现实世界复杂性而构建。在编码与协作方面进一步后训练后,Qwen3.8-Max-0902现在在复杂企业任务、科学研究等领域提供更强性能,以及 https://t.co/1dNQwl52zJ — Qwen 来源:https://x.com/Alibaba_Qwen/status/2094968708288680276
相似文章
Qwen3.8-Max-0902 在编码领域超越 Claude Opus 5
Qwen3.8-Max-0902 在 Code Arena: WebDev 中以 1691 分首次亮相排名第一,超越 Claude Opus 5 3 分,并以每百万代币 5 美元的价格占据了 Pareto frontier 上的最高分位置。
Qwen3.8 Max (0902) 在人工智能分析智能指数上获得45分,一个月内提升5分,重返中国排行榜榜首,以微弱优势超越GLM-5.3 (44.9分) 和Kimi K3 (43.8分)
Qwen3.8 Max 经过升级后,以45分的AI分析智能指数得分领跑中国AI排行榜,超越了GLM-5.3和Kimi K3,这是其2.4T MoE模型在30天内优化提升的结果。
Qwen3.8-Max 刚刚以 1,668 分的成绩在 Frontend Code Arena 排行榜上位列第 4!
Qwen3.8-Max 是一个开放权重模型,在 Frontend Code Arena 排行榜上以 1,668 分位列第 4,并在多个领域表现强劲。
Qwen 3.7 Preview
阿里巴巴在 Arena 上发布了 Qwen3.7-Max-Preview 和 Qwen3.7-Plus-Preview,在文本和视觉类别中均取得顶级排名。
Qwen3.8 Max 在智能体指数中被评为最佳整体模型
Qwen3.8 Max 目前在 Artificial Analysis 的智能体指数中排名第一,在独立评估中超越了其他领先的AI模型。