Qwen3.8-Max 刚刚以 1,668 分的成绩在 Frontend Code Arena 排行榜上位列第 4!
摘要
Qwen3.8-Max 是一个开放权重模型,在 Frontend Code Arena 排行榜上以 1,668 分位列第 4,并在多个领域表现强劲。
开放权重正在成为前沿。它在所有领域也排名靠前:消费产品第 2,品牌与营销、参考设计、游戏和内容创作工具第 3,数据与分析第 4,模拟第 5。
相似文章
重磅消息:阿里巴巴@Alibaba_Qwen团队的Qwen3.8-Max-0902在Code Arena: WebDev中以1691分首次亮相即登顶总榜第一!其得分比Claude Opus 5 (Max)高3分,比Kimi K3 (Max)高17分,比前代Qwen3.8-Max高22分。定价为混合每百万令牌5美元,Qwen3.8-Max-0902还声称...
Qwen3.8-Max-0902,阿里巴巴Qwen团队的新型AI模型,在Code Arena: WebDev排行榜上以令人印象深刻的成绩和具有竞争力的定价首次亮相即登顶。
Qwen 3.6 27B 在 DeepSWE 上的表现
Qwen 3.6 27B 在 DeepSWE 基准测试中获得了 2% 的分数,排名 18/20,高于 Haiku 4.5 和 Minimax M2.7,突显了本地模型与前沿模型之间的差距。
Qwen3.8 Max (0902) 在人工智能分析智能指数上获得45分,一个月内提升5分,重返中国排行榜榜首,以微弱优势超越GLM-5.3 (44.9分) 和Kimi K3 (43.8分)
Qwen3.8 Max 经过升级后,以45分的AI分析智能指数得分领跑中国AI排行榜,超越了GLM-5.3和Kimi K3,这是其2.4T MoE模型在30天内优化提升的结果。
Qwen 3.7 Max 在 SWE-Bench Pro 上取得了 60.6% 的得分
Qwen 3.7 Max 在 SWE-Bench Pro 上取得了 60.6% 的得分,展现了在软件工程任务上的竞争力。
Qwen3.7 Max在Artificial Analysis评测中得分,27B/35B等待室
Qwen3.7 Max在Artificial Analysis基准测试中排名第五,与GPT-5.4持平,并超越了刚发布的Gemini 3.5 Flash,而Qwen3.6 27B则明显落后。