GLM-5.2 在 WebDew Arena 上获得第二名
摘要
GLM-5.2 已在 WebDev Arena 排行榜上取得第二名,表明其在网页开发任务中的强劲表现。
glm 5.2 在 WebDev* 上获得第二名 :)
相似文章
GLM-5.2 现已登顶 Design Arena 排行榜,超越已下架的 Claude Fable 5。
GLM-5.2 已登上 Design Arena 排行榜首位,超越了已下架的 Claude Fable 5。
@browser_use:GLM 5.2 刚刚在网站设计上击败了 Fable 5。疯狂的是:GLM 是纯文本模型。它可以构建网站,但无法检查结果……
GLM 5.2 是一个纯文本模型,在与 Browser Use v2 多模态 QA 子代理配合使用时,在网站设计上胜过 Fable 5,从而能够以低成本进行迭代改进。
GLM 5.2 确实可以进行网络搜索
GLM 5.2 现已支持网络搜索功能,增强了其实时信息检索能力。
@mercor_ai: GLM 5.2 刚刚成为首个在APEX-SWE上领跑某一类别的开源模型。它在集成任务上取得了55.3%的Pass@1成绩……
GLM 5.2 成为首个在APEX-SWE上位列类别榜首的开源模型,在集成任务上取得55.3%的Pass@1,这是所有模型中记录的最高分,综合排名第6,成为该榜单上测试过的最佳开源模型。
GLM-5.2 可能是目前最强大的纯文本开放权重大语言模型
中国AI实验室Z.ai发布了GLM-5.2,这是一个拥有7530亿参数的开放权重大语言模型,支持100万token的上下文窗口,采用MIT许可证。该模型在Artificial Analysis Intelligence Index上获得最高分,并在Code Arena WebDev排行榜上排名第二。