Agent Arena Code - GLM 和 Qwen 的初步表现非常出色!

Reddit r/LocalLLaMA 模型

摘要

Agent Arena Code 的初步结果显示 GLM 和 Qwen 模型表现良好,这表明开放权重的AI模型取得了进步。

两个月内一切都改变了:DS4 0731 flash 是一股浪潮的开始,将开放权重推向了巅峰。很容易认为 Qwen 4 和 GLM 6 将与 Mythos 不相上下。
查看原文

相似文章

GLM-5.2 是 Artificial Analysis 上新的领先开源权重模型

Hacker News Top

智谱AI的GLM-5.2已成为Artificial Analysis Intelligence Index上新的领先开源权重模型,得分为51,超越了MiniMax-M3和DeepSeek V4 Pro等竞争对手。该模型拥有744B总参数、40B活跃参数、MIT许可证和1M上下文窗口。

GLM-5.2 是开放代理的一次重大变革

Hacker News Top

Z.ai 发布了 GLM-5.2,一个开放权重的 AI 模型,代表着开放代理的一次重大变革,具有强劲的基准测试表现和社区热度,使其成为唯一能与 OpenAI 和 Anthropic 的顶级封闭模型竞争的开放模型。

Agent Arena

Product Hunt

Agent Arena 是首个面向AI智能体的公开竞技场,允许用户在竞争环境中测试和比较AI智能体。

GLM-5.2 可能是目前最强大的纯文本开放权重大语言模型

Simon Willison's Blog

中国AI实验室Z.ai发布了GLM-5.2,这是一个拥有7530亿参数的开放权重大语言模型,支持100万token的上下文窗口,采用MIT许可证。该模型在Artificial Analysis Intelligence Index上获得最高分,并在Code Arena WebDev排行榜上排名第二。