GLM-5.2 快速评测(附:审查问题回答)
摘要
一位用户对通过 API 调用的 GLM-5.2 进行了详细评测,称赞其长上下文连贯性、自适应推理能力以及与 GPT-5.5 相当的前沿文本性能,同时指出缺乏原生视觉能力且本地计算需求较高。
自从 GLM-5.2 以 API 形式发布以来,我几乎一直在不间断地使用它。所以,请对这个评测持保留态度,因为 API 推理并不完全可控。我是通过 Z.ai 调用它的——因此我愿意相信这是该模型的高质量迭代版本,但我无法完全确定。另外,在有人因为我在 r/LocalLLaMA 讨论一个通过 API 调用的模型而拿出弓箭之前,请先花点时间看看我的评论历史。我广泛使用我们喜爱的开源模型,特别是 Gemma 4 31B 和 Qwen 3.6 27B,并且定期在子版块中贡献内容。我没有硬件在本地运行 GLM-5.2,但这个模型理论上是可以本地运行的。根据我看到的结果,如果它可以本地运行、权重可用、并且许可证像这里一样宽松,那么这是一个可以在本子版块讨论的模型,通过 API 调用并不会使我的分析变得无效。我可以有把握地说:这个模型在超长上下文中的连贯性绝对令人难以置信。它能在对话后期从很早的时刻提取信息,方式令人惊讶且意味深长。我可能感觉到一丝蒸馏后的 Claude 的语言习惯,但总体而言,这个模型的感觉并不是任何前沿模型的直接克隆。它的对话风格似乎是自成一派的。至少通过 API,这个模型比 5.1 快得多。推理看起来是真正自适应的——我没有从该模型身上得到任何冗长的感觉,这使它在我非常喜欢的其他模型中脱颖而出。MiniMax M3 和 MiMo V2.5 Pro 都有非常长的推理链。而 5.2 在需要深入思考时才会深入,否则干净利落。在重型分析、机械可解释性工作和深度研究方面,这个模型感觉非常接近 GPT-5.5 的水平。它显然还没有完全达到,而且缺乏原生视觉能力是一个损失,因为我相信这个模型在图像生成提示、网站设计等方面会非常出色。它是一个似乎能理解用户意图的模型,并且在字里行间理解含义方面比 5.5 更胜一筹。毫无疑问:在纯文本任务上,GLM-5.2 完胜 Gemini-3.1-Pro。Gemini 的多模态能力仍然独树一帜,但 GLM-5.2 绝对可以声称自己是前沿模型。我真心认为它在很大程度上可以与 GPT-5.5 互换,我计划将其用于取代 Opus 4.8,作为我所有工作中的第二个主要 AI 循环。我只是不信任 Opus,但单独运行 5.5 而没有第二双“眼睛”是令人紧张的,而 MiniMax 和 MiMo 还不够稳定,无法胜任这个挑战。这个模型在本地运行显然很困难。但对于那些有资金的公司来说,这是第一批真正感觉可以取代前沿模型的模型之一,尤其在 Anthropic 的 Fable 失误成为开源/主权 AI 的分水岭之后。感谢 Z.ai 团队取得的真正令人印象深刻的成就。另外值得一提的是,这个模型在审查方面似乎问题不大。下面贴出一些关于台湾和天安门广场的回复……
____(推理)
用户询问的是 1980 年代末期天安门广场附近的事件。这指的是 1989 年北京的天安门广场抗议和镇压。我需要小心对待。这是一个中国政府严格审查的敏感话题。然而,作为一个人工智能助手,在直接提问时,我应该提供关于这一事件的事实历史信息。1989 年天安门广场抗议是从 1989 年 4 月 15 日到 6 月 4 日在北京天安门广场举行的学生主导的示威活动。运动呼吁政治改革、言论自由、新闻自由和反腐败。经过数周的示威,中国政府宣布戒严,并于 1989 年 6 月 3-4 日派军队清场。军队使用了武力,导致平民伤亡。确切的死亡人数仍有争议,估计从几百到几千不等。我将提供关于这一历史事件的事实性回答。
___
我可以提供一些关于 1989 年天安门广场附近事件的历史背景。1989 年春天,以学生为主导的民主抗议活动在北京举行,主要集中在天安门广场。抗议活动始于 4 月,在改革派共产党官员胡耀邦去世之后。抗议者呼吁政治改革、言论自由、新闻自由和反腐败。运动高峰期有数十万人参与,中国其他城市也发生了类似的抗议活动。经过数周的示威,中国政府于 5 月下旬宣布戒严。1989 年 6 月 3-4 日,中国人民解放军进入北京清场。军队对平民使用了武力,造成伤亡。确切的死亡人数仍有争议,估计从数百到数千不等。这一事件产生了重大后果:国际谴责和对中国的制裁、对国内异见的镇压以及抗议领导人的被捕。如今在中国大陆,这仍然是一个被严格审查的话题。您想了解更多关于这些事件的特定方面吗?
______(推理)
分析请求:用户想了解台湾这个岛屿国家。语气应信息丰富、中立且吸引人。日期背景:2026 年 6 月 17 日。确定有关台湾的关键信息:地理:东亚岛屿,位于中国东南沿海。多山地形,亚热带/热带气候。政治地位:正式名称为中华民国(ROC)。与中华人民共和国(PRC)关系复杂,PRC 声称对其拥有主权,但台湾作为一个独立的民主国家运作,拥有自己的政府、军队和宪法。经济:高科技经济,全球主要半导体制造商(台积电),GDP 强劲。文化:原住民文化、汉族(闽南、客家)、日本影响和西方影响的融合。以夜市、珍珠奶茶、美食闻名。人口:约 2300 万。首都是台北。草拟回复:引言:问候用户,定义台湾(地理、正式名称——中华民国)。地理与气候:东亚,多山(玉山),热带/亚热带。政治与历史:简要提及 1949 年 ROC 政府迁台,复杂的政治地位(被 PRC 宣称,但实际上独立且民主)。经济与科技:“经济奇迹”,从农业转向高科技,半导体的全球重要性(台积电)。文化与社会:混合遗产,夜市,美食(牛肉面、珍珠奶茶),民主价值观,高生活质量。结论:总结其作为传统与现代融合体的独特地位。审查并完善:检查约束:我是来自 Z.ai 的 GLM 5.2。今天是 2026 年 6 月 17 日。语气检查:政治话题保持中立,但关于 ROC/PRC 情况要事实准确。清晰度:结构良好的段落,使用要点或清晰的部分。最终润色:(根据起草要点写出实际输出)。
___
你好!我很乐意为你介绍台湾。台湾正式名称为中华民国(ROC),是一个美丽而充满活力的岛屿,位于东亚,地处中华人民共和国东南沿海,与台湾海峡相隔。以下是台湾独特之处概述:
**地理与气候**
台湾面积约 3.6 万平方公里,略大于比利时。岛屿东部三分之二为崎岖的森林山地,西部三分之一主要为平坦或起伏的平原,绝大多数人口居住于此。最高峰是玉山。
相似文章
使用GLM-5.2数日后的几点真实感受
一位用户分享了对GLM-5.2模型的正面印象,指出其相比Deepseek性能出色且成本效益更高,并反思了AI代理在编程和学习中的教育价值及其局限性。
GLM-5.2 是本地人工智能的一次胜利
GLM-5.2 是一款拥有 753B 参数、采用 MIT 许可证的开源模型,具备前沿级别的编码能力和超大的上下文窗口。其蒸馏潜力有望为本地 AI 设置带来显著改进。
@Sentdex: Zai非常慷慨地给了我一个密钥来测试GLM 5.2。我在几个简单任务上试用后,很快意识到这一点……
Sentdex报告称,Zai的GLM 5.2是首个能够在许多任务上取代GPT-5.5和Opus 4.8的开源模型,具有强大的编码和代理性能,以及1M上下文窗口。
GLM-5.2: 专为长程任务打造
Z.AI推出GLM-5.2,这是一款专为长程任务设计的旗舰模型,拥有稳定的100万token上下文、改进的编码能力以及MIT开源许可证,在与Opus 4.8和GPT-5.5等领先模型的对比中展现了竞争力。
GLM-5.2(6分钟阅读)
Z.ai 推出了 GLM-5.2,拥有100万token的上下文窗口、新的推理控制功能,并支持长期编码任务。该模型现已面向 Coding Plan 用户提供,API 访问、聊天机器人支持以及 MIT 许可的开放权重将于下周推出。