@mervenoyann: GLM-5.2 与 Opus 4.8 相当,具有 1M 上下文 > 新的 IS 注意力每 4 个稀疏层重用一次索引器(2.9× 每…)
摘要
GLM-5.2 是一款可与 Opus 4.8 相媲美的新模型,具有 1M 上下文、新的 IS 注意力机制、改进的推测解码和灵活的思考努力级别。它已在 MIT 许可证下发布,并在 transformers、vLLM 和 SGLang 中提供 Day-0 支持。
查看缓存全文
缓存时间: 2026/06/16 19:38
GLM-5.2 达到 Opus 4.8 水平 🔥🥵 且支持 1M 上下文
新 IS 注意力机制每 4 个稀疏层复用一次索引器(在 1M 长度下每 token 的 FLOPs 提升 2.9 倍) 改进的 MTP 层用于推测解码 灵活的思考努力级别 第 0 天即支持 transformers + vLLM + SGLang,采用 MIT 许可 🤗 https://t.co/YdHM3njWQC
相似文章
@AdinaYakup: GLM 5.2 来了 753B (比你想象的要小?) 1M上下文 MIT许可证 GLM IndexShare: 跨层复用索引器…
GLM 5.2 作为一款753B参数的开源模型发布,拥有1M上下文长度,MIT许可证,在AIME 2026上达到99.2分,超越了GPT-5.5、Gemini 3.1 Pro和Claude Opus 4.8。
@haider1: GLM 5.2 感觉像是开放权重模型的 opus 4.5 时刻,真正让我印象深刻的是在长时间、多步骤的…
GLM 5.2 标志着开放权重模型的一个重要里程碑,展示了在长多步骤任务中强大的上下文保留能力以及更可靠的工具调用。
GLM 5.2 对比 Opus
GLM 5.2 是 Z.ai 推出的全新开放权重模型,与 Claude Opus 在 3D 游戏编码任务中进行了对比。Opus 性能更快更清晰,但 GLM 5.2 在成本和易用性上具有显著优势。
@startupideaspod: https://x.com/startupideaspod/status/2069494373604282771
GLM 5.2 是一个开源AI模型,拥有100万token的上下文窗口和强大的基准性能,略逊于Opus 4.8。本集提供了使用Cursor和Codex等工具进行本地或云端部署的实用指南,并强调通过串联模型来实现成本效益。
GLM-5.2: 专为长程任务打造
Z.AI推出GLM-5.2,这是一款专为长程任务设计的旗舰模型,拥有稳定的100万token上下文、改进的编码能力以及MIT开源许可证,在与Opus 4.8和GPT-5.5等领先模型的对比中展现了竞争力。