glm-5-2

标签

Cards List
#glm-5-2

在4台GB10上运行GLM 5.2,配备100G交换机,330k上下文,~25 tok/s解码,~650 tok/s预填充

Reddit r/LocalLLaMA · 2026-07-08

本文详细介绍了在4台GB10的配置上,使用100G交换机运行GLM 5.2,在330k上下文下实现约25 tok/s解码和约650 tok/s预填充。内容包括硬件成本、使用Depth Prefill的性能基准测试,以及关于为更长上下文进行模型剪枝的说明。

0 人收藏 0 人点赞
#glm-5-2

@theo:GLM 5.2 是一个令人难以置信的模型。我希望人们不要再假装它可以自托管,并且可以与 Fable 相提并论。

X AI KOLs Timeline · 2026-07-07 缓存

Theo 称赞 GLM 5.2 是一个令人难以置信的模型,但批评了认为它可以自托管且与 Fable 相提并论的看法,引发了关于模型可访问性的讨论。

0 人收藏 0 人点赞
#glm-5-2

GLM 5.2 与即将到来的人工智能利润率崩塌

Lobsters Hottest · 2026-07-06 缓存

来自Z.ai的GLM 5.2作为一款强大的开源权重模型,与Opus、GPT等前沿模型竞争,但真正的故事是随着成本降低和竞争加剧,人工智能推理领域即将到来的利润率崩塌。

0 人收藏 0 人点赞
#glm-5-2

@TheAhmadOsman:腾讯Hy3 请密切关注两个月前发布的预览版相比的改进,以及它如何……

X AI KOLs Following · 2026-07-06 缓存

Ahmad Osman 强调了腾讯Hy3相对于预览版的改进,并将其与体积大两倍的GLM 5.2进行了比较,同时分享了一个关于在RTX 5090上运行类似智能的预测。

0 人收藏 0 人点赞
#glm-5-2

GLM 5.2 FP8 with FP8 KV - Terminal-Bench 2.1 = 79.8 (有一个超时未重新运行)

Reddit r/LocalLLaMA · 2026-07-05

在 H200 上测试 GLM 5.2 的 FP8 量化及 FP8 KV 缓存,在 Terminal-Bench 2.1 上得到 79.8% 的分数,有一个超时未重新运行。

0 人收藏 0 人点赞
#glm-5-2

China Just POPPED The US AI Bubble! (90% Cheaper)

Reddit r/ArtificialInteligence · 2026-07-04 缓存

中国开源模型GLM 5.2以低成本达到与美国顶尖AI模型相当的性能,正在冲击美国AI公司的高价垄断模式,导致硅谷AI泡沫面临破裂风险。

0 人收藏 0 人点赞
#glm-5-2

@wafer_ai: 突发:这些工程师成功在 @AMD MI355X 上以每节点 2626 tok/s 和单流 213 tok/s 的速度运行 GLM 5.2

X AI KOLs Timeline · 2026-07-03 缓存

工程师成功在 AMD MI355X 上部署 GLM 5.2,达到每节点 2626 tok/s 和单流 213 tok/s 的性能,相当于 B200 吞吐量的约 80%,而成本不到 Blackwell 的一半。

0 人收藏 0 人点赞
#glm-5-2

@TheAhmadOsman: 预测

X AI KOLs Timeline · 2026-07-03 缓存

Ahmad Osman 预测,在18个月内,像 RTX 5090 这样的GPU将能够承载相当于 GLM 5.2 的智能。

0 人收藏 0 人点赞
#glm-5-2

GLM 5.2 真的很棒!

Reddit r/LocalLLaMA · 2026-07-03

GLM 5.2 在与RAG结合用于圣经学习时,展现了连接经文主题和引用的出色能力,在提供更深层见解方面优于其他模型。

0 人收藏 0 人点赞
#glm-5-2

@zRdianjiao:GLM-5.2 现在可以通过 Hugging Face Inference Providers 和 hf-claude 在 Claude Code 中选择使用。开源模型正变得越来…

X AI KOLs Following · 2026-07-03 缓存

GLM-5.2 现在可以通过 Hugging Face Inference Providers 和 hf-claude 在 Claude Code 中选择使用,使得将开源模型集成到开发者工作流中变得更加容易。

0 人收藏 0 人点赞
#glm-5-2

Z.ai 推出 ZCode,挑战 Cursor、Claude Code 和 GitHub Copilot 的 AI 编程工具

Reddit r/LocalLLaMA · 2026-07-02 缓存

Z.ai 推出 ZCode,这是为其 GLM-5.2 模型打造的代理式开发环境,凭借深度集成、多设备支持和有竞争力的定价,挑战现有的 AI 编程工具。

0 人收藏 0 人点赞
#glm-5-2

@alvarobartt: GLM 5.2,开放前沿规模的人工智能,在 Microsoft Foundry 上使用 AMD MI300X。使用开放模型运行 Codex 目标…

X AI KOLs Following · 2026-07-01 缓存

GLM 5.2,一个开放前沿规模的 AI 模型,现已可在 Microsoft Foundry 上使用 AMD MI300X 硬件,从而实现高效的 Codex 目标执行。

0 人收藏 0 人点赞
#glm-5-2

使用GLM-5.2数日后的几点真实感受

Reddit r/AI_Agents · 2026-07-01

一位用户分享了对GLM-5.2模型的正面印象,指出其相比Deepseek性能出色且成本效益更高,并反思了AI代理在编程和学习中的教育价值及其局限性。

0 人收藏 0 人点赞
#glm-5-2

GLM 5.2 为我构建了一个端到端可运行的 CV 应用。分享结果。

Reddit r/ArtificialInteligence · 2026-06-30

GLM 5.2 展示了其端到端构建可运行 CV(简历)应用的能力,展现了 AI 辅助开发的成果。

0 人收藏 0 人点赞
#glm-5-2

GLM 5.2 真的达到生产级了吗?通过实际的多文件计算机视觉实现任务进行测试

Reddit r/LocalLLaMA · 2026-06-30

本文通过在一个复杂的多文件计算机视觉实现任务上测试,评估 GLM 5.2 是否适合生产环境使用。

0 人收藏 0 人点赞
#glm-5-2

@FinanceYF5: 据说,zAI 的“某个新模型”在网络安全相关能力上至少和 Fable 5 一样强。 Chubby做了一些研究,但只找到一篇《华尔街日报》的文章。 不过那篇文章并没有提到一个全新的模型,而是把 GLM 5.2 作为近期发布的相对较新的模型来…

X AI KOLs Following · 2026-06-29 缓存

据传闻,zAI 的某个新模型在网络安全能力上至少与 Fable 5 一样强,但信息有限,仅引用了讨论 GLM 5.2 的华尔街日报文章。

0 人收藏 0 人点赞
#glm-5-2

我们自家也有Mythos:GLM 5.2在网络基准测试中击败Claude

Lobsters Hottest · 2026-06-28 缓存

智谱AI的开权重模型GLM 5.2在IDOR检测基准测试中以远低于Claude Code的成本击败了它,尽管仍落后于Semgrep专门构建的多模态管道。文章探讨了漏洞检测性能有多少来自模型本身,又有多少来自其周围的工具链。

0 人收藏 0 人点赞
#glm-5-2

@lmsysorg:NVIDIA 刚刚发布了来自 @Zai_org 的 GLM-5.2 的 NVFP4 检查点,这是一个用于推理和编码的 744B MoE(40B 激活)模型。Day-…

X AI KOLs Following · 2026-06-26 缓存

NVIDIA 发布了 GLM-5.2 的 NVFP4 量化检查点,这是一个 744B MoE 模型(40B 激活),针对推理和编码进行了优化,并在 SGLang 中提供 Day-0 支持。

0 人收藏 0 人点赞
#glm-5-2

@TheAhmadOsman:感谢GLM 5.2,我确切知道企业正在脱离云,获取算力,并致力于为…

X AI KOLs Following · 2026-06-26 缓存

一条推文讨论了GLM 5.2如何揭示企业向本地计算和后训练模型发展的趋势,以及对开源AI未来的不同看法。

0 人收藏 0 人点赞
#glm-5-2

@lqiao: https://x.com/lqiao/status/2070026145895256314

X AI KOLs Following · 2026-06-25 缓存

Fireworks 正在提供一种针对 GLM 5.2 的强化学习训练的托管服务,该服务通过批次不变性和零 KLD 对齐确保训练和推理之间的数值一致性,以前只有顶尖前沿实验室才能使用。这使得任何人都可以定制并超越前沿质量。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈